返回洞察
·5 分钟阅读

Agent 的 Tick-Tock

Agent 的演进在 Model 与 Harness 之间交替推进。真正需要跨越的,也许不是工具的学习成本,而是把智能真正委托出去的心理门槛。

AgentAI未来工作

最近尝试 Codex 和 Astra,让我看到 Agent 的下一次跃迁正在发生:更完整的工作空间与更强的模型,正推动它从辅助编程走向端到端的任务执行。

从协作编程到 Agent 原生工作流

Claude Code + Opus 4.5 的突破,是把能力强大的 Coding Agent 带进开发者原有的工作流。它运行在终端或 IDE 中,可以理解代码库、修改文件、执行命令,但基本交互模式仍然是人与 Agent 共同编程:人提出任务、批准操作、检查代码。

Codex 给我的感受则不同。它把编程、命令执行、运行环境和浏览器操作等能力组织进一个更完整的工作空间。开发者不再只是把 Agent 接入自己的工作流,而是开始进入一个以 Agent 为中心的工作流:定义任务、提供约束,然后让 Agent 更独立、更长时间、更端到端地完成它。

Model 与 Harness 的交替推进

这让我想到 Intel 曾经的 Tick-Tock 模式:制程与架构交替升级,一侧率先突破,另一侧随后跟上。Agent 的发展似乎也遵循着类似的节奏,只不过交替推进的是 Model 与 Harness。

Model 决定 Agent 能力的上限,Harness 则决定这些能力能否真正作用于现实任务。

Claude Code 首先带来了 Harness 层面的创新;Opus 4.5 提供了与之匹配的模型能力,推动 Coding Agent 真正起飞。之后,OpenClaw 和 Hermes 等项目继续探索更自主、更端到端的 Harness,但模型能力尚未完全跟上。现在,Astra 补上了这一侧的能力,也让 Codex 这类更完整的 Agent 环境开始显示出真正的力量。

从 Coding 走向 Work

从用户侧看,Agent 正在从 Coding 走向更广泛的 Work。这个过程最大的门槛,我认为已经不再是学习成本。

工具本身正变得越来越简单,模型也在不断吸收原本由用户承担的交互复杂度。许多过去需要反复钻研的 Prompt Engineering 技巧,正在随着模型能力增强而逐渐失去重要性。

真正难以跨越的,是认知成本:我们是否愿意改变自己控制工作的方式?

在 Claude Code 中,我们仍习惯于逐条批准命令、检查代码,把 Agent 放在“辅助编程”的位置。但面对 Codex 这样的 Agent 原生工作空间,我们是否已经准备好不再介入每一个步骤,甚至在某些任务中完全不看代码,而是把任务交给 Agent 长时间独立处理?Claude Code 最近的演进,也在逐渐靠近这个方向。

专业 Ego 的另一道门槛

更深一层的挑战,来自我们的专业 Ego。

当 Agent 只是一个 Coder 时,人仍然负责设计方案,Agent 只是负责实现。但我们是否愿意只定义问题,把整个解决方案也交给 Agent?是否愿意认真面对这样一种可能:它不仅可以是顶级的 Coder,也可能在架构层面提出比我们自己更好的方案?

Model 与 Harness 的 Tick-Tock 仍在继续。但对用户而言,下一道真正的门槛,或许已经不是学会使用一个更强的工具,而是完成从“使用工具”到“委托智能”的认知转变。

在做决定前,看到所有可能的结局。

立即体验