AI 工具使用指南正在从聊天转向智能体

Simon Willison11 小时前

过去一年,AI 工具的使用重点发生了明显变化。

一年前,主流讨论仍主要围绕聊天式 AI:ChatGPT、Claude、Gemini,以及 o3、Claude 4 Opus、Gemini 2.5 Pro 等模型;Deep Research 则被视为一种有用的替代模式。

现在,焦点正在转向更具“智能体”特征的系统:AI 不只是回答问题,而是能够一次性完成相当于人类数小时工作的任务。

从聊天模型到智能体系统

新的使用指南更强调让 AI 执行复杂任务,而不是单轮对话。这里的关键变化是:AI 可以获得某种“计算机使用能力”,从而执行更长链条的操作。

在 ChatGPT 和 Claude 中,这类模式的命名并不直观:

  • 在 ChatGPT 中,相关模式包括 WorkCodex
  • 在 Claude 中,相关模式包括 CoworkCode

这些名称之间并没有清晰的一一对应关系,而且同名模式在不同设备或环境中可能能力不同,这会让用户理解起来更加困难。

给 AI 一台“电脑”使用

一种重要用法是让 AI 使用由 AI 公司提供的计算环境。按照相关说明:

  • 在 ChatGPT 中,对应模式叫 ChatGPT Work
  • 在 Claude 中,对应模式叫 Cowork

更进一步的方式,是让 AI 访问用户自己的电脑。用户需要下载 ChatGPT 或 Claude 的桌面应用,并选择相应模式。由于桌面应用可以访问本机环境,这些模式通常具备更多能力。

命名混乱带来的问题

ChatGPT 的 Work 模式在移动端和桌面端表现并不完全一致。

一个值得注意的差异是:在移动端,如果把 ChatGPT 从 Chat 切换到 Work,会得到一个 Code Interpreter 容器不再受限于无法访问互联网的版本。

而在桌面应用中,ChatGPT Work 更像是 Codex 之上的一个更易上手的界面。这种差异对于普通用户来说并不直观。

Gemini 的位置变化

在这份新的使用判断中,Gemini 不再是核心推荐对象之一。原因是 Google 目前还没有一个已经被验证、能够稳定对应 Codex、ChatGPT Work 或 Claude Cowork 这一类用途的产品。

Gemini Spark 仍有待证明其能力。

观察

这反映了 AI 工具竞争重心的变化:

  • 过去比拼的是聊天质量、模型能力和推理表现;
  • 现在更重要的是,AI 能否在真实工作流中连续执行任务;
  • 产品形态也从“问答窗口”转向“可操作环境”。

对用户来说,新的挑战不只是选择哪个模型,而是理解不同平台、不同模式、不同设备下的能力差异。

评论

请登录后发表观点

暂无数据