AI 工具使用指南正在从聊天转向智能体
过去一年,AI 工具的使用重点发生了明显变化。
一年前,主流讨论仍主要围绕聊天式 AI:ChatGPT、Claude、Gemini,以及 o3、Claude 4 Opus、Gemini 2.5 Pro 等模型;Deep Research 则被视为一种有用的替代模式。
现在,焦点正在转向更具“智能体”特征的系统:AI 不只是回答问题,而是能够一次性完成相当于人类数小时工作的任务。
从聊天模型到智能体系统
新的使用指南更强调让 AI 执行复杂任务,而不是单轮对话。这里的关键变化是:AI 可以获得某种“计算机使用能力”,从而执行更长链条的操作。
在 ChatGPT 和 Claude 中,这类模式的命名并不直观:
- 在 ChatGPT 中,相关模式包括 Work 和 Codex。
- 在 Claude 中,相关模式包括 Cowork 和 Code。
这些名称之间并没有清晰的一一对应关系,而且同名模式在不同设备或环境中可能能力不同,这会让用户理解起来更加困难。
给 AI 一台“电脑”使用
一种重要用法是让 AI 使用由 AI 公司提供的计算环境。按照相关说明:
- 在 ChatGPT 中,对应模式叫 ChatGPT Work。
- 在 Claude 中,对应模式叫 Cowork。
更进一步的方式,是让 AI 访问用户自己的电脑。用户需要下载 ChatGPT 或 Claude 的桌面应用,并选择相应模式。由于桌面应用可以访问本机环境,这些模式通常具备更多能力。
命名混乱带来的问题
ChatGPT 的 Work 模式在移动端和桌面端表现并不完全一致。
一个值得注意的差异是:在移动端,如果把 ChatGPT 从 Chat 切换到 Work,会得到一个 Code Interpreter 容器不再受限于无法访问互联网的版本。
而在桌面应用中,ChatGPT Work 更像是 Codex 之上的一个更易上手的界面。这种差异对于普通用户来说并不直观。
Gemini 的位置变化
在这份新的使用判断中,Gemini 不再是核心推荐对象之一。原因是 Google 目前还没有一个已经被验证、能够稳定对应 Codex、ChatGPT Work 或 Claude Cowork 这一类用途的产品。
Gemini Spark 仍有待证明其能力。
观察
这反映了 AI 工具竞争重心的变化:
- 过去比拼的是聊天质量、模型能力和推理表现;
- 现在更重要的是,AI 能否在真实工作流中连续执行任务;
- 产品形态也从“问答窗口”转向“可操作环境”。
对用户来说,新的挑战不只是选择哪个模型,而是理解不同平台、不同模式、不同设备下的能力差异。
