Codex、Claude Code、MiniMax Code、DeepSeek Harness 默认工作流对比:按常见入口理解差异

同一句“帮我修好这个登录问题”,放进四种编码 Agent,开始工作的方式并不一样。有的先选项目和运行环境,有的从当前终端目录读取仓库,有的先附加本地工作区,还有的要先启动 Harness、配置模型并选择 workspace。
我想比较的不是模型谁更聪明,也不是哪一个能少写几行代码。我更关心一项任务从哪里开始、Agent 怎么拿到项目上下文、执行过程中如何请求权限,以及最后怎样把结果交还给人。
本文比较的是几种常见入口:Codex 桌面应用/CLI、Claude Code CLI、MiniMax Code 桌面应用、DeepSeek Harness Web UI。这里的“常见工作流”不是四款产品共用的固定默认值;产品版本、入口、仓库配置和权限设置都会改变实际行为。以下内容依据截至 2026 年 9 月 30 日可读取的官方产品文档整理,没有声称我在同一代码库里完成过四款工具的对照实测。

先把比较边界说清楚

Codex 有桌面应用、CLI 和 IDE 等入口;Claude Code 以终端交互为代表,也有其他运行方式;MiniMax Code 是桌面 Agent 应用;DeepSeek Harness 则是可配置的 Agent 运行框架,也提供 Web UI 和预览形态。它们不是四个只换了颜色的聊天框。
为了让比较有用,我把路径统一成五个问题:
  1. 从哪里发起一项任务?
  1. 项目文件和规则怎样进入上下文?
  1. Agent 如何规划、调用工具并迭代?
  1. 哪些动作会停下来等待确认?
  1. 我如何看到改动并决定是否接受?
产品入口
常见起点
上下文从哪里来
执行循环的特点
人主要检查什么
Codex 桌面/CLI
桌面:选择项目并开任务;CLI:在项目目录启动会话
选定的仓库、当前或独立工作树、项目说明与附件
计划、编辑、运行工具、观察结果、修复,再重复
运行结果、差异、权限请求与是否达到验收条件
Claude Code
在项目目录启动 claude 并描述目标
当前目录、仓库说明和会话配置
定位代码、理解上下文、实现变更、按需要运行测试
文件改动、终端动作和 permission mode 下的请求
MiniMax Code 桌面
附加本地工作区后,从任务输入框描述目标
已附加的本地项目、会话内容和项目规则
用文件、终端、浏览器预览逐步实现与调试
Changes/diff、命令结果、预览及当前权限策略下的确认
DeepSeek Harness Web UI
启动 Web UI、配置模型并选 workspace(项目目录)后发起 session
启动目录、明确选择的 workspace、所启用 profile/plugins(工具组合)
由所选 Harness profile 提供读写、shell、搜索、计划和可选子 Agent
当前权限策略、所用插件与工作流版本、文件和命令结果

Codex:把项目、任务和执行环境一起组织起来

在 Codex 的常见桌面使用路径里,我先选择项目和执行环境,再给一项任务和它的验收条件。如果改动需要隔离,我可以为线程使用 Git worktree;如果只是快速查看,也可以继续在本地工作区处理。Plan mode 可以先生成可审阅的步骤,再进入修改。
一个较长的 Codex 任务通常会经历:理解仓库、形成计划、编辑代码、运行检查、观察日志、修复问题,再汇报状态。它强调的是可以持续推进的任务循环,而不是只生成一份代码建议。CLI 与 IDE 上能用哪些环境和权限,由相应配置决定;例如 Codex 配置文档给出 workspace-write 和 on-request 作为常见配置值,但我不会把它们概括成每个 Codex 表面的强制默认值。
我会在完成后看文件差异和验证记录。如果改动跨文件或需要并行处理,worktree 能让代码状态更清楚;代价是要选对基线和工作区,不能把“启动了新线程”误当成“自动隔离了一切”。
这条路径的特点:任务和运行上下文结合较紧,计划、终端反馈与变更审查构成连续循环。对我来说,任务描述中的“完成标准”以及最后的差异检查尤其重要。

Claude Code:从当前项目目录进入终端 Agent 循环

Claude Code 的入门流程更像在项目目录打开一个 Agent 终端:运行 claude,说明希望达成的结果,让它定位相关代码、理解上下文、实现修改,并在适当时运行测试。继续一个工作时,可以恢复当前目录最近的会话或通过会话标识重新打开。
权限行为不宜用一句“默认全部自动”或“每步都要批准”概括。当前官方 Quickstart 对 Claude Code v2.1.283 及以上的交互式终端会话说明:内置起始权限模式是 Auto mode,由分类器审核动作,大多数文件编辑和命令可以不逐项询问;更早版本在 Pro、Max、Team 方案中才以内置 Auto mode 起始。用户设置或组织策略可以改掉起始模式。Auto mode 也不等于 acceptEdits,不同权限模式的审核方式并不相同。
它的工作节奏通常是对话与终端动作交替:我给目标,Agent 查看文件或运行命令,返回结果,再根据反馈继续。需要先对齐方案时,我可以切换到 Plan mode;任务结束时,可以让它解释改动或检查已有 diff,再由我决定是否提交。
这条路径的特点:终端和会话是主要工作台,适合已经在仓库里、习惯用自然语言驱动本地开发工具的工作方式。项目级 CLAUDE.md、允许目录和权限规则会明显影响实际体验。

MiniMax Code:围绕桌面工作区组织实现与复核

MiniMax Code 从桌面首页的 composer 开始。我可以附加一个本地项目,选择 Coding mode,再说明目标;之后 Agent 在同一工作区里读项目、编辑文件、运行终端命令,并用内置浏览器预览页面。
这条路把对话、文件变化、终端和预览放在同一个任务空间。复杂任务可以选择 Agent Team 来分解与并行推进,但它是扩展能力,不代表每个普通任务一开始就会自动拆成多 Agent。官方权限文档列出的可能需要批准的动作包括读取工作区外的文件、编辑或删除文件、运行命令和产生外部副作用的工具;是否弹出确认取决于当前权限策略。我仍会检查 Changes 面板、运行结果和浏览器行为,再判断这次改动是否完整。
这条路径的特点:桌面工作区同时承载项目上下文、执行工具和成果检查。对视觉页面或需要频繁预览的任务,文件与浏览器反馈在一个界面里比较直观;复核时仍要回到实际差异和测试结果。

DeepSeek Harness:先确定运行配置,再让 Agent 开始工作

DeepSeek Harness 的流程多了“运行时配置”这一层。当前官方 Web UI 快速入门要求先启动服务,在 Settings → Models 配置模型,再通过 Choose workspace 加入项目目录。选好 workspace 后,session composer 才能开始接收任务。
Harness 能做什么,取决于当前启用的 profile 和插件;profile 可以理解成一组运行规则与工具组合。Web UI 会依据正在使用的权限策略,对需要批准的操作提出确认。因为它允许替换运行组合,我会记录所选 profile、插件和权限策略;同一个 Harness 名称不保证始终对应完全相同的工具集合。
这和直接启动一个相对固定的产品界面不完全相同:Harness 把模型、工具、会话、沙箱、工作循环和 UI 拆成可组合部件。灵活性意味着我需要在复现问题时记录选了哪个 profile、启用了哪些插件、权限策略是什么。官方 README 当前仍标注 Developer Preview,并提醒会有兼容性变化。
这条路径的特点:先配置 Agent 如何运行,再配置它在什么 workspace 工作。它适合希望理解或调整 Harness 组成的人;如果只想尽快完成一个小修复,初次配置也可能多出几步。

真正影响体验的是五个交接点

我把四种流程放在一起后,发现选择工具时最值得比较的不是宣传里的“全流程”,而是五个具体交接点:
交接点
我会问的问题
项目上下文
我是否清楚 Agent 正在读哪个目录、哪些项目说明会生效?
任务状态
长任务能否看到计划、已完成步骤和待解决问题?
执行环境
文件改动、终端、浏览器或 worktree 是怎样关联起来的?
权限确认
哪些动作会等待我,配置是否会改变这个边界?
验收证据
我能否看到真实 diff、运行结果和失败后的恢复路径?
如果我想把四款工具做成一次有参考价值的小实验,我会使用同一个可丢弃分支、同一份任务说明和同一套验收标准。记录首次得到有效结果的时间、澄清次数、越界改动、验证结果、恢复成本,而不只比较最终回答看起来是否流畅。模型、账户、版本与设置也要记下来,不然观察结果很难复现。

我会给四种工具同一张任务卡

我会让每个 Agent 在各自的干净副本中处理,然后审查 diff 和检查结果。若某一款需要先安装、附加工作区或启用插件,这些准备时间也属于实际工作流的一部分,可以另外记录。

我的结论:选一条适合自己复核的循环

Codex 把任务线程、运行环境和差异审查连成一条持续执行路径;Claude Code 从当前项目目录和终端会话切入;MiniMax Code 把项目、文件、命令与预览放进桌面工作区;DeepSeek Harness 让人先配置模型、workspace 和可组合运行能力。
我不会把某一条路径称为普遍最佳。对于短任务,启动成本和项目上下文最关键;对于持续开发,状态可追溯、权限边界和恢复能力可能更重要。选工具时,我会先看自己能否清楚回答:它现在用的是什么代码、接下来会运行什么、哪些动作需要我确认,以及我凭什么认定工作已经完成。
AI Agent 把执行带进了开发流程,但“完成”仍需要可见证据。对我而言,一条可靠的工作流不是少一个按钮,而是让输入、执行、检查和交接都能看得见。

参考资料

资料核对日期:2026-09-30。Codex 各入口、Claude Code 权限配置和 DeepSeek Harness profile/plugin 组合会影响实际行为;本文比较公开使用路径,不是统一环境的性能或代码质量测试。
Loading...