跳转至

高级实践

主代理 + Luna / DeepSeek 子代理

复杂项目可以让 gpt-5.6-sol 或 gpt-5.6-terra 主代理负责整体方案、关键取舍和最终整合,把简单且边界清晰的局部任务交给 gpt-5.6-luna 或 deepseek-v4-flash 子代理。

角色 推荐工作
Sol / Terra 主代理 整体目标理解、跨模块方案、关键设计、整合、最终审查
Luna 子代理 检索、单模块修改、补测试、独立排障、整理文档
DeepSeek Flash 子代理 简单脚本、资料整理、边界明确的局部实现和重复性工作
Auto Review 代码审查、回归风险和修改检查

deepseek-v4-pro 目前已支持 Agent;用于子代理时以客户端可选模型及工具配置为准。gpt-6-astra 和 deepseek-v4-flash-vision-exp 已加入模型列表,可点击 “从上游获取模型” 更新后选择。新增模型的推理档位和费用不要直接沿用 Luna / Flash 的示例。

子代理配置示例

Luna Agent:~/.codex/agents/luna-worker.toml

model = "gpt-5.6-luna"
model_reasoning_effort = "max"

DeepSeek Flash Agent:~/.codex/agents/deepseek-worker.toml

model = "deepseek-v4-flash"
model_reasoning_effort = "xhigh"

当前模型元数据中,Luna 支持到 max,DeepSeek Flash 支持到 xhigh。如果以后客户端可选档位发生变化,以客户端实际显示的最高可用档位为准,不要手写客户端不接受的值。

可以直接让 Codex 创建并检查配置:

为简单、边界清晰且可独立完成的任务创建两个子代理:
1. luna_worker 使用 gpt-5.6-luna,推理档位 max;
2. deepseek_worker 使用 deepseek-v4-flash,推理档位 xhigh。
保留现有其他配置,完成后展示 diff 并检查格式有效性。
如果当前客户端显示的最高档位不同,使用实际最高可用档位并明确说明。

并发控制

每位成员的总并发上限为 5。同一账号的所有 Key、主代理和子代理共享这 5 个槽位。

  • 主代理仍在执行时,最多同时运行 4 个子代理请求;
  • 通常先启动 2 至 3 个子代理,确认任务确实独立后再增加;
  • 不要把多个子代理安排去修改同一文件或处理相互依赖的步骤;
  • 子任务完成后由主代理统一检查、测试和整合。

比较完成同一任务的实际花费

目标是在保证结果质量的前提下降低整体费用。让 Sol / Terra 负责方案和关键决策,把简单子任务交给 Luna / DeepSeek Flash。即使子代理增加了 token 用量,只要完成同一任务的实际总花费更低,仍然是有效的优化。当前价格以模型广场为准。

大项目的上下文与额度

以下是原有模型的配置说明;新增模型应先检查各自的上下文配置和计费规则,不直接套用这些数值。

Codex 模型目录的默认上下文配置为 272K;默认按 95% 使用,实际有效约 258.4K。大型代码库或长会话可通过 model_context_window = 372000 手工覆盖为 372K。当输入超过 272K 时,成本会升高,具体见模型广场。

预计项目会超过当前周额度时,应提前使用本人学邮联系 ynumerics_admin@163.com。管理员可在总额度充足时重置周额度,或为计划明确的大项目分配有上限和有效期的临时更大额度。