高级实践
主代理 + Luna / DeepSeek 子代理
复杂项目可以让 gpt-5.6-sol 或 gpt-5.6-terra 主代理负责整体方案、关键取舍和最终整合,把简单且边界清晰的局部任务交给 gpt-5.6-luna 或 deepseek-v4-flash 子代理。
| 角色 | 推荐工作 |
|---|---|
| Sol / Terra 主代理 | 整体目标理解、跨模块方案、关键设计、整合、最终审查 |
| Luna 子代理 | 检索、单模块修改、补测试、独立排障、整理文档 |
| DeepSeek Flash 子代理 | 简单脚本、资料整理、边界明确的局部实现和重复性工作 |
| Auto Review | 代码审查、回归风险和修改检查 |
deepseek-v4-pro 目前已支持 Agent;用于子代理时以客户端可选模型及工具配置为准。gpt-6-astra 和 deepseek-v4-flash-vision-exp 已加入模型列表,可点击 “从上游获取模型” 更新后选择。新增模型的推理档位和费用不要直接沿用 Luna / Flash 的示例。
子代理配置示例
Luna Agent:~/.codex/agents/luna-worker.toml
DeepSeek Flash Agent:~/.codex/agents/deepseek-worker.toml
当前模型元数据中,Luna 支持到 max,DeepSeek Flash 支持到 xhigh。如果以后客户端可选档位发生变化,以客户端实际显示的最高可用档位为准,不要手写客户端不接受的值。
可以直接让 Codex 创建并检查配置:
为简单、边界清晰且可独立完成的任务创建两个子代理:
1. luna_worker 使用 gpt-5.6-luna,推理档位 max;
2. deepseek_worker 使用 deepseek-v4-flash,推理档位 xhigh。
保留现有其他配置,完成后展示 diff 并检查格式有效性。
如果当前客户端显示的最高档位不同,使用实际最高可用档位并明确说明。
并发控制
每位成员的总并发上限为 5。同一账号的所有 Key、主代理和子代理共享这 5 个槽位。
- 主代理仍在执行时,最多同时运行 4 个子代理请求;
- 通常先启动 2 至 3 个子代理,确认任务确实独立后再增加;
- 不要把多个子代理安排去修改同一文件或处理相互依赖的步骤;
- 子任务完成后由主代理统一检查、测试和整合。
比较完成同一任务的实际花费
目标是在保证结果质量的前提下降低整体费用。让 Sol / Terra 负责方案和关键决策,把简单子任务交给 Luna / DeepSeek Flash。即使子代理增加了 token 用量,只要完成同一任务的实际总花费更低,仍然是有效的优化。当前价格以模型广场为准。
大项目的上下文与额度
以下是原有模型的配置说明;新增模型应先检查各自的上下文配置和计费规则,不直接套用这些数值。
Codex 模型目录的默认上下文配置为 272K;默认按 95% 使用,实际有效约 258.4K。大型代码库或长会话可通过 model_context_window = 372000 手工覆盖为 372K。当输入超过 272K 时,成本会升高,具体见模型广场。
预计项目会超过当前周额度时,应提前使用本人学邮联系 ynumerics_admin@163.com。管理员可在总额度充足时重置周额度,或为计划明确的大项目分配有上限和有效期的临时更大额度。