OpenAI Codex 是什么:从代码补全到会执行任务的编程 Agent
Codex 可以进入真实项目,读文件、改代码、运行命令并检查结果。用好它的关键是给出边界清楚、可以验证的任务。
目录
Codex 可以进入真实项目,读文件、改代码、运行命令并检查结果。用好它的关键是给出边界清楚、可以验证的任务。
判断一个系统是否称得上 Agent,可以看它有没有真实的工具调用、任务状态和明确的停止条件。
RAG 接进 Agent 后,检索会变成一个反复补证据的过程。切块、过滤、引用和拒答都要落到具体规则上。
Agent 调工具并不难,难的是把参数、权限、重试和日志做成一套不会失控的接口。
Agent 记忆最难的部分不在存储。先决定哪些话值得留下,以及以后凭什么把它取出来。
测 Agent 不能只看最后那段回答。工具调用路径、证据、越权风险、耗时和成本都得留下记录。