用 AI 审核 AI 的代码,踩了一堆坑之后我的方法
AI 生成的代码量越来越大,人工审查早已跟不上节奏。作者分享一套用 AI 审 AI 代码的实战方法:质量门控打底、给 Agent 完整代码库上下文、真实环境验证、对抗式审查测试、安全扫描以及本地环境信息清理,兼顾审查效率与可靠性,避免被 AI 的完美推理链带偏。
ARCHIVE / INDEX
按时间与主题浏览长期积累的技术文章。
AI 生成的代码量越来越大,人工审查早已跟不上节奏。作者分享一套用 AI 审 AI 代码的实战方法:质量门控打底、给 Agent 完整代码库上下文、真实环境验证、对抗式审查测试、安全扫描以及本地环境信息清理,兼顾审查效率与可靠性,避免被 AI 的完美推理链带偏。
用了一年多 Claude Code 后,作者被 TUI 的刷屏和消息审查体验逼到极限,转而使用多 Agent 控制台 Paseo。它不重造 Harness,原生兼容 Claude Code、Codex 等主流 Agent,支持跨设备远程操控和多 Agent 跨 Provider 协作。
OpenAI 27 页 Codex 白皮书解读:用持久会话线程、语音输入、实时插话、记忆库、连接器、手机远程操控、线程自动化和可验收的目标,把 Codex 组织成一个长时间不断线的 AI Agent 工作台,并附三个可直接复用的实战循环。
Loop Engineering 火了,但它到底是什么?本文梳理从 ReAct、Ralph loop 到 Codex /goal 的演进,讲清它与定时任务的区别、独立验证为何是关键,以及上 loop 前你必须想清楚的那个朴素问题:能不能把「做完了」写清楚。
烧掉 20 多亿 token 后总结的 Codex 桌面客户端实战指南:从给足上下文、验证优先、批量操作审查门,到 Side Panel 边看边改、文件记忆、远程接管、定时自动化,10 条经验帮你把 Codex 用成一个通用 Agent 而不只是编程工具。
OpenAI 发布 Codex Mobile 预览版,让 ChatGPT 手机端远程接管本地 Codex 桌面客户端。本文详解连接配置流程,并对比 Claude Code Remote Control 的架构与用量差异,聊聊移动端异步编程的真正价值。
Claude Code 新增 /goal 命令,靠一个独立小模型评估任务是否真的完成,从而实现无人值守跑长任务。本文详细拆解它的实现原理和 Stop hook 机制,并与 Ralph Loop、Codex /goal 做对比,附具体使用技巧和踩坑经验。
Codex 新增的 /goal 命令搭配 GPT-5.5,让长时任务第一次变得丝滑可托付。本文解析 /goal 状态持久化、权限控制、自审注入的三层设计,对比 Ralph loop 的痛点,并分享适合跑 Goal 的任务类型与工作流。
从微软 Recall 到 OpenAI Codex 的 Chronicle,AI 为何执着于持续截取你的屏幕?本文对比 Chronicle 的读屏记忆与 Claude Code 的 Auto Memory 两条路线,剖析上下文争夺战背后的隐私风险与产品逻辑。
本文编译自 OpenAI 工程博客,深入讲解 Codex CLI 的 Agent Loop 实现细节,包括 Prompt 构建、模型推理、工具调用、上下文管理和性能优化。