DeepSeek Harness 入门指南:一切皆插件的 Agent 到底怎么用
DeepSeek 开源首个 Agent 产品 DeepSeek Harness,模型、工具、会话乃至 Agent 循环全部做成可热插拔插件,并用一篇 88 页论文的数学证明保证运行时装卸安全。本文从安装、第一个任务到 Agent 预设、插件系统架构全流程实测讲解。
ARCHIVE / INDEX
按时间与主题浏览长期积累的技术文章。
DeepSeek 开源首个 Agent 产品 DeepSeek Harness,模型、工具、会话乃至 Agent 循环全部做成可热插拔插件,并用一篇 88 页论文的数学证明保证运行时装卸安全。本文从安装、第一个任务到 Agent 预设、插件系统架构全流程实测讲解。
Claude Code 团队 Thariq 的 Fable 5 实战指南:瓶颈不再是模型能力,而是你能否讲清自己的未知。本文拆解四种未知类型,给出盲点扫描、原型头脑风暴、反向面试、实现笔记等消除未知的具体方法,并整理社区最新玩法。
Claude Code 官方把 loop 分成四层:交出验证步骤、停止条件、触发时机和整个决策流程,分别对应 Skill、/goal、/loop 与 /schedule 以及 Proactive 流水线,并给出控制 token 消耗的实操建议。
OpenAI 27 页 Codex 白皮书解读:用持久会话线程、语音输入、实时插话、记忆库、连接器、手机远程操控、线程自动化和可验收的目标,把 Codex 组织成一个长时间不断线的 AI Agent 工作台,并附三个可直接复用的实战循环。
Loop Engineering 火了,但它到底是什么?本文梳理从 ReAct、Ralph loop 到 Codex /goal 的演进,讲清它与定时任务的区别、独立验证为何是关键,以及上 loop 前你必须想清楚的那个朴素问题:能不能把「做完了」写清楚。
烧掉 20 多亿 token 后总结的 Codex 桌面客户端实战指南:从给足上下文、验证优先、批量操作审查门,到 Side Panel 边看边改、文件记忆、远程接管、定时自动化,10 条经验帮你把 Codex 用成一个通用 Agent 而不只是编程工具。
Claude Code 现在能针对具体任务自己写调度脚本,实时生成动态工作流。本文编译自 Anthropic 官方博客,讲清分类路由、扇出合并、对抗验证、锦标赛等六种调度模式,以及大规模重构、深度验证、根因分析等实战场景,还有什么时候完全不需要动用工作流。
OpenAI 发布 Codex Mobile 预览版,让 ChatGPT 手机端远程接管本地 Codex 桌面客户端。本文详解连接配置流程,并对比 Claude Code Remote Control 的架构与用量差异,聊聊移动端异步编程的真正价值。
Claude Code 新增 /goal 命令,靠一个独立小模型评估任务是否真的完成,从而实现无人值守跑长任务。本文详细拆解它的实现原理和 Stop hook 机制,并与 Ralph Loop、Codex /goal 做对比,附具体使用技巧和踩坑经验。
Codex 新增的 /goal 命令搭配 GPT-5.5,让长时任务第一次变得丝滑可托付。本文解析 /goal 状态持久化、权限控制、自审注入的三层设计,对比 Ralph loop 的痛点,并分享适合跑 Goal 的任务类型与工作流。