上下文工程:为什么你的 AI Agent 总是“断片”?
AI Agent 处理复杂任务时为什么总是断片健忘?本文结合 Chroma 上下文腐烂实验和 Manus、Anthropic、Cursor 等团队的实战经验,用管理计算机内存的思路讲清上下文工程的缓存、压缩与筛选方法。
ARCHIVE / INDEX
按时间与主题浏览长期积累的技术文章。
AI Agent 处理复杂任务时为什么总是断片健忘?本文结合 Chroma 上下文腐烂实验和 Manus、Anthropic、Cursor 等团队的实战经验,用管理计算机内存的思路讲清上下文工程的缓存、压缩与筛选方法。
Anthropic 工程团队发现让 Agent 写代码调用工具,可把上千工具带来的上下文爆炸从 15 万 token 降到 2 千,效率提升 98.7%,本文解析这一被称为 Code Mode 的新范式如何顺带解决 PII 脱敏、状态持久化与技能复用。
解读上海交大 28 页论文《Context Engineering 2.0》,从熵减这一全新视角阐释上下文工程的本质是弥合人机认知差距,回溯二十年发展历程,说明写 Prompt、调 RAG、设计 Agent 其实都在帮机器理解人的意图。
Google Gemini 借助 Canvas 模式支持一句话自动生成 PPT,上传网络文章或学术论文即可提取要点生成幻灯片并导出到 Google Slides,本文实测其效果、风格与图表不能自动嵌入等使用细节。
解析 Anthropic 推出的 Claude Skills,讲清 SKILL.md、参考文档与可执行代码的组成,以及渐进式披露如何省 Token,并演示在 Claude 应用、API 和 Claude Code 中的用法。
Karpathy 开源 nanochat,用约 8000 行代码复刻完整的 ChatGPT 全栈流程,涵盖分词器、预训练、微调、推理到 WebUI,租 8 卡 H100 训练 4 小时、成本约 100 美元就能得到一个可读可 hack 的对话模型。
开源我的 OpenAI Codex CLI 配置,支持 ChatGPT、GitHub Copilot、DeepSeek、Ollama 等多种模型提供商,默认用 LiteLLM 网关统一接入,并迁移了 Kiro 工作流和 GitHub Spec Kit 两套完整开发流程,克隆即用。
开源项目 MCP AI Hub 通过 LiteLLM 把 Claude Code、Codex 等 Agent 工具一键接入 100+ AI 模型,只需在配置文件里填好 API Key,就能在同一工具里自由切换 OpenAI、Anthropic、Google 各家模型,本文分享项目由来与使用方法。
介绍 Claude Code Plugin 如何把自定义命令、SubAgent、Hooks 和 MCP 服务打包共享,讲解插件清单的写法、插件市场的用法,以及实际使用中踩过的坑和建议。
介绍 GitHub 拥有 27k 星标的 Spec Kit,它通过 Constitution、Specify、Plan、Tasks、Implement 等标准化步骤把规范驱动开发标准化,解决 AI 编程凭运气、代码偏离意图的 vibe-coding 危机。