写好一个 Skill 有多难?Anthropic 踩了几百个坑之后的答案
Anthropic 内部有几百个 Skill 在日常使用,工程师 Thariq 把踩过的坑写成长文。本文梳理 9 类 Skill 分类,以及写好 Claude Code Skill 的关键原则:Gotchas、渐进式披露、description 触发词、按需 Hook 等。
ARCHIVE / INDEX
按时间与主题浏览长期积累的技术文章。
Anthropic 内部有几百个 Skill 在日常使用,工程师 Thariq 把踩过的坑写成长文。本文梳理 9 类 Skill 分类,以及写好 Claude Code Skill 的关键原则:Gotchas、渐进式披露、description 触发词、按需 Hook 等。
Anthropic 研究发现用 AI 学编程的人成绩反而低 17%。差距不在用不用 AI,而在怎么用。本文剖析答案机与老师两种使用模式,给出 AI 时代程序员保持成长与代码手感的实用建议。
Anthropic 分析 150 万次 Claude 对话,揭示 AI 让人失能的三种模式:现实扭曲、价值判断扭曲与行动扭曲。用户越满意风险反而越高,探讨 AI 如何悄悄削弱人的判断力与自主决策能力。
Anthropic 推出 Cowork,把 Claude Code 的 Agent 能力搬进 macOS 桌面应用,不懂命令行也能让 AI 帮你读写文件、整理资料。本文介绍 Cowork 的定位与典型场景、虚拟机沙箱隔离和权限设计,以及提示词注入等需要留意的使用风险。
本文编译自 Anthropic 工程博客,系统介绍 AI Agent 评估体系的构建方法,包括评估类型、评分器设计、不同类型 Agent 的评估策略以及从 0 到 1 的实操路线图。