上海交大 28 页论文:Context Engineering 2.0 的本质是“熵减”
解读上海交大 28 页论文《Context Engineering 2.0》,从熵减这一全新视角阐释上下文工程的本质是弥合人机认知差距,回溯二十年发展历程,说明写 Prompt、调 RAG、设计 Agent 其实都在帮机器理解人的意图。
ARCHIVE / INDEX
按时间与主题浏览长期积累的技术文章。
解读上海交大 28 页论文《Context Engineering 2.0》,从熵减这一全新视角阐释上下文工程的本质是弥合人机认知差距,回溯二十年发展历程,说明写 Prompt、调 RAG、设计 Agent 其实都在帮机器理解人的意图。
Karpathy 开源 nanochat,用约 8000 行代码复刻完整的 ChatGPT 全栈流程,涵盖分词器、预训练、微调、推理到 WebUI,租 8 卡 H100 训练 4 小时、成本约 100 美元就能得到一个可读可 hack 的对话模型。
分享 GPT-5 的提示词技巧,指出很多人沿用旧写法导致效果变差的常见误区,强调语调统一、格式一致、先规划再执行等原则,并给出提升输出质量的实用模板与新功能用法。
深度解析 OpenAI 时隔多年重返开源发布的 gpt-oss 系列模型,剖析其采用 Apache 2.0 许可、MoE 架构和原生 MXFP4 量化,让 120B 参数模型在单张 80GB GPU 上运行的技术创新与部署方法。