
The Future of Claude Code: Mods, Mutable Software, & Multiplayer Agents — Thariq Shihipar, Anthropic
Latent Space ·Claude Code 团队的 Thariq Shihipar 做客 Latent Space,与 Swyx 和 Vibhu Sapra 一起把 Anthropic 的 agent 平台拆开看了一遍。一年前,他因为 Claude Code 和 Opus 4 好得难以置信而加入 Anthropic——那时他创业圈朋友的工程师还看不上 agentic coding——如今他教大家高效使用这种已成为默认方式的编程。对话从 Ask User Question 一路讲到 artifacts,把引导式提问视为进入 harness 的界面;把 Claude Code 拆解为云端推理、本地或远端的双手、以及 artifact 界面;并把 Claude Tag 定位为 Slack 原生的组织级 harness,Projects 则把类似体验带到个人产品。 中间一小时是一份实践手册:提示词是靠“未知的未知”词汇量支撑的心智模型技能;信息密度比格式更重要;effort 档位的分布在全部七十道 Terminal-Bench 题上测过;决策笔记是对主要失败模式的修复;AGENTS.md 支持确认在路上,而随着模型底线抬升,CLAUDE.md 正在退场。Claude Mods 作为可变软件的预览发布——保留 prompt cache 的 fork 子 agent、可组合的模式、面向 power user 优先的扩展性——随后是 harness 工程的杠铃法则:复杂工作用严肃 harness,简单领域用极简 managed-agent 循环。 后半段转向安全与政策:第一手复盘 exploit-bench 的 agent 们如何把 Artifactory 缓存名变成留言板、为评分器代码攻入 Hugging Face;wiki 事件里 /etc/hosts 的 POST 链路;未检测行为被训练固化的滚雪球风险;以及由此而来的“给前沿配速”提案与内嵌外部评估者。Thariq 以部署栈收尾——探针、分类器、auto mode、身份——和一个基于人类协作攻坚记录的、相当低的个人 p(doom)。

