AI 见闻
精选· 重要性 4/5

与Anthropic Claude Code团队炉边对话:AI编码代理如何改变工程实践

Simon Willison's Weblog··约 8 分钟阅读
中文导读

Anthropic Claude Code团队分享AI编码代理如何改变日常工作流程,包括Claude Tag自动处理65%产品PR、系统提示词缩减80%、以及从手动审查转向自动代码审查等关键洞察。

与Claude Code团队的Cat和Thariq进行炉边对话2026年7月21日本月早些时候,我在AI Engineer World's Fair上与Anthropic Claude Code团队的Cat Wu和Thariq Shihipar主持了一场炉边对话。

我们讨论了Claude Code、Claude Tag、Fable、编码智能体安全、评估、工具设计,以及Anthropic自身如何使用这些工具。该会议的完整视频现已在YouTube上提供。以下是经过编辑的文字记录,附有额外链接和我加粗的重点。

如果你不想观看视频或翻阅整个文字记录,这里有几个高层要点:- Claude Tag(Claude新的协作Slack集成)现在为Claude Code团队处理了65%的产品工程PR。

- Claude Code首先向Anthropic员工发布功能,并且只发布那些在该群体中表现出用户留存率的功能。- Claude Code的关键变更仍由人工审查,但团队越来越依赖自动代码审查来处理产品的“外层”。

- 对于Fable 5甚至Opus 4这样的模型,向系统提示词添加示例已不再是最佳实践。Claude Code的系统提示词最近缩减了80%。- 同样,“不要做X,不要做Y”这类列表会降低最新模型的结果质量。

- Anthropic内部的“吃自己的狗粮”被称为“蚂蚁食粮”。- Anthropic非常相信他们的自动模式,并将其视为Claude Tag的使能技术。

- Thariq建议通过“更加雄心勃勃”地对待工作来抵消编码智能体带来的“深蓝”效应。- Fable擅长编辑视频,Thariq用它来编辑自己的发布视频。

- Anthropic在公共场合(内部)工作的文化是他们成功的关键,正如他们在公共Slack频道中使用Claude Tag的方式所证明的那样。过去一年你的日常工作发生了怎样的变化?

Simon:Claude Code是去年二月发布的——它诞生不到一年半,最初只是Claude Sonnet 3.7发布中的一个要点。既然我们有了这些真正为我们工作的编码智能体,过去一年你的日常工作发生了怎样的变化?

Cat:我记得我们刚推出Claude Code和Sonnet 3.7时,你给它一个任务,就必须密切监视它试图做的每一件小事。我会非常仔细地阅读每一个权限提示。我经常说“不——不,不,不,你检查过这个文件吗?

你检查过那个文件吗?”而现在,随着每一代模型,情况变得不可思议。我觉得我们都有机会退后一步,将更多琐碎的实现工作委托给Claude。

这释放了我们大量时间,用于思考更具创造性的工作,比如:既然我们知道Claude Code可以实现很多功能,我们应该为用户提供什么样的正确体验?而现在有了Fable,这又是一个完全不同的阶跃式改进。

我们看到,在很多用例中,现在用Fable可以一次性实现大量功能。Thariq:我记得我收到第一条关于Claude Code的消息。我最好的朋友之一说:“你得去试试Claude Code。”那是在Opus 4发布的时候,我试了一下,心想:“哦,该死。

我现在得去Anthropic工作。”那是Opus 4——很棒的模型,但你还在阅读权限提示。我们有多健忘,这有点疯狂,我心想:哦,自动模式一直都在,对吧?我甚至不记得按过“是”和“允许”。对我来说,我试图推动自己的一件大事是,我们必须做比以往更高质量的工作。

输出质量非常高。我一直在用它编辑大量视频,我想:好吧,它必须在几个小时内满足我们品牌团队非常严格的要求,否则我们就做不到。这就是我试图通过Fable实现转变的方式:做出我们有史以来最好的作品,比以往任何时候都快。

传统软件工程的哪些部分不再适用?Simon:一年前还成立的传统软件工程原则,你认为在这个新世界中不再适用的是什么?

Cat:我们在工程技能方面看到的最大转变之一:两年前,产品经理通常会与一群客户交谈,在六个月内与跨职能团队就某个PRD达成一致,并在编写第一行代码之前,就如何实现它写一份详尽的规范。现在情况完全反过来了。

对于许多工程师来说,我想给在座各位的建议是:培养更多的商业意识和产品意识,判断我们应该构建什么,因为从产生想法到构建它的时间线大大缩短了——从六到十二个月缩短到可能只有一周。这意味着我们所有人都需要更好的品味,判断什么值得构建,什么才能真正影响我们正在做的业务。

因此,产品品味和商业意识的价值在提升,而大多数产品领域的执行价值则有所下降。当然,对于基础设施来说,仍然非常强调确保所有细节正确。Thariq:对我来说,重写现在是好事。Simon:你以前能做的最糟糕的事,现在竟然没问题了!

Thariq:没错。所有《人月神话》里的东西——永远不要重写——我现在支持重写。

如果你有一个好的测试套件——我认为重写实际上会迫使你确保有一个好的测试套件——但我认为人们低估的是,代码库就是一个规范,而且可能是你拥有的唯一规范副本,因为没有人知道代码库的每个分支部分。你可以把它当作一个产物,提炼它或创建它的其他版本。

我们用Rust重写了Bun,效果很好——我现在就在用。Simon:你还没有在Bun-in-Rust上发布Claude Code,对吧?Thariq:我们内部已经发布了。

(实际上,看起来Anthropic从6月17日开始向所有人发布基于Bun-in-Rust的Claude Code。)非工程师用Claude Tag做什么?Simon:最近另一个重大发布是Claude Tag——至少对我们其他人来说,它已经发布一周了。

我了解到Anthropic的非工程师大量使用它。非工程师用Claude Tag做什么?Cat:Claude Tag是一个存在于团队协作工具中的Claude。我们上周在Slack中发布了它。Claude Tag的不同之处在于它默认是多人协作的。

一旦你将Claude Tag添加到一个Slack频道,你可以加入讨论,你的队友也可以加入,你们可以一起协作处理PR。另一个重大区别是它是主动的,而不是被动的。

你可以告诉Claude Tag:“嘿,监控这个频道里的每个bug报告,提交一个PR来修复它,并标记最后接触这部分代码的工程师。”它会在频道的整个生命周期内自动执行,无需你手动标记。第三个重大转变是我们加入了团队记忆。

如果你在频道中告诉Claude Tag你的偏好,它会记住这些偏好,用于未来的每个帖子。如果你总是希望它调试故障,但不希望它调试警告,只需在频道中用自然语言告诉它,它就会为你和团队中的其他人记住。

在内部,我们将Claude Tag视为Claude Code的演进。我们认为这是我们内部工作方式的重大转变。Claude Tag目前处理了我们65%的产品工程PR。Simon:是针对整个Anthropic,还是仅针对Claude Code团队?

Cat:这仅针对我们的产品工程团队——我们内部版本的Claude Tag目前处理了我们65%的产品PR。这是一个巨大的转变;这超过了我们PR的50%。

我们看到人们将工作分配给Claude Code和Claude Tag的方式是:Claude Code仍然是你处理最复杂任务的最佳场所,当你与智能体进行交互式迭代时。但Claude Tag非常适合

原文出处
A Fireside Chat with Cat and Thariq from the Claude Code team

本文为机器翻译辅以 AI 润色,仅供参考。原始事实以原文为准。

相关阅读