AI 见闻
精选· 重要性 4/5

AI最重要的协议MCP更新:会话ID转向无状态,降低大规模部署门槛

TechCrunch — AI··Russell Brandom·约 3 分钟阅读
中文导读

模型上下文协议(MCP)即将迎来重大更新,通过将服务器端会话ID处理方式改为无状态,解决了大规模部署中的负载均衡难题,有望加速企业级AI集成落地。

模型上下文协议(MCP)是AI互操作性的基本构建模块之一,它为AI模型提供了一种安全访问外部数据源和服务的方式。它就像管道系统,让聊天机器人能够接入你的日历、数据库或内部工具,而无需工程师为每个连接构建定制管道。

下周,该协议将迎来一次重大更新,虽然最终用户可能不会注意到,但它将对生态系统的发展产生重要影响。新版本的官方规范自5月以来已公开,但周一早上,我们从Arcade公司那里得到了异常清晰的解释。

本质上,MCP正在改变其处理会话ID的方式——即服务器用来记住“这是与五秒前相同的对话”的小型token——以便服务器能够在更大规模上更轻松地运行。

正如Arcade的Nate Barbettini所说:[在当前系统下] 像Claude这样的MCP客户端首次连接服务器时,会发送一个“你好”:我是Claude,这是我的版本,这是我的能力。

服务器回复其自身能力并返回一个会话ID……此后,客户端在每次请求中都发送该会话ID,以便服务器知道这是同一个对话。有时ID会过期,客户端必须注意到这一点,请求一个新的ID,然后继续……想象一下一个真实的部署场景。

你正在为数百万用户运行一台服务器,它位于负载均衡器之后,负载均衡器的全部工作就是将每个请求路由到服务器集群中任意空闲的机器,有时甚至在不同区域。现在,每一台机器都必须知道其他机器发放的会话ID。

这并非不可能,但非常麻烦,而且它是在与负载均衡器对抗,而不是与之协同。换句话说,当前的设置假设一台服务器记住你,但真正的公司会将流量分散到数十台默认不互相通信的服务器上,因此今天的MCP服务器必须做额外的工作来跟踪谁是谁。

这对于任何大规模运行MCP服务器的人来说都是一个严重的头痛问题,也是尽管今年围绕智能体AI大肆宣传,但我们仍未看到更多公司推出大规模、第一方MCP集成的部分原因。

在新系统下,该协议将在服务器端对会话ID采取更宽松的“无状态”方法,类似于大多数普通网站的工作方式,这应该会使整个系统更容易维护,理论上大规模运行也更便宜。这一切都相当技术性,但它是一个重要的提醒:并非AI开发的每个部分都在以极快的速度前进。

虽然模型训练竞赛一马当先,但这些模型所需的许多技术基础设施仍然受制于标准机构缓慢的共识推进。它确实在发生,只是慢了一点!

原文出处
AI’s most important protocol is getting a little bit easier to use

本文为机器翻译辅以 AI 润色,仅供参考。原始事实以原文为准。

相关阅读