AI 见闻
精选· 重要性 4/5

OpenRouter 显示 GPT-5.6 Sol 价格下调 50%

Hacker News (AI)··Topfi·约 3 分钟阅读
社区热度 625
中文导读

OpenRouter 页面显示 OpenAI 旗舰模型 GPT-5.6 Sol 价格下调 50%,并披露其性能基准、托管提供商及热门使用场景,反映前沿模型在推理与编码任务中的实际表现。

GPT-5.6 Sol 是 OpenAI GPT-5.6 系列中的旗舰模型,适用于复杂推理、编码和智能体工作流,尤其在命令行任务、多步骤编码和长周期问题求解方面表现突出。模态:输入/输出价格:50% 折扣,每 1M token 2.50 美元 / 15 美元;

上下文窗口:1M;发布时间:2026 年 7 月 9 日;知识截止:2026 年 2 月。不同公司托管同一模型,OpenRouter 根据你选择的路由模式(Balanced 平衡价格与速度、Nitro 最快、Exacto 工具调用准确率最高)将请求路由至其中一家。

客户实际支付的平均价格显示在提供商标价旁边,缓存和折扣意味着实际支付价格通常远低于标价。吞吐量指模型生成速度(每秒 token 数,越高越好);延迟指总往返时间(越低越好);TTFT 指首 token 时间,即看到任何输出前需要等待的时间(越低越好);

正常运行时间指过去 3 天至少有一个提供商响应请求的百分比;可用性指推理成功服务的百分比。OpenRouter 会持续监控,当某个提供商返回错误时,会自动切换到下一个最佳提供商。

标准化评估得分,百分比越高越好,排名百分位显示该模型在 OpenRouter 所有模型中的位置。公共应用向该模型发送的流量最多。

这是真实生产工作负载的良好信号,也暗示了该模型最适合哪些用例。该模型的 token 量和请求流量随时间变化。调用该模型的即插即用代码:OpenRouter 的 API 与 OpenAI 兼容,大多数 SDK 只需更换 base URL 即可。

不同模型之间唯一变化的是下面的模型 slug。吞吐量:37 tok/s(P50,各提供商中最佳);延迟:3.16s(P50,最佳提供商);AutoExacto 基准测试:GPQA Diamond 和 TAU-Bench。

Azure (EU):90.6% / 80.0%;auto-routing:91.4% / 77.3%;Azure (US):92.1% / 74.0%;OpenAI:91.4% / 74.0%;

Amazon Bedrock (US):92.3% / 70.4%;Azure:-- / 77.3%。正常运行时间(3 天):100.00%;可用性(3 天):99.81%。

3 天前、2 天前、昨天、现在:OpenRouter 可用性 99.69%,无路由时 97.56%。当上游提供商发生错误时,如果请求过滤器允许,我们可以通过路由到另一个健康提供商来恢复。你可以通过 Endpoints API 以编程方式访问每个提供商的正常运行时间数据。

了解更多关于负载均衡和定制选项的信息。2. Hermes Agent:Hermes Agent 是 Nous Research 开发的开源、自我改进的 AI 智能体,跨会话持久运行并带有记忆,能从经验中构建可复用技能。

它配备 40 多个内置工具,包括网络搜索、浏览器自动化和视觉,以及定时自动化和子智能体。200B tokens。

3. Claude Code:Claude Code 是 Anthropic 的智能体编码工具,能读取整个代码库,跨文件规划和执行更改,运行测试,并根据失败进行迭代,全部通过自然语言提示完成。

61.3B tokens。4. OpenClaw:OpenClaw 是一个开源 AI 智能体,可连接到你的消息应用并代表你执行实际操作,从运行命令、浏览网页到管理文件和发送电子邮件。52.7B tokens。

原文出处
GPT-5.6 Sol Pricing Cut by 50%

本文为机器翻译辅以 AI 润色,仅供参考。原始事实以原文为准。

相关阅读