全部模型

Okou上的Claude Sonnet 4.6。默认的智能体模型

多数Okou智能体的默认选择。工具路由准,长上下文表现好,也是积分的基准线。其他模型的价格都以Sonnet 4.6为参照。

1M tokens · Text / Vision / Code · Prompt cache

Claude Sonnet 4.6是Claude 4系列的主力,也是Okou上默认的Built-in模型。它挑对工具、传对参数的可靠度高于任何更便宜的模型,在十万token量级的对话里也能保持连贯,多数生产环境的智能体——Slack工单分流、GitHub PR评审、客户支持——从来都不需要往上升级。

服务商标价为每100万token $3/$15,缓存输入降到每100万token $0.30。只有在Sonnet明显扛不住最难的推理时才动用Opus;单位成本压倒一切时,再考虑Kimi K2.7 Code或GPT-5.4 Mini。

Claude Sonnet 4.6是什么?

2026年2月(Claude 4.6代) · Claude 4系列的中端档位。Anthropic的主力模型,位于省钱型模型和Opus之间。

Claude Sonnet 4.6位于Anthropic Claude 4系列的中间位置。它是为承接典型智能体工作全貌而设计的主力模型。多工具路由、代码修改、长时间对话、结构化输出任务。而且没有Opus那样的成本溢价。

Sonnet 4.6支持Anthropic的提示词缓存,这对那些系统提示词稳定、工具结构固定的Okou智能体来说差别很大。缓存的输入token按每100万token $0.30计费,而不是$3。提示词里每轮都不变的那部分,成本直接降到十分之一。

Claude Sonnet 4.6有什么特别之处

架构与能力上的主要亮点。

Sonnet 4.6按标准价提供100万token的上下文窗口,自适应思考继承自Opus 4.6,提示词缓存让缓存输入只按输入价的十分之一计费。它接受文本、视觉和代码的多模态输入。

规格速览

家族Claude 4系列
模态文本、视觉、代码
语言以英文为主,支持多语言
提示词缓存支持(Anthropic)
上下文窗口100万token
最大输出最高64K token
默认用于Okou Managed

Claude Sonnet 4.6基准测试

在Anthropic主打的编码基准上,Sonnet 4.6落后Opus 4.6大约3到4个百分点,而服务商层面的价格便宜三到五倍。这就是Opus和Sonnet之间典型的取舍。

SWE-bench Verified厂商公布
约77%
长上下文召回内部观察
10万token以上依然稳定

Claude Sonnet 4.6价格

服务商标价,按每100万token计。

输入$3.00
输出$15.00
缓存读取$0.30
缓存写入$3.75

Claude Sonnet 4.6实际用起来怎么样

来自生产环境智能体运行的实际观察。

工具路由

在这个价位上,工具路由准确度是同级里最好的。在跨Slack、GitHub、Linear和Notion的多工具流程中,Sonnet 4.6挑对工具、传对参数的可靠度高于任何×2以下的模型。

长上下文连贯性

在10万token以上的记录里依然连贯。只有在最长、最刁钻的运行中才会落后Opus 4.7。

速度

比Opus快,比Kimi K2.7 Code慢。对生产环境的智能体来说,这是合适的速度与质量平衡点。

成本可预测性

它的定价就是积分的基准线;对于系统提示词固定的智能体,提示词缓存让在Okou上的成本格外好预估。

Claude Sonnet 4.6最适合的智能体任务

知道东西都放在哪儿的Slack智能体

分流进来的问题,跟进卡住的会话,发布状态更新,回答搜索式的提问(「auth重构是谁在负责?」)。Sonnet的工具路由准确度意味着,即使请求本身含糊,第一次也能用对的参数调对的工具,所以这个智能体用起来是可靠的,而不是时灵时不灵。

不被噪音淹没的PR评审智能体

Sonnet能扛下大部分和代码相关的工作——PR评审、测试脚手架、重构建议、bug二分定位——而不会留下一堆没人想看的风格评论。100万token的上下文窗口让它在需要时把相关文件和此前的评审一起读进来,你只需要在Sonnet明显吃力的补丁上升级到Opus 4.7。

连着调用20次工具的研究型智能体

GitHub加Linear加Notion再加网页,跨二十多轮工具调用串起来,回答「这个客户上季度为什么流失了?」这类问题。Sonnet能在整个过程中始终盯住目标,成本却只有Opus的一小部分,这才让它撑得起日常研究,而不只是偶尔做一次深挖。

系统提示词固定的客户支持助手

长长的对话历史,频繁调用CRM的工具,每一轮都带着同样一大段系统提示词和工具结构。Sonnet的提示词缓存让这段固定前缀在首次调用之后只占输入成本的一小部分,这正是量涨上去之后单次会话成本还能持平的原因。

什么时候不该用Claude Sonnet 4.6

遇到最难的推理环节、Sonnet 4.6明显开始漏掉指令时,别用它,升级到Opus 4.7;大批量的分类也别用它,GPT-5.4 Mini是更便宜的批量选项;对延迟敏感的短回复同样别用,Kimi K2.7 Code明显更快。

Claude Sonnet 4.6与其他模型对比

Claude Sonnet 4.6对比Claude Opus 4.7

Sonnet 4.6是×1,Opus 4.7是×2。Sonnet能应付大多数智能体;当推理深度比吞吐更重要时,Opus才是那次升级。很多团队让Opus做规划者,Sonnet做执行者。

Claude Sonnet 4.6对比GPT-5.4 Mini

GPT-5.4 Mini是OpenAI那边更便宜的批量选项。工具路由可靠性更重要时用Sonnet;高频的前置筛选和不需要Sonnet级路由的简单环节用Mini。

结论:你该用Claude Sonnet 4.6吗?

先从这里开始。等你看过真实的生产表现、清楚该往哪个方向走,再往上换Opus 4.7,或者往下换Kimi K2.7 Code、DeepSeek V4 Pro。

常见问题

为什么Okou Managed的默认模型是Sonnet 4.6?

在我们的阵容里,它在推理质量、工具路由准确度和成本之间的平衡最好。新智能体几乎不用额外调优就能在Sonnet上跑通。

Claude Sonnet 4.6的上下文窗口有多大?

100万token,单次回复最高输出64K token。

Sonnet 4.6支持图片输入吗?

支持。它是多模态的。文本、代码和图片都行。

什么时候该从Sonnet 4.6换走?

如果Sonnet在长时间的智能体流程里明显跑偏了目标,或者在难的代码修改上失败,就换成Opus 4.7。高频的简单流程、成本压倒一切时,换成Kimi K2.7 Code或GPT-5.4 Mini。

Sonnet 4.6和Sonnet 4.5是一回事吗?

不是。4.6是Claude 4系列里更新的一代,长上下文表现更好,还带自适应思考。服务商的单token价格两者相同。

替代选择

在Okou上使用Claude Sonnet 4.6

在Okou上使用Claude Sonnet 4.6的两种方式

Okou既支持把Claude Sonnet 4.6作为Built-in模型使用、按Okou积分计费,也支持你用Anthropic API key自带密钥接入。Built-in这条路走的是Okou Managed路由和下文说明的价格档;自带密钥这条路由上游服务商直接向你收费,完全跳过Okou的积分换算。

Okou的建议

Okou把Claude Sonnet 4.6定位为核心智能体模型,用于编排、涉及代码的工作,以及其他一旦答错代价很高的环节。

积分与$$价格档

Okou给每个Built-in模型都定了四档积分价格——$$$$$$$$$$——它会作为标记出现在模型选择器里,也出现在zero model lsprice tier那一行。Claude Sonnet 4.6属于$$。这一档决定你从Okou积分余额里扣掉多少;上表里的服务商标价,则是上游服务商在Okou把它换算成积分之前收取的费用。

自Available since launch起在Okou上可用。