Anthropic: Claude Sonnet 4.6
claude-sonnet-4-6- 输入 / 输出-70%
- $3.00 / $15.00$0.90 / $4.50
- 上下文
- 1M
- 发布日期
- 2026年2月17日
- 最大输出
- 128K
- 模态
- 视觉聊天
- 能力
- 工具调用提示词缓存推理
Claude Sonnet 4.6 简介
Claude Sonnet 4.6 是 Anthropic 的中档 Claude 模型,2026 年 2 月发布,面向编程、智能体和日常知识工作。它比 Sonnet 4.5 更稳定地遵循指令,通过截图、鼠标和键盘操作电脑的能力接近 Opus 4.6,同时仍属于 Sonnet 这一档。它接受文本和图像,支持工具调用、提示词缓存和扩展思考。
擅长的任务
- 跨多个文件的编程工作:Anthropic 称早期体验的开发者大幅更偏好它而不是 Sonnet 4.5。
- 电脑操作:在 Anthropic 公布的桌面软件操作评测 OSWorld-Verified 上,得分与 Opus 4.6 只差零点几分。
- 调用大量工具的长智能体运行:Anthropic 称它在 MCP-Atlas 评测上比 Sonnet 4.5 有明显提升。
- 难题可以调高扩展思考,要快速、低成本的回合则可以关掉。
什么情况换别的模型
- 最难的多步推理和最长的自主任务,Opus 级 Claude 模型仍是更好的选择。
- 分类、提取等大批量的简单调用,Claude Haiku 4.5 更快,费率也更低。
- 只输出文本;图像、音频和视频输出需要另外的模型。
快速上手
创建 API 密钥
在 Console 生成一把密钥,平台上的模型都能用。
发送第一个请求
复制你所用语言的示例代码,向该端点发起请求。
文本生成Messages APIPOST/v1/messagesAPI 格式:curl https://api.tokenlab.sh/v1/messages \ -H "Content-Type: application/json" \ -H "x-api-key: sk-xxx" \ -H "anthropic-version: 2023-06-01" \ -d '{ "model": "claude-sonnet-4-6", "max_tokens": 1024, "messages": [ {"role": "user", "content": "Hello!"} ] }'
价格
TokenLab 价格用于 Verified,多数模型更便宜;官方价格是模型厂商公布的价格,用于更稳定的 Official。Auto 按最终完成请求的线路计价。
默认规格
每 1M token- 官方价格
- 输入 $3.00 / 输出 $15.00 / 缓存读取 $0.30 / 缓存写入 $3.75
- TokenLab 价格
- 输入 $0.90 / 输出 $4.50 / 缓存读取 $0.09 / 缓存写入 $1.13
- 折扣
- -70%
缓存读取
- 官方价格
- $0.30
- TokenLab 价格
- $0.09
- 折扣
- -70%
缓存写入
- 官方价格
- $3.75
- TokenLab 价格
- $1.13
- 折扣
- -70%
按次计费,仅在模型实际使用工具时收取。
网页搜索
- 官方价格
- $0.01/次搜索
- TokenLab 价格
- $0.003/次搜索
- 折扣
- -70%
| 官方价格每 1M token | TokenLab 价格每 1M token | 折扣 | |
|---|---|---|---|
| 默认规格 | 输入 $3.00 / 输出 $15.00 / 缓存读取 $0.30 / 缓存写入 $3.75 | 输入 $0.90 / 输出 $4.50 / 缓存读取 $0.09 / 缓存写入 $1.13 | -70% |
| 提示词缓存价格 | |||
| 缓存读取 | $0.30 | $0.09 | -70% |
| 缓存写入 | $3.75 | $1.13 | -70% |
| 工具附加费按次计费,仅在模型实际使用工具时收取。 | |||
| 网页搜索 | $0.01/次搜索 | $0.003/次搜索 | -70% |
用量与动态
成功率是请求完成的比例;延迟是拿到一次完整响应要花的时间,P95 表示 95% 的请求都在这个时间内完成。
用量与可用性
最近 24 小时- 请求
- 成功率
- P95 延迟
- 总 token 数
- 30 天成功率
- 100.0%
- 30 天请求数
- 100+
- 最后活动时间
- 4小时前
数据来自汇总的用户请求,不含状态检查。
直接在 Console 里试
Claude Sonnet 4.6 已在 Console 备好,提示词已填好,可以直接修改或发送。
帮我用 claude-sonnet-4-6 发一条简短消息,接口是 /v1/messages。返回回复,附上延迟和费用。
使用场景
适用场景- 推理
- 视觉
编程智能体
放在编辑器或终端智能体后面,规划改动、编辑多个文件、运行测试并修复失败,漏掉指令的情况比早期 Sonnet 版本少。
电脑操作自动化
目标系统没有 API 时,让它填写网页表单、在桌面应用之间搬运数据,并根据截图确认结果。
文档和合同审阅
载入长报告、合同或研究论文,询问矛盾点和风险,得到的回答会引用所依据的段落。
客服和运营助手
根据知识库回答客户问题,调用内部工具查订单或账户,需要人工时顺畅转接。
提示词示例
下面是一个失败的测试和它涉及的三个文件。找出原因,提出最小的修复,并说明这个改动还可能破坏什么。
阅读这份 40 页的供应商合同,列出所有限制我们终止权利的条款,附上章节号和一句话理由。
你有查询订单和发起退款的工具。客户说订单 4417 到货时已损坏。先判断该查什么,然后执行。
此模型按条件计价,仅凭月度 token 总量无法可靠估算;请按请求规格、缓存和适用时段查看详细定价。
FAQ
Claude Sonnet 4.6 最擅长什么?
编程、智能体工作流和电脑操作。Anthropic 把它定位为多数团队的默认选择:它能很好地处理多文件代码改动和长时间的工具调用,根据截图操作桌面软件的准确度几乎与 Opus 4.6 相当。作为通用模型,做分析、写作和文档审阅也很稳。
Claude Sonnet 4.6 和 Claude Opus 4.6 有什么区别?
Sonnet 4.6 是更快、成本更低的一档,Opus 4.6 能力更强。Sonnet 在编程和电脑操作评测上接近 Opus,所以多数生产负载从 Sonnet 开始。任务需要多步深度推理,或在 Sonnet 上反复失败时,再换 Opus。
Claude Sonnet 4.6 支持扩展思考吗?
支持。可以让模型先推理再回答,并控制它投入多少精力。简短、对延迟敏感的回合关掉思考,调试、规划或分析这类答错代价高于变慢的任务就调高。
Claude Sonnet 4.6 能读图吗?
能。它接受图像和文本一起输入,可以读取截图、图表、扫描页面和界面原型。操作电脑也依靠同样的视觉输入:看屏幕、决定点击或输入的位置,再确认结果。
应该从 Claude Sonnet 4.5 升级到 Sonnet 4.6 吗?
编程和智能体任务建议升级。Anthropic 称它指令遵循更好,过度设计更少,电脑操作比 Sonnet 4.5 大幅提升。为 4.5 写的提示词一般可以沿用;切换生产流量前,先用自己的评测集重新跑一遍。
Claude Sonnet 4.6 的费用是多少?
在 TokenLab 上,Claude Sonnet 4.6 的价格为 输入 $0.90 / 输出 $4.50 每 1M token。完整明细见上方价格表。 价格因计费单位、规格和用量而异。请在模型的详细定价中对比相同条件下的费率;单一费率不代表总价。
Claude Sonnet 4.6 的上下文窗口和输出上限是多少?
Claude Sonnet 4.6 最多接收 1,000,000 token 的上下文,单次最多返回 128,000 token。
Claude Sonnet 4.6 应该使用哪个端点?
Claude Sonnet 4.6 使用 https://api.tokenlab.sh/v1/messages。代码写法见下方的请求示例。
Claude Sonnet 4.6 支持哪些操作?
Claude Sonnet 4.6 支持 文本生成。选了操作,上面会显示对应的端点和请求示例。
Claude Sonnet 4.6 对比
用到 Claude Sonnet 4.6 的指南
资料来源
审阅于 2026年10月2日