每次请求可选择 Auto、TokenLab Verified 或 Official,并查看对应价格。查看更新

Anthropic: Claude Sonnet 4.6

Claude 主力模型,适合编程智能体、细致分析与生产环境成本控制
对比模型
claude-sonnet-4-6
可用Anthropic聊天缓存输入便宜 90%
输入 / 输出-70%
$3.00 / $15.00$0.90 / $4.50
上下文
1M
发布日期
2026年2月17日
最大输出
128K
模态
视觉聊天
能力
工具调用提示词缓存推理

Claude Sonnet 4.6 简介

Claude Sonnet 4.6 是 Anthropic 的中档 Claude 模型,2026 年 2 月发布,面向编程、智能体和日常知识工作。它比 Sonnet 4.5 更稳定地遵循指令,通过截图、鼠标和键盘操作电脑的能力接近 Opus 4.6,同时仍属于 Sonnet 这一档。它接受文本和图像,支持工具调用、提示词缓存和扩展思考。

擅长的任务

  • 跨多个文件的编程工作:Anthropic 称早期体验的开发者大幅更偏好它而不是 Sonnet 4.5。
  • 电脑操作:在 Anthropic 公布的桌面软件操作评测 OSWorld-Verified 上,得分与 Opus 4.6 只差零点几分。
  • 调用大量工具的长智能体运行:Anthropic 称它在 MCP-Atlas 评测上比 Sonnet 4.5 有明显提升。
  • 难题可以调高扩展思考,要快速、低成本的回合则可以关掉。

什么情况换别的模型

  • 最难的多步推理和最长的自主任务,Opus 级 Claude 模型仍是更好的选择。
  • 分类、提取等大批量的简单调用,Claude Haiku 4.5 更快,费率也更低。
  • 只输出文本;图像、音频和视频输出需要另外的模型。

快速上手

  1. 创建 API 密钥

    在 Console 生成一把密钥,平台上的模型都能用。

  2. 发送第一个请求

    复制你所用语言的示例代码,向该端点发起请求。

    文本生成Messages API
    POST/v1/messages
    API 格式:
    curl https://api.tokenlab.sh/v1/messages \
      -H "Content-Type: application/json" \
      -H "x-api-key: sk-xxx" \
      -H "anthropic-version: 2023-06-01" \
      -d '{
        "model": "claude-sonnet-4-6",
        "max_tokens": 1024,
        "messages": [
          {"role": "user", "content": "Hello!"}
        ]
      }'

价格

TokenLab 价格用于 Verified,多数模型更便宜;官方价格是模型厂商公布的价格,用于更稳定的 Official。Auto 按最终完成请求的线路计价。

默认规格

每 1M token
官方价格
输入 $3.00 / 输出 $15.00 / 缓存读取 $0.30 / 缓存写入 $3.75
TokenLab 价格
输入 $0.90 / 输出 $4.50 / 缓存读取 $0.09 / 缓存写入 $1.13
折扣
-70%
提示词缓存价格

缓存读取

官方价格
$0.30
TokenLab 价格
$0.09
折扣
-70%

缓存写入

官方价格
$3.75
TokenLab 价格
$1.13
折扣
-70%
工具附加费

按次计费,仅在模型实际使用工具时收取。

网页搜索

官方价格
$0.01/次搜索
TokenLab 价格
$0.003/次搜索
折扣
-70%

用量与动态

成功率是请求完成的比例;延迟是拿到一次完整响应要花的时间,P95 表示 95% 的请求都在这个时间内完成。

用量与可用性

最近 24 小时
请求
成功率
P95 延迟
总 token 数
模型表现
30 天成功率
100.0%
30 天请求数
100+
最后活动时间
4小时前

数据来自汇总的用户请求,不含状态检查。

直接在 Console 里试

Claude Sonnet 4.6 已在 Console 备好,提示词已填好,可以直接修改或发送。

帮我用 claude-sonnet-4-6 发一条简短消息,接口是 /v1/messages。返回回复,附上延迟和费用。

使用场景

适用场景
  • 推理
  • 视觉
  • 编程智能体

    放在编辑器或终端智能体后面,规划改动、编辑多个文件、运行测试并修复失败,漏掉指令的情况比早期 Sonnet 版本少。

  • 电脑操作自动化

    目标系统没有 API 时,让它填写网页表单、在桌面应用之间搬运数据,并根据截图确认结果。

  • 文档和合同审阅

    载入长报告、合同或研究论文,询问矛盾点和风险,得到的回答会引用所依据的段落。

  • 客服和运营助手

    根据知识库回答客户问题,调用内部工具查订单或账户,需要人工时顺畅转接。

提示词示例

下面是一个失败的测试和它涉及的三个文件。找出原因,提出最小的修复,并说明这个改动还可能破坏什么。

阅读这份 40 页的供应商合同,列出所有限制我们终止权利的条款,附上章节号和一句话理由。

你有查询订单和发起退款的工具。客户说订单 4417 到货时已损坏。先判断该查什么,然后执行。

此模型按条件计价,仅凭月度 token 总量无法可靠估算;请按请求规格、缓存和适用时段查看详细定价。

FAQ

Claude Sonnet 4.6 最擅长什么?

编程、智能体工作流和电脑操作。Anthropic 把它定位为多数团队的默认选择:它能很好地处理多文件代码改动和长时间的工具调用,根据截图操作桌面软件的准确度几乎与 Opus 4.6 相当。作为通用模型,做分析、写作和文档审阅也很稳。

Claude Sonnet 4.6 和 Claude Opus 4.6 有什么区别?

Sonnet 4.6 是更快、成本更低的一档,Opus 4.6 能力更强。Sonnet 在编程和电脑操作评测上接近 Opus,所以多数生产负载从 Sonnet 开始。任务需要多步深度推理,或在 Sonnet 上反复失败时,再换 Opus。

Claude Sonnet 4.6 支持扩展思考吗?

支持。可以让模型先推理再回答,并控制它投入多少精力。简短、对延迟敏感的回合关掉思考,调试、规划或分析这类答错代价高于变慢的任务就调高。

Claude Sonnet 4.6 能读图吗?

能。它接受图像和文本一起输入,可以读取截图、图表、扫描页面和界面原型。操作电脑也依靠同样的视觉输入:看屏幕、决定点击或输入的位置,再确认结果。

应该从 Claude Sonnet 4.5 升级到 Sonnet 4.6 吗?

编程和智能体任务建议升级。Anthropic 称它指令遵循更好,过度设计更少,电脑操作比 Sonnet 4.5 大幅提升。为 4.5 写的提示词一般可以沿用;切换生产流量前,先用自己的评测集重新跑一遍。

Claude Sonnet 4.6 的费用是多少?

在 TokenLab 上,Claude Sonnet 4.6 的价格为 输入 $0.90 / 输出 $4.50 每 1M token。完整明细见上方价格表。 价格因计费单位、规格和用量而异。请在模型的详细定价中对比相同条件下的费率;单一费率不代表总价。

Claude Sonnet 4.6 的上下文窗口和输出上限是多少?

Claude Sonnet 4.6 最多接收 1,000,000 token 的上下文,单次最多返回 128,000 token。

Claude Sonnet 4.6 应该使用哪个端点?

Claude Sonnet 4.6 使用 https://api.tokenlab.sh/v1/messages。代码写法见下方的请求示例。

Claude Sonnet 4.6 支持哪些操作?

Claude Sonnet 4.6 支持 文本生成。选了操作,上面会显示对应的端点和请求示例。

Claude Sonnet 4.6 对比

用到 Claude Sonnet 4.6 的指南

资料来源

审阅于 2026年10月2日

更多 Claude 4 模型

相关模型