每次请求可选择 Auto、TokenLab Verified 或 Official,并查看对应价格。查看更新

Anthropic: Claude Sonnet 5

日常使用的 Claude 智能体模型,面向编程、规划、网页浏览与通用工作
对比模型
claude-sonnet-5
可用Anthropic聊天缓存输入便宜 90%
输入 / 输出-70%
$2.00 / $10.00$0.60 / $3.00
上下文
1M
发布日期
2026年6月30日
最大输出
128K
模态
视觉聊天
能力
工具调用提示词缓存推理

Claude Sonnet 5 简介

Claude Sonnet 5 是 Anthropic 在 2026 年 6 月 30 日发布的中档模型,定位为日常的编程、规划和浏览智能体模型。它以更低的成本缩小了与 Opus 4.8 的差距,能完成早期模型做到一半就停的复杂任务,并且不用提醒就会检查自己的输出。现在当前的 Sonnet 已由 Sonnet 5.5 取代。

擅长的任务

  • Anthropic 称它能完成前代模型会中途停下的复杂任务,并且不用提示就会检查自己的工作。
  • 一位早期测试者描述,它先写出能复现问题的测试,再修复缺陷,然后把修复暂存起来,确认没有修复时测试会失败。
  • 在 BrowseComp 上,medium 推理强度下它与 Opus 4.8 持平,因此是成本效率高的智能体搜索模型。
  • 自适应思考默认开启,较难的提示词无需额外设置就会得到更多推理。

什么情况换别的模型

  • Anthropic 称它的危险网络攻击能力比 Opus 4.8 弱得多,在行为审计中的错位行为略高。
  • 把 temperature、top_p 或 top_k 设为非默认值会返回错误。
  • Sonnet 5.5 更快,Terminal-Bench 4.0 上也更强,新项目应从它开始。

快速上手

  1. 创建 API 密钥

    在 Console 生成一把密钥,平台上的模型都能用。

  2. 发送第一个请求

    复制你所用语言的示例代码,向该端点发起请求。

    文本生成Messages API
    POST/v1/messages
    API 格式:
    curl https://api.tokenlab.sh/v1/messages \
      -H "Content-Type: application/json" \
      -H "x-api-key: sk-xxx" \
      -H "anthropic-version: 2023-06-01" \
      -d '{
        "model": "claude-sonnet-5",
        "max_tokens": 1024,
        "messages": [
          {"role": "user", "content": "Hello!"}
        ]
      }'

价格

Verified 价格用于 Verified,多数模型更便宜;Official 价格是模型厂商公布的价格,用于更稳定的 Official。Auto 按最终完成请求的线路计价。

默认规格

每 1M token
Official 价格
输入 $2.00 / 输出 $10.00 / 缓存读取 $0.20 / 缓存写入 $2.50
Verified 价格
输入 $0.60 / 输出 $3.00 / 缓存读取 $0.06 / 缓存写入 $0.75
折扣
-70%
提示词缓存价格

缓存读取

Official 价格
$0.20
Verified 价格
$0.06
折扣
-70%

缓存写入

Official 价格
$2.50
Verified 价格
$0.75
折扣
-70%
工具附加费

按次计费,仅在模型实际使用工具时收取。

网页搜索

Official 价格
$0.01/次搜索
Verified 价格
$0.003/次搜索
折扣
-70%

用量与动态

成功率是请求完成的比例;延迟是拿到一次完整响应要花的时间,P95 表示 95% 的请求都在这个时间内完成。

用量与可用性

最近 24 小时
请求
成功率
P95 延迟
总 token 数
模型表现
30 天成功率
99.7%
7 天中位延迟
1.9 sn=277
7 天 P95 延迟
6.7 sn=277
30 天请求数
100+
最后活动时间
3天前

数据来自汇总的用户请求,不含状态检查。

直接在 Console 里试

Claude Sonnet 5 已在 Console 备好,提示词已填好,可以直接修改或发送。

帮我用 claude-sonnet-5 发一条简短消息,接口是 /v1/messages。返回回复,附上延迟和费用。

使用场景

适用场景
  • 推理
  • 视觉
  • 日常编程智能体

    放在编辑器或命令行智能体里,把问题从报告处理到带测试的修复,模型会检查自己的改动。

  • 网页研究智能体

    让它浏览、比对来源,并为开放式问题整理出带出处的回答。

  • 规划与运营

    把目标转成计划,调用内部工具收集事实,并带着未解决的问题回来汇报。

提示词示例

调查为什么这个接口在购物车为空时返回 500,写一个能复现问题的测试,然后修复它。

找三个关于这家供应商故障历史的独立来源,总结它们之间的分歧。

为新定价页起草上线计划,写明负责人、依赖项,以及可能阻碍上线的因素。

此模型按条件计价,仅凭月度 token 总量无法可靠估算;请按请求规格、缓存和适用时段查看详细定价。

FAQ

Claude Sonnet 5 最适合做什么?

日常的智能体工作:编程、规划、浏览和通用任务,成本比 Opus 低。Anthropic 称它缩小了与 Opus 4.8 的差距,更可能完成困难任务并检查自己的输出。

Sonnet 5 和 Sonnet 4.6 有什么区别?

Sonnet 5 是新一代,工具调用、编程和知识工作更强,默认开启自适应思考,分词器会把同样的文本切成大约 1.0 到 1.35 倍的 token。它还会拒绝非默认的采样参数。

应该从 Sonnet 5 迁移到 Sonnet 5.5 吗?

新项目应该。Anthropic 称 Sonnet 5.5 输出更快,每个任务用的 token 更少,智能体编程得分高得多。要预期不兼容的改动:强制工具调用会报错,思考块与模型绑定。

Claude Sonnet 5 能读图吗?

能。它接受图像和文本输入,返回文本,Anthropic 称它在 OSWorld-Verified 上的电脑操作结果有所改进。它不能生成图像,生图请用单独的图像模型。

Claude Sonnet 5 的费用是多少?

在 TokenLab 上,Claude Sonnet 5 的价格为 输入 $0.60 / 输出 $3.00 每 1M token。完整明细见上方价格表。 价格因计费单位、规格和用量而异。请在模型的详细定价中对比相同条件下的费率;单一费率不代表总价。

Claude Sonnet 5 的上下文窗口和输出上限是多少?

Claude Sonnet 5 最多接收 1,000,000 token 的上下文,单次最多返回 128,000 token。

Claude Sonnet 5 应该使用哪个端点?

Claude Sonnet 5 使用 https://api.tokenlab.sh/v1/messages。代码写法见下方的请求示例。

Claude Sonnet 5 支持哪些操作?

Claude Sonnet 5 支持 文本生成。选了操作,上面会显示对应的端点和请求示例。

Claude Sonnet 5 对比

用到 Claude Sonnet 5 的指南

资料来源

审阅于 2026年10月2日

更多 Claude 5 模型

相关模型