每次请求可选择 Auto、TokenLab Verified 或 Official,并查看对应价格。查看更新

Anthropic: Claude Opus 4.6

高端 Claude 模型,面向高难度编程、规划与更慢但更专业的推理
对比模型
claude-opus-4-6
可用Anthropic聊天缓存输入便宜 90%
输入 / 输出-70%
$5.00 / $25.00$1.50 / $7.50
上下文
1M
最大输出
128K
模态
视觉聊天
能力
工具调用提示词缓存推理

Claude Opus 4.6 简介

Claude Opus 4.6 是 Anthropic 2026 年 2 月发布的 Opus 级模型,面向高难度编程、规划和长时间智能体任务。它引入了带四档推理强度的自适应思考、用于长时间会话的上下文压缩,以及 Claude 4 系列中较长的上下文窗口。它现在是 Anthropic 产品线中的旧版模型,保留给已经针对它调好的工作负载。

擅长的任务

  • 能把大型编程项目拆成具体步骤并执行到底,Anthropic 发布文章里的早期测试者提到了这一点。
  • 自适应思考让模型自己判断何时值得深入推理,low、medium、high 和 max 四档 effort 用来控制成本。
  • 上下文压缩会自动总结较早的对话轮次,历史变长时长时间的智能体会话不会卡住。
  • Anthropic 称它发布时在智能体编程评测 Terminal-Bench 2.0 和 Humanity's Last Exam 上取得领先成绩。

什么情况换别的模型

  • 可靠的知识截止日期比 Opus 4.7 及之后的模型更早,对近期框架不太熟悉。
  • Anthropic 现在把它标为旧版,并建议使用 Opus 5.5,后者在当前工作负载上表现更好。
  • 这个模型上手动设置预算的扩展思考形式已被弃用,请围绕自适应思考和 effort 来规划。

快速上手

  1. 创建 API 密钥

    在 Console 生成一把密钥,平台上的模型都能用。

  2. 发送第一个请求

    复制你所用语言的示例代码,向该端点发起请求。

    文本生成Messages API
    POST/v1/messages
    API 格式:
    curl https://api.tokenlab.sh/v1/messages \
      -H "Content-Type: application/json" \
      -H "x-api-key: sk-xxx" \
      -H "anthropic-version: 2023-06-01" \
      -d '{
        "model": "claude-opus-4-6",
        "max_tokens": 1024,
        "messages": [
          {"role": "user", "content": "Hello!"}
        ]
      }'

价格

TokenLab 价格用于 Verified,多数模型更便宜;官方价格是模型厂商公布的价格,用于更稳定的 Official。Auto 按最终完成请求的线路计价。

默认规格

每 1M token
官方价格
输入 $5.00 / 输出 $25.00 / 缓存读取 $0.50 / 缓存写入 $6.25
TokenLab 价格
输入 $1.50 / 输出 $7.50 / 缓存读取 $0.15 / 缓存写入 $1.88
折扣
-70%
提示词缓存价格

缓存读取

官方价格
$0.50
TokenLab 价格
$0.15
折扣
-70%

缓存写入

官方价格
$6.25
TokenLab 价格
$1.88
折扣
-70%
工具附加费

按次计费,仅在模型实际使用工具时收取。

网页搜索

官方价格
$0.01/次搜索
TokenLab 价格
$0.003/次搜索
折扣
-70%

用量与动态

成功率是请求完成的比例;延迟是拿到一次完整响应要花的时间,P95 表示 95% 的请求都在这个时间内完成。

用量与可用性

最近 24 小时
请求
成功率
P95 延迟
总 token 数
模型表现
30 天成功率
100.0%
30 天请求数
1K+
最后活动时间
16小时前

数据来自汇总的用户请求,不含状态检查。

直接在 Console 里试

Claude Opus 4.6 已在 Console 备好,提示词已填好,可以直接修改或发送。

帮我用 claude-opus-4-6 发一条简短消息,接口是 /v1/messages。返回回复,附上延迟和费用。

使用场景

适用场景
  • 推理
  • 视觉
  • 多步编程智能体

    驱动终端智能体规划重构、编辑文件、跑测试套件并修复失败,max 档留给最难的任务。

  • 长时间研究会话

    在大量搜索和文档阅读之间保持会话不中断,由压缩裁剪较早的历史,而不是让任务被截断。

  • 专业知识工作

    起草财务模型、法律摘要和分析,错误答案的代价比多等一会儿更高。

提示词示例

规划把这个 Express 服务迁移到 Fastify,按顺序列出受影响的文件,然后做第一步改动并运行测试。

在这三份申报文件中查找各年度收入确认方式的变化,并总结差异,附上页码。

检查这个 pull request 里的并发问题,并按在生产中出现的可能性对问题排序。

此模型按条件计价,仅凭月度 token 总量无法可靠估算;请按请求规格、缓存和适用时段查看详细定价。

FAQ

Claude Opus 4.6 擅长什么?

复杂的智能体编程、规划和专业分析。Anthropic 的发布文章称它在 Terminal-Bench 2.0、Humanity's Last Exam 和 BrowseComp 上成绩居前,早期测试者说它能把大任务拆成步骤并完成,而不是做到一半就停。

Opus 4.6 和 Opus 4.7 有什么区别?

Opus 4.7 增加了更高分辨率的图像输入、xhigh 推理强度、任务预算和新的分词器,并更按字面执行指令。Opus 4.6 早于这些改动,所以依赖宽松理解的提示词,切换后行为可能不同。

Claude Opus 4.6 支持扩展思考吗?

支持自适应思考:模型自己决定推理多少,你用 effort 参数引导。较早的、手动设置 token 预算的扩展思考模式在这个模型上已被标为弃用。

Claude Opus 4.6 现在还值得用吗?

如果现有流程已在它上面验证过、暂时无法重新评测,可以继续用。新项目 Anthropic 建议迁移到 Opus 5.5,它是当前的 Opus 模型,在长编程和知识任务上更好。

Claude Opus 4.6 的费用是多少?

在 TokenLab 上,Claude Opus 4.6 的价格为 输入 $1.50 / 输出 $7.50 每 1M token。完整明细见上方价格表。 价格因计费单位、规格和用量而异。请在模型的详细定价中对比相同条件下的费率;单一费率不代表总价。

Claude Opus 4.6 的上下文窗口和输出上限是多少?

Claude Opus 4.6 最多接收 1,000,000 token 的上下文,单次最多返回 128,000 token。

Claude Opus 4.6 应该使用哪个端点?

Claude Opus 4.6 使用 https://api.tokenlab.sh/v1/messages。代码写法见下方的请求示例。

Claude Opus 4.6 支持哪些操作?

Claude Opus 4.6 支持 文本生成。选了操作,上面会显示对应的端点和请求示例。

Claude Opus 4.6 对比

资料来源

审阅于 2026年10月2日

更多 Claude 4 模型

相关模型