Anthropic: Claude Opus 4.6
claude-opus-4-6- 输入 / 输出-70%
- $5.00 / $25.00$1.50 / $7.50
- 上下文
- 1M
- 最大输出
- 128K
- 模态
- 视觉聊天
- 能力
- 工具调用提示词缓存推理
Claude Opus 4.6 简介
Claude Opus 4.6 是 Anthropic 2026 年 2 月发布的 Opus 级模型,面向高难度编程、规划和长时间智能体任务。它引入了带四档推理强度的自适应思考、用于长时间会话的上下文压缩,以及 Claude 4 系列中较长的上下文窗口。它现在是 Anthropic 产品线中的旧版模型,保留给已经针对它调好的工作负载。
擅长的任务
- 能把大型编程项目拆成具体步骤并执行到底,Anthropic 发布文章里的早期测试者提到了这一点。
- 自适应思考让模型自己判断何时值得深入推理,low、medium、high 和 max 四档 effort 用来控制成本。
- 上下文压缩会自动总结较早的对话轮次,历史变长时长时间的智能体会话不会卡住。
- Anthropic 称它发布时在智能体编程评测 Terminal-Bench 2.0 和 Humanity's Last Exam 上取得领先成绩。
什么情况换别的模型
- 可靠的知识截止日期比 Opus 4.7 及之后的模型更早,对近期框架不太熟悉。
- Anthropic 现在把它标为旧版,并建议使用 Opus 5.5,后者在当前工作负载上表现更好。
- 这个模型上手动设置预算的扩展思考形式已被弃用,请围绕自适应思考和 effort 来规划。
快速上手
创建 API 密钥
在 Console 生成一把密钥,平台上的模型都能用。
发送第一个请求
复制你所用语言的示例代码,向该端点发起请求。
文本生成Messages APIPOST/v1/messagesAPI 格式:curl https://api.tokenlab.sh/v1/messages \ -H "Content-Type: application/json" \ -H "x-api-key: sk-xxx" \ -H "anthropic-version: 2023-06-01" \ -d '{ "model": "claude-opus-4-6", "max_tokens": 1024, "messages": [ {"role": "user", "content": "Hello!"} ] }'
价格
TokenLab 价格用于 Verified,多数模型更便宜;官方价格是模型厂商公布的价格,用于更稳定的 Official。Auto 按最终完成请求的线路计价。
默认规格
每 1M token- 官方价格
- 输入 $5.00 / 输出 $25.00 / 缓存读取 $0.50 / 缓存写入 $6.25
- TokenLab 价格
- 输入 $1.50 / 输出 $7.50 / 缓存读取 $0.15 / 缓存写入 $1.88
- 折扣
- -70%
缓存读取
- 官方价格
- $0.50
- TokenLab 价格
- $0.15
- 折扣
- -70%
缓存写入
- 官方价格
- $6.25
- TokenLab 价格
- $1.88
- 折扣
- -70%
按次计费,仅在模型实际使用工具时收取。
网页搜索
- 官方价格
- $0.01/次搜索
- TokenLab 价格
- $0.003/次搜索
- 折扣
- -70%
| 官方价格每 1M token | TokenLab 价格每 1M token | 折扣 | |
|---|---|---|---|
| 默认规格 | 输入 $5.00 / 输出 $25.00 / 缓存读取 $0.50 / 缓存写入 $6.25 | 输入 $1.50 / 输出 $7.50 / 缓存读取 $0.15 / 缓存写入 $1.88 | -70% |
| 提示词缓存价格 | |||
| 缓存读取 | $0.50 | $0.15 | -70% |
| 缓存写入 | $6.25 | $1.88 | -70% |
| 工具附加费按次计费,仅在模型实际使用工具时收取。 | |||
| 网页搜索 | $0.01/次搜索 | $0.003/次搜索 | -70% |
用量与动态
成功率是请求完成的比例;延迟是拿到一次完整响应要花的时间,P95 表示 95% 的请求都在这个时间内完成。
用量与可用性
最近 24 小时- 请求
- 成功率
- P95 延迟
- 总 token 数
- 30 天成功率
- 100.0%
- 30 天请求数
- 1K+
- 最后活动时间
- 16小时前
数据来自汇总的用户请求,不含状态检查。
直接在 Console 里试
Claude Opus 4.6 已在 Console 备好,提示词已填好,可以直接修改或发送。
帮我用 claude-opus-4-6 发一条简短消息,接口是 /v1/messages。返回回复,附上延迟和费用。
使用场景
适用场景- 推理
- 视觉
多步编程智能体
驱动终端智能体规划重构、编辑文件、跑测试套件并修复失败,max 档留给最难的任务。
长时间研究会话
在大量搜索和文档阅读之间保持会话不中断,由压缩裁剪较早的历史,而不是让任务被截断。
专业知识工作
起草财务模型、法律摘要和分析,错误答案的代价比多等一会儿更高。
提示词示例
规划把这个 Express 服务迁移到 Fastify,按顺序列出受影响的文件,然后做第一步改动并运行测试。
在这三份申报文件中查找各年度收入确认方式的变化,并总结差异,附上页码。
检查这个 pull request 里的并发问题,并按在生产中出现的可能性对问题排序。
此模型按条件计价,仅凭月度 token 总量无法可靠估算;请按请求规格、缓存和适用时段查看详细定价。
FAQ
Claude Opus 4.6 擅长什么?
复杂的智能体编程、规划和专业分析。Anthropic 的发布文章称它在 Terminal-Bench 2.0、Humanity's Last Exam 和 BrowseComp 上成绩居前,早期测试者说它能把大任务拆成步骤并完成,而不是做到一半就停。
Opus 4.6 和 Opus 4.7 有什么区别?
Opus 4.7 增加了更高分辨率的图像输入、xhigh 推理强度、任务预算和新的分词器,并更按字面执行指令。Opus 4.6 早于这些改动,所以依赖宽松理解的提示词,切换后行为可能不同。
Claude Opus 4.6 支持扩展思考吗?
支持自适应思考:模型自己决定推理多少,你用 effort 参数引导。较早的、手动设置 token 预算的扩展思考模式在这个模型上已被标为弃用。
Claude Opus 4.6 现在还值得用吗?
如果现有流程已在它上面验证过、暂时无法重新评测,可以继续用。新项目 Anthropic 建议迁移到 Opus 5.5,它是当前的 Opus 模型,在长编程和知识任务上更好。
Claude Opus 4.6 的费用是多少?
在 TokenLab 上,Claude Opus 4.6 的价格为 输入 $1.50 / 输出 $7.50 每 1M token。完整明细见上方价格表。 价格因计费单位、规格和用量而异。请在模型的详细定价中对比相同条件下的费率;单一费率不代表总价。
Claude Opus 4.6 的上下文窗口和输出上限是多少?
Claude Opus 4.6 最多接收 1,000,000 token 的上下文,单次最多返回 128,000 token。
Claude Opus 4.6 应该使用哪个端点?
Claude Opus 4.6 使用 https://api.tokenlab.sh/v1/messages。代码写法见下方的请求示例。
Claude Opus 4.6 支持哪些操作?
Claude Opus 4.6 支持 文本生成。选了操作,上面会显示对应的端点和请求示例。
Claude Opus 4.6 对比
资料来源
审阅于 2026年10月2日