Anthropic: Claude Opus 4.8
claude-opus-4-8- 输入 / 输出-70%
- $5.00 / $25.00$1.50 / $7.50
- 上下文
- 1M
- 发布日期
- 2026年5月28日
- 最大输出
- 128K
- 模态
- 视觉聊天
- 能力
- 工具调用提示词缓存推理
Claude Opus 4.8 简介
Claude Opus 4.8 是 Anthropic 在 2026 年 5 月 28 日发布的 Opus 级模型,在产品线中介于 Opus 4.7 和 Opus 5 之间。它负责同代中最难的推理、编程和长周期智能体任务,支持自适应思考、图像输入和工具调用。Anthropic 把它列为旧版,新项目建议用 Opus 5.5。
擅长的任务
- 自适应思考,默认推理强度较高,难题无需手动设置 token 预算也能得到推理。
- 接受文本和图像输入,输出文本,覆盖智能体循环中的截图审查和图表问答。
- 使用 Opus 4.7 引入的分词器,token 数与后来的 Claude 模型比与 Opus 4.6 更接近。
- Fable 5 拒绝的请求会回退到这个模型,所以 Anthropic 把它视为 Fable 之下最强的安全通用模型。
什么情况换别的模型
- Opus 5 在 Anthropic 公布的评测中好得多,新项目很难有理由选 4.8。
- 可靠的知识截止日期是 2026 年 1 月,比 Opus 5.5 和 Sonnet 5.5 更早。
- Anthropic 将它标为旧版,并明确建议迁移到 Opus 5.5。
快速上手
创建 API 密钥
在 Console 生成一把密钥,平台上的模型都能用。
发送第一个请求
复制你所用语言的示例代码,向该端点发起请求。
文本生成Messages APIPOST/v1/messagesAPI 格式:curl https://api.tokenlab.sh/v1/messages \ -H "Content-Type: application/json" \ -H "x-api-key: sk-xxx" \ -H "anthropic-version: 2023-06-01" \ -d '{ "model": "claude-opus-4-8", "max_tokens": 1024, "messages": [ {"role": "user", "content": "Hello!"} ] }'
价格
TokenLab 价格用于 Verified,多数模型更便宜;官方价格是模型厂商公布的价格,用于更稳定的 Official。Auto 按最终完成请求的线路计价。
默认规格
每 1M token- 官方价格
- 输入 $5.00 / 输出 $25.00 / 缓存读取 $0.50 / 缓存写入 $6.25
- TokenLab 价格
- 输入 $1.50 / 输出 $7.50 / 缓存读取 $0.15 / 缓存写入 $1.88
- 折扣
- -70%
缓存读取
- 官方价格
- $0.50
- TokenLab 价格
- $0.15
- 折扣
- -70%
缓存写入
- 官方价格
- $6.25
- TokenLab 价格
- $1.88
- 折扣
- -70%
按次计费,仅在模型实际使用工具时收取。
网页搜索
- 官方价格
- $0.01/次搜索
- TokenLab 价格
- $0.003/次搜索
- 折扣
- -70%
| 官方价格每 1M token | TokenLab 价格每 1M token | 折扣 | |
|---|---|---|---|
| 默认规格 | 输入 $5.00 / 输出 $25.00 / 缓存读取 $0.50 / 缓存写入 $6.25 | 输入 $1.50 / 输出 $7.50 / 缓存读取 $0.15 / 缓存写入 $1.88 | -70% |
| 提示词缓存价格 | |||
| 缓存读取 | $0.50 | $0.15 | -70% |
| 缓存写入 | $6.25 | $1.88 | -70% |
| 工具附加费按次计费,仅在模型实际使用工具时收取。 | |||
| 网页搜索 | $0.01/次搜索 | $0.003/次搜索 | -70% |
用量与动态
成功率是请求完成的比例;延迟是拿到一次完整响应要花的时间,P95 表示 95% 的请求都在这个时间内完成。
用量与可用性
最近 24 小时- 请求
- 成功率
- P95 延迟
- 总 token 数
- 30 天成功率
- 100.0%
- 30 天请求数
- 100+
- 最后活动时间
- 3天前
数据来自汇总的用户请求,不含状态检查。
直接在 Console 里试
Claude Opus 4.8 已在 Console 备好,提示词已填好,可以直接修改或发送。
帮我用 claude-opus-4-8 发一条简短消息,接口是 /v1/messages。返回回复,附上延迟和费用。
使用场景
适用场景- 推理
- 视觉
现有智能体流程
让已验证的编程或研究智能体固定在这个模型版本上,同时安排迁移到 Opus 5.5 并重新运行自己的评测。
回退目标
向 Fable 模型的请求被安全分类器拒绝、但仍需要高质量回答时,用它作为重试模型。
深度代码审查
对大型 diff 做长时间审查,要求给出按风险排序的问题、缺失的测试,以及每个问题最小的安全修复。
提示词示例
检查这个模块里的竞态条件,并针对每一处说明触发它的具体执行交错顺序。
下面是我们的故障时间线和相关日志。请写一份根因分析,并列出后续改进事项。
规划替换这个计费库的分阶段上线方案,包括如何确认每个阶段都生效。
此模型按条件计价,仅凭月度 token 总量无法可靠估算;请按请求规格、缓存和适用时段查看详细定价。
FAQ
Claude Opus 4.8 在 Claude 模型中处于什么位置?
它是介于 4.7 和 Opus 5 之间的 Opus 版本,2026 年 5 月 28 日发布,面向 4.x 这一代中最难的推理和编程工作。Anthropic 现在把它列为旧版,并指出 Opus 5.5 是当前的 Opus。
Claude Opus 4.8 支持自适应思考吗?
支持。自适应思考就是它的思考模式,在 Anthropic API 上默认强度是 high。想要更快、更便宜的回合就降低 effort,漏掉边界情况代价高的任务就调高。
应该从 Opus 4.8 切换到 Opus 5.5 吗?
新项目建议切换:Anthropic 推荐 Opus 5.5,并发布了从 4.8 迁移的指南。只有依赖其确切行为的已验证流程才保留 4.8,注意 5.5 改变了思考和工具调用的规则。
Claude Opus 4.8 能读图吗?
能。它接受文本和图像输入,返回文本。它不能生成图像,需要出图时要另外搭配图像模型。
Claude Opus 4.8 的费用是多少?
在 TokenLab 上,Claude Opus 4.8 的价格为 输入 $1.50 / 输出 $7.50 每 1M token。完整明细见上方价格表。 价格因计费单位、规格和用量而异。请在模型的详细定价中对比相同条件下的费率;单一费率不代表总价。
Claude Opus 4.8 的上下文窗口和输出上限是多少?
Claude Opus 4.8 最多接收 1,000,000 token 的上下文,单次最多返回 128,000 token。
Claude Opus 4.8 应该使用哪个端点?
Claude Opus 4.8 使用 https://api.tokenlab.sh/v1/messages。代码写法见下方的请求示例。
Claude Opus 4.8 支持哪些操作?
Claude Opus 4.8 支持 文本生成。选了操作,上面会显示对应的端点和请求示例。
Claude Opus 4.8 对比
用到 Claude Opus 4.8 的指南
资料来源
审阅于 2026年10月2日