每次请求可选择 Auto、TokenLab Verified 或 Official,并查看对应价格。查看更新

Anthropic: Claude Opus 4.8

顶级 Claude Opus 档位,面向最高难度的推理、编程与长程智能体
对比模型
claude-opus-4-8
可用Anthropic聊天缓存输入便宜 90%新发布
输入 / 输出-70%
$5.00 / $25.00$1.50 / $7.50
上下文
1M
发布日期
2026年5月28日
最大输出
128K
模态
视觉聊天
能力
工具调用提示词缓存推理

Claude Opus 4.8 简介

Claude Opus 4.8 是 Anthropic 在 2026 年 5 月 28 日发布的 Opus 级模型,在产品线中介于 Opus 4.7 和 Opus 5 之间。它负责同代中最难的推理、编程和长周期智能体任务,支持自适应思考、图像输入和工具调用。Anthropic 把它列为旧版,新项目建议用 Opus 5.5。

擅长的任务

  • 自适应思考,默认推理强度较高,难题无需手动设置 token 预算也能得到推理。
  • 接受文本和图像输入,输出文本,覆盖智能体循环中的截图审查和图表问答。
  • 使用 Opus 4.7 引入的分词器,token 数与后来的 Claude 模型比与 Opus 4.6 更接近。
  • Fable 5 拒绝的请求会回退到这个模型,所以 Anthropic 把它视为 Fable 之下最强的安全通用模型。

什么情况换别的模型

  • Opus 5 在 Anthropic 公布的评测中好得多,新项目很难有理由选 4.8。
  • 可靠的知识截止日期是 2026 年 1 月,比 Opus 5.5 和 Sonnet 5.5 更早。
  • Anthropic 将它标为旧版,并明确建议迁移到 Opus 5.5。

快速上手

  1. 创建 API 密钥

    在 Console 生成一把密钥,平台上的模型都能用。

  2. 发送第一个请求

    复制你所用语言的示例代码,向该端点发起请求。

    文本生成Messages API
    POST/v1/messages
    API 格式:
    curl https://api.tokenlab.sh/v1/messages \
      -H "Content-Type: application/json" \
      -H "x-api-key: sk-xxx" \
      -H "anthropic-version: 2023-06-01" \
      -d '{
        "model": "claude-opus-4-8",
        "max_tokens": 1024,
        "messages": [
          {"role": "user", "content": "Hello!"}
        ]
      }'

价格

TokenLab 价格用于 Verified,多数模型更便宜;官方价格是模型厂商公布的价格,用于更稳定的 Official。Auto 按最终完成请求的线路计价。

默认规格

每 1M token
官方价格
输入 $5.00 / 输出 $25.00 / 缓存读取 $0.50 / 缓存写入 $6.25
TokenLab 价格
输入 $1.50 / 输出 $7.50 / 缓存读取 $0.15 / 缓存写入 $1.88
折扣
-70%
提示词缓存价格

缓存读取

官方价格
$0.50
TokenLab 价格
$0.15
折扣
-70%

缓存写入

官方价格
$6.25
TokenLab 价格
$1.88
折扣
-70%
工具附加费

按次计费,仅在模型实际使用工具时收取。

网页搜索

官方价格
$0.01/次搜索
TokenLab 价格
$0.003/次搜索
折扣
-70%

用量与动态

成功率是请求完成的比例;延迟是拿到一次完整响应要花的时间,P95 表示 95% 的请求都在这个时间内完成。

用量与可用性

最近 24 小时
请求
成功率
P95 延迟
总 token 数
模型表现
30 天成功率
100.0%
30 天请求数
100+
最后活动时间
3天前

数据来自汇总的用户请求,不含状态检查。

直接在 Console 里试

Claude Opus 4.8 已在 Console 备好,提示词已填好,可以直接修改或发送。

帮我用 claude-opus-4-8 发一条简短消息,接口是 /v1/messages。返回回复,附上延迟和费用。

使用场景

适用场景
  • 推理
  • 视觉
  • 现有智能体流程

    让已验证的编程或研究智能体固定在这个模型版本上,同时安排迁移到 Opus 5.5 并重新运行自己的评测。

  • 回退目标

    向 Fable 模型的请求被安全分类器拒绝、但仍需要高质量回答时,用它作为重试模型。

  • 深度代码审查

    对大型 diff 做长时间审查,要求给出按风险排序的问题、缺失的测试,以及每个问题最小的安全修复。

提示词示例

检查这个模块里的竞态条件,并针对每一处说明触发它的具体执行交错顺序。

下面是我们的故障时间线和相关日志。请写一份根因分析,并列出后续改进事项。

规划替换这个计费库的分阶段上线方案,包括如何确认每个阶段都生效。

此模型按条件计价,仅凭月度 token 总量无法可靠估算;请按请求规格、缓存和适用时段查看详细定价。

FAQ

Claude Opus 4.8 在 Claude 模型中处于什么位置?

它是介于 4.7 和 Opus 5 之间的 Opus 版本,2026 年 5 月 28 日发布,面向 4.x 这一代中最难的推理和编程工作。Anthropic 现在把它列为旧版,并指出 Opus 5.5 是当前的 Opus。

Claude Opus 4.8 支持自适应思考吗?

支持。自适应思考就是它的思考模式,在 Anthropic API 上默认强度是 high。想要更快、更便宜的回合就降低 effort,漏掉边界情况代价高的任务就调高。

应该从 Opus 4.8 切换到 Opus 5.5 吗?

新项目建议切换:Anthropic 推荐 Opus 5.5,并发布了从 4.8 迁移的指南。只有依赖其确切行为的已验证流程才保留 4.8,注意 5.5 改变了思考和工具调用的规则。

Claude Opus 4.8 能读图吗?

能。它接受文本和图像输入,返回文本。它不能生成图像,需要出图时要另外搭配图像模型。

Claude Opus 4.8 的费用是多少?

在 TokenLab 上,Claude Opus 4.8 的价格为 输入 $1.50 / 输出 $7.50 每 1M token。完整明细见上方价格表。 价格因计费单位、规格和用量而异。请在模型的详细定价中对比相同条件下的费率;单一费率不代表总价。

Claude Opus 4.8 的上下文窗口和输出上限是多少?

Claude Opus 4.8 最多接收 1,000,000 token 的上下文,单次最多返回 128,000 token。

Claude Opus 4.8 应该使用哪个端点?

Claude Opus 4.8 使用 https://api.tokenlab.sh/v1/messages。代码写法见下方的请求示例。

Claude Opus 4.8 支持哪些操作?

Claude Opus 4.8 支持 文本生成。选了操作,上面会显示对应的端点和请求示例。

Claude Opus 4.8 对比

用到 Claude Opus 4.8 的指南

资料来源

审阅于 2026年10月2日

更多 Claude 4 模型

相关模型