- 输入 / 输出
- $0.60 / $2.40
- 上下文
- 205K
- 最大输出
- 64K
- 模态
- 聊天
- 能力
- 工具调用提示词缓存
MiniMax-M2.5-highspeed 简介
MiniMax-M2.5-highspeed 是 MiniMax-M2.5 的更快服务选项,M2.5 是 2026 年 2 月发布、针对编程、工具调用、搜索和办公效率调校的模型。MiniMax 表示 M2.5 与其 highspeed 版本结果相同,只是 highspeed 跑得更快。它支持推理、工具调用和提示词缓存,面向低延迟的编程和智能体工作流。
擅长的任务
- MiniMax 称 highspeed 版本结果与 M2.5 一致,生成更快。
- M2.5 面向编程、工具调用和搜索,也覆盖办公效率类工作。
- 推理、工具调用和提示词缓存都可用。
- M2.5 的权重公开发布,可以拿自行部署的副本来核对行为。
什么情况换别的模型
- 仅支持文本输入,图表和照片必须用文字描述。
- 与 M2.1 不同,没有响应 schema 模式;结构化输出要靠提示词和你自己代码里的校验。
快速上手
创建 API 密钥
在 Console 生成一把密钥,平台上的模型都能用。
发送第一个请求
复制你所用语言的示例代码,向该端点发起请求。
文本生成Responses APIPOST/v1/responsesAPI 格式:curl https://api.tokenlab.sh/v1/responses \ -H "Content-Type: application/json" \ -H "Authorization: Bearer sk-xxx" \ -d '{ "model": "minimax-m2.5-highspeed", "input": "Hello!" }'
价格
Verified 价格用于 Verified,多数模型更便宜;Official 价格是模型厂商公布的价格,用于更稳定的 Official。Auto 按最终完成请求的线路计价。
默认规格
每 1M token- Official 价格
- 输入 $0.60 / 输出 $2.40 / 缓存读取 $0.03 / 缓存写入 $0.375
- Verified 价格
- —
- 折扣
- —
缓存读取
- Official 价格
- $0.03
- Verified 价格
- —
- 折扣
- —
缓存写入
- Official 价格
- $0.375
- Verified 价格
- —
- 折扣
- —
| Official 价格每 1M token | Verified 价格每 1M token | 折扣 | |
|---|---|---|---|
| 默认规格 | 输入 $0.60 / 输出 $2.40 / 缓存读取 $0.03 / 缓存写入 $0.375 | — | — |
| 提示词缓存价格 | |||
| 缓存读取 | $0.03 | — | — |
| 缓存写入 | $0.375 | — | — |
用量与动态
成功率是请求完成的比例;延迟是拿到一次完整响应要花的时间,P95 表示 95% 的请求都在这个时间内完成。
用量与可用性
最近 24 小时- 请求
- 成功率
- P95 延迟
- 总 token 数
数据来自汇总的用户请求,不含状态检查。
直接在 Console 里试
MiniMax-M2.5-highspeed 已在 Console 备好,提示词已填好,可以直接修改或发送。
帮我用 minimax-m2.5-highspeed 发一条简短消息,接口是 /v1/responses。返回回复,附上延迟和费用。
使用场景
低延迟编程智能体
智能体在读取文件、运行命令和修改计划时保持响应迅速。
搜索与工具流水线
串联网络或数据库工具,每一步模型调用都在等检索结果。
办公任务自动化
起草和修改表格、报告或幻灯片文字,需要快速地来回好几轮。
提示词示例
在仓库里搜索所有用到已弃用客户端的地方,列出文件,并修补其中最简单的几处。
按主题总结本季度的工单,然后为周报起草三条要点。
对列表中的每个 SKU 调用 lookup_price,并报告哪些发生了变化。
此模型按条件计价,仅凭月度 token 总量无法可靠估算;请按请求规格、缓存和适用时段查看详细定价。
FAQ
M2.5-highspeed 和 M2.5 有什么区别?
MiniMax 称两者能力相同,只是速度不同。交互式循环或智能体里各步骤之间的延迟很重要时,用 highspeed 版本。
M2.5 是为什么而做的?
MiniMax 的发布说明称,它在编程、工具调用和搜索、办公效率上取得了领先的结果。它是通用的智能体模型,而不只是编程模型。
它支持结构化 JSON schema 输出吗?
这个模型没有提供响应 schema,但支持工具调用。如果需要严格类型的输出,请在你的代码里校验,或使用带 schema 输出的 M2.1。
它是开源的吗?
M2.5 的权重发布在 Hugging Face 的 MiniMaxAI 下。highspeed 这个名字指的是模型的服务方式和回答速度,而不是另一个模型。
该用 M2.5-highspeed 还是 M2.7-highspeed?
想要技能(skills)和动态工具搜索这类更新的智能体功能,试 M2.7-highspeed。如果你的提示词已针对 M2.5-highspeed 调好、结果稳定,就继续用它。
MiniMax-M2.5-highspeed 的费用是多少?
在 TokenLab 上,MiniMax-M2.5-highspeed 的价格为 输入 $0.60 / 输出 $2.40 每 1M token。完整明细见上方价格表。 价格因计费单位、规格和用量而异。请在模型的详细定价中对比相同条件下的费率;单一费率不代表总价。
MiniMax-M2.5-highspeed 的上下文窗口和输出上限是多少?
MiniMax-M2.5-highspeed 最多接收 204,800 token 的上下文,单次最多返回 65,536 token。
MiniMax-M2.5-highspeed 应该使用哪个端点?
MiniMax-M2.5-highspeed 使用 https://api.tokenlab.sh/v1/responses。代码写法见下方的请求示例。
MiniMax-M2.5-highspeed 支持哪些操作?
MiniMax-M2.5-highspeed 支持 文本生成。选了操作,上面会显示对应的端点和请求示例。
MiniMax-M2.5-highspeed 对比
资料来源
审阅于 2026年10月2日