每次请求可选择 Auto、TokenLab Verified 或 Official,并查看对应价格。查看更新

MiniMax: MiniMax-M2.5-highspeed

高速 MiniMax 模型,面向低延迟编程与智能体工作流
对比模型
minimax-m2.5-highspeed
可用MiniMax聊天
输入 / 输出
$0.60 / $2.40
上下文
205K
最大输出
64K
模态
聊天
能力
工具调用提示词缓存

MiniMax-M2.5-highspeed 简介

MiniMax-M2.5-highspeed 是 MiniMax-M2.5 的更快服务选项,M2.5 是 2026 年 2 月发布、针对编程、工具调用、搜索和办公效率调校的模型。MiniMax 表示 M2.5 与其 highspeed 版本结果相同,只是 highspeed 跑得更快。它支持推理、工具调用和提示词缓存,面向低延迟的编程和智能体工作流。

擅长的任务

  • MiniMax 称 highspeed 版本结果与 M2.5 一致,生成更快。
  • M2.5 面向编程、工具调用和搜索,也覆盖办公效率类工作。
  • 推理、工具调用和提示词缓存都可用。
  • M2.5 的权重公开发布,可以拿自行部署的副本来核对行为。

什么情况换别的模型

  • 仅支持文本输入,图表和照片必须用文字描述。
  • 与 M2.1 不同,没有响应 schema 模式;结构化输出要靠提示词和你自己代码里的校验。

快速上手

  1. 创建 API 密钥

    在 Console 生成一把密钥,平台上的模型都能用。

  2. 发送第一个请求

    复制你所用语言的示例代码,向该端点发起请求。

    文本生成Responses API
    POST/v1/responses
    API 格式:
    curl https://api.tokenlab.sh/v1/responses \
      -H "Content-Type: application/json" \
      -H "Authorization: Bearer sk-xxx" \
      -d '{
        "model": "minimax-m2.5-highspeed",
        "input": "Hello!"
      }'

价格

Verified 价格用于 Verified,多数模型更便宜;Official 价格是模型厂商公布的价格,用于更稳定的 Official。Auto 按最终完成请求的线路计价。

默认规格

每 1M token
Official 价格
输入 $0.60 / 输出 $2.40 / 缓存读取 $0.03 / 缓存写入 $0.375
Verified 价格
—
折扣
—
提示词缓存价格

缓存读取

Official 价格
$0.03
Verified 价格
—
折扣
—

缓存写入

Official 价格
$0.375
Verified 价格
—
折扣
—

用量与动态

成功率是请求完成的比例;延迟是拿到一次完整响应要花的时间,P95 表示 95% 的请求都在这个时间内完成。

用量与可用性

最近 24 小时
请求
成功率
P95 延迟
总 token 数
模型表现
达到隐私和数据量阈值后,指标才会显示。

数据来自汇总的用户请求,不含状态检查。

直接在 Console 里试

MiniMax-M2.5-highspeed 已在 Console 备好,提示词已填好,可以直接修改或发送。

帮我用 minimax-m2.5-highspeed 发一条简短消息,接口是 /v1/responses。返回回复,附上延迟和费用。

使用场景

  • 低延迟编程智能体

    智能体在读取文件、运行命令和修改计划时保持响应迅速。

  • 搜索与工具流水线

    串联网络或数据库工具,每一步模型调用都在等检索结果。

  • 办公任务自动化

    起草和修改表格、报告或幻灯片文字,需要快速地来回好几轮。

提示词示例

在仓库里搜索所有用到已弃用客户端的地方,列出文件,并修补其中最简单的几处。

按主题总结本季度的工单,然后为周报起草三条要点。

对列表中的每个 SKU 调用 lookup_price,并报告哪些发生了变化。

此模型按条件计价,仅凭月度 token 总量无法可靠估算;请按请求规格、缓存和适用时段查看详细定价。

FAQ

M2.5-highspeed 和 M2.5 有什么区别?

MiniMax 称两者能力相同,只是速度不同。交互式循环或智能体里各步骤之间的延迟很重要时,用 highspeed 版本。

M2.5 是为什么而做的?

MiniMax 的发布说明称,它在编程、工具调用和搜索、办公效率上取得了领先的结果。它是通用的智能体模型,而不只是编程模型。

它支持结构化 JSON schema 输出吗?

这个模型没有提供响应 schema,但支持工具调用。如果需要严格类型的输出,请在你的代码里校验,或使用带 schema 输出的 M2.1。

它是开源的吗?

M2.5 的权重发布在 Hugging Face 的 MiniMaxAI 下。highspeed 这个名字指的是模型的服务方式和回答速度,而不是另一个模型。

该用 M2.5-highspeed 还是 M2.7-highspeed?

想要技能(skills)和动态工具搜索这类更新的智能体功能,试 M2.7-highspeed。如果你的提示词已针对 M2.5-highspeed 调好、结果稳定,就继续用它。

MiniMax-M2.5-highspeed 的费用是多少?

在 TokenLab 上,MiniMax-M2.5-highspeed 的价格为 输入 $0.60 / 输出 $2.40 每 1M token。完整明细见上方价格表。 价格因计费单位、规格和用量而异。请在模型的详细定价中对比相同条件下的费率;单一费率不代表总价。

MiniMax-M2.5-highspeed 的上下文窗口和输出上限是多少?

MiniMax-M2.5-highspeed 最多接收 204,800 token 的上下文,单次最多返回 65,536 token。

MiniMax-M2.5-highspeed 应该使用哪个端点?

MiniMax-M2.5-highspeed 使用 https://api.tokenlab.sh/v1/responses。代码写法见下方的请求示例。

MiniMax-M2.5-highspeed 支持哪些操作?

MiniMax-M2.5-highspeed 支持 文本生成。选了操作,上面会显示对应的端点和请求示例。

MiniMax-M2.5-highspeed 对比

资料来源

审阅于 2026年10月2日

更多 MiniMax 模型

相关模型