MiniMax: MiniMax-M2.1-highspeed
minimax-m2.1-highspeed- 输入 / 输出
- $0.60 / $2.40
- 上下文
- 205K
- 最大输出
- 128K
- 模态
- 聊天
- 能力
- 工具调用提示词缓存
MiniMax-M2.1-highspeed 简介
MiniMax-M2.1-highspeed 是 MiniMax 的 M2.1 模型面向速度的版本,用于编程和工具辅助的任务。它适合交互式智能体循环:应用在生成的指令、工具结果和下一次回复之间来回切换。它保留了 M2.1 的推理、工具调用、JSON 模式和 schema 输出,功能上没有取舍,只是每一轮更快。
擅长的任务
- 为“模型回答、工具运行、模型再回答”的循环设计,每一轮的延迟都会累加。
- 保留 M2.1 的 JSON 模式和 schema 约束输出。
- 某一步需要时可以使用推理。
- 同时支持工具调用和提示词缓存。
什么情况换别的模型
- 仅支持文本,不能发送截图或其他图片。
- M2.5-highspeed 和 M2.7-highspeed 是后来的快速版本,可能更适合新建的项目。
快速上手
创建 API 密钥
在 Console 生成一把密钥,平台上的模型都能用。
发送第一个请求
复制你所用语言的示例代码,向该端点发起请求。
文本生成Responses APIPOST/v1/responsesAPI 格式:curl https://api.tokenlab.sh/v1/responses \ -H "Content-Type: application/json" \ -H "Authorization: Bearer sk-xxx" \ -d '{ "model": "minimax-m2.1-highspeed", "input": "Hello!" }'
价格
Verified 价格用于 Verified,多数模型更便宜;Official 价格是模型厂商公布的价格,用于更稳定的 Official。Auto 按最终完成请求的线路计价。
默认规格
每 1M token- Official 价格
- 输入 $0.60 / 输出 $2.40 / 缓存读取 $0.03 / 缓存写入 $0.375
- Verified 价格
- —
- 折扣
- —
缓存读取
- Official 价格
- $0.03
- Verified 价格
- —
- 折扣
- —
缓存写入
- Official 价格
- $0.375
- Verified 价格
- —
- 折扣
- —
| Official 价格每 1M token | Verified 价格每 1M token | 折扣 | |
|---|---|---|---|
| 默认规格 | 输入 $0.60 / 输出 $2.40 / 缓存读取 $0.03 / 缓存写入 $0.375 | — | — |
| 提示词缓存价格 | |||
| 缓存读取 | $0.03 | — | — |
| 缓存写入 | $0.375 | — | — |
用量与动态
成功率是请求完成的比例;延迟是拿到一次完整响应要花的时间,P95 表示 95% 的请求都在这个时间内完成。
用量与可用性
最近 24 小时- 请求
- 成功率
- P95 延迟
- 总 token 数
数据来自汇总的用户请求,不含状态检查。
直接在 Console 里试
MiniMax-M2.1-highspeed 已在 Console 备好,提示词已填好,可以直接修改或发送。
帮我用 minimax-m2.1-highspeed 发一条简短消息,接口是 /v1/responses。返回回复,附上延迟和费用。
使用场景
交互式编程助手
驱动编辑器内的助手,它在读取和修改文件时,要对每条指令快速作出回应。
步骤很多很短的智能体循环
运行“规划、调用工具、读取结果”的循环,模型延迟占任务总耗时的大头。
在线应用中的结构化回复
向正在等待回复的前端返回符合 schema 的 JSON。
提示词示例
打开 utils/date.ts,找到时区缺陷并修复。然后运行测试,只汇报失败项。
根据这些工具结果,决定下一步唯一的动作,以 JSON 输出,字段为 action 和 args。
在列出的这些文件中重命名这个函数,并给出每个文件的 diff。
此模型按条件计价,仅凭月度 token 总量无法可靠估算;请按请求规格、缓存和适用时段查看详细定价。
FAQ
MiniMax-M2.1 的 highspeed 版本是什么?
同一个 M2.1 世代,作为面向速度的选项,用于编程和工具辅助的任务。交互式智能体各步骤之间的延迟很重要时,选它。
与 M2.1 相比,它会损失功能吗?
不会。它保留了 M2.1 的推理、工具调用、提示词缓存、JSON 模式和响应 schema 功能集,变化只在每一轮的速度。在你自己的任务上,质量仍然值得测试。
可以用它做结构化输出吗?
可以。JSON 模式和响应 schema 都标明支持,所以你可以要求固定格式的输出,并在应用中解析。
有更新的 MiniMax 快速模型吗?
有。MiniMax 后来推出了 M2.5-highspeed 和 M2.7-highspeed 作为更快的选项。如果是新项目而不是保留已有集成,请在自己的任务上对比它们。
它支持图片吗?
不支持。它没有图片输入,只读写文本。提示词需要理解图片或视频时,请选 MiniMax M3。只需输入文本提示词和工具结果。
MiniMax-M2.1-highspeed 的费用是多少?
在 TokenLab 上,MiniMax-M2.1-highspeed 的价格为 输入 $0.60 / 输出 $2.40 每 1M token。完整明细见上方价格表。 价格因计费单位、规格和用量而异。请在模型的详细定价中对比相同条件下的费率;单一费率不代表总价。
MiniMax-M2.1-highspeed 的上下文窗口和输出上限是多少?
MiniMax-M2.1-highspeed 最多接收 204,800 token 的上下文,单次最多返回 131,072 token。
MiniMax-M2.1-highspeed 应该使用哪个端点?
MiniMax-M2.1-highspeed 使用 https://api.tokenlab.sh/v1/responses。代码写法见下方的请求示例。
MiniMax-M2.1-highspeed 支持哪些操作?
MiniMax-M2.1-highspeed 支持 文本生成。选了操作,上面会显示对应的端点和请求示例。
MiniMax-M2.1-highspeed 对比
资料来源
审阅于 2026年10月2日