MiniMax: MiniMax-M2.5-highspeed
minimax-m2.5-highspeed- Đầu vào / Đầu ra
- $0.60 / $2.40
- Ngữ cảnh
- 205K
- Độ dài đầu ra tối đa
- 64K
- Phương thức
- Trò chuyện
- Khả năng
- Sử dụng công cụBộ nhớ đệm Prompt
Về MiniMax-M2.5-highspeed
MiniMax-M2.5-highspeed là tùy chọn phục vụ nhanh hơn của MiniMax-M2.5, mô hình ra mắt tháng 2 năm 2026 được tinh chỉnh cho lập trình, gọi công cụ, tìm kiếm và năng suất văn phòng. MiniMax cho biết M2.5 và phiên bản highspeed của nó cho kết quả giống hệt nhau, với phiên bản highspeed chạy nhanh hơn. Nó có khả năng suy luận, gọi công cụ và lưu trữ bộ nhớ đệm (caching) cho các câu lệnh, hướng tới các quy trình làm việc của tác nhân (agent) và lập trình có độ trễ thấp.
Ưu điểm
- MiniMax cho biết phiên bản highspeed mang lại kết quả tương đương với M2.5 trong khi tạo phản hồi nhanh hơn.
- M2.5 nhắm đến việc lập trình, gọi công cụ, tìm kiếm và các công việc năng suất văn phòng.
- Các tính năng suy luận, sử dụng công cụ và lưu trữ bộ nhớ đệm câu lệnh đều được hỗ trợ.
- Trọng số của M2.5 được công bố công khai, vì vậy hành vi có thể được kiểm tra dựa trên bản sao tự lưu trữ.
Khi nào nên chọn model khác
- Chỉ hỗ trợ đầu vào văn bản, vì vậy sơ đồ và ảnh phải được mô tả bằng lời.
- Không có chế độ response-schema (lược đồ phản hồi) như M2.1; đầu ra có cấu trúc dựa vào việc đặt câu lệnh (prompting) và xác thực trong mã nguồn của bạn.
Bắt đầu
Tạo API key
Tạo API key trong Console để dùng cho mọi mô hình trên nền tảng.
Gửi yêu cầu đầu tiên của bạn
Sao chép ví dụ cho ngôn ngữ của bạn và chạy nó với endpoint.
Văn bản sang văn bảnResponses APIPOST/v1/responsesĐịnh dạng API:curl https://api.tokenlab.sh/v1/responses \ -H "Content-Type: application/json" \ -H "Authorization: Bearer sk-xxx" \ -d '{ "model": "minimax-m2.5-highspeed", "input": "Hello!" }'
Giá
Giá Verified áp dụng cho Verified, thường rẻ hơn trên hầu hết các model. Giá Official là giá niêm yết từ nhà phát triển, áp dụng cho route Official ổn định hơn. Auto sẽ tính phí dựa trên route hoàn thành yêu cầu.
Thông số mặc định
mỗi 1M token- Giá Official
- Đầu vào $0.60 / Đầu ra $2.40 / Đọc bộ nhớ đệm $0.03 / Ghi bộ nhớ đệm $0.375
- Giá Verified
- —
- Giảm giá
- —
Đọc bộ nhớ đệm
- Giá Official
- $0.03
- Giá Verified
- —
- Giảm giá
- —
Ghi bộ nhớ đệm
- Giá Official
- $0.375
- Giá Verified
- —
- Giảm giá
- —
| Giá Officialmỗi 1M token | Giá Verifiedmỗi 1M token | Giảm giá | |
|---|---|---|---|
| Thông số mặc định | Đầu vào $0.60 / Đầu ra $2.40 / Đọc bộ nhớ đệm $0.03 / Ghi bộ nhớ đệm $0.375 | — | — |
| Giá cache của prompt | |||
| Đọc bộ nhớ đệm | $0.03 | — | — |
| Ghi bộ nhớ đệm | $0.375 | — | — |
Sử dụng & hoạt động
Tỷ lệ thành công là tỷ lệ yêu cầu hoàn tất. Độ trễ là thời gian của một phản hồi đầy đủ; P95 nghĩa là 95% yêu cầu hoàn thành trong khoảng thời gian đó.
Mức sử dụng & tình trạng
24 giờ qua- Yêu cầu
- Tỷ lệ thành công
- Độ trễ P95
- Tổng token
Dữ liệu dựa trên các yêu cầu tổng hợp của người dùng, không bao gồm các kiểm tra trạng thái.
Mở trong Console
Mở MiniMax-M2.5-highspeed trong Console để chỉnh sửa và gửi prompt ngay.
Giúp tôi thử minimax-m2.5-highspeed với tin nhắn ngắn tại /v1/responses. Hiển thị phản hồi, độ trễ và chi phí.
Tình huống sử dụng
Các tác nhân lập trình có độ trễ thấp
Giữ cho tác nhân phản hồi nhanh trong khi nó đọc tệp, chạy lệnh và sửa đổi kế hoạch của mình.
Các quy trình tìm kiếm và công cụ
Kết nối các công cụ web hoặc cơ sở dữ liệu nơi mỗi bước của mô hình chờ đợi kết quả truy xuất.
Tự động hóa tác vụ văn phòng
Soạn thảo và sửa đổi bảng tính, báo cáo hoặc văn bản slide khi cần thực hiện nhiều vòng nhanh.
Ví dụ prompt
Tìm kiếm trong kho lưu trữ mọi cách sử dụng của client đã lỗi thời, liệt kê các tệp và vá những tệp đơn giản nhất.
Tóm tắt các phiếu yêu cầu (ticket) của quý này theo chủ đề, sau đó soạn thảo ba gạch đầu dòng cho bản cập nhật hàng tuần.
Gọi lookup_price cho mỗi SKU trong danh sách và báo cáo bất kỳ SKU nào đã thay đổi.
Mô hình này có giá theo điều kiện. Chỉ tổng token hàng tháng không thể tạo ước tính đáng tin cậy; hãy dùng bảng giá chi tiết theo thông số yêu cầu, bộ nhớ đệm và khung giờ áp dụng.
FAQ
M2.5-highspeed khác gì so với M2.5?
MiniMax mô tả hai mô hình này có khả năng giống hệt nhau, chỉ khác biệt về tốc độ. Hãy sử dụng phiên bản highspeed khi độ trễ giữa các bước quan trọng trong một vòng lặp tương tác hoặc tác nhân.
M2.5 được xây dựng để làm gì?
Ghi chú phát hành của MiniMax cho biết nó đạt kết quả hàng đầu trong lập trình, gọi công cụ, tìm kiếm và năng suất văn phòng. Đây là một mô hình tác nhân tổng quát thay vì chỉ dành riêng cho lập trình.
Nó có hỗ trợ đầu ra lược đồ JSON có cấu trúc không?
Không có lược đồ phản hồi nào được cung cấp cho mô hình này, mặc dù việc sử dụng công cụ được hỗ trợ. Nếu bạn cần đầu ra có kiểu dữ liệu nghiêm ngặt, hãy xác thực nó trong mã của bạn hoặc sử dụng M2.1, vốn có hỗ trợ đầu ra lược đồ.
Nó có phải là mã nguồn mở không?
Trọng số của M2.5 được công bố trên Hugging Face dưới tên MiniMaxAI. Tên highspeed đề cập đến cách mô hình được phục vụ và tốc độ trả lời, không phải là một mô hình khác.
Tôi nên sử dụng M2.5-highspeed hay M2.7-highspeed?
Hãy thử M2.7-highspeed cho các tính năng tác nhân mới hơn như kỹ năng và tìm kiếm công cụ động. Giữ lại M2.5-highspeed nếu các câu lệnh của bạn đã được tinh chỉnh cho nó và kết quả ổn định.
MiniMax-M2.5-highspeed có giá bao nhiêu?
Trên TokenLab, MiniMax-M2.5-highspeed có giá Đầu vào $0.60 / Đầu ra $2.40 mỗi 1M token. Bảng giá phía trên cho thấy chi tiết đầy đủ. Giá phụ thuộc vào đơn vị tính phí, thông số và mức sử dụng. Hãy so sánh các điều kiện tương đương trong bảng giá chi tiết của mô hình; một mức giá đơn lẻ không quyết định tổng chi phí.
Giới hạn ngữ cảnh và đầu ra của MiniMax-M2.5-highspeed là bao nhiêu?
MiniMax-M2.5-highspeed hỗ trợ tối đa 204.800 token ngữ cảnh và trả về tối đa 65.536 token mỗi phản hồi.
MiniMax-M2.5-highspeed nên dùng endpoint nào?
Dùng https://api.tokenlab.sh/v1/responses làm mặc định cho MiniMax-M2.5-highspeed. Nếu mô hình hỗ trợ định dạng native của nhà cung cấp, API workbench cũng hiển thị endpoint đó.
MiniMax-M2.5-highspeed hỗ trợ những thao tác nào?
MiniMax-M2.5-highspeed hỗ trợ Văn bản sang văn bản. Chọn một thao tác trong API workbench phía trên để xem endpoint và mã ví dụ tương ứng.
So sánh MiniMax-M2.5-highspeed
Nguồn
Đánh giá ngày 2 thg 10, 2026