MiniMax: MiniMax-M2.1-highspeed
minimax-m2.1-highspeed- Đầu vào / Đầu ra
- $0.60 / $2.40
- Ngữ cảnh
- 205K
- Độ dài đầu ra tối đa
- 128K
- Phương thức
- Trò chuyện
- Khả năng
- Sử dụng công cụBộ nhớ đệm Prompt
Về MiniMax-M2.1-highspeed
MiniMax-M2.1-highspeed là phiên bản tập trung vào tốc độ của mô hình M2.1 từ MiniMax dành cho các tác vụ lập trình và hỗ trợ bằng công cụ. Nó phù hợp với các vòng lặp tác nhân tương tác, nơi ứng dụng luân phiên giữa các hướng dẫn được tạo, kết quả công cụ và phản hồi tiếp theo. Nó giữ nguyên khả năng suy luận, sử dụng công cụ, chế độ JSON và xuất lược đồ của M2.1 mà không đánh đổi bất kỳ tính năng nào để đạt được tốc độ phản hồi nhanh hơn.
Ưu điểm
- Dành cho các vòng lặp mà tại đó mô hình phản hồi, một công cụ chạy, và mô hình phản hồi lần nữa, vì vậy độ trễ của mỗi lượt sẽ cộng dồn.
- Giữ nguyên chế độ JSON và đầu ra bị ràng buộc bởi lược đồ của M2.1.
- Khả năng suy luận luôn sẵn sàng khi một bước cần đến nó.
- Hỗ trợ cả việc sử dụng công cụ và bộ nhớ đệm prompt (prompt caching).
Khi nào nên chọn model khác
- Chỉ văn bản; ảnh chụp màn hình và các hình ảnh khác không thể được gửi.
- M2.5-highspeed và M2.7-highspeed là các biến thể nhanh ra mắt sau đó và có thể phù hợp hơn với các bản dựng mới.
Bắt đầu
Tạo API key
Tạo API key trong Console để dùng cho mọi mô hình trên nền tảng.
Gửi yêu cầu đầu tiên của bạn
Sao chép ví dụ cho ngôn ngữ của bạn và chạy nó với endpoint.
Văn bản sang văn bảnResponses APIPOST/v1/responsesĐịnh dạng API:curl https://api.tokenlab.sh/v1/responses \ -H "Content-Type: application/json" \ -H "Authorization: Bearer sk-xxx" \ -d '{ "model": "minimax-m2.1-highspeed", "input": "Hello!" }'
Giá
Giá Verified áp dụng cho Verified, thường rẻ hơn trên hầu hết các model. Giá Official là giá niêm yết từ nhà phát triển, áp dụng cho route Official ổn định hơn. Auto sẽ tính phí dựa trên route hoàn thành yêu cầu.
Thông số mặc định
mỗi 1M token- Giá Official
- Đầu vào $0.60 / Đầu ra $2.40 / Đọc bộ nhớ đệm $0.03 / Ghi bộ nhớ đệm $0.375
- Giá Verified
- —
- Giảm giá
- —
Đọc bộ nhớ đệm
- Giá Official
- $0.03
- Giá Verified
- —
- Giảm giá
- —
Ghi bộ nhớ đệm
- Giá Official
- $0.375
- Giá Verified
- —
- Giảm giá
- —
| Giá Officialmỗi 1M token | Giá Verifiedmỗi 1M token | Giảm giá | |
|---|---|---|---|
| Thông số mặc định | Đầu vào $0.60 / Đầu ra $2.40 / Đọc bộ nhớ đệm $0.03 / Ghi bộ nhớ đệm $0.375 | — | — |
| Giá cache của prompt | |||
| Đọc bộ nhớ đệm | $0.03 | — | — |
| Ghi bộ nhớ đệm | $0.375 | — | — |
Sử dụng & hoạt động
Tỷ lệ thành công là tỷ lệ yêu cầu hoàn tất. Độ trễ là thời gian của một phản hồi đầy đủ; P95 nghĩa là 95% yêu cầu hoàn thành trong khoảng thời gian đó.
Mức sử dụng & tình trạng
24 giờ qua- Yêu cầu
- Tỷ lệ thành công
- Độ trễ P95
- Tổng token
Dữ liệu dựa trên các yêu cầu tổng hợp của người dùng, không bao gồm các kiểm tra trạng thái.
Mở trong Console
Mở MiniMax-M2.1-highspeed trong Console để chỉnh sửa và gửi prompt ngay.
Giúp tôi thử minimax-m2.1-highspeed với tin nhắn ngắn tại /v1/responses. Hiển thị phản hồi, độ trễ và chi phí.
Tình huống sử dụng
Trợ lý lập trình tương tác
Cung cấp năng lượng cho một trình hỗ trợ trong trình soạn thảo cần phản hồi nhanh chóng với mỗi hướng dẫn trong khi đọc và chỉnh sửa tệp.
Các vòng lặp tác nhân với nhiều bước ngắn
Chạy các chu kỳ lập kế hoạch, gọi công cụ, đọc kết quả nơi độ trễ của mô hình chiếm ưu thế trong tổng thời gian tác vụ.
Phản hồi có cấu trúc trong các ứng dụng trực tiếp
Trả về JSON hợp lệ theo lược đồ cho giao diện người dùng đang chờ phản hồi.
Ví dụ prompt
Mở utils/date.ts, tìm lỗi múi giờ và vá nó. Sau đó chạy các bài kiểm tra và chỉ báo cáo các lỗi.
Dựa trên các kết quả công cụ này, hãy quyết định hành động đơn lẻ tiếp theo và xuất nó dưới dạng JSON với các trường action và args.
Đổi tên hàm trên các tệp được liệt kê và hiển thị diff cho mỗi tệp.
Mô hình này có giá theo điều kiện. Chỉ tổng token hàng tháng không thể tạo ước tính đáng tin cậy; hãy dùng bảng giá chi tiết theo thông số yêu cầu, bộ nhớ đệm và khung giờ áp dụng.
FAQ
Phiên bản tốc độ cao của MiniMax-M2.1 là gì?
Đó là cùng một thế hệ M2.1 được trình bày như một tùy chọn tập trung vào tốc độ cho các tác vụ lập trình và hỗ trợ bằng công cụ. Hãy chọn nó khi độ trễ giữa các bước của một tác nhân tương tác là quan trọng.
Nó có bị mất tính năng nào so với M2.1 không?
Không. Nó giữ nguyên bộ tính năng của M2.1 bao gồm suy luận, sử dụng công cụ, bộ nhớ đệm prompt, chế độ JSON và lược đồ phản hồi, vì vậy thay đổi nằm ở tốc độ lượt phản hồi. Chất lượng trên các tác vụ của riêng bạn vẫn đáng để kiểm tra.
Tôi có thể sử dụng nó cho đầu ra có cấu trúc không?
Có. Chế độ JSON và lược đồ phản hồi đều được đánh dấu là hỗ trợ, vì vậy bạn có thể yêu cầu đầu ra theo một hình dạng cố định và phân tích cú pháp nó trong ứng dụng của mình.
Có mô hình MiniMax nhanh hơn mới hơn không?
Có. MiniMax sau đó đã phát hành M2.5-highspeed và M2.7-highspeed như những tùy chọn nhanh hơn. Hãy so sánh chúng trên các tác vụ của riêng bạn nếu bạn đang bắt đầu một dự án mới thay vì duy trì một tích hợp hiện có.
Nó có hỗ trợ hình ảnh không?
Không. Nó không có đầu vào hình ảnh, vì vậy nó chỉ đọc và viết văn bản. Hãy chọn MiniMax M3 khi một prompt cần hiểu hình ảnh hoặc video. Nó chỉ nhận đầu vào là các prompt văn bản và kết quả công cụ.
MiniMax-M2.1-highspeed có giá bao nhiêu?
Trên TokenLab, MiniMax-M2.1-highspeed có giá Đầu vào $0.60 / Đầu ra $2.40 mỗi 1M token. Bảng giá phía trên cho thấy chi tiết đầy đủ. Giá phụ thuộc vào đơn vị tính phí, thông số và mức sử dụng. Hãy so sánh các điều kiện tương đương trong bảng giá chi tiết của mô hình; một mức giá đơn lẻ không quyết định tổng chi phí.
Giới hạn ngữ cảnh và đầu ra của MiniMax-M2.1-highspeed là bao nhiêu?
MiniMax-M2.1-highspeed hỗ trợ tối đa 204.800 token ngữ cảnh và trả về tối đa 131.072 token mỗi phản hồi.
MiniMax-M2.1-highspeed nên dùng endpoint nào?
Dùng https://api.tokenlab.sh/v1/responses làm mặc định cho MiniMax-M2.1-highspeed. Nếu mô hình hỗ trợ định dạng native của nhà cung cấp, API workbench cũng hiển thị endpoint đó.
MiniMax-M2.1-highspeed hỗ trợ những thao tác nào?
MiniMax-M2.1-highspeed hỗ trợ Văn bản sang văn bản. Chọn một thao tác trong API workbench phía trên để xem endpoint và mã ví dụ tương ứng.
So sánh MiniMax-M2.1-highspeed
Nguồn
Đánh giá ngày 2 thg 10, 2026