MiniMax: MiniMax-M3
minimax-m3- Đầu vào / Đầu ra
- $0.30 / $1.20
- Ngữ cảnh
- 1M
- Độ dài đầu ra tối đa
- 512K
- Phương thức
- Trò chuyện
- Khả năng
- Sử dụng công cụBộ nhớ đệm Prompt
Về MiniMax-M3
MiniMax-M3 là mô hình mã nguồn mở (open-weight) của MiniMax ra mắt vào tháng 6 năm 2026, dành cho các tác vụ lập trình, công việc đại lý (agentic work) và xử lý ngữ cảnh dài. Mô hình sử dụng MiniMax Sparse Attention để duy trì chi phí hợp lý cho các đầu vào rất dài, thực hiện suy luận trước khi trả lời, gọi công cụ và lưu trữ bộ nhớ đệm cho các câu lệnh (prompt). Đây là mô hình dòng M tiên phong của công ty và là phiên bản kế nhiệm của M2.7.
Ưu điểm
- MiniMax Sparse Attention giúp giảm khối lượng tính toán trên mỗi token đối với các đầu vào rất dài so với thế hệ trước.
- Hướng tới việc phân tách tác vụ tự động, gọi công cụ và suy luận đa bước cho các đại lý.
- Trọng số mô hình được MiniMax công bố rộng rãi, cho phép kiểm tra hành vi thông qua bản sao tự lưu trữ.
- Khả năng suy luận, sử dụng công cụ và lưu trữ bộ nhớ đệm câu lệnh đều có thể được bật cho các vòng lặp đại lý dài.
Khi nào nên chọn model khác
- Chỉ hỗ trợ đầu vào văn bản, do đó không thể đọc trực tiếp biểu đồ và ảnh chụp màn hình.
- Khả năng suy luận và đầu vào rất dài khiến các yêu cầu xử lý chậm hơn so với các mô hình M2.x tốc độ cao.
Bắt đầu
Tạo API key
Tạo API key trong Console để dùng cho mọi mô hình trên nền tảng.
Gửi yêu cầu đầu tiên của bạn
Sao chép ví dụ cho ngôn ngữ của bạn và chạy nó với endpoint.
Văn bản sang văn bảnResponses APIPOST/v1/responsesĐịnh dạng API:curl https://api.tokenlab.sh/v1/responses \ -H "Content-Type: application/json" \ -H "Authorization: Bearer sk-xxx" \ -d '{ "model": "minimax-m3", "input": "Hello!" }'
Giá
Giá Verified áp dụng cho Verified, thường rẻ hơn trên hầu hết các model. Giá Official là giá niêm yết từ nhà phát triển, áp dụng cho route Official ổn định hơn. Auto sẽ tính phí dựa trên route hoàn thành yêu cầu.
Đầu vào token <= 512K
mỗi 1M token- Giá Official
- Đầu vào $0.30 / Đầu ra $1.20 / Đọc bộ nhớ đệm $0.06
- Giá Verified
- —
- Giảm giá
- —
Đầu vào token > 512K
mỗi 1M token- Giá Official
- Đầu vào $0.60 / Đầu ra $2.40 / Đọc bộ nhớ đệm $0.12
- Giá Verified
- —
- Giảm giá
- —
Đọc bộ nhớ đệm
- Giá Official
- $0.06
- Giá Verified
- —
- Giảm giá
- —
| Giá Officialmỗi 1M token | Giá Verifiedmỗi 1M token | Giảm giá | |
|---|---|---|---|
| Đầu vào token <= 512K | Đầu vào $0.30 / Đầu ra $1.20 / Đọc bộ nhớ đệm $0.06 | — | — |
| Đầu vào token > 512K | Đầu vào $0.60 / Đầu ra $2.40 / Đọc bộ nhớ đệm $0.12 | — | — |
| Giá cache của prompt | |||
| Đọc bộ nhớ đệm | $0.06 | — | — |
Sử dụng & hoạt động
Tỷ lệ thành công là tỷ lệ yêu cầu hoàn tất. Độ trễ là thời gian của một phản hồi đầy đủ; P95 nghĩa là 95% yêu cầu hoàn thành trong khoảng thời gian đó.
Mức sử dụng & tình trạng
24 giờ qua- Yêu cầu
- Tỷ lệ thành công
- Độ trễ P95
- Tổng token
- Tỷ lệ thành công 30 ngày
- 100,0%
- Lượt yêu cầu 30 ngày
- 100+
- Hoạt động gần nhất
- Hôm kia
Dữ liệu dựa trên các yêu cầu tổng hợp của người dùng, không bao gồm các kiểm tra trạng thái.
Mở trong Console
Mở MiniMax-M3 trong Console để chỉnh sửa và gửi prompt ngay.
Giúp tôi thử minimax-m3 với tin nhắn ngắn tại /v1/responses. Hiển thị phản hồi, độ trễ và chi phí.
Tình huống sử dụng
Làm việc trên toàn bộ kho lưu trữ (repository)
Tải một cơ sở mã lớn và để mô hình truy vết các thay đổi trên các mô-đun trước khi thực hiện chỉnh sửa.
Đại lý lập kế hoạch
Cung cấp cho đại lý một bộ công cụ và mục tiêu, sau đó để đại lý tự phân tách tác vụ và gọi công cụ từng bước một.
Phân tích tài liệu dài
Xem xét các bản ghi chép, thông số kỹ thuật hoặc hồ sơ dài trong một lần duy nhất thay vì phải chia nhỏ chúng.
Ví dụ prompt
Đây là toàn bộ kho lưu trữ. Logic thử lại (retry) được triển khai ở đâu và điều gì sẽ xảy ra nếu tôi thay đổi thời gian chờ (backoff) của nó?
Đây là dòng thời gian sự cố và nhật ký dịch vụ. Hãy viết các bước để tái hiện lỗi và nêu tên mô-đun có khả năng bị lỗi nhất.
Lập kế hoạch chia tách khối mã này thành ba dịch vụ và nêu tên lệnh gọi công cụ đầu tiên bạn sẽ thực hiện cho mỗi dịch vụ.
Mô hình này có giá theo điều kiện. Chỉ tổng token hàng tháng không thể tạo ước tính đáng tin cậy; hãy dùng bảng giá chi tiết theo thông số yêu cầu, bộ nhớ đệm và khung giờ áp dụng.
FAQ
Điều gì làm cho MiniMax-M3 khác biệt so với M2.7?
MiniMax giới thiệu M3 như một thế hệ mới được xây dựng dựa trên cơ chế sparse attention cho ngữ cảnh rất dài, nhắm vào các tác vụ lập trình và đại lý, trong khi M2.7 hướng tới các khung đại lý trước đó.
MiniMax-M3 có phải là mô hình mã nguồn mở (open-weight) không?
MiniMax công bố M3 là mô hình mã nguồn mở, vì vậy bạn có thể tự lưu trữ nếu các quy định về dữ liệu của bạn yêu cầu điều đó. Hãy đọc giấy phép trên thẻ mô hình trước khi thực hiện.
Mô hình có chấp nhận hình ảnh và video không?
Không. MiniMax-M3 chỉ nhận đầu vào văn bản, vì vậy hãy sử dụng mô hình có hỗ trợ đầu vào hình ảnh khi bạn cần đọc trực tiếp ảnh chụp màn hình, biểu đồ, sơ đồ hoặc khung hình video.
Mô hình có thể sử dụng công cụ không?
Có. Mô hình có thể gọi công cụ và MiniMax hướng nó vào việc lập kế hoạch đại lý, nơi một tác vụ được chia thành các bước và một công cụ được gọi tại mỗi bước. Hãy truyền các định nghĩa công cụ của bạn cùng với yêu cầu và để mô hình quyết định thời điểm gọi chúng.
Khi nào tôi nên sử dụng M3 thay vì mô hình M2.x tốc độ cao?
Chọn M3 cho các đầu vào rất dài hoặc các tác vụ lập kế hoạch đại lý khó hơn. Chọn biến thể M2.x tốc độ cao khi độ trễ của mỗi lượt phản hồi quan trọng hơn chiều sâu của suy luận.
MiniMax-M3 có giá bao nhiêu?
Trên TokenLab, MiniMax-M3 có giá Đầu vào $0.30 / Đầu ra $1.20 mỗi 1M token. Bảng giá phía trên cho thấy chi tiết đầy đủ. Giá phụ thuộc vào đơn vị tính phí, thông số và mức sử dụng. Hãy so sánh các điều kiện tương đương trong bảng giá chi tiết của mô hình; một mức giá đơn lẻ không quyết định tổng chi phí.
Giới hạn ngữ cảnh và đầu ra của MiniMax-M3 là bao nhiêu?
MiniMax-M3 hỗ trợ tối đa 1.048.576 token ngữ cảnh và trả về tối đa 524.288 token mỗi phản hồi.
MiniMax-M3 nên dùng endpoint nào?
Dùng https://api.tokenlab.sh/v1/responses làm mặc định cho MiniMax-M3. Nếu mô hình hỗ trợ định dạng native của nhà cung cấp, API workbench cũng hiển thị endpoint đó.
MiniMax-M3 hỗ trợ những thao tác nào?
MiniMax-M3 hỗ trợ Văn bản sang văn bản. Chọn một thao tác trong API workbench phía trên để xem endpoint và mã ví dụ tương ứng.
So sánh MiniMax-M3
Nguồn
Đánh giá ngày 2 thg 10, 2026