Anthropic: Claude Opus 4.8
claude-opus-4-8- Đầu vào / Đầu ra-70%
- $5.00 / $25.00$1.50 / $7.50
- Ngữ cảnh
- 1M
- Ngày phát hành
- 28 thg 5, 2026
- Độ dài đầu ra tối đa
- 128K
- Phương thức
- Thị giácTrò chuyện
- Khả năng
- Sử dụng công cụBộ nhớ đệm PromptSuy luận
Về Claude Opus 4.8
Claude Opus 4.8 là mô hình cấp Opus của Anthropic được phát hành vào ngày 28 tháng 5 năm 2026, nằm giữa Opus 4.7 và Opus 5 trong dòng sản phẩm. Mô hình này xử lý các tác vụ suy luận, lập trình và tác vụ đại lý (agent) dài hạn khó nhất trong thế hệ của nó, với khả năng tư duy thích ứng, đầu vào hình ảnh và sử dụng công cụ. Anthropic liệt kê đây là mô hình cũ (legacy) và khuyến nghị sử dụng Opus 5.5 cho các công việc mới.
Ưu điểm
- Tư duy thích ứng với mức nỗ lực mặc định cao, vì vậy các câu lệnh khó sẽ nhận được khả năng suy luận mà không cần thiết lập ngân sách token thủ công.
- Chấp nhận văn bản và hình ảnh rồi trả lời bằng văn bản, hỗ trợ việc xem xét ảnh chụp màn hình và các câu hỏi về sơ đồ trong vòng lặp đại lý.
- Sử dụng bộ mã hóa (tokenizer) được giới thiệu cùng với Opus 4.7, vì vậy số lượng token khớp với các mô hình Claude sau này chặt chẽ hơn so với Opus 4.6.
- Fable 5 chuyển hướng sang mô hình này đối với các yêu cầu bị các biện pháp bảo vệ của nó từ chối, vì vậy Anthropic coi đây là mô hình tổng quát an toàn hàng đầu bên dưới Fable.
Khi nào nên chọn model khác
- Opus 5 mang lại kết quả tốt hơn rõ rệt trên các đánh giá do Anthropic công bố, vì vậy rất khó để biện minh cho việc sử dụng 4.8 cho các bản dựng mới.
- Mốc thời gian kiến thức đáng tin cậy của nó là tháng 1 năm 2026, sớm hơn so với Opus 5.5 và Sonnet 5.5.
- Anthropic đánh dấu đây là mô hình cũ, với khuyến nghị rõ ràng là nên chuyển sang Opus 5.5.
Bắt đầu
Tạo API key
Tạo API key trong Console để dùng cho mọi mô hình trên nền tảng.
Gửi yêu cầu đầu tiên của bạn
Sao chép ví dụ cho ngôn ngữ của bạn và chạy nó với endpoint.
Văn bản sang văn bảnMessages APIPOST/v1/messagesĐịnh dạng API:curl https://api.tokenlab.sh/v1/messages \ -H "Content-Type: application/json" \ -H "x-api-key: sk-xxx" \ -H "anthropic-version: 2023-06-01" \ -d '{ "model": "claude-opus-4-8", "max_tokens": 1024, "messages": [ {"role": "user", "content": "Hello!"} ] }'
Giá
Giá TokenLab áp dụng cho Verified, giúp tiết kiệm chi phí trên hầu hết các model. Giá Official là giá niêm yết từ nhà phát triển, áp dụng cho luồng Official ổn định hơn. Auto sẽ tính phí dựa trên luồng thực hiện thành công yêu cầu.
Thông số mặc định
mỗi 1M token- Giá niêm yết
- Đầu vào $5.00 / Đầu ra $25.00 / Đọc bộ nhớ đệm $0.50 / Ghi bộ nhớ đệm $6.25
- Giá TokenLab
- Đầu vào $1.50 / Đầu ra $7.50 / Đọc bộ nhớ đệm $0.15 / Ghi bộ nhớ đệm $1.88
- Giảm giá
- -70%
Đọc bộ nhớ đệm
- Giá niêm yết
- $0.50
- Giá TokenLab
- $0.15
- Giảm giá
- -70%
Ghi bộ nhớ đệm
- Giá niêm yết
- $6.25
- Giá TokenLab
- $1.88
- Giảm giá
- -70%
Phí tính theo mỗi lượt gọi khi model sử dụng công cụ.
Tìm kiếm web
- Giá niêm yết
- $0.01/lượt tìm
- Giá TokenLab
- $0.003/lượt tìm
- Giảm giá
- -70%
| Giá niêm yếtmỗi 1M token | Giá TokenLabmỗi 1M token | Giảm giá | |
|---|---|---|---|
| Thông số mặc định | Đầu vào $5.00 / Đầu ra $25.00 / Đọc bộ nhớ đệm $0.50 / Ghi bộ nhớ đệm $6.25 | Đầu vào $1.50 / Đầu ra $7.50 / Đọc bộ nhớ đệm $0.15 / Ghi bộ nhớ đệm $1.88 | -70% |
| Giá cache của prompt | |||
| Đọc bộ nhớ đệm | $0.50 | $0.15 | -70% |
| Ghi bộ nhớ đệm | $6.25 | $1.88 | -70% |
| Phí công cụPhí tính theo mỗi lượt gọi khi model sử dụng công cụ. | |||
| Tìm kiếm web | $0.01/lượt tìm | $0.003/lượt tìm | -70% |
Sử dụng & hoạt động
Tỷ lệ thành công là tỷ lệ yêu cầu hoàn tất. Độ trễ là thời gian của một phản hồi đầy đủ; P95 nghĩa là 95% yêu cầu hoàn thành trong khoảng thời gian đó.
Mức sử dụng & tình trạng
24 giờ qua- Yêu cầu
- Tỷ lệ thành công
- Độ trễ P95
- Tổng token
- Tỷ lệ thành công 30 ngày
- 100,0%
- Lượt yêu cầu 30 ngày
- 100+
- Hoạt động gần nhất
- 3 ngày trước
Dữ liệu dựa trên các yêu cầu tổng hợp của người dùng, không bao gồm các kiểm tra trạng thái.
Mở trong Console
Mở Claude Opus 4.8 trong Console để chỉnh sửa và gửi prompt ngay.
Giúp tôi thử claude-opus-4-8 với tin nhắn ngắn tại /v1/messages. Hiển thị phản hồi, độ trễ và chi phí.
Tình huống sử dụng
Phù hợp cho- Suy luận
- Thị giác
Các quy trình đại lý hiện có
Duy trì một đại lý lập trình hoặc nghiên cứu đã được xác thực trên một phiên bản mô hình cố định trong khi bạn lên lịch chuyển sang Opus 5.5 và chạy lại các đánh giá của riêng mình.
Mục tiêu dự phòng
Sử dụng làm mô hình thử lại khi một yêu cầu gửi đến mô hình Fable bị bộ phân loại bảo vệ từ chối nhưng vẫn cần một câu trả lời mạnh mẽ.
Đánh giá mã nguồn chuyên sâu
Chạy đánh giá dài trên một diff lớn, yêu cầu xếp hạng các rủi ro, các bài kiểm tra còn thiếu và bản sửa lỗi an toàn nhỏ nhất cho từng trường hợp.
Ví dụ prompt
Kiểm tra mô-đun này để tìm các điều kiện tranh chấp (race conditions) và giải thích từng trường hợp với sự xen kẽ chính xác gây ra lỗi đó.
Dưới đây là dòng thời gian sự cố và các nhật ký liên quan của chúng tôi. Hãy viết phân tích nguyên nhân gốc rễ và danh sách các thay đổi tiếp theo.
Lập kế hoạch triển khai theo giai đoạn để thay thế thư viện thanh toán này, bao gồm cách xác nhận từng giai đoạn đã hoạt động.
Mô hình này có giá theo điều kiện. Chỉ tổng token hàng tháng không thể tạo ước tính đáng tin cậy; hãy dùng bảng giá chi tiết theo thông số yêu cầu, bộ nhớ đệm và khung giờ áp dụng.
FAQ
Claude Opus 4.8 nằm ở đâu trong số các mô hình Claude?
Đây là phiên bản Opus nằm giữa 4.7 và Opus 5, ra mắt ngày 28 tháng 5 năm 2026. Nó nhắm đến các công việc lập trình và suy luận khó nhất của thế hệ 4.x. Anthropic hiện liệt kê nó là mô hình cũ và chỉ định Opus 5.5 là Opus hiện tại.
Claude Opus 4.8 có hỗ trợ tư duy thích ứng không?
Có. Tư duy thích ứng là chế độ tư duy của nó và mức nỗ lực mặc định là cao trên API của Anthropic. Hãy giảm nỗ lực để có các lượt phản hồi nhanh hơn, rẻ hơn hoặc tăng lên đối với các tác vụ mà việc bỏ sót một trường hợp biên sẽ gây tốn kém.
Tôi có nên chuyển từ Opus 4.8 sang Opus 5.5 không?
Đối với công việc mới, có: Anthropic khuyến nghị Opus 5.5 và xuất bản hướng dẫn di chuyển cho 4.8. Chỉ giữ lại 4.8 ở những nơi quy trình đã xác thực phụ thuộc vào hành vi chính xác của nó, và lưu ý rằng 5.5 thay đổi các quy tắc về tư duy và sử dụng công cụ.
Claude Opus 4.8 có đọc được hình ảnh không?
Có. Nó nhận văn bản và hình ảnh làm đầu vào và trả về văn bản. Nó không thể tạo hình ảnh, vì vậy đối với việc tạo ảnh, bạn cần một mô hình hình ảnh riêng biệt đi kèm.
Claude Opus 4.8 có giá bao nhiêu?
Trên TokenLab, Claude Opus 4.8 có giá Đầu vào $1.50 / Đầu ra $7.50 mỗi 1M token. Bảng giá phía trên cho thấy chi tiết đầy đủ. Giá phụ thuộc vào đơn vị tính phí, thông số và mức sử dụng. Hãy so sánh các điều kiện tương đương trong bảng giá chi tiết của mô hình; một mức giá đơn lẻ không quyết định tổng chi phí.
Giới hạn ngữ cảnh và đầu ra của Claude Opus 4.8 là bao nhiêu?
Claude Opus 4.8 hỗ trợ tối đa 1.000.000 token ngữ cảnh và trả về tối đa 128.000 token mỗi phản hồi.
Claude Opus 4.8 nên dùng endpoint nào?
Dùng https://api.tokenlab.sh/v1/messages làm mặc định cho Claude Opus 4.8. Nếu mô hình hỗ trợ định dạng native của nhà cung cấp, API workbench cũng hiển thị endpoint đó.
Claude Opus 4.8 hỗ trợ những thao tác nào?
Claude Opus 4.8 hỗ trợ Văn bản sang văn bản. Chọn một thao tác trong API workbench phía trên để xem endpoint và mã ví dụ tương ứng.
So sánh Claude Opus 4.8
Hướng dẫn sử dụng Claude Opus 4.8
Nguồn
Đánh giá ngày 2 thg 10, 2026