Anthropic: Claude Haiku 5.5
claude-haiku-5-5- Đầu vào / Đầu ra-70%
- $0.10 / $0.50$0.03 / $0.15
- Ngữ cảnh
- 1M
- Ngày phát hành
- 7 thg 10, 2026
- Độ dài đầu ra tối đa
- 128K
- Phương thức
- Thị giácTrò chuyện
- Khả năng
- Sử dụng công cụBộ nhớ đệm PromptSuy luận
Về Claude Haiku 5.5
Claude Haiku 5.5 là mô hình Claude nhỏ, nhanh của Anthropic, được phát hành vào ngày 7 tháng 10 năm 2026 cho các công việc có khối lượng lớn, nhạy cảm với độ trễ như phân loại, trích xuất, định tuyến và các tác vụ tác nhân phụ (subagent). Đây là mô hình Haiku đầu tiên có khả năng điều chỉnh mức độ nỗ lực, cho phép một mô hình có thể trả lời nhanh các yêu cầu đơn giản và suy nghĩ lâu hơn đối với các yêu cầu khó hơn. Anthropic gọi đây là mô hình nhanh nhất của họ ở tốc độ tiêu chuẩn, với thời điểm cắt dữ liệu kiến thức là tháng 6 năm 2026.
Ưu điểm
- Anthropic gọi đây là mô hình nhanh nhất của họ ở tốc độ tiêu chuẩn, phù hợp cho hỗ trợ khách hàng trực tiếp và sử dụng trình duyệt.
- Đây là mô hình Haiku đầu tiên có các mức độ nỗ lực, cho phép một mô hình có thể phục vụ cả trò chuyện nhanh và các tác vụ tác nhân dài hơn.
- Anthropic báo cáo những cải thiện lớn so với Haiku 4.5 trên các tiêu chuẩn đánh giá bao gồm OSWorld 2.1, GDPval-AA và Terminal-Bench 4.0.
- Theo Anthropic, mô hình này chấp nhận đầu vào là văn bản và hình ảnh, đồng thời hoạt động như một tác nhân phụ bên cạnh Opus 5.5 hoặc Sonnet 5.5 trong các công việc lập trình.
- Tính năng suy nghĩ thích ứng (adaptive thinking) được bật theo mặc định và cài đặt mức độ nỗ lực sẽ kiểm soát mức độ suy nghĩ của mô hình.
Khi nào nên chọn model khác
- Anthropic cho biết Sonnet 5.5 và Opus 5.5 vẫn là những lựa chọn tốt hơn cho các công việc lập trình tác nhân phức tạp và các công việc mở.
- Các bộ phân loại an toàn có thể từ chối yêu cầu với lý do dừng từ chối, và các biện pháp bảo vệ an ninh mạng vẫn chặn việc kiểm thử xâm nhập.
- Ngân sách suy nghĩ thủ công không được hỗ trợ; suy nghĩ thích ứng với cài đặt mức độ nỗ lực sẽ thay thế chúng.
Bắt đầu
Tạo API key
Tạo API key trong Console để dùng cho mọi mô hình trên nền tảng.
Gửi yêu cầu đầu tiên của bạn
Sao chép ví dụ cho ngôn ngữ của bạn và chạy nó với endpoint.
Văn bản sang văn bảnMessages APIPOST/v1/messagesĐịnh dạng API:curl https://api.tokenlab.sh/v1/messages \ -H "Content-Type: application/json" \ -H "x-api-key: sk-xxx" \ -H "anthropic-version: 2023-06-01" \ -d '{ "model": "claude-haiku-5-5", "max_tokens": 1024, "messages": [ {"role": "user", "content": "Hello!"} ] }'
Giá
Giá TokenLab áp dụng cho Verified, giúp tiết kiệm chi phí trên hầu hết các model. Giá Official là giá niêm yết từ nhà phát triển, áp dụng cho luồng Official ổn định hơn. Auto sẽ tính phí dựa trên luồng thực hiện thành công yêu cầu.
Đầu vào token <= 100K
mỗi 1M token- Giá niêm yết
- Đầu vào $0.10 / Đầu ra $0.50 / Đọc bộ nhớ đệm $0.01 / Ghi bộ nhớ đệm $0.125
- Giá TokenLab
- Đầu vào $0.03 / Đầu ra $0.15 / Đọc bộ nhớ đệm $0.003 / Ghi bộ nhớ đệm $0.0375
- Giảm giá
- -70%
Đầu vào token 100K-1M
mỗi 1M token- Giá niêm yết
- Đầu vào $0.50 / Đầu ra $2.50 / Đọc bộ nhớ đệm $0.05 / Ghi bộ nhớ đệm $0.625
- Giá TokenLab
- Đầu vào $0.15 / Đầu ra $0.75 / Đọc bộ nhớ đệm $0.015 / Ghi bộ nhớ đệm $0.1875
- Giảm giá
- -70%
Đọc bộ nhớ đệm
- Giá niêm yết
- $0.01
- Giá TokenLab
- $0.003
- Giảm giá
- -70%
Ghi bộ nhớ đệm
- Giá niêm yết
- $0.125
- Giá TokenLab
- $0.0375
- Giảm giá
- -70%
Phí tính theo mỗi lượt gọi khi model sử dụng công cụ.
Tìm kiếm web
- Giá niêm yết
- $0.01/lượt tìm
- Giá TokenLab
- $0.003/lượt tìm
- Giảm giá
- -70%
| Giá niêm yếtmỗi 1M token | Giá TokenLabmỗi 1M token | Giảm giá | |
|---|---|---|---|
| Đầu vào token <= 100K | Đầu vào $0.10 / Đầu ra $0.50 / Đọc bộ nhớ đệm $0.01 / Ghi bộ nhớ đệm $0.125 | Đầu vào $0.03 / Đầu ra $0.15 / Đọc bộ nhớ đệm $0.003 / Ghi bộ nhớ đệm $0.0375 | -70% |
| Đầu vào token 100K-1M | Đầu vào $0.50 / Đầu ra $2.50 / Đọc bộ nhớ đệm $0.05 / Ghi bộ nhớ đệm $0.625 | Đầu vào $0.15 / Đầu ra $0.75 / Đọc bộ nhớ đệm $0.015 / Ghi bộ nhớ đệm $0.1875 | -70% |
| Giá cache của prompt | |||
| Đọc bộ nhớ đệm | $0.01 | $0.003 | -70% |
| Ghi bộ nhớ đệm | $0.125 | $0.0375 | -70% |
| Phí công cụPhí tính theo mỗi lượt gọi khi model sử dụng công cụ. | |||
| Tìm kiếm web | $0.01/lượt tìm | $0.003/lượt tìm | -70% |
Sử dụng & hoạt động
Tỷ lệ thành công là tỷ lệ yêu cầu hoàn tất. Độ trễ là thời gian của một phản hồi đầy đủ; P95 nghĩa là 95% yêu cầu hoàn thành trong khoảng thời gian đó.
Mức sử dụng & tình trạng
24 giờ qua- Yêu cầu
- Tỷ lệ thành công
- Độ trễ P95
- Tổng token
Dữ liệu dựa trên các yêu cầu tổng hợp của người dùng, không bao gồm các kiểm tra trạng thái.
Mở trong Console
Mở Claude Haiku 5.5 trong Console để chỉnh sửa và gửi prompt ngay.
Giúp tôi thử claude-haiku-5-5 với tin nhắn ngắn tại /v1/messages. Hiển thị phản hồi, độ trễ và chi phí.
Tình huống sử dụng
Phù hợp cho- Suy luận
- Thị giác
Phân loại và định tuyến khối lượng lớn
Gán nhãn phiếu hỗ trợ, định tuyến yêu cầu và trích xuất các trường thông tin từ tài liệu với số lượng lớn, nơi tốc độ phản hồi và thông lượng ổn định là quan trọng nhất.
Tác nhân phụ trong quy trình lập trình
Thực hiện các tác vụ phụ hẹp như tìm kiếm cơ sở mã hoặc tóm tắt tệp trong khi một mô hình lớn hơn dẫn dắt công việc, một sự kết hợp mà Anthropic nhấn mạnh.
Hỗ trợ trực tiếp và các tác vụ trình duyệt
Trả lời khách hàng theo thời gian thực hoặc điều khiển các bước trên trình duyệt từ ảnh chụp màn hình, nơi thời gian chờ giữa các lượt phản hồi quyết định trải nghiệm.
Tóm tắt và nén dữ liệu
Cô đọng các cuộc hội thoại, hồ sơ hoặc nhật ký dài thành các bản tóm tắt ngắn, và nén ngữ cảnh của tác nhân giữa các bước.
Ví dụ prompt
Hãy phân loại từng phiếu hỗ trợ trong số 50 phiếu này thành thanh toán, lỗi hoặc yêu cầu tính năng, và trả về một danh sách JSON với ID phiếu và danh mục.
Đọc hồ sơ này và trích xuất tên công ty, năm tài chính, doanh thu và thu nhập ròng vào một bảng. Đánh dấu bất kỳ giá trị nào bạn không thể tìm thấy.
Tóm tắt cuộc hội thoại này cho đến nay thành sáu gạch đầu dòng, giữ lại mọi quyết định, câu hỏi mở và tên tệp, để một tác nhân mới có thể tiếp tục công việc.
Mô hình này có giá theo điều kiện. Chỉ tổng token hàng tháng không thể tạo ước tính đáng tin cậy; hãy dùng bảng giá chi tiết theo thông số yêu cầu, bộ nhớ đệm và khung giờ áp dụng.
FAQ
Claude Haiku 5.5 giỏi nhất ở việc gì?
Các công việc có phạm vi hẹp, khối lượng lớn: phân loại, trích xuất, định tuyến, tóm tắt, nén dữ liệu và các tác vụ tác nhân phụ. Anthropic quảng bá đây là mô hình nhanh nhất của họ và cho biết Sonnet 5.5 hoặc Opus 5.5 vẫn tốt hơn cho việc lập trình tác nhân phức tạp.
Tôi nên bắt đầu với mức độ nỗ lực nào trên Haiku 5.5?
Anthropic khuyến nghị mức trung bình (medium), mức mặc định, cho hầu hết các công việc bao gồm lập trình tác nhân. Sử dụng mức thấp (low) cho trò chuyện, các tác vụ công cụ ngắn và các yêu cầu đơn giản với khối lượng lớn, mặc dù trong các lời nhắc tác nhân dài, nó có thể bỏ qua tìm kiếm hoặc dừng sớm. Sử dụng mức cao (high) để tuân thủ hướng dẫn nghiêm ngặt, và chỉ sử dụng xhigh hoặc max khi các thử nghiệm của riêng bạn cho thấy hiệu quả tăng lên.
Tôi có thể tắt tính năng suy nghĩ trên Haiku 5.5 không?
Một phần. Tính năng suy nghĩ là thích ứng và được bật theo mặc định. Việc gửi yêu cầu với tính năng suy nghĩ bị vô hiệu hóa sẽ hoạt động ở mức nỗ lực thấp, trung bình và cao, và trả về lỗi ở mức xhigh và max. Cách ưu tiên của Anthropic để giảm bớt suy nghĩ là chọn mức độ nỗ lực thấp hơn. Suy nghĩ được tính vào giới hạn đầu ra, vì vậy hãy để dành dung lượng cho nó.
Haiku 5.5 khác với Haiku 4.5 như thế nào?
Anthropic báo cáo những cải thiện lớn về tiêu chuẩn đánh giá, cửa sổ ngữ cảnh và giới hạn đầu ra dài hơn, mức độ nỗ lực có thể điều chỉnh và suy nghĩ thích ứng thay thế cho ngân sách suy nghĩ thủ công. Nó sử dụng bộ mã hóa (tokenizer) mới hơn, vì vậy cùng một văn bản sẽ được tính là nhiều token hơn, và các bộ phân loại an toàn của nó có thể trả về các từ chối mà Haiku 4.5 không có.
Khi nào tôi nên chọn Sonnet 5.5 thay vì Haiku 5.5?
Hãy chọn Sonnet 5.5 hoặc Opus 5.5 cho các công việc lập trình tác nhân phức tạp, các phiên làm việc trên terminal dài và các tác vụ cần sự phán đoán bền bỉ, nơi Anthropic cho biết chúng vẫn mạnh mẽ hơn. Hãy chọn Haiku 5.5 khi tốc độ và khối lượng công việc là quan trọng và tác vụ có phạm vi hẹp, chẳng hạn như phân loại, tóm tắt hoặc công việc tác nhân phụ.
Claude Haiku 5.5 có giá bao nhiêu?
Trên TokenLab, Claude Haiku 5.5 có giá Đầu vào $0.03 / Đầu ra $0.15 mỗi 1M token. Bảng giá phía trên cho thấy chi tiết đầy đủ. Giá phụ thuộc vào đơn vị tính phí, thông số và mức sử dụng. Hãy so sánh các điều kiện tương đương trong bảng giá chi tiết của mô hình; một mức giá đơn lẻ không quyết định tổng chi phí.
Giới hạn ngữ cảnh và đầu ra của Claude Haiku 5.5 là bao nhiêu?
Claude Haiku 5.5 hỗ trợ tối đa 1.000.000 token ngữ cảnh và trả về tối đa 128.000 token mỗi phản hồi.
Claude Haiku 5.5 nên dùng endpoint nào?
Dùng https://api.tokenlab.sh/v1/messages làm mặc định cho Claude Haiku 5.5. Nếu mô hình hỗ trợ định dạng native của nhà cung cấp, API workbench cũng hiển thị endpoint đó.
Claude Haiku 5.5 hỗ trợ những thao tác nào?
Claude Haiku 5.5 hỗ trợ Văn bản sang văn bản. Chọn một thao tác trong API workbench phía trên để xem endpoint và mã ví dụ tương ứng.
So sánh Claude Haiku 5.5
Nguồn
- Introducing Claude Haiku 5.5
- Claude Haiku 5.5 model overview
- What's new in Claude Haiku 5.5
- Prompting Claude Haiku 5.5
Đánh giá ngày 8 thg 10, 2026