Anthropic: Claude Haiku 4.5
claude-haiku-4-5- Đầu vào / Đầu ra-70%
- $1.00 / $5.00$0.30 / $1.50
- Ngữ cảnh
- 200K
- Độ dài đầu ra tối đa
- 64K
- Phương thức
- Thị giácTrò chuyện
- Khả năng
- Sử dụng công cụBộ nhớ đệm PromptSuy luận
Về Claude Haiku 4.5
Claude Haiku 4.5 là mô hình Claude nhỏ, nhanh của Anthropic, được phát hành vào tháng 10 năm 2025 cho các công việc có khối lượng lớn và nhạy cảm với độ trễ. Anthropic mô tả đây là mô hình nhanh nhất trong dòng sản phẩm của họ với trí thông minh gần đạt ngưỡng tiên phong. Nó chấp nhận văn bản và hình ảnh, hỗ trợ sử dụng công cụ và lưu trữ gợi ý (prompt caching), đồng thời sử dụng tư duy mở rộng thủ công với ngân sách token thay vì tư duy thích ứng như các mô hình Claude mới hơn.
Ưu điểm
- Độ trễ thấp nhất trong số các mô hình Claude được liệt kê trên trang tổng quan của Anthropic, phù hợp với các giao diện trò chuyện và trợ lý thời gian thực.
- Đọc hình ảnh cùng với văn bản, vì vậy nó có thể phân loại ảnh chụp màn hình, biên lai và biểu đồ với số lượng lớn.
- Tư duy mở rộng là tùy chọn và được thiết lập với ngân sách token cụ thể, vì vậy bạn quyết định mức độ suy luận cần chi trả cho mỗi yêu cầu.
- Hỗ trợ sử dụng công cụ, xuất dữ liệu JSON có cấu trúc và lưu trữ gợi ý, giúp giữ cho các gợi ý hệ thống lặp lại có chi phí thấp trong các vòng lặp tác nhân.
Khi nào nên chọn model khác
- Thời điểm cắt giảm kiến thức của nó sớm hơn nhiều so với thế hệ Claude 5, vì vậy nó biết ít hơn về các thư viện và sự kiện gần đây.
- Nó có cửa sổ ngữ cảnh và giới hạn đầu ra nhỏ hơn so với các mô hình Opus và Sonnet 5.x, điều này hạn chế các công việc trên toàn bộ kho lưu trữ hoặc độ dài của một cuốn sách.
- Đối với các tác vụ lập trình tự động dài hoặc lập kế hoạch đa bước mơ hồ, mô hình Sonnet hoặc Opus ít gặp lỗi hơn.
Bắt đầu
Tạo API key
Tạo API key trong Console để dùng cho mọi mô hình trên nền tảng.
Gửi yêu cầu đầu tiên của bạn
Sao chép ví dụ cho ngôn ngữ của bạn và chạy nó với endpoint.
Văn bản sang văn bảnMessages APIPOST/v1/messagesĐịnh dạng API:curl https://api.tokenlab.sh/v1/messages \ -H "Content-Type: application/json" \ -H "x-api-key: sk-xxx" \ -H "anthropic-version: 2023-06-01" \ -d '{ "model": "claude-haiku-4-5", "max_tokens": 1024, "messages": [ {"role": "user", "content": "Hello!"} ] }'
Giá
Giá TokenLab áp dụng cho Verified, giúp tiết kiệm chi phí trên hầu hết các model. Giá Official là giá niêm yết từ nhà phát triển, áp dụng cho luồng Official ổn định hơn. Auto sẽ tính phí dựa trên luồng thực hiện thành công yêu cầu.
Thông số mặc định
mỗi 1M token- Giá niêm yết
- Đầu vào $1.00 / Đầu ra $5.00 / Đọc bộ nhớ đệm $0.10 / Ghi bộ nhớ đệm $1.25
- Giá TokenLab
- Đầu vào $0.30 / Đầu ra $1.50 / Đọc bộ nhớ đệm $0.03 / Ghi bộ nhớ đệm $0.375
- Giảm giá
- -70%
Đọc bộ nhớ đệm
- Giá niêm yết
- $0.10
- Giá TokenLab
- $0.03
- Giảm giá
- -70%
Ghi bộ nhớ đệm
- Giá niêm yết
- $1.25
- Giá TokenLab
- $0.375
- Giảm giá
- -70%
Phí tính theo mỗi lượt gọi khi model sử dụng công cụ.
Tìm kiếm web
- Giá niêm yết
- $0.01/lượt tìm
- Giá TokenLab
- $0.003/lượt tìm
- Giảm giá
- -70%
| Giá niêm yếtmỗi 1M token | Giá TokenLabmỗi 1M token | Giảm giá | |
|---|---|---|---|
| Thông số mặc định | Đầu vào $1.00 / Đầu ra $5.00 / Đọc bộ nhớ đệm $0.10 / Ghi bộ nhớ đệm $1.25 | Đầu vào $0.30 / Đầu ra $1.50 / Đọc bộ nhớ đệm $0.03 / Ghi bộ nhớ đệm $0.375 | -70% |
| Giá cache của prompt | |||
| Đọc bộ nhớ đệm | $0.10 | $0.03 | -70% |
| Ghi bộ nhớ đệm | $1.25 | $0.375 | -70% |
| Phí công cụPhí tính theo mỗi lượt gọi khi model sử dụng công cụ. | |||
| Tìm kiếm web | $0.01/lượt tìm | $0.003/lượt tìm | -70% |
Sử dụng & hoạt động
Tỷ lệ thành công là tỷ lệ yêu cầu hoàn tất. Độ trễ là thời gian của một phản hồi đầy đủ; P95 nghĩa là 95% yêu cầu hoàn thành trong khoảng thời gian đó.
Mức sử dụng & tình trạng
24 giờ qua- Yêu cầu
- Tỷ lệ thành công
- Độ trễ P95
- Tổng token
- Tỷ lệ thành công 30 ngày
- 100,0%
- Độ trễ trung vị 7 ngày
- 1 sn=269
- Độ trễ P95 7 ngày
- 16,1 sn=269
- Lượt yêu cầu 30 ngày
- 100+
- Hoạt động gần nhất
- 3 phút trước
Dữ liệu dựa trên các yêu cầu tổng hợp của người dùng, không bao gồm các kiểm tra trạng thái.
Mở trong Console
Mở Claude Haiku 4.5 trong Console để chỉnh sửa và gửi prompt ngay.
Giúp tôi thử claude-haiku-4-5 với tin nhắn ngắn tại /v1/messages. Hiển thị phản hồi, độ trễ và chi phí.
Tình huống sử dụng
Phù hợp cho- Suy luận
- Thị giác
Trò chuyện và hỗ trợ thời gian thực
Đặt nó phía sau một tiện ích dành cho khách hàng, nơi tốc độ phản hồi quan trọng hơn chiều sâu, với các lệnh gọi công cụ để tra cứu đơn hàng và chuyển giao khi câu hỏi trở nên khó.
Phân loại và trích xuất
Gắn thẻ các phiếu hỗ trợ, trích xuất các trường từ hóa đơn hoặc ảnh chụp màn hình và trả về JSON nghiêm ngặt cho một quy trình hạ nguồn chạy hàng ngàn lần mỗi ngày.
Tác nhân phụ (Sub-agent workers)
Chạy nó như một nhân viên giá rẻ trong thiết lập đa tác nhân: một mô hình lớn hơn lập kế hoạch, và nhiều lệnh gọi Haiku tìm kiếm, tóm tắt hoặc kiểm tra tệp song song.
Ví dụ prompt
Phân loại email hỗ trợ này là thanh toán, lỗi, yêu cầu tính năng hoặc khác, và trả về JSON với nhãn và lý do trong một câu.
Tóm tắt bản ghi trò chuyện này thành ba gạch đầu dòng và liệt kê bất kỳ mục hành động nào cùng với người chịu trách nhiệm.
Hãy nhìn vào ảnh chụp màn hình của hộp thoại lỗi này và cho tôi biết người dùng nên thay đổi cài đặt nào.
Mô hình này có giá theo điều kiện. Chỉ tổng token hàng tháng không thể tạo ước tính đáng tin cậy; hãy dùng bảng giá chi tiết theo thông số yêu cầu, bộ nhớ đệm và khung giờ áp dụng.
FAQ
Claude Haiku 4.5 được sử dụng tốt nhất cho việc gì?
Các công việc nhanh, khối lượng lớn: trợ lý trò chuyện, phân loại, trích xuất dữ liệu, tóm tắt và các tác nhân làm việc. Anthropic định vị nó là mô hình Claude nhanh nhất với trí thông minh gần đạt ngưỡng tiên phong, vì vậy đây là lựa chọn mặc định khi thời gian phản hồi và thông lượng quan trọng hơn suy luận sâu sắc nhất.
Claude Haiku 4.5 có hỗ trợ tư duy mở rộng không?
Có, nhưng ở dạng thủ công: bạn bật tư duy và đặt ngân sách token. Nó không sử dụng chế độ tư duy thích ứng hoặc tham số nỗ lực mà các mô hình Sonnet và Opus mới hơn sử dụng, vì vậy bạn kiểm soát độ sâu suy luận thông qua ngân sách bạn cung cấp.
Claude Haiku 4.5 có thể xử lý hình ảnh không?
Có. Nó nhận hình ảnh cùng với văn bản và trả lời bằng văn bản. Điều đó bao gồm việc đọc ảnh chụp màn hình, biểu đồ và tài liệu quét. Nó không thể tạo hoặc chỉnh sửa hình ảnh, vì vậy hãy sử dụng mô hình hình ảnh khi bạn cần đầu ra là hình ảnh.
Khi nào tôi nên chuyển từ Haiku 4.5 lên Sonnet?
Hãy chuyển lên khi Haiku bỏ lỡ các hướng dẫn trong các gợi ý dài, bỏ sót các bước trong các lần chạy tác nhân đa công cụ, hoặc cần kiến thức về các bản phát hành gần đây. Sonnet 5.5 là bước tiếp theo và duy trì cấu hình nhanh, với cửa sổ ngữ cảnh dài hơn và thời điểm cắt giảm kiến thức muộn hơn nhiều.
Claude Haiku 4.5 có giá bao nhiêu?
Trên TokenLab, Claude Haiku 4.5 có giá Đầu vào $0.30 / Đầu ra $1.50 mỗi 1M token. Bảng giá phía trên cho thấy chi tiết đầy đủ. Giá phụ thuộc vào đơn vị tính phí, thông số và mức sử dụng. Hãy so sánh các điều kiện tương đương trong bảng giá chi tiết của mô hình; một mức giá đơn lẻ không quyết định tổng chi phí.
Giới hạn ngữ cảnh và đầu ra của Claude Haiku 4.5 là bao nhiêu?
Claude Haiku 4.5 hỗ trợ tối đa 200.000 token ngữ cảnh và trả về tối đa 64.000 token mỗi phản hồi.
Claude Haiku 4.5 nên dùng endpoint nào?
Dùng https://api.tokenlab.sh/v1/messages làm mặc định cho Claude Haiku 4.5. Nếu mô hình hỗ trợ định dạng native của nhà cung cấp, API workbench cũng hiển thị endpoint đó.
Claude Haiku 4.5 hỗ trợ những thao tác nào?
Claude Haiku 4.5 hỗ trợ Văn bản sang văn bản. Chọn một thao tác trong API workbench phía trên để xem endpoint và mã ví dụ tương ứng.
So sánh Claude Haiku 4.5
Hướng dẫn sử dụng Claude Haiku 4.5
Nguồn
Đánh giá ngày 2 thg 10, 2026