Chọn Auto, TokenLab Verified hoặc Official cho mỗi yêu cầu, với giá được hiển thị ngay từ đầu.Xem có gì mới

Anthropic: Claude Haiku 5.5

Mô hình Claude nhanh nhất, được xây dựng cho các công việc có khối lượng lớn, đòi hỏi độ trễ thấp như phân loại, trích xuất, định tuyến và các tác vụ tác nhân phụ.
So sánh mô hình
claude-haiku-5-5
Sẵn sàngAnthropicTrò chuyệnGiảm 90% cho đầu vào đã lưuMới
Đầu vào / Đầu ra-70%
$0.10 / $0.50$0.03 / $0.15
Ngữ cảnh
1M
Ngày phát hành
7 thg 10, 2026
Độ dài đầu ra tối đa
128K
Phương thức
Thị giácTrò chuyện
Khả năng
Sử dụng công cụBộ nhớ đệm PromptSuy luận

Về Claude Haiku 5.5

Claude Haiku 5.5 là mô hình Claude nhỏ, nhanh của Anthropic, được phát hành vào ngày 7 tháng 10 năm 2026 cho các công việc có khối lượng lớn, nhạy cảm với độ trễ như phân loại, trích xuất, định tuyến và các tác vụ tác nhân phụ (subagent). Đây là mô hình Haiku đầu tiên có khả năng điều chỉnh mức độ nỗ lực, cho phép một mô hình có thể trả lời nhanh các yêu cầu đơn giản và suy nghĩ lâu hơn đối với các yêu cầu khó hơn. Anthropic gọi đây là mô hình nhanh nhất của họ ở tốc độ tiêu chuẩn, với thời điểm cắt dữ liệu kiến thức là tháng 6 năm 2026.

Ưu điểm

  • Anthropic gọi đây là mô hình nhanh nhất của họ ở tốc độ tiêu chuẩn, phù hợp cho hỗ trợ khách hàng trực tiếp và sử dụng trình duyệt.
  • Đây là mô hình Haiku đầu tiên có các mức độ nỗ lực, cho phép một mô hình có thể phục vụ cả trò chuyện nhanh và các tác vụ tác nhân dài hơn.
  • Anthropic báo cáo những cải thiện lớn so với Haiku 4.5 trên các tiêu chuẩn đánh giá bao gồm OSWorld 2.1, GDPval-AA và Terminal-Bench 4.0.
  • Theo Anthropic, mô hình này chấp nhận đầu vào là văn bản và hình ảnh, đồng thời hoạt động như một tác nhân phụ bên cạnh Opus 5.5 hoặc Sonnet 5.5 trong các công việc lập trình.
  • Tính năng suy nghĩ thích ứng (adaptive thinking) được bật theo mặc định và cài đặt mức độ nỗ lực sẽ kiểm soát mức độ suy nghĩ của mô hình.

Khi nào nên chọn model khác

  • Anthropic cho biết Sonnet 5.5 và Opus 5.5 vẫn là những lựa chọn tốt hơn cho các công việc lập trình tác nhân phức tạp và các công việc mở.
  • Các bộ phân loại an toàn có thể từ chối yêu cầu với lý do dừng từ chối, và các biện pháp bảo vệ an ninh mạng vẫn chặn việc kiểm thử xâm nhập.
  • Ngân sách suy nghĩ thủ công không được hỗ trợ; suy nghĩ thích ứng với cài đặt mức độ nỗ lực sẽ thay thế chúng.

Bắt đầu

  1. Tạo API key

    Tạo API key trong Console để dùng cho mọi mô hình trên nền tảng.

  2. Gửi yêu cầu đầu tiên của bạn

    Sao chép ví dụ cho ngôn ngữ của bạn và chạy nó với endpoint.

    Văn bản sang văn bảnMessages API
    POST/v1/messages
    Định dạng API:
    curl https://api.tokenlab.sh/v1/messages \
      -H "Content-Type: application/json" \
      -H "x-api-key: sk-xxx" \
      -H "anthropic-version: 2023-06-01" \
      -d '{
        "model": "claude-haiku-5-5",
        "max_tokens": 1024,
        "messages": [
          {"role": "user", "content": "Hello!"}
        ]
      }'

Giá

Giá TokenLab áp dụng cho Verified, giúp tiết kiệm chi phí trên hầu hết các model. Giá Official là giá niêm yết từ nhà phát triển, áp dụng cho luồng Official ổn định hơn. Auto sẽ tính phí dựa trên luồng thực hiện thành công yêu cầu.

Đầu vào token <= 100K

mỗi 1M token
Giá niêm yết
Đầu vào $0.10 / Đầu ra $0.50 / Đọc bộ nhớ đệm $0.01 / Ghi bộ nhớ đệm $0.125
Giá TokenLab
Đầu vào $0.03 / Đầu ra $0.15 / Đọc bộ nhớ đệm $0.003 / Ghi bộ nhớ đệm $0.0375
Giảm giá
-70%

Đầu vào token 100K-1M

mỗi 1M token
Giá niêm yết
Đầu vào $0.50 / Đầu ra $2.50 / Đọc bộ nhớ đệm $0.05 / Ghi bộ nhớ đệm $0.625
Giá TokenLab
Đầu vào $0.15 / Đầu ra $0.75 / Đọc bộ nhớ đệm $0.015 / Ghi bộ nhớ đệm $0.1875
Giảm giá
-70%
Giá cache của prompt

Đọc bộ nhớ đệm

Giá niêm yết
$0.01
Giá TokenLab
$0.003
Giảm giá
-70%

Ghi bộ nhớ đệm

Giá niêm yết
$0.125
Giá TokenLab
$0.0375
Giảm giá
-70%
Phí công cụ

Phí tính theo mỗi lượt gọi khi model sử dụng công cụ.

Tìm kiếm web

Giá niêm yết
$0.01/lượt tìm
Giá TokenLab
$0.003/lượt tìm
Giảm giá
-70%

Sử dụng & hoạt động

Tỷ lệ thành công là tỷ lệ yêu cầu hoàn tất. Độ trễ là thời gian của một phản hồi đầy đủ; P95 nghĩa là 95% yêu cầu hoàn thành trong khoảng thời gian đó.

Mức sử dụng & tình trạng

24 giờ qua
Yêu cầu
Tỷ lệ thành công
Độ trễ P95
Tổng token
Hiệu năng mô hình
Các chỉ số sẽ xuất hiện sau khi đạt ngưỡng về quyền riêng tư và khối lượng dữ liệu.

Dữ liệu dựa trên các yêu cầu tổng hợp của người dùng, không bao gồm các kiểm tra trạng thái.

Mở trong Console

Mở Claude Haiku 5.5 trong Console để chỉnh sửa và gửi prompt ngay.

Giúp tôi thử claude-haiku-5-5 với tin nhắn ngắn tại /v1/messages. Hiển thị phản hồi, độ trễ và chi phí.

Tình huống sử dụng

Phù hợp cho
  • Suy luận
  • Thị giác
  • Phân loại và định tuyến khối lượng lớn

    Gán nhãn phiếu hỗ trợ, định tuyến yêu cầu và trích xuất các trường thông tin từ tài liệu với số lượng lớn, nơi tốc độ phản hồi và thông lượng ổn định là quan trọng nhất.

  • Tác nhân phụ trong quy trình lập trình

    Thực hiện các tác vụ phụ hẹp như tìm kiếm cơ sở mã hoặc tóm tắt tệp trong khi một mô hình lớn hơn dẫn dắt công việc, một sự kết hợp mà Anthropic nhấn mạnh.

  • Hỗ trợ trực tiếp và các tác vụ trình duyệt

    Trả lời khách hàng theo thời gian thực hoặc điều khiển các bước trên trình duyệt từ ảnh chụp màn hình, nơi thời gian chờ giữa các lượt phản hồi quyết định trải nghiệm.

  • Tóm tắt và nén dữ liệu

    Cô đọng các cuộc hội thoại, hồ sơ hoặc nhật ký dài thành các bản tóm tắt ngắn, và nén ngữ cảnh của tác nhân giữa các bước.

Ví dụ prompt

Hãy phân loại từng phiếu hỗ trợ trong số 50 phiếu này thành thanh toán, lỗi hoặc yêu cầu tính năng, và trả về một danh sách JSON với ID phiếu và danh mục.

Đọc hồ sơ này và trích xuất tên công ty, năm tài chính, doanh thu và thu nhập ròng vào một bảng. Đánh dấu bất kỳ giá trị nào bạn không thể tìm thấy.

Tóm tắt cuộc hội thoại này cho đến nay thành sáu gạch đầu dòng, giữ lại mọi quyết định, câu hỏi mở và tên tệp, để một tác nhân mới có thể tiếp tục công việc.

Mô hình này có giá theo điều kiện. Chỉ tổng token hàng tháng không thể tạo ước tính đáng tin cậy; hãy dùng bảng giá chi tiết theo thông số yêu cầu, bộ nhớ đệm và khung giờ áp dụng.

FAQ

Claude Haiku 5.5 giỏi nhất ở việc gì?

Các công việc có phạm vi hẹp, khối lượng lớn: phân loại, trích xuất, định tuyến, tóm tắt, nén dữ liệu và các tác vụ tác nhân phụ. Anthropic quảng bá đây là mô hình nhanh nhất của họ và cho biết Sonnet 5.5 hoặc Opus 5.5 vẫn tốt hơn cho việc lập trình tác nhân phức tạp.

Tôi nên bắt đầu với mức độ nỗ lực nào trên Haiku 5.5?

Anthropic khuyến nghị mức trung bình (medium), mức mặc định, cho hầu hết các công việc bao gồm lập trình tác nhân. Sử dụng mức thấp (low) cho trò chuyện, các tác vụ công cụ ngắn và các yêu cầu đơn giản với khối lượng lớn, mặc dù trong các lời nhắc tác nhân dài, nó có thể bỏ qua tìm kiếm hoặc dừng sớm. Sử dụng mức cao (high) để tuân thủ hướng dẫn nghiêm ngặt, và chỉ sử dụng xhigh hoặc max khi các thử nghiệm của riêng bạn cho thấy hiệu quả tăng lên.

Tôi có thể tắt tính năng suy nghĩ trên Haiku 5.5 không?

Một phần. Tính năng suy nghĩ là thích ứng và được bật theo mặc định. Việc gửi yêu cầu với tính năng suy nghĩ bị vô hiệu hóa sẽ hoạt động ở mức nỗ lực thấp, trung bình và cao, và trả về lỗi ở mức xhigh và max. Cách ưu tiên của Anthropic để giảm bớt suy nghĩ là chọn mức độ nỗ lực thấp hơn. Suy nghĩ được tính vào giới hạn đầu ra, vì vậy hãy để dành dung lượng cho nó.

Haiku 5.5 khác với Haiku 4.5 như thế nào?

Anthropic báo cáo những cải thiện lớn về tiêu chuẩn đánh giá, cửa sổ ngữ cảnh và giới hạn đầu ra dài hơn, mức độ nỗ lực có thể điều chỉnh và suy nghĩ thích ứng thay thế cho ngân sách suy nghĩ thủ công. Nó sử dụng bộ mã hóa (tokenizer) mới hơn, vì vậy cùng một văn bản sẽ được tính là nhiều token hơn, và các bộ phân loại an toàn của nó có thể trả về các từ chối mà Haiku 4.5 không có.

Khi nào tôi nên chọn Sonnet 5.5 thay vì Haiku 5.5?

Hãy chọn Sonnet 5.5 hoặc Opus 5.5 cho các công việc lập trình tác nhân phức tạp, các phiên làm việc trên terminal dài và các tác vụ cần sự phán đoán bền bỉ, nơi Anthropic cho biết chúng vẫn mạnh mẽ hơn. Hãy chọn Haiku 5.5 khi tốc độ và khối lượng công việc là quan trọng và tác vụ có phạm vi hẹp, chẳng hạn như phân loại, tóm tắt hoặc công việc tác nhân phụ.

Claude Haiku 5.5 có giá bao nhiêu?

Trên TokenLab, Claude Haiku 5.5 có giá Đầu vào $0.03 / Đầu ra $0.15 mỗi 1M token. Bảng giá phía trên cho thấy chi tiết đầy đủ. Giá phụ thuộc vào đơn vị tính phí, thông số và mức sử dụng. Hãy so sánh các điều kiện tương đương trong bảng giá chi tiết của mô hình; một mức giá đơn lẻ không quyết định tổng chi phí.

Giới hạn ngữ cảnh và đầu ra của Claude Haiku 5.5 là bao nhiêu?

Claude Haiku 5.5 hỗ trợ tối đa 1.000.000 token ngữ cảnh và trả về tối đa 128.000 token mỗi phản hồi.

Claude Haiku 5.5 nên dùng endpoint nào?

Dùng https://api.tokenlab.sh/v1/messages làm mặc định cho Claude Haiku 5.5. Nếu mô hình hỗ trợ định dạng native của nhà cung cấp, API workbench cũng hiển thị endpoint đó.

Claude Haiku 5.5 hỗ trợ những thao tác nào?

Claude Haiku 5.5 hỗ trợ Văn bản sang văn bản. Chọn một thao tác trong API workbench phía trên để xem endpoint và mã ví dụ tương ứng.

So sánh Claude Haiku 5.5

Nguồn

Đánh giá ngày 8 thg 10, 2026

Xem thêm từ Claude 5

Mô hình liên quan