Chọn Auto, TokenLab Verified hoặc Official cho mỗi yêu cầu, với giá được hiển thị ngay từ đầu.Xem có gì mới

Blog TokenLab

Hướng dẫn, mô hình và cập nhật sản phẩm

OpenRouter so với TokenLab: So sánh kiến trúc AI API Gateway
So sánh

OpenRouter so với TokenLab: So sánh kiến trúc AI API Gateway

So sánh kỹ thuật giữa OpenRouter và TokenLab, phân tích quá trình chuẩn hóa theo một lược đồ duy nhất (single-schema) so với định tuyến cổng gốc đa định dạng (multi-format native gateway) qua các endpoint của OpenAI, Anthropic và Gemini.

19 tháng 9
Chuyển đổi từ OpenAI sang TokenLab trong 5 phút
Hướng dẫn

Chuyển đổi từ OpenAI sang TokenLab trong 5 phút

Việc chuyển đổi từ OpenAI sang TokenLab bắt đầu bằng việc thay đổi `base_url` và `api_key`, sau đó kiểm tra các model ID, streaming, tool calls, cấu trúc lỗi, thời gian chờ (timeout) và thanh toán dựa trên tài liệu đã được cập nhật.

19 tháng 9
Độ trễ (Latency) so với Thông lượng (Throughput) của LLM: Cách người mua API nên đo lường tốc độ
Góc nhìn

Độ trễ (Latency) so với Thông lượng (Throughput) của LLM: Cách người mua API nên đo lường tốc độ

Một mẫu streaming bốn mô hình đã cũ từ TokenLab cho thấy lý do tại sao thời gian hiển thị token đầu tiên (first visible token), tổng thời gian và số lượng token mỗi giây (tokens per second) phải được đo lường riêng biệt, cùng với một bộ công cụ (harness), các tiêu đề (headers) để ghi nhật ký và tính toán giới hạn tốc độ (rate-limit).

19 tháng 9
API Gemini 3.5 Flash cho các vòng lặp Agent nhanh
Hướng dẫn

API Gemini 3.5 Flash cho các vòng lặp Agent nhanh

Việc gặp lỗi 404 do chuỗi định danh model bị thay đổi là một khởi đầu tồi tệ cho một vòng lặp agent. Dưới đây là cách ghim `gemini-3.5-flash`, đọc bảng giá của Google Cloud và xây dựng một vòng lặp có khả năng chống chịu với các đợt ngừng hỗ trợ (deprecations).

19 tháng 9