각 요청에 대해 Auto, TokenLab Verified 또는 Official를 선택할 수 있으며, 가격은 사전에 표시됩니다.새로운 기능 확인하기

TokenLab 블로그

사용 가이드 · 모델 소식 · 제품 업데이트

5분 만에 OpenAI에서 TokenLab으로 마이그레이션하기
튜토리얼

5분 만에 OpenAI에서 TokenLab으로 마이그레이션하기

OpenAI에서 TokenLab으로 마이그레이션하는 과정은 `base_url`과 `api_key`를 변경하는 것부터 시작하며, 이후 모델 ID, 스트리밍, tool calls, 에러 형태, 타임아웃 및 과금 체계를 최신 문서와 대조하여 확인해야 합니다.

9월 19일
LLM Latency vs Throughput: API 구매자가 속도를 측정하는 방법
인사이트

LLM Latency vs Throughput: API 구매자가 속도를 측정하는 방법

TokenLab의 날짜가 지난 4개 모델 스트리밍 샘플은 왜 첫 번째 가시 토큰(first visible token), 총 시간(total time), 초당 토큰 수(tokens per second)를 하니스(harness), 로그 기록용 헤더, 그리고 속도 제한(rate-limit) 계산과 함께 각각 별도로 측정해야 하는지를 보여줍니다.

9월 19일
빠른 에이전트 루프를 위한 Gemini 3.5 Flash API
튜토리얼

빠른 에이전트 루프를 위한 Gemini 3.5 Flash API

모델 문자열이 변경되어 404 오류가 발생하는 것은 에이전트 루프를 시작하는 아주 좋지 않은 방법입니다. 다음은 `gemini-3.5-flash`를 고정(pin)하고, Google Cloud 요금 정보를 읽어오며, 서비스 종료(deprecation) 상황에서도 살아남는 루프를 구축하는 방법입니다.

9월 19일