핵심 가이드
안정적인 TokenLab 통합
안정적인 TokenLab 통합
모델과 비용
모델 API나 모델 페이지에서 현재 기능과 가격을 확인하고 같은 작업으로 비교하세요. 요청마다 모델을 명시하세요. 모델 변경은 가격, 품질, 도구, 컨텍스트를 바꿀 수 있으므로 알리지 않고 전환하지 마세요.
API 형식과 모델에 맞는 출력 제한을 설정하고 중복 컨텍스트를 줄이세요. 미디어 비용은 수량, 길이, 해상도 등에 따라 달라집니다. 비싼 생성은 확인 전에 제공 가능한 예상 비용을 보여 주세요.
스트리밍과 재시도
스트리밍은 텍스트를 빨리 보여 주지만 토큰 비용을 줄이지 않습니다. 연결이 끊기면 유용한 부분 출력은 보존하되 완성된 답변으로 표시하지 마세요.
429는 Retry-After 또는 retry_after만큼 기다리고 일시적인 5xx에는 짧은 백오프를 적용하세요. 인증, 권한, 잔액, 입력과 컨텍스트 오류는 수정이 필요합니다. 재시도 횟수와 총 시간을 제한하고 SDK 재시도와 중복하지 마세요.
키 보호와 요청 기록
API 키는 서버 환경이나 비밀 관리 도구에 보관하세요. 브라우저, 모바일 앱 번들, 공개 저장소, 로그에 넣지 마세요. 개발, 운영, 독립 앱의 키를 분리하고 모델과 지출을 제한하세요. 노출되면 즉시 폐기하세요.
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["TOKENLAB_API_KEY"],
base_url="https://api.tokenlab.sh/v1",
timeout=30.0,
max_retries=0,
)request_id, task_id, 반환된 billing_transaction_id, 모델, 엔드포인트, 자체 작업 ID를 기록하세요. 자격 증명, 전체 비공개 프롬프트, 미디어, 서명 URL은 기록하지 마세요. 최종 비용은 Console Usage나 관리 API 사용 기록으로 확인하세요.
비동기 작업
비동기 생성 성공 시 task ID와 poll_url을 저장하고 completed 또는 failed까지 조회하세요. 조회 실패는 생성 실패가 아닙니다. 시간 초과나 새로 고침 뒤에는 저장된 작업을 먼저 조회하고 지원 엔드포인트에서는 멱등 키를 사용하세요.
출시 전 확인
출시 전 실제 모델과 형식, 정상 응답과 일반 오류, 현재 가격, 새로 고침 및 반복 클릭 동작을 검증하세요.