الأطر والمنصات

Promptfoo

تشغيل تقييمات Promptfoo مقابل نماذج TokenLab

نظرة عامة

يمكن لـ Promptfoo تقييم TokenLab من خلال مزودي الدردشة (chat) والاستجابات (Responses) المتوافقين مع OpenAI.

النوع: إطار عمل التقييم

المسارات الأساسية: إكمال الدردشة المتوافق مع OpenAI والاستجابات

مستوى دعم المسار: مسار مدعوم

البيئة

export TOKENLAB_API_KEY="sk-your-tokenlab-key"

مثال على الإعدادات

description: TokenLab provider example

prompts:
  - 'Answer in one concise paragraph: {{question}}'

providers:
  - id: openai:chat:gpt-5.4-mini
    label: tokenlab-chat-gpt-5.4-mini
    config:
      apiBaseUrl: https://api.tokenlab.sh/v1
      apiKey: '{{env.TOKENLAB_API_KEY}}'
  - id: openai:responses:gpt-5.5
    label: tokenlab-responses-gpt-5.5
    config:
      apiBaseUrl: https://api.tokenlab.sh/v1
      apiKey: '{{env.TOKENLAB_API_KEY}}'

tests:
  - vars:
      question: What are two practical ways to evaluate an LLM gateway?
    assert:
      - type: contains-any
        value:
          - latency
          - reliability
          - cost
          - quality

التشغيل

promptfoo eval

استخدم مزودي الدردشة (chat providers) للحصول على توافق واسع. استخدم مزودي الاستجابات (Responses providers) عندما يعتمد التقييم بشكل خاص على سلوك الاستجابات.

في هذه الصفحة