框架与平台

Promptfoo

针对 TokenLab 模型运行 Promptfoo 评估

概述

Promptfoo 可以通过 OpenAI 兼容的 Chat Completions 或 Responses 配置评测 TokenLab 模型。

环境

export TOKENLAB_API_KEY="sk-your-tokenlab-key"

配置示例

description: TokenLab provider example

prompts:
  - 'Answer in one concise paragraph: {{question}}'

providers:
  - id: openai:chat:gpt-5.4-mini
    label: tokenlab-chat-gpt-5.4-mini
    config:
      apiBaseUrl: https://api.tokenlab.sh/v1
      apiKey: '{{env.TOKENLAB_API_KEY}}'
  - id: openai:responses:gpt-5.5
    label: tokenlab-responses-gpt-5.5
    config:
      apiBaseUrl: https://api.tokenlab.sh/v1
      apiKey: '{{env.TOKENLAB_API_KEY}}'

tests:
  - vars:
      question: What are two practical ways to evaluate an LLM gateway?
    assert:
      - type: contains-any
        value:
          - latency
          - reliability
          - cost
          - quality

运行

promptfoo eval

使用 chat 提供程序以获得广泛的兼容性。当评估明确依赖于 responses 行为时,请使用 responses 提供程序。

本页内容