為每個請求選擇 Auto、TokenLab Verified 或 Official,並預先顯示價格。查看最新動態

StepFun: Step 3.7 Flash

較新的 StepFun 快速模型,用於更快速的代理、程式編寫和多模態提示。
比較模型
step-3.7-flash
可用StepFun對話
輸入 / 輸出
$0.20 / $1.15
上下文
256K
最大輸出長度
256K
模態
對話
能力
工具使用提示詞快取

關於 Step 3.7 Flash

Step 3.7 Flash 是 StepFun 用於編碼代理、搜尋工作流和長上下文生產力工作的稀疏混合專家模型。其模型卡描述了一個 198B 參數的設計,每個 token 約激活 11B,並具有三個可選的推理級別。它是 Step 3.5 Flash 的後續版本,增加了結構化輸出支援,並以 Apache 2.0 授權發布。

適用場景

  • 搜尋與驗證:模型卡描述了一個代理,它會根據檢索到的來源檢查聲明,並能抵禦對抗性網頁。
  • 代理可靠性:模型卡報告在 ClawEval-1.1(一項針對帶有對抗性陷阱的多輪工作流測試)中得分 67.1。
  • 儲存庫工作:它在 SWE-Bench Pro 上得分 56.3,在模型卡的比較中排名第二。
  • 推理深度可設定為低、中或高,以在每個請求的延遲與準確性之間進行權衡。
  • 支援 JSON 模式、回應結構(response-schema)輸出、工具調用和提示詞快取。

其他選擇建議

  • StepFun 本身指出 Terminal-Bench(59.5 分)和 GDPVal-AA(45.8 分)是需要改進的領域。
  • 這是一個不支援圖像輸入的純文字模型,因此螢幕截圖和掃描頁面需要先使用具備視覺能力的模型。
  • 完整的 198B 權重對於自託管來說負擔較重,因此大多數團隊透過 API 使用它。

入門指南

  1. 建立 API 金鑰

    請至 Console 建立金鑰,即可在平台上使用各類模型。

  2. 發送您的第一個請求

    複製您所選語言的範例,並針對端點執行它。

    文字轉文字Messages API
    POST/v1/messages
    API 格式:
    curl https://api.tokenlab.sh/v1/messages \
      -H "Content-Type: application/json" \
      -H "x-api-key: sk-xxx" \
      -H "anthropic-version: 2023-06-01" \
      -d '{
        "model": "step-3.7-flash",
        "max_tokens": 1024,
        "messages": [
          {"role": "user", "content": "Hello!"}
        ]
      }'

定價

Official 價格為模型開發商的公開基準價。TokenLab 價格則為您在 TokenLab 使用該模型的實際費用。

Default

每 1M Token
Official 定價
輸入 $0.20 / 輸出 $1.15 / 快取讀取 $0.04 / 純文字 輸入 $0.20 / 純文字 輸出 $1.15
Official
輸入 $0.20 / 輸出 $1.15 / 快取讀取 $0.04 / 純文字 輸入 $0.20 / 純文字 輸出 $1.15
折扣
—
Prompt 快取價格

快取讀取

Official 定價
$0.04
Official
$0.04
折扣
—

使用量與活動

成功率是請求完成的比例;延遲是一次完整回應所需的時間,P95 表示 95% 的請求在該時間內完成。

用量與可用性

過去 24 小時
請求數
成功率
P95 延遲
總 Token 用量
模型效能
當達到隱私權與資料量的門檻後,指標才會顯示。

資料基於彙總的使用者請求,不包含狀態檢查。

直接在 Console 裡試

在 Console 中開啟 Step 3.7 Flash,並準備好編輯或發送提示詞。

協助我使用 step-3.7-flash 透過 /v1/messages 進行對話,並顯示回覆、延遲與成本。

應用情境

  • 並發編碼代理

    針對同一個儲存庫執行多個代理,每個代理追蹤程式碼路徑並產生修補程式,並對常規編輯使用較低的推理級別。

  • 搜尋與驗證循環

    讓代理在回答前進行搜尋、讀取來源並檢查自己的聲明,利用模型對對抗性網頁的抵抗力。

  • 結構化提取

    透過回應結構強制執行,從發票、工單或文件中返回型別化的 JSON,而不是解析自由文字。

  • 長上下文摘要

    將長報告、轉錄稿和工單歷史記錄濃縮為摘要,對常規摘要使用較低的推理級別,對分析使用較高的推理級別。

提示詞範例

搜尋儲存庫中 billing.charge() 的所有調用者,列出那些忽略回傳值的調用者,並為每個調用者提出修補建議。

從這段文字中提取供應商、發票號碼、明細項目和總計,並轉換為符合我提供之結構的 JSON。

根據您可以檢索到的來源檢查此草稿中的每一項聲明,並標記出您無法確認的每一句話。

此模型按條件計價,僅憑每月 token 總量無法可靠估算;請按請求規格、快取和適用時段查看詳細定價。

FAQ

什麼是 Step 3.7 Flash?

這是 StepFun 針對代理編碼、搜尋和長上下文工作而設計的稀疏混合專家模型。模型卡列出總參數為 198B,每個 token 約激活 11B,並採用 Apache 2.0 授權。StepFun 將其定位為開發者擴展代理工作流的選擇。

什麼是推理級別?

StepFun 提供三個可選級別:低、中、高。對於常規工具調用和簡短回答,請使用「低」;對於除錯、規劃或需要準確性高於回應速度的多步驟驗證,請使用「高」。

Step 3.7 Flash 支援結構化輸出嗎?

是的。它支援回應結構(response schemas)以及 JSON 模式和工具調用,因此您可以將回覆限制在特定結構內。這使其與不支援回應結構的 Step 3.5 Flash 區分開來。

它可以讀取圖像嗎?

不能。這是一個純文字模型,因此不支援圖像輸入。對於螢幕截圖或掃描頁面,請使用支援圖像和影片的 Step 5 Preview,或先提取文字。

什麼時候應該選擇 Step 5 Preview?

當您需要 StepFun 的旗艦模型、百萬級 token 的上下文窗口或影片輸入時,請選擇 Step 5 Preview。Step 3.7 Flash 是用於高頻代理循環的更快速、更輕量的選擇。

Step 3.7 Flash 的費用是多少?

在 TokenLab 上,Step 3.7 Flash 價格為 輸入 $0.20 / 輸出 $1.15 每 1M Token。完整明細見上方價格表。 價格因計費單位、規格和用量而異。請在模型的詳細定價中比較相同條件下的費率;單一費率不代表總價。

Step 3.7 Flash 的上下文長度與輸出限制為何?

Step 3.7 Flash 支援最高 262,144 tokens 的上下文,單次回應上限為 262,144 tokens。

Step 3.7 Flash 應該使用哪一個端點?

請使用 https://api.tokenlab.sh/v1/messages 進行 Step 3.7 Flash 的呼叫。下方的請求範例展示了對應的程式碼格式。

Step 3.7 Flash 支援哪些操作?

Step 3.7 Flash 支援 文字轉文字。請在上方選擇一項操作以查看其端點與請求範例。

比較 Step 3.7 Flash

來源

更新於 2026年10月2日

相關模型