每次请求可选择 Auto、TokenLab Verified 或 Official,并查看对应价格。查看更新

StepFun: Step 3.7 Flash

阶跃星辰更新的 Flash 模型,面向更快的智能体、编程与多模态提示
对比模型
step-3.7-flash
可用StepFun聊天
输入 / 输出
$0.20 / $1.15
上下文
256K
最大输出
256K
模态
聊天
能力
工具调用提示词缓存

Step 3.7 Flash 简介

Step 3.7 Flash 是阶跃星辰(StepFun)的稀疏混合专家模型,面向编码智能体、搜索工作流和长上下文的效率工作。模型卡描述其为 198B 参数的设计,每个 token 约激活 11B,并提供三个可选的推理级别。它接续 Step 3.5 Flash,增加了结构化输出支持,以 Apache 2.0 协议发布。

擅长的任务

  • 搜索与核实:模型卡描述的智能体会对照检索到的来源核实说法,并能抵御恶意页面。
  • 智能体可靠性:模型卡报告 ClawEval-1.1 得分 67.1,该测试针对带对抗陷阱的多轮工作流。
  • 代码库工作:SWE-Bench Pro 得分 56.3,在模型卡的对比中排第二。
  • 推理深度可设为低、中、高,每次请求都可以在延迟和准确度之间取舍。
  • 支持 JSON 模式、响应 schema 输出、工具调用和提示词缓存。

什么情况换别的模型

  • StepFun 自己指出,Terminal-Bench 的 59.5 和 GDPVal-AA 的 45.8 是需要改进的方面。
  • 它是文本模型,没有图像输入,截图和扫描页需要先交给具备视觉能力的模型处理。
  • 完整的 198B 权重自托管很吃资源,所以多数团队通过 API 使用。

快速上手

  1. 创建 API 密钥

    在 Console 生成一把密钥,平台上的模型都能用。

  2. 发送第一个请求

    复制你所用语言的示例代码,向该端点发起请求。

    文本生成Messages API
    POST/v1/messages
    API 格式:
    curl https://api.tokenlab.sh/v1/messages \
      -H "Content-Type: application/json" \
      -H "x-api-key: sk-xxx" \
      -H "anthropic-version: 2023-06-01" \
      -d '{
        "model": "step-3.7-flash",
        "max_tokens": 1024,
        "messages": [
          {"role": "user", "content": "Hello!"}
        ]
      }'

价格

官方价格是模型厂商公开的基线价,TokenLab 价格是用这个模型时实际的计费价。

Default

每 1M token
官方价格
输入 $0.20 / 输出 $1.15 / 缓存读取 $0.04 / 文本 输入 $0.20 / 文本 输出 $1.15
Official
输入 $0.20 / 输出 $1.15 / 缓存读取 $0.04 / 文本 输入 $0.20 / 文本 输出 $1.15
折扣
—
提示词缓存价格

缓存读取

官方价格
$0.04
Official
$0.04
折扣
—

用量与动态

成功率是请求完成的比例;延迟是拿到一次完整响应要花的时间,P95 表示 95% 的请求都在这个时间内完成。

用量与可用性

最近 24 小时
请求
成功率
P95 延迟
总 token 数
模型表现
达到隐私和数据量阈值后,指标才会显示。

数据来自汇总的用户请求,不含状态检查。

直接在 Console 里试

Step 3.7 Flash 已在 Console 备好,提示词已填好,可以直接修改或发送。

帮我用 step-3.7-flash 发一条简短消息,接口是 /v1/messages。返回回复,附上延迟和费用。

使用场景

  • 并发编码智能体

    让多个智能体同时处理一个代码库,各自追踪代码路径并产出补丁,常规修改可以用较低的推理级别。

  • 搜索与核实循环

    让智能体搜索、阅读来源,并在回答前自查自己的说法,利用模型对恶意页面的抵抗能力。

  • 结构化提取

    用响应 schema 约束,从发票、工单或申报文件中返回带类型的 JSON,不用再解析自由文本。

  • 长上下文摘要

    把长报告、转录稿和工单历史浓缩成简报,常规摘要用较低推理级别,分析时用较高级别。

提示词示例

在代码库中搜索 billing.charge() 的所有调用方,列出忽略返回值的那些,并为每一处提出补丁。

从这段文本中提取供应商、发票号、明细行和总额,输出为符合我给出的 schema 的 JSON。

把这份草稿里的每个说法与你能检索到的来源对照,标出所有你无法确认的陈述。

此模型按条件计价,仅凭月度 token 总量无法可靠估算;请按请求规格、缓存和适用时段查看详细定价。

FAQ

Step 3.7 Flash 是什么?

它是阶跃星辰的稀疏混合专家模型,面向智能体编码、搜索和长上下文工作。模型卡列出总参数 198B、每个 token 约激活 11B,以及 Apache 2.0 许可证。StepFun 把它定位为给要扩展智能体工作流的开发者使用。

推理级别有哪些?

StepFun 提供三个可选级别:低、中、高。常规工具调用和短回答用低,调试、规划或多步核实这类准确度比响应时间更重要的任务用高。

Step 3.7 Flash 支持结构化输出吗?

支持。它支持响应 schema,同时提供 JSON 模式和工具调用,所以可以把回复约束到某个 schema。这是它与 Step 3.5 Flash 的区别,后者不支持响应 schema。

它能读图片吗?

不能。它是文本模型,不支持图像输入。处理截图或扫描页时,请用接受图片和视频的 Step 5 Preview,或先提取文字。

什么时候该选 Step 5 Preview?

需要 StepFun 的旗舰模型、百万 token 量级的上下文窗口或视频输入时,选 Step 5 Preview。Step 3.7 Flash 是更快、更小的选项,适合高吞吐的智能体循环。

Step 3.7 Flash 的费用是多少?

在 TokenLab 上,Step 3.7 Flash 的价格为 输入 $0.20 / 输出 $1.15 每 1M token。完整明细见上方价格表。 价格因计费单位、规格和用量而异。请在模型的详细定价中对比相同条件下的费率;单一费率不代表总价。

Step 3.7 Flash 的上下文窗口和输出上限是多少?

Step 3.7 Flash 最多接收 262,144 token 的上下文,单次最多返回 262,144 token。

Step 3.7 Flash 应该使用哪个端点?

Step 3.7 Flash 使用 https://api.tokenlab.sh/v1/messages。代码写法见下方的请求示例。

Step 3.7 Flash 支持哪些操作?

Step 3.7 Flash 支持 文本生成。选了操作,上面会显示对应的端点和请求示例。

Step 3.7 Flash 对比

资料来源

审阅于 2026年10月2日

相关模型