- 输入 / 输出
- $0.20 / $1.15
- 上下文
- 256K
- 最大输出
- 256K
- 模态
- 聊天
- 能力
- 工具调用提示词缓存
Step 3.7 Flash 简介
Step 3.7 Flash 是阶跃星辰(StepFun)的稀疏混合专家模型,面向编码智能体、搜索工作流和长上下文的效率工作。模型卡描述其为 198B 参数的设计,每个 token 约激活 11B,并提供三个可选的推理级别。它接续 Step 3.5 Flash,增加了结构化输出支持,以 Apache 2.0 协议发布。
擅长的任务
- 搜索与核实:模型卡描述的智能体会对照检索到的来源核实说法,并能抵御恶意页面。
- 智能体可靠性:模型卡报告 ClawEval-1.1 得分 67.1,该测试针对带对抗陷阱的多轮工作流。
- 代码库工作:SWE-Bench Pro 得分 56.3,在模型卡的对比中排第二。
- 推理深度可设为低、中、高,每次请求都可以在延迟和准确度之间取舍。
- 支持 JSON 模式、响应 schema 输出、工具调用和提示词缓存。
什么情况换别的模型
- StepFun 自己指出,Terminal-Bench 的 59.5 和 GDPVal-AA 的 45.8 是需要改进的方面。
- 它是文本模型,没有图像输入,截图和扫描页需要先交给具备视觉能力的模型处理。
- 完整的 198B 权重自托管很吃资源,所以多数团队通过 API 使用。
快速上手
创建 API 密钥
在 Console 生成一把密钥,平台上的模型都能用。
发送第一个请求
复制你所用语言的示例代码,向该端点发起请求。
文本生成Messages APIPOST/v1/messagesAPI 格式:curl https://api.tokenlab.sh/v1/messages \ -H "Content-Type: application/json" \ -H "x-api-key: sk-xxx" \ -H "anthropic-version: 2023-06-01" \ -d '{ "model": "step-3.7-flash", "max_tokens": 1024, "messages": [ {"role": "user", "content": "Hello!"} ] }'
价格
官方价格是模型厂商公开的基线价,TokenLab 价格是用这个模型时实际的计费价。
Default
每 1M token- 官方价格
- 输入 $0.20 / 输出 $1.15 / 缓存读取 $0.04 / 文本 输入 $0.20 / 文本 输出 $1.15
- Official
- 输入 $0.20 / 输出 $1.15 / 缓存读取 $0.04 / 文本 输入 $0.20 / 文本 输出 $1.15
- 折扣
- —
缓存读取
- 官方价格
- $0.04
- Official
- $0.04
- 折扣
- —
| 官方价格每 1M token | Official每 1M token | 折扣 | |
|---|---|---|---|
| Default | 输入 $0.20 / 输出 $1.15 / 缓存读取 $0.04 / 文本 输入 $0.20 / 文本 输出 $1.15 | 输入 $0.20 / 输出 $1.15 / 缓存读取 $0.04 / 文本 输入 $0.20 / 文本 输出 $1.15 | — |
| 提示词缓存价格 | |||
| 缓存读取 | $0.04 | $0.04 | — |
用量与动态
成功率是请求完成的比例;延迟是拿到一次完整响应要花的时间,P95 表示 95% 的请求都在这个时间内完成。
用量与可用性
最近 24 小时- 请求
- 成功率
- P95 延迟
- 总 token 数
数据来自汇总的用户请求,不含状态检查。
直接在 Console 里试
Step 3.7 Flash 已在 Console 备好,提示词已填好,可以直接修改或发送。
帮我用 step-3.7-flash 发一条简短消息,接口是 /v1/messages。返回回复,附上延迟和费用。
使用场景
并发编码智能体
让多个智能体同时处理一个代码库,各自追踪代码路径并产出补丁,常规修改可以用较低的推理级别。
搜索与核实循环
让智能体搜索、阅读来源,并在回答前自查自己的说法,利用模型对恶意页面的抵抗能力。
结构化提取
用响应 schema 约束,从发票、工单或申报文件中返回带类型的 JSON,不用再解析自由文本。
长上下文摘要
把长报告、转录稿和工单历史浓缩成简报,常规摘要用较低推理级别,分析时用较高级别。
提示词示例
在代码库中搜索 billing.charge() 的所有调用方,列出忽略返回值的那些,并为每一处提出补丁。
从这段文本中提取供应商、发票号、明细行和总额,输出为符合我给出的 schema 的 JSON。
把这份草稿里的每个说法与你能检索到的来源对照,标出所有你无法确认的陈述。
此模型按条件计价,仅凭月度 token 总量无法可靠估算;请按请求规格、缓存和适用时段查看详细定价。
FAQ
Step 3.7 Flash 是什么?
它是阶跃星辰的稀疏混合专家模型,面向智能体编码、搜索和长上下文工作。模型卡列出总参数 198B、每个 token 约激活 11B,以及 Apache 2.0 许可证。StepFun 把它定位为给要扩展智能体工作流的开发者使用。
推理级别有哪些?
StepFun 提供三个可选级别:低、中、高。常规工具调用和短回答用低,调试、规划或多步核实这类准确度比响应时间更重要的任务用高。
Step 3.7 Flash 支持结构化输出吗?
支持。它支持响应 schema,同时提供 JSON 模式和工具调用,所以可以把回复约束到某个 schema。这是它与 Step 3.5 Flash 的区别,后者不支持响应 schema。
它能读图片吗?
不能。它是文本模型,不支持图像输入。处理截图或扫描页时,请用接受图片和视频的 Step 5 Preview,或先提取文字。
什么时候该选 Step 5 Preview?
需要 StepFun 的旗舰模型、百万 token 量级的上下文窗口或视频输入时,选 Step 5 Preview。Step 3.7 Flash 是更快、更小的选项,适合高吞吐的智能体循环。
Step 3.7 Flash 的费用是多少?
在 TokenLab 上,Step 3.7 Flash 的价格为 输入 $0.20 / 输出 $1.15 每 1M token。完整明细见上方价格表。 价格因计费单位、规格和用量而异。请在模型的详细定价中对比相同条件下的费率;单一费率不代表总价。
Step 3.7 Flash 的上下文窗口和输出上限是多少?
Step 3.7 Flash 最多接收 262,144 token 的上下文,单次最多返回 262,144 token。
Step 3.7 Flash 应该使用哪个端点?
Step 3.7 Flash 使用 https://api.tokenlab.sh/v1/messages。代码写法见下方的请求示例。
Step 3.7 Flash 支持哪些操作?
Step 3.7 Flash 支持 文本生成。选了操作,上面会显示对应的端点和请求示例。
Step 3.7 Flash 对比
资料来源
审阅于 2026年10月2日