StepFun: Step 3.7 Flash
step-3.7-flash- Entrada / Saída
- $0.20 / $1.15
- Contexto
- 256K
- Saída máxima
- 256K
- Modalidades
- Chat
- Capacidades
- Uso de ferramentasCache de prompts
Sobre o Step 3.7 Flash
O Step 3.7 Flash é o modelo de mistura de especialistas esparsa da StepFun para agentes de codificação, fluxos de trabalho de pesquisa e trabalho de produtividade com contexto longo. Seu cartão descreve um design de 198 bilhões de parâmetros com cerca de 11 bilhões ativos por token e três níveis de raciocínio selecionáveis. Ele sucede o Step 3.5 Flash, adiciona suporte a saída estruturada e é lançado sob a licença Apache 2.0.
Pontos fortes
- Pesquisa e verificação: o cartão descreve um agente que verifica alegações em relação a fontes recuperadas e resiste a páginas adversárias.
- Confiabilidade do agente: o cartão relata 67,1 no ClawEval-1.1, um teste de fluxos de trabalho de múltiplos turnos com armadilhas adversárias.
- Trabalho em repositórios: ele pontua 56,3 no SWE-Bench Pro, ocupando o segundo lugar na comparação do cartão.
- A profundidade do raciocínio pode ser definida como baixa, média ou alta, trocando latência por precisão por solicitação.
- Modo JSON, saída com esquema de resposta, chamadas de ferramentas e cache de prompt são todos suportados.
Quando usar outro modelo
- A própria StepFun aponta o Terminal-Bench em 59,5 e o GDPVal-AA em 45,8 como áreas que precisam de melhoria.
- É um modelo de texto sem entrada de imagem, portanto, capturas de tela e páginas digitalizadas precisam primeiro de um modelo com capacidade de visão.
- Os pesos completos de 198 bilhões são pesados para auto-hospedagem, por isso a maioria das equipes o utiliza por meio de uma API.
Primeiros passos
Criar chave de API
Crie uma chave no Console e use com qualquer modelo da plataforma.
Envie sua primeira requisição
Copie o exemplo para sua linguagem e execute-o no endpoint.
Texto para textoMessages APIPOST/v1/messagesFormato da API:curl https://api.tokenlab.sh/v1/messages \ -H "Content-Type: application/json" \ -H "x-api-key: sk-xxx" \ -H "anthropic-version: 2023-06-01" \ -d '{ "model": "step-3.7-flash", "max_tokens": 1024, "messages": [ {"role": "user", "content": "Hello!"} ] }'
Preço
O preço oficial é a base pública do criador do modelo. O preço TokenLab é o que você paga por este modelo na TokenLab.
Default
Por 1M Token- Preço oficial
- Entrada $0.20 / Saída $1.15 / Leitura de cache $0.04 / Texto Entrada $0.20 / Texto Saída $1.15
- Official
- Entrada $0.20 / Saída $1.15 / Leitura de cache $0.04 / Texto Entrada $0.20 / Texto Saída $1.15
- Desconto
- —
Leitura de cache
- Preço oficial
- $0.04
- Official
- $0.04
- Desconto
- —
| Preço oficialPor 1M Token | OfficialPor 1M Token | Desconto | |
|---|---|---|---|
| Default | Entrada $0.20 / Saída $1.15 / Leitura de cache $0.04 / Texto Entrada $0.20 / Texto Saída $1.15 | Entrada $0.20 / Saída $1.15 / Leitura de cache $0.04 / Texto Entrada $0.20 / Texto Saída $1.15 | — |
| Preços de cache de prompt | |||
| Leitura de cache | $0.04 | $0.04 | — |
Uso e atividade
A taxa de sucesso é a proporção de requisições concluídas. A latência é quanto tempo uma resposta completa leva; P95 significa que 95% das requisições terminaram dentro desse tempo.
Uso e disponibilidade
Últimas 24 horas- Requisições
- Taxa de sucesso
- Latência P95
- Total de tokens
Os dados baseiam-se em solicitações agregadas de usuários, excluindo verificações de status.
Abrir no Console
Abra Step 3.7 Flash no Console com um prompt pronto para editar ou enviar.
Ajude-me a testar step-3.7-flash com uma mensagem em /v1/messages. Exiba a resposta, latência e custo.
Casos de uso
Agentes de codificação simultâneos
Execute vários agentes em um único repositório, cada um rastreando caminhos de código e produzindo patches, com um nível de raciocínio mais baixo para edições de rotina.
Loops de pesquisa e verificação
Faça com que um agente pesquise, leia fontes e verifique suas próprias alegações antes de responder, usando a resistência do modelo a páginas adversárias.
Extração estruturada
Retorne JSON tipado de faturas, tickets ou documentos com imposição de esquema de resposta em vez de analisar texto livre.
Resumo de contexto longo
Condense relatórios longos, transcrições e históricos de tickets em resumos, usando um nível de raciocínio mais baixo para resumos de rotina e um mais alto para análise.
Exemplos de prompt
Pesquise no repositório por cada chamador de billing.charge(), liste aqueles que ignoram o valor de retorno e proponha um patch para cada um.
Extraia o fornecedor, número da fatura, itens de linha e total deste texto como JSON correspondente ao esquema que forneci.
Verifique cada alegação neste rascunho em relação às fontes que você pode recuperar e marque cada declaração que você não conseguiu confirmar.
Este modelo tem preço condicional. Totais mensais de tokens sozinhos não produzem uma estimativa confiável; use o preço detalhado para a especificação da requisição, cache e janela aplicável.
FAQ
O que é o Step 3.7 Flash?
É o modelo de mistura de especialistas esparsa da StepFun voltado para codificação agentica, pesquisa e trabalho com contexto longo. O cartão do modelo lista 198 bilhões de parâmetros totais, cerca de 11 bilhões ativos por token e uma licença Apache 2.0. A StepFun o posiciona para desenvolvedores que escalam fluxos de trabalho de agentes.
Quais são os níveis de raciocínio?
A StepFun oferece três níveis selecionáveis: baixo, médio e alto. Use o baixo para chamadas de ferramentas de rotina e respostas curtas, e o alto para depuração, planejamento ou verificação de várias etapas onde a precisão importa mais do que o tempo de resposta.
O Step 3.7 Flash suporta saída estruturada?
Sim. Ele suporta esquemas de resposta juntamente com o modo JSON e chamadas de ferramentas, para que você possa restringir as respostas a um esquema. Isso o diferencia do Step 3.5 Flash, que não possui suporte a esquema de resposta.
Ele consegue ler imagens?
Não. É um modelo de texto, portanto, a entrada de imagem não é suportada. Para capturas de tela ou páginas digitalizadas, use o Step 5 Preview, que aceita imagens e vídeos, ou extraia o texto primeiro.
Quando devo escolher o Step 5 Preview?
Escolha o Step 5 Preview quando precisar do carro-chefe da StepFun, de uma janela de contexto na casa do milhão de tokens ou de entrada de vídeo. O Step 3.7 Flash é a opção mais rápida e menor para loops de agentes de alto volume.
Quanto custa o Step 3.7 Flash?
No TokenLab, Step 3.7 Flash custa Entrada $0.20 / Saída $1.15 Por 1M Token. A tabela de preços acima mostra o detalhamento completo. As tarifas dependem da unidade de cobrança, da especificação e do uso. Compare condições iguais no preço detalhado do modelo; uma única tarifa não determina o custo total.
Qual a janela de contexto e o limite de saída do Step 3.7 Flash?
O Step 3.7 Flash aceita até 262.144 tokens de contexto e gera até 262.144 tokens por resposta.
Qual endpoint o Step 3.7 Flash deve usar?
Use https://api.tokenlab.sh/v1/messages para Step 3.7 Flash. O exemplo de requisição abaixo mostra o formato de código correspondente.
Quais operações o Step 3.7 Flash suporta?
Step 3.7 Flash suporta Texto para texto. Selecione uma operação acima para ver seu endpoint e exemplo de requisição.
Comparar Step 3.7 Flash
Fontes
Revisado em 2 de out. de 2026