Escolha Auto, TokenLab Verified ou Official para cada solicitação, com preços exibidos antecipadamente.Veja as novidades

StepFun: Step 3.7 Flash

Modelo flash mais recente da StepFun para agentes mais rápidos, codificação e prompts multimodais.
Comparar modelos
step-3.7-flash
DisponívelStepFunChat
Entrada / Saída
$0.20 / $1.15
Contexto
256K
Saída máxima
256K
Modalidades
Chat
Capacidades
Uso de ferramentasCache de prompts

Sobre o Step 3.7 Flash

O Step 3.7 Flash é o modelo de mistura de especialistas esparsa da StepFun para agentes de codificação, fluxos de trabalho de pesquisa e trabalho de produtividade com contexto longo. Seu cartão descreve um design de 198 bilhões de parâmetros com cerca de 11 bilhões ativos por token e três níveis de raciocínio selecionáveis. Ele sucede o Step 3.5 Flash, adiciona suporte a saída estruturada e é lançado sob a licença Apache 2.0.

Pontos fortes

  • Pesquisa e verificação: o cartão descreve um agente que verifica alegações em relação a fontes recuperadas e resiste a páginas adversárias.
  • Confiabilidade do agente: o cartão relata 67,1 no ClawEval-1.1, um teste de fluxos de trabalho de múltiplos turnos com armadilhas adversárias.
  • Trabalho em repositórios: ele pontua 56,3 no SWE-Bench Pro, ocupando o segundo lugar na comparação do cartão.
  • A profundidade do raciocínio pode ser definida como baixa, média ou alta, trocando latência por precisão por solicitação.
  • Modo JSON, saída com esquema de resposta, chamadas de ferramentas e cache de prompt são todos suportados.

Quando usar outro modelo

  • A própria StepFun aponta o Terminal-Bench em 59,5 e o GDPVal-AA em 45,8 como áreas que precisam de melhoria.
  • É um modelo de texto sem entrada de imagem, portanto, capturas de tela e páginas digitalizadas precisam primeiro de um modelo com capacidade de visão.
  • Os pesos completos de 198 bilhões são pesados para auto-hospedagem, por isso a maioria das equipes o utiliza por meio de uma API.

Primeiros passos

  1. Criar chave de API

    Crie uma chave no Console e use com qualquer modelo da plataforma.

  2. Envie sua primeira requisição

    Copie o exemplo para sua linguagem e execute-o no endpoint.

    Texto para textoMessages API
    POST/v1/messages
    Formato da API:
    curl https://api.tokenlab.sh/v1/messages \
      -H "Content-Type: application/json" \
      -H "x-api-key: sk-xxx" \
      -H "anthropic-version: 2023-06-01" \
      -d '{
        "model": "step-3.7-flash",
        "max_tokens": 1024,
        "messages": [
          {"role": "user", "content": "Hello!"}
        ]
      }'

Preço

O preço oficial é a base pública do criador do modelo. O preço TokenLab é o que você paga por este modelo na TokenLab.

Default

Por 1M Token
Preço oficial
Entrada $0.20 / Saída $1.15 / Leitura de cache $0.04 / Texto Entrada $0.20 / Texto Saída $1.15
Official
Entrada $0.20 / Saída $1.15 / Leitura de cache $0.04 / Texto Entrada $0.20 / Texto Saída $1.15
Desconto
—
Preços de cache de prompt

Leitura de cache

Preço oficial
$0.04
Official
$0.04
Desconto
—

Uso e atividade

A taxa de sucesso é a proporção de requisições concluídas. A latência é quanto tempo uma resposta completa leva; P95 significa que 95% das requisições terminaram dentro desse tempo.

Uso e disponibilidade

Últimas 24 horas
Requisições
Taxa de sucesso
Latência P95
Total de tokens
Desempenho do modelo
As métricas aparecerão assim que os limites de privacidade e volume de dados forem atingidos.

Os dados baseiam-se em solicitações agregadas de usuários, excluindo verificações de status.

Abrir no Console

Abra Step 3.7 Flash no Console com um prompt pronto para editar ou enviar.

Ajude-me a testar step-3.7-flash com uma mensagem em /v1/messages. Exiba a resposta, latência e custo.

Casos de uso

  • Agentes de codificação simultâneos

    Execute vários agentes em um único repositório, cada um rastreando caminhos de código e produzindo patches, com um nível de raciocínio mais baixo para edições de rotina.

  • Loops de pesquisa e verificação

    Faça com que um agente pesquise, leia fontes e verifique suas próprias alegações antes de responder, usando a resistência do modelo a páginas adversárias.

  • Extração estruturada

    Retorne JSON tipado de faturas, tickets ou documentos com imposição de esquema de resposta em vez de analisar texto livre.

  • Resumo de contexto longo

    Condense relatórios longos, transcrições e históricos de tickets em resumos, usando um nível de raciocínio mais baixo para resumos de rotina e um mais alto para análise.

Exemplos de prompt

Pesquise no repositório por cada chamador de billing.charge(), liste aqueles que ignoram o valor de retorno e proponha um patch para cada um.

Extraia o fornecedor, número da fatura, itens de linha e total deste texto como JSON correspondente ao esquema que forneci.

Verifique cada alegação neste rascunho em relação às fontes que você pode recuperar e marque cada declaração que você não conseguiu confirmar.

Este modelo tem preço condicional. Totais mensais de tokens sozinhos não produzem uma estimativa confiável; use o preço detalhado para a especificação da requisição, cache e janela aplicável.

FAQ

O que é o Step 3.7 Flash?

É o modelo de mistura de especialistas esparsa da StepFun voltado para codificação agentica, pesquisa e trabalho com contexto longo. O cartão do modelo lista 198 bilhões de parâmetros totais, cerca de 11 bilhões ativos por token e uma licença Apache 2.0. A StepFun o posiciona para desenvolvedores que escalam fluxos de trabalho de agentes.

Quais são os níveis de raciocínio?

A StepFun oferece três níveis selecionáveis: baixo, médio e alto. Use o baixo para chamadas de ferramentas de rotina e respostas curtas, e o alto para depuração, planejamento ou verificação de várias etapas onde a precisão importa mais do que o tempo de resposta.

O Step 3.7 Flash suporta saída estruturada?

Sim. Ele suporta esquemas de resposta juntamente com o modo JSON e chamadas de ferramentas, para que você possa restringir as respostas a um esquema. Isso o diferencia do Step 3.5 Flash, que não possui suporte a esquema de resposta.

Ele consegue ler imagens?

Não. É um modelo de texto, portanto, a entrada de imagem não é suportada. Para capturas de tela ou páginas digitalizadas, use o Step 5 Preview, que aceita imagens e vídeos, ou extraia o texto primeiro.

Quando devo escolher o Step 5 Preview?

Escolha o Step 5 Preview quando precisar do carro-chefe da StepFun, de uma janela de contexto na casa do milhão de tokens ou de entrada de vídeo. O Step 3.7 Flash é a opção mais rápida e menor para loops de agentes de alto volume.

Quanto custa o Step 3.7 Flash?

No TokenLab, Step 3.7 Flash custa Entrada $0.20 / Saída $1.15 Por 1M Token. A tabela de preços acima mostra o detalhamento completo. As tarifas dependem da unidade de cobrança, da especificação e do uso. Compare condições iguais no preço detalhado do modelo; uma única tarifa não determina o custo total.

Qual a janela de contexto e o limite de saída do Step 3.7 Flash?

O Step 3.7 Flash aceita até 262.144 tokens de contexto e gera até 262.144 tokens por resposta.

Qual endpoint o Step 3.7 Flash deve usar?

Use https://api.tokenlab.sh/v1/messages para Step 3.7 Flash. O exemplo de requisição abaixo mostra o formato de código correspondente.

Quais operações o Step 3.7 Flash suporta?

Step 3.7 Flash suporta Texto para texto. Selecione uma operação acima para ver seu endpoint e exemplo de requisição.

Comparar Step 3.7 Flash

Fontes

Revisado em 2 de out. de 2026

Modelos relacionados