Elija Auto, TokenLab Verified o Official para cada solicitud, con los precios mostrados por adelantado.Ver las novedades

StepFun: Step 3.7 Flash

Modelo flash de StepFun más reciente para agentes más rápidos, codificación y prompts multimodales.
Comparar modelos
step-3.7-flash
DisponibleStepFunChat
Entrada / Salida
$0.20 / $1.15
Contexto
256K
Salida máxima
256K
Modalidades
Chat
Capacidades
Uso de herramientasCaché de prompts

Sobre Step 3.7 Flash

Step 3.7 Flash es el modelo de mezcla de expertos dispersa de StepFun para agentes de programación, flujos de trabajo de búsqueda y trabajo de productividad de contexto largo. Su ficha describe un diseño de 198B de parámetros con cerca de 11B activos por token y tres niveles de razonamiento seleccionables. Sigue a Step 3.5 Flash, añade soporte para salida estructurada y se lanza bajo Apache 2.0.

Puntos fuertes

  • Búsqueda y verificación: la ficha describe un agente que verifica afirmaciones frente a fuentes recuperadas y resiste páginas adversarias.
  • Fiabilidad del agente: la ficha reporta 67.1 en ClawEval-1.1, una prueba de flujos de trabajo de múltiples turnos con trampas adversarias.
  • Trabajo en repositorios: obtiene una puntuación de 56.3 en SWE-Bench Pro, el segundo lugar en la comparación de la ficha.
  • La profundidad de razonamiento se puede establecer en bajo, medio o alto, intercambiando latencia por precisión por solicitud.
  • Se admiten el modo JSON, la salida de esquema de respuesta, las llamadas a herramientas y el almacenamiento en caché de prompts.

Cuándo buscar otra opción

  • La propia StepFun señala a Terminal-Bench con 59.5 y GDPVal-AA con 45.8 como áreas que necesitan mejora.
  • Es un modelo de texto sin entrada de imagen, por lo que las capturas de pantalla y las páginas escaneadas necesitan primero un modelo con capacidad de visión.
  • Los pesos completos de 198B son pesados para el autohospedaje, por lo que la mayoría de los equipos lo usan a través de una API.

Primeros pasos

  1. Crear clave API

    Genera una clave en Console y úsala con cualquier modelo de la plataforma.

  2. Envía tu primera solicitud

    Copia el ejemplo para tu lenguaje y ejecútalo contra el endpoint.

    Texto a textoMessages API
    POST/v1/messages
    Formato de API:
    curl https://api.tokenlab.sh/v1/messages \
      -H "Content-Type: application/json" \
      -H "x-api-key: sk-xxx" \
      -H "anthropic-version: 2023-06-01" \
      -d '{
        "model": "step-3.7-flash",
        "max_tokens": 1024,
        "messages": [
          {"role": "user", "content": "Hello!"}
        ]
      }'

Precios

El precio oficial es la línea base pública del creador del modelo. El precio de TokenLab es lo que pagas por este modelo en TokenLab.

Default

Por 1M Token
Precio Official
Entrada $0.20 / Salida $1.15 / Lectura de caché $0.04 / Texto Entrada $0.20 / Texto Salida $1.15
Official
Entrada $0.20 / Salida $1.15 / Lectura de caché $0.04 / Texto Entrada $0.20 / Texto Salida $1.15
Descuento
—
Precios de caché de prompt

Lectura de caché

Precio Official
$0.04
Official
$0.04
Descuento
—

Uso y actividad

La tasa de éxito es la proporción de solicitudes completadas. La latencia es cuánto tarda una respuesta completa; P95 significa que el 95 % de las solicitudes terminaron dentro de ese tiempo.

Uso y disponibilidad

Últimas 24 horas
Solicitudes
Tasa de éxito
Latencia P95
Total de tokens
Desempeño del modelo
Las métricas aparecerán una vez que se alcancen los umbrales de privacidad y volumen de datos.

Los datos se basan en solicitudes de usuario agregadas, excluyendo las comprobaciones de estado.

Abrir en Console

Abre Step 3.7 Flash en Console con un prompt listo para editar o enviar.

Ayúdame a probar step-3.7-flash con un mensaje breve en /v1/messages. Muestra la respuesta, la latencia y el coste.

Casos de uso

  • Agentes de programación concurrentes

    Ejecute varios agentes contra un repositorio, cada uno rastreando rutas de código y produciendo parches, con un nivel de razonamiento más bajo para ediciones rutinarias.

  • Bucles de búsqueda y verificación

    Haga que un agente busque, lea fuentes y verifique sus propias afirmaciones antes de responder, utilizando la resistencia del modelo a páginas adversarias.

  • Extracción estructurada

    Devuelva JSON tipado de facturas, tickets o archivos con cumplimiento de esquema de respuesta en lugar de analizar texto libre.

  • Resumen de contexto largo

    Condense informes largos, transcripciones e historiales de tickets en resúmenes, utilizando un nivel de razonamiento más bajo para resúmenes rutinarios y uno más alto para el análisis.

Ejemplos de prompts

Busque en el repositorio cada llamador de billing.charge(), enumere aquellos que ignoran el valor de retorno y proponga un parche para cada uno.

Extraiga el proveedor, el número de factura, los artículos de línea y el total de este texto como JSON que coincida con el esquema que le proporcioné.

Verifique cada afirmación en este borrador frente a las fuentes que puede recuperar y marque cada declaración que no pudo confirmar.

Este modelo tiene precio condicional. Los totales mensuales de tokens por sí solos no producen una estimación fiable; use el precio detallado según la especificación de la solicitud, la caché y la ventana aplicable.

FAQ

¿Qué es Step 3.7 Flash?

Es el modelo de mezcla de expertos dispersa de StepFun destinado a la programación agentica, la búsqueda y el trabajo de contexto largo. La ficha del modelo enumera 198B de parámetros totales, cerca de 11B activos por token y una licencia Apache 2.0. StepFun lo posiciona para desarrolladores que escalan flujos de trabajo de agentes.

¿Cuáles son los niveles de razonamiento?

StepFun proporciona tres niveles seleccionables: bajo, medio y alto. Use bajo para llamadas a herramientas rutinarias y respuestas cortas, y alto para depuración, planificación o verificación de varios pasos donde la precisión importa más que el tiempo de respuesta.

¿Admite Step 3.7 Flash la salida estructurada?

Sí. Admite esquemas de respuesta junto con el modo JSON y llamadas a herramientas, por lo que puede restringir las respuestas a un esquema. Eso lo distingue de Step 3.5 Flash, que no tiene soporte para esquemas de respuesta.

¿Puede leer imágenes?

No. Es un modelo de texto, por lo que no se admite la entrada de imágenes. Para capturas de pantalla o páginas escaneadas, use Step 5 Preview, que acepta imágenes y video, o extraiga el texto primero.

¿Cuándo debería elegir Step 5 Preview en su lugar?

Elija Step 5 Preview cuando necesite el modelo insignia de StepFun, una ventana de contexto en el rango del millón de tokens o entrada de video. Step 3.7 Flash es la opción más rápida y pequeña para bucles de agentes de alto volumen.

¿Cuánto cuesta Step 3.7 Flash?

En TokenLab, Step 3.7 Flash cuesta Entrada $0.20 / Salida $1.15 Por 1M Token. La tabla de precios arriba muestra el desglose completo. Las tarifas dependen de la unidad de facturación, la especificación y el uso. Compare condiciones iguales en el precio detallado del modelo; una sola tarifa no determina el coste total.

¿Cuál es la ventana de contexto y el límite de salida de Step 3.7 Flash?

Step 3.7 Flash admite hasta 262.144 tokens de contexto y genera hasta 262.144 tokens por respuesta.

¿Qué endpoint debe usar Step 3.7 Flash?

Utiliza https://api.tokenlab.sh/v1/messages para Step 3.7 Flash. El ejemplo de solicitud a continuación muestra la estructura de código correspondiente.

¿Qué operaciones soporta Step 3.7 Flash?

Step 3.7 Flash admite Texto a texto. Selecciona una operación arriba para ver su endpoint y ejemplo de solicitud.

Comparar Step 3.7 Flash

Fuentes

Revisado el 2 oct 2026

Modelos relacionados