StepFun: Step 3.7 Flash
step-3.7-flash- Entrée / Sortie
- $0.20 / $1.15
- Contexte
- 256K
- Sortie maximale
- 256K
- Modalités
- Discussion
- Capacités
- Utilisation d'outilsCache de prompts
À propos de Step 3.7 Flash
Step 3.7 Flash est le modèle à mélange d'experts creux de StepFun pour les agents de codage, les flux de travail de recherche et le travail de productivité à long contexte. Sa fiche décrit une conception de 198 milliards de paramètres avec environ 11 milliards actifs par jeton, et trois niveaux de raisonnement sélectionnables. Il succède à Step 3.5 Flash, ajoute la prise en charge des sorties structurées et est publié sous licence Apache 2.0.
Points forts
- Recherche et vérification : la fiche décrit un agent qui vérifie les affirmations par rapport aux sources récupérées et résiste aux pages adverses.
- Fiabilité de l'agent : la fiche rapporte 67,1 sur ClawEval-1.1, un test de flux de travail multi-tours avec des pièges adverses.
- Travail sur dépôt : il obtient un score de 56,3 sur SWE-Bench Pro, deuxième place dans la comparaison de la fiche.
- La profondeur de raisonnement peut être réglée sur faible, moyen ou élevé, échangeant la latence contre la précision par requête.
- Le mode JSON, la sortie avec schéma de réponse, l'appel d'outils et la mise en cache des invites sont tous pris en charge.
Quand préférer un autre modèle
- StepFun lui-même signale Terminal-Bench à 59,5 et GDPVal-AA à 45,8 comme des domaines nécessitant des améliorations.
- C'est un modèle textuel sans entrée d'image, donc les captures d'écran et les pages numérisées nécessitent d'abord un modèle capable de vision.
- Les 198 milliards de poids complets sont lourds à auto-héberger, donc la plupart des équipes l'utilisent via une API.
Pour commencer
Créer une clé API
Générez une clé dans Console et utilisez-la avec tous les modèles de la plateforme.
Envoyez votre première requête
Copiez l'exemple pour votre langage et lancez-le.
Texte vers texteMessages APIPOST/v1/messagesFormat d'API:curl https://api.tokenlab.sh/v1/messages \ -H "Content-Type: application/json" \ -H "x-api-key: sk-xxx" \ -H "anthropic-version: 2023-06-01" \ -d '{ "model": "step-3.7-flash", "max_tokens": 1024, "messages": [ {"role": "user", "content": "Hello!"} ] }'
Tarification
Le tarif officiel est la référence publique du créateur du modèle. Le tarif TokenLab est ce que vous payez pour ce modèle sur TokenLab.
Default
Par 1M Token- Tarif Official
- Entrée $0.20 / Sortie $1.15 / Lecture cache $0.04 / Texte Entrée $0.20 / Texte Sortie $1.15
- Official
- Entrée $0.20 / Sortie $1.15 / Lecture cache $0.04 / Texte Entrée $0.20 / Texte Sortie $1.15
- Remise
- —
Lecture cache
- Tarif Official
- $0.04
- Official
- $0.04
- Remise
- —
| Tarif OfficialPar 1M Token | OfficialPar 1M Token | Remise | |
|---|---|---|---|
| Default | Entrée $0.20 / Sortie $1.15 / Lecture cache $0.04 / Texte Entrée $0.20 / Texte Sortie $1.15 | Entrée $0.20 / Sortie $1.15 / Lecture cache $0.04 / Texte Entrée $0.20 / Texte Sortie $1.15 | — |
| Tarification du cache de prompt | |||
| Lecture cache | $0.04 | $0.04 | — |
Utilisation et activité
Le taux de réussite est la part de requêtes abouties. La latence est la durée d'une réponse complète ; P95 signifie que 95 % des requêtes ont fini dans ce délai.
Utilisation et disponibilité
Dernières 24 heures- Requêtes
- Taux de succès
- Latence P95
- Total des jetons
Les données sont basées sur les requêtes agrégées des utilisateurs, à l'exclusion des vérifications de statut.
Ouvrir dans Console
Ouvrez Step 3.7 Flash dans Console avec un prompt prêt à modifier ou envoyer.
Aide-moi à tester step-3.7-flash avec un message sur /v1/messages. Affiche la réponse, la latence et le coût.
Cas d'usage
Agents de codage simultanés
Exécutez plusieurs agents sur un seul dépôt, chacun traçant les chemins de code et produisant des correctifs, avec un niveau de raisonnement inférieur pour les modifications de routine.
Boucles de recherche et de vérification
Demandez à un agent de rechercher, de lire les sources et de vérifier ses propres affirmations avant de répondre, en utilisant la résistance du modèle aux pages adverses.
Extraction structurée
Renvoyez du JSON typé à partir de factures, de tickets ou de documents avec une application de schéma de réponse au lieu d'analyser du texte libre.
Résumé à long contexte
Condensez de longs rapports, transcriptions et historiques de tickets en résumés, en utilisant un niveau de raisonnement inférieur pour les résumés de routine et un niveau supérieur pour l'analyse.
Exemples de prompts
Recherchez dans le dépôt chaque appelant de billing.charge(), listez ceux qui ignorent la valeur de retour et proposez un correctif pour chacun.
Extrayez le fournisseur, le numéro de facture, les articles et le total de ce texte sous forme de JSON correspondant au schéma que je vous ai donné.
Vérifiez chaque affirmation dans ce brouillon par rapport aux sources que vous pouvez récupérer et marquez chaque déclaration que vous n'avez pas pu confirmer.
Ce modèle a une tarification conditionnelle. Les totaux mensuels de tokens ne suffisent pas pour une estimation fiable ; utilisez la tarification détaillée selon la spécification de la requête, le cache et la fenêtre applicable.
FAQ
Qu'est-ce que Step 3.7 Flash ?
C'est le modèle à mélange d'experts creux de StepFun destiné au codage agentique, à la recherche et au travail à long contexte. La fiche du modèle liste 198 milliards de paramètres au total, environ 11 milliards actifs par jeton, et une licence Apache 2.0. StepFun le positionne pour les développeurs qui mettent à l'échelle des flux de travail d'agents.
Quels sont les niveaux de raisonnement ?
StepFun propose trois niveaux sélectionnables : faible, moyen et élevé. Utilisez le niveau faible pour les appels d'outils de routine et les réponses courtes, et le niveau élevé pour le débogage, la planification ou la vérification à plusieurs étapes où la précision compte plus que le temps de réponse.
Step 3.7 Flash prend-il en charge la sortie structurée ?
Oui. Il prend en charge les schémas de réponse parallèlement au mode JSON et à l'appel d'outils, vous pouvez donc contraindre les réponses à un schéma. Cela le distingue de Step 3.5 Flash, qui n'a pas de prise en charge de schéma de réponse.
Peut-il lire des images ?
Non. C'est un modèle textuel, donc l'entrée d'image n'est pas prise en charge. Pour les captures d'écran ou les pages numérisées, utilisez Step 5 Preview, qui accepte les images et la vidéo, ou extrayez d'abord le texte.
Quand devrais-je choisir Step 5 Preview à la place ?
Choisissez Step 5 Preview lorsque vous avez besoin du produit phare de StepFun, d'une fenêtre de contexte de l'ordre du million de jetons ou d'une entrée vidéo. Step 3.7 Flash est l'option plus rapide et plus petite pour les boucles d'agents à haut volume.
Combien coûte Step 3.7 Flash ?
Sur TokenLab, Step 3.7 Flash coûte Entrée $0.20 / Sortie $1.15 Par 1M Token. La table tarifaire ci-dessus en montre le détail complet. Les tarifs dépendent de l’unité de facturation, de la spécification et de l’usage. Comparez des conditions identiques dans la tarification détaillée du modèle ; un tarif seul ne détermine pas le coût total.
Quelles sont les limites de contexte et de sortie de Step 3.7 Flash ?
Step 3.7 Flash accepte jusqu'à 262 144 jetons de contexte et génère jusqu'à 262 144 jetons par réponse.
Quel endpoint Step 3.7 Flash doit-il utiliser ?
Utilisez https://api.tokenlab.sh/v1/messages pour Step 3.7 Flash. L'exemple de requête ci-dessous montre la structure de code correspondante.
Quelles opérations Step 3.7 Flash prend-il en charge ?
Step 3.7 Flash prend en charge Texte vers texte. Sélectionnez une opération pour voir l'endpoint et un exemple.
Comparer Step 3.7 Flash
Sources
Mis à jour le 2 oct. 2026