Anthropic: Claude Haiku 5.5
claude-haiku-5-5- Eingabe / Ausgabe-70%
- $0.10 / $0.50$0.03 / $0.15
- Kontext
- 1M
- Veröffentlicht
- 7. Okt. 2026
- Maximale Ausgabe
- 128K
- Modalitäten
- VisionUnterhaltung
- Funktionen
- Tool-NutzungPrompt-CacheReasoning
Über Claude Haiku 5.5
Claude Haiku 5.5 ist das kleine, schnelle Claude-Modell von Anthropic, das am 7. Oktober 2026 für hochvolumige, latenzempfindliche Aufgaben wie Klassifizierung, Extraktion, Routing und Subagent-Aufgaben veröffentlicht wurde. Es ist das erste Haiku mit anpassbarem Aufwand, sodass ein Modell einfache Anfragen schnell beantworten und bei schwierigeren Aufgaben länger nachdenken kann. Anthropic bezeichnet es als sein schnellstes Modell bei Standardgeschwindigkeit, mit einem Wissensstand bis Juni 2026.
Stärken
- Anthropic bezeichnet es als sein schnellstes Modell bei Standardgeschwindigkeit, was sich für Live-Kundensupport und Browser-Anwendungen eignet.
- Es ist das erste Haiku mit Aufwandsstufen, sodass ein Modell sowohl für schnelle Chats als auch für längere Agentenaufgaben eingesetzt werden kann.
- Anthropic berichtet von großen Leistungssteigerungen gegenüber Haiku 4.5 bei Benchmarks wie OSWorld 2.1, GDPval-AA und Terminal-Bench 4.0.
- Es akzeptiert Text- und Bildeingaben und fungiert laut Anthropic als Subagent neben Opus 5.5 oder Sonnet 5.5 bei Programmieraufgaben.
- Adaptives Denken ist standardmäßig aktiviert, und die Aufwandseinstellung steuert, wie intensiv das Modell nachdenkt.
Alternativen
- Anthropic gibt an, dass Sonnet 5.5 und Opus 5.5 weiterhin die bessere Wahl für komplexes agentisches Programmieren und offene Aufgaben sind.
- Sicherheitsklassifikatoren können eine Anfrage mit einem Ablehnungsgrund verweigern, und Cybersicherheits-Schutzmaßnahmen blockieren weiterhin Penetrationstests.
- Manuelle Denkbudgets werden nicht unterstützt; adaptives Denken mit der Aufwandseinstellung ersetzt diese.
Erste Schritte
API-Schlüssel erstellen
Erstelle einen Schlüssel in Console und nutze ihn mit jedem Modell auf der Plattform.
Senden Sie Ihre erste Anfrage
Kopieren Sie das Beispiel für Ihre Sprache und führen Sie es gegen den Endpunkt aus.
Text-zu-TextMessages APIPOST/v1/messagesAPI-Format:curl https://api.tokenlab.sh/v1/messages \ -H "Content-Type: application/json" \ -H "x-api-key: sk-xxx" \ -H "anthropic-version: 2023-06-01" \ -d '{ "model": "claude-haiku-5-5", "max_tokens": 1024, "messages": [ {"role": "user", "content": "Hello!"} ] }'
Preise
Der TokenLab-Preis gilt für Verified und ist bei den meisten Modellen günstiger. Der Official-Preis entspricht dem Standardpreis des Herstellers für die zuverlässigere Route. Auto berechnet jeweils die Route, die deine Anfrage erfolgreich verarbeitet.
Eingabe Token <= 100K
Pro 1M Token- Offizieller Preis
- Eingabe $0.10 / Ausgabe $0.50 / Cache-Lesevorgang $0.01 / Cache-Schreibvorgang $0.125
- TokenLab-Preis
- Eingabe $0.03 / Ausgabe $0.15 / Cache-Lesevorgang $0.003 / Cache-Schreibvorgang $0.0375
- Rabatt
- -70%
Eingabe Token 100K-1M
Pro 1M Token- Offizieller Preis
- Eingabe $0.50 / Ausgabe $2.50 / Cache-Lesevorgang $0.05 / Cache-Schreibvorgang $0.625
- TokenLab-Preis
- Eingabe $0.15 / Ausgabe $0.75 / Cache-Lesevorgang $0.015 / Cache-Schreibvorgang $0.1875
- Rabatt
- -70%
Cache-Lesevorgang
- Offizieller Preis
- $0.01
- TokenLab-Preis
- $0.003
- Rabatt
- -70%
Cache-Schreibvorgang
- Offizieller Preis
- $0.125
- TokenLab-Preis
- $0.0375
- Rabatt
- -70%
Die Abrechnung erfolgt pro Aufruf, nur wenn das Modell das Tool verwendet.
Websuche
- Offizieller Preis
- $0.01/Suche
- TokenLab-Preis
- $0.003/Suche
- Rabatt
- -70%
| Offizieller PreisPro 1M Token | TokenLab-PreisPro 1M Token | Rabatt | |
|---|---|---|---|
| Eingabe Token <= 100K | Eingabe $0.10 / Ausgabe $0.50 / Cache-Lesevorgang $0.01 / Cache-Schreibvorgang $0.125 | Eingabe $0.03 / Ausgabe $0.15 / Cache-Lesevorgang $0.003 / Cache-Schreibvorgang $0.0375 | -70% |
| Eingabe Token 100K-1M | Eingabe $0.50 / Ausgabe $2.50 / Cache-Lesevorgang $0.05 / Cache-Schreibvorgang $0.625 | Eingabe $0.15 / Ausgabe $0.75 / Cache-Lesevorgang $0.015 / Cache-Schreibvorgang $0.1875 | -70% |
| Prompt-Cache-Preise | |||
| Cache-Lesevorgang | $0.01 | $0.003 | -70% |
| Cache-Schreibvorgang | $0.125 | $0.0375 | -70% |
| Tool-GebührenDie Abrechnung erfolgt pro Aufruf, nur wenn das Modell das Tool verwendet. | |||
| Websuche | $0.01/Suche | $0.003/Suche | -70% |
Nutzung & Aktivität
Die Erfolgsquote ist der Anteil abgeschlossener Anfragen. Die Latenz ist die Dauer einer vollständigen Antwort; P95 bedeutet, dass 95 % der Anfragen innerhalb dieser Zeit abgeschlossen wurden.
Nutzung & Verfügbarkeit
Letzte 24 Stunden- Anfragen
- Erfolgsrate
- P95-Latenz
- Token gesamt
Die Daten basieren auf aggregierten Benutzeranfragen, Statusprüfungen sind ausgeschlossen.
In Console öffnen
Öffne Claude Haiku 5.5 in Console mit einer bearbeitbaren oder versandbereiten Eingabeaufforderung.
Teste claude-haiku-5-5 mit einer kurzen Nachricht an /v1/messages. Zeige Antwort, Latenz und Kosten.
Anwendungsfälle
Geeignet für- Reasoning
- Vision
Hochvolumige Klassifizierung und Routing
Klassifizieren Sie Tickets, leiten Sie Anfragen weiter und extrahieren Sie Felder aus Dokumenten in großem Umfang, wo Reaktionsgeschwindigkeit und konstanter Durchsatz am wichtigsten sind.
Subagenten in Programmier-Workflows
Führen Sie eng begrenzte Nebenaufgaben aus, wie das Durchsuchen einer Codebasis oder das Zusammenfassen von Dateien, während ein größeres Modell die Arbeit leitet – eine von Anthropic hervorgehobene Kombination.
Live-Support und Browser-Aufgaben
Antworten Sie Kunden in Echtzeit oder steuern Sie Browserschritte anhand von Screenshots, wobei die Wartezeit zwischen den Interaktionen das Erlebnis bestimmt.
Zusammenfassungen und Komprimierung
Fassen Sie lange Konversationen, Unterlagen oder Protokolle in kurzen Berichten zusammen und komprimieren Sie den Kontext eines Agenten zwischen den Schritten.
Prompt-Beispiele
Klassifizieren Sie jedes dieser 50 Support-Tickets als Abrechnung, Fehler oder Funktionsanfrage und geben Sie eine JSON-Liste mit der Ticket-ID und der Kategorie zurück.
Lesen Sie diese Unterlage und extrahieren Sie den Firmennamen, das Geschäftsjahr, den Umsatz und den Nettogewinn in eine Tabelle. Markieren Sie jeden Wert, den Sie nicht finden konnten.
Fassen Sie diese Konversation bisher in sechs Stichpunkten zusammen, die jede Entscheidung, jede offene Frage und jeden Dateinamen enthalten, damit ein neuer Agent die Arbeit fortsetzen kann.
Dieses Modell hat konditionale Preise. Monatliche Token-Summen allein liefern keine verlässliche Schätzung; nutzen Sie die detaillierten Preise für Anfragespezifikation, Cache und Zeitfenster.
FAQ
Worin ist Claude Haiku 5.5 am besten?
Eng begrenzte, hochvolumige Aufgaben: Klassifizierung, Extraktion, Routing, Zusammenfassungen, Komprimierung und Subagent-Aufgaben. Anthropic vermarktet es als sein schnellstes Modell und gibt an, dass Sonnet 5.5 oder Opus 5.5 weiterhin besser für komplexes agentisches Programmieren geeignet sind.
Welche Aufwandsstufe sollte ich bei Haiku 5.5 wählen?
Anthropic empfiehlt für die meisten Aufgaben, einschließlich agentischem Programmieren, die Standardeinstellung „medium“. Verwenden Sie „low“ für Chats, kurze Tool-Aufgaben und einfache hochvolumige Anfragen, wobei es bei langen Agenten-Prompts vorkommen kann, dass eine Suche übersprungen oder vorzeitig abgebrochen wird. Verwenden Sie „high“ für strikte Befolgung von Anweisungen, und „xhigh“ oder „max“ nur dort, wo Ihre eigenen Tests einen Gewinn zeigen.
Kann ich das Denken bei Haiku 5.5 ausschalten?
Teilweise. Das Denken ist adaptiv und standardmäßig aktiviert. Das Senden mit deaktiviertem Denken funktioniert bei den Aufwandsstufen „low“, „medium“ und „high“ und führt bei „xhigh“ und „max“ zu einem Fehler. Der von Anthropic bevorzugte Weg, weniger Denken zu erhalten, ist eine niedrigere Aufwandsstufe. Das Denken zählt zum Ausgabelimit, lassen Sie also entsprechenden Spielraum.
Wie unterscheidet sich Haiku 5.5 von Haiku 4.5?
Anthropic berichtet von großen Benchmark-Gewinnen, einem längeren Kontextfenster und Ausgabelimit, anpassbarem Aufwand und adaptivem Denken anstelle von manuellen Denkbudgets. Es verwendet den neueren Tokenizer, sodass derselbe Text als mehr Token zählt, und seine Sicherheitsklassifikatoren können Ablehnungen zurückgeben, die Haiku 4.5 nicht konnte.
Wann sollte ich Sonnet 5.5 anstelle von Haiku 5.5 wählen?
Wählen Sie Sonnet 5.5 oder Opus 5.5 für komplexes agentisches Programmieren, lange Terminalsitzungen und Aufgaben, die anhaltendes Urteilsvermögen erfordern, bei denen sie laut Anthropic stärker bleiben. Wählen Sie Haiku 5.5, wenn Geschwindigkeit und Volumen wichtig sind und die Aufgabe eng begrenzt ist, wie bei Klassifizierungen, Zusammenfassungen oder Subagent-Arbeiten.
Was kostet Claude Haiku 5.5?
Auf TokenLab kostet Claude Haiku 5.5 Eingabe $0.03 / Ausgabe $0.15 Pro 1M Token. Die vollständige Aufschlüsselung steht in der Preistabelle oben. Die Preise hängen von Abrechnungseinheit, Spezifikation und Nutzung ab. Vergleichen Sie gleiche Bedingungen in der detaillierten Preisliste des Modells; eine einzelne Rate bestimmt nicht die Gesamtkosten.
Welche Kontext- und Ausgabelimits hat Claude Haiku 5.5?
Claude Haiku 5.5 verarbeitet bis zu 1.000.000 Token Kontext und gibt pro Antwort bis zu 128.000 Token aus.
Welchen Endpunkt soll Claude Haiku 5.5 verwenden?
Verwenden Sie https://api.tokenlab.sh/v1/messages für Claude Haiku 5.5. Das folgende Anforderungsbeispiel zeigt die passende Code-Struktur.
Welche Operationen unterstützt Claude Haiku 5.5?
Claude Haiku 5.5 unterstützt Text-zu-Text. Wählen Sie oben einen Vorgang aus, um dessen Endpunkt und Anforderungsbeispiel anzuzeigen.
Claude Haiku 5.5 vergleichen
Quellen
- Introducing Claude Haiku 5.5
- Claude Haiku 5.5 model overview
- What's new in Claude Haiku 5.5
- Prompting Claude Haiku 5.5
Geprüft am 08.10.2026