Wählen Sie Auto, TokenLab Verified oder Official für jede Anfrage, wobei die Preise vorab angezeigt werden.Neuigkeiten ansehen

Anthropic: Claude Haiku 5.5

Das schnellste Claude-Modell, entwickelt für latenzkritische Aufgaben mit hohem Volumen wie Klassifizierung, Extraktion, Routing und Subagent-Prozesse.
Modelle vergleichen
claude-haiku-5-5
VerfügbarAnthropicUnterhaltung90% Rabatt bei Cache-NutzungAktuell
Eingabe / Ausgabe-70%
$0.10 / $0.50$0.03 / $0.15
Kontext
1M
Veröffentlicht
7. Okt. 2026
Maximale Ausgabe
128K
Modalitäten
VisionUnterhaltung
Funktionen
Tool-NutzungPrompt-CacheReasoning

Über Claude Haiku 5.5

Claude Haiku 5.5 ist das kleine, schnelle Claude-Modell von Anthropic, das am 7. Oktober 2026 für hochvolumige, latenzempfindliche Aufgaben wie Klassifizierung, Extraktion, Routing und Subagent-Aufgaben veröffentlicht wurde. Es ist das erste Haiku mit anpassbarem Aufwand, sodass ein Modell einfache Anfragen schnell beantworten und bei schwierigeren Aufgaben länger nachdenken kann. Anthropic bezeichnet es als sein schnellstes Modell bei Standardgeschwindigkeit, mit einem Wissensstand bis Juni 2026.

Stärken

  • Anthropic bezeichnet es als sein schnellstes Modell bei Standardgeschwindigkeit, was sich für Live-Kundensupport und Browser-Anwendungen eignet.
  • Es ist das erste Haiku mit Aufwandsstufen, sodass ein Modell sowohl für schnelle Chats als auch für längere Agentenaufgaben eingesetzt werden kann.
  • Anthropic berichtet von großen Leistungssteigerungen gegenüber Haiku 4.5 bei Benchmarks wie OSWorld 2.1, GDPval-AA und Terminal-Bench 4.0.
  • Es akzeptiert Text- und Bildeingaben und fungiert laut Anthropic als Subagent neben Opus 5.5 oder Sonnet 5.5 bei Programmieraufgaben.
  • Adaptives Denken ist standardmäßig aktiviert, und die Aufwandseinstellung steuert, wie intensiv das Modell nachdenkt.

Alternativen

  • Anthropic gibt an, dass Sonnet 5.5 und Opus 5.5 weiterhin die bessere Wahl für komplexes agentisches Programmieren und offene Aufgaben sind.
  • Sicherheitsklassifikatoren können eine Anfrage mit einem Ablehnungsgrund verweigern, und Cybersicherheits-Schutzmaßnahmen blockieren weiterhin Penetrationstests.
  • Manuelle Denkbudgets werden nicht unterstützt; adaptives Denken mit der Aufwandseinstellung ersetzt diese.

Erste Schritte

  1. API-Schlüssel erstellen

    Erstelle einen Schlüssel in Console und nutze ihn mit jedem Modell auf der Plattform.

  2. Senden Sie Ihre erste Anfrage

    Kopieren Sie das Beispiel für Ihre Sprache und führen Sie es gegen den Endpunkt aus.

    Text-zu-TextMessages API
    POST/v1/messages
    API-Format:
    curl https://api.tokenlab.sh/v1/messages \
      -H "Content-Type: application/json" \
      -H "x-api-key: sk-xxx" \
      -H "anthropic-version: 2023-06-01" \
      -d '{
        "model": "claude-haiku-5-5",
        "max_tokens": 1024,
        "messages": [
          {"role": "user", "content": "Hello!"}
        ]
      }'

Preise

Der TokenLab-Preis gilt für Verified und ist bei den meisten Modellen günstiger. Der Official-Preis entspricht dem Standardpreis des Herstellers für die zuverlässigere Route. Auto berechnet jeweils die Route, die deine Anfrage erfolgreich verarbeitet.

Eingabe Token <= 100K

Pro 1M Token
Offizieller Preis
Eingabe $0.10 / Ausgabe $0.50 / Cache-Lesevorgang $0.01 / Cache-Schreibvorgang $0.125
TokenLab-Preis
Eingabe $0.03 / Ausgabe $0.15 / Cache-Lesevorgang $0.003 / Cache-Schreibvorgang $0.0375
Rabatt
-70%

Eingabe Token 100K-1M

Pro 1M Token
Offizieller Preis
Eingabe $0.50 / Ausgabe $2.50 / Cache-Lesevorgang $0.05 / Cache-Schreibvorgang $0.625
TokenLab-Preis
Eingabe $0.15 / Ausgabe $0.75 / Cache-Lesevorgang $0.015 / Cache-Schreibvorgang $0.1875
Rabatt
-70%
Prompt-Cache-Preise

Cache-Lesevorgang

Offizieller Preis
$0.01
TokenLab-Preis
$0.003
Rabatt
-70%

Cache-Schreibvorgang

Offizieller Preis
$0.125
TokenLab-Preis
$0.0375
Rabatt
-70%
Tool-Gebühren

Die Abrechnung erfolgt pro Aufruf, nur wenn das Modell das Tool verwendet.

Websuche

Offizieller Preis
$0.01/Suche
TokenLab-Preis
$0.003/Suche
Rabatt
-70%

Nutzung & Aktivität

Die Erfolgsquote ist der Anteil abgeschlossener Anfragen. Die Latenz ist die Dauer einer vollständigen Antwort; P95 bedeutet, dass 95 % der Anfragen innerhalb dieser Zeit abgeschlossen wurden.

Nutzung & Verfügbarkeit

Letzte 24 Stunden
Anfragen
Erfolgsrate
P95-Latenz
Token gesamt
Modellleistung
Metriken erscheinen, sobald die Schwellenwerte für Datenschutz und Datenvolumen erreicht sind.

Die Daten basieren auf aggregierten Benutzeranfragen, Statusprüfungen sind ausgeschlossen.

In Console öffnen

Öffne Claude Haiku 5.5 in Console mit einer bearbeitbaren oder versandbereiten Eingabeaufforderung.

Teste claude-haiku-5-5 mit einer kurzen Nachricht an /v1/messages. Zeige Antwort, Latenz und Kosten.

Anwendungsfälle

Geeignet für
  • Reasoning
  • Vision
  • Hochvolumige Klassifizierung und Routing

    Klassifizieren Sie Tickets, leiten Sie Anfragen weiter und extrahieren Sie Felder aus Dokumenten in großem Umfang, wo Reaktionsgeschwindigkeit und konstanter Durchsatz am wichtigsten sind.

  • Subagenten in Programmier-Workflows

    Führen Sie eng begrenzte Nebenaufgaben aus, wie das Durchsuchen einer Codebasis oder das Zusammenfassen von Dateien, während ein größeres Modell die Arbeit leitet – eine von Anthropic hervorgehobene Kombination.

  • Live-Support und Browser-Aufgaben

    Antworten Sie Kunden in Echtzeit oder steuern Sie Browserschritte anhand von Screenshots, wobei die Wartezeit zwischen den Interaktionen das Erlebnis bestimmt.

  • Zusammenfassungen und Komprimierung

    Fassen Sie lange Konversationen, Unterlagen oder Protokolle in kurzen Berichten zusammen und komprimieren Sie den Kontext eines Agenten zwischen den Schritten.

Prompt-Beispiele

Klassifizieren Sie jedes dieser 50 Support-Tickets als Abrechnung, Fehler oder Funktionsanfrage und geben Sie eine JSON-Liste mit der Ticket-ID und der Kategorie zurück.

Lesen Sie diese Unterlage und extrahieren Sie den Firmennamen, das Geschäftsjahr, den Umsatz und den Nettogewinn in eine Tabelle. Markieren Sie jeden Wert, den Sie nicht finden konnten.

Fassen Sie diese Konversation bisher in sechs Stichpunkten zusammen, die jede Entscheidung, jede offene Frage und jeden Dateinamen enthalten, damit ein neuer Agent die Arbeit fortsetzen kann.

Dieses Modell hat konditionale Preise. Monatliche Token-Summen allein liefern keine verlässliche Schätzung; nutzen Sie die detaillierten Preise für Anfragespezifikation, Cache und Zeitfenster.

FAQ

Worin ist Claude Haiku 5.5 am besten?

Eng begrenzte, hochvolumige Aufgaben: Klassifizierung, Extraktion, Routing, Zusammenfassungen, Komprimierung und Subagent-Aufgaben. Anthropic vermarktet es als sein schnellstes Modell und gibt an, dass Sonnet 5.5 oder Opus 5.5 weiterhin besser für komplexes agentisches Programmieren geeignet sind.

Welche Aufwandsstufe sollte ich bei Haiku 5.5 wählen?

Anthropic empfiehlt für die meisten Aufgaben, einschließlich agentischem Programmieren, die Standardeinstellung „medium“. Verwenden Sie „low“ für Chats, kurze Tool-Aufgaben und einfache hochvolumige Anfragen, wobei es bei langen Agenten-Prompts vorkommen kann, dass eine Suche übersprungen oder vorzeitig abgebrochen wird. Verwenden Sie „high“ für strikte Befolgung von Anweisungen, und „xhigh“ oder „max“ nur dort, wo Ihre eigenen Tests einen Gewinn zeigen.

Kann ich das Denken bei Haiku 5.5 ausschalten?

Teilweise. Das Denken ist adaptiv und standardmäßig aktiviert. Das Senden mit deaktiviertem Denken funktioniert bei den Aufwandsstufen „low“, „medium“ und „high“ und führt bei „xhigh“ und „max“ zu einem Fehler. Der von Anthropic bevorzugte Weg, weniger Denken zu erhalten, ist eine niedrigere Aufwandsstufe. Das Denken zählt zum Ausgabelimit, lassen Sie also entsprechenden Spielraum.

Wie unterscheidet sich Haiku 5.5 von Haiku 4.5?

Anthropic berichtet von großen Benchmark-Gewinnen, einem längeren Kontextfenster und Ausgabelimit, anpassbarem Aufwand und adaptivem Denken anstelle von manuellen Denkbudgets. Es verwendet den neueren Tokenizer, sodass derselbe Text als mehr Token zählt, und seine Sicherheitsklassifikatoren können Ablehnungen zurückgeben, die Haiku 4.5 nicht konnte.

Wann sollte ich Sonnet 5.5 anstelle von Haiku 5.5 wählen?

Wählen Sie Sonnet 5.5 oder Opus 5.5 für komplexes agentisches Programmieren, lange Terminalsitzungen und Aufgaben, die anhaltendes Urteilsvermögen erfordern, bei denen sie laut Anthropic stärker bleiben. Wählen Sie Haiku 5.5, wenn Geschwindigkeit und Volumen wichtig sind und die Aufgabe eng begrenzt ist, wie bei Klassifizierungen, Zusammenfassungen oder Subagent-Arbeiten.

Was kostet Claude Haiku 5.5?

Auf TokenLab kostet Claude Haiku 5.5 Eingabe $0.03 / Ausgabe $0.15 Pro 1M Token. Die vollständige Aufschlüsselung steht in der Preistabelle oben. Die Preise hängen von Abrechnungseinheit, Spezifikation und Nutzung ab. Vergleichen Sie gleiche Bedingungen in der detaillierten Preisliste des Modells; eine einzelne Rate bestimmt nicht die Gesamtkosten.

Welche Kontext- und Ausgabelimits hat Claude Haiku 5.5?

Claude Haiku 5.5 verarbeitet bis zu 1.000.000 Token Kontext und gibt pro Antwort bis zu 128.000 Token aus.

Welchen Endpunkt soll Claude Haiku 5.5 verwenden?

Verwenden Sie https://api.tokenlab.sh/v1/messages für Claude Haiku 5.5. Das folgende Anforderungsbeispiel zeigt die passende Code-Struktur.

Welche Operationen unterstützt Claude Haiku 5.5?

Claude Haiku 5.5 unterstützt Text-zu-Text. Wählen Sie oben einen Vorgang aus, um dessen Endpunkt und Anforderungsbeispiel anzuzeigen.

Claude Haiku 5.5 vergleichen

Quellen

Geprüft am 08.10.2026

Mehr aus der Claude 5-Serie

Ähnliche Modelle