Wählen Sie Auto, TokenLab Verified oder Official für jede Anfrage, wobei die Preise vorab angezeigt werden.Neuigkeiten ansehen

Anthropic: Claude Haiku 4.5

Schnelle Claude-Variante für leichtgewichtige Agenten, Büroaufgaben und reaktionsschnelle Chats
Modelle vergleichen
claude-haiku-4-5
VerfügbarAnthropicUnterhaltung90% Rabatt bei Cache-Nutzung
Eingabe / Ausgabe-70%
$1.00 / $5.00$0.30 / $1.50
Kontext
200K
Maximale Ausgabe
64K
Modalitäten
VisionUnterhaltung
Funktionen
Tool-NutzungPrompt-CacheReasoning

Über Claude Haiku 4.5

Claude Haiku 4.5 ist das kleine, schnelle Claude-Modell von Anthropic, das im Oktober 2025 für hochvolumige und latenzempfindliche Aufgaben veröffentlicht wurde. Anthropic beschreibt es als das schnellste Modell im Portfolio mit nahezu erstklassiger Intelligenz. Es akzeptiert Text und Bilder, unterstützt Tool-Nutzung sowie Prompt-Caching und verwendet manuelles erweitertes Denken mit einem Token-Budget anstelle des adaptiven Denkens neuerer Claude-Modelle.

Stärken

  • Niedrigste Latenz unter den auf der Übersichtsseite von Anthropic gelisteten Claude-Modellen, was es für Chat-Frontends und Echtzeit-Assistenten geeignet macht.
  • Liest Bilder neben Text, sodass es Screenshots, Belege und Diagramme in großem Umfang klassifizieren kann.
  • Erweitertes Denken ist optional und wird mit einem expliziten Token-Budget festgelegt, sodass Sie pro Anfrage entscheiden, wie viel Rechenleistung Sie bezahlen möchten.
  • Unterstützt Tool-Nutzung, strukturierte JSON-Ausgabe und Prompt-Caching, wodurch wiederholte System-Prompts in Agenten-Schleifen kostengünstig bleiben.

Alternativen

  • Der Wissensstichtag liegt deutlich vor der Claude-5-Generation, daher ist das Wissen über aktuelle Bibliotheken und Ereignisse begrenzter.
  • Es verfügt über ein kleineres Kontextfenster und ein niedrigeres Ausgabelimit als die Opus- und Sonnet-5.x-Modelle, was Aufgaben für ganze Repositories oder buchlange Texte einschränkt.
  • Für lange autonome Coding-Durchläufe oder mehrstufige Planungen mit Mehrdeutigkeiten sind Sonnet- oder Opus-Modelle zuverlässiger.

Erste Schritte

  1. API-Schlüssel erstellen

    Erstelle einen Schlüssel in Console und nutze ihn mit jedem Modell auf der Plattform.

  2. Senden Sie Ihre erste Anfrage

    Kopieren Sie das Beispiel für Ihre Sprache und führen Sie es gegen den Endpunkt aus.

    Text-zu-TextMessages API
    POST/v1/messages
    API-Format:
    curl https://api.tokenlab.sh/v1/messages \
      -H "Content-Type: application/json" \
      -H "x-api-key: sk-xxx" \
      -H "anthropic-version: 2023-06-01" \
      -d '{
        "model": "claude-haiku-4-5",
        "max_tokens": 1024,
        "messages": [
          {"role": "user", "content": "Hello!"}
        ]
      }'

Preise

Der TokenLab-Preis gilt für Verified und ist bei den meisten Modellen günstiger. Der Official-Preis entspricht dem Standardpreis des Herstellers für die zuverlässigere Route. Auto berechnet jeweils die Route, die deine Anfrage erfolgreich verarbeitet.

Standardspezifikation

Pro 1M Token
Offizieller Preis
Eingabe $1.00 / Ausgabe $5.00 / Cache-Lesevorgang $0.10 / Cache-Schreibvorgang $1.25
TokenLab-Preis
Eingabe $0.30 / Ausgabe $1.50 / Cache-Lesevorgang $0.03 / Cache-Schreibvorgang $0.375
Rabatt
-70%
Prompt-Cache-Preise

Cache-Lesevorgang

Offizieller Preis
$0.10
TokenLab-Preis
$0.03
Rabatt
-70%

Cache-Schreibvorgang

Offizieller Preis
$1.25
TokenLab-Preis
$0.375
Rabatt
-70%
Tool-Gebühren

Die Abrechnung erfolgt pro Aufruf, nur wenn das Modell das Tool verwendet.

Websuche

Offizieller Preis
$0.01/Suche
TokenLab-Preis
$0.003/Suche
Rabatt
-70%

Nutzung & Aktivität

Die Erfolgsquote ist der Anteil abgeschlossener Anfragen. Die Latenz ist die Dauer einer vollständigen Antwort; P95 bedeutet, dass 95 % der Anfragen innerhalb dieser Zeit abgeschlossen wurden.

Nutzung & Verfügbarkeit

Letzte 24 Stunden
Anfragen
Erfolgsrate
P95-Latenz
Token gesamt
Modellleistung
Erfolgsquote (30 Tage)
100,0%
Mediane Latenz (7 Tage)
1 sn=269
P95-Latenz (7 Tage)
16,1 sn=269
Anfragen (30 Tage)
100+
Zuletzt aktiv
vor 3 Minuten

Die Daten basieren auf aggregierten Benutzeranfragen, Statusprüfungen sind ausgeschlossen.

In Console öffnen

Öffne Claude Haiku 4.5 in Console mit einer bearbeitbaren oder versandbereiten Eingabeaufforderung.

Teste claude-haiku-4-5 mit einer kurzen Nachricht an /v1/messages. Zeige Antwort, Latenz und Kosten.

Anwendungsfälle

Geeignet für
  • Reasoning
  • Vision
  • Echtzeit-Chat und Support

    Setzen Sie es hinter ein kundenorientiertes Widget, bei dem die Antwortgeschwindigkeit wichtiger ist als die Tiefe, mit Tool-Aufrufen für Bestellabfragen und einer Übergabe, wenn die Frage komplexer wird.

  • Klassifizierung und Extraktion

    Markieren Sie Tickets, extrahieren Sie Felder aus Rechnungen oder Screenshots und geben Sie striktes JSON für eine nachgelagerte Pipeline aus, die Tausende Male am Tag läuft.

  • Sub-Agent-Worker

    Nutzen Sie es als kostengünstigen Arbeiter in einem Multi-Agenten-Setup: Ein größeres Modell plant, und mehrere Haiku-Aufrufe suchen, fassen zusammen oder prüfen Dateien parallel.

Prompt-Beispiele

Klassifizieren Sie diese Support-E-Mail als Abrechnung, Fehler, Funktionsanfrage oder Sonstiges und geben Sie JSON mit dem Label und einer einzeiligen Begründung zurück.

Fassen Sie dieses Chat-Transkript in drei Stichpunkten zusammen und listen Sie alle Aufgaben mit dem jeweiligen Verantwortlichen auf.

Sehen Sie sich diesen Screenshot eines Fehlerdialogs an und sagen Sie mir, welche Einstellung der Benutzer ändern sollte.

Dieses Modell hat konditionale Preise. Monatliche Token-Summen allein liefern keine verlässliche Schätzung; nutzen Sie die detaillierten Preise für Anfragespezifikation, Cache und Zeitfenster.

FAQ

Wofür eignet sich Claude Haiku 4.5 am besten?

Schnelle, hochvolumige Aufgaben: Chat-Assistenten, Klassifizierung, Datenextraktion, Zusammenfassungen und Worker-Agenten. Anthropic positioniert es als das schnellste Claude-Modell mit nahezu erstklassiger Intelligenz; es ist daher die Standardwahl, wenn Antwortzeit und Durchsatz wichtiger sind als tiefgreifendes Denken.

Unterstützt Claude Haiku 4.5 erweitertes Denken?

Ja, aber in der manuellen Form: Sie aktivieren das Denken und legen ein Token-Budget fest. Es verwendet nicht den adaptiven Denkmodus oder den Aufwandsparameter der neueren Sonnet- und Opus-Modelle, sodass Sie die Denktiefe über das von Ihnen festgelegte Budget steuern.

Kann Claude Haiku 4.5 Bilder verarbeiten?

Ja. Es nimmt Bilder zusammen mit Text entgegen und antwortet in Textform. Dies umfasst das Lesen von Screenshots, Diagrammen und gescannten Dokumenten. Es kann keine Bilder generieren oder bearbeiten; verwenden Sie daher ein Bildmodell, wenn Sie eine Bildausgabe benötigen.

Wann sollte ich von Haiku 4.5 auf Sonnet umsteigen?

Wechseln Sie, wenn Haiku Anweisungen bei langen Prompts nicht befolgt, Schritte bei Multi-Tool-Agenten-Durchläufen auslässt oder Wissen über aktuelle Veröffentlichungen benötigt wird. Sonnet 5.5 ist der nächste Schritt, bietet ein schnelles Profil, ein längeres Kontextfenster und einen deutlich aktuelleren Wissensstichtag.

Was kostet Claude Haiku 4.5?

Auf TokenLab kostet Claude Haiku 4.5 Eingabe $0.30 / Ausgabe $1.50 Pro 1M Token. Die vollständige Aufschlüsselung steht in der Preistabelle oben. Die Preise hängen von Abrechnungseinheit, Spezifikation und Nutzung ab. Vergleichen Sie gleiche Bedingungen in der detaillierten Preisliste des Modells; eine einzelne Rate bestimmt nicht die Gesamtkosten.

Welche Kontext- und Ausgabelimits hat Claude Haiku 4.5?

Claude Haiku 4.5 verarbeitet bis zu 200.000 Token Kontext und gibt pro Antwort bis zu 64.000 Token aus.

Welchen Endpunkt soll Claude Haiku 4.5 verwenden?

Verwenden Sie https://api.tokenlab.sh/v1/messages für Claude Haiku 4.5. Das folgende Anforderungsbeispiel zeigt die passende Code-Struktur.

Welche Operationen unterstützt Claude Haiku 4.5?

Claude Haiku 4.5 unterstützt Text-zu-Text. Wählen Sie oben einen Vorgang aus, um dessen Endpunkt und Anforderungsbeispiel anzuzeigen.

Claude Haiku 4.5 vergleichen

Anleitungen für Claude Haiku 4.5

Quellen

Geprüft am 02.10.2026

Mehr aus der Claude 4-Serie

Ähnliche Modelle