ModelleBeliebt

Claude Haiku 5.5 senkt die API-Kosten kleiner Modelle um 75 Prozent

Anthropics günstigstes Modell kostet im Betrieb nur noch etwa ein Viertel seines Vorgängers. Was Claude Haiku 5.5 für Teams bedeutet, die pro Token bezahlen.

Anna WeberAnna Weber
Beliebtheit: 1,500
Claude Haiku 5.5 senkt die API-Kosten kleiner Modelle um 75 Prozent

Anthropics günstigstes Modell kostet im Betrieb nur noch etwa ein Viertel seines Vorgängers. Was Claude Haiku 5.5 für Teams bedeutet, die pro Token bezahlen.

Claude Haiku 5.5 ist Anthropics günstigstes kleines Modell

Anthropic hat am 7. Oktober Claude Haiku 5.5 veröffentlicht und nennt es das bislang günstigste, schnellste und leistungsfähigste kleine Modell des Hauses. Die Schlagzeile für alle, die API-Rechnungen bezahlen, ist einfach: Der Betrieb von Haiku 5.5 kostet im Schnitt rund 75 Prozent weniger als bei Haiku 4.5, so die Angaben des Herstellers.

Das ist das Versprechen in einem Satz. Kurz. Der ganze Rahmen ist allerdings interessanter, denn Anthropic hat zum Start nicht nur das kleine Modell erneuert, sondern auch bei einem größeren Modell am Preis gedreht und Abonnenten ein Guthaben in Aussicht gestellt.

Haiku ist die kleine, schnelle Klasse der Claude-Familie. Sie übernimmt Arbeit, die sich wiederholt: Dokumente zusammenfassen, Inhalte einsortieren und verschlagworten, Fragen zu einer einzelnen Datei beantworten, Datenbankabfragen dieser Art. Wer schon einmal einen Chatbot an ein Support-Postfach oder eine Dokumentenstrecke angebunden hat, kennt Haiku als das Modell, das im Hintergrund die Masse erledigt, während ein größeres die kniffligen Fälle prüft.

Ob das reicht? Claude Haiku 5.5 behält diese Rolle und macht sie im großen Maßstab billiger. Das unabhängige Bewertungshaus Artificial Analysis vergibt auf seinem Intelligenz-Index 43 Punkte. Ordentlich, aber nicht Spitze.

Was die 75 Prozent Kostenersparnis für API-Nutzer heißen

Die Preissenkung ist der Grund, aus dem sich die meisten Entwickler dafür interessieren. Laut Anthropic kostet der Betrieb von Haiku 5.5 etwa 75 Prozent weniger als bei Haiku 4.5, also ungefähr ein Viertel der alten Rechnung bei gleichem Arbeitsvolumen. Das ist eine Menge.

Was das in der Praxis heißt, zeigt ein Rechenbeispiel. Ein junger Anbieter mit Millionen Klassifizierungsaufrufen im Monat rechnet plötzlich anders, welche Aufgaben sich automatisieren lassen. Die Routinejobs, die über jedes Dokument hinweg bisher zu teuer waren, passen nun in ein normales Budget.

Anthropic empfiehlt Haiku 5.5 für hochvolumige, kostenempfindliche Arbeit und weist darauf hin, dass es sich auch als Unteragent unter Opus 5.5 und Sonnet 5.5 bei Programmieraufgaben eignet. Ein Vorbehalt gehört dazu: Die 75 Prozent sind ein Durchschnittswert des Herstellers, und die tatsächliche Ersparnis hängt von Ihrem Arbeitsaufkommen und der Länge der Antworten ab. Eine vollständige Aufstellung der Token-Preise für jede Stufe hat das Unternehmen nicht veröffentlicht, behandeln Sie den Durchschnitt also als Richtwert, nicht als Zusage.

VentureBeat berichtete von einem noch stärkeren Nachlass in einem Teilbereich: Bei Anfragen unter 100.000 Tokens fielen die Token-Preise um rund 90 Prozent. Unterschiedliche Quellen nennen unterschiedliche Zahlen, weil die Ersparnis je nach Nutzung schwankt.

Sonnet 5.5 wird auch beim Cache-Lesen günstiger

Beim Start ging es nicht nur um das kleine Modell. Anthropic hat den Preis für das Cache-Lesen bei Claude Sonnet 5.5 halbiert. Das ist der Posten, den man bezahlt, wenn das Modell bereits verarbeiteten Kontext wiederverwendet, statt ihn frisch zu lesen.

Cache-Lesen zählt bei Agentenarbeit, wenn ein Modell einen langen Dialog oder eine große Datei über viele Schritte hinweg im Blick behält. Anthropic zufolge sinken die Kosten von Sonnet 5.5 bei den meisten Agentenaufgaben dadurch um rund 20 Prozent. Wer einen Assistenten baut, der ein Projekt durchgehend im Auge behält, sieht genau diese Zeile schrumpfen.

Beide Schritte zeigen in dieselbe Richtung: Anthropic wettbewerbt nicht nur über rohe Leistung, sondern über den Preis für Arbeit, die ständig läuft.

Wo Haiku 5.5 in der Claude-5.5-Familie einzuordnen ist

Mit Haiku 5.5 schließt Anthropic eine Familie ab, die das Unternehmen durch den Herbst ausgerollt hat. Opus 5.5 kam am 22. September, Sonnet 5.5 folgte am 28. September als geschwindigkeitsorientierte Aufwertung, und beide Ankündigungen nannten Haiku 5.5 als in den kommenden Wochen anstehend. Der 7. Oktober ist nun diese Ankunft.

Die drei Modelle teilen die Arbeit nach Kosten und Leistung auf. Opus übernimmt die härtesten Probleme, Sonnet sitzt in der Mitte für Agentenaufgaben, und Haiku trägt die hochvolumigen Jobs mit geringem Risiko. Ein verbreitetes Muster lässt Haiku die erste Runde erledigen und alles Ungewöhnliche eine Stufe höher weiterreichen.

Die Wahl fällt über das Budget.

Verfügbarkeit, Guthaben und die Stellschraube für den Aufwand

Claude Haiku 5.5 ist ab sofort auf der Claude Platform verfügbar, außerdem über AWS, Google Cloud und Microsoft Azure. Teams, die Claude bereits in diesen Clouds betreiben, können umsteigen, ohne neue Infrastruktur aufzusetzen.

Zusätzlich hat Anthropic ein monatliches API-Guthaben für Claude Max und Team eingeführt, gerichtet an alle, die Agenten und Anwendungen auf der Claude Platform bauen. Das Guthaben ist ein Anreiz für die Entwicklerschaft, die am meisten für Token ausgibt.

Ein Detail, das beim Feintuning zählt: Haiku 5.5 ist das erste Modell der Haiku-Klasse mit einem regelbaren Aufwandsmaß. Sie können es auf Tempo und Kosten oder auf Genauigkeit einstellen, je nach Aufgabe.

Wenn Ihre Arbeitslast vor allem aus Zusammenfassungen, Tags und Nachschlagen besteht, ist Haiku 5.5 die Version, die Sie gegen Ihr aktuelles Setup testen sollten. Kleine Änderung, große Ersparnis. Setzen Sie es zuerst für einen einzigen hochvolumigen Job ein, vergleichen Sie nach einer Woche Rechnung und Ausgabequalität, und entscheiden Sie dann, wie weit Sie es in Ihrer Dokumentenstrecke ausrollen.

Diesen Artikel teilen

Quellen

Ähnliche KI-News

GPT-6 und Intelligent UI starten in ChatGPT für alle Nutzer
Modelle

GPT-6 und Intelligent UI starten in ChatGPT für alle Nutzer

GPT-6 erreicht alle ChatGPT-Nutzer, auch die kostenlosen. Die neue Intelligent UI macht aus Antworten bedienbare Oberflächen mit Diagrammen, Knöpfen und Formularen.

Beliebtheit: 1,700
Editorial-Illustration eines leuchtenden neuronalen Netzkerns in einem europäischen Rechenzentrum
Modelle

Mistral Large 4: Europas Billionen-Parameter-Wette im Vorschau-Test

Mistral hat Mistral Large 4 als öffentliche Vorschau gestartet. Das Modell mit einer Billion Parametern läuft in Europa, die offenen Gewichte sollen Ende Oktober folgen.

Beliebtheit: 1,600
Editorial-Illustration eines stilisierten bananenförmigen Cursors, der ein Foto bearbeitet
Modelle

Google Nano Banana 2.1 ist da: halber Bildpreis, 23 Tage zum Umstieg

Google hat Nano Banana 2.1 veröffentlicht. Ein 1K-Bild kostet nur noch halb so viel, aber die Eingabepreise steigen. Nano Banana 2 wird am 29. Oktober abgeschaltet.

Beliebtheit: 1,300
Abstraktes neuronales Netz aus offenen Gewichten, das sich aus einem leuchtenden Kern entfaltet, kühler Blaugrün-Verlauf, ohne Text
Modelle

Reflection stellt Beam vor: 501B-Modell fürs Programmieren

Reflection AI stellt sein erstes offenes Modell vor: 501 Milliarden Parameter, gebaut fürs Programmieren. Die Gewichte sollen noch in diesem Monat unter Apache 2.0 erscheinen.

Beliebtheit: 1,250