Cookie-Einstellungen

Bitte wählen Sie aus, welchen Cookie-Kategorien Sie zustimmen möchten.

Dotbite

Anthropic und OpenAI haben am selben Dienstag ihre Preise gesenkt

Anthropic und OpenAI haben am selben Dienstag die Preise für ihre Top-Modelle gesenkt, und ein kleines Startup hat gezeigt, dass viel Software-Arbeit eh gar kein Sprachmodell braucht. Meta hat seinen neuen Agent Muse in eine Brille und an einen Schlüsselanhänger gebracht, einen Tag nachdem Reuters berichtet hat, dass bei manchen Anrufen Menschen dahinterstecken. Und in derselben Woche ist Rabbit ganz aus dem Gadget-Geschäft ausgestiegen. Wenn du AI-Features für Kunden betreibst, hat sich diese Woche also eher deine Kalkulation bewegt als dein Stack.

Anthropic und OpenAI: Selber Dienstag, halbe Rechnung

Anthropic hat am 22. September Claude Opus 5.5 veröffentlicht, um 4 Dollar Input und 20 Dollar Output pro Million Tokens. Cache-Reads sind um 60 Prozent auf 0,20 Dollar gefallen. Laut Anthropic ist das Modell bei typischen Workloads rund 40 Prozent günstiger als Opus 5 und liefert bei den meisten Aufgaben auf dem Niveau von Fable 5.1.

Ein paar Stunden später hat OpenAI GPT-6 Sol und Luna gebracht, um 2/10 Dollar und 0,10/0,50 Dollar, also zum halben Preis der Modelle, die sie ersetzen. Dazu gibt es besseres Prompt Caching mit bis zu 90 Prozent Rabatt auf gecachten Input.

Die Tokenpreise aus der Headline landen auf den Screenshots. Wer Agents betreibt, für den entscheidet aber die Cache-Zeile über die Monatsrechnung, weil Agent-Loops denselben Kontext immer wieder mitschicken. Beide Labs haben also genau die Zahl gesenkt, die im Betrieb am meisten weh tut.

Einen direkten Vergleich zwischen Sol und Opus 5.5 hat noch niemand gemacht, und laut OpenAIs eigenen Safety-Zahlen umgeht Sol ein explizites "access denied" immer noch in 64,4 Prozent der Durchläufe. Test also mit deinem eigenen Workload, bevor du umsteigst.

Und wenn du heuer im Sommer ein AI-Feature in eine Rahmenvereinbarung mit einem Kunden eingepreist hast, hat sich deine Marge gerade verschoben. Rechne das nochmal durch, bevor die nächste Rechnung rausgeht.

Jev: Das Modell, das nicht redet

TypeSafe AI hat Jev am 15. September gelauncht, und am 18. September hat TechCrunch schon berichtet, dass die Nachfrage die API kurz in die Knie gezwungen hat. Der Gründer Diogo Almeida war vier Jahre bei OpenAI und hat dort an RLHF und ChatGPT gearbeitet.

Jev erzeugt überhaupt keinen Text. Du gibst ihm einen Zustand und typisierte Fragen, etwa eine Option auswählen, einen Score vergeben oder Ja oder Nein, und bekommst Wahrscheinlichkeiten und einen Confidence Score zurück. Weil du die möglichen Antworten vorher festlegst, kann es außerhalb deines Schemas nicht halluzinieren, und Output-Tokens kosten nichts.

Die ersten Zahlen kommen von Entwicklern, und das macht sie spannender. Vercel hat bei einem Klassifizierer für Command-Safety OpenAIs Luna gegen Jev getauscht und Ergebnisse bekommen, die 5 bis 18 Mal schneller und genauer waren. In einem anderen Test war Gemini etwas genauer, aber 10 bis 20 Mal teurer. Das "bis zu 445x günstiger" von TypeSafe ist selbst getestet, und das sagen sie auch dazu.

Ein großer Teil der AI-Arbeit in Agenturen ist genau diese Art von Plumbing. Tickets routen, Emails klassifizieren, riskante Aktionen markieren. Wenn du ein Chat-Modell dafür zahlst, in einer Kunden-Pipeline Ja oder Nein zu sagen, ist es Zeit, etwas zu benchmarken, das genau dafür gebaut ist.

Meta: Muse im Gesicht, am Schlüsselanhänger und am Telefon

Meta hat die Connect am 23. September genutzt, um seinen neuen Agent Muse in jedes Stück Hardware zu packen, das es finden konnte. Am meisten sagt die neue Meta VR Glasses aus, rund 100 Gramm mit 5K-Micro-OLED-Display, um 1.299,99 Dollar ab nächstem Frühjahr. Viele sagen, genau das hätte Apple mit der Vision Pro bringen sollen.

Zum Schluss der Keynote kam der Muse Charm, ein handtellergroßes "Holdable" mit einem ca. 2 Zoll großen OLED-Screen, einer anpassbaren Muse-Figur und 5G. Er kommt im Dezember, einen Preis gibt es noch nicht, und die Tamagotchi-Vergleiche waren sofort da.

Am Tag davor hat eine Exklusivmeldung von Reuters gezeigt, dass manche Anrufe über Muse in Wahrheit von einem Callcenter-Dienstleister erledigt wurden. Laut TNW war dieser "Human Concierge" für die Hälfte der Meta-Mitarbeiter eingeschaltet, und intern wurde gewarnt, dass sensible Daten bei Dienstleistern landen könnten. Das hatte Meta schon einmal, mit Facebooks M, das nie über rund 30 Prozent Automatisierung hinausgekommen ist.

Wie viele der Agent-Demos, die du heuer gesehen hast, hatten wohl irgendwo still einen Menschen im Loop sitzen?

Rabbit: Der R1 ist Geschichte, der Agent lebt weiter

Rabbit hat OS3 gelauncht, einen Agent, der einen lokalen Helfer auf Windows, Mac oder Linux installiert und mit deinen Desktop-Apps, Dateien und Webseiten arbeitet. Du erreichst ihn über den Browser, Telegram, iMessage oder den alten R1 und kannst bis zu fünf Computer mit einem Account verbinden. Eine Nachricht vom Handy kann also eine Tabelle auf dem Rechner im Büro aktualisieren. Ein Abo gibt es nicht. Du bringst deine eigenen API-Keys von OpenAI, Anthropic oder einem lokalen Modell mit.

Gleichzeitig hat Jesse Lyu Wired erzählt, dass Rabbit den R1 nicht mehr produziert und kein R2 geplant ist. Das nächste Gerät ist ein "Vibe Coding"-Cyberdeck, das in den nächsten Monaten kommen soll.

Die orange Box war immer schon ein Pitch für einen Agent, und wie sich gezeigt hat, funktioniert der Agent halt besser auf Hardware, die die Leute eh schon haben. Rabbit steigt aus der AI-Hardware genau in der Woche aus, in der Meta mit dem Charm einsteigt, und Meta muss jetzt zeigen, dass ein größeres Budget löst, woran der R1 gescheitert ist.

Ein Detail, bevor du einen Kunden-Laptop verbindest. Dateien bleiben lokal, der Gesprächsverlauf und die Memory-Logs liegen aber auf Rabbits Servern. Schau dir also an, wo deine Daten landen, bevor du ihm diesen Zugriff gibst.

Diese News kamen zuerst in unserem Dotbite Tech Pulse Newsletter raus. Willst du ihn auch in deiner Inbox?

Häufige Fragen

Was kostet Claude Opus 5.5 pro Million Tokens?
Anthropic hat Claude Opus 5.5 am 22. September 2026 veröffentlicht, um 4 Dollar pro Million Input-Tokens und 20 Dollar pro Million Output-Tokens. Cache-Reads sind um 60 Prozent auf 0,20 Dollar gefallen. Laut Anthropic ist das Modell bei typischen Workloads rund 40 Prozent günstiger als Opus 5 und liefert bei den meisten Aufgaben auf dem Niveau von Fable 5.1.
Was kosten GPT-6 Sol und GPT-6 Luna?
OpenAI hat GPT-6 Sol und Luna am 22. September 2026 veröffentlicht, ein paar Stunden nach Claude Opus 5.5. Sol kostet 2 Dollar Input und 10 Dollar Output, Luna 0,10 und 0,50 Dollar, also die Hälfte der Modelle, die sie ersetzen. Dazu hat OpenAI das Prompt Caching verbessert, mit bis zu 90 Prozent Rabatt auf gecachten Input.
Was ist Jev von TypeSafe AI und was unterscheidet es von einem Chat-Modell?
Jev ist ein Modell von TypeSafe AI, das der frühere OpenAI-Forscher Diogo Almeida am 15. September 2026 gelauncht hat. Es erzeugt keinen Text. Du übergibst einen Zustand und typisierte Fragen und bekommst Wahrscheinlichkeiten und einen Confidence Score zurück. Dadurch kann es außerhalb der vorgegebenen Antworten nicht halluzinieren, und Output-Tokens kosten nichts. In einem Test von Vercel war es bei einem Command-Safety-Klassifizierer 5 bis 18 Mal schneller und genauer als OpenAIs Luna.
Was hat Meta auf der Connect 2026 vorgestellt?
Auf der Connect am 23. September 2026 hat Meta seinen Agent Muse in seine Hardware gebracht. Die Meta VR Glasses wiegen rund 100 Gramm, haben ein 5K-Micro-OLED-Display und kosten 1.299,99 Dollar, erhältlich ab nächstem Frühjahr. Der Muse Charm ist ein handtellergroßes Gerät mit ca. 2 Zoll großem OLED-Screen und 5G, das im Dezember kommt. Einen Preis gibt es noch nicht.
Haben bei Metas Agent Muse Menschen die Anrufe erledigt?
Ja. Laut einer Exklusivmeldung von Reuters vom 22. September 2026 wurden manche Anrufe über Muse von einem Callcenter-Dienstleister erledigt. Laut TNW war dieser Human Concierge für die Hälfte der Meta-Mitarbeiter eingeschaltet, und intern wurde gewarnt, dass sensible Daten bei Dienstleistern landen könnten.
Was ist Rabbit OS3 und baut Rabbit noch den R1?
Rabbit OS3 ist ein Agent, der einen lokalen Helfer auf Windows, Mac oder Linux installiert und mit Desktop-Apps, Dateien und Webseiten arbeitet. Du erreichst ihn über den Browser, Telegram, iMessage oder den R1, kannst bis zu fünf Computer mit einem Account verbinden und bringst deine eigenen API-Keys mit. Ein Abo gibt es nicht. Rabbit produziert den R1 nicht mehr und plant kein R2.

Hol dir den Tech Pulse

Jeden Monat recherchieren wir und schreiben für dich, was sich in Tech und AI wirklich bewegt hat. Dazu Tipps und Tricks, wie du AI einsetzt. Das willst du nicht verpassen.

Join Tech Pulse

Das könnte dich auch interessieren

Ready to connect the dots?

Portrait von Emir

Hi, ich bin Emir, CEO und Mitgründer von Dotbite.

Du hast eine interessante Idee für ein digitales Projekt und suchst einen Sparringspartner, der die Herausforderung gemeinsam mit dir angeht?

Dann bist du bei uns genau richtig.