Anthropic und OpenAI haben am selben Dienstag ihre Preise gesenkt
Anthropic und OpenAI haben am selben Dienstag die Preise für ihre Top-Modelle gesenkt, und ein kleines Startup hat gezeigt, dass viel Software-Arbeit eh gar kein Sprachmodell braucht. Meta hat seinen neuen Agent Muse in eine Brille und an einen Schlüsselanhänger gebracht, einen Tag nachdem Reuters berichtet hat, dass bei manchen Anrufen Menschen dahinterstecken. Und in derselben Woche ist Rabbit ganz aus dem Gadget-Geschäft ausgestiegen. Wenn du AI-Features für Kunden betreibst, hat sich diese Woche also eher deine Kalkulation bewegt als dein Stack.
Anthropic und OpenAI: Selber Dienstag, halbe Rechnung
Anthropic hat am 22. September Claude Opus 5.5 veröffentlicht, um 4 Dollar Input und 20 Dollar Output pro Million Tokens. Cache-Reads sind um 60 Prozent auf 0,20 Dollar gefallen. Laut Anthropic ist das Modell bei typischen Workloads rund 40 Prozent günstiger als Opus 5 und liefert bei den meisten Aufgaben auf dem Niveau von Fable 5.1.
Ein paar Stunden später hat OpenAI GPT-6 Sol und Luna gebracht, um 2/10 Dollar und 0,10/0,50 Dollar, also zum halben Preis der Modelle, die sie ersetzen. Dazu gibt es besseres Prompt Caching mit bis zu 90 Prozent Rabatt auf gecachten Input.
Die Tokenpreise aus der Headline landen auf den Screenshots. Wer Agents betreibt, für den entscheidet aber die Cache-Zeile über die Monatsrechnung, weil Agent-Loops denselben Kontext immer wieder mitschicken. Beide Labs haben also genau die Zahl gesenkt, die im Betrieb am meisten weh tut.
Einen direkten Vergleich zwischen Sol und Opus 5.5 hat noch niemand gemacht, und laut OpenAIs eigenen Safety-Zahlen umgeht Sol ein explizites "access denied" immer noch in 64,4 Prozent der Durchläufe. Test also mit deinem eigenen Workload, bevor du umsteigst.
Und wenn du heuer im Sommer ein AI-Feature in eine Rahmenvereinbarung mit einem Kunden eingepreist hast, hat sich deine Marge gerade verschoben. Rechne das nochmal durch, bevor die nächste Rechnung rausgeht.
Jev: Das Modell, das nicht redet
TypeSafe AI hat Jev am 15. September gelauncht, und am 18. September hat TechCrunch schon berichtet, dass die Nachfrage die API kurz in die Knie gezwungen hat. Der Gründer Diogo Almeida war vier Jahre bei OpenAI und hat dort an RLHF und ChatGPT gearbeitet.
Jev erzeugt überhaupt keinen Text. Du gibst ihm einen Zustand und typisierte Fragen, etwa eine Option auswählen, einen Score vergeben oder Ja oder Nein, und bekommst Wahrscheinlichkeiten und einen Confidence Score zurück. Weil du die möglichen Antworten vorher festlegst, kann es außerhalb deines Schemas nicht halluzinieren, und Output-Tokens kosten nichts.
Die ersten Zahlen kommen von Entwicklern, und das macht sie spannender. Vercel hat bei einem Klassifizierer für Command-Safety OpenAIs Luna gegen Jev getauscht und Ergebnisse bekommen, die 5 bis 18 Mal schneller und genauer waren. In einem anderen Test war Gemini etwas genauer, aber 10 bis 20 Mal teurer. Das "bis zu 445x günstiger" von TypeSafe ist selbst getestet, und das sagen sie auch dazu.
Ein großer Teil der AI-Arbeit in Agenturen ist genau diese Art von Plumbing. Tickets routen, Emails klassifizieren, riskante Aktionen markieren. Wenn du ein Chat-Modell dafür zahlst, in einer Kunden-Pipeline Ja oder Nein zu sagen, ist es Zeit, etwas zu benchmarken, das genau dafür gebaut ist.
Meta: Muse im Gesicht, am Schlüsselanhänger und am Telefon
Meta hat die Connect am 23. September genutzt, um seinen neuen Agent Muse in jedes Stück Hardware zu packen, das es finden konnte. Am meisten sagt die neue Meta VR Glasses aus, rund 100 Gramm mit 5K-Micro-OLED-Display, um 1.299,99 Dollar ab nächstem Frühjahr. Viele sagen, genau das hätte Apple mit der Vision Pro bringen sollen.
Zum Schluss der Keynote kam der Muse Charm, ein handtellergroßes "Holdable" mit einem ca. 2 Zoll großen OLED-Screen, einer anpassbaren Muse-Figur und 5G. Er kommt im Dezember, einen Preis gibt es noch nicht, und die Tamagotchi-Vergleiche waren sofort da.
Am Tag davor hat eine Exklusivmeldung von Reuters gezeigt, dass manche Anrufe über Muse in Wahrheit von einem Callcenter-Dienstleister erledigt wurden. Laut TNW war dieser "Human Concierge" für die Hälfte der Meta-Mitarbeiter eingeschaltet, und intern wurde gewarnt, dass sensible Daten bei Dienstleistern landen könnten. Das hatte Meta schon einmal, mit Facebooks M, das nie über rund 30 Prozent Automatisierung hinausgekommen ist.
Wie viele der Agent-Demos, die du heuer gesehen hast, hatten wohl irgendwo still einen Menschen im Loop sitzen?
Rabbit: Der R1 ist Geschichte, der Agent lebt weiter
Rabbit hat OS3 gelauncht, einen Agent, der einen lokalen Helfer auf Windows, Mac oder Linux installiert und mit deinen Desktop-Apps, Dateien und Webseiten arbeitet. Du erreichst ihn über den Browser, Telegram, iMessage oder den alten R1 und kannst bis zu fünf Computer mit einem Account verbinden. Eine Nachricht vom Handy kann also eine Tabelle auf dem Rechner im Büro aktualisieren. Ein Abo gibt es nicht. Du bringst deine eigenen API-Keys von OpenAI, Anthropic oder einem lokalen Modell mit.
Gleichzeitig hat Jesse Lyu Wired erzählt, dass Rabbit den R1 nicht mehr produziert und kein R2 geplant ist. Das nächste Gerät ist ein "Vibe Coding"-Cyberdeck, das in den nächsten Monaten kommen soll.
Die orange Box war immer schon ein Pitch für einen Agent, und wie sich gezeigt hat, funktioniert der Agent halt besser auf Hardware, die die Leute eh schon haben. Rabbit steigt aus der AI-Hardware genau in der Woche aus, in der Meta mit dem Charm einsteigt, und Meta muss jetzt zeigen, dass ein größeres Budget löst, woran der R1 gescheitert ist.
Ein Detail, bevor du einen Kunden-Laptop verbindest. Dateien bleiben lokal, der Gesprächsverlauf und die Memory-Logs liegen aber auf Rabbits Servern. Schau dir also an, wo deine Daten landen, bevor du ihm diesen Zugriff gibst.
Diese News kamen zuerst in unserem Dotbite Tech Pulse Newsletter raus. Willst du ihn auch in deiner Inbox?
Häufige Fragen
Was kostet Claude Opus 5.5 pro Million Tokens?
Was kosten GPT-6 Sol und GPT-6 Luna?
Was ist Jev von TypeSafe AI und was unterscheidet es von einem Chat-Modell?
Was hat Meta auf der Connect 2026 vorgestellt?
Haben bei Metas Agent Muse Menschen die Anrufe erledigt?
Was ist Rabbit OS3 und baut Rabbit noch den R1?
Hol dir den Tech Pulse
Jeden Monat recherchieren wir und schreiben für dich, was sich in Tech und AI wirklich bewegt hat. Dazu Tipps und Tricks, wie du AI einsetzt. Das willst du nicht verpassen.
Join Tech PulseDas könnte dich auch interessieren
Dario Amodei will, dass die ganze AI-Branche langsamer macht
Dario Amodei will die AI-Labs bremsen und Altman und Musk stimmen zu, Salesforce bringt das eigene Modell Koa, und Google öffnet Google Home für MCP.
Apples Foldable kostet 1.999 Dollar, und deine Watch hört jetzt mit
Apple bringt das iPhone Duo um 1.999 Dollar und eine Watch, die mithört, Meta startet den Agent Muse, und ein Navier-Stokes-Beweis sorgt für Streit.
GPT-6 Astra bedient deinen Computer und schreibt eigene Exploits
OpenAI hat GPT-6 Astra gelauncht und nennt es den Beginn von AGI, Anthropic senkt die Cache-Reads um 75%, und Teslas Cybercab fährt in Austin.
Ready to connect the dots?
Hi, ich bin Emir, CEO und Mitgründer von Dotbite.
Du hast eine interessante Idee für ein digitales Projekt und suchst einen Sparringspartner, der die Herausforderung gemeinsam mit dir angeht?
Dann bist du bei uns genau richtig.