Claude Opus 5: Nahe am Spitzenmodell, zum halben Preis
Anthropic hat am 24. Juli Claude Opus 5 veröffentlicht. Was das Modell für Agenten und Wissensarbeit im Mittelstand bedeutet.
Automatisierung · 12. März 2026

OpenAI hat am 5. März 2026 GPT-5.4 vorgestellt. Laut Hersteller ist es das erste Allzweckmodell mit eingebauter Computernutzung (Computer Use). Das Modell kann Bildschirminhalte verstehen, Schaltflächen anklicken und Programme bedienen, ohne dass dafür eine eigene Schnittstelle gebaut werden muss. Es erscheint als Thinking-Variante für zahlende ChatGPT-Nutzer und als Pro-Variante für die API sowie Pro- und Enterprise-Tarife.
Auf dem Benchmark OSWorld-Verified, der die Bedienung von Desktop-Umgebungen misst, erreicht GPT-5.4 nach Angaben von OpenAI 75 Prozent. Der Vorgänger GPT-5.2 kam auf 47,3 Prozent. Außerdem nennt OpenAI, dass einzelne Aussagen des Modells 33 Prozent seltener falsch sind und vollständige Antworten 18 Prozent seltener Fehler enthalten als bei GPT-5.2. Das sind Herstellerangaben aus Tests. Wie sich das in Ihren Abläufen verhält, zeigt erst ein eigener Versuch.
Viele Unternehmen arbeiten mit Software ohne saubere Schnittstelle: ein älteres Warenwirtschaftssystem, ein Behördenportal, eine Branchenlösung. Hier war Automatisierung bisher teuer, weil jemand eine Anbindung programmieren musste. Ein Modell, das den Bildschirm bedient wie ein Mensch, öffnet diese Türen, zumindest für klar umrissene, wiederkehrende Aufgaben:
Ein Modell, das klickt, kann auch falsch klicken. Es arbeitet mit den Rechten des Kontos, unter dem es angemeldet ist. Deshalb gelten die bekannten Regeln für Agenten besonders streng:
OpenAI selbst beschreibt für das Modell erweiterte Sicherheitssysteme, Überwachung und Zugriffskontrollen für riskantere Anfragen. Das ersetzt nicht Ihre eigenen Leitplanken.
Wählen Sie eine Aufgabe, die ein Mitarbeiter heute mindestens einmal pro Woche über 15 bis 30 Minuten erledigt, bei der ein Fehler keinen Schaden anrichtet und deren Ergebnis sich leicht prüfen lässt. Lassen Sie das Modell die Aufgabe vier Wochen lang parallel ausführen und vergleichen Sie Ergebnisse mit der manuellen Arbeit. Erst danach entscheiden Sie über den Einsatz.
Computer Use ist ein Werkzeug für die Lücke zwischen Systemen, nicht für den Ersatz sauberer Schnittstellen. Wo es eine API gibt, bleibt sie die stabilere Lösung.