Zum Inhalt springen
Strategie-Call buchen

Automatisierung · 12. März 2026

GPT-5.4 bedient den Rechner selbst

OpenAI hat am 5. März GPT-5.4 vorgestellt, das erste Allzweckmodell mit eingebauter Computernutzung. Eine Einordnung für Sachbearbeitung und Backoffice.
Grüner Würfel mit zwei Keramikkugeln und jungen Trieben

Automatisierung 2 Min. Lesezeit Von Alexander Otto

AgentenAutomatisierungSicherheitSprachmodelle

OpenAI hat am 5. März 2026 GPT-5.4 vorgestellt. Laut Hersteller ist es das erste Allzweckmodell mit eingebauter Computernutzung (Computer Use). Das Modell kann Bildschirminhalte verstehen, Schaltflächen anklicken und Programme bedienen, ohne dass dafür eine eigene Schnittstelle gebaut werden muss. Es erscheint als Thinking-Variante für zahlende ChatGPT-Nutzer und als Pro-Variante für die API sowie Pro- und Enterprise-Tarife.

Was belegt ist

Auf dem Benchmark OSWorld-Verified, der die Bedienung von Desktop-Umgebungen misst, erreicht GPT-5.4 nach Angaben von OpenAI 75 Prozent. Der Vorgänger GPT-5.2 kam auf 47,3 Prozent. Außerdem nennt OpenAI, dass einzelne Aussagen des Modells 33 Prozent seltener falsch sind und vollständige Antworten 18 Prozent seltener Fehler enthalten als bei GPT-5.2. Das sind Herstellerangaben aus Tests. Wie sich das in Ihren Abläufen verhält, zeigt erst ein eigener Versuch.

Wo das im Mittelstand helfen kann

Viele Unternehmen arbeiten mit Software ohne saubere Schnittstelle: ein älteres Warenwirtschaftssystem, ein Behördenportal, eine Branchenlösung. Hier war Automatisierung bisher teuer, weil jemand eine Anbindung programmieren musste. Ein Modell, das den Bildschirm bedient wie ein Mensch, öffnet diese Türen, zumindest für klar umrissene, wiederkehrende Aufgaben:

  • Daten aus einem Portal in eine Tabelle übertragen,
  • Bestellbestätigungen zwischen zwei Systemen abgleichen,
  • Formulare nach festen Regeln vorausfüllen.

Wo Vorsicht gilt

Ein Modell, das klickt, kann auch falsch klicken. Es arbeitet mit den Rechten des Kontos, unter dem es angemeldet ist. Deshalb gelten die bekannten Regeln für Agenten besonders streng:

  • Eigenes Benutzerkonto mit minimalen Rechten, nie das Konto einer Führungskraft.
  • Zunächst nur lesende Aufgaben, danach schreibende mit Freigabe durch einen Menschen.
  • Protokoll jeder Aktion, getrennt vom Agenten selbst.
  • Ein benannter Mensch, der den Lauf abbrechen darf.

OpenAI selbst beschreibt für das Modell erweiterte Sicherheitssysteme, Überwachung und Zugriffskontrollen für riskantere Anfragen. Das ersetzt nicht Ihre eigenen Leitplanken.

Ein sinnvoller erster Versuch

Wählen Sie eine Aufgabe, die ein Mitarbeiter heute mindestens einmal pro Woche über 15 bis 30 Minuten erledigt, bei der ein Fehler keinen Schaden anrichtet und deren Ergebnis sich leicht prüfen lässt. Lassen Sie das Modell die Aufgabe vier Wochen lang parallel ausführen und vergleichen Sie Ergebnisse mit der manuellen Arbeit. Erst danach entscheiden Sie über den Einsatz.

Computer Use ist ein Werkzeug für die Lücke zwischen Systemen, nicht für den Ersatz sauberer Schnittstellen. Wo es eine API gibt, bleibt sie die stabilere Lösung.

Quellen

Einen Agenten-Pilot sauber aufsetzen

Wir wählen mit Ihnen eine Aufgabe, definieren Rechte und Prüfschritte und messen vier Wochen lang das Ergebnis.