OpenAI hat kürzlich die Einführung eines neuen Allzweck-Agenten innerhalb von ChatGPT bekannt gegeben, der eine breite Palette von computerbasierten Aufgaben im Namen der Nutzer erledigen kann. Dieses neue Tool, bekannt als ChatGPT-Agent, kombiniert zahlreiche Fähigkeiten aus OpenAIs früheren agentischen Werkzeugen. Dazu gehört unter anderem die Fähigkeit von Operator, auf Webseiten zu navigieren, sowie die Fähigkeit von Deep Research, Informationen aus zahlreichen Webseiten in einen prägnanten Forschungsbericht zusammenzufassen. Nutzer können mit dem Agenten einfach durch Eingaben in natürlicher Sprache interagieren.
Der ChatGPT-Agent wird an diesem Donnerstag für Abonnenten der Pro-, Plus- und Team-Pläne von OpenAI verfügbar sein. Um das Tool zu aktivieren, können Nutzer den „Agentenmodus“ im Dropdown-Menü von ChatGPT auswählen.
Diese Einführung markiert OpenAIs mutigsten Versuch, ChatGPT in ein agentisches Produkt zu verwandeln, das Aufgaben für Nutzer übernehmen und ausführen kann, anstatt nur Fragen zu beantworten. In den letzten Jahren haben Unternehmen im Silicon Valley, darunter OpenAI, Google und Perplexity, zahlreiche KI-Agenten vorgestellt, die genau das versprechen. Allerdings hatten diese frühen Versionen von KI-Agenten Schwierigkeiten mit komplexen Aufgaben und schienen als Produkte weniger überzeugend zu sein als die ultimative Vision, die Technologieführer rund um KI-Agenten präsentieren.
OpenAI behauptet jedoch, dass der ChatGPT-Agent wesentlich leistungsfähiger ist als seine bisherigen Angebote. Der neue Agent kann auf ChatGPT-Konnektoren zugreifen, die es Nutzern ermöglichen, Apps wie Gmail und GitHub zu verbinden, sodass der Agent relevante Informationen zu den Eingaben der Nutzer finden kann. Der ChatGPT-Agent hat Zugang zu einem Terminal und kann APIs nutzen, um auf bestimmte Apps zuzugreifen.
Laut OpenAI können Nutzer den ChatGPT-Agenten nutzen, um unter anderem „Zutaten für ein japanisches Frühstück für vier Personen zu planen und zu kaufen“ oder „drei Wettbewerber zu analysieren und eine Präsentation zu erstellen“. Diese Fähigkeiten erfordern, dass der ChatGPT-Agent Webseiten durchsucht, einen Aktionsplan entwickelt und Werkzeuge verwendet – weitaus kompliziertere Aufgaben, als OpenAI bisher mit seinen Agenten in Angriff genommen hat.
Das Modell, das dem ChatGPT-Agenten zugrunde liegt, bietet laut OpenAI eine erstklassige Leistung in mehreren Benchmarks. Das Unternehmen gibt an, dass das Modell des ChatGPT-Agenten 41,6 % im „Humanity’s Last Exam“ (pass@1) erreicht, einem schwierigen Test mit Tausenden von Fragen aus mehr als hundert Themengebieten. Das ist etwa doppelt so viel wie OpenAIs o3 und o4-mini bei diesem Test erreicht haben.
Beim FrontierMath, einem der schwierigsten bekannten Mathematik-Benchmarks, erzielt der ChatGPT-Agent laut OpenAI 27,4 %, wenn er Zugang zu Werkzeugen wie einem Terminal für die Codeausführung hat. Der vorherige Spitzenwert stammt von o4-mini, das nur 6,3 % erreichte.
OpenAI hebt hervor, dass der ChatGPT-Agent mit dem Gedanken an Sicherheit entwickelt wurde, da das Produkt einige neue Fähigkeiten bietet, die in den Händen eines böswilligen Akteurs gefährlicher sein könnten. In einem Sicherheitsbericht für den ChatGPT-Agenten erklärt OpenAI, dass das Modell in den Bereichen biologische und chemische Waffen als „hohe Fähigkeit“ eingestuft wurde, was in OpenAIs Preparedness Framework als ein Modell definiert ist, das „vorhandene Wege zu schwerem Schaden verstärken“ kann. OpenAI weist darauf hin, dass es keine direkten Beweise dafür gibt, aber es hat beschlossen, einen vorsorglichen Ansatz zu verfolgen und neue Sicherheitsmaßnahmen zu ergreifen, um diese Risiken zu mindern.
Die neuen Sicherheitsmaßnahmen für den ChatGPT-Agenten umfassen einen Monitor, der in Echtzeit arbeitet, während Nutzer mit dem Produkt interagieren. OpenAI erklärt, dass ein Klassifikator alle Eingaben analysiert, um festzustellen, ob die Anfrage mit Biologie in Verbindung steht. Wenn ja, wird die Antwort des ChatGPT-Agenten durch einen zweiten Monitor überprüft, um festzustellen, ob der Inhalt genutzt werden könnte, um eine biologische Bedrohung hervorzurufen.
OpenAI hat auch die Speicherfunktion des ChatGPT-Agenten deaktiviert, um Missbrauch zu verhindern. In anderen Bereichen von ChatGPT ermöglicht die Speicherfunktion dem Chatbot, Informationen aus vorherigen Benutzerchats zu referenzieren. Allerdings könnten böswillige Akteure diese Funktion im ChatGPT-Agenten nutzen, um durch Eingabeaufforderungsangriffe sensible Daten zu extrahieren. Das Unternehmen erklärt, dass es die Wiedereinführung dieser Funktion in der Zukunft möglicherweise in Betracht ziehen wird.
Obwohl der ChatGPT-Agent beeindruckend klingt, bleibt abzuwarten, wie fähig er in der realen Welt tatsächlich ist. Bisher hat sich die Agententechnologie als relativ anfällig erwiesen, wenn sie mit der realen Welt interagiert. Dennoch betont OpenAI, dass sie ein leistungsfähigeres Modell entwickelt haben, das das Versprechen von KI-Agenten erfüllen kann.