Die Meinungen dazu, wie intelligent die Künstliche Intelligenz ist, gehen weit auseinander. Zwar meistern neueste Modelle mittlerweile nicht nur gängige Maturaprüfungen, sondern schaffen bereits Aufnahmetests an renommierten Universitäten. Doch die verschiedenen KI-Services à la ChatGPT, MS Copilot oder Gemini sind noch immer in Logik, Autonomie sowie Entscheidungsfähigkeit und damit eigenständigem Handeln eingeschränkt. Das könnte sich jedoch bald ändern. Denn die Entwicklung von KI-Systemen transformiert sich derzeit in Windeseile von Task-spezifischen, statischen AI-Agenten, die menschlichen Input benötigen (Prompts), hin zu interaktiven und selbstlernenden Agenten. Diese können sich dank einer höheren Stufe an Autonomie der Umgebung anpassen und kommen mit ihrem Reifegrad einer «Allgemeinen Künstlichen Intelligenz» (Artificial General Intelligence, AGI) wieder einen Schritt näher. Die AGI ist laut OpenAI-Gründer Sam Altman in der Lage, ökonomisch wertvolle Arbeit ebenso kreativ, intelligent und flexibel wie ein Mensch, wenn nicht sogar besser, zu erledigen.
Task-spezifische KI vs. Agenten-Generalisten
Task-spezifische KI wird heutzutage auch in der Finanz- und Versicherungswirtschaft bereits breit genutzt. Sie dient der Automatisierung einfacher, strukturierter Tasks; die meisten im Einsatz stehenden Chatbots sind ein gutes Beispiel dafür. Sie werden mit Wissen zu Daten und Workflows gefüttert und handeln in dem ihnen vorgegebenen Rahmen, wodurch sie zwar wertvolle Fachkräfte entlasten und für Effizienzsteigerungen sorgen – allerdings entscheiden sie nur nach vorprogrammiertem Schema und können sich nur in engen Limiten an neue Situationen anpassen.
Agentic AI entwickelt sich in Richtung Agenten-Generalisten, die neue Fähigkeiten beherrschen, die ihr Lernen, Entscheiden und Handeln hochgradig von menschlichen Eingriffen entkoppeln. Sie basieren auf multimodalen Systemen, die effizient eine grosse Menge an verschiedensten (Umgebungs-)Daten verarbeiten und daraus eine grosse Breite an agentenbasierten multimodalen Interaktionen ableiten können. Die Daten können Text, aber auch Video oder Robotics-Sequenzen sein (daher: multimodal).
Ein hohes Mass an Autonomie
Generell ist der KI eigen, dass sie dem Menschen weit überlegen ist, grosse Datenmengen in kürzester Zeit zu verarbeiten. Neue KI-Modelle ermöglichen AI-Agenten mit einem höheren Mass an Autonomie, so dass sie nicht ständig mit dem Menschen interagieren müssen. Arbeitsschritte werden eigenständig geplant und abgearbeitet.
Gemessen wird die Leistungsfähigkeit einer KI am «General AI Assistant (GAIA)» Benchmark. Auf niedrigstem Level stehen KI-Modelle, die in der Lage sind, Aufgaben zu erledigen, die keine oder höchstens ein Werkzeug erfordern und in maximal fünf Schritten lösbar sind. Auf Level 2 heben sich KIs bei Aufgaben, für die sie fünf bis zehn Schritte benötigen und mehrere Werkzeuge kombinieren müssen. Level 3 schliesslich setzt ein allgemeines Verständnis der Welt voraus, um sich mit Aufgaben befassen zu können, für die die Anzahl an Arbeitsschritten und Werkzeugen unlimitiert sind. Neueste KI-Modelle rücken menschlicher Intelligenz bereits recht nahe, indem sie auf Level 1 bei über 80 (vs. Mensch: 100), auf Level 2 bei 70 (vs. Mensch: 92) und Level 3 fast 60 (Mensch: 87) Prozent erreichen.