Google Cloud hat am Donnerstag den Gemini-Agenten angekündigt, einen einzigen, universellen KI-Agenten für die Arbeit, der Fragen beantwortet, Wissensarbeit erledigt, Medien erstellt sowie Code schreibt und ausführt – alles über eine Eingabeaufforderungsbox und in allen Apps, in denen Büroarbeit bereits vorhanden ist. Die Ankündigung erfolgte in der Keynote von Google Cloud-CEO Thomas Kurian auf der Veranstaltung „Gemini at Work 2026“ des Unternehmens.

Der Pitch stellt eine grundlegende Veränderung in der Art und Weise dar, wie Arbeitnehmer mit KI interagieren. In einem aus der Keynote übernommenen Blogbeitrag brachte Google den Wandel klar zum Ausdruck: Beim Gemini-Agenten geben Benutzer Ziele statt Anweisungen vor. Sie delegieren ein Ergebnis, und der Agent plant die Arbeit, nutzt Fähigkeiten und Tools, stellt eine Verbindung zu Ihren Systemen her und bringt etwas Fertiges zurück. Weitere Informationen zu dieser Geschichte finden Sie in unserer KI-Branchenberichterstattung.

Ein Agent, jede Oberfläche

Der Gemini-Agent arbeitet direkt in Gmail, Drive, Docs, Slides, Sheets, Chat und Calendar und verfügt über den gleichen Speicher, die gleichen Fähigkeiten und Steuerelemente wie überall sonst. Der Zugriff darauf erfolgt von jedem Gerät – Web, iOS- und Android-Mobilgeräten, Windows- und Mac-Desktops – und über jeden Kanal, einschließlich der Befehlszeile, Google Workspace, Microsoft 365 und Slack. Es kann auch in Anwendungen von Drittanbietern integriert werden oder als Headless-Agent arbeiten, der überhaupt keine dedizierte Schnittstelle benötigt.

Da der Agent in der Cloud ausgeführt wird, verwaltet er laut Google einen einzigen Satz von Erinnerungen, Kontext und ein Personalisierungsdiagramm, unabhängig davon, welches Gerät oder welchen Kanal ein Mitarbeiter verwendet. Sie müssen es nie erneut einweisen oder sich daran erinnern, welcher Maschine Sie eine Aufgabe zugewiesen haben. Entscheidend für langwierige Arbeiten ist, dass Aufgaben, die Stunden oder Tage dauern, auch dann weiter ausgeführt werden, wenn ein Benutzer seinen Laptop schließt, und die Ergebnisse immer noch vorhanden sind, wenn er zurückkehrt.

The Verge berichtete, dass der Agent in der Gemini Enterprise-App verfügbar sein wird, sodass Benutzer mit ihm chatten und ihm über eine einzige Schnittstelle Aufgaben zuweisen können, und dass er mit auftragsspezifischen Unteragenten zusammenarbeiten kann, um Aufgaben zu erledigen.

Ein Kollege mit eigener E-Mail-Adresse

Die auffälligste Fähigkeit ist eher organisatorischer als technischer Natur. Der Gemini-Agent kann dynamisch eine Liste von Unteragenten erstellen – temporäre, auftragsspezifische Agenten mit jeweils eigener Identität –, um mehrstufige Aufgaben zu bewältigen und Arbeitsabläufe zu koordinieren, die parallele und aufeinanderfolgende Schritte umfassen, die stunden- oder tagelang laufen.

Über diese temporären Helfer hinaus kann der Agent laut Google auch als Mitarbeiter fungieren: ein beharrliches Teammitglied mit einer definierten Rolle und operativer Präsenz, beispielsweise ein Projektmanager innerhalb eines Teams oder ein Analyst in einer Finanzabteilung. Mitarbeiteragenten erhalten ihre eigenen E-Mail-Adressen in der Domäne eines Unternehmens – The Verge nennt das Format @agents.company.com – sowie ihren eigenen dauerhaften Speicher und können nur auf den Kontext zugreifen, den ein Benutzer oder ein Team explizit bereitstellt.

Dieses Design zielt eindeutig auf die Governance-Bedenken ab, die die Einführung von Unternehmensagenten verlangsamt haben. Indem Google seinen KI-Mitarbeitern begrenzte, überprüfbare Identitäten gibt, anstatt die Anmeldeinformationen eines Menschen weiterzugeben, versucht Google, das Delegieren von Arbeit an einen Agenten eher wie das Onboarding eines Mitarbeiters und weniger wie die Übergabe der Schlüssel zum Firmenintranet zu gestalten.

Das Modell ist eine separate Wahl – einschließlich Claude

In einem bemerkenswerten Eingeständnis einer Zukunft mit mehreren Modellen sagt Google, dass der Gemini-Agent nicht an Googles eigene Modelle gebunden ist. Der Agent führt jeden Job für das Modell aus, das am besten passt, und orchestriert dabei die Gemini-Modellfamilie und Claude, die Modellreihe von Anthropic, heißt es in dem Blogbeitrag.

Diese Architektur macht die Agentenschicht und nicht ein einzelnes Modell zur Differenzierungsquelle von Google. Wenn Grenzmodelle aus mehreren Labors hinsichtlich ihrer Leistungsfähigkeit konvergieren, wird der dauerhafte Wassergraben zum System, das Ihre Daten, Ihre Werkzeuge und Ihren Arbeitsverlauf kennt – und das jede Aufgabe an das Modell weiterleiten kann, das sie am besten ausführt.

Die Skalenzahlen hinter dem Push

Kurians Keynote verknüpfte die Ankündigung mit Nutzungszahlen, die laut Google zeigen, dass Unternehmen über das Experimentieren hinausgehen. Nach Angaben des Unternehmens verarbeiteten fast 500 Google Cloud-Kunden im letzten Jahr jeweils mehr als eine Billion Token. Laut Google nutzen inzwischen fast 80 Prozent aller Google Cloud-Kunden seine KI-Produkte und fast 90 Prozent der Fortune-100-Unternehmen nutzen Gemini Enterprise.

Dabei handelt es sich um Googles eigene Zahlen, die nicht unabhängig geprüft wurden, aber sie skizzieren den Wettbewerbskontext: Der Unternehmens-KI-Markt hat sich von der Pilotphase zur Produktion entwickelt, und die Anbieter streiten sich nun darüber, welche Plattform zur Standardbetriebsebene für KI-gestützte Arbeit wird.

Das Agent-Plattform-Rennen ist eröffnet

Der Gemini-Agent kam einen Tag nach der Einführung von Claude Dashboards und Motion durch Anthropic auf den Markt, neue Tools, die Claude in eine Live-Datenanalyse- und Animationsplattform für Geschäftsanwender verwandeln. Die aufeinanderfolgenden Veröffentlichungen zeigen, dass die Frontier Labs zu dem gleichen Schluss kommen: Das Chatbot-Zeitalter weicht dem Agenten-Zeitalter, und der Gewinner wird derjenige sein, der die Agenten am tiefsten in die Arbeitsabläufe des Unternehmens einbettet.

Derzeit liegt der Vorteil von Google in der Verbreitung. Der Gemini-Agent trifft Mitarbeiter in den Gmail-Posteingängen, Kalendern und Dokumenten, die sie bereits verwenden, und dringt durch Slack- und Microsoft 365-Integrationen in das Gebiet der Konkurrenten vor. Der Vorteil von Anthropic ist das Vertrauen, das es in die Codierung und Analyse aufgebaut hat. Microsoft bleibt mit Copilot, das in seinem eigenen Büroimperium verankert ist, der etablierte Betreiber, von dem keiner aufwachen möchte.

Was als nächstes passiert, wird weniger von Demovideos als vielmehr von Beschaffungsentscheidungen entschieden – und davon, ob Unternehmen zu dem Schluss kommen, dass ein KI-Mitarbeiter mit eigener E-Mail-Adresse ein Kollege ist, den sie gerne einstellen würden.

---

Bleib vorne bei KI

Die neuesten KI-Nachrichten, Analysen und Durchbrüche – alles an einem Ort.

Read more AI news →