Google macht aus Gemini einen universellen Agenten für den Arbeitsplatz. Er beantwortet Fragen, übernimmt Wissensarbeit, erstellt Bilder und Medien und kann Code schreiben sowie ausführen. Statt einzelner Anweisungen erhält er ein Ziel und soll das fertige Ergebnis direkt in Dokumenten, Postfächern oder Entwicklungsumgebungen abliefern.
Ein Agent für beinahe jede Aufgabe
Der Gemini Agent läuft in der Cloud und behält Erinnerungen, Kontext und persönliche Einstellungen geräteübergreifend. Aufträge können Stunden oder Tage weiterlaufen, auch wenn der Nutzer seinen Computer ausschaltet. Erreichbar ist der Agent im Browser, unter iOS, Android, Windows und macOS sowie über Kommandozeile, Google Workspace, Microsoft 365 und Slack.
Bei größeren Aufgaben erstellt Gemini vorübergehende Unteragenten und koordiniert deren Arbeit. Daneben lassen sich dauerhafte »Coworker Agents« für Teams oder bestimmte Rollen einrichten. Sie bekommen eine eigene Identität, eine E-Mail-Adresse, einen Kalender und Speicherplatz in Drive. Mitarbeiter können sie in Google Chat erwähnen oder ihnen über Kommentare in Docs Aufgaben geben.
Anzeige
Gemini arbeitet direkt in Workspace
In Gmail, Drive, Docs, Slides, Sheets, Chat und Kalender greift derselbe Agent auf seine Erinnerungen, Fähigkeiten und Berechtigungen zu. So kann Gemini etwa die Teilnehmer eines regelmäßigen Termins selbst ermitteln, ihre Kalender prüfen und die Abstimmung per E-Mail beginnen. Auch mehrteilige Aufträge über mehrere Anwendungen hinweg sollen ohne erneute Erklärung des Zusammenhangs funktionieren.
Das zugrunde liegende Modell ist nicht fest an den Agenten gebunden. Gemini wählt je nach Aufgabe zwischen Googles Modellen und Claude von Anthropic. Unternehmen erhalten außerdem eigene Identitäten und Zugriffsrechte für Agenten, Protokolle ihrer Aktionen, abgeschottete Ausführungsumgebungen sowie Ausgabenlimits. Der Agent Gateway kontrolliert den Datenverkehr und setzt zentrale Regeln für alle eingesetzten Agenten durch.
