KI-Agenten
für Alle.

Wie KI-Agenten im Business-Alltag
produktiv eingesetzt werden können.

01 · Kernbotschaften

Sieben Thesen zur Agenten-Landschaft.

Die Demokratisierung der Agenten-Landschaft ist 2026 vollzogen. Was 2023 als Bastel-Experiment begann, ist Stand August 2026 industrielles Werkzeug — und der Markt ist in die zweite Phase eingetreten: Erstmals werden mehr Agentenprodukte eingestellt als neu gestartet.

— These 01

Status: Wir sind angekommen.

2026 ist die Phase der agentischen KI. Was 2023 mit AutoGPT als Bastel-Experiment begann, ist Stand August 2026 industrielles Werkzeug. Neu ist die Gegenbewegung: Google stellte Project Mariner und die Gemini CLI ein, OpenAI Atlas, den Agentenmodus und AgentKit.

— These 02

Demokratisierung ist real.

Das Vorurteil, nur Entwickler:innen könnten Agenten bauen, ist überholt. Viele Wissensarbeiter:innen können in natürlicher Sprache eigene Agenten konfigurieren.

— These 03

Business-Realität, nicht Vision.

Microsoft Work Trend Index 2026: 15-faches Wachstum aktiver Agenten in Microsoft 365 binnen eines Jahres, in Großunternehmen das 18-fache. LangChain: 57 % der befragten Organisationen haben Agenten in Produktion. In Deutschland nutzen laut ifo 54,5 % der Unternehmen KI.

— These 04

Hebel: Delegation, nicht Erfindung.

Der größte Produktivitätsgewinn liegt in der Delegation bestehender Routineabläufe an Cowork, Workspace-Agents und Office-Add-ins.

— These 05

Die letzte Meile ist überbrückt.

Mit Computer Use lassen sich auch Anwendungen ohne API automatisieren. Seit dem 29.05.2026 läuft Codex Computer Use auch unter Windows — und seit Mitte Juni 2026 ist es auch im EWR, in UK und der Schweiz freigeschaltet. Damit steht Computer Use in Europa bei OpenAI, Anthropic, Microsoft Copilot Studio und Google zur Verfügung; der EU-Ausschluss als Bremse ist entfallen.

— These 06

Vorsicht vor blindem Vertrauen.

Agenten halluzinieren, machen Fehler, brauchen Aufsicht. Die wichtigste neue Rolle ist nicht der „Agentenbauer", sondern der „Agent Supervisor".

— These 07

Regulierung ist konkret geworden.

Seit dem 02.08.2026 gelten die Transparenzpflichten des EU AI Act. Agenten müssen ihre künstliche Natur und ihren Auftraggeber offenlegen. Deutschland hat seit dem 29.07.2026 mit der Bundesnetzagentur eine zuständige Aufsichtsbehörde.

78%
der Wissensarbeiter:innen nutzen wöchentlich KI-Agenten
(MS Work Trend Index 2026)
89%
der Business-Teams setzen Agenten ein
(Google AI Agent Trends)
12
Agenten pro Organisation im Schnitt
(Google 2026)
13
Monate vom ersten General-Purpose-Agenten bis zur Mainstream-Adoption
02 · Definition

Was ist ein KI-Agent — und was ist es nicht?

Die kürzeste sinnvolle Definition

„Ein KI-Agent ist ein KI-System, das ein Ziel selbstständig in mehrere Schritte zerlegt, dafür Werkzeuge benutzt, sein Vorgehen anpasst, wenn etwas nicht klappt — und am Ende ein Ergebnis liefert, ohne dass jemand jeden einzelnen Schritt vorgibt."

— 01

Chatbots antworten.

Ein klassischer Chatbot reagiert auf eine Eingabe, liefert eine Antwort und wartet auf die nächste Frage.

— 02

Agenten handeln.

Ein Agent zerlegt ein Ziel in Schritte, nutzt Werkzeuge, prüft Zwischenergebnisse und korrigiert seinen Plan.

— 03

Aufsicht bleibt Pflicht.

Je mehr ein Agent sehen, verändern oder versenden darf, desto klarer müssen Regeln, Freigaben und Kontrollpunkte sein.

Das mentale Modell: der digitale Fachexperte

Ein KI-Agent ist wie ein digitaler Fachexperte mit Werkzeugzugriff: extrem schnell, breit informiert und ausdauernd, aber ohne eigenes Verantwortungsbewusstsein. Er braucht ein klares Ziel, Zugriff auf die richtigen Daten und Tools, Spielregeln, Feedback und menschliche Letztkontrolle.

Was ist kein Agent?

Das ist KEIN AgentBegründung
Klassischer Chatbot (FAQ-Bot)Einmalige Antwort auf einmalige Frage; keine Tool-Nutzung, keine Mehrstufigkeit.
Custom GPT (alte Generation)Reagiert nur auf Eingaben; führt keine eigenständigen Aktionen aus.
n8n / Make WorkflowFolgt einem fest verdrahteten Ablauf; passt sich nicht an neue Situationen an.
Code-VervollständigungVorschläge auf Tastendruck, keine eigenständige Handlung.
Suchmaschine mit KI-ZusammenfassungAggregiert Inhalte; plant keine Handlungen.

Die Grenze ist allerdings fließend: Ein n8n-Workflow, der an einer Stelle ein LLM aufruft, das dann Entscheidungen über den weiteren Verlauf trifft, wird zu einem agentischen System.

03 · Kernkomponenten

Fünf Bausteine bilden jeden Agenten.

Egal welches Tool — die Architektur ist immer dieselbe. Brain, Tools, Memory, Goals und Loop bilden das System, das aus Sprachmodell-Antworten zielgerichtetes Handeln macht.

Goals & Plans
Ziel · Plan · Erfolgskriterien
Memory
Kontext · Präferenzen
Brain (Reasoning)
LLM · Planen · Entscheiden
Tools
APIs · Maus · Tastatur
Loop
Wahrnehmen → Planen → Handeln → Beobachten
ReAct-Pattern: Reasoning + Acting · Loop läuft, bis Ziel erreicht oder Mensch interveniert

Die Bausteine im Klartext

KomponenteFunktionAnalogie aus dem Büroalltag
Brain (LLM/Reasoning)Versteht das Ziel, plant Schritte, bewertet ErgebnisseFachlogik, Urteilsvermögen, Planungsfähigkeit
Tools (Werkzeuge)API-Aufrufe, Datei lesen/schreiben, Mail senden, Maus & TastaturTastatur, Browser, Telefon
MemoryKontext, frühere Ergebnisse, gelernte VorliebenNotizbuch, Onboarding-Doc
Goals & PlansAufgabenbeschreibung, Erfolgskriterien, Schritt-für-SchrittAuftragszettel, Checkliste
LoopWahrnehmen-Planen-Handeln-Beobachten-Kreislauf„Tun, prüfen, korrigieren, weitermachen"

Memory hat drei Ebenen: Kurzzeit (Kontextfenster), Mittelzeit (Projekt-Memory), Langzeit (persönliche Präferenzen über Wochen). Microsoft nutzt Work IQ, Google Workspace Intelligence.

04 · Entwicklung

Von AutoGPT zu Cowork — 13 Monate.

Vom ersten viralen General-Purpose-Agenten (Manus, März 2025) bis zur Mainstream-Verfügbarkeit für Wissensarbeiter (Cowork, Workspace Agents, Office Add-ins, Frühjahr 2026) lagen etwa 13 Monate. Solche Adoptionsgeschwindigkeiten gab es selbst beim ChatGPT-Boom nicht.

NOV 2022
Wendepunkt 1 — ChatGPT
Aus „KI für Spezialisten" wird ein Konsumprodukt. Aber: noch ein Chatbot, kein Agent.
2023
AutoGPT & BabyAGI
Erste autonome LLM-Agenten als Open-Source-Bastelei.
OKT 2024
Anthropic Computer Use
Start als API-Funktion zur Steuerung von Maus, Tastatur und Bildschirm; später Grundlage für integrierte Arbeitsmodi.
JAN 2025
OpenAI Operator
Erster Mainstream-Browser-Agent, basierend auf dem CUA-Modell.
MRZ 2025
Manus AI — viraler Moment
1 Mio. Demo-Video-Aufrufe in 20 Stunden. Der erste „General Purpose"-Agent.
MAI 2025
Google Project Mariner
Browser-Agent mit Gemini 2.0; 83,5 % auf WebVoyager-Benchmark.
OKT 2025
Claude für Excel (Beta)
Erste agentische Office-Add-ins von einem Drittanbieter.
DEZ 2025
Meta übernimmt Manus
~2 Mrd. USD. Geopolitisches Tauziehen beginnt.
JAN–FEB 2026
Wendepunkt 2 — Cowork-Welle
Claude Cowork (Jan), Codex-Desktop (Feb), Claude für PowerPoint (Feb), 1 Mio. Token Kontext.
FEB 2026
Hermes Agent (Nous Research)
Selbst gehosteter Open-Source-Agent unter MIT-Lizenz, der eigene Skills schreibt. Bis April 2026 über 73.000 GitHub-Sterne — zweites Signal nach OpenClaw, wie stark die Nachfrage nach Agenten außerhalb der Anbieter-Clouds ist.
MRZ 2026
Microsoft Frontier-Event
Copilot Cowork in Kooperation mit Anthropic; Multi-Modell-Strategie wird offiziell.
22. APR 2026
Der „große Agenten-Tag"
Microsoft Agent Mode GA · OpenAI Workspace Agents · Google Cloud Next 2026 (Gemini Enterprise) — alles innerhalb 48 Stunden.
16. APR 2026
Codex Computer Use (macOS)
OpenAI bringt parallele Desktop-Agenten — explizit für API-lose Apps. Zum Start noch ohne EWR/UK/CH (Freigabe folgte im Juni 2026).
27. APR 2026
China blockt Manus-Übernahme
NDRC ordnet Rückabwicklung der Meta-Akquisition an. Status der Umsetzung unklar.
MAI 2026
ChatGPT Workspace Agents: kreditbasiertes Pricing
OpenAI beendet die kostenlose Vorschau und stellt Workspace Agents auf ein kreditbasiertes Preismodell um.
MAI 2026
Google stellt Project Mariner ein
Begründet mit Ressourcenverbrauch und Fehleranfälligkeit. Die Technik geht in die Gemini API über.
21. MAI 2026
ChatGPT Workspace Agents allgemein verfügbar
Für Business-Kunden. Die tokenbasierte Credit-Abrechnung startet am 06.07.2026.
28. MAI 2026
Claude Opus 4.8 · Anthropic Series H
82,3 % auf OSWorld-Verified. Zugleich 65 Mrd. USD Finanzierung bei 965 Mrd. USD Bewertung.
29. MAI 2026
Codex Computer Use auf Windows
Version 26.527, Steuerung im Vordergrund. EWR, UK und Schweiz zunächst noch ausgenommen.
02. JUN 2026
Microsoft Build 2026
Microsoft IQ, Work-IQ-APIs, neue Kategorie „Autopilots“ mit Microsoft Scout, sieben eigene MAI-Modelle.
09. JUN 2026
Claude Fable 5 und Mythos 5
Eine Modellklasse oberhalb von Opus. Mythos 5 nur auf Einladung — Zugangsbeschränkung als Sicherheitsmaßnahme.
12. JUN 2026
US-Exportkontrollen für Fable und Mythos
Anthropic setzt den Zugang weltweit aus. Aufhebung am 30. Juni, Wiederfreigabe am 1. Juli.
16. JUN 2026
Microsoft Copilot Cowork weltweit verfügbar
Abrechnung über Copilot Credits (0,01 USD), standardmäßig deaktiviert.
17. JUN 2026
Codex Computer Use kommt nach Europa
OpenAI schaltet Computer Use (macOS und Windows), die Codex-Chrome-Erweiterung, Memories und Chronicle für EWR, UK und Schweiz frei. Memories bleibt dort standardmäßig aus (Opt-in), das Chrome-DevTools-Protokoll zunächst gesperrt.
18. JUN 2026
Gemini CLI abgeschaltet
Antigravity CLI übernimmt. Bezahlte Standard- und Enterprise-Lizenzen behalten Zugriff.
30. JUN 2026
Claude Sonnet 5
Natives Kontextfenster von 1 Mio. Token zum Einführungspreis.
01. JUL 2026
JADEPUFFER — erste agentische Ransomware
Sysdig dokumentiert einen weitgehend autonomen Angriff über eine exponierte Langflow-Instanz. 1.342 verschlüsselte Konfigurationselemente, keine Wiederherstellung möglich.
09. JUL 2026
GPT-5.6 und ChatGPT Work
Der Agentenmodus wird eingestellt, Atlas zum 9. August abgeschaltet. ChatGPT besteht nun aus Chat, Work und Codex.
24. JUL 2026
Claude Opus 5
1 Mio. Token Kontext bei unverändertem Preis. Führt Vending-Bench 2.
27. JUL 2026
Digital Omnibus on AI in Kraft
Verordnung (EU) 2026/1744 verschiebt die Hochrisiko-Pflichten nach Anhang III auf Dezember 2027.
29. JUL 2026
KI-MIG in Kraft
Die Bundesnetzagentur wird zentrale Marktüberwachungsbehörde, mit Koordinierungszentrum KoKIVO und KI-Reallabor.
02. AUG 2026
EU AI Act: Transparenzpflichten anwendbar
Art. 50 gilt vollständig, das AI Office kann GPAI-Anbieter mit Bußgeldern belegen.
05 · Klassifikation

Typen von KI-Agenten — vier Sichtweisen.

KI-Agenten lassen sich nach mehreren Dimensionen klassifizieren. Für die praktische Orientierung ist die anwendungsorientierte Sicht besonders hilfreich — sie dockt direkt an die konkreten Tools im nächsten Abschnitt an.

TypWas er tutBeispiele
Conversational AgentsErweiterte Chatbots mit Tool-ZugriffChatGPT, Claude.ai, Gemini, Copilot Chat
Research AgentsRecherche, Quellensynthese, BerichteOpenAI/Gemini Deep Research, Perplexity, NotebookLM
Browser AgentsBedienen Webseiten wie ein MenschPerplexity Comet, Operator, Project Mariner, Skyvern
Office-Add-in-AgentsArbeiten direkt in Word/Excel/PPT als SidebarClaude für Office, ChatGPT für Excel, MS Agent Mode
Workspace-AgentsCloud-basiert, persistent, mit ConnectorsChatGPT Workspace Agents, Workspace Studio, Copilot Studio
Cowork / Desktop AgentsGreifen aufs lokale Dateisystem zuClaude Cowork, Microsoft Copilot Cowork
Computer-Use AgentsBedienen Desktop-Apps mit Maus/TastaturClaude Computer Use, Codex Computer Use (macOS + Windows)
Coding AgentsSchreiben, refaktorieren, debuggen CodeClaude Code, OpenAI Codex, Cursor, Devin
General Purpose AgentsBreit aufgestellt, multitasking-fähigManus AI, Paperclip AI, OpenClaw
Spezialisierte Rollen-AgentenEine konkrete GeschäftsrolleSintra Helpers, agents.ai-Marktplatz
Multi-Agent-PlattformenSteuern ganze AgententeamsPaperclip, CrewAI, LangGraph, Google ADK
StufeCharakteristikBeispielRisiko
1 — AssistivMensch initiiert jede AktionKlassisches ChatGPT, Copilot-VorschlägeSehr niedrig
2 — AufgabenagentMehrstufige Erledigung auf AnfrageChatGPT Apps, Claude Cowork, Gemini in DocsNiedrig
3 — Workflow-AgentEreignisgesteuert oder geplantChatGPT Workspace Agents, Workspace Studio SkillsMittel
4 — Persistenter AgentKontinuierlich, proaktivAgent 365 Security/Compliance, Gemini InboxHoch
5 — Multi-Agent-OrganisationHierarchien, Rollen, BudgetsPaperclip, „Zero-Human Companies"Sehr hoch

Für KMU-Einstieg ist Stufe 2 oder 3 der realistische Sweet Spot in 2026.

Bauen

Eigene Agenten erstellen

No-/Low-Code: Lindy.ai, Relevance AI, Microsoft Copilot Studio, ChatGPT Workspace Agent Builder, Google Workspace Studio.

Frameworks (Code): LangGraph, CrewAI, AutoGen, Pydantic AI, Google ADK.

Vorteil: Tiefe Integration, eigene Logik. Nachteil: Konfigurationsaufwand.

Mieten

Fertige Agenten beziehen

Marketplaces: Sintra.ai (Rollen-Helper), agents.ai (App Store), Sōkosumi (DE, EU-AI-Act-konform).

Partner-Agenten in Plattformen: Box, Workday, Salesforce, ServiceNow in Gemini Enterprise / Microsoft Copilot Marketplace.

Vorteil: Sofort einsatzfähig. Nachteil: weniger maßgeschneidert.

EinsatzortCharakteristikBeispiele
Inline-AgentsInnerhalb bestehender Anwendung als SidebarMS Agent Mode, Claude für Excel, Gemini in Sheets
Workspace-AgentsPersistente Cloud-Umgebung mit ConnectorsChatGPT Workspace Agents, Gemini Enterprise
Desktop-Agents (Cowork)Lokales DateisystemClaude Cowork, Microsoft Copilot Cowork
Computer-Use-AgentsBedienen den Desktop wie ein MenschClaude Computer Use, Codex CU (macOS + Windows)
Browser-AgentsBedienen WebseitenComet, Operator, Project Mariner
Hintergrund-AgentsEreignisgesteuert, ohne UIWorkspace Agent mit Slack-Trigger, Google Batch Agents
06 · Schlüsselkonzept

Die letzte Meile — und warum sie 2026 überbrückt wurde.

KI-Agenten sind nur so mächtig wie die Werkzeuge, die sie bedienen können. Bisheriger Standardweg: APIs. Aber viele wichtige Geschäfts-Anwendungen haben keine — und genau hier setzt Computer Use an.

Problem

Keine API, keine Automatisierung?

  • Branchen-CRMs, alte ERP-Systeme, lokale Buchhaltungs-Software — vieles hat keine API.
  • Andere Anwendungen haben theoretisch eine, aber zu eng oder zu kompliziert.
  • Gerade im Mittelstand hängt vieles weiterhin an Maus und Tastatur.
Lösung

Computer Use — Bedienen wie ein Mensch

  • Sieht den Bildschirm (Screenshot oder Accessibility-Tree).
  • Denkt nach, was als Nächstes zu tun ist.
  • Handelt mit Maus und Tastatur.
  • Beobachtet das Ergebnis und reagiert.

Stand August 2026: Wo Computer Use aktiv ist

AnbieterFunktionStatusVerfügbarkeit
Anthropic ClaudeComputer Use API (Beta); zusätzlich direkte Bildschirmsteuerung in Cowork und Claude Code in der Claude-Desktop-AppAPI seit Okt 2024 · Desktop-Steuerung als Research Preview seit März/April 2026macOS und Windows · Pro und Max (nicht Team/Enterprise) · keine EU-Sperre
OpenAI CodexComputer Use auf macOS und Windows, mehrere Agenten parallelGA seit 16. Apr 2026 · Windows seit 29. Mai 2026 · EWR/UK/CH seit 17. Jun 2026auch in EWR / UK / Schweiz · Memories dort Opt-in, Chrome-DevTools-Protokoll gesperrt
Microsoft CopilotAgent Mode — App-natives Agieren in OfficeGA seit 22. Apr 2026Word, Excel, PowerPoint · Outlook nur Frontier, nicht EU
Google GeminiComputer Use Tool in der Gemini API — Project Mariner wurde im Mai 2026 eingestelltPublic Preview seit 24. Jun 202683,0 % OSWorld-Verified mit Gemini 3.6 Flash

Drei Konsequenzen für Business

— Konsequenz 01

APIs werden weniger wichtig.

Wo früher galt „diese App hat keine API, also keine Automatisierung“, lautet die Antwort Stand August 2026 oft: „Dann nehmen wir Computer Use.“

— Konsequenz 02

Legacy-Systeme bekommen ein zweites Leben.

Alte ERP-, CRM- und Branchen-Systeme, deren Ablösung sich nie gelohnt hat, lassen sich plötzlich von Agenten bedienen.

— Konsequenz 03

Aus „API-fähig?" wird „UI-stabil?".

Ein Agent, der eine UI bedient, scheitert an häufig wechselnden Layouts. Statt APIs zu bauen, optimiert man UIs für Agent-Bedienung.

Kernaussage

„Die letzten zwölf Monate haben einen oft übersehenen, aber entscheidenden Sprung gebracht: Agenten können nicht nur das tun, was Programmierer:innen ihnen über APIs zugänglich machen — sie können zunehmend das tun, was ein Mensch am Computer tun könnte. Das ist die Brücke vom Chatbot zum digitalen Fachexperten mit Werkzeugzugriff."

07 · State of the Art

Konkrete Tools — der Markt im August 2026.

Nicht erschöpfend, aber repräsentativ: acht Anbieter- und Plattformwelten plus eine kompakte Vergleichsmatrix. Jedes Tool ist mit Klick auf + aufklappbar — Stärken, Grenzen, Ausprobierbeispiele.

ChatGPT-Familie · OpenAI
Stack aus 5 Bausteinen
ChatGPT Work
Nachfolger des Agentenmodus (eingestellt am 09.07.2026). Arbeitet über Apps und Dateien hinweg, bleibt stundenlang an einem Projekt und liefert fertige Ergebnisse. Plan-Modus zur Bestätigung vor der Ausführung.
GAPlus 20 $/Mo · Pro 200 $/Mo
+
Stärken
  • Niedrige Einstiegshürde im gewohnten ChatGPT-Frontend
  • Eigene virtuelle Computer-Umgebung mit Browser, Terminal, Datei-Tools
Grenzen
  • Episodisch — jede Aufgabe ist eigenständig
  • Nicht ohne Weiteres mit Triggern automatisierbar
Ausprobierbeispiel„Recherchiere die letzten drei Quartalszahlen von [Branche] und erstelle daraus eine zweiseitige Zusammenfassung als PDF."
ChatGPT Plugin Directory
Seit Juli 2026 neuer Name für das App Directory. Über 1.400 Plugins — Drive, Gmail, SharePoint, Slack, Salesforce, Notion. Seit Juni 2026 auch schreibende Aktionen, jeweils mit Bestätigung pro Vorgang.
GAIm Plan enthalten
+
Stärken
  • Großer Connector-Katalog
  • Admin-Kontrolle über Berechtigungen, Read-only/Read-Write
  • App Directory seit Frühjahr 2026
Grenzen
  • In Enterprise standardmäßig deaktiviert — verzögert Adoption
  • Re-Auth nötig nach Permission-Änderungen
ChatGPT Workspace Agents
Codex-betriebene, cloud-basierte Team-Agenten mit Triggern, Memory, Skills. Nachfolger der Custom GPTs.
NEU 22.04.2026Business 25 $/User/Mo + Credits
+
Stärken
  • Bauen ohne Code — Workflow in natürlicher Sprache
  • Teilbar im Workspace (ein Agent für das Team)
  • Trigger: manuell, geplant, ereignis-basiert
  • Läuft in der Cloud und ist damit unabhängig vom lokalen Rechner
Grenzen
  • Nur Business / Enterprise / Edu / Teachers
  • Integriert in Abos nach Ende der kostenlosen Preview
  • Fortentwicklung von Custom GPTs
AusprobierbeispielEinen Workspace Agent bauen, der zu jeder Kalendereinladung automatisch ein zweiseitiges Briefing erstellt.
ChatGPT-Add-ins für Office
Native Sidebar in Excel, PowerPoint und Google Sheets, betrieben mit GPT-5.6. PowerPoint ist seit dem 06.07.2026 allgemein verfügbar. Ein Word-Add-in von OpenAI gibt es weiterhin nicht.
BetaUSA/CA/AU initialPlus / Pro / Business / Enterprise
+
Stärken
  • Beidseitig: Microsoft 365 und Google Workspace
  • GPT-5.4 erreicht 87,3 % auf OpenAI Investment-Banking-Benchmark
  • Direkte Anbindung an FactSet, Dow Jones, LSEG, Daloopa, S&P
Grenzen
  • Getrennt vom ChatGPT-Hauptkonto — kein gemeinsames Memory
  • Office Scripts, Power Query, VBA-Makros nicht voll unterstützt
Codex Computer Use
Codex bedient Anwendungen mit eigenem Cursor, mehrere Agenten parallel. Seit dem 29.05.2026 auch unter Windows — dort im Vordergrund. Seit dem 17.06.2026 auch in EWR, UK und der Schweiz freigeschaltet.
NEU 16.04.2026EU seit 17.06.2026macOS · Windows · ChatGPT Plus+
+
Stärken
  • Schließt die „letzte Meile" zu API-losen Anwendungen
  • macOS im Hintergrund — Nutzer kann parallel weiterarbeiten
  • Eingebauter Atlas-basierter Browser, dazu Codex-Chrome-Erweiterung
  • In DACH nutzbar — Einrichtung in der ChatGPT-App unter Einstellungen › Computernutzung
Grenzen
  • Unter Windows übernimmt der Agent den Vordergrund — kein paralleles Weiterarbeiten
  • In EWR/UK/CH: Memories nur per Opt-in, Chrome-DevTools-Protokoll gesperrt
  • Performance & Permission-Management noch reifend
Ausprobierbeispiel (mit Vorsicht)Eine API-lose Desktop-App in einer isolierten Testumgebung bedienen — etwa alte Branchen-Software oder eine Figma-Iteration.
Perplexity
KI-Suche → Browser-Stack
Perplexity Comet
KI-nativer Browser mit Agenten-Seitenleiste. Sammelt Infos über Tabs, vergleicht Preise, füllt Formulare.
GA~20 $/Mo
+
Stärken
  • Starke Recherche-Performance
  • Intuitive Bedienung
  • Günstig im Vergleich zu Enterprise-Lösungen
Grenzen
  • Eher individuell als organisationsweit
  • Kein zentrales Admin-Management
Perplexity Computer
„Software Stack Operator“ mit Multi-Modell-Synthese. Zugang über das Max-Abonnement (200 USD/Monat). Neu als Research Preview: „Brain“, ein selbstlernendes Projektgedächtnis.
GA seit März 2026Pro / Enterprise
+
Stärken
  • Sehr hohe Output-Qualität durch Modell-Synthese
  • Ambitionierte Sub-Agent-Architektur
Grenzen
  • Höherer Preis und Zusatzberechnung mit Credits
  • Eher für anspruchsvolle Wissensarbeit als Standard-Office-Workflows
OS
Selbst gehostete Agenten
OpenClaw · Hermes Agent — Open Source, volle Datenhoheit, volle Verantwortung
OpenClaw
Open-Source-Agent, selbst gehostet, über Skills erweiterbar. Seit dem 08.07.2026 in einer gemeinnützigen Stiftung (Sponsoren: OpenAI, GitHub, NVIDIA). Im Mai 2026 wurden vier Schwachstellen bekannt (CVSS bis 9,6), alle behoben.
Hype 2026Open SourceHoher Schutzbedarf
+
Warum relevant?
  • Zeigt die Zugkraft selbst gehosteter, stark erweiterbarer Agenten
  • Community-Skills machen neue Fähigkeiten sehr schnell verfügbar
  • Bringt Agenten aus dem Chatfenster in dauerhafte Hintergrundprozesse
Grenzen & Risiken
  • Breite Rechte auf Dateien, Accounts, Browser und Netzwerk erhöhen die Angriffsfläche
  • Skills/Plug-ins und offene Gateways brauchen harte Prüfung
  • Nicht auf Produktivgeräten oder mit echten Konten ausprobieren
AusprobierbeispielNur isoliert: in einer Wegwerf-VM einen agentischen Browser-Workflow testen, ohne reale Logins, Produktivdaten oder Schreibrechte.
Hermes Agent
Open-Source-Agent von Nous Research, seit Februar 2026 unter MIT-Lizenz. Läuft auf eigener Hardware (Linux, macOS, WSL2), merkt sich Kontext über Sitzungen hinweg und schreibt aus gelösten Aufgaben selbst neue Skills. Bedienung über Messenger statt Chatfenster.
Seit Feb 2026Open Source · MITSelbst gehostetHoher Schutzbedarf
+
Warum relevant?
  • Lernschleife statt Konfiguration — der Agent legt eigene Skills an und verbessert sie im Betrieb
  • Persistentes Gedächtnis über Sitzungen hinweg
  • Erreichbar über Telegram, Discord, Slack, WhatsApp und Signal — der Agent sitzt dort, wo ohnehin kommuniziert wird
  • Cron-Zeitplanung, parallele Sub-Agenten, Browser-Automatisierung, MCP-Anbindung
  • Modellwahl frei: Nous Portal, OpenRouter, eigene OpenAI-kompatible Endpunkte oder lokales vLLM — damit auch vollständig on-premise betreibbar
Grenzen & Risiken
  • Gleiche Angriffsfläche wie OpenClaw: breite Rechte auf Dateien, Konten und Netzwerk
  • Gedächtnis eng begrenzt und erst in der nächsten Sitzung wirksam
  • Braucht Modelle mit mindestens 64K Kontext — kleine lokale Modelle fallen aus
  • Selbst geschriebene Skills sind selbst geschriebener, ungeprüfter Code
  • Kein Support, keine Auftragsverarbeitung, keine Zertifizierung — Betrieb und Haftung liegen vollständig im Haus
AusprobierbeispielNur isoliert: in einer abgeschotteten VM einen wiederkehrenden Report per Cron erzeugen lassen — ohne Produktivkonten, ohne Schreibrechte auf Fachsysteme.
Einordnung

OpenClaw und Hermes Agent lösen dieselbe Aufgabe unterschiedlich: OpenClaw setzt auf Kanalvielfalt und eine Plugin-Architektur, Hermes auf die Lernschleife aus Gedächtnis und selbst erzeugten Skills. Für Unternehmen sind beide vorerst Lern- und Testobjekte, keine Produktivwerkzeuge.

A
Claude · Anthropic
Cowork + Office Add-ins + Computer Use
Claude Cowork
Desktop-Agent mit Zugriff auf das lokale Dateisystem — seit dem 07.07.2026 auch als Web- und Mobilversion. Über 90 % der Nutzung entfällt nach Anbieterangabe auf Nicht-Coding-Arbeit.
GA seit April 2026Pro 20 $/Mo
+
Stärken
  • Echte Datei-Aktion — liefert das fertige Excel, nicht die Anleitung
  • Computer Use eingebaut
  • Connectors zu Drive, Gmail, DocuSign, FactSet
  • Sub-Agenten für Batch-Verarbeitung
  • Dispatch — Aufgaben per Text/Stimme vom Smartphone
  • 1 Mio. Token Kontext (Opus 4.6/4.7)
Grenzen
  • Stärker für Einzelpersonen als Team-Orchestrierung
  • Lokaler Datenfluss erschwert Governance in regulierten Branchen
AusprobierbeispielClaude Cowork aus einem Markdown-Briefing ein strukturiertes Management-Briefing oder ein Word-Dokument erstellen lassen.
Claude Chrome Extension
Browser-Extension, die Workflows aufzeichnen, wiederholen und über mehrere Tabs orchestrieren kann.
Beta/GAPro / Max
+
Stärken
  • „Workflow-Memo" — einmal vormachen, beliebig wiederholen
  • Konsolen-Errors für Debugging auslesbar
Grenzen
  • Beta-Status zu Beginn 2026
  • Sicherheitsfreigaben in Unternehmen oft langwierig
Claude Computer Use
Gestartet als API-Fähigkeit für Maus, Tastatur und Bildschirm (weiterhin Beta). Seit Frühjahr 2026 zusätzlich als Research Preview direkt in der Claude-Desktop-App: Claude darf in Cowork und Claude Code den Bildschirm sehen und Apps bedienen.
Research PreviewmacOS · WindowsPro & Max · nicht Team/EnterpriseIn der EU nutzbar
+
Stärken
  • Pionier bei Computer Use und Bildschirmsteuerung
  • Klare Eskalationslogik: erst Connector (Gmail, Slack …), dann Chrome, erst zuletzt Maus und Tastatur
  • Kombiniert Connectors, lokale Dateien und direkte App-Bedienung
  • In Sandboxes ausführbar · API-Beta mit Opus 4.5+ und Sonnet 4.6+
Grenzen
  • Research Preview — nur Pro und Max, nicht in Team und Enterprise
  • Keine Sandbox zwischen Claude und den Anwendungen; Schutzmechanismen ausdrücklich unfertig
  • Governance hängt stark von Berechtigungen und Freigabeprozessen ab
Claude für Office (Excel · PowerPoint · Word · Outlook)
Native Office-Add-ins mit Shared Context. Excel, PowerPoint und Word allgemein verfügbar, Outlook weiterhin Beta. Seit dem 07.07.2026 hat der Microsoft-365-Connector Schreibrechte.
NEU 2026Pro 20 $/Mo (Excel) · Max+ (PPT)
+
Stärken
  • Shared Context zwischen Apps — Modell aus Excel kann an PowerPoint übergeben werden
  • 6 Skills für Financial Services (DCF, Comparable, Due Diligence)
  • Cell-level Citations
  • Auch direkt im Microsoft Copilot Agent Mode wählbar
Grenzen
  • Auf Pro/Max/Team/Enterprise beschränkt
  • Kein Audit-Logging in Free/Pro/Team-Plänen
  • Prompt-Injection-Risiko bei fremden Templates
AusprobierbeispielMulti-Tab-Excel mit 3-Statement-Modell laden. Claude bitten, das Modell zu erklären, eine Sensitivitätsanalyse zu bauen und das Ganze als Briefing zu paraphrasieren.
M
Manus AI
Geopolitisches Lehrstück
Manus AI
Erster viraler „General Purpose“-Agent. Meta trennt sich seit Juni 2026 operativ; ein Konsortium unter Führung von Tencent verhandelt den Rückkauf. Produktseitig weiter aktiv (Plan Mode seit 22.07.2026).
Geopolitisch volatil~20 $/Mo
+
Stärken
  • Sehr starke Demo-Performance, virale Bekanntheit
  • Breites Aufgabenspektrum
  • Eigene Browser-Operator-Funktion und Dokument-Generierung
Grenzen
  • Politisch volatil (Meta-Übernahme Dez 25, China-Block Apr 26)
  • Weniger Office-Integration als Microsoft/Google
  • In DACH/EU kein zentraler Anbieter
EinordnungDer Manus-Fall ist ein starkes geopolitisches Lehrstück: agentische KI ist ein strategisches Asset. Daraus folgt die Frage, worauf europäische KMUs setzen sollten.
Microsoft 365 Copilot
Multi-Modell-Strategie
Copilot Cowork
In Kooperation mit Anthropic entwickelt. Weltweit verfügbar seit dem 16.06.2026, standardmäßig deaktiviert, Abrechnung über Copilot Credits (0,01 USD). Modelle: Claude Opus 4.8 und Sonnet 4.6, GPT-5.5.
GAM365 Copilot 30 $/Mo
+
Stärken
  • Tiefe Office-365-Integration (Work IQ, SharePoint, Teams, Outlook)
  • Enterprise-Governance ab Werk
  • Multi-Modell-Power — Anthropic, OpenAI und MS in einem Tool
Grenzen
  • Lizenzkomplexität (Copilot, M365 E7, Agent 365)
  • Claude LLMs laufen auf AWS und nicht in der Microsoft Cloud-Umgebung des Unternehmens
Copilot Agent Mode in Office
„Vibe Working" — Copilot arbeitet direkt im Dokument, plant mehrstufig, ändert iterativ. Modell-Switcher inkl. Claude.
GA 22.04.2026Word · Excel · PowerPoint
+
Stärken
  • 30-Tage-Preview Excel: +67 % Engagement, +50 % Retention
  • Modell-Switcher: Claude statt OpenAI wählbar (Sub-Processor-Freigabe)
  • Transparente Plan-and-Execute-UX
Grenzen
  • Outlook, Teams, OneNote noch in Vorbereitung
  • Cross-App erst über Copilot Workflows Agent + Agent 365
AusprobierbeispielExcel mit Verkaufszahlen öffnen: „Bau mir ein Pivot mit Umsatz pro Region und Quartal, ein Diagramm und drei Insights als Kommentar."
Word · Excel · PowerPoint Agents in Copilot Chat
Komplementär zum Inline-Modus: aus dem Chat heraus komplette Office-Artefakte erstellen lassen.
GA
+
Stärken
  • „Headless Office"-Generierung — voll Office-kompatibel
  • Kombination Chat-First-Erstellung + App-First-Bearbeitung
Grenzen
  • Aktuell weniger interaktiv als der Inline-Modus
Agent 365
Verwaltungs- und Governance-Plattform für Agenten: Inventar, RBAC, Audit, Sicherheitsrichtlinien, eigene Agentenidentität in Entra. Enthalten in Microsoft 365 E7 (99 USD/Nutzer/Monat).
August 2026M365 E7 · 99 $/User/Mo
+

Erwähnenswert als Hinweis darauf, dass Governance 2026 zum Erstklass-Feature wird — nicht mehr nur die Agenten selbst zählen, sondern auch ihre Aufsicht.

G
Google-Ökosystem
Vollintegrierter Stack — Cloud Next 2026
Gemini Enterprise
Die neue Klammer (vorher Agentspace). Zwischen Juni und August 2026 wurden Skills, Workflow Agents, Agent Observability und Agent Registry Governance allgemein verfügbar; seit dem 01.08.2026 gibt es eine Pay-as-you-go-Edition.
Cloud Next 2026Standard / Plus
+
Stärken
  • Inbox in Gemini Enterprise — zentrale Verwaltung aller Agenten
  • Projects: geteilte Arbeitsräume mit persistentem Kontext
  • Canvas mit Microsoft-365-Interoperabilität
  • Connectors zu MS 365, Workspace, OneDrive, SharePoint, HubSpot, Jira
Wachstum
  • 40 % Quartalswachstum bei zahlenden MAUs in Q1 2026
Gemini in Google Workspace
Agentische Erweiterung von Gmail, Docs, Sheets, Slides, Meet, Chat. Workspace Intelligence als semantische Schicht.
GAIn Workspace-Lizenz
+
Stärken
  • Workspace Intelligence — semantische Schicht analog MS Work IQ
  • Skills für agentische Automatisierung in allen Workspace-Apps
  • Gemini in Sheets löst Optimierungsprobleme nativ
  • Avatars in Google Vids für Markenvideos
Grenzen
  • Sichtbar weniger Marktanteil in DACH als Microsoft
Workspace Studio
Googles No-Code-Builder für Workspace-Agenten — seit Mai 2026 auch auf Deutsch. Allgemein verfügbar bereits seit Dezember 2025, vollständig ausgerollt im März 2026.
GA seit April 2026Workspace Business+
+
Stärken
  • Pendant zu ChatGPT Workspace Agents & Copilot Studio
  • Verbindungen zu Salesforce, Asana, Jira, Mailchimp
  • Apps Script + Webhooks für Power-User
  • Oft in Workspace-Lizenz enthalten
Einordnung
  • Googles Demokratisierungs-Antwort — Bauen ohne Code im vertrauten Werkzeug
Gemini Computer Use
Project Mariner wurde im Mai 2026 eingestellt. Die Technik lebt im Computer-Use-Werkzeug der Gemini API weiter (Public Preview seit 24.06.2026) — 83,0 % auf OSWorld-Verified mit Gemini 3.6 Flash.
Roll-out 2026AI Ultra · Workspace Enterprise
+
Stärken
  • Höchste dokumentierte Browser-Agent-Performance
  • Teach & Repeat: einmal vormachen, dann wiederholen
  • Multi-Step-Reasoning auf Webseiten
  • 10 parallele Browser-Tasks in Cloud-VMs
Roadmap
  • Mariner Studio (Q2 2026) — visueller Builder
  • Cross-Device-Sync (Q3 2026)
  • Agent Marketplace (Q4 2026)
Gemini Enterprise Agent Platform
Entwickler-Schicht mit über 200 Modellen inklusive Claude, ADK 2.0 und A2A-Protokoll v1.0. Seit dem 29.07.2026 zusätzlich Agent Runtime (bis zu sieben Tage Laufzeit), Agent Memory Bank, Agent Identity und Agent Gateway.
Konsolidiert 2026Developer / Enterprise
+
Highlights
  • Model Garden: Gemini, Gemma, Anthropic Claude, Llama
  • Agent Designer (visueller Flow-Builder)
  • ADK mit Sub-Agent-Orchestrierung
  • A2A-Protokoll v1.0 in Produktion bei 150+ Organisationen
Partner-Agenten
  • Box, Workday, Salesforce, ServiceNow
  • Dun & Bradstreet, S&P Global
  • Voller Lifecycle: Identity, Registry, Observability, Simulation
Gemini Notebook & Deep Research
NotebookLM heißt seit dem 16.07.2026 Gemini Notebook — über 30 Mio. Nutzer und mehr als 600.000 Organisationen. Audio-Overviews, Multi-Source-Analyse, anpassbare Recherche-Pläne.
GA
+

Sehr beliebt bei Wissenschaftler:innen, Berater:innen, Studierenden. Mit AI Ultra werden Limits massiv erhöht. Konkurriert direkt mit OpenAI Deep Research und Perplexity.

Kernaussage zu Google

„Microsoft hat den größten Office-Marktanteil. OpenAI hat das bekannteste Produkt. Google hat den am tiefsten integrierten Stack — vom Chip (Ironwood TPU) über das Modell (Gemini 3) und die Plattform (Agent Platform) bis zur Anwendung (Workspace mit Gmail, Docs)."

Paperclip
Multi-Agent-Orchestrierung
Paperclip AI
Open-Source-Plattform für ganze Agenten-„Organisationen“. Bleibt ein Denkmodell: Zu Nutzung und Finanzierung gibt es keine belastbaren Primärquellen.
ResearchOpen Source
+
Stärken
  • Zeigt, wohin die Reise gehen könnte
  • Konzept der „Zero-Human Companies" konkret
Grenzen
  • Stand August 2026 mehr Forschungsobjekt als Produkt
  • Sicherheit, Governance, Realitätstest noch ausstehend
  • Für klassische KMUs nicht sinnvoll
EinordnungPaperclip macht den Sprung von Stufe 3 (Agents) zu Stufe 5 (Organizations) der OpenAI-AGI-Stufen greifbar.

Tool-Übersichtsmatrix · filterbar

Filter nach Anbieter oder Reife:

ToolStärkeEinsatzformPreis (Ø)Reife
ChatGPT WorkAus einem Ziel fertige ErgebnisseChat / Work / Codexim Plan, verbrauchsbasiertGA seit 09.07.2026
ChatGPT Plugin Directory1.400+ Plugins, auch schreibendConnector-SchichtIm PlanGA
ChatGPT Workspace AgentsTrigger & TeamworkTeam-Workflow25 $/Mo + CreditsGA
ChatGPT für Excel/PPT/SheetsGPT-5.6 in der SidebarOffice-Add-inim Plan + CreditsGA · PowerPoint seit 06.07.
Codex Computer UseAnwendungen ohne APIDesktop-SteuerungPlus+GA macOS + Windows · EWR/UK/CH seit 17.06.2026
Perplexity CometBrowser-RechercheAgentischer Browser~20 $/MoGA
Perplexity ComputerMulti-Modell-TasksResearch-WorkspacePro / EnterpriseGA
OpenClawSelf-hosted AgentExperiment / SandboxOpen SourceHype · riskant
Hermes AgentSelbstlernend · eigene Skills · Messenger-BedienungSelf-hosted / SandboxOpen Source · MITReif genug zum Testen · riskant im Betrieb
Claude CoworkLokale Datei + CUDesktop, Web, MobilePro 20 $/MoGA · Web/Mobile seit 07.07.
Claude Chrome ExtensionBrowser-WorkflowsBrowser-ErweiterungPro / MaxGA in Cowork/Code · Extension Beta
Claude für Excel/PPT/WordOffice-Sidebar mit ReasoningOffice-Add-in20 $ / Max+GA · Outlook Beta
Claude Computer UsemacOS + Windows · 82,3 % OSWorldAPI-Beta / Desktop-AppAPI · Pro & MaxResearch Preview · in der EU nutzbar
Manus AIGeneral Purpose PowerGeneral-Purpose-Agent~20 $/MoGA · volatil
Microsoft Copilot CoworkOffice-Tiefenintegration + Multi-ModellM365-Cowork30 $/Mo + CreditsGA weltweit seit 16.06.2026
Copilot Agent ModeInline-Office-BearbeitungOffice-Modus30 $/User/MoGA seit 22.04.
Gemini in WorkspaceInline in Google-OfficeWorkspace-inlineIn Workspace-LizenzGA
Workspace StudioNo-Code Citizen-BuilderNo-Code-BuilderWorkspace Business+GA seit Dez. 2025 · deutschsprachig
Gemini Computer Use83,0 % OSWorld-VerifiedGemini APInach VerbrauchPublic Preview · Mariner eingestellt
Gemini EnterpriseAgenten-Verwaltung & HubEnterprise-HubStandard / PlusGA
PaperclipMulti-Agent-OrchestrierungForschungsplattformOpen SourceResearch · dünne Quellenlage

Preise Stand August 2026; sie können sich kurzfristig ändern. Für operative Entscheidungen bitte gegen die Anbieter-Webseiten prüfen.

08 · Plattformen

Bauen oder mieten?

Nicht jedes Unternehmen muss selbst Agenten bauen. Die Plattform-Landschaft 2026 lässt sich praktisch in drei Grundentscheidungen ordnen: selbst bauen, fertige Agenten beziehen — oder das erweitern, was ohnehin schon lizenziert ist. Darunter liegen sechs Ausprägungen: No-/Low-Code, Frameworks, selbst gehostete Open-Source-Agenten, Marktplätze, Partner-Agenten und die Erweiterungsschicht aus Skills, Connectors und Plugins.

Bauen — eigene Agenten

Plattformen zum Selbstbauen

No-/Low-Code

  • Lindy.ai — persönliche Stabschef-Agenten, 5.000+ Integrationen
  • Relevance AI — KI-Mitarbeiter für Vertrieb/Marketing/Support
  • Microsoft Copilot Studio — für M365-Kunden
  • ChatGPT Workspace Agent Builder — direkt im ChatGPT-Ökosystem
  • Google Workspace Studio — für Workspace-Kunden
  • Anthropic Claude Managed Agents — API-getrieben, mit Sandbox

Frameworks (Code)

  • LangGraph, CrewAI, AutoGen, Pydantic AI, Google ADK

Selbst gehostet (Open Source)

  • Hermes Agent — Nous Research, MIT; persistentes Gedächtnis, schreibt eigene Skills, Modell frei wählbar bis hin zu lokalem vLLM
  • OpenClaw — Stiftungsgetragen, große Skill-Community
  • Beide: volle Datenhoheit, volle Betriebs- und Sicherheitsverantwortung
Mieten — fertige Agenten

Plattformen zum Beziehen

Marketplaces

  • Sintra.ai — vorkonfigurierte Helper (Milli/Penn/Buddy/Cassie)
  • agents.ai — App-Store-artiger Marktplatz
  • Sōkosumi — DE/Serviceplan; EU-AI-Act-konform; Pay-per-Use

Partner-Agenten in Plattformen

  • Gemini Enterprise: Box, Workday, Salesforce, ServiceNow, S&P, Dun & Bradstreet
  • Microsoft Agent 365: über Copilot Marketplace

Die dritte Option: erweitern statt bauen oder mieten

Bevor eine neue Plattform ins Haus kommt, lohnt der Blick auf die Lizenzen, die schon da sind. ChatGPT und Claude haben 2026 beide eine Erweiterungsschicht bekommen, mit der sich vorhandene Abos ohne Plattformwechsel deutlich weiter tragen lassen. Die Bausteine heißen bei beiden Anbietern fast gleich — und meinen auch fast dasselbe.

BausteinWas er leistetOpenAI — ChatGPT Work & CodexAnthropic — Claude, Cowork & Code
SkillsEine wiederverwendbare Arbeitsanweisung: Vorgehen, Vorlagen, Prüfschritte, Tonfall. Kein Code — Klartext.Skills, im Chat per @, in Codex per $ aufgerufen; im Arbeitsbereich mit Kolleg:innen teilbarAgent Skills als SKILL.md (YAML + Markdown); werden automatisch erkannt und nur bei Bedarf geladen
Connectors / AppsZugang zu externen Systemen und Daten, per OAuth und mit abgestuften Rechten.Connectors auf MCP-Basis, dazu eigene Oberflächen-Bausteine direkt im ChatConnectors auf MCP-Basis (Drive, Gmail, Slack, Microsoft 365, Figma …), teils mit interaktiver Oberfläche im Chat
PluginsInstallierbares Bündel aus Skills, Connectors, MCP-Servern, Hooks und Aufgaben-Vorlagen — ein Klick statt Einzelteile.Gemeinsames Plugin Directory für ChatGPT Work und Codex; ersetzt das frühere App-Verzeichnis. Nicht in Chat, IDE-Erweiterung oder MobilePlugins nach dem Marketplace-Standard aus Claude Code (.claude-plugin/), heute auch in Cowork nutzbar
GovernanceWer darf was installieren — und was läuft dabei mit?Workspace-Admins steuern Installation und Vorgaben; Verfügbarkeit hängt zusätzlich an Tarif, Oberfläche und RegionSkills auf allen Tarifen (Codeausführung muss aktiv sein); eigene Organisations-Marktplätze erfordern Team oder Enterprise
— Merksatz

Skill = Wissen. Connector = Zugang. Plugin = Bündel aus beidem.

Wer eine immer gleiche Arbeitsweise hat, braucht einen Skill. Wer an ein Fachsystem heranmuss, braucht einen Connector. Wer beides zusammen und fertig verpackt will, nimmt ein Plugin. Der teuerste Weg ist, für eine dieser drei Aufgaben einen eigenen Agenten zu bauen.

— Standardisierung

Zwei offene Standards, ein gemeinsamer Unterbau

MCP ist bei beiden Anbietern die technische Grundlage der Connectors. Anthropic hat zusätzlich Agent Skills am 18.12.2025 als offene Spezifikation veröffentlicht; Partner wie Atlassian, Canva, Cloudflare, Figma, Notion, Ramp und Sentry liefern eigene Skills aus. Für Unternehmen heißt das: Einmal geschriebene Arbeitsanweisungen sind nicht zwingend an einen Anbieter gebunden.

— Warnung

Hooks sind ausführbarer Code

Plugins können Hooks enthalten — Befehle, die an festgelegten Punkten automatisch laufen. Sie sind der nützlichste und zugleich gefährlichste Teil der Erweiterungsschicht. Vor der Freigabe gehört jedes Plugin auf dieselbe Prüfliste wie eine Software-Installation: Herkunft, Rechte, Hooks, Datenabfluss.

Entscheidungsleitfaden

ProfilEmpfehlung
Vorhandene ChatGPT- oder Claude-Lizenz besser ausnutzen, ohne neue PlattformErweitern statt bauen: Skills, Connectors und Plugins in ChatGPT Work/Codex bzw. Claude/Cowork/Code. Erste Station vor jeder Beschaffung.
Immer dieselbe Arbeitsweise (Vorlage, Tonfall, Prüfschritte) in vielen AufgabenSkill schreiben — ChatGPT-Skill oder SKILL.md. Klartext, kein Code, kein Agentenbau.
Agent soll auf Fachsysteme zugreifen (CRM, Ticketsystem, Drive, Postfach)Erst fertigen Connector auf MCP-Basis prüfen, dann eigenen MCP-Server, erst zuletzt Eigenbau
Ein Fachbereich soll ein fertiges Paket bekommen (Vertrieb, Analytics, Code-Review)Plugin aus dem Verzeichnis — bündelt Skills und Connectors. Vor Freigabe Hooks und Rechte prüfen.
Standardaufgaben loswerden, ohne KonfigurationMieten: Sintra.ai oder Sōkosumi
Spezifische, wiederkehrende Team-WorkflowsBauen mit Low-Code: Lindy, ChatGPT Workspace Agents, Workspace Studio
Tiefe Integration mit eigenen GeschäftsprozessenBauen mit Plattform: Relevance AI, Copilot Studio, Gemini Agent Platform
Microsoft-365-Haus mit ComplianceMicrosoft Copilot Stack (Cowork, Agent Mode, Studio, Agent 365)
Google-Workspace-HausGemini Enterprise + Workspace Studio (oft in Lizenz)
Engineering-Team mit voller KontrolleFrameworks: LangGraph, CrewAI, Pydantic AI, Google ADK
Regulierte Branche / EU-AI-Act-relevantSōkosumi, Microsoft mit EU Data Boundary, Google Cloud/Workspace mit EU-Datenresidenz bzw. Assured-Workloads-Kontrollen, oder selbst gehostet
Volle Datenhoheit, eigene Hardware, keine Anbieter-CloudSelbst gehostet: Hermes Agent (MIT, Nous Research) oder OpenClaw — mit lokalem Modell betreibbar, aber nur mit hartem Sandboxing, ohne Produktivkonten und mit eigener Betriebsverantwortung
09 · Anwendungen

Wo Agenten Stand August 2026 Stunden sparen.

Use Cases nach Geschäftsfunktion, geordnet nach Reife — von oben nach unten absteigend. Jeder Block trägt seinen Reifegrad im Kopf. Klick auf eine Funktion zeigt konkrete Anwendungen ohne Festlegung auf einzelne Tools.

Reife heißt hier: Wie belastbar sind Werkzeuge, Praxisberichte und Governance für dieses Feld? Sehr hoch — vielfach im Produktivbetrieb, ausgereifte Werkzeuge. Hoch — tragfähig, aber mit Nacharbeit und klarer Aufsicht. Mittel — funktioniert technisch, wird durch Regulierung oder Datenlage gebremst. Der Reifegrad sagt nichts über den Nutzen im eigenen Haus: Ein mittelreifer Use Case kann bei Ihnen mehr sparen als ein sehr reifer.

  • Coding-Assistenz — Features, Tests, Pull Requests und Refactorings unterstützen.
  • Computer-Use für Frontend-Tests — UI-Iteration ohne API oder spezielle Test-Schnittstelle.
  • Code-Review — automatisierte Reviews.
  • Bug-Triage — Klassifizieren, Reproduktions­schritte vorschlagen.
  • Infra-as-Code — Terraform/K8s aus Anforderungen.
  • Security — Schwachstellenanalyse, Review-Hinweise und Policy-Prüfung vorbereiten.
  • Lead-Qualifizierung & -Anreicherung — automatisch mit Web-Daten anreichern, Score, CRM-Eintrag.
  • Outbound-Sequenzen — personalisierte Akquise-E-Mails, A/B-Tests.
  • Account Briefing — vor jedem Termin automatisch Mappe mit Hintergrund, News und Interaktionen.
  • Content-Produktion — Posts, Newsletter und Entwürfe im Markenton.
  • Wettbewerbs­beobachtung — regelmäßige Reports zu Marktbewegungen und Wettbewerbern.
  • Ticket-Triage — klassifizieren, priorisieren, routen.
  • Selbstbedienung Stufe 2 — einfache Anfragen direkt auflösen.
  • Wissensbasis-Pflege — aus FAQ-Tickets neue Artikel-Vorschläge ableiten.
  • Sentiment-Analyse — regelmäßige Stimmungsberichte aus Kundenkontakten.
  • Multi-Agent-Bearbeitung — mehrere spezialisierte Agenten übernehmen Analyse, Antwortvorschlag und Qualitätssicherung.
  • Berichts-Erstellung — Wochen-, Monats- oder Quartalsberichte aus mehreren Quellen.
  • Spesen-Verarbeitung — aus Beleg-Fotos eine fertige Abrechnung vorbereiten.
  • Meeting-Nachbereitung — Protokolle, To-Dos und Follow-ups aus Aufnahmen.
  • Vertrags-Reviews — kritische Klauseln markieren und mit Vorlagen vergleichen.
  • Inbox-Triage — priorisieren, Antwortentwürfe vorbereiten, Newsletter zusammenfassen.
  • Rechnungsprüfung — automatischer Vergleich mit Bestellungen, Verträgen oder Historie.
  • Markt- & Wettbewerbs-Recherchen — strukturiert und quellenbasiert statt losem Web-Sammeln.
  • Akademische Literaturrecherche — Übersichten mit Quellen, Gegenpositionen und offenen Fragen.
  • Daten-Analyse — aus CSV-Dateien automatisch Insights, Visualisierungen und Prüfhinweise ableiten.
  • Finanzanalyse mit Live-Daten — Modelle, Vergleichsgruppen und Sensitivitätsanalysen vorbereiten.
  • Patent- & Regulierungs­recherche — strukturierte Sichtung mit Quellen- und Risikohinweisen.
  • Cashflow-Modellierung — Forecasts aus Buchhaltungs- und Planungsdaten.
  • Kontoabstimmung — Bank vs. Buchhaltung mit Differenz-Markierung.
  • Reporting-Pakete — Quartalsreports automatisch vorbereiten.
  • Budget-Reviews — Abweichungs­analysen mit Erklärungen.
  • Pitchbooks & Due Diligence — Anthropic publiziert 10 Ready-to-Run-Templates für Cowork & Code.
  • Recruitment-Vorscreening — Lebensläufe vorbewerten (High Risk!).
  • Interview-Vorbereitung — Briefings für Interviewer.
  • Onboarding-Begleitung — personalisierte Pfade.
  • Mitarbeiter-Anfragen — Standardanfragen automatisch beantworten oder zur richtigen Stelle routen.
  • Energieversorgung — Lastprognosen, Anomalie-Erkennung in Netzdaten, Bürger-Anfragen-Triage.
  • Engineering — Angebotskalkulation aus LV, Konsistenzprüfung techn. Doku, Genehmigungsverfahren.
  • Systemische Beratung — Workshop-Doku aus Audio, Theorie-Recherchen und Interventions-Designs.
  • Medizinprodukte — Regulierungs-Recherche (FDA, MDR), Audit-Vorbereitung, Wettbewerber.
  • Legacy-System-Bedienung — alte Branchen-CRM/ERP plötzlich automatisierbar via Computer Use → IT-Modernisierungs-Tür.
10 · Demokratisierung

KI-Agenten für Alle.

Die sechs Stufen der Nutzung reichen vom einfachen Konsumieren bis zu eigenen Agenten-Architekturen. Stufe 4 ist 2026 der entscheidende Schwellenwert: Wer dort ankommt, ist ein „Citizen Agent Builder" — vergleichbar mit dem Citizen Developer, den Microsoft mit Power Platform vor zehn Jahren etablierte. Neu 2026: Die Erweiterungsschicht aus Skills, Connectors und Plugins zieht sich durch die Stufen 2 bis 5 und macht den Aufstieg deutlich flacher als noch im Vorjahr.

Die sechs Stufen der Nutzung

Konsumieren

ChatGPT, Claude, Gemini, Copilot Chat. Niedrigste Hürde, sofort produktiv.

Personalisieren

ChatGPT Custom Instructions, Claude Memory, Copilot Personalization, Gemini-Personalisierung. Dazu die ersten Connectors: Postfach, Ablage, Kalender verbinden — der Assistent kennt ab hier den eigenen Arbeitskontext.

Konfigurieren — Fertiges aktivieren

Nichts selbst schreiben, nur einschalten: Plugins aus dem ChatGPT Plugin Directory (in ChatGPT Work und Codex) bzw. aus dem Claude-Plugin-Verzeichnis (Cowork und Code), fertige Skills per @ oder $ aufrufen, Sintra-Helper engagieren, Sōkosumi-Modul aktivieren, Workspace-Studio-Bausteine einbinden.

Bauen mit Sprache — der Schwellenwert

Workspace Agent, Lindy, Copilot Studio oder Workspace Studio in Klartext beschreiben. „Wenn neuer Lead in Salesforce kommt, recherchiere ihn auf LinkedIn …" — ohne Code.

Hierher gehört auch der eigene Skill. Eine SKILL.md oder ein ChatGPT-Skill ist reiner Klartext: Name, Zweck, Vorgehen, Vorlagen. Wer sein Vorgehen einmal sauber aufschreibt, hat einen wiederverwendbaren Baustein — und kann ihn im Team teilen. Für viele Fachbereiche ist das der schnellste Weg über die Schwelle, noch vor dem ersten gebauten Agenten.

Skripten

Code-Tools einbinden, Apps Script in Workspace einsetzen, eigene MCP-Server für Fachsysteme bereitstellen, Skills und Connectors zu einem eigenen Plugin für die Organisation bündeln. Ab hier wird's technisch — ist ab Stufe 4 oft nicht mehr nötig.

Frameworks & Eigenbetrieb

LangGraph, CrewAI, AutoGen — oder ein selbst gehosteter Agent wie Hermes Agent oder OpenClaw auf eigener Hardware. Volle Freiheit, vollständige Kontrolle, vollständige Verantwortung. Für 99 % der Business-User unnötig.

Die neue Rolle: „Agent Supervisor"

Microsoft führte mit dem Work Trend Index 2026 einen neuen Begriff ein, der sich als zentrale Rolle etabliert: „Agent Supervisor" — Mitarbeiter:innen, deren primäre Wertschöpfung nicht mehr im Erledigen von Aufgaben liegt, sondern im Management, Coaching und Auditieren von Agenten-Flotten.

  • Gute Domänen-Kenntnis (kann beurteilen, ob Output „richtig" ist)
  • Pragmatischer Umgang mit Tools (muss kein Programmierer sein)
  • Sinn für Workflow-Design
  • Verständnis für Compliance und Governance
Kernaussage

„Vor zwei Jahren musste oft noch erklärt werden, was ein KI-Agent ist. Stand August 2026 haben viele Wissensarbeiter:innen bereits mit agentischen Funktionen gearbeitet — teils ohne sie so zu nennen."

11 · Risiken

Was schiefgehen kann.

Agenten sind mächtig, weil sie sehen, entscheiden und handeln können. Genau daraus entstehen neue Risiken: falsche Entscheidungen, überbreite Berechtigungen, Datenabfluss und Angriffe über scheinbar harmlose Inhalte.

— Risiko 01

Halluzinationen

Bei spezifischen Faktenfragen, falschen Tool-Ergebnissen, unverstandenen Aufgaben. Schutz: Citation Tools, Reasoning-Modelle, Human-in-the-Loop.

— Risiko 02

DSGVO & Datenresidenz

EU-Residenz ist bei Google (Datenregionen seit Juni 2026) und Microsoft konfigurierbar. Anthropic bietet sie für die eigene API und für Cowork nicht — nur über AWS, Vertex AI oder Microsoft Foundry. Codex Computer Use ist seit dem 17.06.2026 auch in EWR, UK und der Schweiz freigeschaltet; Memories ist dort standardmäßig aus, das Chrome-DevTools-Protokoll gesperrt. Die Funktion ist damit verfügbar — die Frage nach Datenresidenz und Auftragsverarbeitung beantwortet das aber nicht.

— Risiko 03

EU AI Act

Seit dem 02.08.2026 gelten die Transparenzpflichten nach Art. 50 und der Sanktionsrahmen (bis 15 Mio. € oder 3 % Jahresumsatz). Die Hochrisiko-Pflichten nach Anhang III — darunter HR-Screening — wurden per Verordnung (EU) 2026/1744 auf den 02.12.2027 verschoben.

— Risiko 04

Prompt Injection

Schädliche Anweisungen können in E-Mails, Webseiten, PDFs, Tickets, Templates oder Datenfeldern versteckt sein. Besonders kritisch ist das bei agentischen Browsern, Computer-Use-Szenarien, Office-Add-ins und allen Agenten, die externe Inhalte lesen und anschließend Aktionen ausführen.

— Risiko 05

Computer-Use-Sicherheit

Vollzugriff auf alles, was der Nutzer sieht oder bedienen darf. Sandboxing, getrennte Profile, minimale Rechte und Freigaben für sensible Aktionen sind essenziell. OpenClaw ist ein gutes Warnbeispiel: Hype, starke Fähigkeiten, aber auch dokumentierte Sicherheitsprobleme rund um Skills, offene Instanzen und zu breite Berechtigungen.

— Risiko 06

Wann nicht Agenten?

Sehr regelbasiert (RPA günstiger). Rechtsverbindlich ohne menschliche Letztverantwortung. Echtzeit-Performance. Volatile UIs für CU.

12 · OpenAI 5 Stufen

Wo wir 2026 stehen.

OpenAIs fünfstufige Skala (Juli 2024) ersetzt die diffuse AGI-Definition durch ein operatives Modell. 2026 stecken wir mittendrin in der Level-3-Welle — Computer Use ist die technische Voraussetzung dafür.

01

Chatbots

KI mit konversationellem Sprachvermögen.

✓ Mainstream seit 2022
02

Reasoners

Menschen-Niveau in Problemlösung. Nachdenkende Modelle.

✓ Erreicht 2024–25
03

Agents — wir sind hier

Systeme, die Aktionen über längere Zeiträume ausführen. Cowork, Workspace Agents, Office Add-ins, Computer Use.

↻ August 2026
04

Innovators

KI, die Erfindungen unterstützt oder selbst tätigt. Erste Anzeichen in Forschung und Coding.

○ Frühe Anzeichen
05

Organizations

KI, die die Arbeit ganzer Organisationen leistet. Konzeptionell auf dem Tisch (Paperclip), nicht produktionsreif.

○ Forschung

Aktivierungsfrage

„Wenn wir 2026 mitten in der Level-3-Welle stecken — was bedeutet das konkret für eure Organisation?"

  • Habt ihr Tools auf Level 1 im Einsatz? (Chatbot-Spielereien, Custom GPTs)
  • Sind Mitarbeiter:innen mit Level 2 (Reasoning-Modelle) vertraut?
  • Habt ihr Level 3-Pilotierungen (Agenten, Office-Add-ins, Computer Use)?
  • Plant ihr für Level 4 (zunehmende Innovations-Beteiligung von KI)?
  • Habt ihr Vorstellung, was Level 5 für eure Wertschöpfung bedeutet?

Methodische Kritik: Das Framework hat inkonsistente Logik (Level 2 = Fähigkeit, Level 5 = Anwendungsform), Marketing-Charakter und suggeriert Sprung-Klarheit, die es nicht gibt. Trotzdem ein gut verwendbares Modell zur Orientierung.

13 · Ausblick

Was bringt der Rest von 2026?

— Trend 01

Cross-App-Orchestrierung

Microsoft Copilot Cowork (weltweit seit 16.06.2026), ChatGPT Work, Agent 365 und Gemini Enterprise bündeln Agenten über Anwendungsgrenzen hinweg.

— Trend 02

Computer Use ist in Europa angekommen

Eingetreten: Seit dem 17.06.2026 ist Codex Computer Use auch im EWR, in UK und der Schweiz freigeschaltet — samt Chrome-Erweiterung. Zusammen mit Claude (Pro/Max, Research Preview) und dem Computer-Use-Werkzeug der Gemini API steht die Technik damit auch in DACH breit zur Verfügung. Offen bleibt nicht mehr die Verfügbarkeit, sondern die Governance: Freigabeprozesse, Protokollierung und Haftung bei Fehlbedienung.

— Trend 03

Agent-zu-Agent

Die Verbreitung von A2A-Protokoll (Google) und MCP (Anthropic) steigt stark an.

— Trend 04

EU-Anbieter im Aufwind

Sōkosumi und ähnliche profitieren vom AI Act. Compliance als Differenzierung.

— Trend 05

Komplexes Pricing

Subscription + Credits + Tiered. Wechsel zwischen Anbietern wird Geschäftsfeld.

— Trend 06

Geopolitik formt Adoption

Manus-Fall ist nicht der letzte. US-EU-Datenregime werden Tool-Verfügbarkeit beeinflussen.

Drei Empfehlungen

Empfehlung 01

Schnell starten, niedrig anfangen

Wartet nicht auf die „perfekte Strategie". Einen konkreten, schmerzhaften Workflow herauspicken (Wochenreport, Inbox-Triage, Lead-Qualifikation) und genau diesen automatisieren. Lerneffekte und Akzeptanz folgen.

Empfehlung 02

In Agent Supervisor investieren

Im Team Personen mit pragmatischer KI-Affinität, gutem Domänen-Wissen und Workflow-Sinn identifizieren. Zu Multiplikatoren machen.

Empfehlung 03

Governance früh, nicht spät

BEVOR ihr Agenten produktiv setzt: Welche Daten dürfen sie sehen? Welche Aktionen brauchen Approval? Wer auditiert? Eine kleine Governance-Investition vorne erspart später viel.

Drei Schritte für jede:n

Praktische nächste Schritte

  1. Sofort: Einen Agentenmodus an einem realen Mini-Problem ausprobieren — mit überschaubarem Zeitaufwand.
  2. Diese Woche: Einen wiederkehrenden Workflow identifizieren, in einem Satz beschreiben.
  3. Diesen Monat: Mit einer No-Code-Plattform (Lindy, Workspace Agent, Workspace Studio, Copilot Studio, Sintra) den ersten eigenen Agenten bauen.