Unternehmen mangelt es nicht an Modellen, sondern an einer Betriebsschicht, die Agenten sicher und nützlich im großen Maßstab macht. Cloudflares interne Plattform Cloudflare OS entstand, weil engagierte Teams plötzlich Arbeit mit Agenten automatisieren konnten – doch die Vergabe weitreichender API-Schlüssel war keine Option. Das OS sitzt zwischen Modellen und Produktionssystemen und setzt identitätsbewusste Berechtigungen, eingeschränkten Datenzugriff, Ausführungssandboxen und prüfbare Aktionen durch. Dieser Wandel verlagert die Diskussion von Prompt-Engineering hin zu operativem Design: Wen stellt der Agent dar, welche Fähigkeiten hat er, wo kann er ausgeführt werden und wie werden seine Entscheidungen überprüft? Sind diese Fragen geklärt, können Agenten die Arbeit spürbar beschleunigen, ohne die Sicherheit zu gefährden.
Ein aussagekräftiges Beispiel ist Cloudflares Engineering Codex: eine meinungsstarke Kontextschicht, die definiert, wie „gute“ Arbeit in verschiedenen Bereichen aussieht. Agenten nutzen ihn zur Planung, Designüberprüfung und zur Steuerung von Code-Merges. Die Wirkung ist messbar – Tausende blockierte Merges und frühzeitige Erkennung von Architekturproblemen – weil das OS den Zugriff nicht erweitert, sondern bestehende Zero-Trust-Regeln und Domänenstandards auf jede Agentenaktion anwendet. Das ist der entscheidende Unterschied zu modellzentrierten Lösungen: Ein OS behandelt Kontext, Richtlinien und Verantwortlichkeit als Kernbestandteile, nicht als Anhängsel. Es verwandelt spontane Experimente in geregelte Arbeitsabläufe mit konsistentem Verhalten über Teams und Tools hinweg.
Für Entscheidungsträger bietet Cloudflare OS ein praktisches Muster für die Einführung von Agenten. Bevor in weitere Modelle investiert wird, sollte man die Identitätsstruktur, Berechtigungen, Kontextspeicher, Ausführungsumgebungen und Evaluationsschleifen inventarisieren, die Agenten einschränken und formen. Existieren diese Elemente nicht, ist der richtige Schritt, diese Betriebsschicht zu bauen oder zu kaufen – statt Pilotprojekte zu skalieren, die stillschweigend technische, Daten- und Compliance-Schulden anhäufen. Der Gewinn ist Geschwindigkeit bei gleichzeitiger Sicherheit: schnellere Überprüfungen, verlässliche Automatisierung und eine klare Verantwortlichkeitskette für jeden Agenten und jede Aktion. Anders gesagt: Produktionsreife Agenten sind eine IT-Fähigkeit, kein Chatbot.


