KI-native Arbeit: Nativ im KI-Reifegrad-Atlas
KI-native Arbeit
Dies ist die Stufe, auf der du aufhörst, Agenten in deine alten Abläufe zu setzen, und anfängst, die Abläufe um die KI herum neu zu bauen. Nicht mehr wie beschleunige ich meinen Prozess, sondern wie sähe er aus, wenn ein Agent von Anfang an mitarbeitet.
Das ist der Beginn der Phase Nativ: ganze Aufgabenberge werden per Ziel und Loop delegiert.
Was auf dieser Stufe zählt
Bau die Prozesse um die KI herum neu und delegiere ganze Aufgaben als Ziel und Loop, nicht Schritt für Schritt.
Prozesse um die KI herum neu bauen
Entwirf jeden Ablauf so, als arbeite ein Agent ab Tag eins mit. Agenten sind vergesslich, brauchen exakt den richtigen Kontext und sehr gut dokumentierte Prozesse.
Vom Ingenieur zum Architekten
Statt Zeile für Zeile zu schreiben, triffst du große Entscheidungen, delegierst und steuerst über Kontext und Risiko. Die Fachkraft wird zur CEO ihres Themas.
Ganze Aufgaben als Ziel und Loop
Ein Loop ist ein Ziel, das der Agent eigenständig verfolgt, bis eine erkennbare Abschlussbedingung erfüllt ist. Große Ziele vorher in messbare Unterziele zerlegen.
Erst bauen, dann entscheiden
Produktteams planen nicht mehr sechs Monate voraus, sondern bauen lauffähige Varianten und entscheiden danach. Die knappe Ressource verschiebt sich vom Herstellen zum Auswählen.
Der Mensch liefert Urteil und letzte Meile
Sechs Felder bleiben deins: Absicht, Richtung, Entscheidung, Geschmack, Verantwortung und Beziehung. Die letzten zehn Prozent musst du selbst anschauen, sonst entsteht Massenware.
Bau eine ganze Domäne um, nicht einen Schritt
Die am stärksten mit Wertschöpfung verbundene Praxis ist das Neudenken kompletter Abläufe von Anfang bis Ende. Wer viele enge Anwendungsfälle nebeneinander baut, landet im Pilot-Fegefeuer: rund 90 Prozent der Firmen nutzen KI, aber nur etwa 7 Prozent bringen sie über den Pilotstatus hinaus.
Freie Kapazität ist noch kein Wert
Wenn ein Agent Arbeit abnimmt, entsteht zuerst nur Zeit, kein Ergebnis. Reine Produktivität ist keine Strategie, weil Wettbewerber dieselben Modelle haben und der Vorteil über den Preis an die Kunden weitergereicht wird. Wert bleibt, wenn du mit der Kapazität etwas anderes tust als vorher.
Wo du auf jeder Achse stehst
Reife ist ein Profil aus fünf Werten. So sieht jede Achse auf dieser Stufe aus.
Die Rolle kippt vom Ausführenden zum Dirigenten. Die Last ist nicht Tippen, sondern die kognitive Last paralleler Ströme, also begrenzt man bewusst die Zahl der Baustellen. Die Position wandert vom im Loop zum über dem Loop, und Prognosen gehen davon aus, dass fast jede Rolle in zwei bis drei Jahren eine neue Aufgabenbeschreibung braucht und rund 70 Prozent der Führungsrollen neu zugeschnitten werden.
Der Agent ist brillant, aber amnesisch. Eine einzige Wahrheitsquelle pro Sachverhalt wird Pflicht, ergänzt um selbstaktualisierende Statusseiten. Liegt ein Vertrag an fünf Orten, hat der Agent fünf Chancen, die falsche Version zu erwischen.
Die Umgebung schlägt das Modell: der Harness aus Werkzeugen, Gedächtnis, Rechten und Skills. Je besser die Modelle, desto schlanker die Anweisungen. Und du routest bewusst: das kleinste Modell, das die Teilaufgabe löst, statt reflexhaft das größte.
Der Kern von der vorigen Stufe: Prozesse als Fragen definieren, jede Phase als eigener Übergabeschritt im eigenen Kontextfenster. Leitfrage ist nicht können wir, sondern sollten wir. Vor dem ersten Agenten steht die Prozesslandkarte, und nicht jeder Schritt braucht einen Agenten: unterscheide Aufgaben-Agenten für einen abgegrenzten Schritt, Ziel-Agenten für ein Ergebnis über mehrere Schritte und Orchestrierungs-Agenten, die andere koordinieren.
Zehnmal so viele Auslieferungen bedeuten zehnmal so viele Störungen, also überinvestierst du in Qualität: Pflicht-Prüfschritt je Skill, ein zweiter Agent als unvoreingenommener Prüfer im frischen Kontext. Zwei Regeln kommen dazu, sobald Agenten wirklich in Systemen handeln: KI-geschriebener Code bekommt volles Review und ein Test-Set gegen Rückschritte, und du fragst vorab, was maximal passieren kann, wenn ein Agent das Falsche tut.
Woraus diese Stufe besteht
- Loops und Ziele: Ein Ziel bekommt eine klare Abschlussbedingung, dann läuft der Agent, bis sie erfüllt ist, gesteuert per Checkliste oder Bewerter-Modell.
- Sub-Agenten und paralleles Fächern: Ein Hauptagent orchestriert viele Unter-Agenten im Master-Child-Muster und lässt zehn isolierte Experimente gleichzeitig laufen.
- Harness, Skills und MCP-Gateway: Deine Fachperspektive gehört in Skills, gebündelt über ein zentrales Gateway, Hooks erzwingen Regeln grundsätzlich.
- Compound Engineering: Erst einen Plan schreiben lassen, dann bauen lassen, plus gegnerischer Prüfschritt und Advocatus-Diaboli-Kritik zum Stresstest.
- Automationen als wiederholbares System: Was du einmal im Chat durchspielst, wird als Automation oder Skill festgehalten. Deterministische Zeitpläne schlagen hoffnungsvolle Selbstauslöser.
- Freigabe-Loop und Agenten-Cockpit: Der Agent postet die geplante Aktion in einen eigenen Kanal, ein Mensch gibt sie frei oder korrigiert vorher, erst danach wird ausgeführt. Jeder produktive Agent hat einen namentlichen Verantwortlichen, einen Gesundheitsstatus und ein Protokoll seiner Aktionen.
Die ersten Schritte
Die Kennzahlen dieser Stufe
- Anteil delegierter Ziele und Loops: wächst gegenüber Schritt-für-Schritt-Prompts
- Parallele Agenten: mehrere gleichzeitig, du bist nicht mehr der Flaschenhals
- Verhältnis Entscheiden zu Herstellen: mehr Zeit mit Prüfen als mit Bauen
- Skills mit Prüfschritt: jeder wichtige Skill hat einen verpflichtenden Prüfschritt
- Durchlaufzeit umgebauter Abläufe: um eine Größenordnung gefallen, nicht um ein paar Prozent
- Umgebaute Abläufe statt Piloten: Prozesse laufen von Anfang bis Ende neu, nicht als Vorführung in einem Team