{"id":2653,"date":"2026-04-20T11:43:59","date_gmt":"2026-04-20T11:43:59","guid":{"rendered":"https:\/\/jamalnichols.com\/?p=2653"},"modified":"2026-05-26T11:43:19","modified_gmt":"2026-05-26T11:43:19","slug":"ai-validation","status":"publish","type":"post","link":"https:\/\/jamalnichols.com\/de\/ai-validation\/","title":{"rendered":"Wie ich entscheide, ob KI-Output mein Vertrauen verdient"},"content":{"rendered":"<h2 class=\"wp-block-heading\">Vom Prompting zur \u00dcberwachung<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">Das erste Mal, dass mir das wirklich klar wurde, war bei der \u00dcberpr\u00fcfung deutscher \u00dcbersetzungen eines benutzerdefinierten, von Gemini angetriebenen Plugins, das ich entwickelt hatte f\u00fcr&nbsp;<a href=\"https:\/\/christianpure.com\/\" rel=\"noopener\" target=\"_blank\">Christian Pure<\/a>. Die Admin-Tabelle sah normal aus. Die Zeilen waren gef\u00fcllt. Die Auftr\u00e4ge waren als abgeschlossen markiert. Aus der Ferne sah es so aus, als h\u00e4tte das System die Arbeit erledigt.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Dann \u00f6ffnete ich ein paar Beitr\u00e4ge und fand Englisch in Feldern, die eigentlich Deutsch enthalten sollten. Der Fehler war nicht subtil. Es war keine Frage des Geschmacks, des Sprachflusses oder der Formulierung. Der Workflow hatte unfertige Arbeit als fertig markiert, und die Benutzeroberfl\u00e4che hatte diesen Fehler unauff\u00e4llig aussehen lassen.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Dieser Fehler hat meine Sichtweise auf KI-gest\u00fctzte Arbeit ver\u00e4ndert. Ein ausgef\u00fclltes Feld ist keine \u00dcbersetzung. Ein gerenderter Bildschirm ist kein Produkt. Eine koh\u00e4rente Antwort ist nicht dasselbe wie eine korrekte Antwort. KI ist sehr gut darin, Artefakte zu produzieren, die wie Fortschritt aussehen: \u00fcbersetzt wirkende Zeilen, plausibler Code, aufger\u00e4umte Bildschirme, polierte Zusammenfassungen. Wenn ich m\u00fcde bin oder schnell arbeite, kann diese \u00c4hnlichkeit ausreichen, um mich f\u00fcr einen Moment zu t\u00e4uschen.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Da h\u00f6rte ich auf, Prompting als den Kern der F\u00e4higkeit zu betrachten. Prompting ist immer noch wichtig, aber die wichtigere Arbeit ist die \u00dcberwachung: zu entscheiden, was Erfolg bedeutet, bevor die Generierung beginnt, das Modell im realen System zu verankern und Pr\u00fcfungen zu erstellen, die flie\u00dfende Fehler sichtbar machen, bevor sie die Nutzer erreichen.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Manchmal nennt man diese umgebende Schicht ein Harness (Ger\u00fcst). Ich hatte dieses Wort nicht im Kopf, als ich den Christian Pure-Workflow erstellte, aber genau das ist daraus geworden. Gemini generierte die \u00dcbersetzungen. Ein theologisches Glossar schr\u00e4nkte Schl\u00fcsselbegriffe ein. Pr\u00fcfungen nach der \u00dcbersetzung suchten nach englischen \u00dcberbleibseln. API-Protokolle und Ausgabenlimits machten es einfacher, Fehler zu erkennen. Die Admin-\u00dcberpr\u00fcfung hielt die Ausgabe von der Produktion fern, bis jemand sie \u00fcberpr\u00fcfen konnte.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Der Gro\u00dfteil meiner KI-Arbeit findet in dieser unordentlichen Mitte zwischen Produkt, Design und Implementierung statt. Ich habe an einer Gute-Nacht-App f\u00fcr Kinder mit Kaufprozessen und mehrsprachigem Audio gearbeitet, an einem WordPress-\u00dcbersetzungssystem, das Tausende von Beitr\u00e4gen abdeckt, und an einem Raumvisualisierer, bei dem r\u00e4umliche Fehler das Versprechen des Produkts brechen. Bei dieser Art von Arbeit ist es ein schwaches Signal, wenn etwas fertig aussieht. Ich muss wissen, welche Source of Truth das Modell verwendet hat, welche Einschr\u00e4nkungen es beibehalten hat, was sich im Diff ge\u00e4ndert hat, welche Pr\u00fcfungen bestanden wurden und wie ein Fehler aussehen w\u00fcrde, wenn das Modell falsch l\u00e4ge.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\">Die Aufgabe geht tiefer als die sichtbare Ausgabe<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">F\u00fcr Christian Pure war die Aufgabe gr\u00f6\u00dfer als nur Text in einer anderen Sprache zu generieren. Die eigentliche Aufgabe bestand darin, einer gro\u00dfen mehrsprachigen Website zu helfen, sich koh\u00e4rent anzuf\u00fchlen, ohne die Verwaltung in permanente Aufr\u00e4umarbeit zu verwandeln. Wenn eine deutsche Seite immer noch englische \u00dcberbleibsel enth\u00e4lt, hat das System eine nicht-leere Ausgabe produziert, aber keine \u00fcbersetzte Seite.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Dieser Unterschied zeigt sich \u00fcberall. Ein Modell kann ein Feld ausf\u00fcllen, einen Bildschirm rendern oder eine strukturierte Antwort zur\u00fcckgeben und dabei den Sinn der Arbeit verfehlen. Die tiefere Frage ist, ob das Artefakt die Aufgabe erf\u00fcllt hat, auf die es ankommt. Hat die \u00dcbersetzung die Bedeutung bewahrt? Hat der Code den Fehler behoben, der das eigentliche Problem verursacht hat? Hat das Design die reale Umgebung des Nutzers unterst\u00fctzt und nicht nur den sauberen Demo-Pfad?<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Nach dem \u00dcbersetzungsfehler begann ich, KI-Ausgaben als nicht vertrauensw\u00fcrdige Zwischenarbeit zu behandeln. F\u00fcr das Plugin bedeutete das explizite Pr\u00fcfungen auf un\u00fcbersetzte englische Zeichenfolgen, eine strengere \u00dcberpr\u00fcfung abgeschlossener Zeilen und eine genauere \u00dcberwachung des API-Verhaltens. Der Workflow war nicht l\u00e4nger eine Anfrage nach \u00dcbersetzung, sondern wurde zu einem System, in dem schlechte \u00dcbersetzungen einen Ort hatten, an dem sie auftauchen konnten.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Dasselbe Muster zeigt sich beim Code. Ein Modell kann Flutter-Code generieren, der kompiliert, w\u00e4hrend es den RevenueCat-Sonderfall ignoriert, der den Kauf-Bug verursacht hat. Es kann einen sauberen Implementierungsplan erstellen, der die eigentliche Einschr\u00e4nkung \u00fcbersieht. Es kann einen Bildschirm bauen, der im normalen Entwicklungspfad gut aussieht und dann auf einem \u00e4lteren Android-Ger\u00e4t oder beim Audio-Verhalten auf dem Sperrbildschirm fehlschl\u00e4gt. Bevor ich der Ausgabe vertraue, formuliere ich die Aufgabe in einfacher Sprache neu und pr\u00fcfe, ob das Artefakt diese Aufgabe gel\u00f6st hat, einschlie\u00dflich der unsch\u00f6nen Teile.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\">Beschr\u00e4nkungen m\u00fcssen explizit sein<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">Viele KI-generierte Arbeiten scheitern, weil die sichtbare Anfrage einfacher ist als die tats\u00e4chliche Einschr\u00e4nkung, die darunter liegt. Das Modell kann die Anweisung erf\u00fcllen und gleichzeitig den Freigabeprozess, Design-Tokens, die Kostenobergrenze, Inhaltsregeln, Ger\u00e4teeinschr\u00e4nkungen, die Architektur oder den Wartungsaufwand verletzen.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Das \u00dcbersetzungs-Plugin hat mich das auf die harte Tour gelehrt. Die erste Version hatte zu wenig Instrumentierung rund um Fehler, Wiederholungsversuche und Ratenbegrenzungen. Es stie\u00df an die API-Limits von Gemini, schlug stillschweigend fehl, versuchte es zu aggressiv erneut und verbrannte ungef\u00e4hr $250, bevor ich es bemerkte. Es gab keinen dramatischen Absturz. Die Ausgabe sah auf den ersten Blick immer noch normal genug aus. Das System versuchte es weiter, schlug fehl und stellte Rechnungen aus.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Die Lektion war praktischer Natur. Ich hatte dem Modell ein saubereres Problem \u00fcbergeben, als ich tats\u00e4chlich hatte. Das reale Problem umfasste \u00dcbersetzungsqualit\u00e4t unter Kostenlimits, Ratenbegrenzungen, theologische Terminologieregeln, Anforderungen an die Admin-\u00dcberpr\u00fcfung und Fehlermodi, die sichtbar sein mussten. Als ich das verstanden hatte, \u00e4nderte ich die Art und Weise, wie ich nicht-triviale KI-Aufgaben formuliere.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Bevor die Generierung beginnt, versuche ich vier Dinge aufzuschreiben: was unver\u00e4ndert bleiben muss, welche Source of Truth das Modell verwenden soll, welche Fehlermuster Aufmerksamkeit verdienen und wie ich vor der Produktion erkenne, ob etwas nicht stimmt. F\u00fcr Christian Pure bedeutete das festgeschriebene Glossarbegriffe, sprachspezifische Vermeidungslisten und Pr\u00fcfungen auf un\u00fcbersetztes Englisch, nachdem das Modell die Ausgabe zur\u00fcckgegeben hatte. Das Modell war immer noch n\u00fctzlich und arbeitete endlich innerhalb der realen Form des Problems.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Ich sah dasselbe Problem in&nbsp;<a href=\"https:\/\/jamalnichols.com\/de\/project\/halo-family-bedtime-routines\/\" rel=\"noopener\" target=\"_blank\">Halo<\/a>. Ich bat Claude Code um Hilfe bei einem spezifischen Android-Audiofokus-Bug im Zusammenhang mit dem Verhalten auf dem Sperrbildschirm. Der Plan, den es zur\u00fcckgab, war ehrgeizig und in sich stimmig, doch er weitete einen schmalen Fix zu einem breiten Architekturprojekt aus. Das ist eine spezifische Art von KI-Drift: Das Modell l\u00f6st eine sauberere Version des Problems, indem es den Umfang erweitert. Wenn aus einer kleinen Reparatur ein gro\u00dfes Redesign wird, betrachte ich das jetzt als Warnsignal.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\">Die Ausgabe muss zum System geh\u00f6ren<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">Einer der am leichtesten zu \u00fcbersehenden Fehler ist Arbeit, die so aussieht, als w\u00fcrde sie dazugeh\u00f6ren, w\u00e4hrend sie vom eigentlichen System getrennt bleibt. Die Namen f\u00fchlen sich richtig an. Die Form der Komponente ist vertraut. Der Text klingt passend. Dann \u00fcberpr\u00fcft man das Ergebnis und stellt fest, dass es die echten Tokens, Dateien, APIs, Komponenten oder Entscheidungen ignoriert hat, die bereits im Produkt vorhanden sind.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Langweilige Setup-Dateien und Projektkonventionen sind aus diesem Grund wichtig. In Halo gibt eine CLAUDE.md-Datei dem Modell Regeln vor, die es respektieren muss: Projektstruktur, Programmierkonventionen, Architekturnotizen und Bereiche, in denen beil\u00e4ufige Umschreibungen gef\u00e4hrlich sind. Diese Art von Kontext wird niemals eine beeindruckende Demo abgeben, aber sie verringert die Wahrscheinlichkeit, dass das Modell plausiblen Au\u00dfenseiter-Code produziert, der der App nur \u00e4hnelt.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Ich vermeide es auch, Prosa-Zusammenfassungen von Code\u00e4nderungen zu vertrauen. Ich m\u00f6chte den Diff. Ich m\u00f6chte sehen, welche Dateien sich ge\u00e4ndert haben, welche Imports hinzugekommen sind, ob das Modell mehr ber\u00fchrt hat, als die Aufgabe erforderte, und ob die L\u00f6sung in das bestehende Muster passt. F\u00fcr Flutter-Arbeiten verwende ich Claude Code-Hooks, um Pr\u00fcfungen wie dart analyze, dart format und flutter test rund um Bearbeitungen auszuf\u00fchren, mit GitHub Actions als weiteres Tor, bevor \u00c4nderungen \u00fcbernommen werden. Diese Pr\u00fcfungen ersetzen nicht das Urteilsverm\u00f6gen. Sie verhindern, dass grundlegende Fehler alles davon aufzehren.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Das ist der praktische Unterschied zwischen der beil\u00e4ufigen Nutzung von KI und der ernsthaften \u00dcberwachung von KI. Ich gestalte die Umgebung rund um die Ausgabe: die Quelldateien, auf die sie verweisen kann, die Einschr\u00e4nkungen, die sie beibehalten muss, die Pr\u00fcfungen, die sie bestehen muss, und den \u00dcberpr\u00fcfungspfad, den sie durchl\u00e4uft, bevor ich ihr vertraue.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\">Die Herkunft ist am wichtigsten, wenn der Text gut klingt<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">KI ist n\u00fctzlich, weil sie L\u00fccken f\u00fcllen kann. Dieselbe F\u00e4higkeit macht sie gef\u00e4hrlich, wenn die Arbeit auf Wahrheit angewiesen ist. Plausibles Material und fundiertes Material kommen oft im selben selbstbewussten Tonfall daher, was bedeutet, dass der Text genau dann am \u00fcberzeugendsten wirken kann, wenn er am meisten \u00fcberpr\u00fcft werden muss.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Darauf stie\u00df ich beim Entwerfen einer Halo-Fallstudie. Der erste Durchgang hatte eine gute Struktur und enthielt echte Details aus unserem Gespr\u00e4chsverlauf. Einige der am besten klingenden Abschnitte hatten jedoch keine Beweise hinter sich: eine Namensgeschichte, eine Entscheidung zum Kunststil, ein Migrationsmoment. Das Modell hatte fehlende Informationen mit einer plausiblen Erz\u00e4hlung gegl\u00e4ttet. Es las sich gut, und Teile davon waren nicht wahr.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Dieser Fehler hat ver\u00e4ndert, wie ich KI-gest\u00fctztes Schreiben und Recherchieren \u00fcberpr\u00fcfe. Ich frage, woher eine Behauptung stammt, bevor ich entscheide, ob sie gut klingt. Kam sie aus meinen Notizen, einem Transkript, einem Repo, einer Quelle oder dem Versuch des Modells, die Geschichte fl\u00fcssiger zu machen? Wenn ein Modell mir Marktzahlen, Keyword-Daten oder eine selbstbewusste strategische Behauptung liefert, m\u00f6chte ich eine nachvollziehbare Quelle. Wenn es keine liefern kann, behandle ich die Behauptung als Schlussfolgerung.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Das gilt auch f\u00fcr Code. Wenn ein Modell auf eine API, ein Paketverhalten oder eine Projektmethode verweist, m\u00f6chte ich wissen, ob diese existiert. \u201eF\u00fchlt sich an, als sollte es existieren\u201c ist ein schlechter Grund, irgendetwas zu vertrauen. Plausibilit\u00e4t ist keine Herkunft, und bei polierten Ausgaben ist die Herkunft oft am wichtigsten.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\">Gute Demos verbergen Schwachstellen<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">Saubere Prompts lassen KI besser aussehen, als sie ist. Saubere Screenshots, saubere Eingaben, saubere Tests und saubere Demos tun dasselbe. Die reale Nutzung ist chaotischer. Benutzer sind vage. Inhalte fehlen. Ger\u00e4te sind klein. APIs fallen aus. Berechtigungen werden seltsam. Alte Zust\u00e4nde verweilen an Orten, an die niemand gedacht hat, sie zu \u00fcberpr\u00fcfen.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Das Room-Styler-Projekt machte dies offensichtlich. Einige generierte Layouts waren nicht auf dramatische Weise kaputt. Sie hatten M\u00f6bel, Stil und genug Feinschliff, um einem fl\u00fcchtigen Blick standzuhalten. Das Problem war die Produktbeurteilung: Der Ma\u00dfstab stimmte nicht, G\u00e4stezimmer wirkten unrealistisch, und einige Layouts sahen akzeptabel aus, bis man bemerkte, dass sie die Laufwege blockierten. Nichts st\u00fcrzte ab. Die Ausgabe war einfach auf eine Weise falsch, die bei einer allgemeinen visuellen \u00dcberpr\u00fcfung \u00fcbersehen werden w\u00fcrde.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Das hat meine Denkweise \u00fcber vorhersehbare KI-Fehler ver\u00e4ndert. Wenn ein System nach einem Muster versagt, versuche ich, nicht jeden Fall als neues \u00c4rgernis zu behandeln. Ich frage, welche Leitplanke fehlt. Muss der Prompt expliziter sein? Sollte es einen zweiten Durchgang geben? Sollte das System auf blockierte T\u00fcren, nicht unterst\u00fctzte Behauptungen, un\u00fcbersetzte Zeichenfolgen, Kostenspitzen oder einen erweiterten Umfang pr\u00fcfen? Ich erwarte nicht, dass KI perfekt wird. Ich erwarte jedoch, dass mein Workflow nicht mehr zweimal vom selben Fehler \u00fcberrascht wird.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Die \u00dcberpr\u00fcfungen sollten den Risiken folgen, die Benutzer tats\u00e4chlich sp\u00fcren. Ein Raumlayout, das Laufwege blockiert, zerst\u00f6rt das Vertrauen in das Tool. Ein Kauf-Bug betrifft Geld. Ein falsch \u00fcbersetzter religi\u00f6ser Begriff ver\u00e4ndert die Bedeutung. Diese Fehler geh\u00f6ren in unterschiedliche Risikokategorien, und der \u00dcberpr\u00fcfungsprozess sollte sie unterschiedlich behandeln.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\">Fehler m\u00fcssen sichtbar sein<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">Stilles Versagen ist der Teil, der mich am meisten beunruhigt. Herk\u00f6mmliche Software kann ebenfalls still versagen, aber ihre Fehlermodi sind oft leichter zu lokalisieren, weil das System deterministischer ist. KI-Systeme sind schwieriger, weil die Ausgabe fl\u00fcssig und wohlgeformt bleiben kann, selbst wenn die zugrunde liegende Operation fehlgeschlagen ist. Das Format bleibt sauber, der Ton bleibt ruhig und die Oberfl\u00e4che bleibt \u00fcberzeugend.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Bevor ich einem KI-Workflow vertraue, m\u00f6chte ich wissen, wie ich bemerke, wenn er kaputtgeht. F\u00fcr das \u00dcbersetzungs-Plugin bedeutet das, API-Aufrufe und Kosten zu protokollieren, das Wiederholungsverhalten zu \u00fcberpr\u00fcfen, die Ausgaben zu deckeln und Ausgaben zu markieren, die anscheinend noch Englisch enthalten. Erkennung kommt vor Wiederherstellung. Wenn ich den Fehler nicht sehen kann, kann ich ihn nicht rechtzeitig beheben.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">F\u00fcr Halo ist das \u00c4quivalent ein mehrschichtiger \u00dcberpr\u00fcfungspfad. Statische \u00dcberpr\u00fcfungen fangen einige Probleme ab. Tests fangen andere ab. Ein fokussierter Gutachter-Durchgang ist n\u00fctzlich f\u00fcr \u00c4nderungen, die Kauflogik, Audioverhalten oder andere Hochrisikobereiche betreffen. Tests auf echten Ger\u00e4ten sind wichtig, weil sich emulator-sauberes Verhalten von benutzer-sauberem Verhalten unterscheiden kann, insbesondere auf \u00e4lterer Android-Hardware.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Nichts davon hat den Nervenkitzel eines schnellen Prototyps. Es sind Logs, Tests, Diffs, Review-Warteschlangen, CI-Gates, Staging, Kostenobergrenzen, Retry-Inspektionen und Ger\u00e4tepr\u00fcfungen. Es ist aber auch das Ger\u00fcst, das verhindert, dass KI-Output stillschweigend zu einem Risiko wird.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\">\u00dcberpr\u00fcfungen sollten mit dem Risiko skalieren<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">Ich wende nicht auf alles das gleiche Ma\u00df an Pr\u00fcfung an. Das w\u00fcrde die Arbeit langsam und m\u00fchsam machen. Wegwerf-Texte werden nur fl\u00fcchtig gepr\u00fcft. Eine kleine UI-Anpassung wird auf Passgenauigkeit und offensichtlichen Unsinn kontrolliert. Alles, was mit Geld, Nutzervertrauen, Produktionsdaten, ver\u00f6ffentlichten Behauptungen oder einem zentralen Produktablauf zu tun hat, wird viel aggressiver \u00fcberpr\u00fcft.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Bei Output mit geringem Risiko frage ich mich meistens, ob er vern\u00fcnftig aussieht und ins System passt. Bei Arbeiten mit mittlerem Risiko f\u00fcge ich Fragen hinzu, ob die eigentliche Aufgabe gel\u00f6st, die Einschr\u00e4nkungen respektiert und die unsch\u00f6nen F\u00e4lle behandelt wurden. Bei Arbeiten mit hohem Risiko, wie RevenueCat-Kaufcode, mehrsprachigem Publishing oder allem, was echte Kunden und echtes Geld ber\u00fchrt, erwarte ich Fundierung, Fehlererkennung, Kostenbewusstsein und Wartungskosten, die ich auch im n\u00e4chsten Quartal noch akzeptieren w\u00fcrde.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Dieser letzte Punkt ist wichtig, weil viel KI-Output nach dem ersten Arbeitsschritt stillschweigend versagt. Die Datei funktioniert, ist aber aufgebl\u00e4ht. Die Benutzeroberfl\u00e4che ist nah dran, aber die Struktur ist falsch. Die Logik bew\u00e4ltigt die Demo, wird dann aber m\u00fchsam zu erweitern. Kurzfristige Geschwindigkeit kann zu langfristigem Ballast f\u00fchren, wenn ich die erste funktionierende Antwort zu leichtfertig akzeptiere.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\">Was sich f\u00fcr mich ge\u00e4ndert hat<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">Ich mag immer noch Geschwindigkeit. Ich mag immer noch Feinschliff. Ich mag es immer noch, in Minuten statt in Stunden einen starken ersten Entwurf zu bekommen. Ich vertraue diesen Signalen jedoch weniger als fr\u00fcher, weil ich gesehen habe, wie oft sie vor der Zuverl\u00e4ssigkeit eintreffen.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Die Frage, die ich mir jetzt stelle, ist einfach: Was w\u00fcrde mich davon \u00fcberzeugen, dass diese Ausgabe es verdient, freigegeben zu werden? Diese Frage verlagert die Arbeit weg von isolierten Prompts und hin zu Systemen: Akzeptanzkriterien, Quellenbasierung, Projektkontext, automatisierte Pr\u00fcfungen, Review-Pfade, Kostenkontrollen und Praxistests. Das Modell ist immer noch wichtig, aber das Vertrauen wird im Workflow rund um das Modell verdient.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Ein erster Entwurf ist leichter zu bekommen als fr\u00fcher. Die schwierigere Arbeit besteht darin, ein ausreichendes Ger\u00fcst um mein Urteilsverm\u00f6gen herum aufzubauen, sodass ich es wiederholen kann, wenn ich m\u00fcde bin, schnell arbeite oder auf eine Ausgabe starre, die fertiger aussieht, als sie tats\u00e4chlich ist.<\/p>\n\n\n    \r\n    \r\n    \r\n            <!-- jtoc progress bar widget -->\r\n        <div class=\"wpj-jtoc--widget-progress --progress-top\">\r\n            <div class=\"wpj-jtoc--widget-progress-bar\"><\/div>\r\n        <\/div>\r\n    \r\n\r\n<div id=\"wpj-jtoc\" class=\"wpj-jtoc wpj-jtoc--main  --jtoc-the-content --jtoc-theme-modern --jtoc-toc-incontent-desktop --jtoc-toc-sidebar-desktop --jtoc-title-align-left --jtoc-toggle-icon --jtoc-toggle-position-right --jtoc-toggle-1 --jtoc-headings-full-row-clickable --jtoc-dynamic-mode --jtoc-slide-out-blend --jtoc-fade-past-headings --jtoc-has-custom-styles --jtoc-is-unfolded --jtoc-animate --jtoc-align-left --jtoc-main-is-hidden\"  style=\"display:none;\">\r\n                \r\n    <!-- TOC -->\r\n        <div class=\"wpj-jtoc--toc wpj-jtoc--toc-inline  --jtoc-is-hidden\" >\r\n                                <div class=\"wpj-jtoc--body\">\r\n                        <nav class=\"wpj-jtoc--nav\">\r\n                <ol class=\"wpj-jtoc--items\"><li class=\"wpj-jtoc--item --jtoc-h2\">\r\n        <div class=\"wpj-jtoc--item-content --jtoc-h2\" data-depth=\"2\">\r\n                                                <a href=\"#from-prompting-to-supervision\"  title=\"Vom Prompting zur \u00dcberwachung\" data-numeration=\"1\">Vom Prompting zur \u00dcberwachung<\/a>\r\n                    <\/div><\/li><li class=\"wpj-jtoc--item --jtoc-h2\">\r\n        <div class=\"wpj-jtoc--item-content --jtoc-h2\" data-depth=\"2\">\r\n                                                <a href=\"#the-job-is-deeper-than-the-visible-output\"  title=\"Die Aufgabe geht tiefer als die sichtbare Ausgabe\" data-numeration=\"2\">Die Aufgabe geht tiefer als die sichtbare Ausgabe<\/a>\r\n                    <\/div><\/li><li class=\"wpj-jtoc--item --jtoc-h2\">\r\n        <div class=\"wpj-jtoc--item-content --jtoc-h2\" data-depth=\"2\">\r\n                                                <a href=\"#constraints-have-to-be-explicit\"  title=\"Beschr\u00e4nkungen m\u00fcssen explizit sein\" data-numeration=\"3\">Beschr\u00e4nkungen m\u00fcssen explizit sein<\/a>\r\n                    <\/div><\/li><li class=\"wpj-jtoc--item --jtoc-h2\">\r\n        <div class=\"wpj-jtoc--item-content --jtoc-h2\" data-depth=\"2\">\r\n                                                <a href=\"#the-output-has-to-belong-to-the-system\"  title=\"Die Ausgabe muss zum System geh\u00f6ren\" data-numeration=\"4\">Die Ausgabe muss zum System geh\u00f6ren<\/a>\r\n                    <\/div><\/li><li class=\"wpj-jtoc--item --jtoc-h2\">\r\n        <div class=\"wpj-jtoc--item-content --jtoc-h2\" data-depth=\"2\">\r\n                                                <a href=\"#provenance-matters-most-when-the-writing-sounds-good\"  title=\"Die Herkunft ist am wichtigsten, wenn der Text gut klingt\" data-numeration=\"5\">Die Herkunft ist am wichtigsten, wenn der Text gut klingt<\/a>\r\n                    <\/div><\/li><li class=\"wpj-jtoc--item --jtoc-h2\">\r\n        <div class=\"wpj-jtoc--item-content --jtoc-h2\" data-depth=\"2\">\r\n                                                <a href=\"#good-demos-hide-weak-spots\"  title=\"Gute Demos verbergen Schwachstellen\" data-numeration=\"6\">Gute Demos verbergen Schwachstellen<\/a>\r\n                    <\/div><\/li><li class=\"wpj-jtoc--item --jtoc-h2\">\r\n        <div class=\"wpj-jtoc--item-content --jtoc-h2\" data-depth=\"2\">\r\n                                                <a href=\"#failure-has-to-be-visible\"  title=\"Fehler m\u00fcssen sichtbar sein\" data-numeration=\"7\">Fehler m\u00fcssen sichtbar sein<\/a>\r\n                    <\/div><\/li><li class=\"wpj-jtoc--item --jtoc-h2\">\r\n        <div class=\"wpj-jtoc--item-content --jtoc-h2\" data-depth=\"2\">\r\n                                                <a href=\"#review-should-scale-with-risk\"  title=\"\u00dcberpr\u00fcfungen sollten mit dem Risiko skalieren\" data-numeration=\"8\">\u00dcberpr\u00fcfungen sollten mit dem Risiko skalieren<\/a>\r\n                    <\/div><\/li><li class=\"wpj-jtoc--item --jtoc-h2\">\r\n        <div class=\"wpj-jtoc--item-content --jtoc-h2\" data-depth=\"2\">\r\n                                                <a href=\"#what-changed-for-me\"  title=\"Was sich f\u00fcr mich ge\u00e4ndert hat\" data-numeration=\"9\">Was sich f\u00fcr mich ge\u00e4ndert hat<\/a>\r\n                    <\/div><\/li><\/ol>            <\/nav>\r\n                                                            <\/div>\r\n            <\/div>\r\n    <\/div>","protected":false},"excerpt":{"rendered":"<p>Vom Prompting zur \u00dcberwachung Das erste Mal, als es bei mir Klick machte, \u00fcberpr\u00fcfte ich deutsche \u00dcbersetzungen eines benutzerdefinierten, Gemini-gest\u00fctzten Plugins, das ich f\u00fcr Christian Pure entwickelt hatte. Die Admin-Tabelle sah normal aus. Die Zeilen waren gef\u00fcllt. Die Auftr\u00e4ge waren als abgeschlossen markiert. Von Weitem sah es so aus, als h\u00e4tte das System die Arbeit erledigt. Dann \u00f6ffnete ich ein paar [\u2026]<\/p>","protected":false},"author":3,"featured_media":2658,"comment_status":"open","ping_status":"open","sticky":false,"template":"","format":"standard","meta":{"_jetpack_newsletter_access":"","_jetpack_dont_email_post_to_subs":false,"_jetpack_newsletter_tier_id":0,"_jetpack_memberships_contains_paywalled_content":false,"_vp_format_video_url":"","_vp_image_focal_point":[],"_vp_custom_popup_image":0,"_vp_format_audio_url":"","_vp_album_images":[],"_vp_custom_thumbnail":0,"_vp_custom_thumbnail_focal_point":[],"_vp_custom_thumbnail_cover":0,"_vp_hover_thumbnail":0,"_vp_hover_thumbnail_focal_point":[],"_wpcom_ai_launchpad_first_post":false,"_jetpack_feature_clip_id":0,"_jetpack_memberships_contains_paid_content":false,"footnotes":"","jetpack_post_was_ever_published":false},"categories":[19,6],"tags":[],"class_list":["post-2653","post","type-post","status-publish","format-standard","has-post-thumbnail","hentry","category-ai","category-writing"],"jetpack_sharing_enabled":true,"jetpack-related-posts":[{"id":2811,"url":"https:\/\/jamalnichols.com\/de\/ai-voice\/","url_meta":{"origin":2653,"position":0},"title":"If English Isn\u2019t Your First Language, Don\u2019t Let AI Become Your Voice","author":"jamalnichols","date":"Juni 7, 2026","format":false,"excerpt":"I understand why non-native English speakers reach for ChatGPT. You can be sharp in German, Hindi, Arabic, etc, then still have your job application, sales email, investor update, or blog post judged by how naturally you sound in English. That is a strange burden, and AI feels like relief: paste\u2026","rel":"","context":"In &quot;Commentary&quot;","block_context":{"text":"Commentary","link":"https:\/\/jamalnichols.com\/de\/category\/commentary\/"},"img":{"alt_text":"","src":"","width":0,"height":0},"classes":[]},{"id":1412,"url":"https:\/\/jamalnichols.com\/de\/europes-software-challenge\/","url_meta":{"origin":2653,"position":1},"title":"Europe\u2019s Software Challenge \u2014 and how to overcome it","author":"Jamal Nichols","date":"Mai 11, 2025","format":false,"excerpt":"Europe has no shortage of talent. It has smart founders, strong engineers, and serious product people. But on the global software stage, the US still operates at a different scale. That does not mean one region is \u201cbetter.\u201d It means the two systems produce different outcomes. Summary Europe has strong\u2026","rel":"","context":"In &quot;Essays&quot;","block_context":{"text":"Essays","link":"https:\/\/jamalnichols.com\/de\/category\/writing\/"},"img":{"alt_text":"","src":"https:\/\/jamalnichols.com\/wp-content\/uploads\/2025\/05\/FeaturedImg-EU@2x-e1775249217825.avif","width":350,"height":200,"srcset":"https:\/\/jamalnichols.com\/wp-content\/uploads\/2025\/05\/FeaturedImg-EU@2x-e1775249217825.avif 1x, https:\/\/jamalnichols.com\/wp-content\/uploads\/2025\/05\/FeaturedImg-EU@2x-e1775249217825.avif 1.5x, https:\/\/jamalnichols.com\/wp-content\/uploads\/2025\/05\/FeaturedImg-EU@2x-e1775249217825.avif 2x, https:\/\/jamalnichols.com\/wp-content\/uploads\/2025\/05\/FeaturedImg-EU@2x-e1775249217825.avif 3x"},"classes":[]},{"id":1982,"url":"https:\/\/jamalnichols.com\/de\/ai-design-workflow\/","url_meta":{"origin":2653,"position":2},"title":"How I Ship Real Products with AI-Assisted Product Design","author":"Jamal Nichols","date":"Februar 25, 2026","format":false,"excerpt":"A few months ago, I exported a FlutterFlow project into Claude Code. I have not opened FlutterFlow since. That sounds cleaner than the actual experience felt at the time, which was more like realizing that a tool I had depended on was no longer the center of the work. My\u2026","rel":"","context":"In &quot;AI&quot;","block_context":{"text":"AI","link":"https:\/\/jamalnichols.com\/de\/category\/ai\/"},"img":{"alt_text":"","src":"https:\/\/jamalnichols.com\/wp-content\/uploads\/2026\/02\/FeaturedImg-Prototype@2x-e1775415036641.avif","width":350,"height":200,"srcset":"https:\/\/jamalnichols.com\/wp-content\/uploads\/2026\/02\/FeaturedImg-Prototype@2x-e1775415036641.avif 1x, https:\/\/jamalnichols.com\/wp-content\/uploads\/2026\/02\/FeaturedImg-Prototype@2x-e1775415036641.avif 1.5x, https:\/\/jamalnichols.com\/wp-content\/uploads\/2026\/02\/FeaturedImg-Prototype@2x-e1775415036641.avif 2x, https:\/\/jamalnichols.com\/wp-content\/uploads\/2026\/02\/FeaturedImg-Prototype@2x-e1775415036641.avif 3x"},"classes":[]},{"id":2724,"url":"https:\/\/jamalnichols.com\/de\/claude-design-quick-review\/","url_meta":{"origin":2653,"position":3},"title":"Claude Design Quick Review","author":"jamalnichols","date":"Mai 20, 2026","format":false,"excerpt":"Tried Claude Design last week. I really like it. Would I give it my highest leverage, most complex work? No. But not all work is like that. There is a ton of work that's not very challenging for me at this stage of my career, but still needs to get\u2026","rel":"","context":"In &quot;Commentary&quot;","block_context":{"text":"Commentary","link":"https:\/\/jamalnichols.com\/de\/category\/commentary\/"},"img":{"alt_text":"","src":"https:\/\/jamalnichols.com\/wp-content\/uploads\/2026\/05\/Screenshot-2026-05-20-at-11.03.38-AM-e1779267872134.avif","width":350,"height":200,"srcset":"https:\/\/jamalnichols.com\/wp-content\/uploads\/2026\/05\/Screenshot-2026-05-20-at-11.03.38-AM-e1779267872134.avif 1x, https:\/\/jamalnichols.com\/wp-content\/uploads\/2026\/05\/Screenshot-2026-05-20-at-11.03.38-AM-e1779267872134.avif 1.5x, https:\/\/jamalnichols.com\/wp-content\/uploads\/2026\/05\/Screenshot-2026-05-20-at-11.03.38-AM-e1779267872134.avif 2x, https:\/\/jamalnichols.com\/wp-content\/uploads\/2026\/05\/Screenshot-2026-05-20-at-11.03.38-AM-e1779267872134.avif 3x, https:\/\/jamalnichols.com\/wp-content\/uploads\/2026\/05\/Screenshot-2026-05-20-at-11.03.38-AM-e1779267872134.avif 4x"},"classes":[]},{"id":1928,"url":"https:\/\/jamalnichols.com\/de\/halo\/","url_meta":{"origin":2653,"position":4},"title":"Halo: Family Bedtime Routines","author":"Jamal Nichols","date":"Oktober 29, 2025","format":false,"excerpt":"I built Halo because bedtime kept becoming a screen-time problem. I researched, designed, engineered, and shipped the five-language audio app on iOS and Android.","rel":"","context":"In &quot;AI&quot;","block_context":{"text":"AI","link":"https:\/\/jamalnichols.com\/de\/category\/ai\/"},"img":{"alt_text":"","src":"https:\/\/jamalnichols.com\/wp-content\/uploads\/2025\/10\/Slide-16_9-1.avif","width":350,"height":200,"srcset":"https:\/\/jamalnichols.com\/wp-content\/uploads\/2025\/10\/Slide-16_9-1.avif 1x, https:\/\/jamalnichols.com\/wp-content\/uploads\/2025\/10\/Slide-16_9-1.avif 1.5x, https:\/\/jamalnichols.com\/wp-content\/uploads\/2025\/10\/Slide-16_9-1.avif 2x, https:\/\/jamalnichols.com\/wp-content\/uploads\/2025\/10\/Slide-16_9-1.avif 3x"},"classes":[]},{"id":1576,"url":"https:\/\/jamalnichols.com\/de\/facebook-interview-marketplace\/","url_meta":{"origin":2653,"position":5},"title":"Facebook: Interviewer Marketplace","author":"Jamal Nichols","date":"Juni 19, 2025","format":false,"excerpt":"This stuff is old (2020), but people keep asking about it, so I put it up. Facebook: Interviewer Marketplace My role: Leadership in helping young team identify an opportunity, design a solution end-to-end, and using design superpowers to help team visualize early ideas and pivot Team Composition: Enterprise Engineering: Schedule\u2026","rel":"","context":"In &quot;Pre-AI Work&quot;","block_context":{"text":"Pre-AI Work","link":"https:\/\/jamalnichols.com\/de\/category\/pre-ai\/"},"img":{"alt_text":"","src":"https:\/\/jamalnichols.com\/wp-content\/uploads\/2025\/05\/Screenshot-2025-06-23-at-3.20.55\u202fPM-e1750684893330.avif","width":350,"height":200,"srcset":"https:\/\/jamalnichols.com\/wp-content\/uploads\/2025\/05\/Screenshot-2025-06-23-at-3.20.55\u202fPM-e1750684893330.avif 1x, https:\/\/jamalnichols.com\/wp-content\/uploads\/2025\/05\/Screenshot-2025-06-23-at-3.20.55\u202fPM-e1750684893330.avif 1.5x, https:\/\/jamalnichols.com\/wp-content\/uploads\/2025\/05\/Screenshot-2025-06-23-at-3.20.55\u202fPM-e1750684893330.avif 2x, https:\/\/jamalnichols.com\/wp-content\/uploads\/2025\/05\/Screenshot-2025-06-23-at-3.20.55\u202fPM-e1750684893330.avif 3x"},"classes":[]}],"jetpack_shortlink":"https:\/\/wp.me\/phbeCp-GN","jetpack_featured_media_url":"https:\/\/jamalnichols.com\/wp-content\/uploads\/2026\/04\/FeaturedImg-AiOutput@2x-e1776681465417.avif","_links":{"self":[{"href":"https:\/\/jamalnichols.com\/de\/wp-json\/wp\/v2\/posts\/2653","targetHints":{"allow":["GET"]}}],"collection":[{"href":"https:\/\/jamalnichols.com\/de\/wp-json\/wp\/v2\/posts"}],"about":[{"href":"https:\/\/jamalnichols.com\/de\/wp-json\/wp\/v2\/types\/post"}],"author":[{"embeddable":true,"href":"https:\/\/jamalnichols.com\/de\/wp-json\/wp\/v2\/users\/3"}],"replies":[{"embeddable":true,"href":"https:\/\/jamalnichols.com\/de\/wp-json\/wp\/v2\/comments?post=2653"}],"version-history":[{"count":11,"href":"https:\/\/jamalnichols.com\/de\/wp-json\/wp\/v2\/posts\/2653\/revisions"}],"predecessor-version":[{"id":2790,"href":"https:\/\/jamalnichols.com\/de\/wp-json\/wp\/v2\/posts\/2653\/revisions\/2790"}],"wp:featuredmedia":[{"embeddable":true,"href":"https:\/\/jamalnichols.com\/de\/wp-json\/wp\/v2\/media\/2658"}],"wp:attachment":[{"href":"https:\/\/jamalnichols.com\/de\/wp-json\/wp\/v2\/media?parent=2653"}],"wp:term":[{"taxonomy":"category","embeddable":true,"href":"https:\/\/jamalnichols.com\/de\/wp-json\/wp\/v2\/categories?post=2653"},{"taxonomy":"post_tag","embeddable":true,"href":"https:\/\/jamalnichols.com\/de\/wp-json\/wp\/v2\/tags?post=2653"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}