Unter dem Namen Adrian Verdan, dem Publishing-Imprint von Dargel Solutions, veröffentlichen wir Berichte über die eigene Automatisierung — jeder aus einem konkreten Fehlschlag, mit Datum, Logauszug und der Änderung, die daraus folgte. Jeder Bericht steht hier im vollständigen englischen Original, die meisten zusätzlich bei Medium. Frei lesbar, ohne Anmeldung.
Drei KI-Modelle bewerteten die Bilder meines Social-Media-Bots. Einer lobte fast alles, einer gab allem fast dieselbe Note, und der, den ich behielt, notierte den Defekt und ließ das Bild trotzdem durch. Betriebsessay im englischen Original.
Das Teil, das der Richter „disconnected“ nannte, und seine drei Noten über meinen Schwellen. (Render: KI-generierte Illustration)
Ein Abnahmeapparat für KI-Agenten prüfte vier Tage lang sich selbst: was das Gate kostete, was es fing, die Tür, die ich neben mein eigenes Gate baute, und was ich abgeschaltet habe — jede Zahl aus meinen eigenen Aufzeichnungen.
Ein Vorhaben, vier Rahmen tief, und ein Plan, den niemand ausgefüllt hat.
Fünf wiederholte KI-Prüfläufe bevorzugten einstimmig die bewegtere Filmszene. Vier meldeten zugleich einen Major; einer dieser Berichte zeigte, wie die Bilder offene Aufgaben im Archiv verschwinden ließen und das Fortschritt nannten. Warum ein 5:0 eine Richtung wählen, aber keine Freigabe erteilen darf.
Fünf Präferenzen. Eine unerfüllte Abnahmeregel. (KI-generierte Illustration)
Fünfzehn Regeln, 457 grüne Tests, 77 von 77 getöteten Mutanten — und kein einziges Testdokument des eigenen Layout-Prüfers enthielt eine Abbildung, die er messen kann, während 40 von 74 verkauften Produktseiten eine tragen. Ein Prüfkorpus, der geschrieben wurde, damit die Tests bestehen, misst den Autor, nicht die Welt.
Neun Läufe auf drei selbst geschriebenen Testdateien, derselbe Prompt, derselbe Morgen — einzige Variable war das Modell. Das günstigere Modell übersah einen absichtlich fehlenden Eintrag in vier von fünf Läufen, das teurere fand ihn in vier von vier.
Sechs Produkte, fünf Wochen, ein einziger Käufer, der zweimal kaufte. Beim Prüfen der eigenen Website-Zähler stellte sich einer als falsch heraus — den zweiten fand erst ein fremder Leser. Am Ende steht eine Behauptung weniger als am Anfang.
Der Zweitmeinungs-Runner brach mit Exit-Code 7 ab und schrieb keine Datei — zwölf Tage lang, unbemerkt. Schweigen und Zustimmung sehen im Protokoll gleich aus. Der Bericht korrigiert dabei die Zahl in seiner eigenen Überschrift.
Ein Adapter las camelCase, während die Schnittstelle snake_case lieferte. Die Tests blieben grün, weil sie genau das prüften, was der Code tat. Der Bericht zeigt, woran ein Prüfmittel erkennbar wird, das nur seine eigene Annahme misst.
Vom 23. bis zum 28. Juli veröffentlichte unser Marketing-Bot fast nichts: drei Nulltage am 23., 27. und 28., dazwischen drei, zwei und ein Post. Kein Absturz, keine Fehlermeldung — an den Nulltagen ergaben Tageslimit, Sicherungsschalter, Bildkontingent und Freigabe-Gate, jedes für sich richtig gesetzt, zusammen null. Der Bericht rechnet die gemeinsame Kapazität nach.