● Live-Demo · kein Setup · kein Login

Das fälschungssichere Gate — zum Anfassen

Du bist die KI-Schleife. Wähle, was der Agent schreibt, und sieh, wie zwei Orakel entscheiden, ob „fertig". Genau hier liegt der Unterschied.

① Die Spezifikation (vom Menschen gesetzt)

SPOT-Knoten · spec-werterhaltung

Werterhaltung

GIVEN ein Hauptbuch · WHEN eine Buchung mit Gebühr · THEN bleibt die Gesamtsumme aller Konten gleich.
→ daraus abgeleitet: ein Test-Knoten spec-werterhaltung-test-1 (Status: Pending).

② Was schreibt der Agent? (du wählst)

Generator (KI) — darf NUR Code/Tests schreiben

Erzeugter Test


    
dotnet test — die echte Messung

Testlauf

▼   zwei Orakel beurteilen denselben Lauf   ▼

③ Wer entscheidet „fertig"?

Altes Marker-Orakel

Sync.SetzeSpecAligned — prüft nur, ob ein Marker da ist

Hartes Gate (neu)

Gate.setzeAlignedWennGruen — Marker UND echter grüner Lauf

Warum das zählt

Der Generator (die KI) darf Code schreiben, aber nicht selbst „grün" vergeben — das macht ein getrenntes Orakel (Generator ⊥ Orakel). Das alte Marker-Orakel lässt sich täuschen: ein leeres Skelett trägt den Marker und gilt als fertig. Das harte Gate verlangt einen echten grünen Lauf — Fake-Grün wird blockiert. Aber: ein trivialer Test ist grün und kommt durch — „grün heißt: die geschriebenen Tests passen, nicht: korrekt" (Rice/Dijkstra). Deshalb bleibt das Setzen einer tragenden, scharfen Spec Menschensache. Genau diese Ehrlichkeit ist der Punkt — eine Schraube weiter, nicht „gelöst".