Agenttinen ohjelmistotuotanto jossa epäluotettavasta moottorista tehdään luotettava järjestelmä rakenteella, ei toiveella. Tämä ei ole vibe coding.
Ongelma ei ole malli. Ongelma on rakenteen puute. Malli tuottaa koodia jota et uskalla mergetä, koska mikään ei takaa että se on oikein, ei vain vihreä.
LLM on epäluotettava komponentti: sama syöte tuottaa eri tuloksen eri kerroilla, konteksti rapautuu. Sitä ei korjata paremmalla promptilla vaan rakenteella ja porteilla. Rakenne tekee epäluotettavasta moottorista luotettavan järjestelmän, kuten TCP epäluotettavasta verkosta.
Pelkkä testivalidointi hyväksyi tämän. Tämä on tarkalleen se mitä pelkäät agenttikehityksessä: vihreä ei tarkoita oikein.
Eksakti ja toistettava, exact-match. 0 token. Läpi tai ei.
Eri malli arvioi: vastaako specia vai pelaako testejä. Tunnisti stateful-huijauksen joka kerta.
Ajot ja virhemoodit kirjataan. Sama virhe ei toistu. Audit trail syntyy itsestään.
Lisäksi: testit johdetaan ERI agentilla kuin toteutus, circuit breaker pysäyttää hallusinaatioloopin. Validointi on välttämätön muttei riittävä.
Speksausvaihe pakottaa jokaiselle komponentille: riskLevel, henkilötiedot, peruuttamattomat toiminnot, HITL-piste. Ihminen hyväksyy päätöskohdissa (speksaus, arkkitehtuuri, merge, deploy). Jokainen ajo lokitetaan.
Boilerplate, muotoilu.
Toteutus, testit, korjaukset. Työhevonen.
Päätökset, kriittinen arviointi.
Testit, build, validointi koodina.
Token-kulutus on harkittua, ei sattumaa. Circuit breaker estää karkaamisen. Kustannus on ennustettava, ei yllätys laskulla.
Katso putki ajossa: speksaus, golden-testit, self-healing loop, review-portti, PR. Et osta lupausta vaan näet kurin toiminnassa.