Pa baš zato mi ovo ne pije vodu nikako. Imam vrlo konkretno iskustvo sa GPT-om i Codexom na složenom editovanju Android kernela. Posle nekih 300 poruka model više nema pojma gde se nalazi u operaciji. Moraš da mu vraćaš kontekst, objašnjavaš šta je već urađeno i proveravaš da li je upravo izmislio gde se nalazi.
A to je operacija u okviru jednog razgovora, sa svim tim "shared memory", alatima i kontekstom.
Zato mi je malo smešno da iz self correcting loop + memory + orchestration odmah pređemo na "održavanje softvera više ne postoji".
Prvo rešite da agent posle 200 koraka zna gde je bio.
Ti mu objašnjavaš šta je već urađeno, on ti mrtav ladan tvrdi nešto što si mu već tri puta dokazao da nije tako. Vraćaš ga na prethodni korak, on opet ode negde levo. Na kraju mu jebeš mater kao da ispred sebe imaš senilnog dedu koji iz svake prošle poruke izvlači random zaključke, jer se više ne seća šta je radio pre 100 poruka.
E, sad zamisli da mu poveriš održavanje ozbiljnog sistema nekoliko dana.
Meni prvo to rešite, pa onda pričamo da software engineering nestaje.