„Nu putem vedea decât la o distanță mică înainte, dar putem vedea acolo destule lucruri care trebuie făcute.”Alan M. Turing · Computing Machinery and Intelligence · 1950 · Computing Machinery and Intelligence, Mind 59(236), octombrie 1950 — ultima frază
Un proces, un agent, evaluări înainte de autonomie, buget, urmă și proprietar.
Starea în septembrie 2026: agenții care folosesc calculatorul au urcat de la circa 15% la circa 66% pe testele de clasa OSWorld într-un an (Stanford AI Index 2026); protocoalele au trecut sub guvernare neutră (MCP și A2A la Linux Foundation); „abilitățile” împachetate ca instrucțiuni au devenit format deschis; lucrătorii sunt modele mici. Gartner (iunie 2025) așteaptă ca peste 40% din proiectele agentice să fie anulate până la finalul lui 2027, pe cost, ROI neclar și control de risc slab; raportul MIT NANDA (august 2025) găsește 95% din pilotele GenAI fără efect măsurabil în profit, cu cauza în organizare, nu în model. Ce faci lunea viitoare: un proces, un agent, evaluări înainte de autonomie, un buget, o urmă, un proprietar. Fraza lui Turing e postura corectă: nu prezici; livrezi următorul lucru care trebuie făcut și îl măsori.
Turing spunea că vedem puțin înainte, dar destul ca să lucrăm. În 2026 asta devine o regulă de management. Modelele au devenit aproape identice între ele la sarcini practice. Diferența o face restul sistemului: cine definește ce înseamnă „rezolvat”, cine oprește agentul când greșește, cine plătește factura. Gandeste-te la o echipă care automatizează raportarea săptămânală. Modelul e la fel pentru toți. Cine are un test simplu de verificat și un om răspunzător livrează; ceilalți descoperă la trei luni că agentul a umplut foaia cu ceva plauzibil dar greșit. Abilitatea rară nu mai e alegerea modelului, ci proiectarea evaluării. Următorul pas: cum arată, concret, o evaluare bună pentru un agent.
Pasajul 1 s-a terminat cu întrebarea: cum arată o evaluare bună? Răspunsul scurt: înainte de autonomie, nu după. Mai întâi rulezi agentul pe sarcini vechi, cu răspunsuri pe care le cunoști deja. Dacă greșește acolo, nu-l lași liber pe calculator. Abia apoi îi dai acces, cu pași mici. Exemplu concret: agentul care face rezervări de călătorie. Îl testezi pe zece rezervări din trecut, unde știi ce ar fi trebuit să rezerve. Dacă bifează zece din zece, îi dai o lună reală, dar cu plafon de buget și raport zilnic. Dacă bifează șapte, oprești și repari. E ca la angajarea unui om nou: nu-l lași să semneze contracte în prima săptămână. Evaluarea nu e un formular; e frâna care decide cât acces primește agentul. Iar frâna are nevoie de cineva care s-o apuce. Următorul pas: cine e, concret, proprietarul agentului.
De ce contează Diferența dintre cei 5% și restul n-a fost modelul, ci evaluările, gardurile și un proprietar.