Claude își construiește deja propriii succesori, dar adevăratul pilot automat este încă departe
Dezvoltarea inteligenței artificiale începe să devină un proces oarecum circular. Anthropic a dezvăluit că Claude „coordonează” deja 26% din activitatea de cercetare și dezvoltare în domeniul AI a companiei. În februarie, aceeași pondere era sub 1%. Și mai impresionant este că AI-ul participă, cel puțin în calitate de colaborator, la peste 90% din activitatea de dezvoltare a Anthropic.
Înainte de a ne lăsa însă purtați de scenarii științifico-fantastice, merită să definim termenii. Claude nu stă într-un laborator digital și nu decide independent ce model mai inteligent decât el însuși să construiască în continuare.
Anthropic folosește o scară de automatizare de la AL0 la AL5. AL4, nivelul descris drept „coordonează”, înseamnă că AI-ul primește de la un om o sarcină generală și poate realiza singur cea mai mare parte a acesteia, de la început până la sfârșit. O persoană monitorizează activitatea, dar nu mai trebuie să precizeze în prealabil fiecare etapă. AL5 ar însemna autonomie deplină, fără intervenție umană, iar în activitatea de dezvoltare evaluată de Anthropic, Claude nu a atins încă acest nivel în niciun domeniu.
Saltul de la 1% la 26% contează mai mult decât titlul atrăgător
Cel mai remarcabil aspect nu este nici măcar nivelul actual de 26%, ci viteza schimbării. În februarie, ponderea activității coordonate de Claude era încă sub 1%.
Astfel apare o buclă de feedback destul de interesantă în dezvoltarea AI. Un model mai performant îi ajută pe cercetători și ingineri să construiască următorul model, care, la rândul său, ar trebui să poată prelua o parte și mai mare din munca necesară dezvoltării generației următoare.
Un exemplu recent oferit de Anthropic arată ce înseamnă în practică o asemenea împărțire a muncii. În mai puțin de patru săptămâni, Claude a optimizat peste 30 de modele open-source pentru modelare biomoleculară, făcându-le, în medie, de aproximativ patru ori mai rapide.
Așadar, nu mai este vorba doar despre un chatbot care scrie câteva linii de cod Python pentru un inginer. Agenților li se pot încredința pachete de lucru complete, de dimensiuni tot mai mari.
Aproximativ 30.000 de agenți AI lucrează simultan în laboratorul Anthropic
Amploarea face situația și mai interesantă. Pe platforma internă cea mai utilizată a Anthropic, aproximativ 30.000 de agenți lucrează simultan la sarcini de cercetare și inginerie. Compania controlează activitatea agenților prin sisteme automate de siguranță.
Acesta ilustrează destul de bine cum începe să arate în realitate „AI-ul la locul de muncă”. O singură fereastră de conversație cu Claude nu este deosebit de interesantă. Zeci de mii de agenți care rezolvă sarcini în paralel sunt însă interesanți.
Anthropic pune accent pe supraveghere deoarece, cu cât sarcinile încredințate agenților sunt mai ample, cu atât deciziile pe care aceștia le iau în timpul activității devin mai importante. La un moment dat, întrebarea nu mai este dacă modelul a scris linia corectă de cod, ci ce direcție de cercetare a ales de la bun început.
Procentul trebuie totuși privit cu o oarecare rezervă
Procentul de 26% nu provine dintr-un audit independent și nici nu reprezintă un standard universal al industriei. Indicatorul a fost dezvoltat de Anthropic, iar compania însăși recunoaște că își folosește propriile modele pentru evaluarea sistemelor. Acest lucru poate crea o situație în care modelul care face evaluarea comite aceleași erori ca modelul evaluat. În plus, laboratoarele de AI nu dispun în prezent de o metodologie comună care să permită compararea echitabilă, directă, a cifrelor publicate de Anthropic, OpenAI și Google DeepMind.
Prin urmare, ar fi prematur să afirmăm că Claude realizează deja un sfert din munca cercetătorilor Anthropic sau că se dezvoltă singur, în mod autonom.
O concluzie mult mai exactă — și, de fapt, mai interesantă — este următoarea: într-o parte tot mai mare din dezvoltarea AI de ultimă generație, oamenii trec de la rolul de executanți direcți la cel de coordonatori care stabilesc sarcinile și supraveghează realizarea lor.
Dacă, potrivit indicatorului Anthropic, Claude putea coordona în februarie mai puțin de 1% din activitatea de dezvoltare, iar în august ajunsese deja la 26%, această evoluție este principalul aspect de urmărit în rapoartele viitoare. AI-ul care contribuie la construirea următorului AI nu mai este o idee pur teoretică. Deocamdată, are însă în continuare nevoie de un om alături.