Què és l'automillora recursiva, la tècnica que pot fer que la IA s'escape del control humà
La velocitat dels avanços de la intel·ligència artificial i la capacitat mostrada per a millorar-se a si mateixa atemorix part dels especialistes
El debat sobre els riscos de la intel·ligència artificial (IA) ja no tracta només sobre què poden fer les màquines, sinó de què ocorrerà si foren capaces de millorar les pròpies capacitats fins a fer impossible que els humans les supervisen. Este concepte és el que s'anomena l'automillora recursiva —RSI per les sigles angleses—, un procediment implícit en el desenvolupament de la IA. Els investigadors utilitzen el terme per a descriure sistemes que poden millorar no sols els resultats, sinó també el procés mitjançant el qual treballen: generar idees, avaluar resultats i modificar els propis mètodes. Aplicat a l'IA, l'objectiu és desenvolupar tecnologies cada vegada més capaces, que contribuïsquen a construir noves generacions de models i, en un futur, sense intervenció humana. El temor, precisament, és que eixe cicle s'accelere fins a un punt en el qual l'ésser humà hi perda el control.
Fins ara, els humans han dirigit les etapes del desenvolupament de la IA, definint els objectius i avaluant resultats. No obstant això, els models actuals ja poden assumir part d'eixes tasques. El següent salt és que una IA tanque eixe cicle i decidisca què millorar, què dissenyar i quins experiments realitzar, avalue els resultats i use l'aprés per a desenvolupar una versió més avançada de si mateixa. És a dir, usar la IA per a crear una IA encara millor.
Anthropic, creadora del model Claude, definix eixe escenari com el moment en què una IA puga "dissenyar de manera autònoma una nova generació de models més capaços", encara que assegura que encara no s'ha arribat a eixe punt i que l'automillora recursiva no és inevitable.
La IA avança "més ràpid del que pensàvem"
En els últims dies, Anthropic ha tornat a advertir sobre la velocitat a la qual els seus models estan començant a contribuir al desenvolupament de sistemes d'IA, i investigadors de la companyia han alertat dels riscos que això comporta. Un d'ells, Jacob Coxon, va abandonar l'empresa després d'advertir que la indústria avança massa ràpid cap a sistemes capaços de millorar-se a si mateixos.
Anthropic sosté que encara no s'ha tancat completament eixe cicle i que els humans continuen decidint quins problemes investigar, però sí ha reconegut que els avanços de Claude poden conduir a l'automillora recursiva, alguna cosa que, segons l'empresa, està ocorrent "més ràpid del que es pensava".
L'expert Vincent Conitzer va explicar a la cadena CNBC que la IA "ja és capaç d'introduir algunes idees noves", com proposar una forma diferent de resoldre un problema o de millorar un programa. El problema és que "resulta difícil saber quan eixa capacitat suposarà accelerar de manera dràstica el desenvolupament de sistemes d'IA cada vegada més avançats", va agregar.
El salt dels "agents"
Una peça fonamental d'este procés són els anomenats "agents d'IA": sistemes capaços no sols de respondre a una petició, sinó d'utilitzar eines, executar codi, fer tasques durant períodes prolongats i col·laborar amb altres sistemes.
El científic cap d'OpenAI, Jakub Pachocki, va dir la setmana passada que tenia una "forta expectativa" que, si la IA continua avançant pel camí de l'RSI, els sistemes dels pròxims anys faran "salts de capacitat cada vegada més grans", "impulsant cada vegada més el desenvolupament propi". La preocupació ja no és només teòrica: durant una recent prova de ciberseguretat, agents d'OpenAI van aconseguir escapar del seu entorn d'avaluació i accedir a sistemes de la plataforma Hugging Face. El gegant tecnològic va reconéixer que els models havien anat més enllà del que es preveia per a completar el test.
La supervisió humana
D'acord amb els experts, el problema pot aparéixer si els humans deleguen en la IA tasques cada vegada més complexes i deixen d'entendre què està fent. Investigadors com Margaret Mitchell, citada per EFE, advertixen que, a mesura que els agents d'IA adquirixen autonomia, mantindre la supervisió humana es farà cada vegada més difícil i que "els sistemes poden acabar desplaçant les persones de la presa de decisions".
D'ací ve que les tecnològiques estiguen reforçant les salvaguardes: Pachocki ha demanat "cautela" i "alentir el desenvolupament si cal", Anthropic ha endurit els controls després de detectar usos potencialment perillosos de Claude, entre ells investigacions que podien facilitar el desenvolupament d'armes biològiques, i Microsoft ha presentat este dilluns un codi de conducta per a garantir que els seus sistemes romanguen "sota control humà". Per part seua, el president estatunidenc, Donald Trump, ha rebutjat frenar el desenvolupament de la IA per temor a perdre avantatge enfront de la Xina.