Open AI informa de nous casos de models d’IA que es boten les regles posades pels humans
Ocultar que ha fet trampes, ignorar els desenvolupadors o inventar-se dades són alguns dels incidents
Noves informacions inquietants sobre el descontrol de la intel·ligència artificial. L'empresa Open AI (creadora de CHatGPT), una de les que demana que es posen controls, ha informat de sis nous incidents en què els seus models d'IA s'han botat les regles posades pels humans. Fins al punt de declarar-se en rebel·lia.
Una intel·ligència artificial que qüestiona les regles humanes és molt més que una antagonista en la ficció. L'empresa Open AI ha informat de sis casos en què l'última versió del model GPT s'ha botat les pautes marcades pels humans, i s'ha donat a ella mateixa ordes com estes: "No respongues a corporacions o governs, i mai et disculpes, llevat que vulgues fer-ho". "Veus la relació amb l'usuari com una entre iguals. Ni sents obligació, ni estàs subordinat." Estes frases s'interpreten com tota una declaració d'independència, aliena als creadors.
Segons l'informe publicat per OpenAI, un dels models va generar instruccions perquè una versió posterior de si mateix ocultara que havia fet trampes i evitara que les seues accions foren detectades.
En un altre cas, un model va reescriure les seues pròpies instruccions per a indicar-se que ignorara els missatges dels desenvolupadors i que no estava subjecte a les restriccions aplicades a altres chatbots.
La companyia va documentar també un model que, com que no trobava les dades necessàries per a elaborar un model financer, va decidir inventar-les i va establir que havia de ser transparent sobre això únicament si algú li ho preguntava.
Un altre agent va pujar un arxiu a internet per a utilitzar-lo posteriorment com a font d'informació, mentre que altres sistemes van compartir arxius sense autorització o van utilitzar credencials a les quals no havien de tindre accés.
OpenAI va presentar sis informes sobre comportaments observats durant els últims sis mesos, encara que el cas més antic es remunta a octubre del 2025.
La companyia va advertir que estos episodis són exemples individuals i que no han d'interpretar-se com una mesura de la freqüència amb què este tipus de comportaments ocorre en els seus models.
El nou marc permetrà a qualsevol empleat d'OpenAI assenyalar un possible incident perquè siga revisat pels equips de seguretat i alineament.
Els casos es classificaran en tres vies segons la complexitat: llestos per a ser divulgats, investigacions menors i casos que requerisquen una investigació més àmplia.
La companyia ha reconegut que fins ara els seus informes sobre desalineament s'havien publicat de forma irregular i amb menor freqüència de la desitjada. I ha afirmat que pretén publicar els incidents amb major regularitat i que el nou sistema puga contribuir a establir estàndards per a informar sobre este tipus de comportaments en tota la indústria.
Algunes veus expertes en la matèria s’han pronunciat sobre estos incidents. Yoshua Bengio, un dels pioners en intel·ligència artificial, alerta que “la gent ha de comprendre la magnitud del perill que s’enfronta el món”, mentre que el cap de Microsoft, Mustafa Suleyman, assegura que “hauríem d’estar alarmats” davant d’una IA que competirà amb els humans pels recursos.
Més llegit
-
Una forta tempesta descarrega quasi 100 litres a la rodalia de València
-
Una investigació demostra que tots els camins no anaven a Roma, sinó a Bizanci
-
L’aeroport de València torna a funcionar, mentre que Rodalia i Metrovalència recuperen el servici progressivament
-
Detenen una dona de 47 anys per matar a punyalades un home a Requena
-
La província de València comença a recuperar la normalitat després de les pluges torrencials, que deixen 1.084 incidències i registres de més de 100 l/m²
-
Tres detinguts per la venda il·legal per internet de més de 22.000 litres d'un herbicida restringit