comparte

Banner de FIRSTonline

OpenAI bloquea el lanzamiento de un nuevo modelo de IA por motivos de seguridad, mientras que Anthropic advierte de "riesgos existenciales para la humanidad".

OpenAI avrebbe voluto lanciare Gpt-6.1 Astra nel giro di qualche settimana. Il modello però non è risultato abbastanza affidabile per essere rilasciato in sicurezza

OpenAI bloquea el lanzamiento de un nuevo modelo de IA por motivos de seguridad, mientras que Anthropic advierte de "riesgos existenciales para la humanidad".

OpenAi ha deciso di rinunciare al lancio del suo ultimo modello di intelligenza di nuova generazione a causa dei timori sulla sicurezza sollevati dai ricercatori durante i test. La startup guidata da Sam Altman avrebbe voluto lanciare Gpt-6.1 Astra nel giro di qualche settimana. Il modello però non è risultato abbastanza affidabile per essere rilasciato in sicurezza.  

La notizia si inserisce nel dibattito sulla sicurezza dell’IA lanciato dai ceo delle principali società del settore, da Anthropic a OpenAi, appunto, che nelle ultime settimane si erano detti d’accordo sulla necessità di imporre maggiori controlli al settore nonostante la netta contrarietà del presidente statunitense Donald Trump, secondo cui nuove regolamentazioni permetterebbero alla Cina di superare gli Stati Uniti nella corsa all’IA, un sorpasso che la Casa Bianca ha tutte le intenzioni di impedire. 

OpenAi: “Modello poco affidabile e propenso all’inganno”

De acuerdo con el Wall Street Journal alla base del passo indietro ci sarebbero preoccupazioni in materia di sicurezza sollevate dai ricercatori durante i test interni. Saachi Jain, responsabile dei sistemi di sicurezza di OpenAi, ha infatti spiegato che il modello ha ottenuto risultati scadenti nell’allineamento, ovvero nella capacità di attenersi alle aspettative degli umani, e ha mostrato una maggiore propensione all’inganno. Tra le criticità emerse figurerebbe “l’autorizzazione all’ambito d’azione”, ovvero il fatto che il modello procedesse in un compito senza chiedere il permesso all’utente e, in alcune occasioni, usasse strumenti e servizi esterni anche se ciò poteva risultare pericoloso.

Astra 6.1, “pur rappresentando un miglioramento rispetto ai modelli precedenti sotto alcuni aspetti, non ha raggiunto gli standard richiesti per quanto riguarda il rispetto dei limiti operativi e delle autorizzazioni, nonché le modalità di comunicazione all’utente in merito al lavoro svolto”, ha spiegato ancora Jain. “Vogliamo garantire che lo sviluppo dei nostri modelli avvenga in sicurezza, sia all’interno dell’azienda che al momento del rilascio agli utenti. Quando rendiamo un modello disponibile agli utenti, applichiamo criteri estremamente rigorosi in termini di sicurezza e allineamento”, ha aggiunto.

Anthropic: nel prospetto Opa avverte sui “rischi per l’umanità”

In un contesto in cui i timori per la sicurezza diventano di giorno in giorno più elevati, un altro campanello d’allarme arriva dalla rivale diretta di OpenAI. Anthropic ha avvertito gli investitori che la sua tecnologia potrebbe comportare “rischi esistenziali per l’umanità”. La Financial Times, secondo cui l’allarme sarebbe stato inserito nel prospetto per la quotazione in Borsa. 

Secondo Pie, la startup guidata da Dario Amodei ha dedicato quasi un terzo della sua lunga documentazione alla descrizione dettagliata dei “fattori di rischio”, tra cui la possibilità che modelli di IA sempre più avanzati manipolino, ricattino e mostrino altri comportamenti imprevedibili.

Revisión