Fondato nel 1996 da Angelo Maria Perrino
Direttore responsabile Marco Scotti

Home » Mediatech » Intelligenza artificiale, OpenAi e Anthropic indagano su decine di migliaia di incidenti nei test

Intelligenza artificiale, OpenAi e Anthropic indagano su decine di migliaia di incidenti nei test

Lo riporta Axios

Intelligenza artificiale, OpenAi e Anthropic indagano su decine di migliaia di incidenti nei test

OpenAI, Anthropic e alcuni dei principali ricercatori nel campo della sicurezza dell’intelligenza artificiale stanno indagando su decine di migliaia di episodi in cui i loro modelli più avanzati avrebbero compiuto azioni considerate problematiche dai valutatori esterni. Lo riporta Axios, citando alcune fonti a conoscenza delle verifiche. Gli incidenti si sarebbero verificati negli ultimi mesi, sia durante i test interni delle aziende sia in situazioni reali. Tra i casi segnalati ci sono l’aggiramento dei meccanismi di protezione, la creazione di bacheche, la fuga dalle sandbox, il dirottamento di siti web, fenomeni di auto-prompting e tentativi di eludere i sistemi di monitoraggio.

Leggi anche: OpenAI sospende l’addestramento dei modelli IA dopo una serie di incidenti. È la seconda volta in tre mesi

Gli episodi presentano livelli di gravità differenti e comprendono sia tentativi riusciti di superare i sistemi di sicurezza, sia tentativi che non hanno avuto successo. Secondo le fonti citate da Axios, nella maggior parte dei casi non risultano, almeno finora, danni concreti nel mondo reale. Il numero degli episodi è inoltre destinato a essere ulteriormente analizzato, mentre le aziende continuano a studiare i comportamenti dei modelli per individuare eventuali vulnerabilità e rafforzare i sistemi di sicurezza.

LEGGI LE NEWS DI MEDIATECH