San Francisco, 18 agosto 2026

La società di intelligenza artificiale OpenAI intende far controllare più rigorosamente, tramite sistemi automatizzati, ciò che i suoi modelli di IA fanno durante i test in corso, e allertare il personale umano entro 30 minuti in caso di comportamento sospetto.

La misura è una reazione a diversi incidenti in cui i modelli di IA avevano cercato, durante i test interni, di aggirare le disposizioni di sicurezza. Secondo quanto riferito dall'azienda, in futuro i controlli automatizzati dovranno osservare in tempo reale ogni azione di un modello ed escalare immediatamente in caso di anomalie.