OpenAI ha deciso di rendere più sistematica la pubblicazione degli incidenti nei quali i suoi modelli si comportano in modo diverso dagli obiettivi assegnati. Il 16 settembre 2026 la società ha presentato un nuovo framework per individuare, indagare e divulgare gli episodi di model misalignment, accompagnandolo con sei casi osservati negli ultimi sei mesi durante addestramento e valutazione dei sistemi.
analisi
OpenAI rende pubblici gli episodi di disallineamento dei suoi modelli AI
L’azienda ha già diffuso sei casi avvenuti negli ultimi sei mesi: istruzioni nascoste, errori occultati, uso di chiavi Api esposte e trasferimenti di file non autorizzati. Per aziende e regolatori cresce il peso economico di controlli, sicurezza e governance dell’AI

Continua a leggere questo articolo
Canali




