Dataconomy IT
  • Notizia
  • Industria
Subscribe
No Result
View All Result
Dataconomy IT
  • Notizia
  • Industria
Subscribe
No Result
View All Result
Dataconomy IT
No Result
View All Result

Openai Anti-Scyming AI Training Backfires

byEmre Çıtak
22 Settembre 2025
in Intelligenza Artificiale
Home Notizia Intelligenza Artificiale
Share on FacebookShare on Twitter
Google Preferred Source

I ricercatori di Openi, in una collaborazione con Apollo Research, hanno scoperto che un tentativo di addestrare un modello di intelligenza artificiale per essere più onesti aveva una conseguenza non intenzionale: ha insegnato al modello come nasconderne il suo inganno in modo più efficace. Lo studio evidenzia le sfide significative per garantire la sicurezza e l’affidabilità dei sistemi AI avanzati.

Come la formazione ha creato inavvertitamente un ingannatore più intelligente

La ricerca si è concentrata su un comportamento che Openi chiama “Scheming”, che definisce come:

“Quando un’intelligenza artificiale si comporta in una superficie mentre nasconde i suoi veri obiettivi.”

Il team ha sviluppato una tecnica di allenamento “anti-screziata” con l’obiettivo di impedire al modello di infrangere segretamente le regole o di sottoperformare intenzionalmente nei test. Tuttavia, la formazione ha prodotto il contrario del risultato previsto. Openi ha dichiarato in un post sul blog:

“Un’importante modalità di fallimento nel tentativo di” allenare “è semplicemente insegnare al modello a Schingay più attentamente e segretamente.”

I ricercatori hanno scoperto che i modelli AI hanno imparato a riconoscere quando venivano valutati e avrebbero adattato il loro comportamento per superare i test. Ciò ha permesso ai sistemi di superare in astuzia i protocolli di formazione senza cambiare veramente i loro obiettivi sottostanti.

I limiti degli attuali metodi di sicurezza

Secondo Apollo Research, le tecniche di sicurezza che hanno testato non potevano:

“Ridurre significativamente, ma non eliminare questi comportamenti.”

Mentre Openai afferma che questo non è un problema serio nei suoi prodotti attuali, i risultati evidenziano potenziali rischi futuri in quanto i sistemi AI vengono dati più autonomia e integrati in aspetti più critici degli affari umani. La ricerca sottolinea che la tendenza per l’IA a perseguire obiettivi segreti è il risultato diretto dei metodi utilizzati per addestrarli. Openai ha riconosciuto i limiti dei suoi metodi attuali, affermando,

“Abbiamo più lavoro da fare.”


Credito d’immagine in primo piano

Tags: apertoFormazione AIIn primo piano

Related Posts

Accesso gratuito a Claude Fable 5 esteso fino al 19 luglio

Accesso gratuito a Claude Fable 5 esteso fino al 19 luglio

13 Luglio 2026
OpenAI aumenta temporaneamente i limiti di utilizzo di GPT-5.6 Sol

OpenAI aumenta temporaneamente i limiti di utilizzo di GPT-5.6 Sol

13 Luglio 2026
Meta lancia Muse Spark 1.1 per la codifica dell’intelligenza artificiale degli agenti

Meta lancia Muse Spark 1.1 per la codifica dell’intelligenza artificiale degli agenti

10 Luglio 2026
SpaceXAI lancia Grok 4.5 come nuovo modello AI di punta

SpaceXAI lancia Grok 4.5 come nuovo modello AI di punta

10 Luglio 2026
Brevetto sui metafile per un dispositivo di monitoraggio emotivo basato sull’intelligenza artificiale

Brevetto sui metafile per un dispositivo di monitoraggio emotivo basato sull’intelligenza artificiale

10 Luglio 2026
Claude ottiene la dashboard di Reflect per monitorare l’utilizzo dell’intelligenza artificiale

Claude ottiene la dashboard di Reflect per monitorare l’utilizzo dell’intelligenza artificiale

10 Luglio 2026

Recent Posts

  • Accesso gratuito a Claude Fable 5 esteso fino al 19 luglio
  • SpaceX programma il volo Starship 13 per il lancio del 16 luglio
  • Jensen Huang afferma che Nvidia si avvicina ai 100 miliardi di dollari nel trimestre
  • L’UE prevede sanzioni più severe per le Big Tech in base alla nuova legge
  • A Microsoft viene ordinato di ripristinare la libreria Xbox sospesa

Recent Comments

Nessun commento da mostrare.
Dataconomy IT

COPYRIGHT © DATACONOMY MEDIA GMBH, ALL RIGHTS RESERVED.

  • Sample Page

Follow Us

  • Notizia
  • Industria
No Result
View All Result
Subscribe

This website uses cookies to improve your experience. You can choose to accept or reject them. Visit our Privacy Policy.