Última hora
ESTrump anuncia reanudación de conversaciones con Irán tras cancelar "ataque masivo"ESAccidente múltiple en Italia deja seis muertos y treinta heridosESIncendio en edificio de Chamberí provoca derrumbe de tejado sin heridosESBombardeo ruso en Kiev causa al menos 10 muertos y 30 heridosESFIFA abandona su plan de privatizar el Mundial tras rechazo continentalESLa crisis migratoria en Ceuta: decenas de muertos y más de 60.000 inmigrantes en pocos díasESEl sueño truncado de dos jóvenes marroquíes que intentaron cruzar a CeutaESGianni Infantino bajo escrutinio por planes frustrados de venta del Mundial y posibles desafíos a su reelección en la FIFAES¿Has visto a mi hijo?: Familias marroquíes buscan a sus seres queridos en la frontera de CeutaESFrancia enfrenta su mayor incendio en tiempos de paz: 220.000 evacuados y críticas por la gestión climáticaESTrump anuncia reanudación de conversaciones con Irán tras cancelar "ataque masivo"ESAccidente múltiple en Italia deja seis muertos y treinta heridosESIncendio en edificio de Chamberí provoca derrumbe de tejado sin heridosESBombardeo ruso en Kiev causa al menos 10 muertos y 30 heridosESFIFA abandona su plan de privatizar el Mundial tras rechazo continentalESLa crisis migratoria en Ceuta: decenas de muertos y más de 60.000 inmigrantes en pocos díasESEl sueño truncado de dos jóvenes marroquíes que intentaron cruzar a CeutaESGianni Infantino bajo escrutinio por planes frustrados de venta del Mundial y posibles desafíos a su reelección en la FIFAES¿Has visto a mi hijo?: Familias marroquíes buscan a sus seres queridos en la frontera de CeutaESFrancia enfrenta su mayor incendio en tiempos de paz: 220.000 evacuados y críticas por la gestión climática
Newsgather
AtrásAI Models Vulnerable to Adaptive Attacks, Study Finds
AI Models Vulnerable to Adaptive Attacks, Study Finds
En desarrollo
ANSA Economia16/6/2026Tecnología2 min de lecturaItaly

AI Models Vulnerable to Adaptive Attacks, Study Finds

En resumen

  • Uno studio dell'AI4I rivela che i modelli AI avanzati, pur bloccando la maggior parte degli attacchi, restano vulnerabili a tecniche adattive.
  • I metodi tradizionali sono inefficaci, ma gli attacchi che apprendono dalle risposte del modello continuano a ottenere risultati dannosi.

Resumen generado por IA

Tamaño de fuente

Anche i sistemi di Intelligenza Artificiale più avanzati restano vulnerabili ad alcuni attacchi esterni. È quanto emerge dallo studio "Measuring the Residual Jailbreak Surface of Frontier Large Language Models" dell'Ai Security Lab dell'Istituto Italiano di Intelligenza Artificiale (AI4I), guidato da Nicola Franco.

Attraverso la piattaforma open source HackAgent, i ricercatori hanno effettuato centinaia di migliaia di tentativi di jailbreak contro due modelli linguistici avanzati, utilizzando 7.826 intenti dannosi in dieci categorie di rischio, dalla cybersicurezza alla disinformazione. I risultati mostrano che i modelli bloccano la maggior parte degli attacchi: oltre l'88% nel caso di Claude Opus 4.8 e oltre il 93% per Fable 5.

Tuttavia, sono state individuate centinaia di risposte dannose ottenute tramite tecniche automatizzate.

Lo studio evidenzia inoltre che i tradizionali metodi di aggiramento basati su codifiche e artifici linguistici sono ormai in gran parte neutralizzati, mentre restano efficaci gli attacchi adattivi, capaci di apprendere dalle risposte del modello e modificare progressivamente la propria strategia.

"La sicurezza dei sistemi di Intelligenza Artificiale richiede valutazioni indipendenti, continue e basate su evidenze empiriche", afferma Franco. "Misurare la robustezza dei modelli in condizioni avversariali è una componente essenziale della governance dell'Ai e della fiducia necessaria per la sua adozione su larga scala".

Secondo i ricercatori, la sicurezza dell'Ia non può essere considerata acquisita una volta per tutte, ma richiede un processo continuo di verifica e miglioramento. Per Fabio Pammolli, sviluppare capacità autonome di valutazione dei sistemi di IA avanzati è "una componente essenziale della sovranità tecnologica" dell'Italia e dell'Europa.

Temas relacionados

This article was originally published by ANSA Economia.

Noticias relacionadas

Más sobre este temaintelligenza artificiale