Sai cosa pensano davvero i modelli di OpenAI e Google? Una falla svela tutti i loro segreti

Wait 5 sec.

Una ricerca rivela che minime porzioni di ragionamento nascosto possono alterare le risposte dei modelli, esporre contenuti dannosi e generare riassunti fuorvianti. Lo studio vuole evidenziare i rischi strutturali nella gestione delle tracce di reasoning