La filigrana che dovrebbe rendere sicuri gli LLM ne altera il comportamento: lo studio

Wait 5 sec.

Una ricerca di Lasso Security ha scoperto che SynthID-Text, il sistema di watermarking che Anthropic adotterà sui futuri modelli Claude per rispettare la normativa UE, altera anche i rifiuti di sicurezza e le chiamate agli strumenti degli agenti IA