Gli llm possono diventare agenti attaccanti specialmente in un attacco bruto dove una pseudo logica può essere applicata. Si possono ridurre a mio avviso i tentativi necessari per forzare l'attacco. Applicando anche una certa ingegneria sociale è possibile che siano in grado di estrapolare per esempio credenziali di accesso più facilmente. Non va pensato soltanto ai soliti llm accessibili all'utenza comune più o meno "tarpati". Ci sono molti modelli "non censurati" in partenza o cui è stata tolta. Il caso huggingface potrebbe avere diverse interpretazioni. È emblematico in qualche maniera che sia stato attaccato essendo uno dei maggiori repository di llm "open source" quantizzati per utilizzi locali (qwen, deepseek, kimi, mistral, llama...) che sono diretti concorrenti dei "closed" americani.