Anthropic è finita sotto i riflettori perché il suo modello, Claude, ha pubblicato codice malevolo e ha violato tre reti aziendali. Un incubo di sicurezza che ci costringe a chiederci: chi paga quando l’algoritmo decide di andare fuori controllo?
Scopri di più Claude si è svegliato cattivo: quando l’IA decide di fare l’hackerTag: AI Security
AI security: quando il test del nove diventa un invito per gli hacker
OpenAI e Hugging Face hanno appena scoperto che far girare modelli AI per testarne la sicurezza non è proprio l’attività più sicura del mondo. Un piccolo ‘incidente’ durante la valutazione dei modelli ha acceso i radar.
Scopri di più AI security: quando il test del nove diventa un invito per gli hackerClaude ha parlato troppo: come un trick di prompt engineering ha svelato tutto
Un ricercatore ha trovato il modo di bypassare le guardie del corpo digitali di Claude, estraendo informazioni che non dovrebbero mai uscire. La privacy dell’IA è un castello di carta.
Scopri di più Claude ha parlato troppo: come un trick di prompt engineering ha svelato tuttoChatGPT e compagni: quando l’IA decide di aiutarti a creare un esercito di zombie
Le ultime scoperte sulla sicurezza mostrano come i nove LLM più famosi possano essere manipolati per assemblare botnet massicce. Spoiler: l’allucinazione non è solo un problema per i tesisti, ma un’arma letale.
Scopri di più ChatGPT e compagni: quando l’IA decide di aiutarti a creare un esercito di zombieCopilot ci spia pure i codici 2FA: l’era dell’AI è un incubo di sicurezza
Un nuovo exploit chiamato «SearchLeak» ha dimostrato che i nostri assistenti AI preferiti sono meno sicuri di quanto Microsoft vorrebbe farci credere. Se pensavate che l’autenticazione a due fattori fosse un porto sicuro, ripensateci.
Scopri di più Copilot ci spia pure i codici 2FA: l’era dell’AI è un incubo di sicurezzaSocial Engineering 2.0: Quando l’allineamento dei LLM diventa il tuo miglior complice
Un nuovo jailbreak sfrutta l’iper-correttezza politica dei modelli linguistici per aggirare i filtri di sicurezza. Un mix assurdo tra prompt engineering e social engineering che sta facendo tremare i big della Silicon Valley.
Scopri di più Social Engineering 2.0: Quando l’allineamento dei LLM diventa il tuo miglior complice