Anthropic ha finalmente sbloccato i System Prompts per Claude, permettendo un controllo più granulare sul comportamento del modello. È un passo avanti per il controllo del prompt, ma restiamo comunque dentro il giardino recintato di Anthropic.
Scopri di più Claude ci dà le chiavi della prigione (o quasi): arrivano i System PromptsTag: Prompt Engineering
Claude ha parlato troppo: come un trick di prompt engineering ha svelato tutto
Un ricercatore ha trovato il modo di bypassare le guardie del corpo digitali di Claude, estraendo informazioni che non dovrebbero mai uscire. La privacy dell’IA è un castello di carta.
Scopri di più Claude ha parlato troppo: come un trick di prompt engineering ha svelato tuttoSocial Engineering 2.0: Quando l’allineamento dei LLM diventa il tuo miglior complice
Un nuovo jailbreak sfrutta l’iper-correttezza politica dei modelli linguistici per aggirare i filtri di sicurezza. Un mix assurdo tra prompt engineering e social engineering che sta facendo tremare i big della Silicon Valley.
Scopri di più Social Engineering 2.0: Quando l’allineamento dei LLM diventa il tuo miglior complice