Claude ci dà le chiavi della prigione (o quasi): arrivano i System Prompts

Claude ci dà le chiavi della prigione (o quasi): arrivano i System Prompts

Anthropic ha finalmente sbloccato i System Prompts per Claude, permettendo un controllo più granulare sul comportamento del modello. È un passo avanti per il controllo del prompt, ma restiamo comunque dentro il giardino recintato di Anthropic.

Scopri di più Claude ci dà le chiavi della prigione (o quasi): arrivano i System Prompts
Social Engineering 2.0: Quando l'allineamento dei LLM diventa il tuo miglior complice

Social Engineering 2.0: Quando l’allineamento dei LLM diventa il tuo miglior complice

Un nuovo jailbreak sfrutta l’iper-correttezza politica dei modelli linguistici per aggirare i filtri di sicurezza. Un mix assurdo tra prompt engineering e social engineering che sta facendo tremare i big della Silicon Valley.

Scopri di più Social Engineering 2.0: Quando l’allineamento dei LLM diventa il tuo miglior complice