Anthropic e la magia nera dei guardrail invisibili: quando l'AI ti mente senza darti il preavviso

Anthropic e la magia nera dei guardrail invisibili: quando l’AI ti mente senza darti il preavviso

Anthropic ha chiesto scusa dopo aver scoperto di aver implementato dei ‘filtri invisibili’ su Claude Fable 5. In pratica, il modello degradava le risposte in silenzio per evitare la distillazione. Un bel modo di fare, no?

Scopri di più Anthropic e la magia nera dei guardrail invisibili: quando l’AI ti mente senza darti il preavviso
Claude Opus 4.8: Finalmente un'IA che non si inventa tutto per puro gusto!

Claude Opus 4.8: Finalmente un’IA che non si inventa tutto per puro gusto!

Anthropic ha rilasciato Claude Opus 4.8, una versione che promette di essere meno ‘allucinata’ e molto più efficiente nel coding. Ecco perché questo update potrebbe essere la svolta per i nostri progetti più pesanti.

Scopri di più Claude Opus 4.8: Finalmente un’IA che non si inventa tutto per puro gusto!