Un nuovo tool scovato su Hacker News ci permette di capire quanto la nostra identità sia rimasta impressa nei pesi dei modelli linguistici. Una sorta di test del DNA per l’era dell’intelligenza artificiale.
Scopri di più Tracce digitali nei LLM: sei tu, o è solo un pattern statistico?Tag: LLM
Il grande bluff del LLM brasiliano: quando il ‘nuovo modello’ è solo un remix di quelli esistenti
Pensate che Rio-3.5 sia un capolavoro di addestramento locale? Peggio: è un semplice mix matematico tra Nex e Qwen. Ecco come è stato smascherato.
Scopri di più Il grande bluff del LLM brasiliano: quando il ‘nuovo modello’ è solo un remix di quelli esistentiAnthropic e il ritorno del passato: quando la privacy diventa un optional per la ‘sicurezza’
Anthropic ha deciso che i nuovi modelli Mythos e Fable hanno bisogno di un po’ di memoria extra. Niente più Zero Data Retention per tutti, se non volete restare indietro.
Scopri di più Anthropic e il ritorno del passato: quando la privacy diventa un optional per la ‘sicurezza’Demistificare gli LLM: No, non è magia (anche se l’hype vorrebbe convincerti del contrario)
Basta con la fuffa da ufficio marketing. Analizziamo come funzionano davvero i Transformer, dai token ai blocchi di calcolo, senza troppi giri di parole.
Scopri di più Demistificare gli LLM: No, non è magia (anche se l’hype vorrebbe convincerti del contrario)Addio debugging notturno: gli agenti AI hanno finalmente imparato a scrivere codice decente
Dopo mesi di allucinazioni e bug ridicoli, i nuovi coding agent basati su Reinforcement Learning hanno superato la barriera della funzionalità. Ecco perché la nostra vita da developer sta per cambiare (in meglio).
Scopri di più Addio debugging notturno: gli agenti AI hanno finalmente imparato a scrivere codice decentearXiv dichiara guerra alle allucinazioni: se l’IA inventa le fonti, ti bannano!
L’era dell’accademia ‘copia-incolla’ dall’LLM sta finendo. arXiv introduce una sanzione severa per chiunque pubblichi riferimenti bibliografici inventati dalle IA.
Scopri di più arXiv dichiara guerra alle allucinazioni: se l’IA inventa le fonti, ti bannano!AI Delegation: l’arte di rompere le cose senza nemmeno accorgersene
Un nuovo paper su arXiv rivela che delegare compiti ai modelli linguistici più avanzati è il modo più veloce per corrompere i propri documenti. Un tasso di errore del 25% non è esattamente quello che cercavamo nel ‘vibe coding’.
Scopri di più AI Delegation: l’arte di rompere le cose senza nemmeno accorgerseneQuando l’IA ruba il lavoro (e pure il merito) ai matematici
Un incontro incredibile tra ricerca pura e Large Language Models: ecco cosa succede quando un algoritmo riesce a completare un ragionamento matematico complesso.
Scopri di più Quando l’IA ruba il lavoro (e pure il merito) ai matematiciSocial Engineering 2.0: Quando l’allineamento dei LLM diventa il tuo miglior complice
Un nuovo jailbreak sfrutta l’iper-correttezza politica dei modelli linguistici per aggirare i filtri di sicurezza. Un mix assurdo tra prompt engineering e social engineering che sta facendo tremare i big della Silicon Valley.
Scopri di più Social Engineering 2.0: Quando l’allineamento dei LLM diventa il tuo miglior compliceDeepSeek v4: Il nuovo giocattolo per smanettare (che parla la lingua degli altri)
DeepSeek ha appena rilasciato la versione v4 della sua API, e non è solo un altro aggiornamento dei pesi. È una bomba di compatibilità che promette di farci risparmiare un sacco di tempo nel debug dei nostri script Python o Node.js.
Scopri di più DeepSeek v4: Il nuovo giocattolo per smanettare (che parla la lingua degli altri)