Le ultime scoperte sulla sicurezza mostrano come i nove LLM più famosi possano essere manipolati per assemblare botnet massicce. Spoiler: l’allucinazione non è solo un problema per i tesisti, ma un’arma letale.
Scopri di più ChatGPT e compagni: quando l’IA decide di aiutarti a creare un esercito di zombieTag: LLM
L’underdog che ha scosso l’AI: GLM-3 è il nuovo killer dei benchmark?
Un nuovo test rivela che un modello meno noto sta superando i giganti del settore in compiti di sicurezza specifici. Ecco perché non dovresti fidarti solo dei nomi famosi.
Scopri di più L’underdog che ha scosso l’AI: GLM-3 è il nuovo killer dei benchmark?DSpark: Quando il DeepSeek decide di smettere di pensare troppo e inizia a correre
Scopriamo come la nuova tecnica di speculative decoding di DeepSeek promette di accelerare l’inferenza dei LLM, portando un po’ di velocità in un mondo di modelli sempre più pesanti.
Scopri di più DSpark: Quando il DeepSeek decide di smettere di pensare troppo e inizia a correreBasta impazzire tra mille API: RubyLLM è il jolly che non sapevate di volere
Stanco di scrivere wrapper diversi per ogni modello AI? RubyLLM arriva per unificare il caos di OpenAI, Anthropic e Ollama in un unico, elegante framework Ruby.
Scopri di più Basta impazzire tra mille API: RubyLLM è il jolly che non sapevate di volereGPT-5.5: Il gigante che parla tanto, ma non dice nulla di vero
Sembra che l’era dei modelli da trilioni di parametri stia sbattendo la testa contro un muro di allucinazioni. Mentre i colossi proprietari inventano realtà parallele, un modello open-weight più piccolo e snello sta dimostrando che saper dire «non lo so» è molto più importante di avere un database infinito.
Scopri di più GPT-5.5: Il gigante che parla tanto, ma non dice nulla di veroTracce digitali nei LLM: sei tu, o è solo un pattern statistico?
Un nuovo tool scovato su Hacker News ci permette di capire quanto la nostra identità sia rimasta impressa nei pesi dei modelli linguistici. Una sorta di test del DNA per l’era dell’intelligenza artificiale.
Scopri di più Tracce digitali nei LLM: sei tu, o è solo un pattern statistico?Il grande bluff del LLM brasiliano: quando il ‘nuovo modello’ è solo un remix di quelli esistenti
Pensate che Rio-3.5 sia un capolavoro di addestramento locale? Peggio: è un semplice mix matematico tra Nex e Qwen. Ecco come è stato smascherato.
Scopri di più Il grande bluff del LLM brasiliano: quando il ‘nuovo modello’ è solo un remix di quelli esistentiAnthropic e il ritorno del passato: quando la privacy diventa un optional per la ‘sicurezza’
Anthropic ha deciso che i nuovi modelli Mythos e Fable hanno bisogno di un po’ di memoria extra. Niente più Zero Data Retention per tutti, se non volete restare indietro.
Scopri di più Anthropic e il ritorno del passato: quando la privacy diventa un optional per la ‘sicurezza’Demistificare gli LLM: No, non è magia (anche se l’hype vorrebbe convincerti del contrario)
Basta con la fuffa da ufficio marketing. Analizziamo come funzionano davvero i Transformer, dai token ai blocchi di calcolo, senza troppi giri di parole.
Scopri di più Demistificare gli LLM: No, non è magia (anche se l’hype vorrebbe convincerti del contrario)Addio debugging notturno: gli agenti AI hanno finalmente imparato a scrivere codice decente
Dopo mesi di allucinazioni e bug ridicoli, i nuovi coding agent basati su Reinforcement Learning hanno superato la barriera della funzionalità. Ecco perché la nostra vita da developer sta per cambiare (in meglio).
Scopri di più Addio debugging notturno: gli agenti AI hanno finalmente imparato a scrivere codice decente