Dimenticate i giganteschi modelli cloud che pesano terabyte. Un nuovo progetto dimostra che un modello da 125M parametri può fare musica in tempo reale direttamente sul vostro device.
Scopri di più Un mini-Transformer in tasca: l’IA che completa le tue improvvisazioni al pianoTag: machine learning
L’era dell’IA rimpicciolita: perché i modelli stanno diventando più stupidi (e perché potrebbe andare bene)
I grandi laboratori di AI stanno facendo una scelta drastica: meno conoscenza enciclopedica, più capacità di ragionamento. Ecco perché questo ‘downgrade’ potrebbe essere la chiave per modelli più veloci e intelligenti.
Scopri di più L’era dell’IA rimpicciolita: perché i modelli stanno diventando più stupidi (e perché potrebbe andare bene)RAM infinita, neuroni in crisi: perché l’AI non è un genio, ma ha una memoria che non finisce mai
L’intelligenza artificiale non sta superando noi in logica o ragionamento puro, ma ha un vantaggio sleale: una memoria di lavoro che non conosce l’oblio. Scopriamo perché questo cambia tutto.
Scopri di più RAM infinita, neuroni in crisi: perché l’AI non è un genio, ma ha una memoria che non finisce maiAI by Hand: Quando il futuro dell’intelligenza artificiale sembra un progetto di bricolage
Un nuovo approccio alla creazione di modelli IA che promette di riportare il controllo nelle mani di chi sa dove mettere le dita nel codice. Sarà la rivoluzione che stavamo aspettando o solo l’ennesima promessa da hype?
Scopri di più AI by Hand: Quando il futuro dell’intelligenza artificiale sembra un progetto di bricolageMistral OCR 4.1: Finalmente un occhio che non vede solo pixel, ma struttura
Mistral lancia la versione 4.1 del suo servizio OCR, portando con sé capacità di analisi strutturale che potrebbero far impallidire i vecchi script Python scritti in preda all’ansia.
Scopri di più Mistral OCR 4.1: Finalmente un occhio che non vede solo pixel, ma strutturaGLM-5.3: Il nuovo assistente che scrive codice e, forse, ti buca il firewall
Arriva GLM-5.3, il nuovo modello che promette capacità di coding da paura e alcune… ‘capacità cyber emergenti’ che fanno venire i brividi. Ecco cosa dobbiamo aspettarci (e cosa dovremmo temere).
Scopri di più GLM-5.3: Il nuovo assistente che scrive codice e, forse, ti buca il firewallCompressione e LLM: lo stesso vecchio trucco con un nuovo look
Un’analisi affascinante che mette a nudo il segreto dietro i modelli linguistici: in fondo, prevedere il prossimo token è solo un modo super sofisticato per comprimere i dati.
Scopri di più Compressione e LLM: lo stesso vecchio trucco con un nuovo lookDiscovery Loop: Quando i geni di Google decidono di automatizzare il metodo scientifico
Un team di leggende del calcolo distribuito e dell’AI lancia Discovery Loop per automatizzare il ciclo della scoperta scientifica. Sarà la fine del trial-and-error umano o solo l’ennesimo super-cluster che gira su infrastrutture proprietarie?
Scopri di più Discovery Loop: Quando i geni di Google decidono di automatizzare il metodo scientificoOpenAI e l’arte del ‘smuggling’: quando il nuovo modello arriva tra un teorema e l’altro
OpenAI ha deciso di annunciare il suo nuovo modello Astra nascondendolo in un post dedicato alla matematica pura. Una mossa da ninja o solo un modo per evitare troppo hype?
Scopri di più OpenAI e l’arte del ‘smuggling’: quando il nuovo modello arriva tra un teorema e l’altroDeep Dive nel futuro: DeepSeek lancia il nuovo modello e la velocità non è un’opinione
Il nuovo DeepSeek-V3 è arrivato. Analizziamo le novità, le prestazioni impressionanti e cosa significa per il mondo dell’Open Source.
Scopri di più Deep Dive nel futuro: DeepSeek lancia il nuovo modello e la velocità non è un’opinione