Moonshot AI ha appena svelato Kimi K3, un mostro da 2.8 trilioni di parametri che promette di dominare la scena. Ma tra benchmark gonfiati e costi folli, quanto conta davvero un pellicano in bicicletta?
Scopri di più Il ritorno del pellicano: Kimi K3 e l’arte di spendere un capitale per un SVGTag: machine learning
Kaggle e il mistero del premio: quando l’AGI diventa un gioco d’azzardo
Un carico di dubbi sulla trasparenza delle valutazioni nella competizione Kaggle per misurare l’AGI. Tra incongruenze e vincitori sospetti, sembra che la logica stia lasciando il posto al caos.
Scopri di più Kaggle e il mistero del premio: quando l’AGI diventa un gioco d’azzardoFar girare un mostro da 700 miliardi di parametri sul proprio PC: missione impossibile o genio puro?
Un nuovo progetto open source, Colibrì, dimostra che non serve un data center della NASA per far girare modelli linguistici enormi. Basta tanta ingegno e un po’ di ottimizzazione estrema.
Scopri di più Far girare un mostro da 700 miliardi di parametri sul proprio PC: missione impossibile o genio puro?DSpark: Quando il DeepSeek decide di smettere di pensare troppo e inizia a correre
Scopriamo come la nuova tecnica di speculative decoding di DeepSeek promette di accelerare l’inferenza dei LLM, portando un po’ di velocità in un mondo di modelli sempre più pesanti.
Scopri di più DSpark: Quando il DeepSeek decide di smettere di pensare troppo e inizia a correreGPT-5.6 Sol: Il prossimo upgrade o solo un altro strato di marketing?
OpenAI ha appena droppato un’anteprima di GPT-5.6 Sol. Vediamo se è davvero la rivoluzione che promettono o se è solo il solito modo per farci salire l’hype prima del prossimo round di subscription fees.
Scopri di più GPT-5.6 Sol: Il prossimo upgrade o solo un altro strato di marketing?Smettetela di digitare come dei dinosauri: arriva il nuovo swipe typing (e con licenza MIT!)
FUTO ha appena rilasciato un dataset massiccio di un milione di swipe per migliorare la digitazione su mobile. Niente trucchetti proprietari, solo dati puliti e open source per chi vuole davvero addestrare modelli che funzionino.
Scopri di più Smettetela di digitare come dei dinosauri: arriva il nuovo swipe typing (e con licenza MIT!)Addio manoscritti illeggibili: è arrivato l’OCR che non si stanca mai
Baidu ha rilasciato Unlimited-OCR, un modello capace di analizzare documenti lunghi e complessi con una precisione che farebbe invidia a un archivista sotto caffeina. Addio al parsing a pezzi e benvenuto al futuro del parsing a lungo raggio.
Scopri di più Addio manoscritti illeggibili: è arrivato l’OCR che non si stanca maiGPT-5.5: Il gigante che parla tanto, ma non dice nulla di vero
Sembra che l’era dei modelli da trilioni di parametri stia sbattendo la testa contro un muro di allucinazioni. Mentre i colossi proprietari inventano realtà parallele, un modello open-weight più piccolo e snello sta dimostrando che saper dire «non lo so» è molto più importante di avere un database infinito.
Scopri di più GPT-5.5: Il gigante che parla tanto, ma non dice nulla di veroGLM-5.2: L’open weights ha finalmente un nuovo re (e non è il solito gigante di Mountain View)
Mentre tutti fissano i benchmark chiusi di OpenAI, il nuovo GLM-5.2 ha appena scalato la vetta di Artificial Analysis. Ecco perché per noi che amiamo far girare tutto in locale la notizia è una bomba.
Scopri di più GLM-5.2: L’open weights ha finalmente un nuovo re (e non è il solito gigante di Mountain View)Anthropic e la magia nera dei guardrail invisibili: quando l’AI ti mente senza darti il preavviso
Anthropic ha chiesto scusa dopo aver scoperto di aver implementato dei ‘filtri invisibili’ su Claude Fable 5. In pratica, il modello degradava le risposte in silenzio per evitare la distillazione. Un bel modo di fare, no?
Scopri di più Anthropic e la magia nera dei guardrail invisibili: quando l’AI ti mente senza darti il preavviso