Un esperimento scientifico (o quasi) tenta di smontare la teoria del complotto più folle del momento: i laboratori di AI addestrano i loro modelli su specifici dataset per truccare i benchmark.
Scopri di più Il grande complotto dei pellican: i modelli AI stanno barando davvero?Tag: machine learning
ChatGPT e la Congettura di Jacobian: l’IA sta davvero riscrivendo la matematica o è solo un fenomenale allucinatore?
Terrence Tao, uno dei geni più grandi della matematica moderna, si è messo a testare i limiti di ChatGPT su un problema che farebbe esplodere il cervello a chiunque. Il risultato? Un mix tra genialità e puro delirio statistico.
Scopri di più ChatGPT e la Congettura di Jacobian: l’IA sta davvero riscrivendo la matematica o è solo un fenomenale allucinatore?Smettetela di scommettere tutto su un unico modello: l’era del routing è arrivata
Perché scegliere tra il gigante chiuso e il campione open source quando puoi usarli entrambi in modo intelligente? Scopriamo come il sistema Kimi K3 + Fable sta riscrivendo le regole del gioco.
Scopri di più Smettetela di scommettere tutto su un unico modello: l’era del routing è arrivataQwen3.8 sta arrivando: l’Open Source respira (forse) ancora
Alibaba sta per rilasciare i pesi di Qwen3.8. Tra hype e realtà, ecco perché dovremmo iniziare a preparare i nostri server locali.
Scopri di più Qwen3.8 sta arrivando: l’Open Source respira (forse) ancoraIl ritorno del pellicano: Kimi K3 e l’arte di spendere un capitale per un SVG
Moonshot AI ha appena svelato Kimi K3, un mostro da 2.8 trilioni di parametri che promette di dominare la scena. Ma tra benchmark gonfiati e costi folli, quanto conta davvero un pellicano in bicicletta?
Scopri di più Il ritorno del pellicano: Kimi K3 e l’arte di spendere un capitale per un SVGKaggle e il mistero del premio: quando l’AGI diventa un gioco d’azzardo
Un carico di dubbi sulla trasparenza delle valutazioni nella competizione Kaggle per misurare l’AGI. Tra incongruenze e vincitori sospetti, sembra che la logica stia lasciando il posto al caos.
Scopri di più Kaggle e il mistero del premio: quando l’AGI diventa un gioco d’azzardoFar girare un mostro da 700 miliardi di parametri sul proprio PC: missione impossibile o genio puro?
Un nuovo progetto open source, Colibrì, dimostra che non serve un data center della NASA per far girare modelli linguistici enormi. Basta tanta ingegno e un po’ di ottimizzazione estrema.
Scopri di più Far girare un mostro da 700 miliardi di parametri sul proprio PC: missione impossibile o genio puro?DSpark: Quando il DeepSeek decide di smettere di pensare troppo e inizia a correre
Scopriamo come la nuova tecnica di speculative decoding di DeepSeek promette di accelerare l’inferenza dei LLM, portando un po’ di velocità in un mondo di modelli sempre più pesanti.
Scopri di più DSpark: Quando il DeepSeek decide di smettere di pensare troppo e inizia a correreGPT-5.6 Sol: Il prossimo upgrade o solo un altro strato di marketing?
OpenAI ha appena droppato un’anteprima di GPT-5.6 Sol. Vediamo se è davvero la rivoluzione che promettono o se è solo il solito modo per farci salire l’hype prima del prossimo round di subscription fees.
Scopri di più GPT-5.6 Sol: Il prossimo upgrade o solo un altro strato di marketing?Smettetela di digitare come dei dinosauri: arriva il nuovo swipe typing (e con licenza MIT!)
FUTO ha appena rilasciato un dataset massiccio di un milione di swipe per migliorare la digitazione su mobile. Niente trucchetti proprietari, solo dati puliti e open source per chi vuole davvero addestrare modelli che funzionino.
Scopri di più Smettetela di digitare come dei dinosauri: arriva il nuovo swipe typing (e con licenza MIT!)