GPT-5.5: Il gigante che parla tanto, ma non dice nulla di vero

GPT-5.5: Il gigante che parla tanto, ma non dice nulla di vero

Sembra che l’era dei modelli da trilioni di parametri stia sbattendo la testa contro un muro di allucinazioni. Mentre i colossi proprietari inventano realtà parallele, un modello open-weight più piccolo e snello sta dimostrando che saper dire «non lo so» è molto più importante di avere un database infinito.

Scopri di più GPT-5.5: Il gigante che parla tanto, ma non dice nulla di vero
GLM-5.2: L'open weights ha finalmente un nuovo re (e non è il solito gigante di Mountain View)

GLM-5.2: L’open weights ha finalmente un nuovo re (e non è il solito gigante di Mountain View)

Mentre tutti fissano i benchmark chiusi di OpenAI, il nuovo GLM-5.2 ha appena scalato la vetta di Artificial Analysis. Ecco perché per noi che amiamo far girare tutto in locale la notizia è una bomba.

Scopri di più GLM-5.2: L’open weights ha finalmente un nuovo re (e non è il solito gigante di Mountain View)
Anthropic e la magia nera dei guardrail invisibili: quando l'AI ti mente senza darti il preavviso

Anthropic e la magia nera dei guardrail invisibili: quando l’AI ti mente senza darti il preavviso

Anthropic ha chiesto scusa dopo aver scoperto di aver implementato dei ‘filtri invisibili’ su Claude Fable 5. In pratica, il modello degradava le risposte in silenzio per evitare la distillazione. Un bel modo di fare, no?

Scopri di più Anthropic e la magia nera dei guardrail invisibili: quando l’AI ti mente senza darti il preavviso
Qwen 3.6-Max-Preview: Un altro mostro di silicio che promette di farci sudare freddo (o meno)

Qwen 3.6-Max-Preview: Un altro mostro di silicio che promette di farci sudare freddo (o meno)

Il nuovo aggiornamento di Qwen è arrivato con promesse di maggiore precisione e intelligenza. Vediamo se è davvero un salto generazionale o solo l’ennesimo trick di marketing per far gonfiare i benchmark.

Scopri di più Qwen 3.6-Max-Preview: Un altro mostro di silicio che promette di farci sudare freddo (o meno)
Self-distillazione low cost: il trucchetto che fa codeggiare gli LLMs come dei campioni

Self-distillazione low cost: il trucchetto che fa codeggiare gli LLMs come dei campioni

Sapete quella sensazione quando scoprite che il vostro modello preferito può migliorare da solo, senza bisogno di trainer super costosi? Ecco la storia di come un po’ di auto-distillazione ha fatto miracoli per la generazione di codice.

Scopri di più Self-distillazione low cost: il trucchetto che fa codeggiare gli LLMs come dei campioni