Categoria

LLM per coding

4 articoli associati a questo tag.

1 settembre 2026

GLM 5.3 Flash (ex “Ox Alpha”): il modello multimodale che ha conquistato i dev con un costo fuori scala

Per qualche giorno è stato “il modello anonimo” che tutti usavano perché gratuito e sorprendentemente capace. Poi è arrivata l’identificazione: GLM 5.3 Flash, un Mixture-of-Experts multimodale con pesi rilasciati con licenza MIT e un pricing aggressivo. Vediamo perché ha creato così tanto rumore, quali trade-off tecnici porta con sé e come impatta su workflow reali: refactor di app legacy, debugging UI con immagini e pipeline video-to-text.

22 luglio 2026

Kimi K3 e l’era dei pesi aperti: cosa cambia davvero per chi fa frontend

Moonshot ha alzato l’asticella dei modelli open-weight con Kimi K3: un mixture-of-experts multimodale da 2,8T parametri e 1M di contesto, competitivo su benchmark di coding e UI. Ma tra hallucinations, valutazioni non sempre comparabili e requisiti hardware proibitivi, la vera domanda per i team frontend è: quando conviene usarlo (o auto-ospitarlo) e come cambiano workflow, tooling e governance?

10 luglio 2026

GPT 5.6: modelli “a famiglia” e sviluppo agentico (davvero) in parallelo

GPT 5.6 arriva in più varianti e introduce due leve operative—Max Reasoning e Ultra mode—che puntano a migliorare produttività e throughput nello sviluppo. Tra benchmark più “realistici” (workflow da terminale), dubbi su metriche omesse e segnali di shortcutting, la vera domanda non è quale modello sia “il più intelligente”, ma quale configurazione convenga usare nel flusso di lavoro quotidiano.

11 giugno 2026

Claude Fable 5: un salto enorme per il coding “agentico”, ma con costo e guardrail che cambiano le regole

Fable 5 porta capacità agentiche e risultati pratici che fino a poco fa richiedevano iterazioni infinite. Ma tra protezioni aggressive, pricing sbilanciato sugli output e disponibilità limitata, diventa essenziale scegliere quando impiegarla e come progettare prompt e workflow per non bruciare budget e tempo.