Vai al contenuto

SGLang 0.5.19 aggiunge supporto a Qwen 3.8, Ling 3.0, MiniCPM-SALA e Granite 4.2, oltre a beam search e ottimizzazioni Hopper e Blackwell.

L’ANALISI

SGLang 0.5.19 amplia il serving di modelli nuovi e MoE

SGLang 0.5.19 aggiunge supporto a Qwen 3.8, Ling 3.0, MiniCPM-SALA e Granite 4.2, oltre a beam search e ottimizzazioni Hopper e Blackwell.

1 min di letturaFatti, limiti e fonti primarie
Schermata della fonte primaria: SGLang 0.5.19 amplia il serving di modelli nuovi e MoE
Pagina ufficiale usata per verificare il delta e la data dell’evento.

In breve: SGLang 0.5.19 aggiunge supporto a Qwen 3.8, Ling 3.0, MiniCPM-SALA e Granite 4.2, oltre a beam search e ottimizzazioni Hopper e Blackwell.

Che cosa cambia

La release stabile è datata 5 settembre.

Il supporto copre nuove famiglie e ricette per GLM-5.3 e MiniMax-H3.

W4A8 MoE su Hopper, DCP Blackwell e DeepEP v2 sono i delta infrastrutturali più operativi.

Perché conta adesso

Il delta modifica ciò che un team può scaricare, eseguire, misurare o mettere in sicurezza oggi, distinto dall’annuncio originario del progetto.

Impatto operativo

La decisione utile è verificare compatibilità, costi e confini di sicurezza sul proprio ambiente prima di estendere il rollout.

Condizioni e limiti

Le guide e i backend hanno requisiti hardware diversi; un modello elencato non implica prestazioni ottimali su ogni GPU.

Checklist pratica

  • Verifica la matrice GPU e precisione.
  • Fissa la versione 0.5.19 nel deployment.
  • Misura throughput e latenza sul carico reale.

Fonti primarie

Radar AI · a cura di Francesco Gruner

Il sito, in una chat.

Servizi, guide e idee da approfondire

Sono l’assistente AI di questo sito. Ti aiuto a orientarti tra il lavoro di Francesco, il blog, Radar AI e i video, con i link alle fonti.

Risposte AI da verificare nelle fonti. 16 messaggi al giorno per rete.