L’ANALISI
Step 5 Preview è disponibile via API: cosa offre oggi e cosa manca
StepFun apre Step 5 Preview via API con contesto da 1M token e input multimodale, ma rimanda i pesi al 15 ottobre: specifiche, costi, limiti e checklist.

In breve: Oggi Step 5 Preview è un servizio API, non ancora un modello eseguibile in locale. L’API usa l’identificatore step-5-preview, accetta testo, immagini e video, offre una finestra dichiarata da 1 milione di token e un massimo output documentato di 64 mila token. I pesi aperti sono una promessa datata 15 ottobre, da verificare quando il repository sarà completo.
Che cosa è disponibile oggi
StepFun indica accesso immediato dai propri prodotti e dalla piattaforma API. La documentazione ufficiale specifica il modello step-5-preview, input testuale, immagini e video, output testuale, tool calling, output strutturato e livelli di ragionamento low, medium e high.
Architettura e finestra di contesto
La pagina di lancio descrive una Mixture-of-Experts sparse da 600B parametri totali e 27B attivi per token. La documentazione dichiara una finestra da 1M token, con massimo output di 64k. Attivare pochi esperti riduce il calcolo per token, ma non permette di dedurre da solo latenza, memoria o costo reale del serving.
Prezzi e integrazione
Il listino ufficiale cinese indica 7 yuan per milione di token in input senza cache, 0,35 yuan con cache e 20 yuan in output; ragionamento e risposta finale sono entrambi conteggiati come output. L’accesso usa la piattaforma StepFun e un flusso compatibile con Chat Completions, ma limiti effettivi e disponibilità dipendono dall’account.
Condizioni e limiti
StepFun presenta benchmark interni ed esterni e casi di lavoro fino a 24 ore, ma i risultati sono pubblicati dal produttore e alcune impostazioni non sono direttamente confrontabili. I pesi, la licenza e la configurazione completa non sono ancora disponibili: fino al 15 ottobre non è possibile verificare self-hosting, quantizzazione o requisiti hardware.
Checklist pratica
- Verificare che l’account esponga davvero il modello step-5-preview prima di modificare un flusso di produzione.
- Impostare un budget ridotto e registrare token di input, cache, ragionamento, output, latenza ed errori.
- Provare separatamente testo lungo, immagini, video, tool calling e JSON Schema con casi ripetibili.
- Confrontare qualità e costo con il modello già in uso sullo stesso harness e sugli stessi task.
- Il 15 ottobre controllare pesi, licenza, config, checksum e requisiti prima di parlare di esecuzione locale.