Vai al contenuto

StepFun apre Step 5 Preview via API con contesto da 1M token e input multimodale, ma rimanda i pesi al 15 ottobre: specifiche, costi, limiti e checklist.

L’ANALISI

Step 5 Preview è disponibile via API: cosa offre oggi e cosa manca

StepFun apre Step 5 Preview via API con contesto da 1M token e input multimodale, ma rimanda i pesi al 15 ottobre: specifiche, costi, limiti e checklist.

2 min di letturaFatti, limiti e fonti primarie
Pagina ufficiale di lancio di Step 5 Preview
La pagina ufficiale presenta Step 5 Preview come modello sparse MoE per attività agentiche, disponibile via API con pesi annunciati per il 15 ottobre.

In breve: Oggi Step 5 Preview è un servizio API, non ancora un modello eseguibile in locale. L’API usa l’identificatore step-5-preview, accetta testo, immagini e video, offre una finestra dichiarata da 1 milione di token e un massimo output documentato di 64 mila token. I pesi aperti sono una promessa datata 15 ottobre, da verificare quando il repository sarà completo.

Che cosa è disponibile oggi

StepFun indica accesso immediato dai propri prodotti e dalla piattaforma API. La documentazione ufficiale specifica il modello step-5-preview, input testuale, immagini e video, output testuale, tool calling, output strutturato e livelli di ragionamento low, medium e high.

Architettura e finestra di contesto

La pagina di lancio descrive una Mixture-of-Experts sparse da 600B parametri totali e 27B attivi per token. La documentazione dichiara una finestra da 1M token, con massimo output di 64k. Attivare pochi esperti riduce il calcolo per token, ma non permette di dedurre da solo latenza, memoria o costo reale del serving.

Prezzi e integrazione

Il listino ufficiale cinese indica 7 yuan per milione di token in input senza cache, 0,35 yuan con cache e 20 yuan in output; ragionamento e risposta finale sono entrambi conteggiati come output. L’accesso usa la piattaforma StepFun e un flusso compatibile con Chat Completions, ma limiti effettivi e disponibilità dipendono dall’account.

Condizioni e limiti

StepFun presenta benchmark interni ed esterni e casi di lavoro fino a 24 ore, ma i risultati sono pubblicati dal produttore e alcune impostazioni non sono direttamente confrontabili. I pesi, la licenza e la configurazione completa non sono ancora disponibili: fino al 15 ottobre non è possibile verificare self-hosting, quantizzazione o requisiti hardware.

Checklist pratica

  • Verificare che l’account esponga davvero il modello step-5-preview prima di modificare un flusso di produzione.
  • Impostare un budget ridotto e registrare token di input, cache, ragionamento, output, latenza ed errori.
  • Provare separatamente testo lungo, immagini, video, tool calling e JSON Schema con casi ripetibili.
  • Confrontare qualità e costo con il modello già in uso sullo stesso harness e sugli stessi task.
  • Il 15 ottobre controllare pesi, licenza, config, checksum e requisiti prima di parlare di esecuzione locale.

Fonti primarie

Radar AI · a cura di Francesco Gruner

Chiedi al sito.

Assistente OpenAI

Le domande vengono inviate a OpenAI. Non inserire dati personali o riservati. Privacy.

Verifica le risposte nelle fonti. 16 messaggi al giorno per rete.

Cosa cerchi? Ti indico le pagine utili.