Vai al contenuto

Qwen3.8-Omni-Flash analizza testo, immagini, audio e video fino a 1M token; Jev usa stato e domande tipizzate invece di generare testo libero; Kimi K3 arriva su Amazon Bedrock con prompt caching esplicito e altri 1 aggiornamenti verificati.

Radar AI / Edizione giornaliera

IL PUNTO SULL’AI

18 settembre 2026

Qwen3.8-Omni-Flash analizza testo, immagini, audio e video fino a 1M token; Jev usa stato e domande tipizzate invece di generare testo libero; Kimi K3 arriva su Amazon Bedrock con prompt caching esplicito e altri 1 aggiornamenti verificati.

4 notizie1 min di letturaVerificato alle 19:30
MULTIMODALE01
Qwen3.8-Omni-Flash analizza testo, immagini, audio e video fino a 1M token

Alibaba rende disponibile via Model Studio un modello nativamente multimodale con input testo, immagini, audio e video, output testuale, tool calling, ricerca web e contesto fino a un milione di token.

Limiti da conoscere

Limite: È un servizio API proprietario, non un rilascio open-weight. Prezzi, regioni, latenza e qualità su audio/video lunghi vanno verificati nel deployment scelto.

CLOUD03
Kimi K3 arriva su Amazon Bedrock con prompt caching esplicito

AWS rende disponibile Kimi K3 su Bedrock tramite profili cross-region e API native o compatibili OpenAI, aggiungendo explicit prompt caching e zero data retention dichiarata.

Limiti da conoscere

Limite: Il modello resta enorme e gestito nel cloud; costi, regioni, quote, latenza e comportamento del caching devono essere misurati sul carico reale.

INFERENZA04
SGLang 0.5.20 amplia modelli e replay delle traiettorie RL

La release integra nuovi modelli tra cui GLM-5.3-Flash e Qwen3.8-Flash-Next e restituisce sampling mask e log-probabilità per riprodurre correttamente rollout RL.

Limiti da conoscere

Limite: È una release ampia con 713 pull request: nuove funzioni e backend richiedono test mirati, senza attribuire a tutti i workload gli incrementi dichiarati.

LA COMMUNITY SCEGLIE

Quale notizia merita un test?

Scegli una notizia qui sotto o usa “Mi interessa” nella sua scheda. Un voto per edizione su questo dispositivo, senza iscrizione.

Radar AI · a cura di Francesco Gruner

Chiedi al sito.

Assistente OpenAI

Le domande vengono inviate a OpenAI. Non inserire dati personali o riservati. Privacy.

Verifica le risposte nelle fonti. 16 messaggi al giorno per rete.

Cosa cerchi? Ti indico le pagine utili.