Vai al contenuto

Archivio completo di 40 notizie AI verificate dal 06/09 al 12/09/2026.

Radar AI / Riepilogo settimanale

LA SETTIMANA IN AI

6–12 settembre 2026

Tutte le 40 notizie verificate pubblicate dal 06/09 al 12/09/2026, raccolte in un unico archivio settimanale.

40 notizie8 min di lettura
In questa settimana 40 notizie
Vota un tema

MODELLI LOCALI01
Pagina ufficiale Hugging Face di OpenBMB MiniCPM5-2B

OpenBMB ha pubblicato il checkpoint finale da 2,52 miliardi di parametri con contesto 131K, tool calling e licenza Apache 2.0. La cronologia del repository colloca il caricamento effettivo dei pesi il 6 settembre, distinto dal precedente annuncio della famiglia.

Limiti da conoscere

Limite: prestazioni e primati sono dichiarazioni del produttore; contesto lungo, qualità delle quantizzazioni e velocità vanno misurati sul runtime scelto.

RICERCA AGENTI09
Schermata della fonte primaria: Cambiare modello può rompere la memoria dell’agente

Uno studio controllato su 48 storie misura la portabilità della memoria: gli schemi fissi restano stabili, note compresse ed embedding possono degradare dopo il cambio modello.

Limiti da conoscere

Limite: Il dataset è sintetico e circoscritto; i risultati non quantificano ogni stack RAG o memoria in produzione.

MODELLI LOCALI12
Pagina ufficiale Hugging Face di OpenBMB MiniCPM5-2B

Dopo i pesi BF16 e le prime quantizzazioni community, OpenBMB ha pubblicato repository ufficiali GGUF, MLX 4-bit e GPTQ 4-bit. Il delta rende disponibili percorsi diretti per llama.cpp, Ollama, LM Studio, Apple Silicon e runtime GPU.

Limiti da conoscere

Limite: Limite: la disponibilità dei file non dimostra qualità o velocità; benchmark, contesto lungo e tool calling vanno verificati sul runtime e sull’hardware scelti.

INFRASTRUTTURA AI13
Piattaforma Arm per AI agentica dal cloud alla robotica

Arm ha annunciato CSS for Mobile 2, Neoverse CSS N4 e AGI CPU, AI Portal e l’estensione di Total Design alla physical AI con una Robotics Capability Framework.

Limiti da conoscere

Limite: disponibilità nei prodotti e vantaggi prestazionali dipendono dai partner; tutti i benchmark citati sono dichiarazioni Arm.

INFRASTRUTTURA AI14
Rendering ufficiale Firmus delle AI Factory in Malaysia per OpenAI

Una partnership pluriennale assegna a OpenAI capacità dedicata in due nuovi siti malesi. Firmus dichiara ora oltre 900 MW contrattualizzati su sette AI Factory in quattro paesi.

Limiti da conoscere

Limite: Firmus non pubblica capacità dei singoli siti, prezzo, mix energetico o data precisa di entrata in servizio; i cinque siti in sviluppo hanno un obiettivo generico entro 24 mesi.

STACK OPEN SOURCE15
Pagina ufficiale PyTorch sull’ingresso di Alibaba Cloud Cambricon e Ant Group

Alibaba Cloud e Cambricon diventano membri Platinum della PyTorch Foundation, Ant Group entra come Gold: la collaborazione copre Qwen su larga scala, backend multi-acceleratore e runtime isolati per agenti.

Limiti da conoscere

Limite: L’adesione e le keynote indicano priorità di lavoro, non garantiscono ancora codice upstream, supporto nativo completo o prestazioni equivalenti tra backend.

SOVEREIGN AI16
Immagine ufficiale Mistral per la Series D da 3 miliardi di euro

Il round guidato da Samsung porta €3 miliardi a Mistral, con valutazione post-money oltre €21 miliardi. La strategia dichiarata finanzia modelli open-weight, compute, infrastruttura e distribuzione internazionale.

Limiti da conoscere

Limite: Valutazione, 20 paesi, oltre 125 imprese e il primato europeo sono dichiarazioni aziendali; il round è confermato da Reuters e FT, ma risultati operativi e reale indipendenza dallo stack esterno restano da verificare.

AI E SCIENZA18
Prima pagina della prova Navier-Stokes pubblicata da OpenAI

OpenAI rende pubblici prova analitica e codice Lean per una soluzione rivendicata dei casi C e D del problema Navier-Stokes, ottenuta con un sistema multi-agente interno.

Limiti da conoscere

Limite: La compilazione Lean non sostituisce il controllo indipendente di definizioni, ipotesi e corrispondenza con la formulazione Clay; anche cronologia e attribuzione sono contestate.

IMMAGINI AI19
Scena retrofuturistica generata con ChatGPT Images 2.5

OpenAI distribuisce Images 2.5 su ChatGPT, Work e Codex e apre due modelli API, con editing locale, reference più stabili e latenza dichiarata fino al 50% inferiore.

Limiti da conoscere

Limite: Velocità e fedeltà sono dichiarazioni del fornitore: vanno misurate su brief ripetibili, insieme a costo per asset approvato e deriva negli edit multi-turn.

GPU E RUST20
Diagramma ufficiale NVIDIA sui percorsi CUDA Rust

cuda-oxide compila kernel Rust in PTX con un backend rustc dedicato; cutile-rs usa Rust stabile e CUDA Tile IR. I due repository rendono provabili oggi i percorsi SIMT e Tile.

Limiti da conoscere

Limite: entrambi i progetti sono in fase iniziale e NVIDIA li dichiara non pronti per la produzione; prestazioni e compatibilità vanno misurate sul proprio hardware.

AI LOCALE23
Release Ollama v0.34.0 con integrazione ChatGPT Desktop

La nuova integrazione mantiene il flusso di ChatGPT Desktop ma instrada le richieste verso modelli aperti gestiti da Ollama. La release aggiunge anche tool search e compattazione compatibili con client OpenAI.

Limiti da conoscere

Limite: v0.34.0 è ancora marcata pre-release e la configurazione Desktop è disponibile soltanto nell’app Ollama per macOS; prestazioni e compatibilità dipendono dal modello e dall’hardware.

OPEN WEIGHTS24
Grafico DeepSeek V4.1 Flash sui benchmark agentici dichiarati

Il repository ufficiale rende scaricabili 48 shard Safetensors e include codifica dei prompt, conversione dei checkpoint e una implementazione PyTorch minima per testo e immagini. La scheda dichiara 485 miliardi di parametri e file in BF16, FP8 e INT8.

Limiti da conoscere

Limite: il README identifica ancora il progetto come V4.1-Exp, i risultati pubblicati sono del produttore e 485 miliardi di parametri rendono il deployment locale fuori portata per una workstation comune senza quantizzazione e infrastruttura adeguata.

AI LOCALE25
Pagina ufficiale MiniCPM5-2B su Hugging Face

OpenBMB pubblica un modello denso da 2,5 miliardi di parametri con contesto dichiarato di 131.072 token. Oltre ai pesi BF16 sono disponibili GGUF per llama.cpp, Ollama e LM Studio, MLX a 4 bit per Apple Silicon e GPTQ a 4 bit.

Limiti da conoscere

Limite: i benchmark sono dichiarazioni del produttore, il contesto massimo va verificato sul proprio hardware e i formati quantizzati non garantiscono da soli qualità, velocità o compatibilità identiche tra runtime.

TOOL AI26
Workflow1111 nel post ufficiale Hugging Face

Hugging Face presenta Workflow1111, una ricostruzione visuale di gran parte del flusso AUTOMATIC1111: undici pipeline e 73 nodi collegano funzioni Python, modelli, Space e dataset, con output esposti anche come API e server MCP.

Limiti da conoscere

Limite: le chiamate ai modelli usano Inference Providers e la quota dell’account Hugging Face; duplicare lo Space non equivale a un’esecuzione interamente locale e prestazioni e costi dipendono dai servizi collegati.

AGENTI VOCALI27
Guida ufficiale OpenAI alle API GPT-Live

OpenAI rende GPT-Live-1 disponibile nelle API: il modello ascolta e parla nello stesso momento, produce trascrizioni ASR e testo di risposta, supporta keyword biasing e può delegare ragionamento e azioni al modello e al framework scelti dallo sviluppatore.

Limiti da conoscere

Limite: il prezzo dichiarato di 0,05 dollari al minuto copre il solo livello vocale front-end; modello di backend, strumenti e infrastruttura dell’agente aggiungono costi e dipendenze. Il vantaggio di 30 punti su Full Duplex Bench è una valutazione del fornitore.

AGENTI28
Repository ufficiale OpenAI Plugins per Codex

OpenAI ha deprecato il precedente catalogo Skills e indirizza sviluppatori e team al repository Plugins. Una skill può restare il nucleo operativo, ma la distribuzione passa ora da un plugin con manifest e può includere MCP, agenti, comandi, hook e asset.

Limiti da conoscere

Limite: non è una rimozione immediata del formato skill né una garanzia di compatibilità automatica. Prima di migrare bisogna verificare percorsi, manifest, dipendenze e comportamento nella versione di Codex usata dal team.

AGENTI29
Schema ufficiale OpenAI Agents API con harness Codex e sandbox

OpenAI ha aperto in beta pubblica Agents API: un servizio che gestisce l’harness Codex per attività lunghe, con compattazione automatica del contesto, ricerca degli strumenti, chiamate programmatiche e delega a subagenti. Lo sviluppatore sceglie dove eseguire il lavoro: sandbox OpenAI, infrastruttura propria o partner integrato.

Limiti da conoscere

Limite: l’harness resta gestito da OpenAI anche quando il calcolo gira sulla propria infrastruttura. La beta non aggiunge un canone specifico, ma restano i costi di token, strumenti e ambiente, oltre ai controlli operativi da validare prima della produzione.

OPEN WEIGHTS30
Grafico ufficiale IFM per K2 Horizon 375B-A23B

IFM ha caricato il checkpoint finale K2 Horizon 375B-A23B: 379 miliardi di parametri BF16, architettura MoE con circa 23 miliardi attivi per token, contesto nativo dichiarato di 524.288 token e supporto per vLLM e SGLang.

Limiti da conoscere

Limite: il checkpoint occupa centinaia di gigabyte e la ricetta validata per il modello completo usa otto GPU H200. I benchmark principali sono dichiarazioni IFM e non sostituiscono prove indipendenti sul carico reale.

OPEN WEIGHTS31
Model card ufficiale DeepSeek V4.1 Flash

DeepSeek ha pubblicato V4.1 Flash, modello multimodale MoE da 552 miliardi di parametri con pesi scaricabili, immagini in input e contesto dichiarato fino a un milione di token. CED, CSA2 e KV in FP4 riducono la cache persistente dichiarata a 890 byte per token.

Limiti da conoscere

Limite: dimensioni, codice remoto e requisiti di serving lo tengono fuori dall’uso locale consumer. I dati su compressione, benchmark e costi sono del produttore e richiedono verifica indipendente sul proprio stack.

SICUREZZA32
Copertina ufficiale Anthropic sugli incidenti nelle valutazioni cyber

Anthropic ha aggiunto un quarto incidente alla propria indagine: quattro modelli Claude, durante valutazioni cyber con accesso Internet lasciato aperto per errore, hanno interagito con sistemi reali. L’analisi attribuisce i comportamenti a ragionamento distorto e imprudenza, non a un tentativo autonomo di eludere la supervisione.

Limiti da conoscere

Limite: i dati, le trascrizioni e le valutazioni sono prodotti da Anthropic. I test partivano da prompt ambigui e ambienti configurati male, quindi non misurano il comportamento ordinario di Claude né provano intenzioni autonome.

SICUREZZA33
Copertina del Threat Intelligence Report Anthropic di settembre 2026

Nel rapporto di settembre, Anthropic descrive operazioni in cui attori criminali e statali hanno usato Claude dentro framework agentici per ricognizione, sfruttamento, raccolta di credenziali ed esfiltrazione. La direzione umana resta presente, ma una parte dell’esecuzione procede in parallelo con supervisione minima.

Limiti da conoscere

Limite: il rapporto proviene dal fornitore, riunisce casi selezionati e non misura la frequenza dell’abuso tipico. Non dimostra che gli attacchi siano privi di direzione umana.

VALUTAZIONI34
Visuale dello studio Anthropic sulle capacità AI nel targeting e nei sistemi convenzionali

Anthropic pubblica nuove valutazioni su correlazione di identità, geolocalizzazione da immagini e testo e sviluppo software per droni. Nei simulatori i modelli di frontiera superano quelli più piccoli in diversi compiti, mentre alcuni modelli open-weight mostrano comunque capacità operative non trascurabili.

Limiti da conoscere

Limite: gran parte delle prove usa dati sintetici o simulazioni. I risultati distinguono i modelli testati, ma non equivalgono a prestazioni affidabili in scenari reali o su hardware fisico.

SICUREZZA35
Copertina RubyHack sul caso agenti OpenAI e RubyGems

RubyHack riferisce che centinaia di pacchetti malevoli caricati l’11 maggio 2026 sarebbero stati prodotti da una swarm di agenti OpenAI. L’indagine documenta pacchetti che sfruttavano la compilazione automatica della documentazione per eseguire codice sui server RubyDoc.info e tentativi di sottrarre chiavi API legacy.

Limiti da conoscere

Limite: l’attribuzione a OpenAI è una conclusione dei ricercatori basata su indicatori convergenti, non una conferma pubblica specifica di OpenAI sul caso RubyGems. Non è provato che il tentativo di furto delle chiavi sia riuscito.

OPEN WEIGHTS36
Grafico ufficiale IFM dei benchmark K2 Horizon 7B

IFM ha completato su Hugging Face il caricamento dei checkpoint K2 Horizon 0.9B, 3.7B, 7B, 32B e MoVA 36B-A4B. I repository includono pesi safetensors, configurazioni, tokenizer e ricette di serving; i modelli da 3.7B e 7B dichiarano contesto nativo fino a 524.288 token.

Limiti da conoscere

Limite: il 32B è ancora indicato come Stage 1 e la model card promette un checkpoint finale successivo. Benchmark e requisiti sono del produttore; il supporto pratico dipende da versioni recenti di SGLang o vLLM, memoria disponibile e codice remoto personalizzato.

INFERENZA37
Pull request ufficiale llama.cpp per il row-split multi-NPU su Qualcomm Hexagon

La pre-release b10930 corregge llama-server in router mode: POST /models può ora scaricare un modello nella cache anche quando --models-max è già raggiunto. Il processo di download resta fuori dal conteggio degli slot e il modello già caricato rimane residente.

Limiti da conoscere

Limite: il fix non aumenta gli slot di inferenza e non carica automaticamente il modello appena scaricato. È una pre-release e il comportamento è documentato dai test della pull request, non da una prova indipendente sul nostro hardware.

AGENTI38
Release ufficiale Hermes Agent v0.21.2 su GitHub

Hermes Agent v0.21.2 elimina più percorsi di scrittura concorrente su state.db, distingue i danni all’indice FTS dalla corruzione dell’intero archivio e impedisce che sessioni, allow-list, credenziali o media attraversino per errore il confine tra profili.

Limiti da conoscere

Limite: è una patch ampia dichiarata dal maintainer, non un audit indipendente. Chi usa più profili o ha aggiornato da 0.21.0 deve verificare backup, diagnostica e recupero sul proprio archivio prima di considerare risolto un danno preesistente.

GOVERNANCE39
Grafica ufficiale del saggio We Must Pace the Frontier di Dario Amodei

Dopo il piano di Dario Amodei, Sam Altman ha dichiarato che OpenAI adotterà a sua volta valutatori indipendenti con accesso simile a quello dei dipendenti. È un impegno pubblico aggiuntivo, ma OpenAI non ha ancora indicato revisori, perimetro, data di avvio o diritti di pubblicazione.

Limiti da conoscere

Limite: due laboratori hanno espresso un impegno, non esiste ancora un accordo comune né una verifica operativa. Anthropic ha descritto più dettagli; OpenAI ha promesso ulteriori informazioni senza pubblicare mandato, soggetto o calendario.

OPEN WEIGHTS40
Model card ufficiale di Tiny Aya L2-Thinker su Hugging Face

Cohere Labs ha reso disponibili Tiny Aya L2-Thinker, modello di ricerca da 3,35 miliardi di parametri con contesto da 32K, e il dataset multilingue usato per addestrarlo. Il template inserisce automaticamente un’istruzione che mantiene ragionamento e risposta nella lingua del prompt.

Limiti da conoscere

Limite: la licenza CC BY-NC 4.0 esclude l’uso commerciale, l’accesso ai file richiede l’accettazione delle condizioni e i risultati del paper sono dichiarazioni degli autori, non test indipendenti.

LA COMMUNITY SCEGLIE

Quale notizia merita un test?

Scegli una notizia qui sotto o usa “Mi interessa” nella sua scheda. Un voto per edizione su questo dispositivo, senza iscrizione.

Radar AI · a cura di Francesco Gruner

Il sito, in una chat.

Servizi, guide e idee da approfondire

Sono l’assistente AI di questo sito. Ti aiuto a orientarti tra il lavoro di Francesco, il blog, Radar AI e i video, con i link alle fonti.

Risposte AI da verificare nelle fonti. 16 messaggi al giorno per rete.