IL PUNTO SULL’AI
28 settembre 2026
Claude Sonnet 5.5 accelera le API, NVIDIA isola gli agenti e AMD porta i modelli spaziali nella propria roadmap hardware.
In questa edizione 7 notizie

Nel Production Index di settembre, Vercel misura che ad agosto i modelli open-weight hanno elaborato per la prima volta la maggioranza dei token del suo AI Gateway: 56%, contro meno del 10% a dicembre 2025. Nello stesso mese il costo medio stimato per token è sceso del 23,2%.
Limiti da conoscere
Limite: È telemetria aggregata di un singolo gateway, non un censimento del mercato. La categoria open-weight segue la lista corrente di Vercel, più ampia della definizione usata nei report precedenti; la spesa è stimata dai prezzi di listino e i mesi passati possono essere rivisti.

OpenDecider 0.1.2 pubblica codice e pesi Apache 2.0 per modelli da 400M, 4B e 30B-A3B che rispondono a scelte, punteggi e domande sì/no con probabilità. Il pacchetto gira in locale e include risultati e predizioni del benchmark.
Limiti da conoscere
Limite: I risultati sono prodotti dall’autore sul proprio harness, non da una valutazione indipendente. Nano è debole sul phishing, l’inglese è l’unica lingua valutata e il modello 30B richiede circa 61 GB di memoria GPU.

La build b11224 di llama.cpp corregge letture fuori riga nei percorsi Vulkan di moltiplicazione delle matrici quando un tensore usa una porzione di una cache più grande. La release aggiunge casi di test e binari Vulkan pronti per Linux e Windows.
Limiti da conoscere
Limite: Il progetto non elenca modelli, GPU o output utente certamente colpiti e questo Radar non ha riprodotto il difetto su hardware AMD. La correzione riguarda il backend Vulkan, non tutte le esecuzioni llama.cpp.

H Company rilascia Holo4 in due taglie, 27B dense e 35B-A3B MoE, per usare GUI, codice, MCP e API nello stesso flusso. Sono disponibili checkpoint BF16, FP8, NVFP4 e GGUF 4-bit, API hosted e traiettorie dei benchmark consultabili.
Limiti da conoscere
Limite: I benchmark e i costi sono dichiarati dal produttore e dipendono dal suo harness. Il 27B usa CC BY-NC 4.0, mentre il 35B-A3B è Apache 2.0; questo Radar non ha ancora verificato memoria, velocità o affidabilità su hardware locale.

NVIDIA riunisce OpenShell e il nuovo design Sentry in una piattaforma di sicurezza per agenti. OpenShell applica policy e traccia le azioni nel runtime; Sentry monitora fuori banda su DPU BlueField-4 e può mettere in quarantena un agente che supera i confini assegnati.
Limiti da conoscere
Limite: OpenShell è disponibile e open source, mentre Sentry è un reference design legato a BlueField-4. Le prestazioni e la quarantena in millisecondi sono dichiarazioni NVIDIA, non risultati verificati indipendentemente in questo Radar.

Anthropic rende disponibile Claude Sonnet 5.5 con ID API claude-sonnet-5-5, prezzi invariati di 2 dollari per milione di token in input e 10 in output, oltre a una velocità dichiarata superiore di oltre il 30%. Arriva su Claude, API, AWS, Google Cloud e Microsoft Azure.
Limiti da conoscere
Limite: Prestazioni, risparmio per attività e benchmark arrivano da Anthropic e tester scelti dal fornitore. Non sono una prova indipendente sui carichi reali e la migrazione richiede attenzione al nuovo comportamento between_tools quando il thinking è disattivato.

AMD ha firmato un accordo definitivo per acquisire World Labs, laboratorio guidato da Fei-Fei Li che sviluppa modelli di intelligenza spaziale per generare e simulare ambienti 3D. L’operazione interamente in azioni vale circa 8,2 miliardi di dollari e punta a collegare ricerca sui modelli e roadmap di hardware, software e sistemi AMD.
Limiti da conoscere
Limite: L’acquisizione non è ancora conclusa: è soggetta ad approvazioni regolatorie e alle normali condizioni di chiusura, prevista entro fine 2026. AMD non ha annunciato prodotti, tempi di integrazione o benchmark derivati dall’operazione.
LA COMMUNITY SCEGLIE
Quale notizia merita un test?
Scegli una notizia qui sotto o usa “Mi interessa” nella sua scheda. Un voto per edizione su questo dispositivo, senza iscrizione.