Vai al contenuto

Claude Sonnet 5.5 accelera le API, NVIDIA isola gli agenti e AMD porta i modelli spaziali nella propria roadmap hardware.

Radar AI / Edizione giornaliera

IL PUNTO SULL’AI

28 settembre 2026

Claude Sonnet 5.5 accelera le API, NVIDIA isola gli agenti e AMD porta i modelli spaziali nella propria roadmap hardware.

7 notizie2 min di letturaVerificato alle 00:25

INFERENZA01
Grafica ufficiale Vercel del Production Index AI Gateway di settembre 2026

Nel Production Index di settembre, Vercel misura che ad agosto i modelli open-weight hanno elaborato per la prima volta la maggioranza dei token del suo AI Gateway: 56%, contro meno del 10% a dicembre 2025. Nello stesso mese il costo medio stimato per token è sceso del 23,2%.

Limiti da conoscere

Limite: È telemetria aggregata di un singolo gateway, non un censimento del mercato. La categoria open-weight segue la lista corrente di Vercel, più ampia della definizione usata nei report precedenti; la spesa è stimata dai prezzi di listino e i mesi passati possono essere rivisti.

MODELLI LOCALI02
Tabella ufficiale dei benchmark OpenDecider con accuratezza, calibrazione e latenza

OpenDecider 0.1.2 pubblica codice e pesi Apache 2.0 per modelli da 400M, 4B e 30B-A3B che rispondono a scelte, punteggi e domande sì/no con probabilità. Il pacchetto gira in locale e include risultati e predizioni del benchmark.

Limiti da conoscere

Limite: I risultati sono prodotti dall’autore sul proprio harness, non da una valutazione indipendente. Nano è debole sul phishing, l’inglese è l’unica lingua valutata e il modello 30B richiede circa 61 GB di memoria GPU.

INFERENZA LOCALE03
Pagina ufficiale GitHub della release llama.cpp b11224 con la correzione Vulkan

La build b11224 di llama.cpp corregge letture fuori riga nei percorsi Vulkan di moltiplicazione delle matrici quando un tensore usa una porzione di una cache più grande. La release aggiunge casi di test e binari Vulkan pronti per Linux e Windows.

Limiti da conoscere

Limite: Il progetto non elenca modelli, GPU o output utente certamente colpiti e questo Radar non ha riprodotto il difetto su hardware AMD. La correzione riguarda il backend Vulkan, non tutte le esecuzioni llama.cpp.

AGENTI LOCALI04
Tabella ufficiale dei benchmark Holo4 per computer use, automazione e tool

H Company rilascia Holo4 in due taglie, 27B dense e 35B-A3B MoE, per usare GUI, codice, MCP e API nello stesso flusso. Sono disponibili checkpoint BF16, FP8, NVFP4 e GGUF 4-bit, API hosted e traiettorie dei benchmark consultabili.

Limiti da conoscere

Limite: I benchmark e i costi sono dichiarati dal produttore e dipendono dal suo harness. Il 27B usa CC BY-NC 4.0, mentre il 35B-A3B è Apache 2.0; questo Radar non ha ancora verificato memoria, velocità o affidabilità su hardware locale.

SICUREZZA AGENTI05
Diagramma ufficiale NVIDIA Open Agent Safety Platform con OpenShell e Sentry

NVIDIA riunisce OpenShell e il nuovo design Sentry in una piattaforma di sicurezza per agenti. OpenShell applica policy e traccia le azioni nel runtime; Sentry monitora fuori banda su DPU BlueField-4 e può mettere in quarantena un agente che supera i confini assegnati.

Limiti da conoscere

Limite: OpenShell è disponibile e open source, mentre Sentry è un reference design legato a BlueField-4. Le prestazioni e la quarantena in millisecondi sono dichiarazioni NVIDIA, non risultati verificati indipendentemente in questo Radar.

MODELLI API06
Grafica ufficiale del lancio di Claude Sonnet 5.5

Anthropic rende disponibile Claude Sonnet 5.5 con ID API claude-sonnet-5-5, prezzi invariati di 2 dollari per milione di token in input e 10 in output, oltre a una velocità dichiarata superiore di oltre il 30%. Arriva su Claude, API, AWS, Google Cloud e Microsoft Azure.

Limiti da conoscere

Limite: Prestazioni, risparmio per attività e benchmark arrivano da Anthropic e tester scelti dal fornitore. Non sono una prova indipendente sui carichi reali e la migrazione richiede attenzione al nuovo comportamento between_tools quando il thinking è disattivato.

INFRASTRUTTURA AI07
Immagine ufficiale AMD per l’acquisizione di World Labs

AMD ha firmato un accordo definitivo per acquisire World Labs, laboratorio guidato da Fei-Fei Li che sviluppa modelli di intelligenza spaziale per generare e simulare ambienti 3D. L’operazione interamente in azioni vale circa 8,2 miliardi di dollari e punta a collegare ricerca sui modelli e roadmap di hardware, software e sistemi AMD.

Limiti da conoscere

Limite: L’acquisizione non è ancora conclusa: è soggetta ad approvazioni regolatorie e alle normali condizioni di chiusura, prevista entro fine 2026. AMD non ha annunciato prodotti, tempi di integrazione o benchmark derivati dall’operazione.

LA COMMUNITY SCEGLIE

Quale notizia merita un test?

Scegli una notizia qui sotto o usa “Mi interessa” nella sua scheda. Un voto per edizione su questo dispositivo, senza iscrizione.

Radar AI · a cura di Francesco Gruner

Chiedi al sito.

Assistente OpenAI

Le domande vengono inviate a OpenAI. Non inserire dati personali o riservati. Privacy.

Verifica le risposte nelle fonti. 16 messaggi al giorno per rete.

Cosa cerchi? Ti indico le pagine utili.