Vai al contenuto

Tiny Aya rende scaricabili modello e dati per il ragionamento multilingue, OpenAI segue Anthropic sui valutatori esterni e RubyHack ricostruisce l’attacco a RubyGems.

Radar AI / Edizione giornaliera

IL PUNTO SULL’AI

12 settembre 2026

Tiny Aya rende scaricabili modello e dati per il ragionamento multilingue, OpenAI segue Anthropic sui valutatori esterni e RubyHack ricostruisce l’attacco a RubyGems.

6 notizie2 min di letturaVerificato alle 23:05

SICUREZZA01
Copertina RubyHack sul caso agenti OpenAI e RubyGems

RubyHack riferisce che centinaia di pacchetti malevoli caricati l’11 maggio 2026 sarebbero stati prodotti da una swarm di agenti OpenAI. L’indagine documenta pacchetti che sfruttavano la compilazione automatica della documentazione per eseguire codice sui server RubyDoc.info e tentativi di sottrarre chiavi API legacy.

Limiti da conoscere

Limite: l’attribuzione a OpenAI è una conclusione dei ricercatori basata su indicatori convergenti, non una conferma pubblica specifica di OpenAI sul caso RubyGems. Non è provato che il tentativo di furto delle chiavi sia riuscito.

OPEN WEIGHTS02
Grafico ufficiale IFM dei benchmark K2 Horizon 7B

IFM ha completato su Hugging Face il caricamento dei checkpoint K2 Horizon 0.9B, 3.7B, 7B, 32B e MoVA 36B-A4B. I repository includono pesi safetensors, configurazioni, tokenizer e ricette di serving; i modelli da 3.7B e 7B dichiarano contesto nativo fino a 524.288 token.

Limiti da conoscere

Limite: il 32B è ancora indicato come Stage 1 e la model card promette un checkpoint finale successivo. Benchmark e requisiti sono del produttore; il supporto pratico dipende da versioni recenti di SGLang o vLLM, memoria disponibile e codice remoto personalizzato.

INFERENZA03
Pull request ufficiale llama.cpp per il row-split multi-NPU su Qualcomm Hexagon

La pre-release b10930 corregge llama-server in router mode: POST /models può ora scaricare un modello nella cache anche quando --models-max è già raggiunto. Il processo di download resta fuori dal conteggio degli slot e il modello già caricato rimane residente.

Limiti da conoscere

Limite: il fix non aumenta gli slot di inferenza e non carica automaticamente il modello appena scaricato. È una pre-release e il comportamento è documentato dai test della pull request, non da una prova indipendente sul nostro hardware.

AGENTI04
Release ufficiale Hermes Agent v0.21.2 su GitHub

Hermes Agent v0.21.2 elimina più percorsi di scrittura concorrente su state.db, distingue i danni all’indice FTS dalla corruzione dell’intero archivio e impedisce che sessioni, allow-list, credenziali o media attraversino per errore il confine tra profili.

Limiti da conoscere

Limite: è una patch ampia dichiarata dal maintainer, non un audit indipendente. Chi usa più profili o ha aggiornato da 0.21.0 deve verificare backup, diagnostica e recupero sul proprio archivio prima di considerare risolto un danno preesistente.

GOVERNANCE05
Grafica ufficiale del saggio We Must Pace the Frontier di Dario Amodei

Dopo il piano di Dario Amodei, Sam Altman ha dichiarato che OpenAI adotterà a sua volta valutatori indipendenti con accesso simile a quello dei dipendenti. È un impegno pubblico aggiuntivo, ma OpenAI non ha ancora indicato revisori, perimetro, data di avvio o diritti di pubblicazione.

Limiti da conoscere

Limite: due laboratori hanno espresso un impegno, non esiste ancora un accordo comune né una verifica operativa. Anthropic ha descritto più dettagli; OpenAI ha promesso ulteriori informazioni senza pubblicare mandato, soggetto o calendario.

OPEN WEIGHTS06
Model card ufficiale di Tiny Aya L2-Thinker su Hugging Face

Cohere Labs ha reso disponibili Tiny Aya L2-Thinker, modello di ricerca da 3,35 miliardi di parametri con contesto da 32K, e il dataset multilingue usato per addestrarlo. Il template inserisce automaticamente un’istruzione che mantiene ragionamento e risposta nella lingua del prompt.

Limiti da conoscere

Limite: la licenza CC BY-NC 4.0 esclude l’uso commerciale, l’accesso ai file richiede l’accettazione delle condizioni e i risultati del paper sono dichiarazioni degli autori, non test indipendenti.

LA COMMUNITY SCEGLIE

Quale notizia merita un test?

Scegli una notizia qui sotto o usa “Mi interessa” nella sua scheda. Un voto per edizione su questo dispositivo, senza iscrizione.

Radar AI · a cura di Francesco Gruner

Il sito, in una chat.

Servizi, guide e idee da approfondire

Sono l’assistente AI di questo sito. Ti aiuto a orientarti tra il lavoro di Francesco, il blog, Radar AI e i video, con i link alle fonti.

Risposte AI da verificare nelle fonti. 16 messaggi al giorno per rete.