Vai al contenuto

Ollama, DeepSeek e MiniCPM rafforzano l’AI locale, Workflow1111 organizza pipeline creative, GPT-Live-1 apre gli agenti vocali full-duplex e Codex consolida skill e integrazioni nei plugin.

Radar AI / Edizione giornaliera

IL PUNTO SULL’AI

10 settembre 2026

Ollama, DeepSeek e MiniCPM rafforzano l’AI locale, Workflow1111 organizza pipeline creative, GPT-Live-1 apre gli agenti vocali full-duplex e Codex consolida skill e integrazioni nei plugin.

6 notizie2 min di letturaVerificato alle 22:35

AI LOCALE01
Release Ollama v0.34.0 con integrazione ChatGPT Desktop

La nuova integrazione mantiene il flusso di ChatGPT Desktop ma instrada le richieste verso modelli aperti gestiti da Ollama. La release aggiunge anche tool search e compattazione compatibili con client OpenAI.

Limiti da conoscere

Limite: v0.34.0 è ancora marcata pre-release e la configurazione Desktop è disponibile soltanto nell’app Ollama per macOS; prestazioni e compatibilità dipendono dal modello e dall’hardware.

OPEN WEIGHTS02
Grafico DeepSeek V4.1 Flash sui benchmark agentici dichiarati

Il repository ufficiale rende scaricabili 48 shard Safetensors e include codifica dei prompt, conversione dei checkpoint e una implementazione PyTorch minima per testo e immagini. La scheda dichiara 485 miliardi di parametri e file in BF16, FP8 e INT8.

Limiti da conoscere

Limite: il README identifica ancora il progetto come V4.1-Exp, i risultati pubblicati sono del produttore e 485 miliardi di parametri rendono il deployment locale fuori portata per una workstation comune senza quantizzazione e infrastruttura adeguata.

AI LOCALE03
Pagina ufficiale MiniCPM5-2B su Hugging Face

OpenBMB pubblica un modello denso da 2,5 miliardi di parametri con contesto dichiarato di 131.072 token. Oltre ai pesi BF16 sono disponibili GGUF per llama.cpp, Ollama e LM Studio, MLX a 4 bit per Apple Silicon e GPTQ a 4 bit.

Limiti da conoscere

Limite: i benchmark sono dichiarazioni del produttore, il contesto massimo va verificato sul proprio hardware e i formati quantizzati non garantiscono da soli qualità, velocità o compatibilità identiche tra runtime.

TOOL AI04
Workflow1111 nel post ufficiale Hugging Face

Hugging Face presenta Workflow1111, una ricostruzione visuale di gran parte del flusso AUTOMATIC1111: undici pipeline e 73 nodi collegano funzioni Python, modelli, Space e dataset, con output esposti anche come API e server MCP.

Limiti da conoscere

Limite: le chiamate ai modelli usano Inference Providers e la quota dell’account Hugging Face; duplicare lo Space non equivale a un’esecuzione interamente locale e prestazioni e costi dipendono dai servizi collegati.

AGENTI VOCALI05
Guida ufficiale OpenAI alle API GPT-Live

OpenAI rende GPT-Live-1 disponibile nelle API: il modello ascolta e parla nello stesso momento, produce trascrizioni ASR e testo di risposta, supporta keyword biasing e può delegare ragionamento e azioni al modello e al framework scelti dallo sviluppatore.

Limiti da conoscere

Limite: il prezzo dichiarato di 0,05 dollari al minuto copre il solo livello vocale front-end; modello di backend, strumenti e infrastruttura dell’agente aggiungono costi e dipendenze. Il vantaggio di 30 punti su Full Duplex Bench è una valutazione del fornitore.

AGENTI06
Repository ufficiale OpenAI Plugins per Codex

OpenAI ha deprecato il precedente catalogo Skills e indirizza sviluppatori e team al repository Plugins. Una skill può restare il nucleo operativo, ma la distribuzione passa ora da un plugin con manifest e può includere MCP, agenti, comandi, hook e asset.

Limiti da conoscere

Limite: non è una rimozione immediata del formato skill né una garanzia di compatibilità automatica. Prima di migrare bisogna verificare percorsi, manifest, dipendenze e comportamento nella versione di Codex usata dal team.

LA COMMUNITY SCEGLIE

Quale notizia merita un test?

Scegli una notizia qui sotto o usa “Mi interessa” nella sua scheda. Un voto per edizione su questo dispositivo, senza iscrizione.

Radar AI · a cura di Francesco Gruner

Il sito, in una chat.

Servizi, guide e idee da approfondire

Sono l’assistente AI di questo sito. Ti aiuto a orientarti tra il lavoro di Francesco, il blog, Radar AI e i video, con i link alle fonti.

Risposte AI da verificare nelle fonti. 16 messaggi al giorno per rete.