IL PUNTO SULL’AI
10 settembre 2026
Ollama, DeepSeek e MiniCPM rafforzano l’AI locale, Workflow1111 organizza pipeline creative, GPT-Live-1 apre gli agenti vocali full-duplex e Codex consolida skill e integrazioni nei plugin.
In questa edizione 6 notizie

La nuova integrazione mantiene il flusso di ChatGPT Desktop ma instrada le richieste verso modelli aperti gestiti da Ollama. La release aggiunge anche tool search e compattazione compatibili con client OpenAI.
Limiti da conoscere
Limite: v0.34.0 è ancora marcata pre-release e la configurazione Desktop è disponibile soltanto nell’app Ollama per macOS; prestazioni e compatibilità dipendono dal modello e dall’hardware.

Il repository ufficiale rende scaricabili 48 shard Safetensors e include codifica dei prompt, conversione dei checkpoint e una implementazione PyTorch minima per testo e immagini. La scheda dichiara 485 miliardi di parametri e file in BF16, FP8 e INT8.
Limiti da conoscere
Limite: il README identifica ancora il progetto come V4.1-Exp, i risultati pubblicati sono del produttore e 485 miliardi di parametri rendono il deployment locale fuori portata per una workstation comune senza quantizzazione e infrastruttura adeguata.

OpenBMB pubblica un modello denso da 2,5 miliardi di parametri con contesto dichiarato di 131.072 token. Oltre ai pesi BF16 sono disponibili GGUF per llama.cpp, Ollama e LM Studio, MLX a 4 bit per Apple Silicon e GPTQ a 4 bit.
Limiti da conoscere
Limite: i benchmark sono dichiarazioni del produttore, il contesto massimo va verificato sul proprio hardware e i formati quantizzati non garantiscono da soli qualità, velocità o compatibilità identiche tra runtime.

Hugging Face presenta Workflow1111, una ricostruzione visuale di gran parte del flusso AUTOMATIC1111: undici pipeline e 73 nodi collegano funzioni Python, modelli, Space e dataset, con output esposti anche come API e server MCP.
Limiti da conoscere
Limite: le chiamate ai modelli usano Inference Providers e la quota dell’account Hugging Face; duplicare lo Space non equivale a un’esecuzione interamente locale e prestazioni e costi dipendono dai servizi collegati.

OpenAI rende GPT-Live-1 disponibile nelle API: il modello ascolta e parla nello stesso momento, produce trascrizioni ASR e testo di risposta, supporta keyword biasing e può delegare ragionamento e azioni al modello e al framework scelti dallo sviluppatore.
Limiti da conoscere
Limite: il prezzo dichiarato di 0,05 dollari al minuto copre il solo livello vocale front-end; modello di backend, strumenti e infrastruttura dell’agente aggiungono costi e dipendenze. Il vantaggio di 30 punti su Full Duplex Bench è una valutazione del fornitore.

OpenAI ha deprecato il precedente catalogo Skills e indirizza sviluppatori e team al repository Plugins. Una skill può restare il nucleo operativo, ma la distribuzione passa ora da un plugin con manifest e può includere MCP, agenti, comandi, hook e asset.
Limiti da conoscere
Limite: non è una rimozione immediata del formato skill né una garanzia di compatibilità automatica. Prima di migrare bisogna verificare percorsi, manifest, dipendenze e comportamento nella versione di Codex usata dal team.
LA COMMUNITY SCEGLIE
Quale notizia merita un test?
Scegli una notizia qui sotto o usa “Mi interessa” nella sua scheda. Un voto per edizione su questo dispositivo, senza iscrizione.