L’ANALISI
Ollama 0.34.2: onboarding condiviso e fix MLX per generazioni lunghe
La release stabile aggiunge il primo avvio con scelta tra accesso e uso locale, deep link alle app e corregge una crescita eccessiva della memoria durante lo speculative decoding MLX.

In breve: La modifica più concreta è la stabilizzazione della memoria nelle lunghe generazioni MLX, accompagnata da un onboarding che preserva esplicitamente la possibilità di continuare in locale.
Primo avvio
CLI e app desktop condividono lo stato di configurazione e offrono accesso oppure continuazione locale.
Correzione MLX
La release corregge buffer liberati ma non restituiti durante speculative decoding e crescita della cache KV.
Impatto pratico
Su carichi lunghi il fix può evitare crescita progressiva della memoria e crash del processo su Apple Silicon.
Condizioni e limiti
Il risultato dipende da modello, contesto e backend; serve una prova riproducibile prima e dopo l’aggiornamento.
Checklist pratica
- Salvare versione, modello e prompt di prova.
- Misurare RAM su una generazione lunga.
- Verificare che il percorso locale resti selezionato.
- Tenere un rollback alla versione precedente.