Vai al contenuto

La release stabile aggiunge il primo avvio con scelta tra accesso e uso locale, deep link alle app e corregge una crescita eccessiva della memoria durante lo speculative decoding MLX.

L’ANALISI

Ollama 0.34.2: onboarding condiviso e fix MLX per generazioni lunghe

La release stabile aggiunge il primo avvio con scelta tra accesso e uso locale, deep link alle app e corregge una crescita eccessiva della memoria durante lo speculative decoding MLX.

1 min di letturaFatti, limiti e fonti primarie
Ollama 0.34.2 aggiunge onboarding locale e corregge la crescita di memoria MLX
Schermata o grafica ufficiale collegata alla fonte primaria: release Ollama 0.34.2.

In breve: La modifica più concreta è la stabilizzazione della memoria nelle lunghe generazioni MLX, accompagnata da un onboarding che preserva esplicitamente la possibilità di continuare in locale.

Primo avvio

CLI e app desktop condividono lo stato di configurazione e offrono accesso oppure continuazione locale.

Correzione MLX

La release corregge buffer liberati ma non restituiti durante speculative decoding e crescita della cache KV.

Impatto pratico

Su carichi lunghi il fix può evitare crescita progressiva della memoria e crash del processo su Apple Silicon.

Condizioni e limiti

Il risultato dipende da modello, contesto e backend; serve una prova riproducibile prima e dopo l’aggiornamento.

Checklist pratica

  • Salvare versione, modello e prompt di prova.
  • Misurare RAM su una generazione lunga.
  • Verificare che il percorso locale resti selezionato.
  • Tenere un rollback alla versione precedente.

Fonti primarie

Radar AI · a cura di Francesco Gruner

Chiedi al sito.

Assistente OpenAI

Le domande vengono inviate a OpenAI. Non inserire dati personali o riservati. Privacy.

Verifica le risposte nelle fonti. 16 messaggi al giorno per rete.

Cosa cerchi? Ti indico le pagine utili.