v0.32.10
Bild från github.com
Ollama v0.32.10 är en uppdatering av det verktyg som låter dig köra AI-modeller lokalt på din dator.
Ändringar inkluderar att modeller nu per standard är inställda på att inte upprepa sig själva (repeat_penalty ändras från 1.1 till 1.0), vilket gör allt snabbare. Det finns också en hastighetshöjning på 7–8 procent för vissa GPU-accelererade modeller som Qwen3.6 och Muse Glimmer. En bugg reparerades där verifieringen av modellfiler ibland hoppasss över.
Models that don't set a repeat_penalty now default to 1.0 (off) instead of 1.1, matching other engines and speeding up speculative decoding; set a per-model parameter if an older model repeats itself.
Läs hela hos Ollama →
Sammanfattningen är skriven av Vibekollen utifrån källans egen publicering. Innehållet tillhör Ollama.