v0.32.6
Bild från github.com
Ollama version 0.32.6 är en uppdatering som gör Qwen3.5-modellen snabbare på Apples GPU:er, förbättrar hur chatströmning fungerar för att matcha OpenAIs format, och fixar flera problem i användargränssnittet.
Experimentell bildgenerering har tagits bort tillfälligt — använd version 0.32.5 om du behöver den funktionen.
Qwen3.5 is faster on Apple GPUs: the MLX engine now uses the model's MTP head for speculative decoding automatically
Läs hela hos Ollama →
Sammanfattningen är skriven av Vibekollen utifrån källans egen publicering. Innehållet tillhör Ollama.