ReleaseOllama
v0.33.2
lint fix (#18081)
28 aug. github.com
Källa
37 referat i flödet. Sammanfattningarna är skrivna av Vibekollen — innehållet tillhör Ollama.
ReleaseOllama
lint fix (#18081)
28 aug. github.com
ReleaseOllama
Ollama släppte version 0.33.2-rc1 med tre uppdateringar: återställning av systemets mörka läge i appen, förbättringar så att förfrågningar fortsätter när modellkatalogen ändras, och synkronisering av macOS appöverföring mellan enheter.
27 aug. github.com
ReleaseOllama
Ollama version 0.33.2 är en uppdatering som fixar systemets mörka läge i appen, gör så att proxyn fortsätter fungera när modellkatalogen ändras, och synkroniserar handoff-funktionen på macOS.
27 aug. github.com
ReleaseOllama
app: consume Claude recommendation mappings (#18042)
27 aug. github.com
ReleaseOllama
What's Changed MLX: Qwen3.8 Flash Next support cmake: make external compat patches idempotent MLX and llama.cpp update mlxrunner: add structured output support mlxrunner: avoid Metal GPU timeouts when loading models from slow storage New Contributors @pd95 made their first contribution in #17948 Full Changelog: v0.33.0...v0.33.1-rc1
26 aug. github.com
ReleaseOllama
Ollama v0.33.0 förbättrar integreringen med Claude Desktop genom att låta dig växla mellan lokala Ollama-modeller direkt från menyraden. Det finns en ny Apps-vy för att hantera integrationer, och flera tekniska fel åtgärdas — bland annat problem med caching där avbrutna beräkningar nu sparar sin framsteg istället för att börja om från början. Versionen fixar också installationsproblem på Linux och Windows, och förbättrar användarens första gång med programmet.
26 aug. github.com
ReleaseOllama
proxy: preserve string content during image fallback (#18002)
26 aug. github.com
ReleaseOllama
Ollama version 0.33.0 förbättrar integrationen med Claude Desktop: du kan nu slå AI-modeller på och av direkt från menyraden och välja mellan dina lokala Ollama-modeller inifrån Claude. Det finns också en ny Apps-vy för att hantera appintegrationer. Under huven har utvecklarna fixat flera prestandaproblem, bland annat med hur systemet återhämtar sig när långvariga beräkningar avbryts, och löst buggarna på macOS, Linux och Windows.
25 aug. github.com
ReleaseOllama
Ollama släpper version 0.33.0 (release candidate) med flera uppdateringar. Det finns fel åtgärdade för Mac-antaganden på Linux och Windows, uppdateringar för MLX-motorn, och nya funktioner i appen såsom stöd för Claude Desktop App, förbättrad onboarding, och möjlighet att koppla in andra appar.
22 aug. github.com
ReleaseOllama
Ollama v0.33.0 är en ny version av verktyget som låter dig köra AI-modeller lokalt på din dator. Uppdateringen innehåller flera förbättringar: fixes för att mlx (en snabb ML-motor) fungerar rätt på Linux och Windows, integrering med Claude Desktop-appen, förbättrad användarupplevelse i onboarding-flödet, och nya funktioner för att koppla samman olika appar. Versionen är ännu en release candidate (testversion innan officiell släpp).
22 aug. github.com
ReleaseOllama
Ollama v0.33.0 är en uppdatering av det open source-verktyg som kör AI-modeller lokalt på din dator. Versionen lägger till stöd för Claude-modellen från Anthropic, förbättrar hur appen fungerar på Windows och Linux, och lägger till nya funktioner för att koppla ihop andra appar med Ollama. Det finns också flera tekniska fixar för hur modellerna körs effektivare.
22 aug. github.com
ReleaseOllama
What's Changed Add a model metadata cache to reduce Ollama’s per-request overhead New Contributors @gaugarg-nv made their first contribution in #17752 Full Changelog: v0.32.14...v0.32.15-rc1
20 aug. github.com
ReleaseOllama
app: add desktop onboarding flow (#17853)
20 aug. github.com
ReleaseOllama
What's Changed Add a model metadata cache to reduce Ollama’s per-request overhead New Contributors @gaugarg-nv made their first contribution in #17752 Full Changelog: v0.32.14...v0.32.15-rc1
19 aug. github.com
ReleaseOllama
What's Changed llm: transcode WebP images for llama-server renderers/qwen: tolerate non-leading system messages Full Changelog: v0.32.13...v0.32.14-rc0
15 aug. github.com
ReleaseOllama
mlx update (#17761)
15 aug. github.com
ReleaseOllama
qwen3.8: support developer instructions Qwen3.8 does not define a developer role, while OpenAI-compatible coding agents commonly send developer instructions before user messages. Fold the leading system/developer instruction prefix into a single system turn before Qwen3.8 validation, preserving instruction precedence without changing Qwen3.5 or other renderer behavior. Add streaming tool-call integration coverage for the native Ollama, OpenAI Chat Completions, OpenAI Responses, and Anthropic Messages request shapes. Each case exercises prior assistant tool calls, tool results, follow-up rendering, and parsed tool-call output. Add Qwen3.8 to the release tools sweep. Removes an unnecessary unit test that should not have been included in the original 3.8 PR. review comments
14 aug. github.com
ReleaseOllama
Qwen3.8 keeps the Qwen3.5 model architecture and parser, but its chat template adds reasoning-effort and preserved-thinking semantics. Detect those template markers during safetensors import, select the qwen3.8 renderer, and cover thinking, tools, continuation, and malformed parser input. Make indexed safetensors imports use the weight map's shard names instead of independently filtering files by the model-* convention. Reject unsafe shard paths, ignore unindexed tensors, and fail when an indexed weight is missing or stored in a different shard. Retain the conservative model-* scan when no index is present. Treat Classification.Quantize as the effective tensor format and pass it to the manifest writer. This records file_type for automatic block-FP8-to-MXFP8 conversion and recognized prequantized inputs, preserves requested quantization and base-plus-draft behavior, and avoids claiming one type for mixed or unknown formats. Normalize both supported convolution weight layouts with an explicit reshape.
14 aug. github.com
ReleaseOllama
agent: allow multiple edits per edit tool call (#17711)
13 aug. github.com
ReleaseOllama
Ollama v0.32.10 är en uppdatering av det verktyg som låter dig köra AI-modeller lokalt på din dator. Ändringar inkluderar att modeller nu per standard är inställda på att inte upprepa sig själva (repeat_penalty ändras från 1.1 till 1.0), vilket gör allt snabbare. Det finns också en hastighetshöjning på 7–8 procent för vissa GPU-accelererade modeller som Qwen3.6 och Muse Glimmer. En bugg reparerades där verifieringen av modellfiler ibland hoppasss över.
13 aug. github.com
ReleaseOllama
Select the 3.5 parser and renderer from its checkpoint template, preserve its prompt semantics, and map medium reasoning effort to the final-user annotation expected by the reference template. Exercise parser and renderer registration, create-time metadata inference, and exact Jinja parity so created models cannot silently fall back to the Nemotron 3 renderer.
11 aug. github.com
ReleaseOllama
Select the 3.5 parser and renderer from its checkpoint template, preserve its prompt semantics, and map medium reasoning effort to the final-user annotation expected by the reference template. Exercise parser and renderer registration, create-time metadata inference, and exact Jinja parity so created models cannot silently fall back to the Nemotron 3 renderer.
11 aug. github.com
ReleaseOllama
Ollama har släppt version 0.32.8 med stöd för Muse Glimmer, ett verktyg för att köra bildgenerering, på fler plattformar — nu kan det användas på NVIDIA-grafikkort, AMD-grafikkort och andra hårdvara.
11 aug. github.com
ReleaseOllama
llama.cpp update (#17659)
11 aug. github.com
ReleaseOllama
ci: retry CUDA pre-release download
10 aug. github.com
ReleaseOllama
Ollama version 0.32.6 är en uppdatering som gör Qwen3.5-modellen snabbare på Apples GPU:er, förbättrar hur chatströmning fungerar för att matcha OpenAIs format, och fixar flera problem i användargränssnittet. Experimentell bildgenerering har tagits bort tillfälligt — använd version 0.32.5 om du behöver den funktionen.
4 aug. github.com
ReleaseOllama
llama.cpp update (#17545)
4 aug. github.com
ReleaseOllama
Ollama version 0.32.5 fixar en bugg i MLX Metal (systemet som kör AI-modeller på vissa Apple-datorer) som gjorde att NVFP4-modeller, särskilt Laguna, producerade sämre resultat.
27 juli github.com
ReleaseOllama
mlx update (#17397)
27 juli github.com
ReleaseOllama
Ollama version 0.32.4 lägger till stöd för Laguna på Apples GPU:er och förbättrar hur AI-modeller skapas när man använder snabbare förhandsversion-teknologi. Versionen fixar också problem med en särskild typ av modell (Qwen3 MoE) och gör den snabbare på Apple-chips.
25 juli github.com
ReleaseOllama
Ollama har uppdaterat sitt MLX-stöd (en teknik för att köra AI-modeller effektivt) för att fungera med Laguna-modellerna XS 2, XS 2.1 och S 2.1. Uppdateringen innehåller optimeringar för hur modellerna laddar och kör, samt förbättringar för hur stora och komplexa delar av modellen hanteras snabbare.
25 juli github.com
ReleaseOllama
Withdrawn, please use 0.32.3 or newer
23 juli github.com
ReleaseOllama
Ollama släppte version 0.32.3 med lagningar för nedladdningar som stannade upp, bättre stöd för olika AI-modeller (bland annat Claude och Anthropic), och utökad GPU-stöd för Windows och Linux. De lade också till nya funktioner för Laguna 2.1-modeller och fixade problem med verktygsanrop i GLM-modeller.
23 juli github.com
ReleaseOllama
Ollama uppdaterar sitt underliggande AI-motor (llama.cpp) för att använda den senaste versionen av Laguna, som är en teknik för att köra stora modeller effektivt. Ollama tar bort sin egen version och behåller bara en liten justering för Apple Silicon-datorer.
23 juli github.com
ReleaseOllama
Ollama har organiserat om sina integrationstester — de automatiska testerna som kontrollerar att olika delar fungerar tillsammans — i tre grupper: snabba tester, release-tester och bibliotekstester. De har också uppdaterat vilka AI-modeller som testas, tagit bort äldre och lagt till nyare.
22 juli github.com
ReleaseOllama
Needed for cross-compiling WoA
21 juli github.com
ReleaseOllama
Ollama v0.32.2-rc1 förbättrar hur servern hanterar nedladdningar genom att upptäcka när en nedladdning fastnar redan innan den börjar ta emot data. Det finns även ändringar för hur timeout-inställningen för nedladdningar fungerar.
21 juli github.com