ollama v0.32.8正式发布:Muse Glimmer 全平台支持、MLX 图像输入与 VS Code 64k 上下文配置详解

🤖 AI总结

主题

Ollama v0.32.8版本发布,主要支持Muse Glimmer模型并扩展至NVIDIA、AMD平台。

摘要

Ollama v0.32.8发布,支持Muse Glimmer全平台运行,新增NVIDIA、AMD支持,更新llama.cpp及VS Code要求,并增强测试。

关键信息

  • 1 Muse Glimmer已支持全平台,包括NVIDIA、AMD。
  • 2 更新了llama.cpp版本及VS Code集成要求。
  • 3 新增视觉OCR文档测试。

ollama v0.32.8正式发布:Muse Glimmer 全平台支持、MLX 图像输入与 VS Code 64k 上下文配置详解

ollama v0.32.8正式发布:Muse Glimmer 全平台支持、MLX 图像输入与 VS Code 64k 上下文配置详解

ollama v0.32.8正式发布:Muse Glimmer 全平台支持、MLX 图像输入与 VS Code 64k 上下文配置详解

2026年8月11日,github.com/ollama/ollama 发布 v0.32.8 版本。本次版本的核心内容是加入对 Muse Glimmer 的支持,并将该模型扩展至 NVIDIA、AMD 以及更多平台。同时,版本中还包含 llama.cpp 更新、VS Code 文档要求调整、上下文长度配置说明、视觉 OCR 文档测试接入,以及 Windows CUDA 安装流程的下载重试改进。

从变更统计看,本次更新包含 4 次提交、44 个文件变更、4,967 行新增以及 49 行删除,共有 2 位贡献者参与。版本发布前后的代码变更覆盖自动化工作流、集成测试、文档、模型运行时依赖版本等多个部分。

一、v0.32.8 发布信息

版本号:v0.32.8
发布日期:2026年8月11日
更新名称:Muse Glimmer

本次发布最重要的内容是:Muse Glimmer 已可在全部平台使用。

Muse Glimmer 可用于多类本地 AI 应用场景,包括编码代理应用和长期运行的个人助手框架。公告中列出的编码代理应用包括:

• Claude Code

  • • Codex

  • • Pi

    公告中列出的长期运行个人助手框架包括:

    • OpenClaw

  • • Hermes

    对于希望在本地运行 Muse Glimmer 的用户,可以直接使用以下命令下载并启动模型:

    ollama run muse-glimmer

    这条命令用于拉取并运行muse-glimmer模型。

    二、Muse Glimmer 的运行方式

    除了直接运行模型外,v0.32.8 还给出了 Muse Glimmer 与多种应用的启动方式。

    如果需要通过 Claude Code 运行 Muse Glimmer,需要先下载 Ollama,然后执行:

    ollama launch claude --model muse-glimmer

    这条命令通过ollama launch启动 Claude Code,并指定模型为muse-glimmer

    对于更轻量级的编码代理,公告建议使用 Pi,命令如下:

    ollama launch pi --model muse-glimmer

    该方式同样使用ollama launch,但目标应用变为 Pi,模型仍为muse-glimmer

    对于个人助手框架,公告给出了 OpenClaw 与 Hermes 的启动命令。

    启动 OpenClaw:

    ollama launch openclaw --model muse-glimmer

    启动 Hermes:

    ollama launch hermes --model muse-glimmer

    从这些命令可以看到,Muse Glimmer 在 v0.32.8 中已被纳入多种应用启动路径。无论是直接通过 Ollama 执行模型,还是通过编码代理应用、个人助手框架调用模型,均可通过指定--model muse-glimmer使用该模型。

    三、Muse Glimmer 扩展至 NVIDIA、AMD 及更多平台

    本次更新中的变更说明明确指出:为 Muse Glimmer 增加 NVIDIA、AMD 和其他更多平台支持。

    此前公告重点提到 Apple Silicon 环境下的 MLX 引擎表现,而 v0.32.8 则进一步补充了 NVIDIA、AMD 以及附加平台的支持范围。该项变更是本次版本“What’s Changed”部分唯一直接列出的核心功能更新。

    更新内容可以概括为:

    • Muse Glimmer 支持 NVIDIA 平台

  • • Muse Glimmer 支持 AMD 平台

  • • Muse Glimmer 支持更多额外平台

  • • Muse Glimmer 已在全部平台可用

    四、MLX 引擎、Apple Silicon 与图像输入支持

    公告同时说明,Ollama 的 MLX 引擎可为 Muse Glimmer 在 Apple Silicon 上提供先进性能。

    在 Ollama 0.32.7 起,MLX 引擎已经支持以下能力:

    • DFlash

  • • 图像输入

    也就是说,v0.32.8 的 Muse Glimmer 发布信息中,继续明确了 Ollama 0.32.7 已具备的 MLX 相关能力:在 Apple Silicon 上,模型可以结合 MLX 引擎运行,并支持 DFlash 和图像输入。

    公告中的信息包括以下几个关键点:

    • Ollama 的 MLX 引擎面向 Apple Silicon 提供性能支持

  • • Muse Glimmer 可在该引擎能力基础上运行

  • • Ollama 0.32.7 已支持 DFlash

  • • Ollama 0.32.7 已支持 image input,也就是图像输入

    这部分内容与本次新增的跨平台支持共同构成了 Muse Glimmer 的运行支持信息:Apple Silicon 环境对应 MLX 引擎能力,NVIDIA、AMD 以及其他平台则在 v0.32.8 中获得支持。

    五、llama.cpp 版本更新

    v0.32.8 更新了 llama.cpp 依赖版本。

    LLAMA_CPP_VERSION文件中的版本号从:

    b10242

    更新为:

    b10353

    这意味着本次 Ollama 版本同步了新的 llama.cpp 版本标识。对应变更为 1 行删除、1 行新增。

    提交记录中也包含一项 llama.cpp 更新提交,时间为 2026年8月11日,距离发布信息所示时间约 8 小时。

    六、VS Code 集成要求提升至 1.127

    docs/integrations/vscode.mdx文档中,Visual Studio Code 的最低版本要求进行了调整。

    原有要求为:

    Visual Studio Code 1.120 或更高版本

    更新后的要求为:

    Visual Studio Code 1.127 或更高版本

    文档中的 Requirements 部分包含以下要求:

    • Visual Studio Code 1.127 或更高版本

  • • 已安装并正在运行的 Ollama

  • • Ollama 中至少有一个可用的本地模型或云模型

    文档还明确指出,较早版本的 VS Code 无法可靠地取消来自语言模型提供商的请求。

    因此,当前 VS Code 集成文档强调的版本要求是:使用 Ollama 扩展进行 VS Code Chat 时,应使用 Visual Studio Code 1.127 或更高版本。

    七、VS Code 文档新增上下文长度说明

    本次文档更新还新增了 Context length,也就是上下文长度相关说明。

    文档指出,VS Code 可能会显示某个模型支持的最大上下文长度,但 Ollama 在实际运行时分配的上下文长度可能更小。

    也就是说,VS Code 的界面显示与 Ollama 实际分配的上下文长度并不一定完全一致。VS Code 可能展示模型的最大支持上限,而 Ollama 运行时使用的上下文长度则可能低于这一数值。

    对于本地模型,文档给出的操作方式是:

    1. 打开 Ollama Settings。

  • 2. 将 context length 设置为至少 64k。

  • 3. 重新加载 VS Code 窗口。

  • 4. 再次发送提示词。

    文档中的表述强调,本地模型需要在 Ollama 设置中将上下文长度设置为至少 64k,随后重新加载 VS Code 窗口并重新发送提示词。

    相关文档同时指向 Context length 页面,以便查看上下文长度的更多信息。

    这部分新增内容对于在 VS Code 中使用本地模型的场景具有直接对应关系:即使 VS Code 显示模型具备较大的最大上下文能力,仍需关注 Ollama 实际运行时分配的上下文长度,并在本地模型场景下通过 Ollama Settings 设置至少 64k 的上下文长度。

    八、Ollama 版本建议保持不变

    VS Code 集成文档中还保留了关于 Ollama 版本的说明。

    文档建议使用 Ollama 0.17.6 或更新版本,以支持:

    • 云模型登录

  • • 更丰富的模型元数据

    同时,文档也说明,较旧版本仍可能与本地模型配合使用。

    因此,文档中的版本信息可以整理为:

    • VS Code 要求为 1.127 或更高版本

  • • 推荐使用 Ollama 0.17.6 或更高版本,以获得云模型登录和更丰富模型元数据支持

  • • 较旧的 Ollama 版本仍可能支持本地模型

    九、Windows CUDA 安装流程加入重试机制

    本次变更对两个 GitHub Actions 工作流中的 CUDA 安装流程进行了调整:

    .github/workflows/release.yaml

  • .github/workflows/test-llamacpp-update.yaml

    两个文件的改动内容一致,均涉及 Windows PowerShell 环境下 CUDA 安装程序的下载。

    原流程中使用Invoke-WebRequest下载 CUDA 安装程序,并保存为install.exe。更新后,下载过程增加了重试逻辑。

    更新后的流程会在缓存未命中的情况下执行下载:

    if ("${{ steps.cache-install.outputs.cache-hit }}" -ne 'true') {

    下载部分通过循环最多尝试 3 次:

    for ($attempt = 1; $attempt -le 3; $attempt++) {

    每次尝试中执行:

    Invoke-WebRequest -Uri "${{ matrix.install }}" -OutFile "install.exe"

    如果下载成功,则退出循环:

    break

    如果下载失败,流程会判断当前是否已经是第 3 次尝试:

    if ($attempt -eq 3) { throw }

    如果不是最后一次尝试,则输出下载失败提示,并等待 15 秒:

    Write-Host "CUDA installer download attempt $attempt failed: $($_.Exception.Message); retrying in 15s"
    Start-Sleep -Seconds 15

    因此,这部分工作流的下载逻辑具备以下明确行为:

    • CUDA 安装程序下载最多尝试 3 次

  • • 下载失败后会输出失败信息

  • • 非最后一次失败时等待 15 秒

  • • 第 3 次仍失败时抛出错误

  • • 下载成功后退出重试循环

  • • 安装文件仍保存为install.exe

    完成下载后,流程继续根据 CUDA 组件与 CUDA 版本拼接子包名称:

    $subpackages = @(${{ join(matrix.cuda-components, ', ') }}) | Foreach-Object {"${_}_${{ matrix.cuda-version }}"}

    随后以静默方式启动安装程序:

    Start-Process -FilePath .\install.exe -ArgumentList (@("-s") + $subpackages) -NoNewWindow -Wait

    这部分变更同时存在于发布工作流和 llama.cpp 更新测试工作流中。

    十、视觉测试新增 vision-ocr-document

    integration/reg_groups_test.go文件中,视觉测试分组新增了一个测试项:

    vision-ocr-document

    该测试项被加入TestVision所覆盖的视觉测试列表中。更新后的测试列表包含:

    vision-detail
    vision-multi-image
    vision-description
    vision-ocr-document
    vision-split-batch
    vision-text

    其中,vision-ocr-document是本次新增的视觉测试项。

    从命名可见,该测试属于视觉 OCR 文档测试相关内容,并与已有的视觉细节、多图、图像描述、分批处理、视觉文本等测试一同被纳入视觉测试范围。

    十一、发布回归测试调整

    integration/reg_release_test.go文件中,发布回归测试也进行了调整。

    原有固定注册的测试项中包含:

    image-generation

    该项在本次变更中被移除。

    原有固定测试列表中涉及的内容包括:

    create-safetensors
    create-gguf
    quantization
    image-generation

    更新后,固定列表不再包含image-generation

    与此同时,发布回归测试新增了以下注册调用:

    registerVisionOCRDocumentCases(testModels(releaseVisionModels))

    该调用用于为releaseVisionModels注册视觉 OCR 文档测试用例。

    更新后的模型参数化测试注册内容包括:

    registerVisionTextCases(testModels(releaseVisionTextModels))
    registerToolCases(testModels(releaseToolsModels))
    registerToolStressCases(testModels(releaseToolsModels))
    registerVisionOCRDocumentCases(testModels(releaseVisionModels))
    registerAudioTranscriptionCases(testModels(releaseAudioModels))

    因此,发布回归测试的调整包括两个明确部分:

    • 固定测试列表中移除image-generation

  • • 面向releaseVisionModels新增视觉 OCR 文档测试注册

    十二、新增 vision_ocr_test.go 测试文件

    本次更新新增了integration/vision_ocr_test.go文件。

    该文件的变更统计为:

    166 行新增
    0 行删除

    结合integration/reg_groups_test.go中新增的vision-ocr-document,以及integration/reg_release_test.go中新增的registerVisionOCRDocumentCases调用,可以看到视觉 OCR 文档测试已被加入集成测试和发布回归测试相关范围。

    十三、4 次提交记录

    v0.32.8 的变更对比中显示共有 4 次提交。

    2026年8月10日的提交:

    • Release v0.32.7,提交编号 17646

    2026年8月11日的提交:

    • docs: add VS Code context length guidance,提交编号 17610

  • • docs: require VS Code 1.127,提交编号 17655

  • • llama.cpp update,提交编号 17659

    其中,VS Code 上下文长度说明、VS Code 1.127 最低版本要求,以及 llama.cpp 版本更新,均对应本次 v0.32.8 的变更内容。

    十四、v0.32.8 更新内容汇总

    代码地址:github.com/ollama/ollama

    Ollama v0.32.8 的内容可以归纳为以下几点:

    • Muse Glimmer 已在全部平台可用

  • • Muse Glimmer 新增 NVIDIA、AMD 和更多平台支持

  • • Muse Glimmer 可通过ollama run muse-glimmer在本地下载并运行

  • • Muse Glimmer 可与 Claude Code 配合使用

  • • Muse Glimmer 可与 Pi 配合使用

  • • Muse Glimmer 可与 OpenClaw 配合使用

  • • Muse Glimmer 可与 Hermes 配合使用

  • • Ollama MLX 引擎在 Apple Silicon 上支持 Muse Glimmer

  • • Ollama 0.32.7 已支持 DFlash 和图像输入

  • • llama.cpp 版本从 b10242 更新至 b10353

  • • VS Code 最低版本要求由 1.120 提升至 1.127

  • • 文档指出较早版本 VS Code 无法可靠取消语言模型提供商请求

  • • 本地模型在 VS Code 中使用时,Ollama context length 应设置为至少 64k

  • • Windows CUDA 下载流程增加最多 3 次的重试机制

  • • 每次 CUDA 下载失败后,非最终失败场景会等待 15 秒再重试

  • • 视觉测试新增vision-ocr-document

  • • 发布回归测试新增视觉 OCR 文档测试注册

  • • 固定发布回归测试列表中移除image-generation

  • • 新增integration/vision_ocr_test.go,包含 166 行新增内容

    整体来看,v0.32.8 围绕 Muse Glimmer 的全平台支持展开,同时补充了 VS Code 本地模型上下文长度配置说明,更新了 llama.cpp 版本,并将视觉 OCR 文档测试纳入集成测试与发布回归测试范围。

    我们相信人工智能为普通人提供了一种“增强工具”,并致力于分享全方位的AI知识。在这里,您可以找到最新的AI科普文章、工具评测、提升效率的秘籍以及行业洞察。 欢迎关注“福大大架构师每日一题”,发消息可获得面试资料,让AI助力您的未来发展。

    © 版权声明

    相关文章