ollama v0.32.8正式发布:Muse Glimmer 全平台支持、MLX 图像输入与 VS Code 64k 上下文配置详解

发布时间:2026/9/29 14:51:16

ollama v0.32.8正式发布:Muse Glimmer 全平台支持、MLX 图像输入与 VS Code 64k 上下文配置详解 2026年8月11日github.com/ollama/ollama 发布 v0.32.8 版本。本次版本的核心内容是加入对 Muse Glimmer 的支持并将该模型扩展至 NVIDIA、AMD 以及更多平台。同时版本中还包含 llama.cpp 更新、VS Code 文档要求调整、上下文长度配置说明、视觉 OCR 文档测试接入以及 Windows CUDA 安装流程的下载重试改进。从变更统计看本次更新包含 4 次提交、44 个文件变更、4,967 行新增以及 49 行删除共有 2 位贡献者参与。版本发布前后的代码变更覆盖自动化工作流、集成测试、文档、模型运行时依赖版本等多个部分。一、v0.32.8 发布信息版本号v0.32.8发布日期2026年8月11日更新名称Muse Glimmer本次发布最重要的内容是Muse Glimmer 已可在全部平台使用。Muse Glimmer 可用于多类本地 AI 应用场景包括编码代理应用和长期运行的个人助手框架。公告中列出的编码代理应用包括Claude CodeCodexPi公告中列出的长期运行个人助手框架包括OpenClawHermes对于希望在本地运行 Muse Glimmer 的用户可以直接使用以下命令下载并启动模型ollama run muse-glimmer这条命令用于拉取并运行muse-glimmer模型。二、Muse Glimmer 的运行方式除了直接运行模型外v0.32.8 还给出了 Muse Glimmer 与多种应用的启动方式。如果需要通过 Claude Code 运行 Muse Glimmer需要先下载 Ollama然后执行ollama launch claude--modelmuse-glimmer这条命令通过ollama launch启动 Claude Code并指定模型为muse-glimmer。对于更轻量级的编码代理公告建议使用 Pi命令如下ollama launch pi--modelmuse-glimmer该方式同样使用ollama launch但目标应用变为 Pi模型仍为muse-glimmer。对于个人助手框架公告给出了 OpenClaw 与 Hermes 的启动命令。启动 OpenClawollama launch openclaw--modelmuse-glimmer启动 Hermesollama launch hermes--modelmuse-glimmer从这些命令可以看到Muse Glimmer 在 v0.32.8 中已被纳入多种应用启动路径。无论是直接通过 Ollama 执行模型还是通过编码代理应用、个人助手框架调用模型均可通过指定--model muse-glimmer使用该模型。三、Muse Glimmer 扩展至 NVIDIA、AMD 及更多平台本次更新中的变更说明明确指出为 Muse Glimmer 增加 NVIDIA、AMD 和其他更多平台支持。此前公告重点提到 Apple Silicon 环境下的 MLX 引擎表现而 v0.32.8 则进一步补充了 NVIDIA、AMD 以及附加平台的支持范围。该项变更是本次版本“What’s Changed”部分唯一直接列出的核心功能更新。更新内容可以概括为Muse Glimmer 支持 NVIDIA 平台Muse Glimmer 支持 AMD 平台Muse Glimmer 支持更多额外平台Muse Glimmer 已在全部平台可用四、MLX 引擎、Apple Silicon 与图像输入支持公告同时说明Ollama 的 MLX 引擎可为 Muse Glimmer 在 Apple Silicon 上提供先进性能。在 Ollama 0.32.7 起MLX 引擎已经支持以下能力DFlash图像输入也就是说v0.32.8 的 Muse Glimmer 发布信息中继续明确了 Ollama 0.32.7 已具备的 MLX 相关能力在 Apple Silicon 上模型可以结合 MLX 引擎运行并支持 DFlash 和图像输入。公告中的信息包括以下几个关键点Ollama 的 MLX 引擎面向 Apple Silicon 提供性能支持Muse Glimmer 可在该引擎能力基础上运行Ollama 0.32.7 已支持 DFlashOllama 0.32.7 已支持 image input也就是图像输入这部分内容与本次新增的跨平台支持共同构成了 Muse Glimmer 的运行支持信息Apple Silicon 环境对应 MLX 引擎能力NVIDIA、AMD 以及其他平台则在 v0.32.8 中获得支持。五、llama.cpp 版本更新v0.32.8 更新了 llama.cpp 依赖版本。LLAMA_CPP_VERSION文件中的版本号从b10242更新为b10353这意味着本次 Ollama 版本同步了新的 llama.cpp 版本标识。对应变更为 1 行删除、1 行新增。提交记录中也包含一项 llama.cpp 更新提交时间为 2026年8月11日距离发布信息所示时间约 8 小时。六、VS Code 集成要求提升至 1.127在docs/integrations/vscode.mdx文档中Visual Studio Code 的最低版本要求进行了调整。原有要求为Visual Studio Code 1.120 或更高版本更新后的要求为Visual Studio Code 1.127 或更高版本文档中的 Requirements 部分包含以下要求Visual Studio Code 1.127 或更高版本已安装并正在运行的 OllamaOllama 中至少有一个可用的本地模型或云模型文档还明确指出较早版本的 VS Code 无法可靠地取消来自语言模型提供商的请求。因此当前 VS Code 集成文档强调的版本要求是使用 Ollama 扩展进行 VS Code Chat 时应使用 Visual Studio Code 1.127 或更高版本。七、VS Code 文档新增上下文长度说明本次文档更新还新增了 Context length也就是上下文长度相关说明。文档指出VS Code 可能会显示某个模型支持的最大上下文长度但 Ollama 在实际运行时分配的上下文长度可能更小。也就是说VS Code 的界面显示与 Ollama 实际分配的上下文长度并不一定完全一致。VS Code 可能展示模型的最大支持上限而 Ollama 运行时使用的上下文长度则可能低于这一数值。对于本地模型文档给出的操作方式是打开 Ollama Settings。将 context length 设置为至少 64k。重新加载 VS Code 窗口。再次发送提示词。文档中的表述强调本地模型需要在 Ollama 设置中将上下文长度设置为至少 64k随后重新加载 VS Code 窗口并重新发送提示词。相关文档同时指向 Context length 页面以便查看上下文长度的更多信息。这部分新增内容对于在 VS Code 中使用本地模型的场景具有直接对应关系即使 VS Code 显示模型具备较大的最大上下文能力仍需关注 Ollama 实际运行时分配的上下文长度并在本地模型场景下通过 Ollama Settings 设置至少 64k 的上下文长度。八、Ollama 版本建议保持不变VS Code 集成文档中还保留了关于 Ollama 版本的说明。文档建议使用 Ollama 0.17.6 或更新版本以支持云模型登录更丰富的模型元数据同时文档也说明较旧版本仍可能与本地模型配合使用。因此文档中的版本信息可以整理为VS Code 要求为 1.127 或更高版本推荐使用 Ollama 0.17.6 或更高版本以获得云模型登录和更丰富模型元数据支持较旧的 Ollama 版本仍可能支持本地模型九、Windows CUDA 安装流程加入重试机制本次变更对两个 GitHub Actions 工作流中的 CUDA 安装流程进行了调整.github/workflows/release.yaml.github/workflows/test-llamacpp-update.yaml两个文件的改动内容一致均涉及 Windows PowerShell 环境下 CUDA 安装程序的下载。原流程中使用Invoke-WebRequest下载 CUDA 安装程序并保存为install.exe。更新后下载过程增加了重试逻辑。更新后的流程会在缓存未命中的情况下执行下载if(${{ steps.cache-install.outputs.cache-hit }}-netrue){下载部分通过循环最多尝试 3 次for($attempt 1;$attempt-le3;$attempt){每次尝试中执行Invoke-WebRequest-Uri${{ matrix.install }}-OutFileinstall.exe如果下载成功则退出循环break如果下载失败流程会判断当前是否已经是第 3 次尝试if($attempt-eq3){throw}如果不是最后一次尝试则输出下载失败提示并等待 15 秒Write-HostCUDA installer download attempt$attemptfailed:$($_.Exception.Message); retrying in 15sStart-Sleep-Seconds 15因此这部分工作流的下载逻辑具备以下明确行为CUDA 安装程序下载最多尝试 3 次下载失败后会输出失败信息非最后一次失败时等待 15 秒第 3 次仍失败时抛出错误下载成功后退出重试循环安装文件仍保存为install.exe完成下载后流程继续根据 CUDA 组件与 CUDA 版本拼接子包名称$subpackages (${{join(matrix.cuda-components,, )}})|Foreach-Object{${_}_${{ matrix.cuda-version }}}随后以静默方式启动安装程序Start-Process-FilePath.\install.exe-ArgumentList((-s)$subpackages)-NoNewWindow-Wait这部分变更同时存在于发布工作流和 llama.cpp 更新测试工作流中。十、视觉测试新增 vision-ocr-document在integration/reg_groups_test.go文件中视觉测试分组新增了一个测试项vision-ocr-document该测试项被加入TestVision所覆盖的视觉测试列表中。更新后的测试列表包含vision-detail vision-multi-image vision-description vision-ocr-document vision-split-batch vision-text其中vision-ocr-document是本次新增的视觉测试项。从命名可见该测试属于视觉 OCR 文档测试相关内容并与已有的视觉细节、多图、图像描述、分批处理、视觉文本等测试一同被纳入视觉测试范围。十一、发布回归测试调整在integration/reg_release_test.go文件中发布回归测试也进行了调整。原有固定注册的测试项中包含image-generation该项在本次变更中被移除。原有固定测试列表中涉及的内容包括create-safetensors create-gguf quantization image-generation更新后固定列表不再包含image-generation。与此同时发布回归测试新增了以下注册调用registerVisionOCRDocumentCases(testModels(releaseVisionModels))该调用用于为releaseVisionModels注册视觉 OCR 文档测试用例。更新后的模型参数化测试注册内容包括registerVisionTextCases(testModels(releaseVisionTextModels))registerToolCases(testModels(releaseToolsModels))registerToolStressCases(testModels(releaseToolsModels))registerVisionOCRDocumentCases(testModels(releaseVisionModels))registerAudioTranscriptionCases(testModels(releaseAudioModels))因此发布回归测试的调整包括两个明确部分固定测试列表中移除image-generation面向releaseVisionModels新增视觉 OCR 文档测试注册十二、新增 vision_ocr_test.go 测试文件本次更新新增了integration/vision_ocr_test.go文件。该文件的变更统计为166 行新增 0 行删除结合integration/reg_groups_test.go中新增的vision-ocr-document以及integration/reg_release_test.go中新增的registerVisionOCRDocumentCases调用可以看到视觉 OCR 文档测试已被加入集成测试和发布回归测试相关范围。十三、4 次提交记录v0.32.8 的变更对比中显示共有 4 次提交。2026年8月10日的提交Release v0.32.7提交编号 176462026年8月11日的提交docs: add VS Code context length guidance提交编号 17610docs: require VS Code 1.127提交编号 17655llama.cpp update提交编号 17659其中VS Code 上下文长度说明、VS Code 1.127 最低版本要求以及 llama.cpp 版本更新均对应本次 v0.32.8 的变更内容。十四、v0.32.8 更新内容汇总代码地址github.com/ollama/ollamaOllama v0.32.8 的内容可以归纳为以下几点Muse Glimmer 已在全部平台可用Muse Glimmer 新增 NVIDIA、AMD 和更多平台支持Muse Glimmer 可通过ollama run muse-glimmer在本地下载并运行Muse Glimmer 可与 Claude Code 配合使用Muse Glimmer 可与 Pi 配合使用Muse Glimmer 可与 OpenClaw 配合使用Muse Glimmer 可与 Hermes 配合使用Ollama MLX 引擎在 Apple Silicon 上支持 Muse GlimmerOllama 0.32.7 已支持 DFlash 和图像输入llama.cpp 版本从 b10242 更新至 b10353VS Code 最低版本要求由 1.120 提升至 1.127文档指出较早版本 VS Code 无法可靠取消语言模型提供商请求本地模型在 VS Code 中使用时Ollama context length 应设置为至少 64kWindows CUDA 下载流程增加最多 3 次的重试机制每次 CUDA 下载失败后非最终失败场景会等待 15 秒再重试视觉测试新增vision-ocr-document发布回归测试新增视觉 OCR 文档测试注册固定发布回归测试列表中移除image-generation新增integration/vision_ocr_test.go包含 166 行新增内容整体来看v0.32.8 围绕 Muse Glimmer 的全平台支持展开同时补充了 VS Code 本地模型上下文长度配置说明更新了 llama.cpp 版本并将视觉 OCR 文档测试纳入集成测试与发布回归测试范围。
延伸阅读

更多相关文章

2026/9/27 2:08:49

使用vcpkg管理C++依赖:从OpenCV4安装到项目集成实战

1. 项目概述:为什么选择vcpkg来管理你的C依赖如果你在Windows、Linux或者macOS上搞过C项目,尤其是涉及到像OpenCV这种重量级的第三方库,那你一定对“依赖地狱”这个词深有体会。下载源码、配置CMake、解决各种缺失的系统库(比如Wi…

2026/9/26 19:27:08

2026-08-12:统计下标的相反奇偶性得分。用go语言,给定一个整数数组,需要为数组中的每个位置计算一个分数。这个分数等于:在当前索引右侧的所有元素中,与当前元素奇偶性不同(即一个是奇数,另一个是

2026-08-12:统计下标的相反奇偶性得分。用go语言,给定一个整数数组,需要为数组中的每个位置计算一个分数。这个分数等于:在当前索引右侧的所有元素中,与当前元素奇偶性不同(即一个是奇数,另一个…

2026/9/27 7:18:00

C++入门利器CFree:轻量级IDE安装配置与实战指南

1. 为什么选择CFree?一个老C开发者的视角 如果你刚开始接触C,或者厌倦了Visual Studio的庞大和复杂配置,想找一个轻量级、开箱即用的环境来写点小项目、刷算法题,那么CFree可能就是你一直在找的那个“老朋友”。它不是当下最时髦的…

2026/9/29 14:49:59

校园局域网课程设计:NAT、VLAN与路由配置实战指南

简介:这是一份计算机网络课程设计报告,主题为校园局域网综合布局设计,面向网络工程、计算机及相关专业的学生,尤其适合需要完成课程设计或毕业设计校园网部分的读者参考。文档结构完整,从设计目的、背景与系统安全分析…

2026/9/29 14:49:59

GIS设备现场教学PPT:SF6气体运维与缺陷诊断实战指南

简介:本资源是一份面向电力系统专业学生、电气工程技术人员及高压设备运维人员的SF6电气设备与GIS(气体绝缘开关设备)技术教学课件,聚焦高压绝缘介质特性、SF6设备分类、试验检测、运行监测与安全维护等核心实务内容。课件以PPT格…

2026/9/29 14:49:59

YOLOv11工业落地全流程:配置、小目标改进与部署避坑

简介:面向目标检测研究者与算法工程师的YOLOv11与视觉大模型知识分享PDF文档,系统梳理YOLO系列从v1到v11的演进脉络,对比两阶段与单阶段检测框架的精度与速度权衡,并解析FPN多尺度特征融合、骨干网络与特征金字塔等核心模块设计。…

2026/9/29 14:49:59

Muscriptor:AI音频转MIDI完整实战指南,从公共实例到本地部署

做音乐信息检索、自动扒谱、编曲预处理的时候,最常遇到的一个需求就是:把一段音频转成 MIDI。以前大家习惯用 Adobe Audition 看波形、用 Melodyne 手动修音高、再一个个音符画到钢琴卷帘里,过程非常痛苦。最近在 Hacker News 上看到一个公开…

2026/9/29 11:07:23

东莞市品牌网站建设报价常见报错与解决

东莞品牌网站建设报价单背后:一份保姆级建站教程避坑实录 网站做好了没人访问,这大概是很多老板最头疼的事。花了大几万做的品牌站,上线后流量惨淡,比路边摊还冷清。别急着骂外包公司,很多“东莞品牌网站建设报价”里藏着不少猫腻,比如用模板站冒充定制…

2026/9/28 6:05:15

如何划分训练/验证集:Spirula Studio五种eval_mode策略详解

如何划分训练/验证集:Spirula Studio五种eval_mode策略详解 【免费下载链接】spirula-studio Cross-vendor 3D Gaussian Splatting trainer - video to splat to mesh, Vulkan or CUDA. 项目地址: https://gitcode.com/GitHub_Trending/sp/spirula-studio Sp…

2026/9/29 7:00:49

SEO怎么推广速查手册新手避坑实战指南

SEO怎么推广速查手册新手避坑实战指南 模板网站太丑不够用?别急着加滤镜,那是治标不治本。很多老板盯着后台流量掉得眼红,却还在纠结首页Banner的圆角是不是3像素。这就像穿着西装去挖土,姿势不对,努力白费。我整理这份 速查手册…

2026/9/29 0:04:04

AI Evals实战指南:从零搭建LLM应用评估体系与CI/CD集成

1. 为什么AI Evals值得你花时间搞明白做LLM应用的人,迟早会撞上同一堵墙:模型输出飘忽不定,今天答得好好的,明天换个问法就胡说八道。你改了一版提示词,感觉好像好了点,但到底好了多少?说不清。…

2026/9/29 0:04:04

Java采购管理系统实战:从数据库设计到事务一致性

简介:这是一套面向Java Web初学者与课程设计者的采购管理系统完整源码,采用JSP技术搭建,配合MySQL数据库,用于解决企业采购信息的管理问题,适合作为毕业设计、课程大作业或进销存类项目的参考模板。系统实现了用户登录…

2026/9/29 3:53:39

USB Type-C PCB布局分区设计:电源、高速信号与PD协议全攻略

做硬件这行,Type-C接口算是典型的“看着简单,做起来全坑”的东西。光引脚就24个,高低速信号、电源、控制线全部塞在一个小小的连接器里,如果PCB布局不做规划,打样回来基本就是“插上没反应”、“高速掉线”、“静电一打…

2026/9/29 9:46:12

系统编程学习原型如何补齐稳定性边界

系统编程学习原型如何补齐稳定性边界预算有限时&#xff0c;我先优化明显多余的复制&#xff0c;而不是猜测性地换容器。用借用传递只读数据通常就能减少分配&#xff1a; fn parse(line: &str) -> Result<Item, Error> { /* ... */ }用基准确认热点确实在分配&am…

2026/9/29 6:36:14

雨花区哪家财务公司代理记账比较好?

在雨花区&#xff0c;企业处理财税事务常常面临诸多挑战&#xff0c;选择一家靠谱的财务公司至关重要。湖南巨勤财务管理咨询有限公司就是本地正规实体财税服务机构&#xff0c;深耕本地工商财税行业多年&#xff0c;熟悉当地工商局、税务局最新政策与申报流程。主营公司注册、…

还想了解更多?直接咨询顾问

免费诊断 + 免费方案 + 透明报价。

全国咨询热线400-8866-253
免费获取方案
☎咨询二维码 ☎ ↑