ollama v0.34.3正式发布:思考控制可查询、Apple Silicon支持视觉模型、macOS窗口体验优化与模型拉取修复

发布时间:2026/9/25 20:53:29

ollama v0.34.3正式发布:思考控制可查询、Apple Silicon支持视觉模型、macOS窗口体验优化与模型拉取修复 Ollama v0.34.3 已发布发布日期为 2026 年 9 月 23 日。此次 v0.34.3 更新包含四项明确变化模型思考控制能力及默认值可通过接口查询部分视觉模型在 Apple Silicon 与 MLX 环境中获得支持macOS 应用激活时不再重新打开已经关闭的窗口从 HuggingFace 拉取模型的问题得到修复。从本次更新内容来看重点集中在模型能力信息展示、视觉模型支持范围、macOS 应用使用体验以及模型拉取稳定性四个方面。以下内容仅根据本次更新说明展开不增加未提供的信息。一、模型思考控制能力现在可通过 GET /api/show 查询v0.34.3 的核心更新之一是GET /api/show现在会公开每个模型所具备的思考控制能力以及该模型默认使用的思考设置。这意味着当用户查询某个模型的信息时返回结果中不仅可以看到模型本身的相关内容还能够直接了解到该模型是否支持思考控制、支持哪些思考控制值以及默认采用哪一种思考配置。更新说明中将这一能力概括为GET /api/show now advertises each models thinking controls and default其中包含两个重点。第一个重点是每个模型可用的思考控制值。不同模型可能支持不同的思考控制选项。通过模型信息查询结果用户可以看到该模型具体允许使用哪些值。第二个重点是模型默认的思考设置。除了可选值之外接口还会返回默认值。这样一来用户在未明确设置思考控制时也能够知道模型默认会采用什么配置。这一变化让模型的思考控制能力变得更加直观。对于需要查看模型配置、确认模型支持范围、了解默认行为的场景而言GET /api/show返回的信息更加完整。二、命令行中可通过 ollama show 查看思考控制信息本次新增的思考控制信息同样可以在命令行中查看。更新说明给出的示例如下ollama show gemma4执行后可以看到类似以下的思考控制信息thinking levels false, true default true从这一示例可以看到该模型的thinking信息中包含两个字段。levels字段false, true这表示该模型提供了两个可用的思考控制值分别是false和true。default字段true这表示该模型的默认思考设置为true。因此在命令行场景下用户可以通过ollama show gemma4直接查看该模型的思考控制信息包括可选等级和默认值。这一展示形式很清晰先显示thinking再显示levels和default。其中levels用于展示可用选项default用于展示默认选项。对于支持布尔型思考控制的模型示例中呈现的结果是levels false, true default true也就是说模型可以使用false或true而默认使用true。三、API 中可获取模型思考控制值与默认值除了命令行之外这项能力也已经在 API 中提供。更新说明给出的请求示例如下curlhttp://localhost:11434/api/show-d{model: glm-5.3-flash:cloud}该请求用于查询指定模型的信息。返回结果中包含thinking字段示例如下{thinking:{values:[low,high,max],default:max}}这一返回内容展示了思考控制的可选值和默认值。其中values:[low,high,max]表示该模型支持三种思考控制值low high max而default:max表示该模型默认使用的思考控制值为max因此通过 API 查询模型信息时调用方能够明确知道这个模型支持的思考控制范围是low high max并且默认值是max与命令行展示形式相比API 返回的是结构化数据。命令行中使用的是levels default而 API 返回示例中使用的是valuesdefault两者所表达的核心内容一致都是展示模型可用的思考控制选项以及默认思考设置。在命令行示例中可用值为false, true默认值为true在 API 示例中可用值为low, high, max默认值为max这说明不同模型可以具备不同形式的思考控制选项。有的模型使用false与true这样的值有的模型则使用low、high、max这样的值。v0.34.3 将这些信息直接暴露在模型查询结果中使得模型支持哪些思考控制值、默认选择什么值可以通过查询结果直接获得。四、云端模型也可在 ollama.com 直接查看相关信息本次更新说明还明确提到对于云端模型这些思考控制相关信息同样可以直接在 ollama.com 上获取。原始说明为Also available on ollama.com directly for cloud models.这意味着针对云端模型思考控制能力及其默认值不仅可通过本地命令行查看也不仅可通过 API 查询还可以在 ollama.com 上直接获取。结合此前给出的 API 示例curlhttp://localhost:11434/api/show-d{model: glm-5.3-flash:cloud}可以看到示例中的模型带有:cloud标记。该示例返回了如下思考控制信息{thinking:{values:[low,high,max],default:max}}对于这类云端模型用户可以了解到其支持的思考控制值为low high max默认值为max并且这些信息也可在 ollama.com 直接查看。本次更新在模型信息展示方面形成了多个可查看入口命令行可查看、API 可查询、云端模型也可在 ollama.com 直接获取相关信息。五、不同模型可展示不同类型的思考控制选项从本次更新给出的两个示例中可以明确看到模型的思考控制选项并不完全相同。命令行示例ollama show gemma4输出内容为thinking levels false, true default true在这个示例里模型可用的思考控制值是false true默认值是trueAPI 示例curlhttp://localhost:11434/api/show-d{model: glm-5.3-flash:cloud}返回内容为{thinking:{values:[low,high,max],default:max}}在这个示例里模型可用的思考控制值是low high max默认值是max这两组示例分别展示了两种不同的思考控制表达方式。第一种是布尔型选项false true第二种是多级选项low high maxv0.34.3 的变化不在于统一所有模型的思考控制值而在于让每个模型自身支持的思考控制值和默认值能够被查询、展示和识别。也就是说用户不需要只依据模型名称判断思考设置而是可以通过模型信息结果查看该模型实际公开的thinking配置。对于gemma4示例中显示levels false, true default true对于glm-5.3-flash:cloud示例中显示values:[low,high,max],default:max可用值与默认值都在模型信息中被明确展示出来。六、Nemotron H 视觉模型现已支持 Apple Silicon 上的 MLX本次更新的第二项内容是 Nemotron H 视觉模型现在支持在 Apple Silicon 上使用 MLX。更新说明中的原文为Nemotron H vision models are now supported on Apple Silicon with MLX这项变化包含三个关键信息。第一个关键信息是模型类型Nemotron H vision models即 Nemotron H 视觉模型。第二个关键信息是硬件平台Apple Silicon即 Apple Silicon。第三个关键信息是支持方式with MLX即通过 MLX。因此v0.34.3 明确加入了 Nemotron H 视觉模型在 Apple Silicon 与 MLX 组合下的支持。从更新说明本身可以直接确认的是支持对象是 Nemotron H 视觉模型。支持平台是 Apple Silicon。支持方式涉及 MLX。这一支持属于 v0.34.3 的更新内容。视觉模型支持是本次版本更新的重要组成部分。此前关于思考控制的更新主要面向模型信息查询和模型默认配置展示而 Nemotron H 视觉模型支持 Apple Silicon 与 MLX则属于模型支持范围方面的变化。这两项变化分别对应不同方向思考控制信息的可查询性。视觉模型在 Apple Silicon 与 MLX 下的支持。对于关注 Apple Silicon 环境以及 MLX 的使用者而言v0.34.3 的这一条更新具有明确意义Nemotron H 视觉模型已经被列入支持范围。七、macOS 应用激活时不再重新打开已关闭窗口本次更新的第三项内容针对 macOS 应用窗口行为进行了优化。更新说明为Ollamas macOS app will now no longer reopen windows youve closed when activating it按照这项说明在 macOS 应用中当用户已经关闭某个窗口后再次激活应用时该应用不会重新打开此前已经关闭的窗口。这项变化描述得非常明确关键点包括使用场景是 macOS 应用。用户已经关闭窗口。后续再次激活应用。应用不再重新打开已经关闭的窗口。换句话说v0.34.3 对 macOS 应用的窗口行为进行了调整关闭过的窗口在应用激活时不会再次被自动打开。这是一项围绕窗口状态的体验优化。更新说明没有增加其他窗口行为描述只明确指出一个变化已关闭窗口在激活应用时不会重新打开。因此在介绍这一项更新时应准确保留其范围不扩展为其他未说明的窗口功能。可以将该项变化概括为macOS 应用激活后不再重新打开用户已关闭的窗口。这条更新与模型能力本身无关也与模型拉取无关而是面向 macOS 应用的窗口使用体验。八、修复从 HuggingFace 拉取模型的问题本次更新的第四项内容是修复从 HuggingFace 拉取模型的问题。更新说明为Fix for model pulls from HuggingFace这表明v0.34.3 包含了一项与模型拉取有关的修复修复对象是从 HuggingFace 拉取模型的过程。该项内容可以准确概括为修复从 HuggingFace 拉取模型的问题。更新说明没有进一步给出问题的具体表现、触发条件、影响范围或修复细节。因此围绕这一项内容能够确认的信息是修复与模型拉取有关。拉取来源涉及 HuggingFace。该修复被包含在 v0.34.3 中。模型拉取是本次更新中与使用稳定性相关的一项内容。与思考控制信息展示相比它不涉及模型返回字段与视觉模型支持相比它不涉及 Apple Silicon 或 MLX与 macOS 窗口优化相比它不涉及应用激活行为。它对应的是一个独立的修复方向即HuggingFace 模型拉取修复。对于依赖从 HuggingFace 拉取模型的使用场景v0.34.3 的更新说明明确列出了这项修复。九、v0.34.3 更新内容完整汇总根据本次发布说明Ollama v0.34.3 的变更内容可以归纳为以下四项。1. 模型思考控制信息可通过 GET /api/show 获取GET /api/show现在会公开每个模型的思考控制能力和默认值。命令行示例ollama show gemma4对应展示thinking levels false, true default trueAPI 示例curlhttp://localhost:11434/api/show-d{model: glm-5.3-flash:cloud}对应返回{thinking:{values:[low,high,max],default:max}}云端模型的这类信息也可以在 ollama.com 直接查看。2. Nemotron H 视觉模型支持 Apple Silicon 与 MLXNemotron H 视觉模型现在支持在 Apple Silicon 上通过 MLX 使用。3. macOS 应用不再重开已关闭窗口macOS 应用在激活时不会再重新打开用户此前关闭的窗口。4. 修复从 HuggingFace 拉取模型的问题v0.34.3 修复了从 HuggingFace 拉取模型的问题。十、结语代码地址github.com/ollama/ollama本次更新最值得关注的内容是模型思考控制信息的公开展示。现在用户可以通过ollama show查看模型支持的思考控制选项和默认值也可以通过GET /api/show获取结构化的thinking信息。在命令行示例中levels false, true default true在 API 示例中values:[low,high,max],default:max同时云端模型也可以在 ollama.com 上直接查看相关思考控制信息。除此之外v0.34.3 还加入了 Nemotron H 视觉模型对 Apple Silicon 与 MLX 的支持优化了 macOS 应用激活时重新打开已关闭窗口的问题并修复了从 HuggingFace 拉取模型的问题。整体来看本次版本更新覆盖模型信息展示、视觉模型支持、macOS 窗口体验和模型拉取修复四个方面。
延伸阅读

更多相关文章

2026/9/25 20:53:29

Wireshark抓包入门:从乱码到网络协议解析

1. 为什么你第一次打开Wireshark时,看到的全是“看不懂的乱码”?我第一次在公司网络运维岗上手Wireshark,是被一个“用户打不开某内部系统”的工单推到桌前的。主管甩来一句:“抓个包看看”,我就点开Wireshark&#xf…

2026/9/25 20:48:29

Atlas 300V 24G推理加速卡部署YOLOv5/v8全流程实战

提到Atlas这个项目名,放在现在的AI圈子里,几乎不用多想就会指向华为昇腾的Atlas系列硬件平台。热搜词里同时出现了“atlas部署yolo”和“atlas 300v 24g 是运算加速卡吗”,说明不少人对这个平台还处于观望和入门阶段。我先给一句总结&#xf…

2026/9/25 21:58:33

机器人驱动控制 FOC 算法使用经验总结:从电流采样到调参踩坑

第一次把 FOC 跑起来是在一块 STM32F4 的板子上,照着 SimpleFOC 的例程改的。上电,电机轻轻一抖,然后开始疯狂加速,吓得我直接拔线。后来知道那叫"飞车",是电角度错拍的典型症状。 那之后断断续续折腾了两三年,从关节模组到平衡车轮毂电机都碰过。这篇不打算讲…

2026/9/25 21:58:33

学校用知网查AI率,平时自查可以用哪些免费工具?

学校用知网查AI率,平时自查可以用哪些免费工具? 学校已经说要用知网,可论文还在修改,不想每改一段就正式送检。平时可以先用PaperPass、率零免费检测找问题;知网AI率已经偏高、需要试改时,再考虑比话。免费…

2026/9/25 21:58:33

网络工程师别只会配设备了,SDN、SD-WAN、云网络才是新赛道

许多人一旦提到网络工程师这个职业, 脑海中浮现出的图像往往还固化在过去的那几件事物上, 比如交换机、路由器、防火墙, 还有VLAN、OSPF以及ACL这些技术概念。当然, 这些东西确实具备相当重要的地位, 并且直至当下, 它们仍然是行业内最为基础的核心内容。然而, 假如一个人仅仅将…

2026/9/25 21:58:33

昇腾Atlas 300V 24G推理卡部署YOLO实战指南

最近后台收到不少类似的问题:Atlas 300V 24G是不是运算加速卡?还有一堆人在搜“Atlas部署YOLO”。作为一个在昇腾这套生态环境里折腾过一阵子的人,我想先把结论放在前面:Atlas 300V 24G确实是运算加速卡,但它不是给你当…

2026/9/25 21:58:33

ICO/PNG转SVG工具 –谦汐盒子- 在线位图一键转高清矢量图

一、工具简介ICO/PNG转SVG在线工具是一款轻量化、本地运行的图片矢量转换工具,支持将 ICO、PNG、JPG、GIF、WebP、BMP 等常见位图格式,快速转换为标准 SVG 矢量图形。工具内置专业 Potrace 矢量追踪算法,支持原图嵌入模式和智能矢量追踪模式双…

2026/9/25 21:53:32

Atlas 300V 24G 部署 YOLOv5 完整实战:从环境搭建到推理调优

去年底接了一个工业视觉项目,客户指定的就是 Atlas 300V 24G 这张卡,要求在上面跑 YOLOv5 做缺陷检测。当时团队里不少人第一反应是问“Atlas 300V 24G 是运算加速卡吗、能直接当 GPU 用吗”,等我把整套流程跑通之后,才发现市面上…

2026/9/25 21:00:17

GAMP 5 基于风险的计算机化系统验证:软件分类与审计追踪实践

简介:《A Risk-Based Approach to Compliant GxP Computerized Systems》即业内熟知的GAMP 5指南,面向制药企业质量与IT合规人员、验证工程师及计算机化系统管理者,用于解决GxP法规环境下系统合规性难以科学落地的问题。文档以风险管理为主线…

2026/9/25 20:59:52

安全托管MSSP实战:从静态防御到人机协同的攻防运营与应急响应

简介:这份PPT围绕互联网业务安全托管服务展开,面向企业安全负责人、IT运维人员及关注MSSP/MSS选型的读者,重点回应传统安全过度依赖人工、碎片化静态防御难以对抗产业化攻击等痛点。资源共1个pptx文件,包体约30.63MB,以…

2026/9/25 0:02:35

AI元人文:从工具使用到思维重构的深度探索

最近半年我一直在琢磨一件事:AI元人文到底是什么?说白了,就是“用元视角重新审视人与AI的关系”,也在“探索AI如何反向逼着我们发现自己的思考边界”。标题里的“元探索”,在我看就是一层套一层的追问——当你用AI解决…

2026/9/25 0:02:35

Python+CNN车牌识别实战:从数据预处理到模型训练与部署

简介:基于Python与卷积神经网络的车牌识别项目,面向计算机视觉初学者及智能交通开发者,目标是帮助用户掌握从数据预处理、模型构建到实际部署的完整流程。压缩包共25个文件,包含jpg/png图像样本、py训练脚本、md说明文档、dat数据…

2026/9/25 0:02:35

Vim基础操作全攻略:保存退出、模式切换与高频命令实战

1. 项目概述1.1 核心需求解析今天聊聊Vim。写这个题目的原因是:几乎每个后端开发者、运维人员、数据工程师某天都会遇到一个场景——深夜加班,服务器登录界面只有黑底白字,编辑器只有vi/vim,你必须在五分钟内完成一次配置修改并保…

2026/9/25 20:55:38

USB Type-C PCB布局分区设计:电源、高速信号与PD协议全攻略

做硬件这行,Type-C接口算是典型的“看着简单,做起来全坑”的东西。光引脚就24个,高低速信号、电源、控制线全部塞在一个小小的连接器里,如果PCB布局不做规划,打样回来基本就是“插上没反应”、“高速掉线”、“静电一打…

2026/9/25 18:41:36

系统编程学习原型如何补齐稳定性边界

系统编程学习原型如何补齐稳定性边界预算有限时&#xff0c;我先优化明显多余的复制&#xff0c;而不是猜测性地换容器。用借用传递只读数据通常就能减少分配&#xff1a; fn parse(line: &str) -> Result<Item, Error> { /* ... */ }用基准确认热点确实在分配&am…

2026/9/25 18:34:56

雨花区哪家财务公司代理记账比较好?

在雨花区&#xff0c;企业处理财税事务常常面临诸多挑战&#xff0c;选择一家靠谱的财务公司至关重要。湖南巨勤财务管理咨询有限公司就是本地正规实体财税服务机构&#xff0c;深耕本地工商财税行业多年&#xff0c;熟悉当地工商局、税务局最新政策与申报流程。主营公司注册、…

还想了解更多?直接咨询顾问

免费诊断 + 免费方案 + 透明报价。

全国咨询热线400-8866-253
免费获取方案
☎咨询二维码 ☎ ↑