![]()
![]()
![]()
Ollama v0.34.3 已发布,发布日期为 2026 年 9 月 23 日。
此次 v0.34.3 更新包含四项明确变化:模型思考控制能力及默认值可通过接口查询;部分视觉模型在 Apple Silicon 与 MLX 环境中获得支持;macOS 应用激活时不再重新打开已经关闭的窗口;从 HuggingFace 拉取模型的问题得到修复。
从本次更新内容来看,重点集中在模型能力信息展示、视觉模型支持范围、macOS 应用使用体验以及模型拉取稳定性四个方面。以下内容仅根据本次更新说明展开,不增加未提供的信息。
一、模型思考控制能力现在可通过 GET /api/show 查询
v0.34.3 的核心更新之一,是GET /api/show现在会公开每个模型所具备的思考控制能力,以及该模型默认使用的思考设置。
这意味着,当用户查询某个模型的信息时,返回结果中不仅可以看到模型本身的相关内容,还能够直接了解到该模型是否支持思考控制、支持哪些思考控制值,以及默认采用哪一种思考配置。
更新说明中将这一能力概括为:
GET /api/show now advertises each model's thinking controls and default其中包含两个重点。
第一个重点是每个模型可用的思考控制值。
不同模型可能支持不同的思考控制选项。通过模型信息查询结果,用户可以看到该模型具体允许使用哪些值。
第二个重点是模型默认的思考设置。
除了可选值之外,接口还会返回默认值。这样一来,用户在未明确设置思考控制时,也能够知道模型默认会采用什么配置。
这一变化让模型的思考控制能力变得更加直观。对于需要查看模型配置、确认模型支持范围、了解默认行为的场景而言,GET /api/show返回的信息更加完整。
二、命令行中可通过 ollama show 查看思考控制信息
本次新增的思考控制信息同样可以在命令行中查看。
更新说明给出的示例如下:
ollama show gemma4执行后,可以看到类似以下的思考控制信息:
thinking
levels false, true
default true从这一示例可以看到,该模型的thinking信息中包含两个字段。
levels字段:
false, true这表示该模型提供了两个可用的思考控制值,分别是false和true。
default字段:
true这表示该模型的默认思考设置为true。
因此,在命令行场景下,用户可以通过:
ollama show gemma4直接查看该模型的思考控制信息,包括可选等级和默认值。
这一展示形式很清晰:先显示thinking,再显示levels和default。其中,levels用于展示可用选项,default用于展示默认选项。
对于支持布尔型思考控制的模型,示例中呈现的结果是:
levels false, true
default true也就是说,模型可以使用false或true,而默认使用true。
三、API 中可获取模型思考控制值与默认值
除了命令行之外,这项能力也已经在 API 中提供。
更新说明给出的请求示例如下:
curl http://localhost:11434/api/show -d '{"model": "glm-5.3-flash:cloud"}'该请求用于查询指定模型的信息。
返回结果中包含thinking字段,示例如下:
{
"thinking": {
"values": ["low", "high", "max"],
"default": "max"
}
}这一返回内容展示了思考控制的可选值和默认值。
其中:
"values": ["low", "high", "max"]表示该模型支持三种思考控制值:
low
high
max而:
"default": "max"表示该模型默认使用的思考控制值为:
max因此,通过 API 查询模型信息时,调用方能够明确知道这个模型支持的思考控制范围是:
low
high
max并且默认值是:
max与命令行展示形式相比,API 返回的是结构化数据。命令行中使用的是:
levels
default而 API 返回示例中使用的是:
values
default两者所表达的核心内容一致,都是展示模型可用的思考控制选项以及默认思考设置。
在命令行示例中,可用值为:
false, true默认值为:
true在 API 示例中,可用值为:
low, high, max默认值为:
max这说明不同模型可以具备不同形式的思考控制选项。有的模型使用false与true这样的值,有的模型则使用low、high、max这样的值。
v0.34.3 将这些信息直接暴露在模型查询结果中,使得模型支持哪些思考控制值、默认选择什么值,可以通过查询结果直接获得。
四、云端模型也可在 ollama.com 直接查看相关信息
本次更新说明还明确提到,对于云端模型,这些思考控制相关信息同样可以直接在 ollama.com 上获取。
原始说明为:
Also available on ollama.com directly for cloud models.这意味着,针对云端模型,思考控制能力及其默认值不仅可通过本地命令行查看,也不仅可通过 API 查询,还可以在 ollama.com 上直接获取。
结合此前给出的 API 示例:
curl http://localhost:11434/api/show -d '{"model": "glm-5.3-flash:cloud"}'可以看到,示例中的模型带有:cloud标记。该示例返回了如下思考控制信息:
{
"thinking": {
"values": ["low", "high", "max"],
"default": "max"
}
}对于这类云端模型,用户可以了解到其支持的思考控制值为:
low
high
max默认值为:
max并且,这些信息也可在 ollama.com 直接查看。
本次更新在模型信息展示方面形成了多个可查看入口:命令行可查看、API 可查询、云端模型也可在 ollama.com 直接获取相关信息。
五、不同模型可展示不同类型的思考控制选项
从本次更新给出的两个示例中,可以明确看到,模型的思考控制选项并不完全相同。
命令行示例:
ollama show gemma4输出内容为:
thinking
levels false, true
default true在这个示例里,模型可用的思考控制值是:
false
true默认值是:
trueAPI 示例:
curl http://localhost:11434/api/show -d '{"model": "glm-5.3-flash:cloud"}'返回内容为:
{
"thinking": {
"values": ["low", "high", "max"],
"default": "max"
}
}在这个示例里,模型可用的思考控制值是:
low
high
max默认值是:
max这两组示例分别展示了两种不同的思考控制表达方式。
第一种是布尔型选项:
false
true第二种是多级选项:
low
high
maxv0.34.3 的变化不在于统一所有模型的思考控制值,而在于让每个模型自身支持的思考控制值和默认值能够被查询、展示和识别。
也就是说,用户不需要只依据模型名称判断思考设置,而是可以通过模型信息结果查看该模型实际公开的thinking配置。
对于gemma4,示例中显示:
levels false, true
default true对于glm-5.3-flash:cloud,示例中显示:
"values": ["low", "high", "max"],
"default": "max"可用值与默认值都在模型信息中被明确展示出来。
六、Nemotron H 视觉模型现已支持 Apple Silicon 上的 MLX
本次更新的第二项内容,是 Nemotron H 视觉模型现在支持在 Apple Silicon 上使用 MLX。
更新说明中的原文为:
Nemotron H vision models are now supported on Apple Silicon with MLX这项变化包含三个关键信息。
第一个关键信息是模型类型:
Nemotron H vision models即 Nemotron H 视觉模型。
第二个关键信息是硬件平台:
Apple Silicon即 Apple Silicon。
第三个关键信息是支持方式:
with MLX即通过 MLX。
因此,v0.34.3 明确加入了 Nemotron H 视觉模型在 Apple Silicon 与 MLX 组合下的支持。
从更新说明本身可以直接确认的是:
• 支持对象是 Nemotron H 视觉模型。
• 支持平台是 Apple Silicon。
• 支持方式涉及 MLX。
• 这一支持属于 v0.34.3 的更新内容。
视觉模型支持是本次版本更新的重要组成部分。此前关于思考控制的更新,主要面向模型信息查询和模型默认配置展示;而 Nemotron H 视觉模型支持 Apple Silicon 与 MLX,则属于模型支持范围方面的变化。
这两项变化分别对应不同方向:
• 思考控制信息的可查询性。
• 视觉模型在 Apple Silicon 与 MLX 下的支持。
对于关注 Apple Silicon 环境以及 MLX 的使用者而言,v0.34.3 的这一条更新具有明确意义:Nemotron H 视觉模型已经被列入支持范围。
七、macOS 应用激活时不再重新打开已关闭窗口
本次更新的第三项内容,针对 macOS 应用窗口行为进行了优化。
更新说明为:
Ollama's macOS app will now no longer reopen windows you've closed when activating it按照这项说明,在 macOS 应用中,当用户已经关闭某个窗口后,再次激活应用时,该应用不会重新打开此前已经关闭的窗口。
这项变化描述得非常明确,关键点包括:
• 使用场景是 macOS 应用。
• 用户已经关闭窗口。
• 后续再次激活应用。
• 应用不再重新打开已经关闭的窗口。
换句话说,v0.34.3 对 macOS 应用的窗口行为进行了调整:关闭过的窗口在应用激活时不会再次被自动打开。
这是一项围绕窗口状态的体验优化。更新说明没有增加其他窗口行为描述,只明确指出一个变化:已关闭窗口在激活应用时不会重新打开。
因此,在介绍这一项更新时,应准确保留其范围,不扩展为其他未说明的窗口功能。
可以将该项变化概括为:
macOS 应用激活后,不再重新打开用户已关闭的窗口。这条更新与模型能力本身无关,也与模型拉取无关,而是面向 macOS 应用的窗口使用体验。
八、修复从 HuggingFace 拉取模型的问题
本次更新的第四项内容,是修复从 HuggingFace 拉取模型的问题。
更新说明为:
Fix for model pulls from HuggingFace这表明,v0.34.3 包含了一项与模型拉取有关的修复,修复对象是从 HuggingFace 拉取模型的过程。
该项内容可以准确概括为:
修复从 HuggingFace 拉取模型的问题。更新说明没有进一步给出问题的具体表现、触发条件、影响范围或修复细节。因此,围绕这一项内容,能够确认的信息是:
• 修复与模型拉取有关。
• 拉取来源涉及 HuggingFace。
• 该修复被包含在 v0.34.3 中。
模型拉取是本次更新中与使用稳定性相关的一项内容。与思考控制信息展示相比,它不涉及模型返回字段;与视觉模型支持相比,它不涉及 Apple Silicon 或 MLX;与 macOS 窗口优化相比,它不涉及应用激活行为。
它对应的是一个独立的修复方向,即:
HuggingFace 模型拉取修复。对于依赖从 HuggingFace 拉取模型的使用场景,v0.34.3 的更新说明明确列出了这项修复。
九、v0.34.3 更新内容完整汇总
根据本次发布说明,Ollama v0.34.3 的变更内容可以归纳为以下四项。
1. 模型思考控制信息可通过 GET /api/show 获取
GET /api/show现在会公开每个模型的思考控制能力和默认值。
命令行示例:
ollama show gemma4对应展示:
thinking
levels false, true
default trueAPI 示例:
curl http://localhost:11434/api/show -d '{"model": "glm-5.3-flash:cloud"}'对应返回:
{
"thinking": {
"values": ["low", "high", "max"],
"default": "max"
}
}云端模型的这类信息也可以在 ollama.com 直接查看。
2. Nemotron H 视觉模型支持 Apple Silicon 与 MLX
Nemotron H 视觉模型现在支持在 Apple Silicon 上通过 MLX 使用。
3. macOS 应用不再重开已关闭窗口
macOS 应用在激活时,不会再重新打开用户此前关闭的窗口。
4. 修复从 HuggingFace 拉取模型的问题
v0.34.3 修复了从 HuggingFace 拉取模型的问题。
十、结语
代码地址:github.com/ollama/ollama
本次更新最值得关注的内容,是模型思考控制信息的公开展示。现在,用户可以通过ollama show查看模型支持的思考控制选项和默认值,也可以通过GET /api/show获取结构化的thinking信息。
在命令行示例中:
levels false, true
default true在 API 示例中:
"values": ["low", "high", "max"],
"default": "max"同时,云端模型也可以在 ollama.com 上直接查看相关思考控制信息。
除此之外,v0.34.3 还加入了 Nemotron H 视觉模型对 Apple Silicon 与 MLX 的支持,优化了 macOS 应用激活时重新打开已关闭窗口的问题,并修复了从 HuggingFace 拉取模型的问题。
整体来看,本次版本更新覆盖模型信息展示、视觉模型支持、macOS 窗口体验和模型拉取修复四个方面。
我们相信人工智能为普通人提供了一种“增强工具”,并致力于分享全方位的AI知识。在这里,您可以找到最新的AI科普文章、工具评测、提升效率的秘籍以及行业洞察。 欢迎关注“福大大架构师每日一题”,发消息可获得面试资料,让AI助力您的未来发展。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.