Ollama 于 2026 年 10 月 8 日发布 v0.40.2(GitHub Release 时间 2026-10-08T16:53:47Z,非预发布)。核心变化是用旧版本下载的模型会在首次运行时后台升级,以在 llama.cpp 上运行时获得更好的性能与兼容性;同时修掉了列表出现重复条目,以及启动 Claude 时没有用满上下文长度两个问题。
Ollama v0.40.2 发布:旧模型后台升级到 llama.cpp,列表不再出重复项
这次发布的是什么
Ollama 于 2026 年 10 月 8 日发布 v0.40.2,GitHub Release 的发布时间是 2026-10-08T16:53:47Z,不是预发布版本,改动区间为 v0.40.1 到 v0.40.2-rc0。这一版的核心是模型升级:用旧版本下载的模型,会在首次运行时于后台完成升级,官方称目的是在 llama.cpp 上运行时获得更好的性能与兼容性。同时修掉了列表里出现重复条目,以及「ollama launch claude」没有用满模型上下文长度这两个问题。上一个稳定版 v0.40.0 发布于 2026 年 9 月 25 日。
可用性与限制
- 升级方式:后台自动完成,触发时机是旧模型首次运行,不需要手工执行命令。
- 磁盘占用:为便于降级,Ollama 会保留升级前的原始副本,升级后模型会临时多占一份空间。
- 清理时机:官方称未来版本会自动清理这些备份;当前版本需要手动清理的话,官方在发布说明里给了一段依赖 jq 的脚本。
- 降级代价:如果之后降到 0.40 以前的版本,被清理的模型需要重新拉取。
- 影响范围:本地已经拉过一批模型的用户感知明显,全新安装基本无感。
主要功能
- 旧模型在首次运行时后台升级,对齐 llama.cpp 的运行方式。
- 保留原始副本作为备份,让降级不至于丢模型。
- 「ollama list」不再对已升级的模型显示重复条目。
- 「ollama launch claude」改用模型的完整上下文长度。
- 官方 README 新增社区集成 oxi。
技术原理
据官方发布说明,这次升级发生在模型层面:Ollama 为同一份模型同时保留了新旧两种运行形态的清单,升级后模型挂在 llama.cpp 这一侧运行,旧的那份作为备份留在磁盘上,因此列表里会出现两条记录,这一版把重复显示的问题修掉了。「ollama launch claude」这条命令此前没有按模型自身的上下文长度上限来起,这一版改为使用完整上下文长度。具体的兼容性与性能差异,官方没有给出量化说明,以官方发布说明为准。
实际体验
可复现的验证步骤:升级到 v0.40.2 后,先运行一个旧版本拉取的模型,观察首次运行是否触发后台升级;用「ollama list」看同一模型是否只剩一条记录。接着用「ollama show」查看模型信息,确认运行形态已经切到 llama.cpp。再看磁盘占用是否因为备份而上升;如果空间紧张,按官方发布说明里的脚本清理备份,注意清理后再降级需要重新拉取模型。最后用「ollama launch claude」起一次,核对它拿到的上下文长度与模型的标称值是否一致。
项目地址与获取方式
官方发布页在 github.com/ollama/ollama 的 Releases 区,安装包与升级方式以 Ollama 官网与官方发布页为准。请通过官方渠道获取,避免安装被篡改的版本。
适合谁用
- 本地已经拉了一批模型、担心升级后表现不一致的个人开发者。
- 用 Ollama 起 Claude 相关流程、对上下文长度敏感的用户。
- 磁盘空间紧张的机器:升级后的备份会临时多占空间,需要留意。
- 什么人不必用:全新环境、还没拉过模型的用户,直接装最新版即可,这次改动影响很小。
常见问题
升级会导致模型失效吗?
官方的做法是保留原始副本作为备份,因此升级本身不会让模型消失;升级是为了在 llama.cpp 上运行时获得更好的性能与兼容性。若之后降级到 0.40 以前的版本,需要重新拉取。
磁盘被备份占满了怎么办?
官方称未来版本会自动清理备份。当前版本可以按发布说明里给出的脚本手动清理,脚本依赖 jq,执行前先确认你不需要保留降级能力。
为什么列表里同一个模型出现过两条?
这是升级期间的中间状态:新旧两份清单同时存在。v0.40.2 已经让「ollama list」不再显示重复条目。
这次有性能提升吗?
官方的表述是升级后在 llama.cpp 上运行会有更好的性能与兼容性,没有给出量化数字,以官方发布说明为准;实际是否提升,建议用你自己的模型与提示词测一遍。
可以不升级吗?
模型的后台升级在首次运行时触发。如果你暂时不想动,先在离线环境里确认当前链路稳定,再安排升级窗口;具体行为以官方发布说明为准。
相关工具与内容
- 同题材:Ollama 引入决策模型
- 同厂快讯:Claude Code Mods 发布
- 分类:AI 编程
- 工具页:Claude Code、DeepSeek、通义千问
相关内容
微软发布 Microsoft-Decision-1:专做决策打分的模型,已上 Foundry 与 OpenRouter
微软于 2026 年 10 月 9 日在官方博客发布 Microsoft-Decision-1。它不是生成文本的通用大模型,而是决策打分模型:给定一组固定选项,为每个选项输出经过校准的概率分数。官方列出的用途包括路由、分类、优先级排序、校验与工作流控制,模型已在 Microsoft Foundry 与 OpenRouter 上线。
Cloudflare 推出 Clef-omni:决策模型开始直接吃音频、视频与图片
Cloudflare 于 2026 年 10 月 9 日在官方博客发布 Clef-omni,把决策模型的输入从文本与图像扩展到音频与视频,一次调用即可跨模态打分;同时宣布 Clef 本体提速、Clef-flash 降价。官方称权重以开放权重形式发布在 Hugging Face,并与 Jev API 兼容。
Deno 团队加入 Cloudflare:workerd 与 celld 合并,Deno Deploy 六个月后关闭
2026 年 10 月 9 日,Cloudflare 与 Deno 两边的官方博客同步宣布 Deno 团队整体加入 Cloudflare,目标是把 workerd 与 celld 合并,让 Workers 与 Durable Objects 能在自有基础设施上自托管。官方给出的安排是:Deno 运行时再维护一年,Deno Deploy 六个月后关闭,JSR 继续运行。
继续阅读:Deno 团队加入 Cloudflare:workerd 与 celld 合并,Deno Deploy 六个月后关闭 · HyperWrite 4.2 分:它不替你写,替你把下一句接上