">

Ollama v0.40.2 发布:旧模型后台升级到 llama.cpp,列表不再出重复项

Ollama 于 2026 年 10 月 8 日发布 v0.40.2(GitHub Release 时间 2026-10-08T16:53:47Z,非预发布)。核心变化是用旧版本下载的模型会在首次运行时后台升级,以在 llama.cpp 上运行时获得更好的性能与兼容性;同时修掉了列表出现重复条目,以及启动 Claude 时没有用满上下文长度两个问题。

这次发布的是什么

Ollama 于 2026 年 10 月 8 日发布 v0.40.2,GitHub Release 的发布时间是 2026-10-08T16:53:47Z,不是预发布版本,改动区间为 v0.40.1 到 v0.40.2-rc0。这一版的核心是模型升级:用旧版本下载的模型,会在首次运行时于后台完成升级,官方称目的是在 llama.cpp 上运行时获得更好的性能与兼容性。同时修掉了列表里出现重复条目,以及「ollama launch claude」没有用满模型上下文长度这两个问题。上一个稳定版 v0.40.0 发布于 2026 年 9 月 25 日。

可用性与限制

  • 升级方式:后台自动完成,触发时机是旧模型首次运行,不需要手工执行命令。
  • 磁盘占用:为便于降级,Ollama 会保留升级前的原始副本,升级后模型会临时多占一份空间。
  • 清理时机:官方称未来版本会自动清理这些备份;当前版本需要手动清理的话,官方在发布说明里给了一段依赖 jq 的脚本。
  • 降级代价:如果之后降到 0.40 以前的版本,被清理的模型需要重新拉取。
  • 影响范围:本地已经拉过一批模型的用户感知明显,全新安装基本无感。

主要功能

  • 旧模型在首次运行时后台升级,对齐 llama.cpp 的运行方式。
  • 保留原始副本作为备份,让降级不至于丢模型。
  • 「ollama list」不再对已升级的模型显示重复条目。
  • 「ollama launch claude」改用模型的完整上下文长度。
  • 官方 README 新增社区集成 oxi。

技术原理

据官方发布说明,这次升级发生在模型层面:Ollama 为同一份模型同时保留了新旧两种运行形态的清单,升级后模型挂在 llama.cpp 这一侧运行,旧的那份作为备份留在磁盘上,因此列表里会出现两条记录,这一版把重复显示的问题修掉了。「ollama launch claude」这条命令此前没有按模型自身的上下文长度上限来起,这一版改为使用完整上下文长度。具体的兼容性与性能差异,官方没有给出量化说明,以官方发布说明为准。

实际体验

可复现的验证步骤:升级到 v0.40.2 后,先运行一个旧版本拉取的模型,观察首次运行是否触发后台升级;用「ollama list」看同一模型是否只剩一条记录。接着用「ollama show」查看模型信息,确认运行形态已经切到 llama.cpp。再看磁盘占用是否因为备份而上升;如果空间紧张,按官方发布说明里的脚本清理备份,注意清理后再降级需要重新拉取模型。最后用「ollama launch claude」起一次,核对它拿到的上下文长度与模型的标称值是否一致。

项目地址与获取方式

官方发布页在 github.com/ollama/ollama 的 Releases 区,安装包与升级方式以 Ollama 官网与官方发布页为准。请通过官方渠道获取,避免安装被篡改的版本。

适合谁用

  • 本地已经拉了一批模型、担心升级后表现不一致的个人开发者。
  • 用 Ollama 起 Claude 相关流程、对上下文长度敏感的用户。
  • 磁盘空间紧张的机器:升级后的备份会临时多占空间,需要留意。
  • 什么人不必用:全新环境、还没拉过模型的用户,直接装最新版即可,这次改动影响很小。

常见问题

升级会导致模型失效吗?

官方的做法是保留原始副本作为备份,因此升级本身不会让模型消失;升级是为了在 llama.cpp 上运行时获得更好的性能与兼容性。若之后降级到 0.40 以前的版本,需要重新拉取。

磁盘被备份占满了怎么办?

官方称未来版本会自动清理备份。当前版本可以按发布说明里给出的脚本手动清理,脚本依赖 jq,执行前先确认你不需要保留降级能力。

为什么列表里同一个模型出现过两条?

这是升级期间的中间状态:新旧两份清单同时存在。v0.40.2 已经让「ollama list」不再显示重复条目。

这次有性能提升吗?

官方的表述是升级后在 llama.cpp 上运行会有更好的性能与兼容性,没有给出量化数字,以官方发布说明为准;实际是否提升,建议用你自己的模型与提示词测一遍。

可以不升级吗?

模型的后台升级在首次运行时触发。如果你暂时不想动,先在离线环境里确认当前链路稳定,再安排升级窗口;具体行为以官方发布说明为准。

相关工具与内容

Related
快讯 1 小时前

微软发布 Microsoft-Decision-1:专做决策打分的模型,已上 Foundry 与 OpenRouter

微软于 2026 年 10 月 9 日在官方博客发布 Microsoft-Decision-1。它不是生成文本的通用大模型,而是决策打分模型:给定一组固定选项,为每个选项输出经过校准的概率分数。官方列出的用途包括路由、分类、优先级排序、校验与工作流控制,模型已在 Microsoft Foundry 与 OpenRouter 上线。

前沿快讯 9 阅读
快讯 1 小时前

Cloudflare 推出 Clef-omni:决策模型开始直接吃音频、视频与图片

Cloudflare 于 2026 年 10 月 9 日在官方博客发布 Clef-omni,把决策模型的输入从文本与图像扩展到音频与视频,一次调用即可跨模态打分;同时宣布 Clef 本体提速、Clef-flash 降价。官方称权重以开放权重形式发布在 Hugging Face,并与 Jev API 兼容。

前沿快讯 5 阅读
快讯 1 小时前

Deno 团队加入 Cloudflare:workerd 与 celld 合并,Deno Deploy 六个月后关闭

2026 年 10 月 9 日,Cloudflare 与 Deno 两边的官方博客同步宣布 Deno 团队整体加入 Cloudflare,目标是把 workerd 与 celld 合并,让 Workers 与 Durable Objects 能在自有基础设施上自托管。官方给出的安排是:Deno 运行时再维护一年,Deno Deploy 六个月后关闭,JSR 继续运行。

前沿快讯 6 阅读

继续阅读:Deno 团队加入 Cloudflare:workerd 与 celld 合并,Deno Deploy 六个月后关闭 · HyperWrite 4.2 分:它不替你写,替你把下一句接上

关于本文:本站文章由编辑部独立撰写,评测口径与免责说明见关于我们。想继续找工具,可从分类导航按场景浏览,或回首页搜索。

链接已复制