">

Docker Agent v1.149.0 发布:支持从公开 GitHub 仓库加载技能,评测链路改为可替换后端

Docker 工程团队于 2026 年 10 月 7 日发布 Docker Agent v1.149.0,GitHub release 的 published_at 为 2026-10-07T14:55:39Z。这一版支持在配置里直接用公开 GitHub 仓库地址加载技能,新增独立的评测裁判后端并默认走 models gateway,同时修正了 OpenAI 服务档位的计费口径。仓库许可为 Apache-2.0。

这次发布的是什么

Docker 工程团队于 2026 年 10 月 7 日发布 Docker Agent v1.149.0,GitHub release 的 published_at 为 2026-10-07T14:55:39Z,prerelease 标记为 false。Docker Agent 是 Docker 官方的智能体构建与运行时,仓库位于 GitHub 的 docker 组织下,仓库描述为「AI Agent Builder and Runtime by Docker Engineering」,许可为 Apache-2.0。这一版的主要变化集中在三处:技能的加载方式、评测链路的后端,以及计费口径的修正。

可用性与限制

  • 许可:Apache-2.0,具体条款以仓库 LICENSE 文件为准。
  • 形态:开源的命令行工具与运行时,需要本地容器环境,前置条件以仓库文档为准。
  • 能力边界:它提供智能体的构建与运行环境,不提供模型本身,推理需要自备模型服务或 API 凭据。
  • 本版局限:新增的 Nativ provider 指南只覆盖本地 Apple Silicon 推理服务的配置与鉴权,其他硬件以官方文档为准。
  • 中国内地访问:GitHub 与容器镜像仓库的可达性因环境而异,请以你的网络条件为准。

主要功能

  • 支持从公开 GitHub 仓库加载技能:在配置的技能条目里直接写仓库地址即可引入。
  • 补齐调试工具的钩子链路:在调试工具调用上运行输入转换与后置钩子。
  • 新增 evaluator judge 后端,可用独立的评测服务替代「让模型当裁判」的做法。
  • 评测默认走 models gateway,并把 OpenAI Decisions 作为原生评测后端接入。
  • 修正服务档位的计费口径:按响应里实际生效的档位计价,而不是请求里声明的档位。

技术原理

据官方说明,这一版做了两处结构性调整。其一是技能来源:技能本质上是一组可复用的指令、知识与工作流,此前需要手工落到本地,现在可以直接指向公开仓库地址,让技能的来源与版本管理回到 Git 上。其二是评测链路:原本由另一个模型给输出打分的做法,被替换为可插拔的评测服务,并统一走 models gateway,好处是评测与被测模型解耦、后端可换,计费口径也随之统一。计费口径的修正属于同类问题——请求声明的服务档位与实际返回的档位不一致时,此前按前者计算,现在按后者计算。

实际体验

可复现的验证步骤:升级到 v1.149.0 后,先把现有配置里某个本地技能换成公开仓库地址,确认加载结果与原来一致;再用新增的评测后端跑一遍已有评测集,与原先让模型当裁判的结果做对照;最后查一遍费用记录,确认跨档位的请求现在按响应里实际生效的档位计价。升级前请先读 release 里的变更清单,钩子行为的改动会影响自定义钩子。

项目地址与获取方式

仓库:https://github.com/docker/docker-agent ;文档站:https://docker.github.io/docker-agent/ ;本版 release:https://github.com/docker/docker-agent/releases/tag/v1.149.0 。请通过官方渠道获取,避免安装被篡改的版本。

适合谁用

  • 已经在用容器编排智能体工作流的开发团队。
  • 需要把智能体评测从「模型打分」换成可替换后端的团队。
  • 希望用 Git 管理技能版本、跨项目复用的工程团队。
  • 什么人不必用:只需要一个对话式助手、不涉及技能与评测配置的场景,这个工具偏重。

常见问题

从 GitHub 仓库加载技能需要什么权限?

官方说明是支持公开仓库,在技能条目里写仓库地址即可。私有仓库与鉴权方式以官方文档为准。

新的评测后端是必须用的吗?

官方说法是新增了一个可选的评测服务,作为「让模型当裁判」之外的路径;同时评测默认走 models gateway。是否切换取决于你现有的评测流程。

这次的计费修正会影响历史账单吗?

release 只说明按响应里实际生效的档位计价。历史账单是否受影响,以你的账单与官方说明为准。

它和 Docker 本身是什么关系?

仓库由 docker 组织维护,描述是 Docker 工程团队的智能体构建与运行时。它依赖容器环境,但与 Docker 引擎的安装是两件事,具体依赖以仓库文档为准。

相关工具与内容

Related
快讯 1 小时前

Claude Haiku 5.5 发布:Anthropic 给小模型加上可调 effort,已在 AWS、Google Cloud、Azure 同步上线

Anthropic 于 2026 年 10 月 7 日在官网发布 Claude Haiku 5.5,模型 ID 为「claude-haiku-5-5」,官方定位是面向大批量、成本敏感的任务。它是 Haiku 系列中首次提供可调 effort 设置的模型,官方称已在 Amazon Web Services、Google Cloud、Microsoft Azure 与 Claude Platform 上线,并配套下调了 Sonnet 5.5 的缓存读取价格。

前沿快讯 1 阅读
快讯 1 小时前

Google Cloud 发布 Gemini agent:面向企业工作的统一智能体,从单一提示框接管知识工作与写代码

Google Cloud 在 2026 年 10 月 8 日的 Gemini at Work 2026 活动上发布 Gemini agent,官方定位为面向工作的统一智能体:从单一提示框承担知识工作、问答、内容创作与写代码,自行规划并调用技能与工具,连接 Cloud 客户的业务系统,再把成品带回用户已在使用的文档、收件箱与开发环境。

前沿快讯 1 阅读
快讯 1 小时前

SynthID Detector 面向所有人开放:Google DeepMind 把 AI 内容水印检测从媒体从业者扩到全球用户

Google DeepMind 于 2026 年 10 月 7 日在 Google 官方博客宣布 SynthID Detector 面向所有人开放,此前只以早期版本提供给媒体从业者。该工具可检查图像、视频与音频文件是否由 Google 及其合作方的 AI 生成,官方点名的合作方包括 OpenAI、NVIDIA、Kakao,并称 Apple 即将加入。

前沿快讯 1 阅读

继续阅读:EmbeddingGemma 2 发布:7.4 亿参数的端侧多模态嵌入模型,文本、图像、音频、视频共用一个向量空间 · Anthropic 扩展 Cyber Verification Program:把高级网络能力按三档开放给经审核的安全团队

关于本文:本站文章由编辑部独立撰写,评测口径与免责说明见关于我们。想继续找工具,可从分类导航按场景浏览,或回首页搜索。

链接已复制