Docker 工程团队于 2026 年 10 月 7 日发布 Docker Agent v1.149.0,GitHub release 的 published_at 为 2026-10-07T14:55:39Z。这一版支持在配置里直接用公开 GitHub 仓库地址加载技能,新增独立的评测裁判后端并默认走 models gateway,同时修正了 OpenAI 服务档位的计费口径。仓库许可为 Apache-2.0。
Docker Agent v1.149.0 发布:支持从公开 GitHub 仓库加载技能,评测链路改为可替换后端
这次发布的是什么
Docker 工程团队于 2026 年 10 月 7 日发布 Docker Agent v1.149.0,GitHub release 的 published_at 为 2026-10-07T14:55:39Z,prerelease 标记为 false。Docker Agent 是 Docker 官方的智能体构建与运行时,仓库位于 GitHub 的 docker 组织下,仓库描述为「AI Agent Builder and Runtime by Docker Engineering」,许可为 Apache-2.0。这一版的主要变化集中在三处:技能的加载方式、评测链路的后端,以及计费口径的修正。
可用性与限制
- 许可:Apache-2.0,具体条款以仓库 LICENSE 文件为准。
- 形态:开源的命令行工具与运行时,需要本地容器环境,前置条件以仓库文档为准。
- 能力边界:它提供智能体的构建与运行环境,不提供模型本身,推理需要自备模型服务或 API 凭据。
- 本版局限:新增的 Nativ provider 指南只覆盖本地 Apple Silicon 推理服务的配置与鉴权,其他硬件以官方文档为准。
- 中国内地访问:GitHub 与容器镜像仓库的可达性因环境而异,请以你的网络条件为准。
主要功能
- 支持从公开 GitHub 仓库加载技能:在配置的技能条目里直接写仓库地址即可引入。
- 补齐调试工具的钩子链路:在调试工具调用上运行输入转换与后置钩子。
- 新增 evaluator judge 后端,可用独立的评测服务替代「让模型当裁判」的做法。
- 评测默认走 models gateway,并把 OpenAI Decisions 作为原生评测后端接入。
- 修正服务档位的计费口径:按响应里实际生效的档位计价,而不是请求里声明的档位。
技术原理
据官方说明,这一版做了两处结构性调整。其一是技能来源:技能本质上是一组可复用的指令、知识与工作流,此前需要手工落到本地,现在可以直接指向公开仓库地址,让技能的来源与版本管理回到 Git 上。其二是评测链路:原本由另一个模型给输出打分的做法,被替换为可插拔的评测服务,并统一走 models gateway,好处是评测与被测模型解耦、后端可换,计费口径也随之统一。计费口径的修正属于同类问题——请求声明的服务档位与实际返回的档位不一致时,此前按前者计算,现在按后者计算。
实际体验
可复现的验证步骤:升级到 v1.149.0 后,先把现有配置里某个本地技能换成公开仓库地址,确认加载结果与原来一致;再用新增的评测后端跑一遍已有评测集,与原先让模型当裁判的结果做对照;最后查一遍费用记录,确认跨档位的请求现在按响应里实际生效的档位计价。升级前请先读 release 里的变更清单,钩子行为的改动会影响自定义钩子。
项目地址与获取方式
仓库:https://github.com/docker/docker-agent ;文档站:https://docker.github.io/docker-agent/ ;本版 release:https://github.com/docker/docker-agent/releases/tag/v1.149.0 。请通过官方渠道获取,避免安装被篡改的版本。
适合谁用
- 已经在用容器编排智能体工作流的开发团队。
- 需要把智能体评测从「模型打分」换成可替换后端的团队。
- 希望用 Git 管理技能版本、跨项目复用的工程团队。
- 什么人不必用:只需要一个对话式助手、不涉及技能与评测配置的场景,这个工具偏重。
常见问题
从 GitHub 仓库加载技能需要什么权限?
官方说明是支持公开仓库,在技能条目里写仓库地址即可。私有仓库与鉴权方式以官方文档为准。
新的评测后端是必须用的吗?
官方说法是新增了一个可选的评测服务,作为「让模型当裁判」之外的路径;同时评测默认走 models gateway。是否切换取决于你现有的评测流程。
这次的计费修正会影响历史账单吗?
release 只说明按响应里实际生效的档位计价。历史账单是否受影响,以你的账单与官方说明为准。
它和 Docker 本身是什么关系?
仓库由 docker 组织维护,描述是 Docker 工程团队的智能体构建与运行时。它依赖容器环境,但与 Docker 引擎的安装是两件事,具体依赖以仓库文档为准。
相关工具与内容
- AI 编程分类:本站面向开发者的 AI 工具入口。
- AI 智能体分类:智能体构建与运行时方向的入口。
- Claude Code:命令行形态的编程智能体。
- CodeBuddy:面向工程协作的编程助手。
- FastMCP 安全版本快讯:另一篇智能体基础设施方向的近期快讯。
相关内容
Claude Haiku 5.5 发布:Anthropic 给小模型加上可调 effort,已在 AWS、Google Cloud、Azure 同步上线
Anthropic 于 2026 年 10 月 7 日在官网发布 Claude Haiku 5.5,模型 ID 为「claude-haiku-5-5」,官方定位是面向大批量、成本敏感的任务。它是 Haiku 系列中首次提供可调 effort 设置的模型,官方称已在 Amazon Web Services、Google Cloud、Microsoft Azure 与 Claude Platform 上线,并配套下调了 Sonnet 5.5 的缓存读取价格。
Google Cloud 发布 Gemini agent:面向企业工作的统一智能体,从单一提示框接管知识工作与写代码
Google Cloud 在 2026 年 10 月 8 日的 Gemini at Work 2026 活动上发布 Gemini agent,官方定位为面向工作的统一智能体:从单一提示框承担知识工作、问答、内容创作与写代码,自行规划并调用技能与工具,连接 Cloud 客户的业务系统,再把成品带回用户已在使用的文档、收件箱与开发环境。
SynthID Detector 面向所有人开放:Google DeepMind 把 AI 内容水印检测从媒体从业者扩到全球用户
Google DeepMind 于 2026 年 10 月 7 日在 Google 官方博客宣布 SynthID Detector 面向所有人开放,此前只以早期版本提供给媒体从业者。该工具可检查图像、视频与音频文件是否由 Google 及其合作方的 AI 生成,官方点名的合作方包括 OpenAI、NVIDIA、Kakao,并称 Apple 即将加入。
继续阅读:EmbeddingGemma 2 发布:7.4 亿参数的端侧多模态嵌入模型,文本、图像、音频、视频共用一个向量空间 · Anthropic 扩展 Cyber Verification Program:把高级网络能力按三档开放给经审核的安全团队