Google DeepMind 于 2026 年 10 月 7 日在 Google 官方博客宣布 SynthID Detector 面向所有人开放,此前只以早期版本提供给媒体从业者。该工具可检查图像、视频与音频文件是否由 Google 及其合作方的 AI 生成,官方点名的合作方包括 OpenAI、NVIDIA、Kakao,并称 Apple 即将加入。
SynthID Detector 面向所有人开放:Google DeepMind 把 AI 内容水印检测从媒体从业者扩到全球用户
这次发布的是什么
Google DeepMind 于 2026 年 10 月 7 日在 Google 官方博客宣布,SynthID Detector 从面向媒体从业者的早期版本,扩展为面向所有人开放,官方表述为全球可用、语言为英语。页面 JSON-LD 的 datePublished 为 2026-10-07T14:00:00+00:00,作者署名为 Google DeepMind 的 Pushmeet Kohli,页内标注 Oct 07, 2026。SynthID 是 Google 自 2023 年推出的隐式水印技术,覆盖图像、视频与音频;这一次的变化是检测入口的开放范围,而不是水印技术本身的首次发布。
可用性与限制
- 开放范围:官方称即日起全球可用,界面语言为英语,其他语种以官方后续说明为准。
- 可检测范围:只能识别由 Google 及其合作方的 AI 生成的内容,官方点名的合作方包括 OpenAI、NVIDIA、Kakao,并称 Apple 即将加入。
- 覆盖范围限制:未接入 SynthID 的生成方所产出的内容不在检测范围内,这是这项技术的固有边界。
- 并行入口:Search、Gemini app 与 Chrome 里已有的验证功能与该工具并存。
- 中国内地访问:相关 Google 服务的可达性因环境而异,请以你的网络条件与官方说明为准。
主要功能
- 上传图像、视频或音频文件,检查其中是否含有 SynthID 水印。
- 一次覆盖图像、视频、音频三种模态。
- 与 Search、Gemini app、Chrome 中已有的验证入口形成互补。
- 水印由 Google 及合作方在生成侧直接写入,检测侧不需要额外携带元数据。
技术原理
据官方说明,SynthID 采用的是不可感知的水印:在内容生成的过程中把标识信息嵌入内容本身,肉眼与肉耳无法分辨,检测时再从内容里读回这层标识。这与「事后用另一个模型判断内容是不是 AI 生成」的路线不同——前者依赖生成侧的配合,后者依赖分类器的判断。也正因为如此,检测能力严格覆盖到接入了 SynthID 的生成方,官方把合作方名单写在了公告里。检测结论针对所上传的那一份文件,裁剪、重压缩或二次录制等处理是否影响检出,以官方说明为准。
实际体验
可复现的验证步骤:先准备三类样本——由接入 SynthID 的工具生成的图片或音频、由其他模型生成的同类内容、以及确定是人工拍摄的原始素材;依次上传到 Detector,记录三类样本分别给出什么结论;再用 Search 或 Gemini app 里的内置验证入口对同一份文件做一次对照,比较两者的表述差异。如果样本经过裁剪或重编码,建议再传一份原始版本做对比,观察处理环节对结果的影响。
项目地址与获取方式
官方公告:https://blog.google/innovation-and-ai/models-and-research/google-deepmind/synth-id-ai-content/ 。检测器入口以公告中给出的官方链接为准。请通过官方渠道访问,避免安装被篡改的版本。
适合谁用
- 需要判断素材来源的编辑、记者与内容审核岗位。
- 做内容合规与品牌安全的团队,尤其是需要留存核验记录的流程。
- 普通用户:收到来历不明的图片、视频或语音时做一次快速核验。
- 什么人不必用:素材全部来自自有拍摄、且不对外接收投稿的流程,短期收益有限。
常见问题
它能检测所有 AI 生成的内容吗?
不能。官方写明只能识别由 Google 及其合作方生成的内容,未接入 SynthID 的生成方不在覆盖范围内。
支持哪些文件类型?
官方列出的三类是图像、视频与音频。具体支持的格式与大小上限以工具页面当前说明为准。
检测结果能作为判定依据吗?
官方把该工具定位为「提供更多上下文」,帮助用户自行判断。是否可作为正式依据,取决于你所在机构的流程要求。
和 Search、Gemini app 里的验证功能有什么区别?
官方把这三者描述为并存的关系:Detector 是独立的上传检查工具,Search、Gemini app 与 Chrome 里另有内置的验证入口。
相关工具与内容
- AI 绘画分类:本站图像生成方向的入口。
- AI 视频分类:视频生成与处理的工具入口。
- AI 音频分类:语音与音频方向的入口。
- 通义万相:图像与视频生成工具。
- OpenAI EU 文本溯源快讯:另一篇内容溯源方向的近期快讯。
相关内容
Claude Haiku 5.5 发布:Anthropic 给小模型加上可调 effort,已在 AWS、Google Cloud、Azure 同步上线
Anthropic 于 2026 年 10 月 7 日在官网发布 Claude Haiku 5.5,模型 ID 为「claude-haiku-5-5」,官方定位是面向大批量、成本敏感的任务。它是 Haiku 系列中首次提供可调 effort 设置的模型,官方称已在 Amazon Web Services、Google Cloud、Microsoft Azure 与 Claude Platform 上线,并配套下调了 Sonnet 5.5 的缓存读取价格。
Google Cloud 发布 Gemini agent:面向企业工作的统一智能体,从单一提示框接管知识工作与写代码
Google Cloud 在 2026 年 10 月 8 日的 Gemini at Work 2026 活动上发布 Gemini agent,官方定位为面向工作的统一智能体:从单一提示框承担知识工作、问答、内容创作与写代码,自行规划并调用技能与工具,连接 Cloud 客户的业务系统,再把成品带回用户已在使用的文档、收件箱与开发环境。
Docker Agent v1.149.0 发布:支持从公开 GitHub 仓库加载技能,评测链路改为可替换后端
Docker 工程团队于 2026 年 10 月 7 日发布 Docker Agent v1.149.0,GitHub release 的 published_at 为 2026-10-07T14:55:39Z。这一版支持在配置里直接用公开 GitHub 仓库地址加载技能,新增独立的评测裁判后端并默认走 models gateway,同时修正了 OpenAI 服务档位的计费口径。仓库许可为 Apache-2.0。
继续阅读:Docker Agent v1.149.0 发布:支持从公开 GitHub 仓库加载技能,评测链路改为可替换后端 · EmbeddingGemma 2 发布:7.4 亿参数的端侧多模态嵌入模型,文本、图像、音频、视频共用一个向量空间