Google 向公众开放 SynthID 水印检测器,称已有 1800 亿图片和视频带水印
Google 将 SynthID Detector 开放给公众,任何人都可以检测图片、视频或音频是否由 Google 及其合作伙伴的 AI 生成。该工具可识别 Gemini、Veo、Lyria 等模型嵌入的隐形水印,支持 JPG、PNG、MP4 和 MP3 格式,但它并非通用 AI 检测器,只能标记带有 SynthID 水印的内容。
Google 将 SynthID Detector 开放给公众,任何人都可以检测图片、视频或音频是否由 Google 及其合作伙伴的 AI 生成。该工具可识别 Gemini、Veo、Lyria 等模型嵌入的隐形水印,支持 JPG、PNG、MP4 和 MP3 格式,但它并非通用 AI 检测器,只能标记带有 SynthID 水印的内容。
扎克伯格与 Priscilla Chan 支持的 Biohub 正协调一项 18 亿美元的计划,目标是训练能预测细胞行为的 AI 模型,以加速药物研发。该组织此前已在 4 月为五年期虚拟生物学计划承诺 5 亿美元,Meta、Google DeepMind 和 Isomorphic Labs 合计出资 3 亿美元,美国能源部五年内投入超 5 亿美元用于实验室测量与算力。
Google 发布浏览器端 AI 平台 Playground,美国成年用户无需编程,通过文本对话调整游戏规则、物理、角色和环境并即时试玩。
Google DeepMind、Meta 和 AI 药物发现初创公司 Isomorphic Labs 联合向扎克伯格夫妇创立的非营利生物医学研究机构 Biohub 投资 3 亿美元,用于构建 AI 数据集,让研究人员能够以数字化方式提出、预测和回答生物学问题。
Google 上线新网站,任何人都可以验证图像、视频或音频是否由 AI 生成。该工具此前在 Google I/O 上仅向部分记者、媒体从业者和研究人员开放测试,现已向所有人开放,支持 JPG、PNG、GIF 等图像格式,MP4、MOV、WEBM 视频格式以及 WAV、MP3、FLAC 等音频格式。
Google Labs 推出 AI 游戏创作平台 Playground,用户用简单文字提示即可构建浏览器游戏,无需编程经验。创作者可选择问答、竞速等类型,指定 2D 或 3D、单人或多人,并上传素材由 AI 转成符合美术风格的游戏资产;成品可在手机和电脑上玩,可设为私有、通过链接分享或发布到 Explore 画廊,发布后仍可继续修改。
Simon Willison 表示欣赏 EmbeddingGemma 2 采用 Apache 2.0 许可。他认为嵌入模型不适合用闭源、仅托管的形式:嵌入模型通常要计算并存储成千上万甚至数百万个向量,一旦厂商停供该模型,用户就得为重新计算这些已存向量付费。他本人不愿自托管,更愿意付费使用托管版本,同时知道厂商停托管后可以自行运行开放权重版本,或另找能运行的供应商。
Google DeepMind 发布 EmbeddingGemma 2,将文本、代码、图像、视频和音频映射到统一嵌入空间,采用 Apache 2.0 许可,参数量 7.4 亿。
推荐理由:EmbeddingGemma 2 把文本、图像、音频、视频统一到同一嵌入空间,并给出端侧内存与向量截断的具体数据,便于判断本地检索与 RAG 的可行性。
Google 发布图像生成与编辑模型 Nano Banana 2.1,取代 2026 年 2 月发布的 Nano Banana 2,1K 图像价格从 6.70 美分降至 3.36 美分,4K 从 15.10 降至 7.56 美分。
Google 发布开源多模态嵌入模型 EmbeddingGemma 2,可将文本、图像、视频、音频和代码转为数值向量。该模型 7.4 亿参数,在 Massive Text Embedding Benchmark(Code)上得分 78.68,比前代 68.76 提升近 10 分,Google 称其表现超过规模两倍的竞品。
苹果被曝正在研发一款不保存视频录像的智能家居摄像头,改用 AI 将视觉数据转成描述家中情况的文字片段,并支持人脸识别;古尔曼称未来 AirPods 的摄像头也可能采用类似方案。
Mistral 发布迄今最大模型 Mistral Large 4,拥有 1 万亿参数、490 亿激活参数,已在 Mistral Studio 开放 API 预览,权重预计 10 月底发布。
Google 将从 10 月 9 日起把免费版 Gemini 用户限制为只能使用 Flash Lite 模型,目前免费用户可在 Flash Lite、Flash 和 Pro 之间选择。
Google 的 Gemini「Call for Me」AI 功能可能从商务通话扩展到个人通话,可代用户给亲友打电话传话,例如「打给妈妈说我晚到 15 分钟」。Android Authority 在 APK 拆包中发现「Gemini Calling」引导界面,并发现针对单个应用的细粒度权限设置,用户或可选择允许 Gemini 访问哪些应用能力。该扩展与细粒度权限设置是否公开发布尚不确定。
独立研究者 Syed Anas Mohiuddin 测试了 Google、JP Morgan Chase、Weviate、Rapid7、法国政府部际数字事务局和美国联邦政府等机构的智能体,发现 MCP(Model Context Protocol)在智能体间通信中存在信任缺口。
OpenAI 为符合欧盟 AI 法案要求,将在未来几周对欧盟地区的 ChatGPT 和 Codex 用户启用名为 textGrain 的隐形文本水印,通过统计信号嵌入模型的用词选择中;API 水印在全球范围内为可选开启,与 Anthropic 对 Claude 全球强制水印的做法不同,并将在未来几周通过 Microsoft Azure 等云合作伙伴提供。
MIT Technology Review 的 EmTech Future 2026 活动回顾了 AI 与量子、能源、机器人等技术交汇的趋势。Google Research 负责人 Yossi Matias 探讨了 AI 如何开始重塑生物学、基础设施、制造业与科学,并认为其最大影响可能来自与其他领域的交叉。
MIT Technology Review 文章指出,公众对 AI 的负面情绪与使用量正同时飙升:Pew 数据显示更多美国成年人认为 AI 会带来负面影响,年轻人尤为悲观;Gallup 5 月民调中 71% 美国成年人反对在本地新建 AI 数据中心。
Google 以自动提交大幅增加、其中绝大多数无效为由,自 10 月 1 日起暂停其开源软件漏洞赏金计划,并承诺在 2027 年第一季度给出更新。公司称此次暂停源于 AI 提交的显著上升,据 Tom's Hardware 报道,Google 工程师与开源维护者被无效或含幻觉的报告淹没。暂停期间,参与者被建议转向 Google 的其他漏洞赏金项目。
Google 研究者提出 RRSI(Regularized Recursive Self-Improvement of Agent Harnesses),通过随时间收缩的编辑预算和严格评审机制,限制智能体在自我优化时记忆测试任务。
Google 将从 2026 年 10 月起限制个人账户对 Gemini 模型的访问:无订阅用户只能使用最小的 Flash-Lite,不再包含更强的 Flash 和 Pro,而当前免费档提供 3.6 Flash 和部分 3.1 Pro 访问。
曾在 OpenAI 负责撰写每次重大模型发布安全报告的 David Robinson 本周离职,并在 The Atlantic 发表评论文章。他表示行业文化已从根本上损坏,硅谷以极度自信和持续冲刺的方式开发更大模型,忽视或低估潜在问题,并主张前沿实验室应像核电站或繁忙机场一样运行,具备多层冗余和审慎耗时的规划。
DeepMind 研究者提出「人工共生智能」(Artificial Symbiotic Intelligence),主张 AI 研究的核心挑战是协调由智能体、人和连接系统组成的复杂网络,而非构建孤立的机器智能。
前 Google DeepMind 研究员指出,LLM 的思维链并非真正的推理机制,它仍由同一个 next-token 预测过程迭代生成,只是延长了作答前的计算。文章认为当前模型存在三大缺陷:没有显式、持久、可检查的认知状态,知识与推理在神经网络权重中纠缠不清,且思维链常是事后编造。作者主张借鉴 AlphaGo 的搜索架构,为机器推理引入独立的推理机制。
Google 在 Gemini 聊天中全球上线 Skills,用针对具体任务的详细提示词取代此前的 Gems,用户输入“/”加名称即可调用。Skills 格式源自 Anthropic 并以开放标准提供,支持文本、PDF 和图片作为参考材料,Gemini 还能从历史对话生成 Skills 并在匹配时自动运行。
Google 发布新一代前沿模型 Gemini 4 Argon,在 Artificial Analysis 智能指数上以 53 分追平 GPT-6 Astra(max)和 Claude Fable 5.1,但仍落后 Claude Opus 5.5 的 58 分。
推荐理由:汇总第三方与 Google 自测的基准、价格和 token 消耗差异,可判断 Argon 在头部模型中的实际位置。
据 The Information 报道,Google 已启动一项试点,为其 AI 搜索功能中出版商内容的贡献付费,约 100 家出版商参与,测试覆盖 AI Overviews、Search 中的 AI Mode 以及 Gemini 聊天机器人。
特朗普在白宫与 Google、Anthropic、Meta、OpenAI、xAI、Nvidia 六家公司高管会面后,宣布以《前沿责任联合承诺》取代联邦 AI 监管,该承诺属道德约束性质,企业自行制定安全准则,违约似无后果。
Google 发布下一代前沿模型 Gemini 4 Argon,称其在真实软件工程、法律金融等企业知识工作和网络安全防御等复杂工作流中具备前沿性能。该模型初期仅向一组可信网络安全方开放,Google 表示正参与美国政府的前沿模型发布前自愿访问流程,并将逐步扩大访问范围。
推荐理由:Google 发布 Gemini 4 Argon 却先只开放给可信网络安全方,读者可据此观察前沿模型发布与安全审查的绑定趋势。
美国联邦法官驳回 Chegg 与 Rolling Stone 母公司 Penske Media Corporation 针对 Google AI 搜索功能提起的两起反垄断诉讼,两方称 AI Overviews 导致其网站流量流失。
Google 在 Gemini Live 中上线 Guided Vision,可在兼容的 Android 设备上通过共享摄像头,对镜头所指向的内容进行实时语音描述,用于读小字、描述周围环境、寻找或识别物体等。
Google 母公司 Alphabet 发布 Gemini 4 Argon,称其可处理编码、研究和写作等任务,并专门针对防御性网络安全训练,能自主发现、验证和修补关键软件漏洞。
前 Google 和 SpaceX 产品经理 Rama Afullo 创办的 Satlyt 完成 800 万美元种子轮,由 Non Sibi Ventures 领投,专注为卫星开发在轨运行 AI 模型的软件,而非自建航天器。
Graphite 研究发现 Claude Opus 5.5 最爱用"this matters",出现频率是人类写作的 116 倍,"dependable"高出 23 倍;OpenAI 的 Astra 则以"not simply X"等纠正性框架为最大特征,出现频率超人类 100 倍。
Google 的轨道计算卫星原型随 SpaceX 火箭从加州升空,这是该公司首次把自研芯片送入太空,卫星由 Planet Labs 建造,将验证 TPU 能否在轨运行。
Google DeepMind 发布 Gemini 4 Argon,面向编码、企业知识工作和网络防御,首批开放给 Fairwind 计划中的政府用户与可信网络安全人员,之后才会向开发者、企业和消费者开放。
推荐理由:汇总 Gemini 4 Argon 的基准、定价与可用范围,并列出观察者对公布数据的质疑。
Google DeepMind 推出 SynthID Bio,将水印技术引入合成生物学,把不可感知的签名直接嵌入生物代码,使水印不仅能在数字模型上验证,也能在合成出的实体蛋白质上验证,同时保持其生物功能。
推荐理由:SynthID 水印技术首次延伸到合成生物学,读者可了解 AI 生成蛋白质如何在保留功能的同时被标记与验证。
Google DeepMind 发布前沿模型 Gemini 4 Argon,先通过 Fairwind Program 向受信任的网络安全防御方开放,随后逐步扩展至开发者、企业和消费者。
推荐理由:Gemini 4 Argon 的发布信息给出了输出上限、定价与多项基准成绩,可据此判断前沿模型在长程工程与安全防御上的进展。
Google 找到一种为 AI 设计的蛋白质添加水印的方法,目标是帮助生物安全领域识别 AI 生成的蛋白质。该方法适用于一款流行的 AI 蛋白质设计工具。
Google 的 AI 内容付费试点项目进展不顺,约 100 家出版商获准参与,其内容被用于 Gemini 驱动的 AI Overview 等搜索结果时可获得分成,但实际支付金额仅相当于这些出版商广告收入的约千分之一。由于回报过低,多家大型出版商已拒绝加入该项目,希望借此迫使 Google 给出更优厚的条件。