Logan Kilpatrick 发布与 Google DeepMind 负责人 Koray 的对谈视频。话题包括通往 AGI 的路径、3.7 Flash 的进展,以及团队为何专注于前沿模型方向。
Logan Kilpatrick@OfficialLoganKAI 评分4949
Elon Musk@elonmuskAI 评分5858IT之家(RSS)AI 评分6060 消息称 SpaceX 数据中心出现工程与稳定性问题,马斯克换掉多名建设团队高管
据《The Information》援引知情人士报道,马斯克在最近数周内重组 SpaceXAI 数据中心建设团队并替换多名高管,调整与田纳西州和密西西比州数据中心的工程和稳定性问题有关。
DogeDesigner@cb_dogeAI 评分6666The Decoder:AI News(RSS)AI 评分6262 AlgorithmWatch 研究:Google 选举类 AI Overviews 触发不透明、来源集中且时有倾向性
AlgorithmWatch 借助欧盟 DSA 第 40(12) 条的研究数据访问权限,对德国东部三场选举相关搜索运行 4480 次查询并分析 Google 的 AI Overviews。
The Decoder:AI News(RSS)AI 评分6767 Google AI 搜索按国籍给出不同安全建议,修复后仍对 Facebook 相关提问发出警告
Futurism 测试发现,Google AI Overviews 对用户称与非洲、印度或巴基斯坦裔独处的提问会建议报警或前往安全地点,对英国人则建议喝茶聊天气。Reddit 用户首先发现差异,Google 承认结果不符合其标准并称触发词是 alone,修复后国籍类提问恢复正常,但询问与来自 Facebook 的人独处时仍会建议离开并拨打 110。
SemiAnalysis@SemiAnalysis_AI 评分3131
Rohan Paul@rohanpaul_aiAI 评分6565
OpenClaw🦞@openclawAI 评分2626OpenClaw 官方发推提示用户可以将 Google DeepMind 的 Flash 3.7 接入 OpenClaw 使用,并引用了 @_philschmid 的一篇文章作为说明来源。
MarkTechPost(RSS)AI 评分4848 Google Research 发布 TimesFM-3:330M 参数多变量时间序列零样本基础模型
Google Research 发布 TimesFM-3,一个 330M 参数、原生支持多变量预测的时间序列基础模型,在超过 1 万亿时间点上预训练,无需任务特定微调即可零样本接受多目标、过去协变量和过去-未来协变量。
Google Research:Blog(网页)AI 评分5555 Google Research 发布 TimesFM-3:330M 参数零样本多变量时序预测基础模型
Google Research 发布 TimesFM-3,一款原生支持多变量时序预测的零样本基础模型,参数量 330M,在超过 1 万亿时间点的真实与合成语料上预训练。
Google DeepMind精选AI 评分7777 Gemini 上线智能体视频理解,按任务动态查看关键片段
Gemini API 上线智能体视频理解,可按问题动态检查画面、音频和字幕,支持上传视频与 YouTube 链接。功能适用于多款 Flash 模型,沿用标准 API 计价;谷歌测试中的节省幅度取决于任务,不能直接当作所有视频的成本承诺。
推荐理由:按问题选择视频片段改变了长视频分析的资源分配方式,开发者可据此设计更有针对性的检索和理解流程。
Google DeepMind精选AI 评分7171 Google DeepMind 发布 Gemini Omni 1.1 Flash
Google DeepMind 发布 Gemini Omni 1.1 Flash,为开发者带来场景延长、首尾帧插值、360p 快速草稿和最高 4K 放大等生成视频控制能力。
推荐理由:官方给出场景延长、首尾帧插值与 4K 放大等具体能力与开放入口,可据此判断生成视频工作流的变化。
Google DeepMindAI 评分5858 Google DeepMind 试点全球首个双盲 AI 评测
Google DeepMind 宣布试点全球首个针对专有前沿模型的雙盲评测,把外部评测限制在密码学环境中,避免模型提前接触测试题。该项目与新加坡 AI 安全研究所、OpenMined、AVERI 和 MLCommons 合作,在隐私保护环境下用保密基准测试 Gemini Flash Lite 模型,以提升评测可信度。
Google DeepMind精选AI 评分7171 Google 发布 Gemini 3.5 Transcribe 语音转文字模型
Google 发布 Gemini 3.5 Transcribe,称其为目前最精确的语音转文字模型,可将原始音频直接转为准确、格式化文本。据 Artificial Analysis 测量,流式场景平均词错误率 4.0%,非流式 2.6%;相比上一代 Chirp 3,最终转写时间改善 70%,FLEURS 基准上流式 WER 为 5.50%、非流式为 5.04%。
推荐理由:Gemini 3.5 Transcribe 的 WER、延迟与多语言数据,可用来判断实时语音转写当前的能力水位。
Google DeepMindAI 评分3636 从 Atari 到 EVE Online:Google DeepMind 回顾 15 年游戏 AI 研究并携手开发商探索新玩法
Google DeepMind 回顾了从 DQN 玩 Atari、AlphaGo、AlphaZero、MuZero 到 AlphaStar 的游戏 AI 研究历程,并宣布与游戏开发商合作,为游戏与 AI 的前沿打造新玩法原型。
Google DeepMind精选AI 评分7878 Google 发布 Gemini 3.7 Flash,面向编码与智能体并降价一半
Google DeepMind 发布 Gemini 3.7 Flash,定位为面向编码与智能体的最强主力模型,距 Gemini 3.6 Flash 发布仅三周。
推荐理由:官方给出与 3.6 Flash 的多项基准对比和半价定价,可据此判断编码与智能体场景的成本变化。
Google DeepMind精选AI 评分7171 Google DeepMind 发布 SL2T 手语转文本模型,落地 Gboard 与 Live Transcribe
Google DeepMind 发布多语言手语转文本模型 SL2T,在 Gboard 和 Live Transcribe 中为 Pixel 11 提供手语听写功能,首发支持美国手语(ASL)转英文。
推荐理由:Google DeepMind 发布多语言手语转文本模型 SL2T,并首次落地 Gboard 与 Live Transcribe,可了解其数据规模与隐私设计。
Google DeepMind精选AI 评分7171 Google DeepMind 发布 WeatherNext 气旋预报模型并开源
Google DeepMind 在 Nature 发表论文,称 WeatherNext AI 模型在预测气旋路径、强度和风场结构上达到 SOTA,平均为预报员多争取一天预警时间,三天预报精度相当于此前模型的两天水平。
推荐理由:原文给出气旋预报多出一天预警时间的实测结果与开源入口,读者可据此判断气象 AI 的可用边界。
Google DeepMind精选AI 评分7171 Google DeepMind 发布 Gemini Robotics ER 2 具身推理模型
Google DeepMind 发布 Gemini Robotics ER 2,定位为机器人的高层大脑,可理解物理世界、规划多步任务,并把动作执行交给底层 VLA 模型,同时支持调用 Google Search 等工具。
推荐理由:官方给出 ER 2 相对 ER 1.6 的能力升级与开放入口,读者可据此判断机器人在视频理解与多机协作上的进展。
Google DeepMindAI 评分5858 Google DeepMind 在 Flow Music 发布音乐生成模型 Lyria 3.5
Google DeepMind 发布音乐生成模型 Lyria 3.5,并当天在 Google Flow Music 上线。新版本在旋律结构、歌词质量与提示词遵循、人声表现力与发音上均有提升,同时让用户更易控制输出的节奏与时长。
Google DeepMind精选AI 评分7474 Google DeepMind 发布 Gemini Robotics 2,实现机器人全身控制
Google DeepMind 发布 Gemini Robotics 2,由 Gemini Robotics 2、Gemini Robotics ER 2 和 Gemini Robotics On-Device 2 三款模型组成,首次实现对人形机器人从脚到指尖的全身控制,并支持双手与夹爪的精细操作和多机器人协作。
推荐理由:官方给出三款模型的定位与开放入口,可据此判断机器人全身控制与端侧适配的进展。
Google DeepMindAI 评分3030 Google 向 Genesis Mission 承诺 4000 万美元 AI tokens 与额度
Google 宣布向 Genesis Mission 承诺 4000 万美元的 AI tokens 与额度,用于加速科学发现前沿。该承诺以 AI 算力资源形式提供,具体使用方式与覆盖范围原文未进一步说明。
Google DeepMind精选AI 评分7878 Google DeepMind 发布 Gemini 3.6 Flash、3.5 Flash-Lite 与 3.5 Flash Cyber
Google DeepMind 发布 Gemini 3.6 Flash、3.5 Flash-Lite 和面向代码安全的 3.5 Flash Cyber 三款模型。
推荐理由:官方给出三款 Flash 新模型的 token 效率、价格与基准对比,可据此判断智能体工作流的成本变化。
Google DeepMind精选AI 评分7171 Google DeepMind 发布 Gemini 3.5 Flash Cyber 网络安全模型
Google DeepMind 发布 Gemini 3.5 Flash Cyber,这是基于 3.5 Flash 微调的轻量网络安全模型,用于快速发现、验证和修补漏洞,在 CyberGym 等基准上以多次调用取得接近更大模型的成绩。
推荐理由:Google 把轻量 Flash 微调成专用安全模型,并给出 CyberGym 与 Chrome 流水线的实测对比,可看专用小模型在漏洞挖掘上的取舍。
Google DeepMindAI 评分4242 Google DeepMind 与 Isomorphic Labs 发布生物韧性联合方案
Google DeepMind 与 Isomorphic Labs 公布联合生物韧性方案,一方面防止威胁行为者滥用其模型,另一方面让政府、科学家和生物安全专家用 AI 构建更具韧性的世界。
Google DeepMindAI 评分2222 Google DeepMind 推出 Gemini 驱动的 ATL Saathi,为印度教师提供 24/7 教学助手
Google DeepMind 在印度启动 ATL Saathi 试点,这是一款由 Gemini 驱动的 Web 应用,为 Atal Tinkering Labs 教育者提供 24/7 备课与培训助手。
Google DeepMindAI 评分2222 Google DeepMind 与 A24 宣布首个此类研究合作
Google DeepMind 与 A24 宣布达成首个此类研究合作,将顶尖研究实验室与电影制作公司配对,帮助艺术家开发新工作流与技术。合作将跨越多个项目,让 A24 及其电影人直接参与塑造新技术,同时为 Google DeepMind 提供艺术家反馈。Google 还对 A24 进行了投资。
Google DeepMind精选AI 评分7878 Google DeepMind 发布 Nano Banana 2 Lite 与 Gemini Omni Flash
Google DeepMind 发布 Nano Banana 2 Lite 和 Gemini Omni Flash 两款模型。
推荐理由:两款新模型给出了延迟、单价与可用入口,读者可据此判断图像与视频生成链路的成本变化。
Google DeepMind精选AI 评分7878 Google DeepMind 在 Gemini 3.5 Flash 中内置 computer use
Google DeepMind 将 computer use 作为内置工具集成进 Gemini 3.5 Flash,此前该能力仅以独立的 Gemini 2.5 computer use 模型提供。
推荐理由:Gemini 3.5 Flash 把 computer use 从独立模型并入主模型,读者可据此判断智能体跨平台自动化的落地路径。
Google DeepMindAI 评分4040 Google DeepMind 与英国政府用 Gemini 打造 AI 规划原型,目标将住宅规划审批时间减半
Google DeepMind 正与英国政府、Google Cloud、Faculty 及 Barnet、Dorset、Camden 地方规划部门合作,基于 Gemini 共同开发 AI 规划原型,目标将住宅规划申请审批时间缩短 50%。
Google DeepMind精选AI 评分6262 Google DeepMind 发布 AI Control Roadmap,用系统级安全约束 AI 智能体
Google DeepMind 发布 AI Control Roadmap,一套用于在 Google 内部部署和管理高级 AI 的框架,在模型对齐之外增加系统级安全层,即使对齐不完美也能提供保障。
推荐理由:DeepMind 公开内部 AI Control Roadmap,说明如何在模型对齐之外用系统级监控约束智能体,并给出可迁移的威胁建模与分级响应思路。
Google DeepMind精选AI 评分7171 Google DeepMind 发布 DiffusionGemma:文本生成提速 4 倍
Google DeepMind 发布实验性开源模型 DiffusionGemma,采用文本扩散方式并行生成整块文本,在专用 GPU 上推理速度最高提升 4 倍。
推荐理由:Google DeepMind 开源文本扩散模型,给出 4x 推理加速与本地部署的硬件门槛,可据此判断速度优先场景的取舍。
Google DeepMindAI 评分4040 Google DeepMind 联合多方发起最高 1000 万美元多智能体 AI 安全研究资助
Google DeepMind 联合 Schmidt Sciences、Cooperative AI Foundation、ARIA 发起最高 1000 万美元的多智能体 AI 安全研究资助,Google.org 提供支持。
Google DeepMind精选AI 评分7878 Google DeepMind 发布 Gemini 3.5 Live Translate 实时语音翻译模型
Google DeepMind 发布音频模型 Gemini 3.5 Live Translate,可自动检测 70+ 语言并生成保留说话人语调、节奏和音高的近实时语音翻译,全程仅落后说话人数秒。
推荐理由:Gemini 3.5 Live Translate 支持 70+ 语言连续语音翻译,并同步开放 API、Meet 与 Translate 入口,可据此判断实时翻译的落地节奏。
Google DeepMind精选AI 评分7878 Google DeepMind 发布 Gemma 4 12B:统一无编码器多模态模型
Google DeepMind 发布 Gemma 4 12B,一款面向笔记本本地运行的多模态模型,采用无编码器统一架构,视觉和音频输入直接进入 LLM 主干。该模型在标准基准上性能接近 26B MoE 模型,内存占用不到其一半,可在 16GB 显存或统一内存的设备上运行,并首次在中型模型中支持原生音频输入。
推荐理由:Gemma 4 12B 用无编码器架构把视觉和音频直接接入 LLM,读者可据此判断本地多模态智能体的硬件门槛。
Google DeepMindAI 评分2222 Google DeepMind 启动欧洲机器人加速器,15 家初创入选
Google DeepMind 推出为期三个月的 Robotics 加速器,从欧洲选出 15 家机器人初创公司,提供技术指导并开放其 AI 技术栈与 Gemini 机器人模型。入选公司覆盖物流、制造、医疗、气候与导航等领域,包括挪威 3D-Components、法国 Bubble Robotics、英国 Touchlab 等。
Google DeepMindAI 评分1818 Google DeepMind 在亚太推出“AI for the Planet”加速器计划,应对环境风险
Google DeepMind 在亚太地区启动首届 Accelerator 加速器计划,聚焦“AI for the Planet”,面向该地区初创公司、研究团队和非营利组织,为期三个月。入选机构将获得专家指导,以及 Google AI 专家协助将前沿 AI 与科学 AI 模型整合进其项目或产品。计划以在新加坡举行的线下 bootcamp 开营,现已开放意向登记。
Google DeepMindAI 评分5050 Google DeepMind 的 Co-Scientist 加速细胞衰老逆转研究
Google DeepMind 的 Co-Scientist 正被用于加速细胞衰老逆转研究。它扫描数万篇论文后提出 20 多个可测试的新遗传因子,实验室验证其中几个成功将细胞推向更年轻状态并改善整体功能。它还能将原本长达六个月的筛选数据分析缩短到几天。
Google DeepMind精选AI 评分6262 Google 为 Project Genie 加入 Street View 实景能力并向全球 AI Ultra 订阅者开放
Google DeepMind 在实验性原型 Project Genie 中上线 Street View 实景锚定能力,可选取美国地点并叠加风格,让 Genie 基于真实影像生成可交互世界。
推荐理由:Google 把 Genie 的世界模型与 Street View 实景绑定,读者可据此判断智能体训练环境的取材方式变化。