Google 开源 autofinetune:用 AI Agent 在 TPU 上自动完成 LLM 后训练
Google 发布 autofinetune 项目,把 autoresearch 的自主研究循环应用到 LLM 后训练(SFT 和 GRPO),使用 Tunix、Gemma、Cloud TPU,由 Antigravity CLI 和 Gemini Flash 3.7 编排。
Google 发布 autofinetune 项目,把 autoresearch 的自主研究循环应用到 LLM 后训练(SFT 和 GRPO),使用 Tunix、Gemma、Cloud TPU,由 Antigravity CLI 和 Gemini Flash 3.7 编排。
Google 推出 Gemini Windows 桌面应用,面向 Windows 10 和 11 全球开放,下载地址 gemini.google/desktop。
Google 宣布在芬兰进行 130 亿欧元投资,为其在欧洲最大单笔投资,将购买 Loviisa 核电站最多 50% 的电力输出,与 Fortum 签订 22 年合同。资金用于在 Kajaani、Muhos 和 Vaala 新建三座数据中心并扩建 Hamina 现有设施,以支撑 Gemini、Search 等服务的 AI 算力需求,建设计划在 2027 至 2028 年进行。
Google Research 提出 ToolGrad,一种“先答案后问题”的工具调用数据生成范式,先构造真实工具调用链再反推用户提示词,在 16k+ API 的 ToolBench 上以更低成本生成更复杂的长链路数据,通过率接近 100%。
谷歌正式推出面向 Windows 10/11 的 Gemini 独立客户端,安装后可通过 Alt + Space 快捷键在任意界面唤起,快捷键支持自定义修改。应用界面与网页版大致相同,支持生成图像/视频、调用连接的应用,并提供独立设置菜单,可管理麦克风、摄像头、位置权限、查看使用统计与崩溃报告、设置开机自动启动。
Google AI 的 Tilde A. Thurium 发布访谈视频,请 Annie Wang 从头讲解图工程(graph engineering),以及它如何让开发者掌控复杂 AI 系统。
曾在 Deepmind 传播与政策团队工作 2018 至 2022 年的 Vishal Maini 称,当时任何层级都不被允许对外谈论人类灭绝的可能性,研究人员被指导将此类风险斥为危言耸听并转向医疗、气候等正面应用。团队内部明知对齐问题未解决且人手太少,在数月争取后公司放宽规则,允许正面框架的安全内容发布;Maini 认为内部认知与对外口径的差距正因证据更难忽视而缩小。
Gemini 应用现已支持 Windows。用户按 Alt + Space 即可在常用工具旁唤起 Gemini,用于润色草稿、总结长文档、头脑风暴以及生成自定义图片和视频。
Google 发布图像生成工具 Google Pics,基于 Nano Banana 构建,现已上线 pics.new。支持局部对象编辑、图内文字修改与翻译、多人协作创作和单提示词生成多个选项。
推荐理由:原文列出了 Pics 的四项具体编辑与协作能力及可用范围,读者可据此判断是否值得一试。
Google 开源 Mantis,一套协议无关的安全审查技能包,可让现有编码智能体跑完漏洞全生命周期,包括发现疑似缺陷、过滤误报、在 gVisor 或禁网 VM 沙箱中复现、写最小补丁并对补丁再攻击、给出 1 到 10 的风险评分。
Google Developers Blog 发布关于 AI 编码 Agent harness 工程的实践文章,主张用行为评估补充 Terminal-Bench、SWE-bench 等端到端基准。
推荐理由:Google 团队分享用行为评估迭代和守护 AI 编码 Agent 的方法,给出可复用的三步测试循环与示例代码。
Google 发布纪录短片 Love, Rendered,讲述结婚超过 70 年的 Burt 和 Ethelle Shatz 应对 Burt 认知衰退的故事,用技术重现未曾被拍摄的记忆,包括两人在克利夫兰学生合作社相遇的那一天。
Google 宣布 Agent Development Kit(ADK)for Kotlin 1.0 正式 GA,功能与 ADK 1.0 Core 完全对齐,并提供 Android 优先的端侧扩展。
谷歌宣布将在芬兰投入至少 130 亿欧元建设 AI 基础设施,为公司迄今在欧洲最大单笔投资,未来两年至少新建 3 座数据中心并扩建哈米纳现有数据中心。新数据中心位于卡亚尼、穆奥斯和瓦拉,依托当地寒冷气候、无碳能源和电网条件,具备余热回收能力;Fortum 与谷歌签署 22 年购电协议,2030 年至 2049 年采购洛维萨核电站总发电能力的 50%。
谷歌研究院与 HHMI Janelia 于 9 月 4 日宣布首次绘制成年雄果蝇完整大脑和中枢神经系统图谱,MaleCNS v1.0 连接组含 166,691 个神经元、约 1.25 亿个突触连接,记录 11,691 种细胞类型。
Epoch AI 推出 AI Chip Users explorer,以 Nvidia H100 等效值(H100e)估算 OpenAI、Google DeepMind、Anthropic、Meta Superintelligence Labs 和 SpaceXAI 用于研究、训练和推理的算力。
微软9月补丁日修复约972个漏洞,创历史纪录,其中112个达到严重级别,而两个月前的纪录还是570个。文章提到 OpenAI、Anthropic、Google、Microsoft 等超过100家公司和组织两周前发布公开信,警告 AI 加持的攻击正在压缩漏洞修补窗口,Zero Day Initiative 研究员 Dustin Childs 称这种激增是“新常态”。
Google Cloud 与 Accenture 成立 Accenture Gemini Enterprise Business Group,Google 将培训至多 1,000 名 Accenture 前置部署工程师,帮助企业在 Gemini Enterprise 平台上构建定制 AI 应用。
Google DeepMind 发布 AlphaGenome Atlas,一个 AI 驱动的可搜索数据库,绘制全部 90 亿种单碱基 DNA 变异的预测影响,帮助科学家更好地理解疾病。
谷歌 DeepMind 推出 AlphaGenome Atlas 平台,包含人类基因组约 90 亿种单核苷酸变异的功能预测,学术界可通过门户网站和 AlphaGenome API 免费使用。平台规模达 1 PB,比 AlphaFold 数据库大 30 倍以上,同时发布结合 AlphaGenome 与 AlphaMissense 预测的 AVI 评分,在多种变异致病性和罕见疾病基准测试中表现一流。
Katie McLaughlin 在 Google AI 的 AI 评测系列最终篇中,介绍如何将 Inspect AI 评测的 CSV 数据接入 Data Studio,通过克隆 Master Dashboard Template 并绑定 Google Sheets 数据源,约 30 秒完成无代码交互式仪表盘搭建。
SemiAnalysis 在 InferenceX 上发布 TPUv7 Ironwood 的首批第三方推理结果,FP8 聚合服务下 Ironwood 每美元性能最高比 B200/B300 高 50%,在 20 tok/s/user 交互速度下每百万 token 成本约 0.181 美元,低于 B200 的 0.222 和 B300 的 0.276 美元。
Similarweb 数据显示,ChatGPT 网站 AI 聊天流量份额从三个月前的 52.7% 回升至 55.5%,Gemini 则从 27.8% 降到 25.6%。
纽约 Somerset 的 Lake Mariner 数据中心一栋未完工建筑 6 月初起火,Barker 消防队长 Steve Matisz 称消防员近乎盲入,现场无可用报警器、灭火系统,三个消火栓失效,应依法可查的安全文件据称也在火中烧毁。
Google Research 与 DeepMind 发布 AI 天气模型 WeatherNext 3,不再依赖传统物理模拟,直接处理实时地球静止卫星数据,每小时生成一次预报。
Google 在 Gemini app 和 API 中发布 Lyria 3.5 音乐生成模型,官方称其人声表现力和编曲丰富度超过前代。用户可在 app 中选择流派、风格、人声或纯器乐,生成长短曲目,还提供背景音乐和个性化生日歌模板。
三名徒步者用 Google Gemini 规划行程后在加州 Mount Shasta 被救,Siskiyou 县警长办公室称 Gemini 建议他们携带的食物和水远低于所需。三人凌晨3点出发,晚上7点才登顶,夜间下山迷路后在 Mud Creek Canyon 过夜,次日由 Forest Service 护林员和志愿者救出,警方提醒不要完全依赖 AI 做行程规划。
Google DeepMind 用 100 个共享权重、人设随机的 Gemini 3.1 Pro 智能体模拟科学会议,协作求解 71 个 Lean 形式化数学猜想。
TestingCatalog 9月5日 AI 日报汇总:OpenAI 将 Astra 推送给所有 Plus 和 Business 用户(不再限于 Pro/Enterprise)。
Google 在 Gemini Flash 系列模型上推出 agentic 视频理解,模型不再按固定 1 FPS 单遍读取视频,而是按需加载帧、音频和转录文本。
据 TechRadar 报道,美国加州 3 名缺乏经验的登山者向 Gemini 咨询沙斯塔山路线,按其预计 8 小时登顶的建议出发,实际耗时约 16 小时才登顶。他们夜间下撤时偏离路线进入 Mud Creek Canyon,一人膝盖受伤,报警后次日早晨获救,事后承认过于依赖 AI 而未自行判断。
谷歌于 9 月 5 日宣布在 Gemini 应用和 Gemini API 中上线音乐生成模型 Lyria 3.5,可生成含数段副歌、桥段等数分钟完整歌曲,用户可通过 gemini.google.com/music 网站和应用使用。
Google Photos 负责人 Shimrit Ben-Yair 宣布 Gemini Spark 支持管理 Google Photos 照片库,用户可用自然语言指令让 AI 智能体执行照片相关操作。