Google 发布 Gemini 3.8 Flash,六周内第三款 Flash 模型
Google 发布 Gemini 3.8 Flash,称其为此前最佳的推理与编码模型,这是六周内的第三款 Flash 模型,另推出面向漏洞检测与缓解的 Gemini 3.8 Flash Cyber。
Google 发布 Gemini 3.8 Flash,称其为此前最佳的推理与编码模型,这是六周内的第三款 Flash 模型,另推出面向漏洞检测与缓解的 Gemini 3.8 Flash Cyber。
Google DeepMind 发布 Gemini 3.8 Flash 和 Gemini 3.8 Flash Cyber,两者基于同一核心智能,区别在于安全包络和访问方式。
Google 发布 Gemini 3.8 Flash,含通用版和面向经审核防御者的 3.8 Flash Cyber。
Google 发布 Gemini 3.8 Flash 及新的 3.8 Flash Cyber,作者称后者推进网络防御前沿,这是 6 周内第 3 次 Flash 模型更新。
Google DeepMind 发布 Gemini 3.8 Flash 与 3.8 Flash Cyber。
推荐理由:官方给出两版模型的定价、基准成绩和实际安全应用数据,读者可据此评估在新旧 Flash 模型间的迁移与选型。
Google DeepMind 发布 Gemini 3.8 Flash 模型卡,称其为 Gemini 3.7 Flash 的下一代迭代,在软件工程和智能体知识工作流方面提升性能,并继续支持自定义 effort 等级以平衡质量、成本和延迟。
谷歌 9 月 2 日在 Google DeepMind 网站低调上线 Gemini 3.8 Flash 模型,基于 Gemini 3.7 Flash,截至发稿官方尚未通过新闻稿或社媒官宣。
谷歌于当地时间 9 月 2 日宣布推出 Gemini 3.8 Flash Cyber 模型,通过 Fairwind 计划面向首批受信任的安全防护团队开放。该模型在 CyberGym 基准上达到顶尖自主漏洞挖掘水平,内部测试中 20 种编程语言的漏洞挖掘成功率突破 70%,CWE-Bench 上 Pass@1 达 47.2%。
推荐理由:原文给出模型能力变化、定价和多项基准对比,读者可据此评估它相对更大模型的性价比与适用场景。
Google 发布 Gemini 3.8 Flash,这是 6 周内第 3 次更新的 Flash 模型,官方称智能体与编码能力再次提升。
Multiverse Computing 发布首款大模型 Quasar 438B,定位面向企业级智能体和编码的推理模型,支持英文和西班牙语。
WeatherNext 3 结合实时卫星和地面观测生成逐小时天气预报,并开始接入搜索、Gemini、地图及开发者数据服务。温湿度采用五公里网格,其他变量分辨率不同;其降水精度提升来自具体评测,不能扩大成所有地区和天气都更准确。
推荐理由:天气模型开始进入日常查询与开发者数据服务,公开的分辨率和评测范围有助于判断预测数据适用的场景。
World Labs(李飞飞联合创立)发布世界模型 Atlas,可从几张照片完成 3D 场景生成、重建与仿真,输出最高 1440p、1 分钟的可控镜头视频,并支持点云与 3D Gaussian splats 等 3D 数据输出。
马斯克 9 月 2 日在 X 平台预告 Grok 4.7 将于 10 天后(约 2026 年 9 月 12 日)发布。他称 Grok 4.7 参数规模达 2.1 万亿,较 Grok 4.6 的 1.5 万亿增长 40%,除服务速度略慢外各方面均优于 Grok 4.6 且 Token 效率更高,并称上线后将超越所有模型。
Meta Superintelligence Labs 发布首个实时音频感知模型 Muse Voice Transcribe,将流式 ASR、20+ 说话人的说话人分离和端点检测合并为一个自回归模型,无需后处理。
Anthropic 发布 Claude Fable 5.1 和 Claude Mythos 5.1,两者为同一模型但安全防护级别不同,Mythos 5.1 仅通过可信访问计划提供给网络安全和生命科学领域的受审机构。
推荐理由:官方发布给出了定价变化、基准数据和科学应用实例,读者可以据此评估新模型在编码与科研场景中的成本与能力取舍。
阿里千问宣布 Qwen3.8-Max 升级到 0902 版本,围绕编程和专业办公进行后训练,CodeArena 前端编程总榜提升 22 分至 1691 分夺得冠军。
Elon Musk 宣布 Grok 4.7 将在 10 天后发布。推文中还引用了他人对 Grok 4.6 表现的称赞作为背景。
推荐理由:官方发布自家新模型并给出 Arena 排名与价格数据,读者可据此比较其在编码场景的性价比位置。
李飞飞创办的 World Labs 发布多模态世界模型 Atlas,称其能以像素级精确相机控制生成图像和视频帧,并在 3D 中重建。Atlas 可输出最长 1 分钟的 1440p 视频,从一至数十张图像进行空间重建,支持时空模拟和文本生成图像与 360 度全景,部分合作伙伴已获抢先体验,未来几周内开放早期访问。