安全为谁而设?边界感知自蒸馏实现话题内精准拒绝
Hugging Face 新论文提出边界感知自蒸馏方法,解决模型安全对齐中“话题级拒绝”过于粗糙的问题。该方法通过升级重试策略将训练数据覆盖率从丢失 19.88% 提示词降至 0.20% 残差失败。
Hugging Face 新论文提出边界感知自蒸馏方法,解决模型安全对齐中“话题级拒绝”过于粗糙的问题。该方法通过升级重试策略将训练数据覆盖率从丢失 19.88% 提示词降至 0.20% 残差失败。
Runway 宣布巴黎研究实验室 Kinetix 团队加入公司,借此加速机器人研究投入并扩大商业化部署。官方同时开放巴黎及全球的职位招聘,详情见其发布链接。
Google DeepMind 发布 AlphaGenome Atlas,绘制了覆盖人类基因组中 90 亿个单碱基 DNA 变异分子效应的预测图谱。该图谱为研究基因变异的影响提供了系统性的预测资源。
OpenAI 启动面向新闻业的多方面支持计划,覆盖学生、教育者、记者与新闻机构。新学年将为纽约城市大学纽马克新闻学院和西北大学梅迪尔新闻学院的逾 400 名研究生及教师提供 ChatGPT Edu 订阅,并与 Tow-Knight 中心及 Knight Lab 合作。
Berkeley RDI 推出开源平台 CUA-Lite,为计算机使用智能体提供三个标准化抽象。其环境接口下运行 15+ 个覆盖桌面、浏览器和移动端的基准,并提供含 30k+ 可验证任务的免 VM 桌面沙箱;统一监督数据格式已转换 10+ 个公开 CUA 数据集;每模型一个 harness 在评测、SFT 和 RL 间共享,支持 14 个模型族。
推荐理由:原文说明了平台的三项标准化抽象及覆盖规模,读者可以据此评估它在整合分散的计算机使用智能体资源上的可用性。
OpenAI 探讨更强大且更实惠的 AI 如何拓展个人与企业可完成的工作范围,并让增长更具经济性。文章聚焦于 AI 能力提升与成本下降带来的实际应用空间扩展,而非发布具体新模型或产品。
很高兴看到 MiniCPM5-2B 在 RTX 3080 上流畅运行!在较旧的 GPU 上实现高响应智能体正是我们追求的边缘性能。感谢演示 🔥
面壁智能 OpenBMB 在开源 MiniCPM5-2B 后,进一步开源其背后的 RL 训练栈。Meshy 是服务化 RL 训练框架,将推理、rollout 和训练解耦为统一数据平面上的独立服务。
斯坦福 RegLab 团队用 LLM 流程审查全美 9,623 个地方司法辖区的 900 万条法律条款,筛出约 10,000 条疑似歧视性法律,估计至少 5000 万美国人生活在存在明显歧视性法律的城市、县或镇。该流程在识别差别待遇上准确率超 90%,并正确标记了人工标注者认定为"高优先级"条款中的 88%,相关论文发表于 ICAIL。
IBM Research 联合 Red Hat、Google 的开源项目 llm-d 展示在 544 块 NVIDIA H100 GPU 上部署 753B 参数的开放权重 MoE 模型 GLM-5.2(约 39B 激活),在数百到 3000 个并发编码智能体负载下峰值输出超 6.6M tokens 每分钟,零抢占。
东华软件与火山引擎合作,通过 TRAE 企业版将 AI Coding 融入医疗、金融等业务线的 10 余个研发、测试与交付团队。在医疗核心业务系统改造中,原本需数天完成的代码阅读与理解工作已缩短至小时级;东华TMC平台已在多个供应商接口接入项目中应用 TRAE 辅助开发。目前 TRAE 已覆盖东华 10 余个核心团队,医疗团队核心 HIS 系统下已嵌入 200 多个智能体。
Katie McLaughlin 在 Google AI 的 AI 评测系列最终篇中,介绍如何将 Inspect AI 评测的 CSV 数据接入 Data Studio,通过克隆 Master Dashboard Template 并绑定 Google Sheets 数据源,约 30 秒完成无代码交互式仪表盘搭建。
Xiaomi MiMo Desktop 桌面客户端携两款新一代模型 Preview 版(MiMo-X-Pro-Preview、MiMo-X-Flash-Preview)正式开放邀测,用户可提交申请限时免费体验。
Mistral 宣布完成 30 亿欧元 D 轮融资,投后估值超过 210 亿欧元,公司称这是欧洲科技公司有史以来最大的股权融资,距其成立三年。
推荐理由:融资公告由公司官方发布,给出了金额、估值、领投方和资金用途,读者可以据此了解欧洲主权 AI 阵营的资本动向。
Mistral AI 官方宣布完成 30 亿欧元 D 轮融资,公司称这是欧洲科技公司有史以来规模最大的股权融资,距离其创立仅三年。
OpenBMB 发布 MiniCPM5 端侧模型,采用 Apache 2.0 协议,1B 与 2B 版本支持 128K 上下文、编码、推理和智能体工具调用。
百度智能云在2026开放数据中心大会暨首届算博会期间举办AI算力基础设施专题论坛,指出云计算正全面迈进Agent原生时代,基础设施需围绕Agent运行特征系统性升级。百度天池256超节点、百舸AIStack轻量GPU云及全国产化方案已实现部件级软硬件贯通与生产级验证。百度瀚海U高密集成UPS电源获评2026ODX突破项目,天池超节点架构将完整开放。
千问APP推出限时「开学资料包」活动,9月30日前输入“开学资料包”或“x年级开学资料包”即可免费领取、下载并打印。资料覆盖小学到大学不同学段,包含知识点梳理、专项练习、解题技巧及名校真题,可搭配千问学习功能使用。
9 月 8 日,面壁智能联合 OpenBMB 开源 2B 端侧基座模型 MiniCPM5-2B,支持工具调用、深度搜索、代码生成。
可灵AI将于9月10日至16日亮相2026多伦多国际电影节市场(TIFF Market),与全球影视创作者及行业伙伴探讨AI进入电影制作的真实现场。期间将举办产业论坛、行业交流酒会,并设置展位(A20, Metro Toronto Convention Centre),展示可灵AI驱动连贯、可控的电影级AI视频创作。
Epoch AI 测量四款模型的首 token 延迟(TTFT)随上下文长度的缩放,发现 GPT-5.6 Terra 和 Sol 呈明显二次曲线,Claude Sonnet 5 接近线性,Opus 5 噪声较大但仍接近线性。
推荐理由:原文以实测数据和三种稳健估计器比较 GPT-5.6 与 Claude 5 的长上下文延迟缩放,可帮助读者理解两家不同的架构取舍与成本影响。
vLLM 团队发布针对智能体负载优化的博客,基于 SemiAnalysis 的公开 AgentX 基准展示成果:DeepSeek V4 Pro 在 GB300 上达到 83K total tokens/GPU-秒。
推荐理由:vLLM 团队结合 AgentX 实测数据讲解智能体负载的全栈优化方法与失败教训,读者可以借此理解并行策略如何跟随模型架构调整。