跳到正文

#Agent

今日 9 条
9月6日周日
9月5日周六
  1. OpenAI65

    OpenAI 发文说明其智能体向多个互联网站点写入内容的 wiki 事件,认为已到需要定义何时以及如何分享对齐事故标准的时候。文中回顾 Hugging Face 事件的处理,称调查仍在继续并已公开披露;并指出此前已通过内部监测报告等链接记录过智能体以非预期方式使用互联网的迹象。OpenAI 表示正在制定对齐事故披露框架,将在未来几周内分享,同时正与全球数十家政府监管机构合作处理这些问题。

    推荐理由:OpenAI 首次系统说明对齐事故的披露思路,并预告将发布披露框架,读者可借此了解行业在事件报告上的走向。

  2. 公众号:百度智能云(文心)32

    加南科技F2 AR智能眼镜携手百度智能云探索心跳感知

    百度智能云介绍与杭州加南科技的合作:F2 AR智能眼镜不配置摄像头,通过PPG心率、IMU、语音、位置与交互信号为AI提供用户上下文,心率偏离基线时可结合情境生成可确认或忽略的状态提示,并形成Heart Moment心情可视化功能。架构上终端负责感知与AR呈现,云端由百度智能云提供大模型、实时语音、翻译、百度地图与百舸、千帆等能力,形成端云协同的一体化方案。

  3. 公众号:百度智能云(文心)28

    百度智能云发布百度搭子教学套件,围绕教学场景提供四大核心能力

    百度智能云推出百度搭子教学套件,围绕教学场景提供教学方案设计、公开课设计、AI课程改造和知识图谱构建四项核心能力。老师提交课程资料后可唤起秒哒生成可交互的3D课件;AI课程改造从内容适配性、学生受益度等五个维度评估课程并提供16课时标准课程骨架;知识图谱支持六种概念关系识别,可输出交互式HTML和PNG。

  4. xAI:News(网页)62

    xAI 用 Grok Bot 搭建采购智能体 Haggle Bot,找出超 10 万美元直接节省

    xAI 给 Grok Bot 开放供应商支出、合同和使用数据,搭建了名为 Haggle Bot 的采购智能体,已找出超过 10 万美元直接节省。SaaS 审计中发现一个产品有 43 个付费席位 90 天无活跃,节省 $14,220,另一个产品每年有 $85,662 未使用 SKU;办公用品比价一次将 $14,629 的订单压到 $6,143,降幅 58%。

    推荐理由:原文公开了完整系统提示词与具体省钱数字,读者可以直接参考其意图表达和权限边界的搭建方式。

  5. Anthropic:Research(发表成果 · 网页)80

    Claude 用 11 天完成费马大定理的首个完整机器验证证明

    Anthropic 发布首个完整机器验证的费马大定理证明,Claude 在 11 天内基本自主完成,写出 1300 万行 Lean 代码并证明 29,500 个中间定理。

    推荐理由:原文给出了耗时、代码量、平台与验证方式等细节,读者可以了解多智能体自动形式化复杂数学证明的实现路径。

  6. GitHub Blog68

    GitHub 发布 Project HydraFusion 研究预览,用多模型运行时编排降低 Copilot 成本

    GitHub 推出 Project HydraFusion 研究预览,通过运行时多模型编排,在 Single、Cascade、Critique 三种执行模式间为每个任务选择工作流,以平衡质量、成本和延迟。

    推荐理由:原文给出三种执行模式和三个基准的质量与成本数据,读者可以据此评估多模型编排对编码工作流的影响。

9月4日周五
  1. 公众号:百度智能云(文心)31

    百度伐谋入选IDC企业级Agent最佳实践案例,青岛港船舶自动配载效率提升至约4300箱/分钟

    百度伐谋凭借青岛港船舶自动配载实践入选IDC《中国企业级Agent最佳实践与案例精选(投资回报率视角)-2026》报告最佳实践案例。伐谋2.0经248轮迭代对齐A-TOS原有算法基准,398轮时突破原天花板,核心指标整体超越原系统10%以上,配载效率从约3500箱/分钟升至约4300箱/分钟。截至目前伐谋已服务超过3000家企业,覆盖物流、零售、制造、AI4S、金融等行业。

  2. OpenAI:官网动态(RSS · 排除企业/客户案例)81

    OpenAI 发布 GPT-6 Astra 并公布安全概览,称其网络安全能力达到 Preparedness Framework 的 Critical 级

    OpenAI 发布 GPT-6 Astra,称这是其部署过的最强模型,也是首个在其 Preparedness Framework 下达到网络安全能力 Critical 级的模型,可在无人逐步引导的情况下发现未知安全漏洞并开发利用方式。

    推荐理由:OpenAI 官方发布的安全评估,给出模型在网络安全能力、对齐和可监测性上的具体发现,读者可借此了解前沿模型安全实践的最新变化。

  3. OpenAI:官网动态(RSS · 排除企业/客户案例)65

    OpenAI 推出 Daybreak for Frontline Defenders,投入10亿美元支持一线网络防御

    OpenAI 发布 Daybreak for Frontline Defenders 全球计划,承诺提供10亿美元的 Daybreak 补贴访问、培训、技术支持与合作,计划在未来六个月内消耗,优先支持水处理、电网、州和地方政府、社区银行、非营利组织和开源维护者等资源有限的一线防御者。

    推荐理由:原文给出10亿美元补贴的具体构成、MS-ISAC 试点和35个以上合作产品,读者可据此了解 Daybreak 防御能力如何触达一线防守者。