跳到正文

#Agent

今日 20 条
9月4日周五
  1. -Zho-40

    ZHO 刷了大量 GPT-6 Astra 提前测试案例后评价,其惊艳点在于通过建模/渲染软件实现高质量 3D 建模和渲染,建筑与游戏均适用。作为职业建筑师,他认为这并不惊艳,早在 2023 年就提出 AI 能生成真实照片后就不再需要效果图;如果 GPT-6 真的足够强,应重建全新的工作逻辑和链路,而不是更好地完成旧链路,那才是迈向 AGI 的起点。

  2. OpenAI:官网动态(RSS · 排除企业/客户案例)81

    OpenAI 发布 GPT-6 Astra 并公布安全概览,称其网络安全能力达到 Preparedness Framework 的 Critical 级

    OpenAI 发布 GPT-6 Astra,称这是其部署过的最强模型,也是首个在其 Preparedness Framework 下达到网络安全能力 Critical 级的模型,可在无人逐步引导的情况下发现未知安全漏洞并开发利用方式。

    推荐理由:OpenAI 官方发布的安全评估,给出模型在网络安全能力、对齐和可监测性上的具体发现,读者可借此了解前沿模型安全实践的最新变化。

  3. OpenAI:官网动态(RSS · 排除企业/客户案例)65

    OpenAI 推出 Daybreak for Frontline Defenders,投入10亿美元支持一线网络防御

    OpenAI 发布 Daybreak for Frontline Defenders 全球计划,承诺提供10亿美元的 Daybreak 补贴访问、培训、技术支持与合作,计划在未来六个月内消耗,优先支持水处理、电网、州和地方政府、社区银行、非营利组织和开源维护者等资源有限的一线防御者。

    推荐理由:原文给出10亿美元补贴的具体构成、MS-ISAC 试点和35个以上合作产品,读者可据此了解 Daybreak 防御能力如何触达一线防守者。

  4. François Chollet62

    François Chollet 表示,ARC-AGI-3 于今年 3 月发布时前沿模型得分低于 1%,曾引发部分人质疑基准本身有问题、聪明人类也无法得高分。他称基准校准良好,认真投入的普通人应能得 90% 以上,表现优于其人类基线即可得 100%;AI 在 6 个月内从 <1% 提升到 100%,显示该基准记录了智能体能力的快速上升,这一速度超出包括他们自己在内多数人的预期。

  5. Ethan Mollick48

    Ethan Mollick 让 GPT-6 阅读他数万封邮件、 writings 和日程,自主下载软件、制定策略,在五天不间断工作中无需干预地构建了数 GB 的个人 wiki,涵盖研究、联系人、想法和任务。现在该 AI 每天两次交叉核对新邮件并发送摘要简报。他提醒授权访问自己电脑存在风险需谨慎,试用期内 token 未收费,因此无法告知完整成本但可能相当可观,日常简报 token 消耗不大。