跳到正文

#OpenAI

今日 12 条
9月4日周五
  1. IT之家(RSS)36

    IT之家早报 0904:GPT-6 Astra 发布,ChatGPT、Claude 和 Grok 集体宕机近 4 小时

    OpenAI 发布目前最强的大语言模型 GPT-6 Astra,称其首次达到“关键”级网络安全能力门槛,但也承认模型可监控性有所下降,已强化安全防护。同日 Downdetector 报告 ChatGPT、Claude、Grok、Cursor 服务在美国集体出现故障,后已恢复正常。早报还涵盖华为国行 5G 回归、微短剧统一标识“苔花标”发布等内容。

  2. 公众号:数字生命卡兹克14

    GPT-6 Astra 全面解析

    作者数字生命卡兹克发布对 GPT-6 Astra 的全面解析,标题以“欢迎来到AGI时代”点题。当前材料仅提供摘要级信息,正文以“一段渐变的旅程”描述,未给出可验证的具体细节。

  3. Gary Marcus:The Road to AI We Can Trust(RSS)74

    Gary Marcus 评 GPT-6 Astra:进步明显但鲁棒性与可监控性存疑

    Gary Marcus 发文点评 GPT-6 Astra,称多项报告显示其为真正的进步,OpenAI 产品显式创建并操纵符号世界模型,令其近十年的主张获得印证。

    推荐理由:作者结合自身近十年主张神经符号世界模型的立场,指出 Astra 的关键未知在鲁棒性与可监控性,判断有具体依据。

  4. Greg Brockman72

    Greg Brockman 转发 @arcprize 的评测称 OpenAI 的 GPT-6 Astra 在 ARC-AGI-3 上取得 SOTA,他称该基准已饱和。Astra 标准 harness 得分 63%,经新的 Provider Adapter harness 达 99%,在 96% 的 ARC-AGI-3 关卡上超越人类表现;排行榜图还显示更高推理层级通常成本更低,因为 Astra 用更少动作通关,减少模型调用和 token 数。

    推荐理由:转发 ARC Prize 对 GPT-6 Astra 的评测数据,标准与 Provider Adapter 两种 harness 分差大,可据此了解 harness 对得分的影响。

  5. OpenAI:官网动态(RSS · 排除企业/客户案例)81

    OpenAI 发布 GPT-6 Astra 并公布安全概览,称其网络安全能力达到 Preparedness Framework 的 Critical 级

    OpenAI 发布 GPT-6 Astra,称这是其部署过的最强模型,也是首个在其 Preparedness Framework 下达到网络安全能力 Critical 级的模型,可在无人逐步引导的情况下发现未知安全漏洞并开发利用方式。

    推荐理由:OpenAI 官方发布的安全评估,给出模型在网络安全能力、对齐和可监测性上的具体发现,读者可借此了解前沿模型安全实践的最新变化。

  6. OpenAI:官网动态(RSS · 排除企业/客户案例)65

    OpenAI 推出 Daybreak for Frontline Defenders,投入10亿美元支持一线网络防御

    OpenAI 发布 Daybreak for Frontline Defenders 全球计划,承诺提供10亿美元的 Daybreak 补贴访问、培训、技术支持与合作,计划在未来六个月内消耗,优先支持水处理、电网、州和地方政府、社区银行、非营利组织和开源维护者等资源有限的一线防御者。

    推荐理由:原文给出10亿美元补贴的具体构成、MS-ISAC 试点和35个以上合作产品,读者可据此了解 Daybreak 防御能力如何触达一线防守者。