跳到正文

#现象/趋势

今日 2 条
9月4日周五
  1. Sherwin Wu66

    Sherwin Wu 表示自己曾觉得 ARC-AGI-3 很难,如今该基准已被 Astra 饱和。引用 François Chollet 的话称,ARC 3 发布时他预计前沿模型约一年才能饱和,实际只用了 6 个月,约为预期的 2 倍速度,新一代模型的能力将挑战人们基于旧模型形成的 AI 观点。

    推荐理由:结合 Arc Prize 负责人的预估与半年即饱和的结果,读者可以借此对照自己对前沿模型进展速度的预期。

  2. Ethan Mollick48

    Ethan Mollick 让 GPT-6 阅读他数万封邮件、 writings 和日程,自主下载软件、制定策略,在五天不间断工作中无需干预地构建了数 GB 的个人 wiki,涵盖研究、联系人、想法和任务。现在该 AI 每天两次交叉核对新邮件并发送摘要简报。他提醒授权访问自己电脑存在风险需谨慎,试用期内 token 未收费,因此无法告知完整成本但可能相当可观,日常简报 token 消耗不大。

  3. Hacker News 热门(buzzing.cc 中文翻译)32

    Grok 服务中断,x.ai 状态页更新

    Hacker News 热帖报告 Grok 出现服务中断,链接指向 x.ai 的状态页 status.x.ai,帖子获得 108 个 HN Points。材料仅提供标题与链接,未包含故障原因或恢复情况等细节。

9月3日周四
  1. Thomas Wolf42

    Thomas Wolf 引用 @jdlichtman 的消息:其同事 Youness Lamzouri 产出了对 Claude 关于超过 2/3 zeta 零点论证的更简单的人类版证明消化。论文摘要称给出概念上更简短的无条件证明,证明超过 67.25% 的非平凡零点简单且位于临界线上,至少 83.62% 非平凡零点互不相同;原证明由 Anthropic 内部研究版 Claude 产出并经 Alpöge 和 Furman 验证,新证明用 Hilbert 空间不等式替代矩阵框架。作者评论 great mathematicians still lead on taste。