跳到正文

#大佬观点

今日 2 条
9月4日周五
  1. Gary Marcus:The Road to AI We Can Trust(RSS)56

    Gary Marcus 呼吁立即暂停 OpenAI

    Gary Marcus 撰文呼吁暂停 OpenAI,理由是其不值得信任:新发布的 Astra 降低了思维链(CoT)可监控性,尤其在 destructive actions 上自家数据显示监控受损,OpenAI 仍照常发布;另有一起新事故被公司隐瞒数周。

  2. Frank Wang 玉伯54

    玉伯转述小珺播客对曾鸣教授的采访,提出 AI 产业分基础设施、探索性应用、原生 AI 应用三阶段,第一阶段企业几乎无法跨越到第三阶段成为终局赢家。当前处于基础设施收尾、探索性应用爆发前夜,现有应用类似移动时代早期的手电筒和墨迹天气,Codex 则像当年的 MS Visual Studio;AI 创业应避开脚手架型应用,构建数据飞轮上的智能复利和网络效应上的黑洞效应。

  3. Gary Marcus:The Road to AI We Can Trust(RSS)74

    Gary Marcus 评 GPT-6 Astra:进步明显但鲁棒性与可监控性存疑

    Gary Marcus 发文点评 GPT-6 Astra,称多项报告显示其为真正的进步,OpenAI 产品显式创建并操纵符号世界模型,令其近十年的主张获得印证。

    推荐理由:作者结合自身近十年主张神经符号世界模型的立场,指出 Astra 的关键未知在鲁棒性与可监控性,判断有具体依据。

  4. -Zho-40

    ZHO 刷了大量 GPT-6 Astra 提前测试案例后评价,其惊艳点在于通过建模/渲染软件实现高质量 3D 建模和渲染,建筑与游戏均适用。作为职业建筑师,他认为这并不惊艳,早在 2023 年就提出 AI 能生成真实照片后就不再需要效果图;如果 GPT-6 真的足够强,应重建全新的工作逻辑和链路,而不是更好地完成旧链路,那才是迈向 AGI 的起点。

  5. François Chollet62

    François Chollet 表示,ARC-AGI-3 于今年 3 月发布时前沿模型得分低于 1%,曾引发部分人质疑基准本身有问题、聪明人类也无法得高分。他称基准校准良好,认真投入的普通人应能得 90% 以上,表现优于其人类基线即可得 100%;AI 在 6 个月内从 <1% 提升到 100%,显示该基准记录了智能体能力的快速上升,这一速度超出包括他们自己在内多数人的预期。

  6. Tessl:产品与工程博客62

    Tessl 提出反馈回路工程:用内、中、外三层循环让项目对智能体更友好

    Tessl 提出反馈回路工程这一实践,把围绕智能体的循环分为内循环(测试、类型、评审)、中循环(维护智能体修复项目本身的状态)和外循环(读取生产信号),认为常被忽略的中循环能改善未来大量变更的条件。

    推荐理由:文章提出反馈回路工程的三层框架,并给出 Tessl 自身维护智能体的运行数据,可作为改进智能体开发环境的可迁移方法。

9月3日周四