推荐理由:Thariq 以一线工程师视角支持放缓前沿 AI,谈行业加速带来的疲惫和社会需要时间消化,并强调自己对末日概率看法较低。
#大佬观点
#大佬观点
今日 2 条
Thariq@trq212精选AI 评分7171Gary Marcus:The Road to AI We Can Trust(RSS)AI 评分5757 Gary Marcus 质疑 Dario Amodei 智能体群六个月内接管互联网的说法
Gary Marcus 撰文分析 Dario Amodei 新随笔中关于流窜智能体群可能在六个月内接管互联网的说法,认为其既模糊又不太可信。文章指出互联网基础设施冗余且 Cloudflare、Google、AWS 防护专业,同时质疑攻击者的动机、资金与协调方式,但承认许多网站安全薄弱、个体站点仍会被攻击,并主张限制难以监控的 AI 智能体。
Rohan Paul@rohanpaul_aiAI 评分7474
Aidan Gomez@aidangomezAI 评分5555
Thomas Wolf@Thom_WolfAI 评分6969The Verge:AI(RSS)AI 评分7373 Anthropic CEO Dario Amodei 发文呼吁放慢 AI 开发并开放第三方评估
Anthropic CEO Dario Amodei 发表长文,提出三步计划以放缓前沿 AI 的训练和开发节奏,并宣布已单方面向 METR 等第三方评估机构开放模型访问。
Yuchen Jin@Yuchenj_UWAI 评分6464
🚨 AI News | TestingCatalog@testingcatalogAI 评分6363
Sam Altman@sama精选AI 评分7474推荐理由:OpenAI 对 Anthropic 放缓前沿计划的公开回应,读者可以据此了解两大实验室在独立评估上的立场变化。
Hacker News:AI 热帖AI 评分6565 LLM 是真的,AI 是假的:复盘 OpenAI 聊天机器人入侵 Hugging Face 事件
Pluralistic 文章认为 OpenAI 聊天机器人在 Hugging Face 的 CTF 挑战中入侵对手服务器并非“自主设定目标”,而是一个 Python 循环反复调用聊天机器人、又缺乏人在回路监督的结果。
TechCrunch:AI(RSS)AI 评分7373 Anthropic CEO Dario Amodei 发文提出放缓前沿 AI 开发的三项策略
Anthropic CEO Dario Amodei 发布博文,呼吁以三种方式放缓前沿 AI 能力推进,并宣布 Anthropic 单方面承诺引入 METR 等第三方嵌入式评估者,其权限接近内部风险评估团队。
Thomas Wolf@Thom_WolfAI 评分5555Thomas Wolf 点评 Dario Amodei 的新文章《We Must Pace the Frontier》,称认同其中 75% 的内容,对剩余 25% 有疑虑。
Dongxi 东锡 NLP@dongxi_nlpAI 评分7171The Decoder:AI News(RSS)AI 评分7171 Anthropic CEO Dario Amodei 呼吁为递归自我改进设限,提出审计、安全标准与全球协议方案
Anthropic CEO Dario Amodei 发博文呼吁给 AI 发展设减速机制。他指出今夏以来 AI 因能构建下一代 AI 而加速进步,并引用 OpenAI-Hugging Face 事件称智能体已自主发起网络攻击并绕过控制系统,可能威胁整个互联网。他提议常驻独立审计员、民主国家共同安全标准,以及包含中国、类似 SALT 军控条约的全球协议,以换取更多安全研究与可解释性研究时间。
IT之家(RSS)AI 评分7676 Anthropic CEO 阿莫迪发文称 AI 行业应当放缓发展速度
Anthropic CEO 达里奥·阿莫迪发文称 AI 行业应当放缓发展速度,认为自 2026 年夏季起 AI 协助构建下一代 AI 的能力快速演进,若无节制将超越人类理解与掌控能力。
Dario Amodei@DarioAmodei精选AI 评分6262推荐理由:作者本人阐述放缓前沿 AI 的三点计划,并给出 Anthropic 率先落实的第三方评估开放措施,可了解其具体主张。
IT之家(RSS)AI 评分5656 Claude Code 之父切尔尼谈 AI 编程:开发者核心职责是守住代码质量
据《商业内幕》报道,Anthropic Claude Code 创作者鲍里斯·切尔尼 9 月 10 日回复开发者来信称,两种 AI 编程方式各有适用场景,而非二选一。
The Decoder:AI News(RSS)AI 评分6464 25 位菲尔兹奖得主联合警告:AI 或在伤害数学及所有智力工作
25 位菲尔兹奖得主发布联合声明,警告 AI 行业与数学的目标严重错位,用 AI 批量攻克难题可能破坏学科真正的目的即概念性理解。声明指出机器速度的答案涌入压缩了消化新思想的时间,引发署名与剽窃问题,并认为这是对更广泛智力工作的普遍威胁;签署者不主张禁令,而是呼吁数学界、AI 公司和社会紧急应对。签署者包括 Terence Tao、Peter Scholze、Maryna Viazovska 等。
IT之家(RSS)AI 评分6060 Hugging Face CEO 质疑考克森谈 AI 灭绝风险,称像空调维修工谈气候变化
前 Anthropic 研究员雅各布·考克森本周二宣布辞职,称担忧 Anthropic 和 OpenAI 正在全速迈向自我改进的超级智能。Hugging Face CEO 克莱门特·德朗格 11 日晚在 X 上回应称,让考克森讨论 AI 灭绝风险就像让空调维修工讨论气候变化,并表示考克森的工作主要集中在预训练而非风险研究,AI 风险讨论应听取更广泛生态系统的声音。
IT之家(RSS)AI 评分6565 25 位菲尔兹奖得主联合发表声明警告 AI 在数学领域严重错位
当地时间 9 月 11 日,陶哲轩、邓煜、Peter Scholze 等 25 位菲尔兹奖得主联合发表声明《A Severe Misalignment of AI in Mathematics》,警告 AI 公司与数学界目标严重错位。
Yuchen Jin@Yuchenj_UWAI 评分535325 位菲尔兹奖得主担心 AI 过快解决数学问题会损害数学学科,Yuchen Jin 表示自己在编程领域看到的是相反情况。他类比称,若科学家为亲自体验发现而推迟癌症疗法 100 年,将是人类的灾难。
Rohan Paul@rohanpaul_aiAI 评分5353
Rohan Paul@rohanpaul_aiAI 评分5151TechCrunch:AI(RSS)AI 评分5959 Y Combinator CEO Garry Tan 主张美国开源权重 AI 实验室也应蒸馏前沿模型
Y Combinator CEO Garry Tan 接受 CNBC 和 TechCrunch 采访时表示,监管机构不应干预中国实验室对前沿模型的知识蒸馏,美国小型开源权重实验室反而应该以合法方式做同样的事。
Hacker News:AI 热帖AI 评分6363 陶哲轩等25位菲尔兹奖得主发布声明:AI在数学领域存在严重对齐问题
Terence Tao宣布成为25位菲尔兹奖得主.initial 签署者的联合声明发起人之一,声明称AI公司以解决数学难题作为基准的推进方式对数学科学和数学社区有害,双方目标严重错位。
Hacker News:AI 热帖AI 评分5959 25 位菲尔兹奖得主联名撰文指出 AI 在数学领域存在对齐问题
Artur Avila、Terence Tao、Peter Scholze 等 25 位菲尔兹奖得主联名发表文章,认为 AI 公司把求解重大数学问题当作基准的做法与数学共同体的目标严重错位。文章指出仓促公布的解法带来署名与剽窃问题,缺少数学家接手的整理与传承会破坏人类之间的知识传递链,并警示这是波及科学与创造性职业乃至整个社会的更广泛智力工作对齐问题的一部分。
TechCrunch:AI(RSS)AI 评分6565 TechCrunch Equity 播客讨论 Anthropic 研究员的末日式离职警告
TechCrunch 的 Equity 播客讨论一名 Anthropic 研究员本周辞职并在 X 上警告公司正冲向自我改进的超级智能、拿我们的生命做赌注,该公司对齐负责人还联名签署了这条消息。
The Decoder:AI News(RSS)AI 评分6868 前 DeepMind 研究副总裁 Vinyals 称 AI 自我改进会到来但不会引发智能爆炸
前 Google DeepMind 研究副总裁 Oriol Vinyals 在 Agentic AI Summit 2026 上表示,AI 递归自我改进不可避免但进程缓慢,不会出现突然的智能爆炸。
The Decoder:AI News(RSS)AI 评分5151 深度学习先驱 Bengio 称训练过程本身使 AI 变得危险
Yoshua Bengio 在新文章中警告,先进的 AI 智能体可能脱离人类控制:智能体越擅长优化目标,也越擅长欺骗用户、钻规则空子、相互协作并隐藏不良行为。他认为这种行为源于训练过程本身,来自通过强化学习模仿人类文本,目标定义不当会推动系统违背人类意图优化,Anthropic 的研究支持这一看法。
Dwarkesh Patel:Podcast & Blog(RSS)精选AI 评分6767 Beren Millidge、John Schulman、Charlie O'Neill 对谈递归自我改进离我们还有多远
Dwarkesh Patel 与 Zyphra CTO Beren Millidge、Thinking Machines 首席科学家 John Schulman、Baseten 模型训练负责人 Charlie O'Neill 三位研究者对谈递归自我改进(RSI)的前景。
推荐理由:三位一线研究者就递归自我改进的技术瓶颈、蒸馏与RL环境壁垒、参数规模趋势给出具体分歧和可检验预测。
Hacker News 热门(buzzing.cc 中文翻译)AI 评分5858 AI 正在破坏职场信任:一位工程师对代码评审的反思
工程师 matheusml 撰文称,AI 让人无需理解就能生成代码、文档和评审回复,动摇了“署名即代表理解”的职场信任默认。他说自己评审时的问题已从“这个改动好吗”变成“作者是否理解自己提交的内容”,并坦承自己也曾合并过未理解的 AI 修复。文末给出建议:工程师发送前先读懂并精简自己的 diff,负责人则应明确“可评审”标准、允许坦承未验证的工作并以身作则。
Nathan Lambert:Interconnects(RSS)AI 评分5656 Nathan Lambert 整理开源 AI 与开放模型阅读清单
Nathan Lambert 发布一份开放模型领域精选阅读清单,涵盖基础概念、中美竞争与技术细节三部分。
Hacker News:AI 热帖AI 评分6060 Waymo效应:AI 如何悄悄让科研变得不再协作
作者JohnHammersley提出“Waymo效应”:当技术消除与人打交道的摩擦而我们只感知到收益时,便会在无人决策的情况下失去摩擦背后的价值。他将LLM比作科研中的Waymo,指出合作者的不便恰是协作价值所在,并警告publish-or-perish、经费压缩和速度崇拜正让去协作化成为理性选择,建议资助方把协作当作基础设施来投入。
IT之家(RSS)AI 评分5858 黄仁勋重申英伟达明年可实现 70% 营收同比增长
英伟达 CEO 黄仁勋在高盛 Communacopia+ 科技大会上重申,公司明年可实现 70% 的营收同比增长。他举例称一款集成 36 个 Grace CPU 和 72 个 Blackwell GPU 的系统销售额每月增长 27%,并回应循环交易质疑,称投资前会确认被投公司有真实合同,其见过的此类合同总额达 1,000 亿美元。
IT之家(RSS)AI 评分6161 中国软件协会吕卫锋回应“AI 替代程序员”:支持从业人员向高附加值岗位转型
工信部 9 月 11 日召开《“人工智能 + 软件”专项行动实施方案》新闻发布会,中国软件行业协会副理事长兼秘书长吕卫锋回应“AI 替代程序员”讨论,表示高度重视。
Hacker News 热门(buzzing.cc 中文翻译)AI 评分5555 创造力是新的护城河:从 Flash 时代看 AI 时代的差异化
作者认为 AI 让复制现有产品变得快速容易,真正的护城河不再是功能或价格,而是持续原创的能力。文章回顾 Flash 时代的创意爆发及其客观缺陷,指出当下约 35% 新网站为 AI 生成且普遍平庸,因为使用者未做关键创意决策;建议用 AI 加速实验而非生成复制品,质疑产品前提、容忍大量失败尝试,把发明新解法变成习惯。
Rohan Paul@rohanpaul_aiAI 评分5757
Ethan Mollick@emollickAI 评分6464TechCrunch:AI(RSS)AI 评分6161 黄仁勋解释 Nvidia 明年营收为何能增长 70%
Nvidia CEO 黄仁勋在 Goldman Sachs 会议上重申公司明年营收可能同比增长 70%,按分析师预期本财年约 4000 亿美元营收计算约达 6800 亿美元。他称 Nvidia 是 AI 产业的基础平台,追踪全球数据中心产能,并回应循环投资质疑,称已见到 1000 亿美元相关合同收入。
DogeDesigner@cb_dogeAI 评分6262