跳到正文

#大佬观点

今日 2 条
9月21日周一
9月20日周日
  1. Hacker News 热门(buzzing.cc 中文翻译)51

    基于对话的 LLM 复制了通灵师的冷读骗术:LLMentalist 效应

    作者提出 LLMentalist 效应,认为聊天机器人给人的智能印象源于通灵师冷读术的同款机制,即主观验证和 Forer 式验证语句,让统计上泛泛的回答显得专为用户而写。文章将通灵骗术的六个步骤逐一映射到聊天机器人场景,并认为 RLHF 无法针对具体事实给出奖励,实际上优化出的是擅长生成验证语句的机械通灵师;作者判断这种错觉是无意造成的,并建议不要将决策和推理交给聊天机器人。

  2. Dan Hendrycks78

    AI安全研究者Dan Hendrycks发布一张对比表格,将10个道德困境(如‘救孩子还是陌生人’‘未来世代是否重要’)分别置于‘功利主义’(∑i w(i))与‘利他主义’(∑i c(i)·w(i))两个框架下评估。表格显示,在多数情境中,功利主义被标记为×(不适用),而利他主义被标记为√(适用),仅在‘陌生人仍重要’等少数情况下两者均适用。该内容源自其个人博客eigenism.org,系对AI伦理设计的思辨性探讨。

    推荐理由:该帖提出了一种可操作的伦理框架,用于指导AI系统如何权衡不同价值——尤其适用于讨论AI对齐与价值观嵌入问题。虽非技术实现,但为从业者提供了清晰的思辨工具,有助于理解为何某些道德直觉(如重视个体而非总量)可能更适配人类社会,从而影响AI决策机制的设计方向。

  3. Hacker News:AI 热帖64

    为什么几乎不应该用 AI 撰写任何实质性文字

    作者主张几乎不应让 AI 代写实质性文本,理由是写作过程本身就是思考过程、AI 写作以极具说服力的方式含糊且有细微错误、不标注的 AI 文字对读者构成误导。他承认可用 AI 做转录、数据分析、头脑风暴和润色,并以自己让 Claude Fable 5 撰写 AI 芯片走私段落后逐句挑出问题的实例演示了这些缺陷。

9月19日周六
  1. The Verge:AI(RSS)53

    Decoder 访谈:前 DOJ 反垄断负责人 Jonathan Kanter 谈 AI 监管与反垄断豁免

    Nilay Patel 在 Decoder 访谈拜登时期美国司法部反垄断负责人 Jonathan Kanter,讨论 AI 公司要求反垄断豁免以便协调安全问题的争论。Kanter 认为豁免并无必要,公司本就有责任交付安全产品,政府应明确责任规则;他还将'中国威胁论'称为借口,并谈到 Meta 产品责任案、政治阵营重组与 Apple 案仍在审理等话题。

  2. IT之家(RSS)55

    英伟达黄仁勋称 2030 年不会是世界末日,反对放缓 AI 发展

    英伟达 CEO 黄仁勋在 CBS《周日早间》节目中表示 2030 年不会是世界末日,反对放缓 AI 发展的呼声。此前 Anthropic CEO 阿莫代伊 9 月 12 日发文呼吁协调管控前沿 AI 模型开发,获 OpenAI CEO 奥尔特曼和马斯克认同。黄仁勋还称 AI 安全与速度可以兼得,冲突是虚假对立,并称在中国没有人谈 AI 末日论。

  3. Hacker News 热门(buzzing.cc 中文翻译)57

    danluu:关掉大脑用 LLM 写代码的 meat proxy 模式走不通

    作者观察到越来越多人在使用 LLM 时关闭大脑、只当 for 循环肉代理,认为这种方式即使在 2026 年 9 月也产不出能用的软件,且员工这样做最终只会让自己被替代。文中用 Dominion 棋类 AI 对比和多个失效案例说明 agent 在分布外任务上表现远逊于合理的人类判断,并引用 Luke Burton、Thomas Dullien 和 Gary Bernhardt 的观点佐证。

  4. Ethan Mollick:One Useful Thing(RSS)63

    Ethan Mollick 谈能力悬差:GPT-6 Astra 与 Fable 5.1 的现有能力远未被用尽

    Ethan Mollick 撰文指出 GPT-6 Astra 和 Fable 5.1 已能可靠完成数周量级的人类工作,但大多数人远未用尽其能力,形成能力悬差。

    推荐理由:作者用自己复刻 Zork 3D 化和重建 Eco 图书馆等实测案例,提出深知识、广知识、品味与能动性四个与 AI 协作的个人优势。

9月18日周五
  1. IT之家(RSS)57

    欧洲业界与政界质疑美国 AI 巨头的开发减速提议

    据路透社 9 月 18 日报道,Dario Amodei、Sam Altman 和马斯克先后警告 AI 风险并主张控制发展节奏,欧洲企业和官员对此明显存疑。Mistral、Proton、Black Forest Labs 等指责此举意在巩固美国巨头市场地位,Hugging Face CEO 也反对放慢,但赞同在企业内部设置独立评估人员。

  2. Hacker News 热门(buzzing.cc 中文翻译)60

    从 Bend 2 看氛围编码的陷阱:重造形式验证已有成果

    作者评论 Bend 2 这种为 AI 编码时代设计的语言:其首页 demo 用 58 行"法则"和 442 行 LLM 证明代码来表达玩家无法获胜的性质。作者让 LLM 无额外指引地在形式验证语言 SPARK 中复刻同一 demo,运行 GNATprove 后全部 12 项检查通过,且无需从零构建长证明。

  3. IT之家(RSS)65

    辛顿警告美国政府:AI 失控前只剩约一年时间出台有效监管

    杰弗里·辛顿 16 日向美国国会议员简报后警告,建立有效 AI 监管的时间只剩大约一年。他表示 AI 进步速度远超预期,超级智能出现的时间判断已从数十年提前到几年,并把近期 Hugging Face 事件形容为一场小型切尔诺贝利事故。上周他还称未来 10 年内 AI 导致人类灭绝的概率约为 10% 并非没有道理。

  4. TechCrunch:AI(RSS)55

    AI 安全之争:是安全问题还是控制权问题

    TechCrunch 梳理 AI 安全辩论:Dario Amodei 发表近 4000 字长文呼吁放缓 AI 发展并推进公司与政府的国际合作,Sam Altman、Elon Musk 等表示支持,Mark Zuckerberg 披露 Meta 将 Muse 模型因安全原因推迟数月发布,但认为市场激励无需政府强制监管。

  5. Hacker News 热门(buzzing.cc 中文翻译)68

    Gowers 撰文解释为何没有签署菲尔兹奖得主联名信

    数学家 Timothy Gowers 发文解释自己未签署 25 位菲尔兹奖得主联名信的原因,称自己在解题与概念理解的关系上持光谱观点,不完全认同信中将概念理解置于解题之上的核心论证。他承认 AI 带来危机,但认为更应担心的是新一代数学家培养和资助等社会结构被破坏而非结果无法消化,并披露自己与 OpenAI 有接触但从未收取报酬。

9月17日周四
  1. Tessl:产品与工程博客55

    Tessl提出用可执行规范解决AI代码审查瓶颈

    Tessl博客指出,AI编码代理导致PR数量激增但审查变慢,核心原因是缺乏对输出结果的信任。文章主张建立“验证层”,将产品意图转化为“可执行规范”。通过拆分规划与验证代理、结合规范与代码进行比对、并在隔离沙箱中运行以规避安全风险,旨在让代理自动检查实现是否符合原始需求,从而提升工程效率。