跳到正文

#DeepMind

今日 0 条
10月3日周六
10月2日周五
  1. MIT Technology Review · AI38

    别被迷惑:LLM 并不会真正推理

    前 Google DeepMind 研究员指出,LLM 的思维链并非真正的推理机制,它仍由同一个 next-token 预测过程迭代生成,只是延长了作答前的计算。文章认为当前模型存在三大缺陷:没有显式、持久、可检查的认知状态,知识与推理在神经网络权重中纠缠不清,且思维链常是事后编造。作者主张借鉴 AlphaGo 的搜索架构,为机器推理引入独立的推理机制。

9月18日周五
9月15日周二
  1. Hacker News 热门(buzzing.cc 中文翻译)57

    Daniel Litt 长文展望 AI 时代数学实践:从证明定理转向人类理解

    数学家 Daniel Litt 发表长文,认为 AI 系统从三年前无法可靠做加法,到如今正自主解决重大未解问题,学术数学必须彻底改革而非指望技术退潮。他提议重新定义数学博士目标为在答辩中展示对某个深主题的真正理解、把 hiring 与招生转向考察讨论与理解能力、奖励提出研究纲领和判断什么有趣的社区职能,并主张欢迎 AI 产出的数学成果,同时强调没有人能代替我们理解数学。

9月13日周日
9月10日周四
9月3日周四