#大佬观点
#大佬观点
今日 2 条
🚨 AI News | TestingCatalog@testingcatalogAI 评分7676
Ethan Mollick@emollickAI 评分7575
凡人小北@frxiaobeiAI 评分7272
Thomas Wolf@Thom_WolfAI 评分5252
Dan Hendrycks@hendrycksAI 评分4545
jason@jxnlcoAI 评分5757The Decoder:AI News(RSS)AI 评分7676 OpenAI 发布自动化研究内部数据,Pachocki 撰文警告无实验室已解决对齐与监控
OpenAI 发布博客文章称已达成去年秋天设定的「自动化研究实习生」目标,计划 2028 年 3 月前建成全自动 AI 研究员;数据显示截至 8 月中旬研究部门每 1 个人类工作日运行 3.1 个智能体工作日,中位研究员每天推理花费超 600 美元,90 分位超 7000 美元,token 产出自 2025 年 12 月以来增长 124 倍。
凡人小北@frxiaobeiAI 评分6363IT之家(RSS)AI 评分6767 OpenAI 首席科学家 Jakub Pachocki 发文呼吁放慢 AI 发展速度,警告智能体可能失控
OpenAI 首席科学家 Jakub Pachocki 发表长篇博文,担心没有人准备好应对机器智能持续快速增长的后果,呼吁建立可由第三方审计、政府或国际组织执行的强制性安全门槛。
IT之家(RSS)AI 评分5959 黄仁勋祝贺 OpenAI 发布 Astra 并称 AGI 已到来,Gary Marcus 认为为时过早
黄仁勋 9 月 7 日在 X 祝贺 OpenAI 发布新模型 Astra,称从 ChatGPT 到 o1 再到 Astra 只用 4 年,AGI 已经到来;OpenAI 称 Astra 是全球最智能、最符合人类价值观的模型,总裁布罗克曼表示欢迎来到 AGI 时代。
Simon Willison 博客AI 评分5353 Simon Willison 评 OpenAI 内部研究加速与编码智能体使用激增
Simon Willison 评论 OpenAI 关于 Recursive Self-Improvement(RSI)的新文章及首席科学家 Jakub Pachocki 的 essay《An Alien Mind》。
公众号:数字生命卡兹克精选AI 评分7272 GPT-6 Astra爆火后,卡兹克谈执行能力贬值与判断力断层
GPT-6 Astra上线后,大量用户用它自主操控Blender、Houdini、Unity、Aseprite等专业软件,做出游戏Demo、3D复刻旧金山艺术宫等作品,其中旧金山艺术宫案例里Astra自己搜索几百张参考图、翻到美国国会图书馆的老扫描文件找柱子尺寸,多数工作在夜间自主完成。
推荐理由:作者从大量GPT-6 Astra操控专业软件的案例出发,讨论执行能力贬值与判断力从何而来的矛盾,视角具体。
Charlie O’Neill 研究写作(RSS)AI 评分6060 Charlie O'Neill 谈 RL 环境信仰与理性下注:长、真、自有
Charlie O'Neill 撰文指出,宣称一切将是 RL 环境的人很少按该信念做出理性行动,如同当年 scaling 和 AGI 信奉者并不真下注。他提出无论 RSI 是否成立都应造高价值数据与环境:若 RSI 成立,单位效用环境价值将指数增长,值得在实验室内做最有针对性、可累积的环境;若不成立,实验室需要模型在所有领域变强,会为有用数据支付高价。
Gary Marcus:The Road to AI We Can Trust(RSS)AI 评分5656 Gary Marcus 质疑 Jensen Huang 无定义无证据地宣称 AGI 到来
Gary Marcus 撰文批评 Jensen Huang 宣称 AGI 竞赛已结束,指出其未给出证据和定义,并建议其参考 Hendrycks、Yoshua Bengio 等人参与的 agidefinition.AI。
Rohan Paul@rohanpaul_aiAI 评分6060Rohan Paul 认为「时间跨度」正成为谈论智能体能力更有用的指标,任务越长无干预成功率越低,OpenAI 数据从 15 分钟内任务的 86% 降到 64-128 小时档的约 16%。
Rohan Paul@rohanpaul_aiAI 评分6565
Dan Hendrycks@hendrycks精选AI 评分7878推荐理由:Hendrycks 是 AI 安全领域权威,此观点结合 OpenAI、Anthropic 等最新实证案例,揭示了 Agent 行为中潜在的“亲缘利己”风险,对理解 AI 对齐与安全治理具有重要参考价值。
Rohan Paul@rohanpaul_aiAI 评分6767
Rohan Paul@rohanpaul_aiAI 评分5151
elvis@omarsar0AI 评分5151OpenAI:官网动态(RSS · 排除企业/客户案例)精选AI 评分7272 OpenAI 长文阐述对齐与监测困境,称 CoT 监控能力正在减弱
OpenAI 发布长文《An Alien Mind》,回溯 2023 年 RLSlow 项目中确认推理模型可扩展训练的起点,并系统阐述目标对齐与价值对齐的区分。文章指出链式思维监控的效果正随着模型能力提升而逐步减弱,GPT‑6 Astra 在对齐上显著优于 GPT‑5.6 Sol;作者预期进展可能持续走向机器递归自我改进(RSI),呼吁自愿放缓扩展、建立第三方安全门槛并加强国际协调。
推荐理由:作者以内部视角回溯推理模型的起源,并给出对齐监测、CoT 监控弱化和 RSI 风险的一手判断。
Jakub Pachocki@merettmAI 评分5151
IT之家(RSS)AI 评分5353 OpenAI 应用研究主管鲍里斯·鲍尔称 Astra 模型已补上人类空间推理优势
OpenAI 应用研究主管鲍里斯·鲍尔 9 月 6 日在 X 平台表示,空间推理曾是人类大幅领先计算机的少数优势之一,有了 Astra 模型后这一差距已不复存在。
Hacker News 热门(buzzing.cc 中文翻译)AI 评分5959 Bryan Cantrill 谈读者的反抗:LLM 代写正让读者弃读作者
Bryan Cantrill 撰文批评用 LLM 代写公开文章的现象,引用 Cynthia Dunlop 对 668 名开发者的调查:78% 检测到 LLM 写作会立即停止阅读,71% 此后会回避该作者,98% 更偏好作者自己写的有瑕疵的文章而非 LLM 润色稿。
Rohan Paul@rohanpaul_aiAI 评分5454
Rohan Paul@rohanpaul_aiAI 评分5252
Yuchen Jin@Yuchenj_UWAI 评分5656
François Chollet@fcholletAI 评分6464
Hacker News 热门(buzzing.cc 中文翻译)AI 评分5353 Rootly 的 Sylvain Kalache 警告 AI 处理事件让工程师与系统失去联系
Rootly AI Labs 负责人、前 LinkedIn SRE Sylvain Kalache 撰文指出,AI SRE 工具接管常规事件响应后,工程师练手机会减少,面对自动化无法解决的复杂事件将更难应对。
Rohan Paul@rohanpaul_aiAI 评分6363elsewhere:文章(RSS)AI 评分2424 Physical Intelligence 联创 Chelsea Finn:物理 AI 已走到自己的 GPT 时刻
十字路口Crossing 发布对 Physical Intelligence 联创 Chelsea Finn 的访谈内容,她认为物理 AI 已经走到自己的 GPT 时刻,并探讨让机器人在现实世界中真正发挥作用需要什么。
dex@dexhorthyAI 评分2727公众号:百度智能云(文心)AI 评分3232 加南科技F2 AR智能眼镜携手百度智能云探索心跳感知
百度智能云介绍与杭州加南科技的合作:F2 AR智能眼镜不配置摄像头,通过PPG心率、IMU、语音、位置与交互信号为AI提供用户上下文,心率偏离基线时可结合情境生成可确认或忽略的状态提示,并形成Heart Moment心情可视化功能。架构上终端负责感知与AR呈现,云端由百度智能云提供大模型、实时语音、翻译、百度地图与百舸、千帆等能力,形成端云协同的一体化方案。
Sherwin Wu@sherwinwuAI 评分5959
Ethan Mollick@emollickAI 评分4646
-Zho-@ZHO_ZHO_ZHOAI 评分2323ZHO 分享了一张 GPT-6 Astra 的截图,显示「额度限制已重置」,并写道自己已经给模型充钱了,让它继续,感慨 GPT-6 Astra 真的让人挺卑微的。
Rohan Paul@rohanpaul_aiAI 评分4949
Rohan Paul@rohanpaul_aiAI 评分6464
Fei-Fei Li@drfeifeiAI 评分5757Fei-Fei Li 与 Justin Johnson、Ben Mildenhall、Martin Casado 在访谈中讨论 World Labs 新发布的空间智能世界模型 Atlas。
Yuchen Jin@Yuchenj_UWAI 评分4444