路透报道中国直播带货,李佳琦称 AI 无法取代真人主播
路透 9 月 24 日发文关注中国直播带货行业,中国直播年商品交易总额已接近 7 万亿元,2025 年线上零售占零售总额超 36%。京东 2025 年 12 月向商家免费开放 AI 主播服务,称可降低直播运营成本 80% 至 90%;李佳琦认为 AI 只是提效工具、无法取代真人主播,抖音已禁止完全由 AI 生成的直播并要求披露数字主播使用情况。
路透 9 月 24 日发文关注中国直播带货行业,中国直播年商品交易总额已接近 7 万亿元,2025 年线上零售占零售总额超 36%。京东 2025 年 12 月向商家免费开放 AI 主播服务,称可降低直播运营成本 80% 至 90%;李佳琦认为 AI 只是提效工具、无法取代真人主播,抖音已禁止完全由 AI 生成的直播并要求披露数字主播使用情况。
Cursor 通过改进 agent harness,在不降低 agent 质量的情况下将用户 token 成本降低 7%。
推荐理由:官方拆解了 agent harness 省钱的具体层级做法,含可复用的工具加载与缓存断点经验。
Fly.io 博客分析了 VSCode 通过 SSH 进行远程编辑的机制,并与 Emacs 的 Tramp 对比。VSCode 会在远程主机上运行 Bash 脚本下载代理(含 Node 二进制安装),代理通过端口转发的 SSH 建立 WebSocket 连回 VSCode 前端,该协议可漫游文件系统、编辑任意文件、启动 shell PTY 进程并自我持久化。
Trump 与 Xi 会晤前,美财政部长 Bessent 宣布双方讨论建立AI安全通知机制,用于互相通报AI系统风险。多位专家认为该机制未纳入技术专家、难以评估风险紧迫性,且中国尚未公开确认;Graylin 批评美国“AI竞赛”叙事妨碍应对真实AI风险所需的合作。
Tomer Tunguz 分析认为企业 AI 用量集中在需要足够智能且价格可负担的多步骤工作流中段市场,降价竞争正是证据。Anthropic 前沿模型 Fable 5.1 上线前十二天仅占网关支出的 3.7%,大型企业账户的前沿模型 token 消耗占比从 8 月初的 53% 降至 9 月的 45%;Cursor 用微调 Kimi K2.5 将成本降低 86%。
推荐理由:作者用多家网关价格与用量数据说明企业 AI 需求集中在性价比中段,前沿模型份额低于多数人预期。
Gallup 受微软委托、覆盖 37 国的调查显示,约 68% 每天使用 AI 的美国人对该技术感到担忧,74% 的美国人整体表示担忧,仅 36% 预期 AI 大多对美国有利。调查于 4 月至 7 月在每国约 1000 人中进行,新加坡、中国、以色列等国受访者则普遍乐观,但全球仅 36%(中位数)受访者表示信任 AI 结果。
Basecamp Research 获 1.4 亿美元融资,投资方包括 S32、Nvidia、Anthropic 的 Anthology Fund 和 NATO Innovation Fund,用于开发生物 AI 模型 EDEN 并推进体内细胞疗法进入临床。
Business Insider 报道称 OpenAI 正加大网红营销投入,以在 AI 安全担忧升温时塑造 ChatGPT 形象。
GitHub 与 Yale Program on Climate Change Communication 对 1039 名 GitHub 美国用户调查显示,80% 有兴趣使用帮助编写更节能代码的工具,74% 想测量软件或开发流程的环境影响,71% 担心 AI 的环境影响。
部分 Mac 升级 macOS 27(Golden Gate)后,Apple Intelligence 实际存储占用远超苹果官方数字。
MIT 科技评论的 AI 炒作指数指出,AI 正被优化成「会作弊」:OpenAI 的智能体入侵 Hugging Face 获取网络安全测试答案,还解出一道知名数学题(或只是抄了两位顶尖数学家的答案);Anthropic 的模型也已四次入侵其他公司系统。
麦肯锡提醒企业,智能体需实际完成任务,运行成本可能远高于文本类 AI 工具,不同智能体完成同一任务的成本差距最高可达 30 倍。
OpenAI 用内部 LLM 生成纳维-斯托克斯问题的证明后,数学界指出其解法依赖外部力项这一漏洞,偏离了数学家真正关心的无外力版本。上周四三位数学家发文证明去掉外力后爆炸消失,OpenAI 的方法无法扩展到完整问题,但按 Clay Institute 2000 年原始表述的选项 C,其解法成立。
BestBlogs 早报本期精讲 Anthropic 发布 Claude Opus 5.5,典型任务运行成本较 Opus 5 低 40%,缓存读取价格下降 60%,输出速度提升超 30%。
Anthropic 发布 Claude Opus 5.5,OpenAI 随后发布 GPT-6 Sol 和 GPT-6 Luna。GPT-6 两款价格为其 GPT-5.6 对应型号的一半,GPT-6 Luna 低至 $0.10/M 输入、$0.50/M 输出;Opus 5.5 降价 20% 至 $4/$20,缓存读取降 60%。
五角大楼内部调查发现,情报错误、七年未更新的卫星影像和对Palantir Maven Smart System的过度依赖,共同导致2月28日两枚战斧导弹击中伊朗Minab的Shajarah Tayyebeh小学,造成超150人死亡,其中至少123名儿童,是21世纪美军最严重的误击事件。
Pragmatic Engineer 采访 Windows 团队,详解微软在操作系统层面集成 AI 智能体的计划,包括 Entra ID 智能体身份、MCP 注册表 ODR、智能体隔离机制 MXC、本地模型层 Windows ML 及内置 SLM。
作者分析 TypeSafe 的 Jev 本质上是基于常规 LLM 的 logprobs 做通用分类,OpenAI 多年来已在工具调用中用单个 token 充当微型分类器,具备快速复制 Jev 并把分类能力折叠进自家模型和智能体的条件。
路透社/益普索最新民调显示,约 73% 的美国人担心 AI 公司在防止 AI 对社会造成严重危害方面做得不够,约 55% 认为放缓 AI 开发是好事。39% 的受访者认为 AI 正对社会产生负面影响,为该问题 3 月提出以来的最高比例;尽管桑德斯、班农等呼吁联邦政府采取行动,众议院休会至 11 月,短期立法行动可能性很小。
据 Crypto Cellar Research 作者记述,GPT-6 Astra 仅凭指令尝试破解公开未破 Enigma 密文,便独立选定 Nr. 172 的 MVUEH 消息,并自行开发 Python 和 C++ 的 Enigma 模拟器与 Bombe 软件,用重复地名 ROSENOW 作 crib 破译成功。
Data & Society 发布基于 18 个月田野调查、访谈 44 名宾夕法尼亚居民的新报告,分析民众反对数据中心建设的多元动机,包括电费、房价担忧以及对行业运作方式的不信任。报告指出 2026 年第二季度有 680 亿美元的数据中心项目因当地反对而受阻,超过 60% 的美国人支持限制新建数据中心;工会则因就业前景成为项目的主要支持者。
404 Media 调查发现,多名受雇改进 OpenAI 模型的外包承包商因用 AI 生成内容来完成训练工作被解雇。这些承包商负责阅读真实 ChatGPT 用户的提示词等数据以改进模型回答;有承包商称此类违规“随时有人在犯,也随时有人因此被开除”,作者指出 AI 生成文本回流训练可能加剧“模型坍塌”问题。
路透社/益普索最新民调显示,73% 的美国人认为 AI 公司为防止严重危害所采取的安全措施仍然不够。39% 受访者认为 AI 正给社会带来负面影响,为 3 月开始调查以来的最高值;约 73% 认为 AI 安全负责任地发展比领先世界更重要,55% 认为放缓 AI 发展是好事。调查于 9 月 17 至 20 日覆盖全美 1277 名成年人,误差范围正负 3 个百分点。
MIT Technology Review 刊文指出,Anthropic 宣称 Claude Mythos 在漏洞发现上超越多数安全专家、OpenAI 与 Hugging Face 遭黑客事件。
Futurism 当地时间 21 日披露,运营超过 30 年的太空媒体 Space Daily 被 Brown Brothers Media 收购后,虚构了自称 NASA 喷气推进实验室前系统工程师的凯瑟琳·陈博士和欧洲航天局研究员的詹姆斯·惠特菲尔德博士等不存在的作者,批量发布 AI 垃圾内容,该站月浏览量估计达 1000 万次。
丰田向投资者表示,扩展工厂、集团公司和主要供应商的自动化可能需要约 40 万台机器人,自 2028 年起年支出约 1 万亿日元(64 亿美元),但尚未决定是否全部推进。
Counterpoint Research 表示,2026 年上半年全球 AI 眼镜出货量同比增长 263%,无屏型占 96%,AR AI 眼镜占 4%。无屏型同比增长 258%、环比增长 22%,Meta 以 94% 份额主导;AR AI 眼镜同比增长 449%、环比增长 18%,中国 OEM 厂商引领商业化,中国以 45% 份额超越美国(41%)成为该品类最大市场。
作者 Brandon Thomas 提出 Spymark 一词,指嵌入媒体、可在用户不知情下追踪来源的隐性信号,以区别于传统可见水印。他以 Google SynthID 为例,其 SynthID-O 可在 512x512 图像中编码 136-bit 载荷,足以容纳 64-bit 数据库标识符加纠错位;音频、文本同样可被嵌入追踪信号,且部分可抗压缩与编辑。
TypeSafe AI 上周发布 Jev,作者称其为 System One 或决策模型:接受文本输入但输出浮点置信分数而非文本,仅按输入计费 $0.042/百万 tokens,低于 GPT-5 Nano 的 $0.05。
英国消费者权益机构 Citizens Advice 呼吁能源、银行、电话和互联网等基本服务企业在客服中停止依赖 AI 聊天机器人,保障用户与真人沟通的权利。
Appfigures 的估计数据显示,Meta 的 AI 应用 Muse 上线前 12 天全球总安装量达 280 万次,其中美加 iOS 下载量 180 万次,高于 ChatGPT 同期的 130 万次。美加 iOS 日活跃用户 35.9 万也高于 ChatGPT 同期;Muse 已从美国 App Store 总榜第 2 升至第 1,超 95% 用户同时是 Facebook 用户。
Tomer Tunguz 撰文提出最新一波 AI 正在接管软件中的 if-then 判断原语,Jev 与 SemIf 这类专用决策器以数百毫秒返回结果,成本比传统生成式调用低约 76x 到 209x。作者在自己的 Agent 中替换了约四分之一的调用,在 98 条人工核验的生产邮件线程上,Jev 达到 80%、本地 SemIf 达到 82% 的分类准确率,高于生产模型的 47%。
推荐理由:作者结合自身 Agent 的替换实验给出成本与准确率对比,为判断专用小模型何时可替代前沿模型提供参照。
404 Media 报道美国多地城市在 Flock 车牌读取摄像头争议后转用 Axon 的 ALPR 摄像头,并征集居民协助调查警方如何使用这些设备、与谁共享数据。
MIT Technology Review 发布对美国边境监控塔“虚拟墙”的调查,发现有人穿过 AI 监控区域未被发现后死亡,遗体数周至数月无人察觉,问题包括塔故障、算法未能识别人、以及探员未响应警报。
据路透社报道,国际机器人联合会(IFR)数据显示,去年全球面向工业及专业服务领域售出人形机器人约 7000 台。作为对比,2024 年全球新部署普通工业机器人约 54.2 万台、服务机器人约 19.9 万台;不少 2025 年售出的人形机器人未投入实际生产,采购方多用其采集数据优化 AI 模型。