消息称长鑫存储计划进军 NAND 闪存市场,将与三星、SK 海力士、美光竞争
据路透社援引三位知情人士报道,长鑫存储计划在北京新工厂建设 NAND 闪存研发生产线,并已就 NAND 业务与客户接洽。TrendForce 数据显示,2026 年第二季度三星以 29.3% 营收份额居全球闪存市场首位;同期长鑫 DRAM 营收达 146.24 亿美元,环比增长 99.3%,市占率从 7.6% 升至 9.5%。
据路透社援引三位知情人士报道,长鑫存储计划在北京新工厂建设 NAND 闪存研发生产线,并已就 NAND 业务与客户接洽。TrendForce 数据显示,2026 年第二季度三星以 29.3% 营收份额居全球闪存市场首位;同期长鑫 DRAM 营收达 146.24 亿美元,环比增长 99.3%,市占率从 7.6% 升至 9.5%。
美光 CEO 高级顾问苏米特·萨达纳在 Six Five Summit 2026 上表示,内存短缺已覆盖所有市场,真正有意义的新增供应要到 2028 年才开始爬坡,供需何时平衡看不到明确时间。
FAA 将推出名为 Smart(Strategic Management of Airspace, Routes and Trajectories)的 AI 空管软件,12 年合同金额 8.75 亿美元。
Figure 的 Helix 2.5 端到端机器人模型在 30 户未见家庭中将零样本家庭任务成功率提升逾六倍,从 9% 升至 56%,且要求整个任务完成、无部分得分。
Anthropic 发布一套测量前沿 AI 开发节奏的指标,覆盖 AI 主导研发、智能体监督和算力分配三方面。
推荐理由:Anthropic 公开测量自身 AI 研发自动化程度、智能体监督和算力分配的方法与数据,读者可以看到前沿实验室透明度报告的一种可复用范式。
新闻集团在诉讼动议中指责 Microsoft 将为 Bing 购买的数据集转售给 OpenAI 作训练数据,且 OpenAI 从受商业限制协议约束的第三方获取含 180 万篇文章的 NYT 数据集并用于训练。原告方引用微软内部文件承认生成式 AI 对训练数据生产者就业存在"真实风险",并主张法院若认定抓取新闻不属于合理使用,可打破各 AI 公司竞相免费搭车的"囚徒困境"。
Tomer Tunguz 撰文分析 Berkeley 本周发表的 HarnessTax 研究:控制 AI Agent 的 harness 系统可在不损失准确率的情况下,将同一结果的成本降低 71%(GPT-5.6 Sol 从 Claude Code 换到 Pi,每解决一个任务成本从 $1.540 降至 $0.441)。
小米团队称 MiMo-V2.6 目前正处于 RL 训练中途,探索 RL 的规模上限。其扩展了三个方向:算力(每步约 2B tokens,1568 prompts × 16 rollouts。
TypeSafe AI 于 9 月 16 日发布 System One 模型 Jev,不生成文本,仅输出 Choice、Score、Noul 三类结构化决策,输入词元定价每百万 0.042 美元,输出词元免费。
据财联社报道,华为副董事长、轮值董事长汪涛 9 月 17 日在上海华为全联接大会上介绍智能时代部署,称华为 AI 战略核心是算力、坚持硬件变现,并以超节点加集群打造算力底座。
零跑在 9 月 16 日技术发布会上公布自研世界模型智能辅助驾驶,称达到全行业第一梯队水平,将覆盖 A 到 D 全系车型。此前内部对智驾 2.0、3.0、4.0 三条路线赛马,4.0 一段式端到端世界模型因综合接管率仅为头部车企三分之一而胜出;4.0 架构成本仅为 1.0 时期的 40%,明年起将面向 35 万辆激光雷达版车型免费升级,2024 款 C16/C11/C10 也可使用。
论文提出 BITCOS,一种由存在位图加压缩符号向量组成的三值 LLM 权重布局,按零密度 z 计成本为 2−z bits per weight。作者实测 29 个三值模型发现零权重占比最高达 51.5%,其中 26 个模型的存储比 five-trit packing 更紧凑,最稀疏模型达 1.485 bits per weight。
Knowledgator Engineering 发布 schema 条件化编码器框架 GLiFormer,单个模型可在推理时按标签和 schema 完成 NER、分类、关系抽取、嵌套 JSON 结构化和文本嵌入。
Rohan Bansal 通过 off-policy 蒸馏 GPT-6 Astra 轨迹和智能体强化学习,将 Qwen 4B 模型训练为查询优化智能体,在 Join Order Benchmark 113 条 join 密集查询上实现 1.81x 几何平均加速和 44.7% 总延迟下降。
Epoch AI 升级其 AI Data Centers 探索器,覆盖从 13 座数据中心(约 15% 全球 AI 算力)扩展到 86 座(约 44%)。每个站点提供卫星影像和 H100 等效算力、芯片类型、资本开支、建设状态等数据;2026 年至今已捕获约 53% 的新部署算力,估算方法与代码已公开。
据 The Information 援引知情人士报道,苹果筹划推出搭载自研芯片的企业级 AI 服务器,基础版配备 2 颗 M8 Ultra 芯片,高配版 4 颗,并考虑采用英伟达 NVLink Fusion 实现芯片互连。
Michael Noukhovitch 发表论文,提出 LLM 强化学习训练中的马太效应,即 RL 提升幅度与模型初始能力成正比,最难的问题(初始 pass@32 为 0)几乎不改进。
TrendForce 集邦咨询发布 AI Server 产业研究,预估 2026 年全球数据中心电力需求容量达 161GW,同比增长约 31%,其中 AI Server 占 33.4%。报告预计 2027 年增速仍超 30%,2030 年需求达 490.7GW,而电网可供容量仅 222.6GW,账面缺口 268GW,其中包含表后自建发电未被计入及并网交付延期两部分因素。
RayOrch提出了一种编程模型和分布式执行引擎,用于解决基础模型训练数据准备中异构文档和视频转换的扩展性问题。它通过保留父子关系、支持有序变量基数扩展及匹配收集,优化GPU批处理效率。在NVIDIA H20 GPU上,RayOrch将MinerU从4卡扩至64卡时加速15.14倍,视频流水线从8卡扩至64卡时加速7.82倍,端到端时间较Ray Data减少13.1%。代码已开源。
LangChain 采用 Baseten Loops 为平台内智能体 LangSmith Engine 训练定制模型,通过微调大型开放权重模型处理读取 GitHub 仓库诊断问题、起草 PR 提示词或代码修改等任务。
《The Information》援引知情人士消息称,字节跳动今年上半年净利润降至 200 亿美元,降幅为个位数百分比,主因是 AI 投入增加;同期营收 1,200 亿美元,同比增长约 30%。公司还扩张 AI 云业务,近期从银行借入约 300 亿美元,创历来最大单笔贷款,或用于支持 AI 投入。
404 Media 披露 OpenAI 内部代号为莉莉计划(Project Lily)的项目,由时薪超 50 美元的提示词审核员查看匿名化后的真实用户聊天记录,评判回复是否切题、是否存在 AI 式话术和谄媚口吻。
推荐理由:报道披露了人工审核流程的运作细节和隐私边界,读者可以据此了解模型优化背后的人力环节与数据风险。
国家网信办通过“网信中国”通报一批执法典型案例,涵盖网页篡改、恶意程序、数据泄露、个人信息违法出境等类别,属地网信办均已责令改正并处罚款或警告。其中两起涉及人工智能:四川某公司小程序因未落实 AI 生成合成内容显式和隐式标识被责令下线,江苏某公司以 API 中转站方式调用大模型接口提供服务但未按规定开展安全评估被警告。
dbt Labs 开源 dbt Charts(Apache 2.0),并用新结构化 YAML 语言将完整交互式仪表盘声明在一个可审计文件中,SQL 声明看什么数据,YAML 包裹声明怎么看,另有 Markdown 承载文字、Jinja 承载变量与宏。
工信部、国家发改委联合印发《电子信息制造业发展“十五五”规划》,提出到 2030 年规模以上企业营业收入突破 30 万亿元、研发投入强度达到 3.5%。规划部署 17 项任务和 9 个专栏,要求提高先进制程能力,突破高端手机核心芯片和 PC 高性能芯片,加强开源鸿蒙等国产操作系统搭载,并推进 RISC-V 研发与产业化。
NanoForecast v0.5 是一个 6.5M 参数的时间序列预测模型,在未改动架构、仅修正训练流程的情况下,与 31 倍参数量的 TimesFM(200M)形成竞争,整体 MASE 从 3.030 降至 1.704,降幅 43.8%。
据《商业内幕》报道,谷歌完成对旧金山 AI 编程初创企业 Mechanize 的人才收购,联合创始人塔迈·贝西罗格鲁自 8 月起加入谷歌 DeepMind,另有十多名工程师一同转投。
作者曾是逆向 ANE Linux 驱动的开发者,三年后重新逆向 M1 上的 Apple Neural Engine,完整测绘其 16 计算核、2048 条 MAC 通道、任务描述符调度和内存层级。
Dwarkesh Patel 与 Zyphra CTO Beren Millidge、Thinking Machines 首席科学家 John Schulman、Baseten 模型训练负责人 Charlie O'Neill 三位研究者对谈递归自我改进(RSI)的前景。
推荐理由:三位一线研究者就递归自我改进的技术瓶颈、蒸馏与RL环境壁垒、参数规模趋势给出具体分歧和可检验预测。
Google 发布 autofinetune 项目,把 autoresearch 的自主研究循环应用到 LLM 后训练(SFT 和 GRPO),使用 Tunix、Gemma、Cloud TPU,由 Antigravity CLI 和 Gemini Flash 3.7 编排。
Nathan Lambert 发布一份开放模型领域精选阅读清单,涵盖基础概念、中美竞争与技术细节三部分。
据《商业内幕》援引 4 名知情人士报道,Meta 调整应用 AI(AAI)部门人员安排,邀请部分非管理岗员工自愿重返管理岗位。AAI 由 Meta 今年设立,约 7000 名员工被调入,部分人调入后不再担任管理职务;此举部分逆转了 Meta 过去一年裁减中层管理人员的方向,此前 Meta 今年已裁员约 10%。
腾讯 Hy 基础模型团队联合新加坡国立大学等机构发布 T1,基于 Qwen3.5-122B-A10B 用强化学习训练终端智能体,在云沙箱中每任务最多执行 300+ 次工具调用,以任务自身验证器给奖励。