Desert Ant Labs 发布 18 个可在设备上运行的专用小模型
欧洲 AI 实验室 Desert Ant Labs 正式成立并上线首批 18 个端侧专用模型(12 个稳定版、6 个 beta),覆盖音频、视觉和文本任务,通过 Swift、Kotlin 和 JavaScript 的统一 SDK 提供,在 GitHub 和 Hugging Face 开放。
欧洲 AI 实验室 Desert Ant Labs 正式成立并上线首批 18 个端侧专用模型(12 个稳定版、6 个 beta),覆盖音频、视觉和文本任务,通过 Swift、Kotlin 和 JavaScript 的统一 SDK 提供,在 GitHub 和 Hugging Face 开放。
Vercel Labs 发布实验性语法高亮工具 gpu-lexer,用 27.4KB 的 WebGPU 模型对任意语言源码做 token 标注,无需按语言选择语法。在 5.56M 字符输入上高亮耗时 402ms,快于 Prism.js 和 Shiki;在留出文件上与 Shiki 的标注一致率为 88.02%,Top-25 加权一致率 90.35%,作者强调这是实验而非语法等价的高亮器。
燧原科技公告,公司股票将于 2026 年 9 月 11 日在上海证券交易所科创板上市,公司尚未盈利,上市后纳入科创成长层。燧原科技与摩尔线程、沐曦股份和壁仞科技并称国产 GPU 四小龙,自研迭代四代架构 5 款云端 AI 芯片;招股书显示拟募资 61.19 亿元,用于第五代和第六代 AI 芯片研发及产业化与软硬件协同创新项目。
面壁智能联合 OpenBMB 开源 2B 端侧基座模型 MiniCPM5-2B,在 AA 榜单获 23 分,居全球 4B 以下开源基座模型第一,Agentic Index 达 20 分,同级模型如 LFM2.5-2.6B、Granite 4.2 3B、Mistral 3 3B 仅 2 分。
作者发布一个基于 Transformers.js 的 LLM 注意力可视化工具,可悬停查看生成 token 依赖的历史 token,代码开在 GitHub。可视化将所有层、所有注意力头的注意力权重乘以 value 向量模长后聚合为单一数值控制透明度,并预生成提示词避免下载数百 MB 模型;作者还通过修改 onnx 文件暴露内部值,上传到自己的 Hugging Face 仓库供浏览器生成使用。
作者实测 Qwen3.8 27B 各档 Unsloth 量化(GGUF)在 GPQA Diamond、IFBench 和 Terminal-Bench 2.1 上的表现。
据 Bloomberg 报道,三星计划 2028 年起将 ASML High-NA EUV 用于量产,TSMC 计划 2030 年,Intel 已在运行,单台机器成本高达 4 亿美元;四家公司还计划将光掩膜从六英寸转向十二英寸,ASML 技术负责人称可提升 High-NA 产能 40%,TSMC 与 ASML 计划 2031 年建测试线、2033 年投产。
微软 Windows 与设备销售企业副总裁 Mark Linton 在 IFA 2026 上提出新愿景,让每张办公桌、每个家庭都拥有不受限制的智能,即本地运行日常 AI 模型、云端只留给复杂任务。
华为 Mate XT 2 三折叠手机发布,首发麒麟 9050 Pro 芯片,19999 元起,整机性能较上一代提升 42%。据央视财经报道,该芯片为首款逻辑折叠 τ 芯片,在上下两层裸芯片间形成高密度垂直互联,以麒麟 2026 芯片为例两层间约 5000 万个连接、其中约 500 万到 1000 万个用于信号通信,远高于 3D 封装几万至几十万的量级。
OpenBMB 发布 MiniCPM5 端侧模型,采用 Apache 2.0 协议,1B 与 2B 版本支持 128K 上下文、编码、推理和智能体工具调用。
9 月 8 日,面壁智能联合 OpenBMB 开源 2B 端侧基座模型 MiniCPM5-2B,支持工具调用、深度搜索、代码生成。
微信支付上线智能眼镜 SDK,将扫一扫支付能力封装后向符合标准的智能眼镜厂商开放,Rokid 乐奇 AI 眼镜为首款适配产品。用户需先在厂商 App 开通并验证支付密码,日常付款分唤起、扫码、滑动镜腿确认、语音播报四步,基础版每日限额 200 元,具备虹膜或指纹等身份识别的设备可享更高额度。SDK 目前处于 Beta 阶段,仅支持扫描收款码付款,暂不支持小程序码、加好友等场景。
Arm 在上海 Arm Everywhere China 活动上发布第二代移动终端计算子系统 CSS for Mobile 2,集成 Arm C2 CPU 集群、Mali G2-Ultra NX GPU 和 SI L2 系统互连,面向智能体 AI 与 AI 原生图形。
OpenBMB 发布 MiniCPM5 系列第二个 checkpoint MiniCPM5-2B,2.52B 稠密模型,原生 131,072 token 上下文,Apache 2.0 权重,采用标准 LlamaForCausalLM 架构,可通过 vLLM、SGLang、llama.cpp、Ollama 等主流引擎直接运行。
燧原科技公布科创板 IPO 发行结果,发行价 142.18 元/股,发行数量 4,303.5173 万股,回拨后网下发行 2,409.9639 万股、网上发行 1,032.85 万股,网上最终中签率 0.02455315%,中签号共 20,657 个,每个中签号可认购 500 股。
华为在全场景新品发布会正式发布鸿蒙 HarmonyOS 7 操作系统,即日起开启公测。新系统采用空间美学设计语言,锁屏新增 3D 空间壁纸与空间时钟,通知中心和文件夹引入液态玻璃。
据 Windows Latest 报道,微软在 IFA 2026 上由 Windows 与设备部门企业副总裁 Mark Linton 提出 unmetered intelligence(无计量智能)概念,希望把原本依赖云端 OpenAI、Claude 等服务的日常 AI 工作转移到用户 PC 本地运行,改变 token 的经济模式,同时云端 AI 仍是体系的重要部分。
Nous Research 在 Hermes Desktop 中将本地模型安装简化为一次点击。应用会读取用户硬件,对照 GPU 对模型目录做适配检查,挑选能装下的最高质量版本并下载,然后自动配置 llama.cpp,同时保证 4-bit 量化下限和 64K 最小上下文窗口。
9 月 3 日,HTC 为 AI 智能眼镜 VIVE Eagle 新增圆框款式并升级软件功能,同时登陆欧洲、北美和澳大利亚市场。高级副总裁黄昭颖在采访中表示,智能手机已很难找到新的创新突破,U24 Pro 预计今年底逐步进入产品周期尾声,资源将转向 AI 眼镜;若未来出现新的突破技术仍可能重新评估手机业务。据报道,VIVE Eagle 自 2025 年推出后,该品类今年营收规模已超越智能手机。
百度智能云介绍与杭州加南科技的合作:F2 AR智能眼镜不配置摄像头,通过PPG心率、IMU、语音、位置与交互信号为AI提供用户上下文,心率偏离基线时可结合情境生成可确认或忽略的状态提示,并形成Heart Moment心情可视化功能。架构上终端负责感知与AR呈现,云端由百度智能云提供大模型、实时语音、翻译、百度地图与百舸、千帆等能力,形成端云协同的一体化方案。
七彩虹为灵创 K16 游戏本新增 128GB RAM + 4TB SSD 版本,定价 39999 元。
IT之家发布 9 月 5 日科技早报,汇总多条行业动态。华为工程师何庭波在 ChinaXiv 发表预印本论文,披露 τ(韬)定律底层原理并给出麒麟 2026 芯片晶体管密度提升 55% 的实测数据;另有消息称月之暗面最早年内赴港 IPO,拟融资 30 亿至 50 亿美元。
彭博社 Mark Gurman 爆料,苹果可能于 2027 年推出家庭安防系统及配套监控服务。摄像头主打隐私保护,不直接记录和分析实际视频,计划用 AI 监测环境,配备面部识别和红外传感器以识别房间内人员,实现如人离开自动关灯、播放家庭成员喜欢的音乐等智能家居自动化。
据 Bloomberg 报道,DeepSeek 计划在内蒙古数据中心部署至少 160,000 颗华为下一代 Ascend-950DT 芯片,仅用于推理,训练仍依赖 Nvidia 硬件。若建成将是已知最大的华为芯片集群;华为受产能和内存短缺限制,可能一年以上才能完成交付。中国内存厂商 CXMT 开始小批量生产 HBM3E,但仍落后三星、SK Hynix 和 Micron 三到五年。
华为工程师何庭波在 ChinaXiv 发布预印本论文《Huawei's τ Chip Was Supposed to Melt?》,披露 τ(韬)缩放定律原理及麒麟 2026 实测数据。
Unsloth 宣布通过优化解码和新增 MTP 支持,让 GLM-5.3-Flash 的本地 GGUF 推理提速 1.6 至 3.4 倍,长上下文下最高达 3.3 倍。
推荐理由:原文给出本地运行 GLM-5.3-Flash 的具体加速倍数、显存需求表和现成 GGUF 资源,方法可直接复用。
博主 @数码闲聊站 爆料,某国产芯片官方数据显示 3.1GHz 主频下 GB6 单核跑分 2084,较前代提升 12.4%;新架构在同等性能下大幅压低电压,功耗显著降低。博主未披露具体型号,网友推测为华为麒麟 9050 系列。另有博主称华为 Mate XT 2 非凡大师将搭载麒麟 9050 Pro 处理器。
Ugreen 在 IFA 展会发布 HomeAgent 智能家居平台,将 NAS、监控 NVR 和端侧 AI 整合到一个中枢中,由语音助手 Uliya 管理,宣称数据全部本地处理、无月费。
AMD 高级副总裁 Jack Huynh 在 IFA 2026 上公布 Threadripper Halo Station 工作站,定位个人超级计算机,支持参数超 1T 的大模型本地运行。
群联 CEO 潘健成表示,Flash 原厂直言明年缺口规模不明,NAND Flash 供给持续吃紧,竞争关键在于谁有能力拿到更多资源。他认为 AI 带动的半导体需求才刚开始,对产能的消耗可能延续二、三十年,存储器扩产不会在一两年内导致供过于求;近期价格涨势放缓反而有利于产业长期发展。
据韩媒 ETNEWS 报道,美光 HBM 晶圆月度投片量有望从 2025 年底的 4~5 万片提升至今年底的 10 万片,一年内翻倍。扩产重点是服务 NVIDIA Rubin GPU 等 AI XPU 的 12Hi HBM4,其占比预计从 2026 年初的 20~30% 升至 2026 年末的 50%;业界预计 SK 海力士、三星 HBM 月产能约 15~20 万片。
Nvidia 发布开源工具 PAIR(Personal AI Router)测试版,可在家庭网络设备间自动分配本地 AI 请求,充当 Ollama、LM Studio 等工具与各机器之间的虚拟路由,无需改动现有智能体或应用。