OpenJev 推出纯浏览器本地决策实验,对比直读概率与逐 token 生成 JSON
OpenJev 是一个纯浏览器、无后端的本地实验站点,用户可在自己的 GPU 上加载模型,对比两种决策方式:直接读取选项 logits 并归一化,或让模型逐 token 写出 JSON 概率分布,并用 performance.now() 实测各阶段耗时。
OpenJev 是一个纯浏览器、无后端的本地实验站点,用户可在自己的 GPU 上加载模型,对比两种决策方式:直接读取选项 logits 并归一化,或让模型逐 token 写出 JSON 概率分布,并用 performance.now() 实测各阶段耗时。
PrismML 宣布推出三值量化版本的 Bonsai 2 27B,基础模型升级至 Qwen3.8 27B,以不到 1/9 的内存占用在综合基准测试中达到基础模型 98.2% 的分数,整体表现好于 Qwen3.6 27B。
台积电暌违 3 年决定重返龙潭设厂,新竹科学园区龙潭园区扩建计划草案已获审议通过。扩建约 104 公顷、开发经费约 956.28 亿元新台币,龙科三期优先锁定 1.4 纳米(A14)以下埃米世代先进制程,初步规划三座晶圆厂,首座厂目标 2030 年前后完工,整体投资规模估计超 1 万亿新台币。龙潭并非 A14 首批量产基地,但可能承接 AI 需求放大后的第二波产能扩张。
PrismML 发布 Ternary Bonsai 2 27B,基于 Qwen3.8 27B,采用三值权重加 FP16 分组缩放,有效每权重 1.76 bit,模型体积 5.9GB,比全精度模型小 9 倍以上,基准综合得分 83.9,保留全精度模型 98.2% 的性能。
AI 实验室 PrismML 发布 Bonsai 2 27B,将阿里开源模型 Qwen3.8 27B 压缩到 5.9 GB,内存较原版减少 9 到 10 倍,可放进 PC 甚至高端智能手机。
论文提出 Edge0,一种流式 MoE 推理引擎,通过每层提前一个 token 预测下一层路由的 prerouter,使专家预取与实际路由一致,解决 SSD 卸载无法提前读取的延迟问题。
浙江大学等高校的外部研究者以 MiniCPM-o 4.5 为基座后训练,开源了端到端全模态交互智能体 Gander,论文、数据、代码和模型全部开放。
零跑在 9 月 16 日技术发布会上公布自研世界模型智能辅助驾驶,称达到全行业第一梯队水平,将覆盖 A 到 D 全系车型。此前内部对智驾 2.0、3.0、4.0 三条路线赛马,4.0 一段式端到端世界模型因综合接管率仅为头部车企三分之一而胜出;4.0 架构成本仅为 1.0 时期的 40%,明年起将面向 35 万辆激光雷达版车型免费升级,2024 款 C16/C11/C10 也可使用。
搭载豆包手机助手消费者版的努比亚NaviX Ultra正式开售,12+512GB定价5999元,国补后5499元。作者实测发现AI键新增指纹鉴权,涉及私人信息或手机操作时验证机主身份;复杂长程任务、记忆、快捷指令和屏幕内容理解能力均升级,并新增SAEP屏幕自动化操作声明协议,第三方App可自行选择是否允许豆包助手进行GUI操作,目前免费额度有限且生态主要支持系统、字节系及部分已接入的第三方应用。
vivo 在 2026 开发者大会上发布四款蓝心大模型,包括端到端 MoE 架构的 BlueLM-RealTime、30 亿参数的 BlueLM-Nano 和搭载自研 Agentic 引擎的 BlueLM-Flash / Pro。同时推出系统级蓝心 Harness,深入原系统内核层,已增加 6000 多项原子技能,支持超万种任务,并预研蓝心 30B MoE 端侧大模型。
GraafHenk 发布开源项目 WangNet,一个 80,804 参数的小型神经网络,用于判定输入是否为 Numberwang。模型为 1.8 MB JSON 文件,推理代码约 100 行纯 Python 标准库实现,无需 PyTorch 或 NumPy,仅要求 Python 3.8+。
据彭博社报道,Meta 计划明年上半年在数据中心部署新一代自研 AI 芯片,以降低运行 AI 模型的成本和能耗。目前正测试第三代产品 MTIA 450(代号 Arke),下一代 MTIA 500(代号 Astrid)预计约一个月后完成设计,2027 年底进入数据中心;Meta 计划 12 个月内部署超 1GW 规模自研芯片。
Apple 发布 2026 年度系统更新,包括 iOS 27、macOS 27 Golden Gate、watchOS 27、visionOS 27 和 tvOS 27。
Apple 发布新一代 Apple Intelligence,推出全面重构的 Siri AI,支持个人语境理解、屏幕感知、系统级应用操作和跨设备对话,今日起以英文测试版随 2027 系统更新推出,下月扩展至法语、日语、韩语、葡萄牙语和西班牙语。
推荐理由:官方公告完整列出 Siri AI 的能力清单、设备与语言范围,以及欧盟和中国市场暂不可用等限制,读者可据此评估适用性。
SemiAnalysis 长文分析通用机器人模型的智能应放在机器人本体还是数据中心。受实时性和单机成本约束,当前机器人模型仍为数十亿参数级,如 Physical Intelligence 的 π0 约 3B。
Perplexity 在兼容的 NVIDIA GeForce RTX PC 和 RTX PRO Workstation 上推出 Windows 版 Portable Computer,这是 Perplexity Computer 的本地版本,可规划并执行多步任务,敏感数据留在设备上且本地任务不消耗云端 credits。
Perplexity 的本地智能体平台 Portable Computer 在 Windows 版客户端上线,面向搭载英伟达 GeForce RTX 显卡的兼容 PC 和 RTX PRO 专业工作站开放。
特斯拉 AI 副总裁 Ashok Elluswamy 表示,Robotaxi 将搭载 FSD v15,商业化车队预计 10 月投入部署,下一代 FSD 架构上线后实现 24 小时不间断载人运营。
IT之家援引 MacRumors 汇总 iOS 27 的 8 项主要改进,系统正式版将于北京时间 9 月 15 日凌晨 1 点推送。核心是类似 ChatGPT 的 Siri AI,可调用个人信息、识别屏幕内容并在应用内执行操作,但仅支持 iPhone 15 Pro 及更新机型,初期仅英语且每日限次。
作者曾是逆向 ANE Linux 驱动的开发者,三年后重新逆向 M1 上的 Apple Neural Engine,完整测绘其 16 计算核、2048 条 MAC 通道、任务描述符调度和内存层级。
Arm 于 9 月 8 日在上海 Arm Everywhere China 大会发布第二代移动计算子系统 CSS for Mobile 2,集成 C2 CPU 集群、Mali G2-Ultra NX GPU 和 SI L2 系统互连。
作者用同一台 M4 MacBook Pro(24GB)和 llama.cpp 服务 Qwen 3.8 27B,对 9 套编程线束跑 8 道 Exercism 题目实测。
一项名为 Detokenization Leaks 的研究提出新攻击,通过观察本地部署 LLM 去分词时的 CPU 缓存活动重建生成文本,无需读取模型内存。
面壁智能转发用户实测,MiniCPM5-2B 已可在 Android 上通过 llama.cpp 加载 GGUF 完成推理,全程数据不离开手机。
面壁智能 MiniCPM5-2B 登顶 Hugging Face Trending,在 AA Intelligence Index V4.1.1 评测中位居全球 4B 以下开放权重模型首位,34 项基准平均得分 53.9。
雷军回应新华社关于小米底层技术自研的报道,称未来 5 年计划投入 2000 亿元研发费用。报道提及小米发布玄戒 O3(安兔兔首破 500 万)、玄戒 O100(1.22TB/s 带宽 AI 加速芯片)。
Apple 发布首款折叠屏 iPhone Duo,展开为 7.6 英寸内屏,合盖后为 5.4 英寸外屏,提供 iPhone 上最大显示面积。搭载 A20 Pro 芯片和蒸汽室散热,iPhone 17 Pro 续航最高 44 小时视频播放,10 月 16 日开启预购、10 月 23 日发售,起售价 $1,999。
推荐理由:官方完整披露了屏幕、铰链、A20 Pro、续航与售价等参数,读者可据此评估这款折叠 iPhone 的实际取舍。
Apple 发布 iPhone 18 Pro 和 iPhone 18 Pro Max,配备带可变光圈的 48MP Fusion 主摄、A20 Pro 芯片和新一代 vapor chamber,eSIM 版 iPhone 18 Pro Max 视频播放最长可达 45 小时。
推荐理由:官方发布稿给出了可变光圈相机、A20 Pro 和电池续航的具体规格与售价,读者可以据此了解这代 Pro 机型的主要变化。
Apple 发布 Apple Watch Ultra 4,采用新 Health Sensing System 和 S11 趕片,称实现可穿戴设备中最准确的心率监测,HRV 测量频率最高提升 24 倍,并新增 0-10 分 readiness 评分。
Apple 发布全新健康与健身功能,Apple Watch Series 12 和 Apple Watch Ultra 4 引入 Health Sensing System,支持每 5 秒测心率、HRV 测量频率提升至 24 倍、每日 0-10 的 readiness 评分。
推荐理由:官方发布列出心率监测频率、readiness 评分和 Health app 各新标签的具体能力,读者可据此评估对自身健康管理的可用性。