跳到正文

#端侧

今日 5 条
9月26日周六
  1. Hacker News:AI 热帖72

    微软与高通悄然放弃“Copilot+ PC”品牌,转向通用AI PC叙事

    Windows Central报道指出,微软与高通在2024年推出的“Copilot+ PC”品牌已逐渐被弃用。由于Recall功能的安全争议及市场反响不佳,该品牌声誉受损。2026年发布的Surface系列不再使用此名称,高通高管确认虽保留硬件规格标准(如45 TOPS NPU),但不再强调该营销术语。NVIDIA的新平台也未采用此品牌。目前厂商正转向更广泛的“边缘AI”和混合解决方案叙事。

9月25日周五
  1. 公众号:面壁智能(MiniCPM)55

    面壁智能与英特尔联合发布端侧AI设备松果派Lite

    在2026英特尔技术创新与产业生态大会上,面壁智能与英特尔联合发布面向开发者与企业用户的桌面级端侧AI设备“松果派 Lite”。该设备搭载第三代酷睿 Ultra X7 358H 处理器,最高综合AI算力180 TOPS,旨在解决端侧AI本地运行、数据隐私及快速产品化问题。此外,双方还展示了基于英特尔225H芯片的SuperMate无感智能座舱方案,并提及开源模型MiniCPM5-2B在端侧Agent能力上的表现及下载量突破5000万。

  2. IT之家(RSS)55

    高通骁龙峰会宣布 Modular 平台将进入骁龙产品线,Mojo 编程语言获 Windows 原生支持

    高通在 2026 骁龙峰会宣布 Modular 平台将进入骁龙等完整产品组合,微软与 Modular 合作让 Mojo 编程语言原生支持 Windows。高通于 2026 年 7 月 29 日完成对 Modular 约 39-40 亿美元的收购,Mojo 1.0 已发布并开源标准库、编译器和工具链,目标是让同一套 AI 软件在 GPU、NPU、数据中心 ASIC 等架构及本地与云端间运行。

9月24日周四
  1. Liquid AI 模型与工程博客(网页)57

    Liquid AI 发布 LFM2.5-VL-DSpark 视觉语言 drafter 模型,边缘端解码最高提速 3.13 倍

    Liquid AI 为视觉语言模型 LFM2.5-VL-3B 发布实验性 DSpark drafter 模型,参数约 280M,仅增加 8.9% 参数量。GPU 上解码吞吐最高提升 2.66 倍、边缘设备 3.13 倍,端到端分别最高 2.27 倍和 2.62 倍;模型已上架 Hugging Face,支持 llama.cpp、SGLang 和 MLX-VLM。

  2. Ars Technica:AI(RSS)58

    Meta 发布多款 AI 眼镜并宣布 Muse 助手将登陆眼镜

    Meta 发布多款 Ray-Ban 新款眼镜,其中无摄像头款仅支持音频交互,另推出售价 1,300 美元、比 Quest 3 轻五倍的新 VR 眼镜,明年春季上市。Muse 助手将登陆眼镜,用户可在视频通话中以超写实数字分身代替面部出镜,但 Muse 已出现可被黑客接管智能体的漏洞并遭 Amazon 封锁访问其购物平台。

  3. IT之家(RSS)51

    高通携手 PrismML 发布 1-bit Bonsai 视觉模型,可在骁龙 AR1 Gen 1 智能眼镜上本地运行

    在 2026 骁龙峰会上,高通与 PrismML 发布 1-bit 量化 Bonsai 视觉语言模型,基于 Bonsai 1.7B 构建,可在骁龙 AR1 Gen 1 智能眼镜平台本地运行 20 亿参数模型。官方称相同内存下可容纳约 4 倍参数,内存占用约为传统 4-bit 模型的 1/4,文本 Token 生成速度翻倍,识图、翻译、环境问答等交互可离线完成,同时降低功耗、改善续航与发热。

  4. Google Developers Blog(RSS)60

    Antigravity SDK 支持本地模型,首发 Gemma 4 26B A4B 配合 LiteRT

    Google 宣布 Antigravity SDK 支持本地工作流,首发支持通过 Google AI Edge 的 LiteRT 运行 Gemma 4 26B A4B,可完全离线获得智能体辅助能力,建议机器配备超过 24GB VRAM 或统一内存。

    推荐理由:官方给出完整的本地模型接入步骤和混合编排示例,开发者可以直接照此把智能体工作流搬到离线环境。

9月23日周三
  1. vLLM 官方博客(RSS)74

    vLLM 发布 vllm-metal v0.28.0:在 Apple Silicon 上支持并发推理服务

    vLLM 官方发布 vllm-metal v0.28.0,把 vLLM 的 V1 调度器、paged KV cache 和 OpenAI 兼容服务器带到 Apple Silicon,由 MLX 和 Metal 执行模型,版本号与上游 vLLM 对齐。

    推荐理由:官方首次发布 vllm-metal,用 packed varlen attention 和 paged KV 解决 Mac 上并发请求的服务问题,并给出可复现的并发基准数据。

  2. IT之家(RSS)61

    微软 Win11 Clipchamp 新增本地 AI 视频超分功能,可将视频分辨率提升至 4K

    微软为 Windows 11 内置视频编辑器 Clipchamp 新增视频超分辨率功能,可利用本地算力将低分辨率视频提升至最高 4K。支持硬件包括 CPU,Copilot+ PC 可用 NPU,兼容 AMD、英特尔和高通硬件,仅限 Windows 桌面版,浏览器版暂不支持。微软提醒 AI 生成的细节可能出现伪影或失真,不建议用于法律证据、身份验证和医学影像等敏感场景。

  3. IT之家(RSS)53

    京东方玻璃基封装载板试验线全线拉通,24 层产品已送客户验证

    京东方董事长陈炎顺在投资者关系活动中表示,玻璃基封装载板试验线已全线拉通,24 层产品已送客户验证。公司已完成 24 层、尺寸超过 100×100 毫米的载板产出并通过厂内可靠性测试,目前正与客户进行芯片上代后的电性能测试,争取在 2027 年上半年前、特别是 2027 年一季度达到量产投资决策条件。

9月22日周二
  1. Hugging Face:Blog(RSS)73

    transformers 支持直接加载 GGUF 量化模型,本地推理性能接近 llama.cpp

    Hugging Face 宣布 transformers 支持直接运行 GGUF 量化模型,通过 from_pretrained 传入 gguf_file 即可加载 Hub 上的 GGUF checkpoint,并复用 ggml 的 Metal 内核。

    推荐理由:官方宣布 transformers 直接加载 GGUF,给出在 Apple Silicon 上接近 llama.cpp 的实测吞吐和加载方法,可帮助本地推理用户选择工作流。

  2. IT之家(RSS)60

    阿里云栖大会发布千问 AI 眼镜 N1 系列,支持眼动追踪与虹膜支付,10 月 13 日发售

    阿里巴巴在 2026 云栖大会展示千问 AI 眼镜 N1、N1 Pro 及 AI 耳夹式耳机,已开启线上预约,10 月 13 日现货发售。N1 系列搭载 5000 万像素传感器支持第一视角拍摄,N1 Pro 支持眼动追踪和虹膜支付;耳机结合 Bose 调音与 AI 助理,支持面对面翻译、AI 听记和语音办事。

  3. 公众号:千问APP(阿里)58

    千问发布三款 AI 硬件:AI 眼镜 N1、N1 Pro 与耳夹式耳机开启预约

    千问在云栖大会首次展示三款新一代 AI 硬件,并已在千问官方旗舰店开启线上预约,10月13日现货发售。千问AI眼镜 N1 配备 5000 万像素传感器、支持第一视角拍摄;N1 Pro 支持眼动追踪与虹膜支付;耳夹式耳机采用 Bose 调音并内置 AI 助理,支持面对面翻译、AI 听记和语音办事。

9月21日周一
9月19日周六
9月18日周五
  1. IT之家(RSS)59

    北京发布“词元经济十条”,部署词元工厂建设与关键技术攻关

    北京市经济和信息化局9月18日发布“词元经济十条”,即《北京市加快词元经济发展的行动方案(2026—2028年)》。方案提出高标准建设词元工厂,制定覆盖模型适配数量、词元吞吐速度、首字延迟、缓存命中率、PUE 等指标的分级评价标准;推动推理专用芯片、模型轻量化、边缘端部署等技术攻关;并部署词元质量评测体系、词元分发平台、通用与垂直领域智能体培育、算力与词元金融工具及词元工程师再技能化培训等措施。