#部署/工程
#部署/工程
今日 12 条
DAIR.AI@dair_aiAI 评分4545Tomer Tunguz 博客(VC 分析)精选AI 评分6161 Tom Tunguz 分析 4 万亿美元 AI 数据中心债务浪潮
Tom Tunguz 分析称,未来五年美国数据中心容量将从 25 吉瓦增至 70 吉瓦,全球建设成本约 5 万亿美元,其中约 4 万亿美元需靠债务融资,相当于美国公司债市场扩容 34%,并超过全球私募信贷市场。
推荐理由:作者把 4 万亿美元 AI 数据中心债务放到主要信贷市场规模中对比,并测算出 2030 年前需要的 AI 收入门槛,提供了一个宏观信用视角。
a16z:News(RSS)AI 评分3232 a16z 宣布投资 Gimlet Labs,打造多芯片推理云
a16z 的 Raghu Raghuram 撰文宣布投资 Gimlet Labs,称其为首个多芯片(multi-silicon)推理云,目标是在同等电力下产出更多智能。
Rohan Paul@rohanpaul_aiAI 评分4949TechCrunch:AI(RSS)AI 评分3030 Equity 播客:John Ternus 执掌 Apple 新时代,Nvidia 押注全 AI 栈
TechCrunch Equity 播客讨论 John Ternus 接掌 Apple 硬件后面临的局面,同时谈及 Nvidia 向芯片之外扩展、robotaxi 竞争升温,以及风投资金涌入下一波 AI 硬件。
Mohamed Moustafa 技术博客(网页)AI 评分6363 如何让 Olly 智能体自己处理客服工单
作者分享了让自家 AI 助手 Olly 自行处理客服的实现方法,整套流程用不到 500 行 TypeScript 完成。智能体通过 sendSupportRequest 工具把用户问题连同近期对话写入反馈集合、用 iMessage 通知团队,并经管理端点回复,回复作为合成轮次由智能体翻译成用户语言转达,引用文本被视为内容而非指令以防提示词注入。
Barret李靖@Barret_ChinaAI 评分6161The Decoder:AI News(RSS)AI 评分6868 DeepSeek 计划在内蒙古部署 16 万颗华为 Ascend-950DT 芯片组建推理集群
据 Bloomberg 报道,DeepSeek 计划在内蒙古数据中心部署至少 160,000 颗华为下一代 Ascend-950DT 芯片,仅用于推理,训练仍依赖 Nvidia 硬件。若建成将是已知最大的华为芯片集群;华为受产能和内存短缺限制,可能一年以上才能完成交付。中国内存厂商 CXMT 开始小批量生产 HBM3E,但仍落后三星、SK Hynix 和 Micron 三到五年。
IT之家(RSS)AI 评分5050 微软推出 Project Zenith,为 Windows 11 开发者提供开箱即用开发环境
微软 9 月 4 日宣布推出 Project Zenith,为 Windows 11 开发人员提供开箱即用的开发环境,面向至少 64 GB 统一内存、250 GB/s 以上内存带宽的设备,首批采用 AMD Ryzen AI Halo。
Aidan Gomez@aidangomezAI 评分1717Aidan Gomez 发帖号召大家来柏林参加 Cohere 的活动,并引用 Cohere 官方带有眼睛表情和 Berlin 字样的预告帖。原文仅为活动预告,未披露具体时间、地点或内容。
The Verge:AI(RSS)AI 评分4949 Microsoft 推出面向开发者的 Project Zenith 设备,首批搭载 AMD Ryzen AI Halo 芯片
Microsoft 为开发者优化的 Windows 体验正式命名为 Project Zenith,面向 64GB 或以上统一内存的开发设备,首批设备搭载 AMD Ryzen AI Halo 芯片,AMD 已在 IFA 上宣布首款搭载该芯片的迷你 PC,未来几个月还将有采用不同芯片的更多设备。
IT之家(RSS)AI 评分4747 AMD 公布 Threadripper Halo Station 工作站,支持超 1T 参数模型本地运行
AMD 高级副总裁 Jack Huynh 在 IFA 2026 上公布 Threadripper Halo Station 工作站,定位个人超级计算机,支持参数超 1T 的大模型本地运行。
公众号:火山引擎AI 评分3737 广汽集团与火山引擎推动一线员工用 TRAE 等工具开发 Agent,落地研产供销全流程
广汽集团与火山引擎通过火山杯Agent创新大赛,鼓励一线员工用 TRAE、ArkClaw 等工具开发 Agent,覆盖 NVH 研发、物流设备管理、智能座舱故障诊断和智驾路测等场景。
The Decoder:AI News(RSS)AI 评分6666 Nvidia 发布开源工具 PAIR,把家庭网络变成本地 AI 迷你数据中心
Nvidia 发布开源工具 PAIR(Personal AI Router)测试版,可在家庭网络设备间自动分配本地 AI 请求,充当 Ollama、LM Studio 等工具与各机器之间的虚拟路由,无需改动现有智能体或应用。
IT之家(RSS)AI 评分4343 IBM 发布迄今最快量子处理器 Nighthawk r2,每秒执行超 10 万个量子线路
IBM 于 8 月 31 日宣布推出 Quantum Nighthawk r2 量子处理器,称其为迄今最快,每秒可执行超过 10 万个量子电路,吞吐量为 Heron 处理器的 25 倍。
Frank Wang 玉伯@lifesingerAI 评分3030
SemiAnalysis@SemiAnalysis_AI 评分3737
Sam Altman@samaAI 评分6060
Greg Brockman@gdbAI 评分7575
Satya Nadella@satyanadella精选AI 评分6363推荐理由:Satya Nadella 确认 GPT-6 Astra 已在 Microsoft Foundry 开放,早期客户已可在 Azure 上使用。
IT之家(RSS)AI 评分3838 后摩智能与国科亿道发布 FN008 AI 笔电,搭载飞腾 D3000M 与 160TOPS 后摩漫界 M50
后摩智能宣布与国科亿道合作开发 FN008 AI 笔记本,全栈国产化,基于飞腾 D3000M 处理器,搭载后摩漫界 M50 dNPU,运行 KylinOS(Linux)。
HuggingFace Daily Papers(社区热门论文)AI 评分5252 Random Attention 提出随机驱逐 KV cache 以提升长推理效率
Salesforce AI Research 提出 Random Attention,不对缓存 token 打分,而是保留提示词并在每个注意力头内均匀随机驱逐,在四个模型、六个推理任务上匹配最强先验驱逐方法,vLLM 部署下吞吐量高出 32-43%。
HuggingFace Daily Papers(社区热门论文)AI 评分5252 Minima 论文解释 Gated DeltaNet 为何能在 NVFP4 W4A4 4-bit 量化下保持性能
Minima 对 Qwen3.8-27B(48 层 GDN、16 层注意力)的全部 496 个线性层(含 GDN)应用 NVFP4 W4A4 量化,在 MMLU-Pro。
DAIR.AI@dair_aiAI 评分6767
Rohan Paul@rohanpaul_aiAI 评分4444MarkTechPost(RSS)AI 评分6565 Google DeepMind 发布 WeatherNext 3:基于气象站观测训练,提供每小时刷新的 5 km 全球预报
Google DeepMind 与 Google Research 发布 WeatherNext 3,以实时静止卫星拼图作为直接输入实现每小时初始化,输出精细至 0.05°(约 5 km)的预报,并直接用原始气象站观测训练专用输出头。
IT之家(RSS)AI 评分5454 微软 Copilot Studio 为 AI 智能体工具调用新增人工审批功能
微软计划 9 月开始推送 Copilot Studio 调整,允许开发者在 AI 智能体调用特定工具前要求人工审批。通过针对每个工具和每个智能体的开关,需要审批的工具调用会暂停并显示审批请求,说明智能体意图,供用户批准、批准会话或拒绝。官方列举的适用场景包括发送电子邮件、关闭工单、处理付款。
TechCrunch:AI(RSS)AI 评分6363 Crusoe 据报道以 300 亿美元估值融资 30 亿美元
据 Bloomberg 报道,数据中心开发商 Crusoe 以 300 亿美元估值完成 30 亿美元新融资,由 Atreides Management 和 Valor Equity Partners 联合领投,Mubadala Capital 参投。
Hacker News 热门(buzzing.cc 中文翻译)AI 评分4646 Cerebras 推理平台提供 Qwen 3.8 27B,速度约 1500 tokens/s
Cerebras 公共端点模型目录新增 Qwen 3.8 27B(qwen-3.8-27b,27 billion 参数,上下文 64k/128k,速度约 1500 tokens/s),另有 gpt-oss-120b(120 billion 参数,65k/131k 上下文,约 3000 tokens/s)。
IT之家(RSS)AI 评分6060 英伟达开源测试版发布 PAIR,在局域网内调度 Mac / RTX PC 跨设备本地 AI 推理
英伟达以开源测试版状态推出 Personal AI Router(PAIR),在局域网内自动发现已配对设备并将本地 AI 请求调度至空闲机器,为 Ollama、LM Studio 等工具提供统一请求入口。
IT之家(RSS)AI 评分4444 铭凡确认 AI 迷你工作站 MS-S1 MAX-P495 九月开售
MINISFORUM(铭凡)确认基于 AMD 锐龙 AI Max+ PRO 495 的 AI 迷你工作站 MS-S1 MAX-P495 将于本月内开售。
Claude Code:GitHub Releases(RSS)AI 评分4444 Claude Code v2.1.260 发布
Claude Code 发布 v2.1.260,新增全屏模式 diff 面板(/diff 切换)、/cost 显示提示缓存未命中原因、/reload-plugins 及文本形式 /advisor 命令。
Epoch AI:研究、数据与评测AI 评分5555 Epoch AI 估算最大 AI 数据中心 IT 功率约每 10 个月翻倍
Epoch AI 基于 Frontier Data Centers 数据集(308 条里程碑、86 座设施)估算,自 2024 年年中以来最大在运数据中心的 IT 功率以每年 2.3 倍增长,90% 置信区间对应约 10 个月翻倍。
ginobefun@hongming731AI 评分3636
ClaudeDevs@ClaudeDevsAI 评分4747
Aravind Srinivas@AravSrinivasAI 评分2424xAI:News(网页)精选AI 评分6060 xAI 发布 Grok Bot 企业版,Grok 与 Cursor Enterprise 客户两周免费
xAI 宣布 Grok Bot 面向企业开放,Grok 和 Cursor Enterprise 客户未来两周可免费使用并邀请全组织成员,包括没有现有席位的员工。
推荐理由:原文给出企业版 Bot 的管控能力、真实使用场景和两周免费安排,企业用户可据此评估是否引入现有工作流。
MarkTechPost(RSS)AI 评分8282 OpenAI 发布 GPT-6 Astra:1.05M 上下文的计算机操作模型,因触及 Critical 网络安全阈值而限制访问
OpenAI 发布 GPT-6 Astra,定位为计算机操作模型,提供 1,050,000 token 上下文窗口、128,000 最大输出 token,2026 年 4 月 30 日知识截止,OSWorld V2-Offline 得分 72.6%(GPT-5.6 Sol 为 65.7%),平均任务时间从约 75 分钟降至 40 分钟。
Charlie Holtz@charlieholtzAI 评分4444Charlie Holtz 发布 Cloud Desktop,一种与云机器交互的新方式,让云机器用起来像 localhost。用户可以观看智能体工作,并在需要时随时接管控制。
Databricks:Blog(RSS)AI 评分2424 Databricks 讲解如何构建高质量且可信的数据产品
Databricks 发布博客,介绍组织在迈向 AI 与数据驱动时,如何借助 Databricks 构建高质量且可信的数据产品。正文从企业在 AI 和数据驱动转型中需要交付数据产品这一需求展开。