Airbnb CTO 谈内部 AI 改造:60% 代码由 AI 编写,半数客服工单由 AI 解决
Airbnb CTO Ahmad Al-Dahle 披露公司 AI 转型进展:目前 60% 的代码由 AI 编写,功能交付量同比增长近 80%,工程师人均 PR 吞吐量提升约 1.6 倍,约一半客服工单已完全由 AI 解决。
Airbnb CTO Ahmad Al-Dahle 披露公司 AI 转型进展:目前 60% 的代码由 AI 编写,功能交付量同比增长近 80%,工程师人均 PR 吞吐量提升约 1.6 倍,约一半客服工单已完全由 AI 解决。
微软宣布将「仿生学」设计推广至美国与德国 20 多个数据中心,通过增加花园、本地树木和生态修复项目,让设施「融入自然景观」。微软称已在荷兰一处数据中心试点,并计划对所有美国新项目采用该方案。此举正值美国多地社区抗议数据中心带来的噪音、污染和绿地消失,微软在圣安东尼奥曾因砍伐 2600 多棵树引发争议。
OpenAI 与 EDA 工具厂商 Synopsys 签署多年战略合作,将共同开发名为 GPT-Synopsys 的专用芯片设计模型,把 OpenAI 的 AI 技术与 Synopsys 的 EDA 工具结合。
硬件设计 AI 工具公司 Flow Engineering 完成 5000 万美元 B 轮融资,估值 7.5 亿美元,由 Valor Equity Partners 的 Antonio Gracias 与 Atreides Management 的 Gavin Baker 联合领投,Sequoia Capital 参投。
前 Google 和 SpaceX 产品经理 Rama Afullo 创办的 Satlyt 完成 800 万美元种子轮,由 Non Sibi Ventures 领投,专注为卫星开发在轨运行 AI 模型的软件,而非自建航天器。
AWS 发布开源决策模型 Strands Decider 2B,基于 Qwen3.5-2B 构建,可在本地运行,用于在预设选项中做选择并给出置信度评分。该模型由 AWS 杰出工程师 Marc Brooker 在看过 TypeSafe 的 Jev 后自行开发,曾在同规模模型的 Jevbench 排名上短暂登顶,随后由 Strands Labs 整理发布。
Google 的轨道计算卫星原型随 SpaceX 火箭从加州升空,这是该公司首次把自研芯片送入太空,卫星由 Planet Labs 建造,将验证 TPU 能否在轨运行。
CoreWeave 宣布 NVIDIA Vera Rubin NVL72 系统搭配 Spectrum-X 102.4T 以太网在 CoreWeave Cloud 上可用,成为首批交付该平台的云厂商之一,Cognition 是首个在生产环境运行 Vera Rubin 的客户。
推荐理由:CoreWeave 上线 Vera Rubin NVL72 并公布 Devin 实测吞吐数据,可看到智能体推理与后训练基础设施的落地形态。
NVIDIA 提出 AI 工厂投资回报由三项因素决定:每兆瓦产出能力、硬件有效寿命和 token 需求。SemiAnalysis AgentX 数据显示,NVIDIA Vera Rubin NVL72 每兆瓦吞吐量比 GB300 NVL72 高 30 倍以上,在 DeepSeek V4 Pro 模型上每百万 token 成本最多低 45 倍。
GPT-6 Astra Ultrafast 已在 OpenAI API 上线,并向符合条件的 ChatGPT Work 和 Codex 用户开放,运行在 NVIDIA Blackwell GPU 上。
推荐理由:原文给出 Ultrafast 相对标准模式的加速幅度与开放入口,读者可据此判断它对编码智能体循环的实际影响。
微软研究院开发了一套端到端机器学习流水线,利用 L1 拉格朗日点的太阳风观测数据,为美国本土 66,935 座变电站生成 30-60 分钟前的空间天气风险预测。系统结合 AE 与 Dst 指数预测、地质电导率和电网数据,在 2020-2026 年评估期内检测到近 80% 的重大空间天气事件,其中 Dst 预测器在 62.2% 的高活跃时段优于 Burton 方程。
AWS 官方博客演示在 Amazon Bedrock AgentCore Runtime Instances 上部署三智能体音乐制作流水线:作曲智能体在实例自带的 NVIDIA L4 上运行开源音乐生成模型 ACE-Step,交付智能体读取共享卷上的 .wav 做 DSP 处理,合规智能体独立复测并做相似度筛查。
Amazon Bedrock Knowledge Bases 可通过 AgenticRetrieveStream API 用自然语言查询理赔文档,支持多轮追问、按 claim ID 和 claim type 等元数据过滤检索,并返回带引用的答案。
uniopen 通过 Amazon SageMaker AI 对 Amazon Nova 2 Lite 进行监督微调,并做提示词层面的输出优化,使其适配自身零售审核策略。
AWS 博客给出 Claude Platform on AWS(CPonAWS)多环境访问的完整实施步骤:在组织内建专用 AI Services 账户承载订阅与工作区,工作负载账户通过跨账户 SigV4 角色调用推理,无需存储 API key。
Amazon Bedrock AgentCore 支持构建"环境智能体"(ambient agent):它监听 Amazon S3 事件通知、EventBridge 规则等事件流并自动触发任务,在需要时通过单个 ask_human 工具暂停等待人工审批,再从中断处恢复执行。
Amazon Payments 在 Amazon SageMaker AI 上用多目标上下文多臂老虎机(LinUCB)为产品获客漏斗做个性化内容选择,七周线上 A/B 测试中,一个人群组的最终漏斗转化率取得高个位数百分比的相对提升,另一人群组则未见改善,问题出在内容而非模型。
NVIDIA NeMo Agent Toolkit(NAT)可通过自定义 memory provider 接入 Amazon S3 Vectors,作为多智能体系统的持久化记忆层,并部署在 Amazon EKS 上。
Amazon Quick 为 AI 构建的 Quick Apps 推出 Live Data in Apps,应用每次打开时都会实时查询受治理的 Quick Sight 数据集,而非依赖构建时的静态快照。
AWS Professional Services 用四个智能体组成的模式,把每个应用的 IaC 开发时间从 3 到 4 周压缩到几分钟,该模式基于 Strands Agents SDK 构建、运行在 Amazon Bedrock AgentCore 上,通过 AgentCore Gateway 暴露的 MCP 工具连接源与目标系统。
Simon Willison 用 Claude Opus 5.5 改进其纯 Python WebAssembly 引擎 pwasm,42 次提交后已支持几乎全部 WASM 规范,PyPI wheel 内置 MicroPython、QuickJS 和 Micro QuickJS 的可用 WASM 构建。该项目最初于今年 1 月由 AI 生成,作者以 alpha 版本发布,提醒不要信任其稳定性。
Amazon Bedrock 在印度上线 Anthropic 的 Claude Opus 5、Claude Sonnet 5 和 Claude Haiku 4.5,通过地理跨区域推理让请求仅在 ap-south-1 与 ap-south-2 之间路由,数据留在印度境内。
Amazon Bedrock 现支持在首尔和新加坡区域进行区域内推理的 Anthropic Claude 模型:首尔支持 Claude Opus 5 和 Claude Sonnet 5,新加坡支持 Claude Sonnet 5,均通过 bedrock-runtime 端点调用。
AWS 发布基于 Amazon Quick 与 Amazon Bedrock AgentCore 的合同智能平台参考架构,用 AI 智能体从合同 PDF 中提取结构化字段并交叉验证,解决 RAG 无法跨数百份合同做聚合统计的问题。
Condé Nast 与 AWS 生成式 AI 创新中心(GenAIIC)合作,基于 Amazon Bedrock 和 Amazon OpenSearch Service 构建多模态视频检索方案,将单次内容发现任务耗时从平均 250 分钟降至 2 分钟以内。
AMD 发布 Adrenalin Edition 26.9.2 可选显卡驱动,新增《我的世界:地下城 2》《使命召唤:现代战争 4》战役抢先体验、《巫师 3:狂猎 完全版》十周年纪念补丁等游戏支持。
作者实测 Anthropic 新发布的 Claude Sonnet 5.5,用代码动画、HTML PPT、3D 网页和写作四项任务对比 Opus 5.5 与 gpt6。
HPE 提出,当 AI 从试验走向客服、IT、研究与业务流程等常驻智能体工作负载后,按 token 逐次消费的模式会让支出难以预测,企业需按自身工作负载测算「自持容量」的盈亏平衡点。
Manus 发布 2.0 版本,将 AI 智能体升级为平台,用户可编辑视频、托管多人游戏,并用手机远程操控智能体。
Google Cloud AI Research 联合 UNC-Chapel Hill、Stanford 和圣路易斯华盛顿大学发布 RRSI(Regularized Recursive Self-Improvement),让 LLM 智能体在不改动模型权重的情况下改写自身 harness 的提示词、工具、记忆、控制流和子智能体。
新紫光集团旗下新华三发布机架级全互联智算产品 UniPoD S81000 X1 超节点,单 Scale-Up 域最大支持 40 张国产加速卡,任意两卡间 P2P 带宽达 448GB/s。40 卡聚合为 5760GB 统一编址显存池,支持 FP8 精度,总算力可达 28P FLOPS,并兼容 19 英寸标准机柜、单柜最大部署 2 套 40 卡超节点。
AMD 宣布以约 82 亿美元全股票收购 Marble 世界模型开发商 World Labs,交易预计 2026 年底前完成,尚待监管批准。World Labs 联合创始人李飞飞将加入 AMD 任执行副总裁兼首席科学家,团队继续模型研究。
MiniCPM-o 4.5 现已支持 SGLang Omni v0.1.7。 为开发者提供更多灵活运行和构建该模型的方式。
PReCache 是一个免训练的 KV cache 共享框架,通过 PreLRShared 和 ReBaseShared 两种设计共享基于预训练权重计算的基础 cache,并预计算紧凑的智能体专属低秩(LR)cache。
开源项目 ESP32S3-LLM-Cluster 在 7 块 ESP32S3 上以分布式流水线方式运行 1.58-bit BitNet 量化模型,其中切片后的 0.5B 模型由 1 块主节点加 6 块计算节点分担。
Cloudflare 推出开源公测版新 CLI cf,将可覆盖的操作从 Wrangler 的约 280 个扩展到超过 3000 个,覆盖整个 Cloudflare API,安装方式为 npm i -g cf。