全部AI 动态
全部动态
今日 1 条
PixVerse@PixVerseAI 评分1515
Tripo@tripoaiAI 评分2525
StepFun@StepFun_aiAI 评分6464
ViggleAI@ViggleAIAI 评分5151NVIDIA Blog(RSS)AI 评分4949 NVIDIA 在 AI Infra Summit 展示 Vera Rubin 与 DSX 平台能效进展
NVIDIA 在 AI Infra Summit 上展示 Vera Rubin 与 DSX 平台的能效进展,DSX MaxLPS 可在同一兆瓦预算内提升最多 40% GPU 容量、token 吞吐提升最多 35%。
NVIDIA Blog(RSS)AI 评分4545 NVIDIA 如何用 DSX 把兆瓦电力转化为 token 产出
NVIDIA 在 AI Infra Summit 上公布 DSX MaxLPS 的首个部署验证结果:Lambda 在五机架 19 节点 HGX B200 集群上,用原本 16 节点的电力预算跑 19 节点,集群 token 吞吐提升 24%,从约 400 万 tokens/秒升至 500 万,每瓦性能提升 23%。
NVIDIA Technical Blog:Agentic AI / Generative AIAI 评分3131 NVIDIA NVLink 6 如何为 AI 工厂提供多层弹性保障
NVIDIA 详解 NVLink 6 的多层弹性框架,通过物理层 FEC、PLR、UPHY 恢复与链路层 CBFC 实现原生无损网络,端到端延迟比通用以太网低 3 倍、包速率高 10 倍。
NVIDIA Technical Blog:Agentic AI / Generative AIAI 评分4040 NVIDIA Groq 3 LPX 的确定性执行如何为 NVIDIA Vera Rubin 带来高能效高交互推理
NVIDIA Groq 3 LPX 通过确定性执行模型让 LPU 编译器生成精确到时钟周期的调度,覆盖整机架 256 颗 LPU 芯片,并据此预测每个周期的电流需求,配合 Preemptive Power(PEP)与 Clock Period Synthesis(CPS)压缩电压保护带,把更多电力留给实际负载。
NVIDIA Technical Blog:Agentic AI / Generative AIAI 评分5353 NVIDIA 技术博客解析 Dense 与 MoE 模型的参数激活、吞吐差异及选型方法
NVIDIA 技术博客讲解 dense 与 MoE 架构在参数激活、吞吐和部署上的差异,以 Nemotron 3.5 Lightning 为例说明 MoE 每词元仅激活约 3B 参数、总参数 30B 仍需约 60 GB 显存。文章给出按显存预算、并发、微调和量化需求选型的建议,并对比 Gemma 4 31B、Qwen3.8-27B、Mistral Small 4 等模型的输出速度与价格数据。
Factory 研究 / 产品(RSS)AI 评分5555 Factory 完成 2 亿美元融资,估值达 50 亿美元
Factory 完成 2 亿美元融资,估值 50 亿美元,投资方包括 Blackstone、Khosla Ventures、Sequoia Capital、Insight Partners 等,累计融资超 4 亿美元。
Tessl:产品与工程博客AI 评分4545 Tessl 提出 Context-Driven Factories:用纯文本技能与循环构建智能体软件工厂
Tessl 提出 context-driven factories 方法,主张把团队工作流与标准写进纯文本插件而非代码,让 agent 读取上下文自行决策,并按“skills 到 loops 再到 factory”的路径组合成完整智能体 SDLC。
Claude:Blog(网页)精选AI 评分6565 Claude for Small Business 新增 43 个 workflow 与 27 个集成
Anthropic 为 Claude for Small Business 新增 43 个 workflow 和 27 个集成,覆盖 Shopify、Salesforce、TikTok、Zoom、Stripe、Zapier 等工具,该产品自 5 月上线以来安装量超过 90 万次。
推荐理由:原文给出43个workflow、27个新集成和默认审批模式的控制方式,读者可以据此判断它怎样接入小店现有的工具链。
Google DeepMind:Blog(RSS)精选AI 评分7070 Google DeepMind 发布 Gemini 3.8 Live 和 3.8 Live Extended Thinking
Google DeepMind 发布 Gemini 3.8 Live 与 Gemini 3.8 Live Extended Thinking 两个近实时语音对话模型,主打语音智能体和复杂任务执行。
推荐理由:原文给出两个语音对话模型的定位分工和多项基准数字,读者可以据此评估其推理、成本与工具调用能力。
Google AI@GoogleAIAI 评分6464Google AI 发布迄今最先进的 Gemini 音频模型 Gemini 3.8 Live 与 3.8 Live Extended Thinking。
Google Developers Blog(RSS)AI 评分5858 Google 零信任智能体系列 Part 2:用运行时治理判断意图而不只是语法
Google 开发者博客发布零信任智能体系列第二部分,把安全检查从构建期移到 Gemini Enterprise Agent Platform 运行时,用 Model Armor、Semantic Governance Policies 和 Agent Anomaly Detection 三项托管控制拦截构建期规则放过的攻击。
Databricks:Blog(RSS)AI 评分4141 Databricks 解读数据本体论:AI 智能体缺失的上下文层
Databricks 提出 Genie Ontology,主张企业不必手工建模全部业务概念,而是"治理头部、学习长尾":人工定义收入、合规规则、核心 KPI 等不能出错的概念,其余从组织实际运作中持续学习。其内部测试中,一个 AI 助手为产品顾问委员会生成简报时声称有 24 家客户参与,被追问后承认该数字是编造的。
Odyssey@odysseymlAI 评分3636
Runway@runwaymlAI 评分1212Databricks:Blog(RSS)AI 评分4545 什么是 AI analytics?为什么它只在受治理的数据上有效
Databricks 产品营销负责人 Richard Tomlinson 解释,AI analytics 与传统 BI 的关键差异在于由系统而非人完成分析路径:从仪表盘展示已测指标,到对话式提问,再到智能体自主调查。它依赖受治理的数据、共享业务上下文、权限感知执行和可验证证据四项条件,仅靠更强的模型无法实现。
Google Cloud:Databases(RSS)AI 评分3535 Google Cloud 用 GNN 与 Distributed GraphFlow 扩展电信网络自主运营
Google Cloud 提出自主网络运营框架,以 Spanner Graph 上的网络数字孪生为底座,用新开源的 Python 库 Distributed GraphFlow(DGF)管理 GNN 建模全流程,高层 API 约 5 行代码即可训练和评估模型。
Databricks:Blog(RSS)AI 评分4646 Databricks 营销团队如何用 AI 分析助手 Genie 将数据使用率提升 3 倍
Databricks 营销团队基于 Genie Agents 构建 AI 分析助手 Marge,让营销人员用自然语言提问、数秒内获得受治理的答案,数据用于决策的频率提升 3 倍。目前超过 85% 的营销组织在使用 Marge,使用量环比增长 50%,每月处理逾 800 个问题、累计回答超 5000 个,错误标记响应下降 25%,且未增加分析人员编制。
Databricks:Blog(RSS)AI 评分1919 能源团队如何用 Genie 与 AI 业务流程将窃电检测转化为受治理的行动
Databricks 发文介绍能源团队如何借助 Genie 和 AI 业务流程,把窃电检测从单纯识别升级为受治理的行动。窃电指故意不付费使用燃气或电力,文章围绕这一场景展开。原文未披露具体模型版本、参数规模或性能数字。
OpenRouter@OpenRouterAI 评分5555Baseten 工程博客(网页)AI 评分3232 LangChain 用 Baseten Loops 为 LangSmith Engine 训练定制模型
LangChain 采用 Baseten Loops 为平台内智能体 LangSmith Engine 训练定制模型,通过微调大型开放权重模型处理读取 GitHub 仓库诊断问题、起草 PR 提示词或代码修改等任务。
Google Blog:AI(RSS)精选AI 评分6363 Google 发布 TranslateGemma 等多语言 AI 成果,语言技术覆盖 300 多种语言
Google 宣布其语言技术已支持超过 300 种语言、覆盖全球 86% 人口,并发布 TranslateGemma 轻量开源翻译模型(基于 Gemini 训练、支持 55 种语言、可离线运行)。
推荐理由:原文来自 Google 对其语言技术的系统性梳理,读者可以借此了解其多语言 AI 的技术路线和数据合作方式。
Google Blog:AI(RSS)AI 评分4444 Google 用 AI 加速科学发现与疾病检测:AlphaFold 已预测 2 亿个蛋白质结构
Google 公布 AI 用于科学与医疗的最新进展:AlphaFold 已预测科学界已知的全部 2 亿个蛋白质结构,被 190 个国家 400 万名研究者使用,并在此基础上推出 AlphaGenome Atlas。
Google Blog:AI(RSS)AI 评分1616 Google 如何用 AI 推动社会公益
Google 展示 AI 在科学发现与社会公益领域的落地进展,覆盖疾病检测、治疗与预防、自然灾害预测、教育普及和经济机会拓展等方向。Google 正与全球社区和研究者合作,推动 AI 突破惠及更多人。
Replit ⠕@ReplitAI 评分4141Hugging Face:Blog(RSS)AI 评分5757 IBM Research 在 ALTK-Evolve 中引入 Consistency Analyzer 与一致性指南,将 GPT-4.1 智能体在 AppWorld 上的一致性差距从 24.4pp 降到 12.0pp
IBM Research 团队在 ALTK-Evolve 中推出 Consistency Analyzer 和一致性指南,针对智能体反复执行同一任务时结果不稳定的问题。
Gary Marcus:The Road to AI We Can Trust(RSS)AI 评分4949 Gary Marcus 解读 Sam Altman 对 Dario 的背书
Gary Marcus 发文解读 Sam Altman 对 Dario 的公开背书,认为其真实含义是"我们会以最快速度推进,只要不坐牢、不被诉讼到消失,但为了观感把它叫做'pacing'"。他还引用 Elon Musk 的讽刺:一边说 AI 有 10% 概率毁灭人类,一边问"你想在我们 IPO 里拿多少配额"。
LlamaIndex:产品、工程与评测AI 评分4949 抽取置信度分数实用指南:如何设定 cutoff 平衡精度与人工审核
LlamaIndex 在 Extract 中为抽取结果提供 0 到 1 的置信度分数,用户可设定 cutoff 决定哪些值自动通过、哪些转人工审核。在 ExtractBench 的 370 份文档上,Extract Agentic Plus 以约 0.77 的 cutoff 达到 97% 精度,自动接受约 66% 的期望字段。
LMSYS:Blog(Chatbot Arena 团队)AI 评分4747 SGLang、Qwen 与 NVIDIA 在 SGLang 中实现 NVFP4 KV cache
SGLang、Qwen 与 NVIDIA 团队在 SGLang 中实现了 NVFP4 KV cache,用于加速长上下文与智能体推理。NVFP4 以 4 位 E2M1 值配合每 16 个值一个 FP8 block scale 和 FP32 tensor 级 scale,每 16 个值仅占 8 字节加 1 字节元数据,约为 FP8 存储的 56%。
PixVerse@PixVerseAI 评分3737PixVerse 在 Growth Studio 中上线 Creative Variations,可将同一产品转化为多个不同的视频创意,用于制作差异化广告素材并跨受众和营销目标测试。
IBM Research:AIAI 评分4545 IBM Research 证明浅层量子电路与 LLM 存在理论分离
IBM Research 在 arXiv 发表论文,证明存在功能性与分布性两类计算问题,浅层量子电路相对 LLM 具有可证明的优势。研究针对 GPT、Claude、Llama 等使用的 decoder-only transformer 架构,证明迭代索引函数需大量计算资源才能求解,而近恒定深度量子电路加单个经典 AND 门即可解决,且该深度无法进一步优化。
PixVerse@PixVerseAI 评分1414Claude:Blog(网页)AI 评分3737 Anthropic 发布《构建 AI 原生营收组织》指南,详解 Claude 在销售团队的落地路径
Anthropic 发布《构建 AI 原生营收组织》指南,介绍如何在销售团队中推广 Claude。指南包含成熟度模型、试点前的配置决策、三阶段推广计划(搭建、试点、扩展)、按效率/扩张/新能力三组衡量的 ROI 方法,以及阻碍全组织推广的常见陷阱。
Claude:Blog(网页)AI 评分5555 Anthropic 推出 Salesforce in Claude 测试版插件
Anthropic 与 Salesforce 合作发布测试版插件 Salesforce in Claude,将卖家的客户、商机和管道数据在既有 Salesforce 权限下接入 Claude,包含 37 个面向客户经理日常工作的技能,如客户调研、电话准备、管道审查和 CRM 更新。
Tripo@tripoaiAI 评分2525
Perplexity@perplexity_aiAI 评分3434
Krea@krea_aiAI 评分4444在 Krea Agent 中引入 Pinterest。 现在你可以把所有的 pin 和 board 导入工具,并将它们用作智能体的上下文。 立即在 krea . ai / agent 试用