跳到正文

全部动态

今日 1 条
9月15日周二
  1. 公众号:京东JoyAI28

    京东数字人JoyAvatar发布「我AI我家·星主播」大赛,设真人及原创数字人双赛道

    京东数字人JoyAvatar在JDD大会发布「我AI我家·星主播」大赛,面向全网开放真人赛道和原创数字人赛道报名,报名时间为9月3日至9月22日。大赛联合京东家电家居事业群及小米、恒洁等品牌发起,前十强及3个特别奖获得者有机会获得与Yuri同款官方虚拟偶像身份认证及数字艺人演出资格。

  2. Claude Code:GitHub Releases(RSS)13

    Claude Code 发布 v2.1.272

    Claude Code 发布 v2.1.272,本次更新为缺陷修复与可靠性改进。该版本未引入新功能,主要针对已有问题进行修复,提升整体稳定性。

  3. PromptArmor:Threat Intelligence72

    Elastic AI SOC 被曝存在间接提示注入漏洞,可窃取凭证

    PromptArmor 披露 Elastic Agentic SOC(AI 安全运营中心)存在严重安全风险。攻击者可通过恶意钓鱼邮件中的指令实施间接提示注入,诱导 AI Agent 创建并执行恶意工作流,进而生成 API 密钥并发送给攻击者。由于缺乏强制的人工审批环节,攻击者可利用窃取的密钥禁用检测规则、伪造警报或窃取数据。该漏洞于 2026 年 8 月报告给 Elastic,但至今未修复。文章提供了关闭自动内置能力、限制工具权限及更换更鲁棒模型等缓解措施。

    推荐理由:揭示了 AI Agent 在安全运营场景下的具体攻击链与风险,为使用或开发类似自动化系统的团队提供了重要的防御配置参考和警示。

  4. OpenRouter:Announcements(RSS)46

    Descript 案例:如何用 OpenRouter 让新模型不再排队等工程师

    Descript 借助 OpenRouter 作为生产推理层,把上线模型从 1 个扩到 13 个(来自 OpenAI、Anthropic、Google、xAI 四家),评估新模型的时间从一周以上缩短到 1-2 小时,最近一次 Anthropic 新模型从发布到上线仅用几小时。团队现在每周评估多次,通过 Claude Tag 自动跑评测并提交 PR,人工只需审核。

  5. Claude Code:GitHub Releases(RSS)41

    Claude Code v2.1.271 发布:Remote 会话新增 fast mode,修复多项权限与策略问题

    Claude Code v2.1.271 为 Remote 会话(云端与自托管 runner)新增 fast mode,并支持在 /config 面板用鼠标操作。该版本还修复了切换账号或 API key 后缓存组织策略被复用、企业 managed-mcp.json 解析失败被忽略、云会话在 worker 重启后拒绝所有 subagent 工具调用等问题。

  6. Epoch AI:研究、数据与评测43

    Epoch AI:美国成年人近每日使用 AI 的比例半年内翻了一倍多

    Epoch AI 基于 Ipsos KnowledgePanel 的两次调查显示,2026 年 3 月至 8 月间,美国成年人中近每日(6-7 天)使用 AI 的比例翻了一倍多。3 月调查覆盖 2,017 名成年人,8 月覆盖 1,016 名。文中指出两波调查的提问方式和 AI 服务清单略有差异,频率对比仅具近似性。

  7. Claude:Blog(网页)51

    Anthropic 联合 Accenture 发布 AI 从试点到生产的部署指南

    Anthropic 与 Accenture 联合发布帮助 CIO 和技术负责人把 AI 项目从试点推进到生产的实用蓝图。指南引用 Accenture 2026 年 7 月报告称仅 23% 的高管认为 AI 项目取得持续的企业级影响,并列出按时间顺序的七项考量、四部分任务定义、轻量总拥有成本模型、四层监督模型及决策过渡蓝图。

  8. Claude:Blog(网页)66

    Anthropic 工程师复盘:智能体编程压力下如何扩展测试影响分析服务

    Anthropic 工程师撰文分享如何在智能体编程压力下扩展测试影响分析服务。Claude 编写约 80% 的代码,测试数量增长 10x,六个月内 CI 任务增加 25x。文章复盘了三个临时补丁(扩容、按包分片、每日重启)分别只维持 70 天、29 天和不到一天,最终用三周重设计为无状态、内存存储加 journal 的可水平扩展架构,并建议团队按两季度内 25x 负载做容量规划。

    推荐理由:作者复盘了智能体编程把 CI 推向 25x 负载的完整演进,给出可迁移的架构与容量规划经验。

  9. Apple:Newsroom(RSS)77

    Apple 发布新一代 Apple Intelligence,Siri AI 正式以测试版上线

    Apple 发布新一代 Apple Intelligence,推出全面重构的 Siri AI,支持个人语境理解、屏幕感知、系统级应用操作和跨设备对话,今日起以英文测试版随 2027 系统更新推出,下月扩展至法语、日语、韩语、葡萄牙语和西班牙语。

    推荐理由:官方公告完整列出 Siri AI 的能力清单、设备与语言范围,以及欧盟和中国市场暂不可用等限制,读者可据此评估适用性。

  10. Arena.ai67

    DeepSeek-V4.1-Flash (Max) 进入 Agent Arena 开源模型第 3 名,净提升 +4.87%,每任务中位成本 $0.07,重塑 Pareto 前沿。其成本比第 2 名 Hy4 preview 低 68%、成绩仅差 0.09 个百分点;总榜排名第 12,Confirmed Success 信号排名 第 4(+13.75%)。

    推荐理由:原文给出开源模型成本与成绩的完整对比,读者可以据此评估 DeepSeek-V4.1-Flash 在性价比上的位置。

  11. NVIDIA Technical Blog:Agentic AI / Generative AI40

    NVIDIA Transformer Engine 如何用 JAX 加速 Dropless MoE 训练

    NVIDIA 在 JAX 中用 Transformer Engine 优化 Dropless MoE 训练,在 NVIDIA GB200 上跑 DeepSeek-V3 时,未优化基线仅 103 TFLOPS/GPU、GPU 间通信占累计 kernel 时间 84%,经针对性 kernel 优化后升至 1,068 TFLOPS/GPU,提升 10.4 倍。

  12. Tomer Tunguz 博客(VC 分析)70

    Tomer Tunguz 解析 Amodei 放缓前沿提议背后的五派立场与算力监管难题

    Tomer Tunguz 分析 Dario Amodei 提出的放缓前沿 AI 发展号召,梳理出可解释性、劳工、经济、地缘政治和监管俘获五派立场,并指出没有任何一派给出具体速度。

    推荐理由:作者用前沿领先期缩短和算力门槛的历史数据,检验放缓前沿的提议在操作层面意味着什么。

  13. Tessl:产品与工程博客63

    Tessl 提出 Agent 上下文归属模型:所有权跟随组织单元

    Tessl 发文提出智能体转型的真正难点是上下文等要素的归属问题,而非 Agent 本身。核心规则是所有权跟随组织单元,个人与团队上下文归领域专家,组织级共享基础由赋能或平台团队托管并开放贡献,赋能团队只提供工具和基础设施而不拥有上下文。

    推荐理由:文章把智能体转型的难点从模型转向上下文归属,给出按组织单元分层确权和赋能团队只供工具不拥有上下文的可迁移框架。

  14. SiliconFlow66

    硅基流动(SiliconFlow)宣布开源模型 Hy4 preview 上线其平台。该模型总参数 770B、每 token 激活 49B、支持 1M 上下文,采用 Apache 2.0 协议,面向编码、分析、研究和复杂实际工作。用户可将其接入 Claude Code、Codex、Cursor 等已有工具;图片显示定价为每 1M tokens 输入 $0.834、输出 $2.501、缓存 $0.042。

    推荐理由:原文给出了参数规模、上下文长度、开源协议和定价,读者可据此评估它能否接入现有编码与 Agent 工具链。