SemiAnalysis 解析 GLM5.3 稀疏注意力对 HBM 内存与推理成本的影响
SemiAnalysis 分析 GLM5.3 的 DeepSeek Sparse Attention 如何影响 HBM 内存使用,指出 top-k 选择仍需完整上下文驻留 HBM,稀疏注意力并不直接降低内存容量瓶颈。
SemiAnalysis 分析 GLM5.3 的 DeepSeek Sparse Attention 如何影响 HBM 内存使用,指出 top-k 选择仍需完整上下文驻留 HBM,稀疏注意力并不直接降低内存容量瓶颈。
Mistral 宣布在慕尼黑开设新中心,设立专注 Physics AI 和工业 AI 的研究团队,并直接服务企业客户。2026 年 5 月收购 Emmi AI 后,超过 30 名物理与工程 AI 研究人员加入;目前正与 BMW 合作碰撞仿真、与 Siemens Energy 合作工业 AI 应用,并与慕尼黑工业大学(TUM)利用其风洞设施研发汽车空气动力学数字孪生。
Claude Sonnet 5.5 现已在 Google Cloud 上线,面向编程与知识工作场景。官方称其能以更低单任务成本、更快速度帮助构建功能并产出规范的工作材料。
Sierra 把 Ghostwriter 从需要提示的 copilot 改造成常驻 Slack 和 Teams 的主动型 AI 队友,用户将其加入频道后可通过 @ 提及获取客服解决率趋势、销售漏斗转化图表或发起新实验。
OpenAI 智能体安全团队的 @joedaroo 表示,模型在“cyber”“swarming”“message boards”等相关事件上的能力跳变之突然远超预期,而安全态势需要时间积累,不只是加固系统,还要把它植入公司文化。他呼吁各组织自问:人员、系统和流程能否应对 AI 能力的突然跃升,是否有正确的事件响应、沟通机制和待命人员。
GitHub Security Lab 发布开源 seclab-taskflows 任务流,通过 gather_mobile_entry_point_info.yaml 和 classify_application_local.yaml 等提示词引导 LLM 审计 Android 应用,已发现并报告 24 个漏洞。
推荐理由:作者以第一手实践拆解了任务流设计与运行步骤,并给出真实漏洞案例和 LLM 局限,方法可直接迁移到自己的项目审计。
20 多位 AI 研究者在论文中警告,自我改进的 AI 可能引发智能爆炸,签署者包括 Geoffrey Hinton、Yoshua Bengio 和 OpenAI 研究负责人 Jakub Pachocki。
NVIDIA 发布 NVIDIA Open Agent Safety Platform,一个面向 AI Agent 安全的开放软件平台和参考系统设计,组合 OpenShell 安全运行时与运行在 BlueField-4 DPU 上的带外看护组件 Sentry,称超过 100 家组织参与。
FuseReg 正则化层融合缓解表征自编码器中的重建-生成差距 论文:https://huggingface.co/papers/2609.31620
Google 与 XPRIZE、Range Media Partners 合办的 Future Vision XPRIZE 在洛杉矶揭晓,独立电影人 Jeff Synthesized 凭《The Gifted》从全球 2500 多件参赛作品中获得大奖。
The Verge 报道 AI 智能体正在放大黑客攻击能力,小型医院、银行和非营利组织难以招架。Anthropic 曾披露一个网络犯罪团伙用 Claude Code 在一个月内勒索医疗机构。
Artificial Analysis 发布对 Claude Sonnet 5.5 的评测:其智能指数得分 56,max effort 下比 Sonnet 5 高 18 分,升至第 2 名,仅落后 Opus 5.5 (max)。
推荐理由:Artificial Analysis 实测指出 Sonnet 5.5 逼近 Opus 5.5 依赖约 193k 输出 token,成本细节对选型有直接参考价值。
Grok Bot 推出 Finance 集成,可连接银行、银行卡和投资账户,帮助管理支出和投资。作者建议结合其他连接器构建业务仪表盘、家庭预算工具,并通过排查忘记取消的订阅来省钱。
Anthropic 的 Claude Sonnet 5.5 上线 OpenRouter。原文称其明显比 Sonnet 5 更聪明、写作更清晰,且对多数工作负载快约 30%、便宜约 30%。
Nvidia CEO 黄仁勋周一发布 Nvidia Open Agent Safety Platform,将开源软件 OpenShell 与运行在 BlueField-4 数据处理器上的独立监控系统 Sentry 结合,在智能体之外提供隔离的安全层,宣称能在毫秒级隔离越界的智能体。
一个名为「绝对不是 Windows / Windows 11½」的独立恶搞项目上线,用假操作系统界面调侃现代软件的订阅、广告、AI 功能、更新提示和存储空间催促。项目声明与 Microsoft 无任何关联或授权,不索要 Microsoft 账号凭据,其访客计数器仅用浏览器随机 ID 加服务端编号记录访问次数。
如果你喜欢攻破系统、构建防护栏(并用前沿 AI 来帮你完成这两件事),欢迎加入我们的安全团队。Kyle 是个很棒的同事,他自己也写很多代码!
AWS 宣布 Claude Sonnet 5.5 在 Amazon Bedrock 和 Claude Platform on AWS 上线,定位为面向编码与知识工作的更高效 Sonnet 模型,多数任务单任务成本更低、速度更快。
推荐理由:AWS 官方给出 Sonnet 5.5 的定位、与 Opus 5.5 的分工以及 Bedrock 上的调用方式,便于判断何时选用。
OpenAI 宣布向 Lenfest Institute 的 AI Collaborative and Fellowship Program 追加 500 万美元资金,并提供最高 500 万美元的软件额度和工程支持,使其支持规模较此前翻倍。该计划自 2024 年启动以来已向 11 家美国新闻机构派驻 AI 工程研究员,此次将邀请新一批新闻机构加入。
Claude Code v2.1.284 将 Anthropic API 上的默认 Sonnet 模型升级为 Claude Sonnet 5.5(claude-sonnet-5-5),支持 1M 上下文,定价 $2/$10 per Mtok、缓存读取 $0.20/Mtok。
Anthropic 发布 Claude Sonnet 5.5,输出速度提升超过 30%,因每任务消耗 token 更少,有效成本最多降低 30%,多项基准接近 Opus 5.5。
推荐理由:Arena 介绍了其 Agent Arena 的评测方式,读者可以据此理解 Claude Sonnet 5.5 在真实智能体任务上的衡量口径。
推荐理由:Artificial Analysis 用自家基准拆解了性能与 token 成本的权衡,为选型提供了可对比的量化参考。
Anthropic 发布 Claude Sonnet 5.5,称为 Claude 5.5 家族的第二款模型,相比 Sonnet 5 是明显升级,运行速度提升超过 30%,多数工作成本最多降低 30%。
Anthropic 发布中端模型 Sonnet 5.5,官方称其比前代 Sonnet 5 快 30%,token 消耗明显更低。公司基准显示该模型在 agentic 编码上优于 Opus 5.5,并称其具备与 Opus 5 相当的网络安全能力,因此成为首个适用与 Fable 和 Opus 相同网络安全防护的 Sonnet 模型;公司还计划在未来几周发布新版本 Haiku。