Amazon Quick 与 Bedrock 如何用实时 ACL 重构 RAG 访问控制
Amazon Quick 与 Amazon Bedrock Knowledge Bases 在原有预检索 ACL 过滤之上新增实时 ACL 校验,在查询时直接向权威数据源核实权限。
Amazon Quick 与 Amazon Bedrock Knowledge Bases 在原有预检索 ACL 过滤之上新增实时 ACL 校验,在查询时直接向权威数据源核实权限。
AWS 宣布 Claude Haiku 5.5 在 Amazon Bedrock 和 Claude Platform on AWS 上可用。
推荐理由:文章给出 Haiku 5.5 在 Bedrock 上的可用区域、成本变化与代码调用方式,便于判断它在多智能体分层中的位置。
在旧金山 Microsoft 活动上,NVIDIA 与 Microsoft 宣布为 Windows PC 的智能体时代共同设计软硬件,Microsoft 宣布 OS 级基础设施 Microsoft Execution Containers(MXC)正式可用,让智能体在系统控制下安全持久地在后台运行。
推荐理由:NVIDIA 与 Microsoft 把智能体运行所需的系统级容器和本地算力硬件一起端上 Windows,读者可据此判断本地智能体的落地条件。
GitHub 发布与 Microsoft Applied Sciences 联合微调的 ModernBERT 分类器,用代码上下文识别无固定格式的密钥,可在 2 毫秒内评估一批候选密钥,据称能把可拦截的密钥数量提升一倍以上。
推荐理由:GitHub 公开了九季度密钥泄露数据,并说明新分类器如何把防护从推送后前移到推送前。
Cornerstone OnDemand 基于 Amazon Bedrock 和 AWS 开源智能体编排框架 Strands Agents 构建了多智能体系统 Orion AI,将数据库诊断时间从每次事故约 45 分钟降至 10 分钟,缩短 78%。
AWS 推出六周结构化项目,让没有工程背景的业务人员用 Amazon Bedrock、AgentCore 和 Strands Agents SDK 构建可运行的 AI 原型。
AWS 展示了一套自动化修复工作流:AWS DevOps Agent 完成事件调查后,通过 Amazon EventBridge 触发 Lambda,再由 Amazon Bedrock 分析调查结果并从批准的 Lambda 工具白名单中提出修复方案。
Qlik 基于 Amazon Bedrock 构建的 Qlik Answers 自 2026 年 2 月正式可用以来,其 Discovery Agent 已为客户发现超过 10 万条异常与离群点,多数启用智能体工具的 Qlik Cloud 账户正在活跃使用。
AWS 提出 Agentic Value Model,用于为智能体自动化构建商业论证,替代按「节省工时×人力成本−建设成本」计算的 RPA 时代 ROI 模型。
微软研究院开源 Agent Lightning v1.0,这是一个约 3500 行代码的轻量智能体强化学习框架,提出 Harnessed Agentic RL 范式,让部署时使用的 agent harness 直接参与训练,无需在训练框架内重新实现 agent。
推荐理由:微软研究院开源 Agent Lightning v1.0,用约 3500 行代码把真实 harness 直接接入强化学习训练,读者可了解其轻量化设计与训练收益。
AWS 发布教程,展示如何用开源智能体系统 OpenClaw 在 Amazon Bedrock AgentCore 上构建具备长期记忆的个人助手。AgentCore memory 将一次性对话转为持久知识,并支持用结构化元数据标记记忆以便检索。
AWS 发文解读国际标准 ISO/IEC 42005:2025,说明如何将 AI 系统影响评估整合进企业风险管理体系。该标准覆盖评估全生命周期,包括范围界定与执行、分析与报告、持续监控与复查,并提供 Annex D 整合流程与 Annex E 独立模板。
基于 Amazon Bedrock AgentCore、Amazon Bedrock Knowledge Bases 和 Amazon Nova 2.5 Sonic,可在航空公司应用中搭建语音旅行助手,让旅客通过语音查询行程、改座位、更新餐食偏好并转接人工客服。
Amazon SageMaker HyperPod Spaces 现可直接在 SageMaker Studio UI 中创建和管理,数据科学家无需命令行工具即可在 HyperPod EKS 集群上启动 JupyterLab 和 Code Editor 环境。
AWS 介绍通过 SageMaker Unified Studio 管理 SageMaker HyperPod 集群的治理方法,将控制划分为组织、项目、集群、工作负载四层。
NVIDIA 最新《State of AI in Telecommunications》报告显示,89% 受访者认为开源模型与软件对公司 AI 战略重要。
Z.ai(智谱 AI)的 GLM 5.3 已在 Amazon Bedrock 上线,这是一个 753B 参数的 MoE 模型,面向编码和长周期智能体任务。Bedrock 提供全托管 API、跨区域推理、提示词缓存和服务层级,支持 OpenAI 兼容的 Responses 与 Chat Completions API 以及 Invoke 和 Converse API。
推荐理由:GLM 5.3 在 Bedrock 上线,读者可了解其 753B MoE 规格、编码与安全能力及托管接入方式。
Amazon SageMaker AI 推出 aws-ai-ml 技能,通过 Agent Toolkit for AWS 提供给 Kiro、Claude Code、Codex 等编码智能体,使其具备推理优化与基准测试能力。
AWS 博客介绍在 AWS GovCloud (US) 中通过 Amazon Bedrock 使用 Claude Code 与 Claude Opus 5.5、Claude Sonnet 5.5、Claude Sonnet 5 开展 AI 辅助开发。
Amazon Bedrock AgentCore Evaluations 提供内置与自定义评估器,用于在多智能体系统的开发和生产阶段衡量准确性、任务成功率与行为表现。
Amazon Quick 控制台无法直接将用户从 Admin 或 Author 降级为 Reader,update-user API 也会以“You cannot downgrade a user role”报错拒绝。
Amazon Bedrock Managed Knowledge Base 现已支持智能体检索,通过 AgenticRetrieveStream API 将多部分问题拆分为子查询并迭代判断证据是否充分,而标准 Retrieve API 仅执行一次混合搜索。langchain-aws 包同时暴露两种检索方式,文章对比了同一多部分问题在两条路径下的表现与成本。
AWS 发布 Quick Resource Migrator 示例 MCP 服务器,托管于 Amazon Bedrock AgentCore,可在单次工具调用中把 Amazon Quick 的 chat agents、action connectors、知识库、flows 和 spaces 从开发账户迁移到生产账户。
AWS 介绍了如何用 Amazon SageMaker AI 的多轮强化学习(MTRL)微调搜索智能体,并在检索质量与可靠性上给出实测结果。方案以 Qwen3.6-27B 为基础模型,环境提供 BM25 词法搜索与向量搜索两种工具,并限制交互轮数。
AWS 发布教程,演示如何通过 Amazon Bedrock AgentCore Gateway 为 Claude Desktop 接入 Web Search,填补模型训练知识截止后的信息缺口。
AWS 提出 Adjudicated Query 设计模式,让业务用户在 Amazon Quick 聊天界面中用自然语言提问,实际合规判定交由确定性规则引擎完成,模型只负责把问题翻译成固定类型操作并转述结果。
NVIDIA 宣布本月推出 64GB 统一内存版 DGX Spark,由 Acer、ASUS、Dell、Gigabyte、HP 和 MSI 等厂商伙伴独家发售,10 月 23 日上市,起售价 4999 美元。
推荐理由:NVIDIA 官方给出 64GB 版 DGX Spark 的定价、上市时间与双机集群实测数据,可据此判断本地跑大模型的成本与扩展方式。
CoreWeave 宣布 NVIDIA Vera Rubin NVL72 系统搭配 Spectrum-X 102.4T 以太网在 CoreWeave Cloud 上可用,成为首批交付该平台的云厂商之一,Cognition 是首个在生产环境运行 Vera Rubin 的客户。
推荐理由:CoreWeave 上线 Vera Rubin NVL72 并公布 Devin 实测吞吐数据,可看到智能体推理与后训练基础设施的落地形态。
NVIDIA 提出 AI 工厂投资回报由三项因素决定:每兆瓦产出能力、硬件有效寿命和 token 需求。SemiAnalysis AgentX 数据显示,NVIDIA Vera Rubin NVL72 每兆瓦吞吐量比 GB300 NVL72 高 30 倍以上,在 DeepSeek V4 Pro 模型上每百万 token 成本最多低 45 倍。
GPT-6 Astra Ultrafast 已在 OpenAI API 上线,并向符合条件的 ChatGPT Work 和 Codex 用户开放,运行在 NVIDIA Blackwell GPU 上。
推荐理由:原文给出 Ultrafast 相对标准模式的加速幅度与开放入口,读者可据此判断它对编码智能体循环的实际影响。
微软研究院开发了一套端到端机器学习流水线,利用 L1 拉格朗日点的太阳风观测数据,为美国本土 66,935 座变电站生成 30-60 分钟前的空间天气风险预测。系统结合 AE 与 Dst 指数预测、地质电导率和电网数据,在 2020-2026 年评估期内检测到近 80% 的重大空间天气事件,其中 Dst 预测器在 62.2% 的高活跃时段优于 Burton 方程。
AWS 官方博客演示在 Amazon Bedrock AgentCore Runtime Instances 上部署三智能体音乐制作流水线:作曲智能体在实例自带的 NVIDIA L4 上运行开源音乐生成模型 ACE-Step,交付智能体读取共享卷上的 .wav 做 DSP 处理,合规智能体独立复测并做相似度筛查。
Amazon Bedrock Knowledge Bases 可通过 AgenticRetrieveStream API 用自然语言查询理赔文档,支持多轮追问、按 claim ID 和 claim type 等元数据过滤检索,并返回带引用的答案。
uniopen 通过 Amazon SageMaker AI 对 Amazon Nova 2 Lite 进行监督微调,并做提示词层面的输出优化,使其适配自身零售审核策略。
AWS 博客给出 Claude Platform on AWS(CPonAWS)多环境访问的完整实施步骤:在组织内建专用 AI Services 账户承载订阅与工作区,工作负载账户通过跨账户 SigV4 角色调用推理,无需存储 API key。
Amazon Bedrock AgentCore 支持构建"环境智能体"(ambient agent):它监听 Amazon S3 事件通知、EventBridge 规则等事件流并自动触发任务,在需要时通过单个 ask_human 工具暂停等待人工审批,再从中断处恢复执行。
Amazon Payments 在 Amazon SageMaker AI 上用多目标上下文多臂老虎机(LinUCB)为产品获客漏斗做个性化内容选择,七周线上 A/B 测试中,一个人群组的最终漏斗转化率取得高个位数百分比的相对提升,另一人群组则未见改善,问题出在内容而非模型。
NVIDIA NeMo Agent Toolkit(NAT)可通过自定义 memory provider 接入 Amazon S3 Vectors,作为多智能体系统的持久化记忆层,并部署在 Amazon EKS 上。
Amazon Quick 为 AI 构建的 Quick Apps 推出 Live Data in Apps,应用每次打开时都会实时查询受治理的 Quick Sight 数据集,而非依赖构建时的静态快照。
AWS Professional Services 用四个智能体组成的模式,把每个应用的 IaC 开发时间从 3 到 4 周压缩到几分钟,该模式基于 Strands Agents SDK 构建、运行在 Amazon Bedrock AgentCore 上,通过 AgentCore Gateway 暴露的 MCP 工具连接源与目标系统。