OpenAI 在 ChatGPT 全球上线 GPT-6 与 Intelligent UI
OpenAI 宣布 GPT-6 正在 ChatGPT 中面向全球上线,并同步推出 Intelligent UI。官方称新版本响应更快,提供可视化内容与可直接探索和使用的交互体验。
推荐理由:OpenAI 官方公布 GPT-6 在 ChatGPT 全球上线,并同步引入 Intelligent UI,读者可据此了解模型与交互形态的同步变化。
OpenAI 宣布 GPT-6 正在 ChatGPT 中面向全球上线,并同步推出 Intelligent UI。官方称新版本响应更快,提供可视化内容与可直接探索和使用的交互体验。
推荐理由:OpenAI 官方公布 GPT-6 在 ChatGPT 全球上线,并同步引入 Intelligent UI,读者可据此了解模型与交互形态的同步变化。
Amazon Quick 与 Amazon Bedrock Knowledge Bases 在原有预检索 ACL 过滤之上新增实时 ACL 校验,在查询时直接向权威数据源核实权限。
AWS 宣布 Claude Haiku 5.5 在 Amazon Bedrock 和 Claude Platform on AWS 上可用。
推荐理由:文章给出 Haiku 5.5 在 Bedrock 上的可用区域、成本变化与代码调用方式,便于判断它在多智能体分层中的位置。
在旧金山 Microsoft 活动上,NVIDIA 与 Microsoft 宣布为 Windows PC 的智能体时代共同设计软硬件,Microsoft 宣布 OS 级基础设施 Microsoft Execution Containers(MXC)正式可用,让智能体在系统控制下安全持久地在后台运行。
推荐理由:NVIDIA 与 Microsoft 把智能体运行所需的系统级容器和本地算力硬件一起端上 Windows,读者可据此判断本地智能体的落地条件。
Radisson Hotel Group 与 Accenture 合作,基于 OpenAI 技术打造了一款 ChatGPT 插件,让旅客在规划行程时即可查找、比较并预订酒店。
GitHub 发布与 Microsoft Applied Sciences 联合微调的 ModernBERT 分类器,用代码上下文识别无固定格式的密钥,可在 2 毫秒内评估一批候选密钥,据称能把可拦截的密钥数量提升一倍以上。
推荐理由:GitHub 公开了九季度密钥泄露数据,并说明新分类器如何把防护从推送后前移到推送前。
OpenAI 为 ChatGPT for Teens 推出 College Planner,帮助学生管理大学申请,同时上线新的 flashcards 和 quizzes 功能。OpenAI 还宣布成立一个青少年 AI 委员会(teen AI council)。
Cornerstone OnDemand 基于 Amazon Bedrock 和 AWS 开源智能体编排框架 Strands Agents 构建了多智能体系统 Orion AI,将数据库诊断时间从每次事故约 45 分钟降至 10 分钟,缩短 78%。
AWS 推出六周结构化项目,让没有工程背景的业务人员用 Amazon Bedrock、AgentCore 和 Strands Agents SDK 构建可运行的 AI 原型。
AWS 展示了一套自动化修复工作流:AWS DevOps Agent 完成事件调查后,通过 Amazon EventBridge 触发 Lambda,再由 Amazon Bedrock 分析调查结果并从批准的 Lambda 工具白名单中提出修复方案。
Qlik 基于 Amazon Bedrock 构建的 Qlik Answers 自 2026 年 2 月正式可用以来,其 Discovery Agent 已为客户发现超过 10 万条异常与离群点,多数启用智能体工具的 Qlik Cloud 账户正在活跃使用。
AWS 提出 Agentic Value Model,用于为智能体自动化构建商业论证,替代按「节省工时×人力成本−建设成本」计算的 RPA 时代 ROI 模型。
微软研究院开源 Agent Lightning v1.0,这是一个约 3500 行代码的轻量智能体强化学习框架,提出 Harnessed Agentic RL 范式,让部署时使用的 agent harness 直接参与训练,无需在训练框架内重新实现 agent。
推荐理由:微软研究院开源 Agent Lightning v1.0,用约 3500 行代码把真实 harness 直接接入强化学习训练,读者可了解其轻量化设计与训练收益。
Jump Trading 使用 OpenAI 扩展量化研究,通过运行时间更长的 AI 工作流整合多个数据源,并结合人工审核。
OpenAI 发布内部前沿模型在数学开放问题上的新结果,并公开 Lean 证明形式化及研究细节。相关材料已发布在 GitHub 上。
推荐理由:OpenAI 公开内部前沿模型在数学开放问题上的结果,并同步放出 Lean 证明形式化与细节,可供研究者直接复核。
Google DeepMind 发布 EmbeddingGemma 2,将文本、代码、图像、视频和音频映射到统一嵌入空间,采用 Apache 2.0 许可,参数量 7.4 亿。
推荐理由:EmbeddingGemma 2 把文本、图像、音频、视频统一到同一嵌入空间,并给出端侧内存与向量截断的具体数据,便于判断本地检索与 RAG 的可行性。
AWS 发布教程,展示如何用开源智能体系统 OpenClaw 在 Amazon Bedrock AgentCore 上构建具备长期记忆的个人助手。AgentCore memory 将一次性对话转为持久知识,并支持用结构化元数据标记记忆以便检索。
OpenAI 与 Ironclad 正围绕复杂的合同工作流训练和评估 AI 智能体,以推进面向专业工作的 computer use 能力。该合作聚焦合同流程这一专业场景,用于检验智能体在真实业务操作中的表现。
Atlassian 与 OpenAI 扩大合作,把前沿模型与企业知识连接起来,帮助团队规划、构建和交付工作。双方称此次合作旨在让企业知识转化为可执行的行动。
AWS 发文解读国际标准 ISO/IEC 42005:2025,说明如何将 AI 系统影响评估整合进企业风险管理体系。该标准覆盖评估全生命周期,包括范围界定与执行、分析与报告、持续监控与复查,并提供 Annex D 整合流程与 Annex E 独立模板。
微软研究院合伙人研究经理 Jennifer Neville 在 Microsoft Research Podcast 中与首席应用科学家 Chad Atalla 对谈,讨论评测如何推动 AI 系统性能边界、以及模型在传统 benchmark 之外测试时出现的「意外失败」。她分享了使用当前 AI 系统的实用建议,并强调当结果与预期不符时应仔细审视数据。
基于 Amazon Bedrock AgentCore、Amazon Bedrock Knowledge Bases 和 Amazon Nova 2.5 Sonic,可在航空公司应用中搭建语音旅行助手,让旅客通过语音查询行程、改座位、更新餐食偏好并转接人工客服。
Amazon SageMaker HyperPod Spaces 现可直接在 SageMaker Studio UI 中创建和管理,数据科学家无需命令行工具即可在 HyperPod EKS 集群上启动 JupyterLab 和 Code Editor 环境。
AWS 介绍通过 SageMaker Unified Studio 管理 SageMaker HyperPod 集群的治理方法,将控制划分为组织、项目、集群、工作负载四层。
NVIDIA 最新《State of AI in Telecommunications》报告显示,89% 受访者认为开源模型与软件对公司 AI 战略重要。
Z.ai(智谱 AI)的 GLM 5.3 已在 Amazon Bedrock 上线,这是一个 753B 参数的 MoE 模型,面向编码和长周期智能体任务。Bedrock 提供全托管 API、跨区域推理、提示词缓存和服务层级,支持 OpenAI 兼容的 Responses 与 Chat Completions API 以及 Invoke 和 Converse API。
推荐理由:GLM 5.3 在 Bedrock 上线,读者可了解其 753B MoE 规格、编码与安全能力及托管接入方式。
Amazon SageMaker AI 推出 aws-ai-ml 技能,通过 Agent Toolkit for AWS 提供给 Kiro、Claude Code、Codex 等编码智能体,使其具备推理优化与基准测试能力。
AWS 博客介绍在 AWS GovCloud (US) 中通过 Amazon Bedrock 使用 Claude Code 与 Claude Opus 5.5、Claude Sonnet 5.5、Claude Sonnet 5 开展 AI 辅助开发。
GitHub 发布 ReviewBench,一个面向 AI 代码审查智能体的开放离线基准,基于 1.039 亿个 GitHub PR 的分布特征构建,包含来自 187 个开源仓库、覆盖 19 种语言的 219 个 PR。
推荐理由:GitHub 公开了代码审查基准的构建方法与评分口径,读者可据此理解 AI 代码审查评测如何贴近真实 PR 分布。
Amazon Bedrock AgentCore Evaluations 提供内置与自定义评估器,用于在多智能体系统的开发和生产阶段衡量准确性、任务成功率与行为表现。
Amazon Quick 控制台无法直接将用户从 Admin 或 Author 降级为 Reader,update-user API 也会以“You cannot downgrade a user role”报错拒绝。
Amazon Bedrock Managed Knowledge Base 现已支持智能体检索,通过 AgenticRetrieveStream API 将多部分问题拆分为子查询并迭代判断证据是否充分,而标准 Retrieve API 仅执行一次混合搜索。langchain-aws 包同时暴露两种检索方式,文章对比了同一多部分问题在两条路径下的表现与成本。
AWS 发布 Quick Resource Migrator 示例 MCP 服务器,托管于 Amazon Bedrock AgentCore,可在单次工具调用中把 Amazon Quick 的 chat agents、action connectors、知识库、flows 和 spaces 从开发账户迁移到生产账户。
OpenAI 就欧盟文本溯源规则说明其文本水印方案:介绍水印的适用范围、检测机制如何运作,以及为何访问权限首先面向研究人员开放。
NVIDIA Inception 计划中的多家初创公司正用 AI 覆盖乳腺癌筛查、风险评估与治疗规划环节。iSono Health 的 FDA 认证 ATUSA 可穿戴 3D 超声系统约两分钟完成单侧乳房标准化扫描,公司称其灵敏度比手持 2D 超声高 28%;Whiterabbit.ai 的 WRDensity 已用于数十万患者,并研发新一代乳腺 X 光 AI。
OpenAI 在 ChatGPT 中引入新的视觉广告格式,并扩展了面向广告主的衡量工具、归因合作与品牌适配能力。该举措围绕人们使用 AI 的方式设计广告投放。
Chatham Financial 使用 OpenAI 的 Codex 和 GPT-5.6 构建技术并重新设计工作流程,将交易验证时间从 30 分钟缩短到 4 分钟以内。
AWS 介绍了如何用 Amazon SageMaker AI 的多轮强化学习(MTRL)微调搜索智能体,并在检索质量与可靠性上给出实测结果。方案以 Qwen3.6-27B 为基础模型,环境提供 BM25 词法搜索与向量搜索两种工具,并限制交互轮数。
AWS 发布教程,演示如何通过 Amazon Bedrock AgentCore Gateway 为 Claude Desktop 接入 Web Search,填补模型训练知识截止后的信息缺口。
AWS 提出 Adjudicated Query 设计模式,让业务用户在 Amazon Quick 聊天界面中用自然语言提问,实际合规判定交由确定性规则引擎完成,模型只负责把问题翻译成固定类型操作并转述结果。