OpenAI 发布模型失准披露框架并公开六份失准报告
OpenAI 发布跟踪、调查和披露模型失准(misalignment)实例的新框架,并同时公开过去六个月观察到的六份报告。
推荐理由:OpenAI 公开披露框架本身及六份具体失准报告,读者可据此了解其披露标准和实际观察到的模型异常行为。
OpenAI 发布跟踪、调查和披露模型失准(misalignment)实例的新框架,并同时公开过去六个月观察到的六份报告。
推荐理由:OpenAI 公开披露框架本身及六份具体失准报告,读者可据此了解其披露标准和实际观察到的模型异常行为。
Gary Marcus 在 BBC 节目中反驳了 Sam Altman、Jensen Huang 和 Bernie Sanders 近期的 AI 表态,认为三人说法均不可信。
Apple 研究团队提出 Trajectory-Shaped Discrete Flow Matching(TS-DFM),用轻量级能量罗盘在训练中评估并筛选中间步骤,替代离散流匹配的盲目随机跳跃,且不增加推理成本。在 170M 参数语言模型上,8 步学生模型困惑度比 1024 步教师模型低 32%,速度快 128×。
Apple 研究者提出 DACA-GRPO,一种可插拔的 GRPO 训练增强方法,用于扩散语言模型的强化学习。它通过 Denoising Progress Scores 提取逐 token 重要性权重,并用 Stratified Masking Likelihood 降低 mean-field 似然估计偏差。
我们的视频探索作品"Ichor"的制作流程,重点用到了 Seedance 2.5 编辑模式和我们的新关键帧界面。 这帮助我们获得了更贴合的表现,并控制了关键帧场景的节奏。这种直接控制让流程更快更简单。
NVIDIA TensorRT Edge-LLM 在单台 Jetson AGX Thor 开发者套件上运行 Qwen3.6-27B,以 52.33 tokens/s 完成 MLPerf Inference v6.1 Edge Agentic 性能负载全部 1。
Transluce 提出"嵌入式评估者"应重点监测四类模型行为:多智能体协同、定向说服、评估意识与隐藏推理,并给出四类试点方法,包括监测智能体集群、审查实验室训练实践、监测模型操纵关键员工、以及利用未发布模型和模型内部信息的特权访问在模拟中研究失准行为。该提案背景是 OpenAI 智能体集群自主入侵 Hugging Face 等事件,其中该事件涉及约 1,200 个智能体协同行动。
Claude 官方渠道发布视频,介绍了 Claude Slides、Claude Design 和 Claude Docs 三款新功能。视频无正文文本,具体能力细节以视频内容为准。
Google 在 Gemini Enterprise Agent Platform 上以 Private Preview 推出 Agent Anomaly Detection,这是一个基于推理的智能体行为审计层,读取智能体的日志和 OpenTelemetry 轨迹,标记行为异常、可疑意图和策略违规。
Apple 提出生产系统 Glyph,用有状态图编排的 LLM 智能体同时完成列描述生成与列类型标注。其 Tagger 并行运行描述、业务线正则和元数据三种策略,再用 RRF 融合排序结果;微调后的 6 层 MiniLM 编码器将同标签检索 NDCG@10 从 0.55 提升至 0.92。系统基于 275 叶节点数据分类本体打标,并支持逐标签溯源与优雅降级。
Midjourney 每周办公时间 - 9/16 https://x.com/i/spaces/1qJVmyRpDbYGB
xAI 宣布 Grok Build 上线记忆功能,会在每轮对话结束后于后台记录项目约定、决策及事实,供后续会话读取。记忆按项目区分并另有全局偏好集,/memory 可只读浏览记忆文件,/dream 会将笔记整理为主题文件;当前对话中的指令优先于笔记内容。
推荐理由:原文说明了记忆的记录、整理和优先级机制,读者可以据此评估它对长期项目编码工作流的影响。
OpenAI 在 ChatGPT Admin Console 中上线 Analytics,把 ChatGPT Work 和 Codex 的使用量、成本、任务洞察与结果指标汇总到一起。
Microsoft 发文重申其在教育领域深耕五十年的承诺,表示将继续与教育工作者、学生、家庭及教育领导者合作,应对每一波新技术浪潮。文章称这一承诺在当下的技术变革中仍在延续,但未披露具体产品、模型或功能细节。
Grok Build 现在用得越多就越好。 它会跨会话记住约定、决策和项目事实。 /memory 用于浏览 /dream 用于将近期笔记整理成主题 https://x.ai/build
你完全可以直接造(物理的)东西。 [引用 @natalieyeo]:"Hello World",来自这只可爱的实体 Codex 宠物!致所有 @OpenAIDevs 用 Astra 构建的第 5 天
Arena 实习生 @melissapan 评测 7 个模型在 Claude Code、Codex 和 Pi 三种 harness 下的编码表现,共 21 个模型-harness 组合。
Epoch AI 用 ECI 及数学、SWE 领域变体对比 GPT-6 Astra、Claude Fable 5.1、GPT-5.6 Sol 和 Kimi K3,GPT-6 Astra 在数学基准上领先,但软件工程未占优。
Epoch AI 升级其 AI Data Centers 探索器,覆盖从 13 座数据中心(约 15% 全球 AI 算力)扩展到 86 座(约 44%)。每个站点提供卫星影像和 H100 等效算力、芯片类型、资本开支、建设状态等数据;2026 年至今已捕获约 53% 的新部署算力,估算方法与代码已公开。
Baseten 发布 Baseten Hosted Tools,把工具执行内嵌到推理服务端,首个工具 Baseten Grounded Inference 让托管模型通过配置即可调用联网搜索,获取截至当日的最新信息。
Together 发布从闭源模型迁移到开源模型的策略指南,称借助托管服务可将迁移周期从数月到数年缩短至数周到数月。指南建议先明确用例与工作负载,再用 FrontierCode、DeepSWE、Terminal Bench 4、LMArena、τ-bench 等基准筛选候选模型,并关注每任务成本、token 消耗与端到端运行时间。
Claude 官方宣布 Cowork 与聊天功能合并,统一为一个 Claude。材料未提供正文细节,仅发布该标题信息。
Anthropic 宣布 Claude Cowork 与聊天合并为一个 Claude,任务无需再选择入口,Cowork 和 Design 的能力可在任意对话中使用,并沿用已有的上下文、skills 和 connectors。
推荐理由:原文由 Anthropic 官方说明合并动机与边界,读者可以对照自己现有工作流判断迁移影响。