跳到正文

全部动态

今日 13 条
9月9日周三
  1. OpenAI:官网动态(RSS · 排除企业/客户案例)50

    1Password 借助 Codex 将工程效率提升 21%

    1Password 将 Codex 集成至软件交付全流程,核心用户群工程效率提升 20.9%,中位 PR 周期缩短 10.9%。按 50 名活跃 Codex 开发者建模,年工程产能价值约 78.4 万美元,ROI 达 553%。1Password 正将 Codex 扩展至财务、市场等部门,并通过密钥引用机制确保明文凭据不进入模型上下文。

  2. OpenAI:官网动态(RSS · 排除企业/客户案例)79

    OpenAI 发布 ChatGPT Images 2.5 图像模型

    OpenAI 发布 ChatGPT Images 2.5 图像模型,生成延迟比 Images 2.0 降低最多 50%,细节、编辑精度、参考照片保真度和多轮编辑一致性均有提升。

    推荐理由:官方原文给出与 Images 2.0 的具体对比数据、新功能入口和 API 双模型分工,读者可以据此评估是否迁移现有图像工作流。

  3. OpenAI:官网动态(RSS · 排除企业/客户案例)86

    OpenAI 宣布以内部 AI 系统给出 Navier–Stokes 千禧年问题解答

    OpenAI 宣布其内部 AI 系统给出 Navier–Stokes 存在与光滑性问题的解答,证明初始光滑的流体可在有限时间内形成奇点,并附证明文稿与 Lean 形式化验证。

    推荐理由:OpenAI 自述用内部模型与上万智能体给出 Navier–Stokes 奇点证明和 Lean 形式化,还交代了欧拉方程副产物与协作细节。

  4. Databricks:Blog(RSS)35

    Databricks 如何用 Temporal 和 Lakebase 构建持久化智能体

    Databricks 介绍如何结合 Temporal 与 Lakebase 构建持久化 AI 智能体,以个人贷款审批场景为例,展示智能体在收集证据、应用策略及等待外部输入等环节中的状态保持与恢复能力。文章聚焦于架构设计与工程实践,而非发布新模型或产品。

  5. Claude:Blog(网页)67

    Anthropic 发布 Claude Platform 降本指南并更新 claude-api 技能

    Anthropic 介绍用 Claude Platform 降低成本、保持性能的三种方法:提高提示词缓存命中率、升级到前沿模型时清除提示词反模式、按任务校准 effort。

    推荐理由:官方给出了提示词缓存、反模式清理和 effort 校准三类降本方法及实测数字,可直接迁移到自己的 Claude API 应用。

  6. Gary Marcus:The Road to AI We Can Trust(RSS)34

    OpenAI 的严重不当行为模式:七天九起令人不安的新报告

    过去七天内出现了九份令人不安的新报告,指向 OpenAI 存在严重不当行为模式。这些报告涉及的具体事件与细节尚未在原文中展开,但整体趋势表明该公司的行为问题正在持续累积。文章以此为依据,对 OpenAI 的运营方式提出质疑。

  7. Dwarkesh Patel:Podcast & Blog(RSS)60

    Dwarkesh Patel 研究:预训练进步主要来自数据改进

    Dwarkesh Patel 发布实验分析,在最高 1e19 FLOPs 的算力预算下训练 2019 至 2025 年各年度代表性模型配方与数据语料,发现数据改进带来 12.0x 算力效率提升,模型改进为 3.7x,数据贡献约为模型的 3.24 倍。

    推荐理由:文章用小规模对照实验量化了 2019 到 2025 年预训练进步中数据与模型改进各自的算力效率贡献,并讨论结论对更大规模模型的适用边界。

  8. Cognition 模型 / Devin 博客(网页)76

    Cognition 团队用 Devin 完成 RSA-260 分解,刷新公开 RSA 挑战纪录

    Cognition 研究团队驱动多个 Devin 智能体构建 GPU 格子筛,用约 4,900 GPU 天(约 40 万美元)完成 260 位 RSA-260 分解,创下公开 RSA 分解挑战新纪录,超越 2020 年 2 月的 RSA-250。

    推荐理由:原文完整披露 GPU 版 GNFS 实现细节、成本拆分和 Devin 协作流程,读者可以看到智能体驱动大规模科学计算的实际分工边界。

9月8日周二