全部AI 动态
全部动态
今日 13 条
OpenRouter@OpenRouterAI 评分5454
AI at Meta@AIatMetaAI 评分5757
AI at Meta@AIatMetaAI 评分3838OpenAI:官网动态(RSS · 排除企业/客户案例)AI 评分5050 1Password 借助 Codex 将工程效率提升 21%
1Password 将 Codex 集成至软件交付全流程,核心用户群工程效率提升 20.9%,中位 PR 周期缩短 10.9%。按 50 名活跃 Codex 开发者建模,年工程产能价值约 78.4 万美元,ROI 达 553%。1Password 正将 Codex 扩展至财务、市场等部门,并通过密钥引用机制确保明文凭据不进入模型上下文。
OpenAI Developers@OpenAIDevs精选AI 评分5959OpenAI 推出 API 新图像模型 GPT-Image-2.5 Flare 和 Sunburst,主要改进包括更锐利的细节、更强的风格遵循,以及更多对图像编辑的控制。
推荐理由:原文给出两款新图像模型在细节、风格遵循和编辑控制上的能力变化,读者可以据此判断 API 图像工作流的升级点。
ViggleAI@ViggleAIAI 评分5555
MiniMax (official)@MiniMax_AIAI 评分2929
OpenAI@OpenAI精选AI 评分5757推荐理由:官方列出了速度、保真度和多次编辑一致性等具体改进点,读者可据此评估是否更新自己的图像生成工作流。
OpenAI:官网动态(RSS · 排除企业/客户案例)精选AI 评分7979 OpenAI 发布 ChatGPT Images 2.5 图像模型
OpenAI 发布 ChatGPT Images 2.5 图像模型,生成延迟比 Images 2.0 降低最多 50%,细节、编辑精度、参考照片保真度和多轮编辑一致性均有提升。
推荐理由:官方原文给出与 Images 2.0 的具体对比数据、新功能入口和 API 双模型分工,读者可以据此评估是否迁移现有图像工作流。
OpenClaw🦞@openclawAI 评分2929
Krea@krea_aiAI 评分4848推出 Realtime Director。 这款新工具可让你实时导演高质量视频生成。 由 @fal 的 H3 Max 提供支持。
OpenAI:官网动态(RSS · 排除企业/客户案例)精选AI 评分8686 OpenAI 宣布以内部 AI 系统给出 Navier–Stokes 千禧年问题解答
OpenAI 宣布其内部 AI 系统给出 Navier–Stokes 存在与光滑性问题的解答,证明初始光滑的流体可在有限时间内形成奇点,并附证明文稿与 Lean 形式化验证。
推荐理由:OpenAI 自述用内部模型与上万智能体给出 Navier–Stokes 奇点证明和 Lean 形式化,还交代了欧拉方程副产物与协作细节。
World Labs@theworldlabsAI 评分1515Databricks:Blog(RSS)AI 评分3535 Databricks 如何用 Temporal 和 Lakebase 构建持久化智能体
Databricks 介绍如何结合 Temporal 与 Lakebase 构建持久化 AI 智能体,以个人贷款审批场景为例,展示智能体在收集证据、应用策略及等待外部输入等环节中的状态保持与恢复能力。文章聚焦于架构设计与工程实践,而非发布新模型或产品。
LangChain:Blog(RSS)AI 评分5858 LangChain 讲解 deepagents 多智能体框架中的上下文组织方式
LangChain 发布博客,介绍 deepagents 中的 context modes 如何帮助子智能体分叉 supervisor 的上下文或以隔离方式启动,从而让多智能体工作更快、更省、更聚焦。
Tripo@tripoaiAI 评分4949Claude:Blog(网页)精选AI 评分6767 Anthropic 发布 Claude Platform 降本指南并更新 claude-api 技能
Anthropic 介绍用 Claude Platform 降低成本、保持性能的三种方法:提高提示词缓存命中率、升级到前沿模型时清除提示词反模式、按任务校准 effort。
推荐理由:官方给出了提示词缓存、反模式清理和 effort 校准三类降本方法及实测数字,可直接迁移到自己的 Claude API 应用。
Gary Marcus:The Road to AI We Can Trust(RSS)AI 评分3434 OpenAI 的严重不当行为模式:七天九起令人不安的新报告
过去七天内出现了九份令人不安的新报告,指向 OpenAI 存在严重不当行为模式。这些报告涉及的具体事件与细节尚未在原文中展开,但整体趋势表明该公司的行为问题正在持续累积。文章以此为依据,对 OpenAI 的运营方式提出质疑。
OpenAI@OpenAIAI 评分7676
OpenAI@OpenAI精选AI 评分7474推荐理由:原文补充了数据隔离说明,并指出其 Euler 情形证明结果与 Alpöge 和 Buckmaster 的工作不同,读者可据此比较两条独立证明路径。
OpenCode@opencodeAI 评分2626
OpenCode@opencodeAI 评分2121
MeshyAI@MeshyAIAI 评分3535
Google Gemini@GeminiAppAI 评分4040
Microsoft Research@MSFTResearchAI 评分1414OpenAI:官网动态(RSS · 排除企业/客户案例)AI 评分4141 OpenAI 推出 500 万美元资助计划,支持生成式 AI 对青少年发展影响的研究
OpenAI 启动一项 500 万美元的资助计划,支持关于生成式 AI 如何影响青少年发展、福祉与安全的独立研究。该计划现已开放申请。
ClaudeDevs@ClaudeDevs精选AI 评分6868Anthropic 团队文章指出,优化 prompt cache 命中率、清除升级到前沿 Claude 模型后的提示词反模式、校准 effort 三个手段可在不牺牲性能的情况下降低成本。
推荐理由:官方团队给出提示词缓存、反模式清理和 effort 校准三条降本路径,并用公开基准实测数字支持,方法可迁移到自己的 Claude 应用。
Dwarkesh Patel:Podcast & Blog(RSS)精选AI 评分6060 Dwarkesh Patel 研究:预训练进步主要来自数据改进
Dwarkesh Patel 发布实验分析,在最高 1e19 FLOPs 的算力预算下训练 2019 至 2025 年各年度代表性模型配方与数据语料,发现数据改进带来 12.0x 算力效率提升,模型改进为 3.7x,数据贡献约为模型的 3.24 倍。
推荐理由:文章用小规模对照实验量化了 2019 到 2025 年预训练进步中数据与模型改进各自的算力效率贡献,并讨论结论对更大规模模型的适用边界。
OpenClaw🦞@openclawAI 评分5050
Ant Ling@AntLingAGIAI 评分5252
MeshyAI@MeshyAIAI 评分4949Meshy 应用正式在 iOS 和 Android 上线! 在应用商店搜索 "Meshy AI" 即可开始使用。 拍张照片。转成 3D。即可打印。📸
AGIBOT 智元(网页)AI 评分5252 智元发布GE-Act 2.0,首次验证原生世界—动作模型预训练与Scaling路径
智元发布原生世界—动作模型GE-Act 2.0,所有参数从随机初始化在具身操作数据上从头训练,不针对评测任务微调或示范。
Preferred Networks:AI 研究与产品AI 评分4141 PFN 与 PFR 共同开发室内移动机器人环境理解基座模型 PLaMo-SemGround
Preferred Networks(PFN)与 Preferred Robotics(PFR)宣布共同开发室内移动机器人环境高度理解基座模型 PLaMo-SemGround,参数规模在 2B 级以下,可从自然语言、RGB 图像和深度信息中理解可行驶/禁行区域及复杂作业条件。
Preferred Networks:AI 研究与产品AI 评分3939 Preferred Networks 的 AI 面试服务「タレスカAI面接」被 CMIC 集团新卒招聘采用
Preferred Networks 的 AI 面试服务「タレスカAI面接」被 CMIC 控股及旗下 3 家集团公司采用,用于 2028 年 4 月入职的新卒招聘选拔。
Cognition 模型 / Devin 博客(网页)精选AI 评分7676 Cognition 团队用 Devin 完成 RSA-260 分解,刷新公开 RSA 挑战纪录
Cognition 研究团队驱动多个 Devin 智能体构建 GPU 格子筛,用约 4,900 GPU 天(约 40 万美元)完成 260 位 RSA-260 分解,创下公开 RSA 分解挑战新纪录,超越 2020 年 2 月的 RSA-250。
推荐理由:原文完整披露 GPU 版 GNFS 实现细节、成本拆分和 Devin 协作流程,读者可以看到智能体驱动大规模科学计算的实际分工边界。
NVIDIA Technical Blog:Agentic AI / Generative AIAI 评分4646 NVIDIA Dynamo 何时该用 Encode-Prefill-Decode 分离加速多模态模型服务
NVIDIA 详解在 Dynamo 推理框架中用 encode-prefill-decode(EPD)分离加速多模态模型服务:把视觉编码器与 prefill、decode 拆成可独立扩缩的 worker,图像密集提示词下 TTFT 最高快 5 倍、端到端响应最高快 7 倍。
OpenBMB@OpenBMBAI 评分3535
SenseTime@SenseTime_AIAI 评分4646
Tripo@tripoaiAI 评分3131Nathan Lambert:Interconnects(RSS)AI 评分5151 开源动态第 24 期:Motif-3、GLM-5.3、Hy4-preview 与开源模型许可证趋势
本期开源模型汇总指出,2026 年开源模型竞争加剧带来许可证分化:Google 和 Meta 转向 Apache 2.0,而智谱 GLM-5.3 从 MIT 改为自定义许可证,要求年收入超 100 亿美元的推理或微调服务商通过 Z.AI 安全审查,且未定义关联方带来不确定性。