跳到正文

全部动态

今日 13 条
9月24日周四
  1. ClaudeDevs68

    Claude Code 云会话正式可用,结束研究预览阶段,可在笔记本合盖后继续在 Anthropic 托管的基础设施上运行。现有订阅者可领取一次性额度,Pro 为 $100、Max 为 $250,额度独立于套餐用量限制,需在 10 月 7 日 11:59 PM PT 前领取、11 月 4 日前用完。

    推荐理由:云会话正式结束预览期,Pro 和 Max 订阅者可领取一次性额度,在本地受限或合盖后仍能继续任务。

  2. OpenAI72

    OpenAI 宣布 ChatGPT Voice 更新,即日起在最新版应用全球推送。语音功能现可使用邮件、日历和 Slack 等插件,并由 GPT-6 Astra、Sol 和 Luna 模型驱动。同时语音可在网页和移动端的 ChatGPT Work 中使用,仅通过说话即可在浏览器中创建文档、演示文稿、网站和表格,或处理复杂任务。

    推荐理由:官方宣布 ChatGPT Voice 接入插件和新模型并支持语音驱动工作流,读者可据此了解语音能力扩展到哪些日常任务。

  3. Modal 官方工程博客(RSS)46

    Modal 与 CMU 推出 Quail:单张 H100 上每分钟处理超 10 亿 token

    Modal 与 CMU Full Stack Data Lab 合作推出查询感知推理层 Quail,在单个 H100 GPU 上对某多表连接查询实现每分钟超 10 亿 token 的处理速度,比同硬件 vLLM 基线快 10 倍以上,Modal 上成本低于每 10 亿 token 6 美分。

  4. Apple Machine Learning Research(RSS)43

    Apple 提出 probe guidance:用冻结内部状态引导扩散语言模型

    Apple 提出 probe guidance,利用现有扩散模型冻结的内部状态构建引导信号,无需在推理时增加额外前向计算,即可让弱模型与强模型保持相近动态。该方法在连续扩散语言模型的无条件生成上取得新的 SOTA,应用于 1.7B 扩散语言模型时在多项选择题基准上持续提升。研究还发现,传统 autoguidance 中的弱模型必须来自训练的低熵区域。

  5. Gary Marcus:The Road to AI We Can Trust(RSS)65

    AI 公司负责人在联合国安理会简报会上警告 AI 可能危及全人类

    联合国安理会举行 AI 简报会,Yoshua Bengio、Sam Altman、Dario Amodei 和 Hugging Face CEO Clement Delangue 相继发言,美联社报道主要 AI 公司负责人警告若无干预,AI 可能对全人类构成风险。

    推荐理由:作者梳理了各方在安理会上达成的安全共识要点,并借病毒学家之口指出 Amodei 对酶发现类比 CRISPR 过于超前。

  6. OpenAI:官网动态(RSS · 排除企业/客户案例)57

    Sam Altman 在联合国安理会阐述 AI 风险与国际合作主张

    OpenAI CEO Sam Altman 在联合国安理会发表演讲,称 AI 进步加速使风险更紧迫,并提出必须避免的两种失败路径:失去对 AI 的控制,以及权力过度集中在少数人手中。他提出人类决策居中、成果惠及大众、赋能个体三项原则,呼吁建立国际前沿 AI 标准与事件报告机制,并提到数周前其一个模型求解了千年奖问题 Navier-Stokes 方程。

  7. OpenAI:官网动态(RSS · 排除企业/客户案例)28

    Airbnb 扩大对 GPT-6 Astra 等 OpenAI 前沿模型的访问权限

    Airbnb 与 OpenAI 达成新协议,让其工程和产品团队通过 OpenAI API 和 Amazon Bedrock 更广泛地使用包括 GPT-6 Astra 在内的前沿模型。Airbnb 此前已在内部 AI 助手中使用 Codex 及 GPT-5.6 Sol、Terra、Luna 等模型,其开发团队目前交付的功能数量比一年前多约 80%。

  8. Claude Code:GitHub Releases(RSS)45

    Claude Code v2.1.281 发布

    Claude Code v2.1.281 为 Claude apps gateway 的 Bedrock 上游新增 assume_role 与 guardrail 支持,并加入 settings.json 的 "attribution": false 以隐藏提交与 PR 署名。

  9. Tomer Tunguz 博客(VC 分析)72

    Tomer Tunguz:AI 最重要的市场在中段而非前沿模型

    Tomer Tunguz 分析认为企业 AI 用量集中在需要足够智能且价格可负担的多步骤工作流中段市场,降价竞争正是证据。Anthropic 前沿模型 Fable 5.1 上线前十二天仅占网关支出的 3.7%,大型企业账户的前沿模型 token 消耗占比从 8 月初的 53% 降至 9 月的 45%;Cursor 用微调 Kimi K2.5 将成本降低 86%。

    推荐理由:作者用多家网关价格与用量数据说明企业 AI 需求集中在性价比中段,前沿模型份额低于多数人预期。

  10. OpenAI:官网动态(RSS · 排除企业/客户案例)63

    OpenAI 联合 80 多位心理健康专家发布开放基准 MentalHealthBench

    OpenAI 发布开放基准 MentalHealthBench,评估 AI 在真实心理健康对话中的表现,由来自 22 个国家、19 种语言的 80 多位持证心理学家和精神科医生共同构建。

    推荐理由:原文给出基准的构建方法、评分权重设计和开放发布方式,研究者可据此复现或扩展心理健康方向的模型评测。

  11. OpenAI:官网动态(RSS · 排除企业/客户案例)28

    Harvey 用 GPT-6 Astra 将法律上下文转化为更完善的草稿

    Harvey 借助 GPT-6 Astra 提升法律文书起草,能处理更多上下文并生成结构更完整的输出。相比其他模型,Harvey 在文档格式和上下文感知上有显著改进,其 memory panel 可将律师偏好(如编号列表、优先采用 EDGAR、按优先级着色)直接带入起草流程。

  12. OpenAI:官网动态(RSS · 排除企业/客户案例)29

    invideo 借助 GPT-6 Astra 将调色效率提升 3 倍

    invideo 借助 GPT-6 Astra 将调色与色彩校正任务的成功率提升约 3 倍,并能在一天内生成约 50 个自定义特效。该模型以更少的推理步骤和输出 token 完成复杂剪辑规划,并能在任务变长时保持编辑者的原始意图。