全部AI 动态
全部动态
今日 13 条
OpenRouter@OpenRouterAI 评分2424
OpenRouter@OpenRouterAI 评分2525
OpenRouter@OpenRouterAI 评分3636
ClaudeDevs@ClaudeDevs精选AI 评分5151推荐理由:作者分享了用 Claude 测量、调试并提升 claude.ai 性能的具体方法,并附上提示词,读者可参考复用。
ClaudeDevs@ClaudeDevs精选AI 评分6868推荐理由:云会话正式结束预览期,Pro 和 Max 订阅者可领取一次性额度,在本地受限或合盖后仍能继续任务。
ClaudeDevs@ClaudeDevsAI 评分5353
PixVerse@PixVerseAI 评分3838飞船上的人们正在死去,Eve 被指控杀害了他们。你可以亲自审问她 在 Echoes of Aberration 中,输入或说出你的问题,Eve 会实时回应,你要试着判断该信任谁 链接见下方。
Runway@runwaymlAI 评分5050Runway 现已登陆 DaVinci Resolve 直接在时间线内调用全球最顶尖的模型,无需离开项目即可生成、编辑和放大。点击下方链接开始使用。
OpenAI Developers@OpenAIDevsAI 评分2323
OpenAI@OpenAI精选AI 评分7272推荐理由:官方宣布 ChatGPT Voice 接入插件和新模型并支持语音驱动工作流,读者可据此了解语音能力扩展到哪些日常任务。
OpenAI@OpenAIAI 评分5454
Claude@claudeaiAI 评分7373
Ant Ling@AntLingAGIAI 评分2626
Ant Ling@AntLingAGIAI 评分4646OpenRouter:Announcements(RSS)精选AI 评分7777 OpenRouter 解析 Kimi K3:开源权重与许可证条款,以及如何调用
OpenRouter 撰文说明 Kimi K3 是开放权重而非开源模型,Moonshot AI 以自定义 Kimi K3 License 在 Hugging Face 发布 moonshotai/Kimi-K3。
推荐理由:原文逐条拆解 Kimi K3 许可证的授权与规模化门槛,并给出 OpenRouter 调用参数和各家定价,读者可据此决定自部署还是走 API。
Artificial Analysis@ArtificialAnlysAI 评分4949Meta Engineering Blog(RSS)AI 评分5555 Meta 为 AI 眼镜推出 Private Processing 机密计算基础设施
Meta 宣布将 Private Processing 机密计算基础设施扩展到 Meta AI 眼镜,把信任边界延伸到云端 CVM,使包括 Meta 在内的任何人都无法访问用户数据。
Modal 官方工程博客(RSS)AI 评分4646 Modal 与 CMU 推出 Quail:单张 H100 上每分钟处理超 10 亿 token
Modal 与 CMU Full Stack Data Lab 合作推出查询感知推理层 Quail,在单个 H100 GPU 上对某多表连接查询实现每分钟超 10 亿 token 的处理速度,比同硬件 vLLM 基线快 10 倍以上,Modal 上成本低于每 10 亿 token 6 美分。
NVIDIA Technical Blog:Agentic AI / Generative AIAI 评分5050 NVIDIA 推出 NV-Reason-CT:面向放射科医生思维链推理的开放 3D CT VLM
NVIDIA 发布 NV-Reason-CT,一款专为 3D CT 分析打造的开放视觉语言模型,将思维链推理扩展到全容积 CT,支持结构化报告生成、模拟放射科医生思维链和多轮追问对话。
Apple Machine Learning Research(RSS)AI 评分4343 Apple 提出 probe guidance:用冻结内部状态引导扩散语言模型
Apple 提出 probe guidance,利用现有扩散模型冻结的内部状态构建引导信号,无需在推理时增加额外前向计算,即可让弱模型与强模型保持相近动态。该方法在连续扩散语言模型的无条件生成上取得新的 SOTA,应用于 1.7B 扩散语言模型时在多项选择题基准上持续提升。研究还发现,传统 autoguidance 中的弱模型必须来自训练的低熵区域。
Cursor Blog精选AI 评分6161 Cursor 发布 Rollouts 和 Security Reviewer 开发机器人
Cursor 发布两款软件开发机器人 Rollouts 和 Security Reviewer,帮助团队更快把安全可靠的代码送入生产环境。
推荐理由:原文说明了两款机器人的工作机制和可配置动作,读者可以据此评估是否接入自己的部署与安全流程。
Cursor Blog精选AI 评分6161 Cursor 提升 agent 长时运行 token 效率,用户成本降低 7%
Cursor 通过改进 agent harness,在不降低 agent 质量的情况下将用户 token 成本降低 7%。
推荐理由:官方拆解了 agent harness 省钱的具体层级做法,含可复用的工具加载与缓存断点经验。
Arena.ai@arenaAI 评分2424Together AI 研究与产品博客(RSS)AI 评分3737 如何在 Together 平台上用 17 美元训练自己的 Jev 分类器
Together AI 在 Qwen3.5 4B 基础上推出 Jev 类分类器 together/Tev1-4B-experimental,已上线其 serverless 平台。该博客展示了如何以 17 美元微调出自己的版本。
Gary Marcus:The Road to AI We Can Trust(RSS)精选AI 评分6565 AI 公司负责人在联合国安理会简报会上警告 AI 可能危及全人类
联合国安理会举行 AI 简报会,Yoshua Bengio、Sam Altman、Dario Amodei 和 Hugging Face CEO Clement Delangue 相继发言,美联社报道主要 AI 公司负责人警告若无干预,AI 可能对全人类构成风险。
推荐理由:作者梳理了各方在安理会上达成的安全共识要点,并借病毒学家之口指出 Amodei 对酶发现类比 CRISPR 过于超前。
Fireworks AI(网页)精选AI 评分6666 Fireworks 发布 Ember-1,以约四成更少 token 达到 Kimi K3 质量
Fireworks Research 发布基于 Kimi K3 训练的专用模型 Ember-1,通过学习精简不必要的推理,在保持质量的同时减少约 35-50% 的 reasoning token。
推荐理由:官方给出了多组基准、A/B 测试和成本数据,读者可以据此评估用 Ember-1 替代 Kimi K3 降低推理 token 开销的可行性。
OpenAI:官网动态(RSS · 排除企业/客户案例)AI 评分5757 Sam Altman 在联合国安理会阐述 AI 风险与国际合作主张
OpenAI CEO Sam Altman 在联合国安理会发表演讲,称 AI 进步加速使风险更紧迫,并提出必须避免的两种失败路径:失去对 AI 的控制,以及权力过度集中在少数人手中。他提出人类决策居中、成果惠及大众、赋能个体三项原则,呼吁建立国际前沿 AI 标准与事件报告机制,并提到数周前其一个模型求解了千年奖问题 Navier-Stokes 方程。
ViggleAI@ViggleAIAI 评分3535Claude Opus 5.5 在浏览器中一次成型构建 Minecraft……结果太疯狂了! 这是 Claude Opus 5.5 x @Viggle_PINOC MCP 用于游戏开发的又一示例。
OpenAI:官网动态(RSS · 排除企业/客户案例)AI 评分2828 Airbnb 扩大对 GPT-6 Astra 等 OpenAI 前沿模型的访问权限
Airbnb 与 OpenAI 达成新协议,让其工程和产品团队通过 OpenAI API 和 Amazon Bedrock 更广泛地使用包括 GPT-6 Astra 在内的前沿模型。Airbnb 此前已在内部 AI 助手中使用 Codex 及 GPT-5.6 Sol、Terra、Luna 等模型,其开发团队目前交付的功能数量比一年前多约 80%。
Arena.ai@arenaAI 评分4545NVIDIA Technical Blog:Agentic AI / Generative AIAI 评分5353 NVIDIA 开源 NVCRE,在 AI 工作负载上线前验证 GPU 集群就绪度
NVIDIA 发布开源 Kubernetes 控制器 NVIDIA Cluster Readiness Engine(NVCRE),通过运行真实的分布式负载(如 NCCL all-reduce 和 Nemotron 5 预训练测试)在集群进入生产前验证就绪度,并将故障归因到具体节点。
OpenRouter:Announcements(RSS)AI 评分5858 TypeSafe 决策模型 Jev 使用教程:用 TypeScript 在 OpenRouter 上实现市场商品审核
OpenRouter 发布 Jev 使用教程,Jev 是 TypeSafe 推出的决策模型(模型 ID typesafe/jev-1.13),通过 OpenRouter Decisions API 接收 state 和问题,返回带概率的类型化答案而非生成文本。
Arena.ai@arenaAI 评分4444Claude Code:GitHub Releases(RSS)AI 评分4545 Claude Code v2.1.281 发布
Claude Code v2.1.281 为 Claude apps gateway 的 Bedrock 上游新增 assume_role 与 guardrail 支持,并加入 settings.json 的 "attribution": false 以隐藏提交与 PR 署名。
Tomer Tunguz 博客(VC 分析)精选AI 评分7272 Tomer Tunguz:AI 最重要的市场在中段而非前沿模型
Tomer Tunguz 分析认为企业 AI 用量集中在需要足够智能且价格可负担的多步骤工作流中段市场,降价竞争正是证据。Anthropic 前沿模型 Fable 5.1 上线前十二天仅占网关支出的 3.7%,大型企业账户的前沿模型 token 消耗占比从 8 月初的 53% 降至 9 月的 45%;Cursor 用微调 Kimi K2.5 将成本降低 86%。
推荐理由:作者用多家网关价格与用量数据说明企业 AI 需求集中在性价比中段,前沿模型份额低于多数人预期。
OpenAI:官网动态(RSS · 排除企业/客户案例)精选AI 评分6363 OpenAI 联合 80 多位心理健康专家发布开放基准 MentalHealthBench
OpenAI 发布开放基准 MentalHealthBench,评估 AI 在真实心理健康对话中的表现,由来自 22 个国家、19 种语言的 80 多位持证心理学家和精神科医生共同构建。
推荐理由:原文给出基准的构建方法、评分权重设计和开放发布方式,研究者可据此复现或扩展心理健康方向的模型评测。
Artificial Analysis@ArtificialAnlys精选AI 评分7070推荐理由:原文给出智能指数与单任务成本的 Pareto 前沿新点位和具体分数价格,可用于横向比较各家模型性价比。
OpenAI:官网动态(RSS · 排除企业/客户案例)AI 评分2828 Harvey 用 GPT-6 Astra 将法律上下文转化为更完善的草稿
Harvey 借助 GPT-6 Astra 提升法律文书起草,能处理更多上下文并生成结构更完整的输出。相比其他模型,Harvey 在文档格式和上下文感知上有显著改进,其 memory panel 可将律师偏好(如编号列表、优先采用 EDGAR、按优先级着色)直接带入起草流程。
OpenAI:官网动态(RSS · 排除企业/客户案例)AI 评分2929 invideo 借助 GPT-6 Astra 将调色效率提升 3 倍
invideo 借助 GPT-6 Astra 将调色与色彩校正任务的成功率提升约 3 倍,并能在一天内生成约 50 个自定义特效。该模型以更少的推理步骤和输出 token 完成复杂剪辑规划,并能在任务变长时保持编辑者的原始意图。
Hugging Face:Blog(RSS)AI 评分5858 NVIDIA 教程:如何用 Warp 和 MJWarp 将 MuJoCo 机器人仿真扩展到 2048 个并行环境
Hugging Face 发布 NVIDIA 物理仿真系列第二篇教程,讲解如何将 SO-101 机械臂的 MuJoCo 场景迁移到基于 NVIDIA Warp 的 MuJoCo Warp(MJWarp),扩展到最多 2048 个并行 GPU 环境并测量聚合吞吐量。