全部AI 动态
全部动态
今日 0 条
Cohere@cohereAI 评分1313OpenAI:官网动态(RSS · 排除企业/客户案例)AI 评分4444 OpenAI Academy 扩展新学习路径,覆盖开发者、领导者、教育者和大学生
OpenAI 扩展 OpenAI Academy,新增面向开发者、领导者、教育者和大学生的课程,与 Apply AI at Work 共同组成按角色划分的学习路径。开发者课程围绕 Codex 和 OpenAI API,涵盖解决方案设计、评估、智能体与生产运维;学习者通过课程评估后可获得 OpenAI Academy 课程徽章。
OpenAI:官网动态(RSS · 排除企业/客户案例)AI 评分5757 OpenAI 提出由美国主导制定前沿 AI 国际标准,覆盖 RSI 与事件报告
OpenAI 发文提出应为下一阶段 AI 发展建立国际技术标准,重点覆盖递归自我改进(RSI)的风险管理。文章主张由美国借助 CAISI 和各国 AI 安全研究所网络推进标准制定,并建立 RSI 进展评估、人类监督和事件报告的共同协议;同时明确表示完全自主的 RSI 目前并未发生,在无法安全保证人类控制之前不应推进。
Arena.ai@arenaAI 评分5454LangChain:Blog(RSS)AI 评分3232 LangSmith 上线 Jev-as-a-Judge 评估功能
LangSmith 现已支持将 Jev 用作评估裁判(Jev-as-a-Judge),可对智能体 trace 进行结构化反馈评估,覆盖生产运行、数据集与回归测试场景。官方称该方式更快、更便宜。
Tomer Tunguz 博客(VC 分析)精选AI 评分6666 Tomer Tunguz 谈 AI 优化 if-then 判断:专用决策器把分类成本降近百倍
Tomer Tunguz 撰文提出最新一波 AI 正在接管软件中的 if-then 判断原语,Jev 与 SemIf 这类专用决策器以数百毫秒返回结果,成本比传统生成式调用低约 76x 到 209x。作者在自己的 Agent 中替换了约四分之一的调用,在 98 条人工核验的生产邮件线程上,Jev 达到 80%、本地 SemIf 达到 82% 的分类准确率,高于生产模型的 47%。
推荐理由:作者结合自身 Agent 的替换实验给出成本与准确率对比,为判断专用小模型何时可替代前沿模型提供参照。
PixVerse@PixVerseAI 评分2424
Arena.ai@arenaAI 评分6464
Artificial Analysis@ArtificialAnlysAI 评分6666
WorkBuddy@WorkBuddy_AIAI 评分1616
Perplexity@perplexity_aiAI 评分4444
Krea@krea_aiAI 评分4242Krea Agent 现已通过 MCP 提供。 你现在可以直接通过你的智能体工作流生成素材、自动化视频流水线,并运行创意迭代循环。 立即试用 👇
通义 QwenAudio:原创语音项目AI 评分4040 通义 QwenAudio 发布 Qwen-Audio-3.1-Realtime 产品页与技术报告
通义 QwenAudio 上线 Qwen-Audio-3.1-Realtime 产品页,并同步放出技术报告预览,导航栏已链接至报告 PDF。该仓库共 3 次提交,最新一次于 9 月 21 日完成,页面包含 demo 与概览脚本。
OpenRouter@OpenRouterAI 评分6363Microsoft Research 博客(RSS)AI 评分5252 Microsoft Research 发布开源逆合成模型 RetroChimera 并登上 Nature
Microsoft Research 在 Nature 发表逆合成预测模型 RetroChimera,结合基于 Transformer 的 R-SMILES 2 和图神经网络模型 NeuralLoc,用 learning-to-rank 集成两者互补预测。
Suno@sunoAI 评分2929
Replit ⠕@ReplitAI 评分3030
OpenRouter@OpenRouterAI 评分3636NVIDIA Blog(RSS)AI 评分3838 NVIDIA 埃及 AI 生态走向规模化落地:开发者一年增长超十倍,非洲 AI 工厂加速建设
NVIDIA 在埃及大埃及博物馆举办活动,展示当地 AI 生态从能力建设转向规模化落地,其埃及 Deep Learning Institute 学员规模一年内增长超十倍。
NVIDIA Blog(RSS)AI 评分3535 NVIDIA Halos:为何规模化部署物理 AI 需要全栈安全
NVIDIA 推出 Halos,称其为首个也是唯一一个面向物理 AI 的全栈安全系统,覆盖设计、验证与部署各层。
Fireworks AI(网页)精选AI 评分6161 Fireworks AI 推出 Specialized Intelligence Index 领域基准索引
Fireworks AI 推出 Specialized Intelligence Index(SII),汇集开放、闭源与专用模型在真实工作任务基准上的表现,首批覆盖医疗、法律、网络安全、金融、客服、生产力和软件七个领域。
推荐理由:Fireworks 联合多家行业实践方推出领域基准索引,不做跨领域综合排名,读者可按成本和时长自行权衡模型选择。
xAI:News(网页)精选AI 评分7474 xAI 发布 Grok 4.7,主打编码与知识工作
xAI 发布 Grok 4.7,定位为其最强编码与知识工作模型,定价 $2/百万输入 token、$6/百万输出 token,与 Grok 4.6 同价同速,另有速度和价格加倍的快速变体。
推荐理由:官方给出了完整定价、速度和多项基准对比,读者可以据此把 Grok 4.7 放进现有模型选型里横向比较。
Arena.ai@arenaAI 评分5656
Arena.ai@arenaAI 评分4444Arena 分析 Agent Arena: Code 中 29 个模型的 20840 条 trace 后发现,前沿模型获得的正向反馈明显更多,新模型整体反馈更偏正面。
Microsoft Research@MSFTResearchAI 评分3434
PixVerse@PixVerseAI 评分2323PixVerse 本周被美国 Google Play Store 评为本周应用。专为移动创作者打造:快速生成,不牺牲质量。#pixverse
OpenClaw🦞@openclawAI 评分4646Claude:YouTube(RSS)AI 评分5353 Claude 宣布 Cowork 与聊天合并为同一个 Claude
Claude 官方发布短视频宣布 Cowork 和聊天功能现已合并为同一个 Claude。视频无正文文本,仅能从标题确认这一功能合并事实。
Tripo@tripoaiAI 评分4242
Runway@runwaymlAI 评分2424NVIDIA Blog(RSS)AI 评分5353 NVIDIA:AI 安全是工程问题,需在 Agent 栈每一层构建可验证的防护
NVIDIA 发文提出 AI 安全是工程问题,需要明确的安全要求、可执行的控制和具名责任人。文章将安全落在完整 Agent 栈的每一层,包括模型、harness 与运行时环境,强调 Agent 需独立于自身推理的可执行边界、可追溯身份和最小权限,关键操作和权限变更需人工审批。
PixVerse@PixVerseAI 评分3434
MeshyAI@MeshyAIAI 评分2525Hugging Face:Blog(RSS)AI 评分4646 Hugging Face tokenizers v1:编码、解码与扩展性能实测
Hugging Face 发布 tokenizers v1,输出 token ID 与 v0.23 完全一致,但速度常达 v0.23 的数十倍。v1 将单个 crate 拆为 workspace,用 SIMD 位流拆分(bitcannon)替代正则引擎,并引入无分配合并模型、合并循环重写、线程本地词缓存和原生多线程并行。
Hugging Face:Blog(RSS)AI 评分4747 Multiverse 将 LLM 块删除重构为 Ising 优化问题
Multiverse 提出将 LLM 整块删除重构为受限二元优化问题,等价于求解 Ising 玻璃的低能态,从而无需跑 benchmark 即可筛选候选配置。在 Llama-3.3-70B-Instruct 压缩 50% 时,该方法在 MMLU 上比最佳同类块删除方法高出近 23 个百分点。
Tessl:产品与工程博客AI 评分2121 Tessl 完成 SOC 2 Type II 审计
Tessl 宣布已完成 SOC 2 Type II 审计,报告由独立审计机构 A-Lign 出具,覆盖访问控制、持续监控与事件响应、员工安全意识培训及安全软件开发等控制项。Tessl 表示正推进 ISO 27001 认证,内部审计本月启动、外部审计在 11 月进行,客户可通过 Tessl Trust Center 申请完整报告。
PixVerse@PixVerseAI 评分2020我们最喜欢的 GPT Image 2.5 提示词用例。宠物失败照片 PixVerse 会员可无限使用 GPT Image 2.5↓
OpenAI:官网动态(RSS · 排除企业/客户案例)AI 评分3636 V7 如何为 AI 智能体提供企业级记忆
V7 推出 V7 Go 智能体平台,通过 Context Graph 将企业文件转化为智能体可查询的记忆,其最难的图查询测试中 GPT-6 Astra 准确率达 89%。平台用 GPT-5.6 Luna 做结构化抽取、GPT-5.6 Terra 和 Sol 负责推理与工具调用,在 HERB 基准上检索系统比官方基线高 69%、不可答查询的幻觉减少 38%。
OpenBMB@OpenBMBAI 评分4646开发者 @markfenner 基于 MiniCPM5-2B 构建了 MiniCPM News Desk,一个本地优先的 AI 新闻简报系统,可采集官方 AI 与技术动态并生成结构化每日摘要。
vLLM 官方博客(RSS)AI 评分3838 vLLM 在 GB300 NVL72 上 PD 部署 Qwen3.8-2.4T 的性能调优实录
vLLM 在 GB300 NVL72 集群上对 Qwen3.8-2.4T 做 PD 分离部署,8K/1K 负载下高吞吐场景达到每 GPU 5000 total token 吞吐,低延迟场景每用户 180 生成 token,并给出完整 pareto 前沿。