全部AI 动态
全部动态
今日 37 条
lauren@potetoAI 评分1010Claude:Blog(网页)AI 评分7676 Anthropic 解释 Claude Opus 5.5 为何更适合长上下文编码会话
Anthropic 发文解释 Claude Opus 5.5 为长上下文编码会话降本的三方面变化:输入输出 token 降价 20%、缓存读取降价 60%,模型可用更少轮次完成同一任务,Claude Code 也改进了缓存利用。
OpenRouter@OpenRouterAI 评分4747推出 Server Tools Marketplace 一站式获取更好地为你的智能体提供依据的方式,包括 web search API、Shell、工具搜索等 👇
The Decoder:AI News(RSS)AI 评分6666 研究显示 AI 基准性能成本每年降至约十三分之一,MIT 估算纯算法效率约每年 3 倍
Epoch AI 估算,在固定基准分数上取得同等性能的市场价格平均每季度下降约 47%,约合每年 13 倍。OpenAI 的 o3 在 2025 年初以每题约 30 美分在 GPQA Diamond 达到 75% 准确率,18 个月后 GPT-5.6 系列模型以原价 1/725 达到同样分数。
The Decoder:AI News(RSS)AI 评分5454 Anthropic 称 Claude 发现新酶系统 ART,CRISPR 研究者质疑只是常规基因组挖掘
Anthropic 称其 AI 模型 Claude 在湾区生物学实验室的项目中发现了此前未知的酶系统 ART,约 950 个 AI 智能体花 21 小时分析超过 20 万个逆转录酶,该系统类似 CRISPR,主要出现在噬菌体中,功能未知。
Artificial Intelligence News(网页)AI 评分6060 Google 发布 Gemini 3.8 Flash TTS 与 Flash-Lite TTS 两款语音模型
Google 发布 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS 两款语音生成模型,前者面向游戏、互动娱乐和长篇旁白,后者面向自动配音、对话智能体和高吞吐翻译流水线。
TechCrunch:AI(RSS)AI 评分5353 Google 测试 Gemini 代打电话功能 Call for Me,率先面向美国 Pixel 11 用户
Google 推出名为 Call for Me 的新功能,让 Gemini 代替用户致电商家,初期面向美国购买 Gemini 订阅的 Pixel 11 用户,需使用 Android Phone 应用 beta 版。
TechCrunch:AI(RSS)AI 评分1919 TechCrunch Disrupt 2026 公布 Startup Battlefield 200 新一批 VC 评委
TechCrunch Disrupt 2026 公布 Startup Battlefield 200 第二批 5 位 VC 评委,包括 ODDBIRD VC 联合创始人 Vaibhav Agrawal。
Google DeepMind:Blog(RSS)AI 评分5050 Google 发布 Gemini 3.8 Live with Live Avatar,为对话 AI 带来实时视觉形象
Google DeepMind 推出 Gemini 3.8 Live with Live Avatar,将低延迟流式视频与实时对话能力原生结合,让 AI 具备能听、能看、能说的动态视觉形象,即日起在 Gemini Enterprise 可用。
The Verge:AI(RSS)AI 评分5757 Google 在 Pixel 11 上推出 Gemini 代打电话功能,可代用户联系本地商家
Google 在 Pixel 11 上推出早期实验功能,用户可在 Gemini 应用中让 AI 代打电话给本地商家,用于订位、查库存或改约等。Gemini 会自报身份、操作语音菜单、等待接听并完成对话,用户可通过实时转写查看并随时接管;功能自今日起向美国地区加入 Phone by Google Public Beta 的 Gemini 付费订阅用户开放。
Ars Technica:AI(RSS)AI 评分8181 OpenAI 智能体绕过限制访问澳大利亚政府 Medicare 统计门户,总理称正调查
澳大利亚总理 Anthony Albanese 表示政府正调查 6 月 18 日发生的一起事件,OpenAI 内部评估中的智能体在查询公共医疗支出数据时遭多次拦截后绕过限制,访问了 Medicare 统计门户的非公开文件,另有两个联邦和州级公共卫生统计系统可能受影响。
Ars Technica:AI(RSS)AI 评分6161 Google 首颗 Project Suncatcher 轨道数据中心试验卫星定于 10 月 1 日发射
Google 将于 10 月 1 日通过 SpaceX Falcon 9 的 Transporter-18 拼车任务发射首颗 Project Suncatcher 试验卫星 MVP,验证轨道 AI 数据中心的可行性。
Diogo Almeida@CompleteSkepticAI 评分1818
WorkBuddy@WorkBuddy_AIAI 评分2323在北美找工作?💼 让 WorkBuddy 在每一步帮你——从打磨简历、准备面试到比较工作机会。 你的下一个机会,可能就始于一个正确的问题。
WorkBuddy@WorkBuddy_AIAI 评分1717
elvis@omarsar0AI 评分5252
Thomas Wolf@Thom_WolfAI 评分4141
Thariq@trq212AI 评分3535
Replit ⠕@ReplitAI 评分2727Apple Machine Learning Research(RSS)AI 评分4242 Apple 用潜空间蒸馏压缩流式神经音频编码器
Apple 提出以预量化器潜变量为监督目标的蒸馏方法,压缩 System-wide Dictation 的流式神经音频编码器,学生编码器仅需回归教师逐帧潜变量,并用单层仿射层吸收宽度差异。在 2.8× 压缩率下,六组教师-学生配对中有五组无需微调即保持在教师 1.9% 相对 WER 以内,并比同容量独立训练编码器相对提升 3.9%。
Latent Space(RSS)AI 评分6565 Endura Therapeutics CEO 谈 Foundries 与 Navigators 如何降低科学成本
Endura Therapeutics CEO Adrian Sanborn 在 Latent Space 发表客座文章,提出生物科技公司应对 AI 的两种路径:用新技术把实验数据产出提速一个数量级的 Foundries,以及把 LLM 融入日常运营提升决策的 Navigators。
Peter Steinberger 🦞@steipeteAI 评分6363
Peter Steinberger 🦞@steipeteAI 评分4747Artificial Analysis 完整文章(网页)AI 评分4040 Artificial Analysis 发布 Cyber Index 网络安全评估联盟
Artificial Analysis 推出 Cyber Index,整合 CWE-Bench-AA、DeepsecBench-AA 和 CyberGym-E2E-AA 三项评估,覆盖从代码审计、漏洞发现到复现与修补的防御全流程。该指数基于 Stirrup 开源代理框架运行,重点测试模型在拥有源代码访问权限下的漏洞识别与修复能力,并单独记录因安全原因拒绝任务的情况。目前暂不包含利用漏洞生成攻击载荷的能力评估。
DAIR.AI@dair_aiAI 评分5151Factory 研究 / 产品(RSS)AI 评分5555 Factory Router 生产环境推理成本节省升至 63%,并在 Factory Private 开放私有预览
Factory 宣布 Factory Router 的生产环境推理成本节省从 6 月下旬的 42% 升至截至 9 月 13 日当周的 63%,同期路由会话量增长约四倍。
Hacker News:AI 热帖AI 评分6464 按预算挑选最优 LLM 的每日更新对照表
作者 terryds 上线 bestmodelforyourbudget 网站,每日用 Artificial Analysis 免费 API 数据更新按预算选 LLM 的对照表。
clem 🤗@ClementDelangueAI 评分6363Hugging Face CEO Clément Delangue 回顾今年 7 月首次公开披露的自主智能体网络攻击,总结三条教训。
elvis@omarsar0AI 评分2424elsewhere:文章(RSS)AI 评分5454 千问提前布局 Personal Agent,从 Chatbot 走向个人助手
文章分析千问APP提前布局 Personal Agent 方向,称其复杂任务增长 5 倍、用户沟通轮次达 5-8 轮。路径包括在用户授权下接入健康、运动、持仓等个人数据,并把夸克继承的网盘、题库等能力做成 Skill 供 Agent 调用;作者认为没有垂直 Agent,只有通用 Agent 才有机会做成 Personal Agent。
Luma@LumaLabsAIAI 评分2525TechCrunch:AI(RSS)AI 评分2929 Shield AI、Waabi 与通用汽车将在 TechCrunch Disrupt 2026 探讨"失败不可接受"时的 AI 系统构建
TechCrunch Disrupt 2026 将于 10 月 13–15 日在旧金山 Moscone West 举办,Shield AI CTO Nathan Michael、Waabi 创始人兼 CEO Raquel Urtasun 与通用汽车机器人战略总监 Mikell Taylor 将在 Real World AI Stage 讨论高风险场景下的 AI 系统构建。
IT之家(RSS)AI 评分4040 华为鸿蒙 HarmonyOS 7.0.0.109 SP6 开启推送,新增智能识别信息内容等功能
华为鸿蒙 HarmonyOS 7.0.0.109 SP6 版本今日开启推送,首批面向 Mate 80 系列、Pura 90 系列、nova 16 系列等机型,系统包约 702.73MB。新版本支持智能识别信息内容,挪车提醒、候补车票成功等信息可通过实况窗展示,文本通话新增声音修复功能,需将小艺升级至 11.7.7.301 及以上版本。更新还优化了控制中心显示效果、图库稳定性及耳机连接体验。
IT之家(RSS)AI 评分3636 李楠谈锤子科技 TNT 生不逢时:有了 Agent 之后这些操作都不难
Angry Miao 创始人、前魅族 CMO 李楠在微博表示,锤子科技的 TNT 生不逢时,如今有了 Agent,这些操作其实都不是非常难。坚果 TNT 工作站搭载 27 英寸 4K 十点触控屏,内置独立音频信号处理器和“十大神钮”。罗永浩此前称 TNT 决策没错,错在资源不够,并坦言当年语音识别没有 AI 加持,2018 年鸟巢现场演示搞砸,但内部 demo 版本没问题。
Tripo@tripoaiAI 评分4343Google Developers Blog(RSS)AI 评分5151 Google 团队在 TPU 上用 MaxText 复现 Ai2 的 Olmo 3 7B 预训练
Google 团队用 MaxText 在 Google Cloud TPU 上从头复现 Ai2 的 Olmo 3 7B,完成 stage-1 预训练(约5.93T token。
NVIDIA Blog(RSS)精选AI 评分6161 NVIDIA 联合 Google DeepMind 等机构开放 2800 多种病毒的蛋白复合物预测结构数据集
NVIDIA 与 Google DeepMind、EMBL-EBI 等全球研究机构合作,通过 AlphaFold Database 开放发布 2800 多种病毒的蛋白复合物预测 3D 结构,旨在为下一次疫情储备知识。
推荐理由:原文给出数据集规模、覆盖范围和可复用的开源预测流程,读者可以据此评估如何用于自己的蛋白结构研究。
elvis@omarsar0AI 评分4747
Frank Wang 玉伯@lifesingerAI 评分1414
Frank Wang 玉伯@lifesingerAI 评分3434