#数据/训练
#数据/训练
今日 2 条
DAIR.AI@dair_aiAI 评分6161
IT之家(RSS)AI 评分6767 国内首款 AI 辅助研发创新药艾普司韦获药监局附条件批准上市
由西湖大学、西湖实验室、西湖制药联合研发的盐酸伊司特韦片(商品名:艾普司韦)获国家药品监督管理局附条件批准上市,用于成人轻型、中型新型冠状病毒感染治疗。这是西湖大学首款完全自主研发的 1 类创新药,也是全球第一款基于 DNA 编码化合物库(DEL)技术获批的小分子创新药,以及国内首款凭借 AI 辅助研发获批上市的原创药,从源头发现到完成临床试验仅用时三年半。
HuggingFace Daily Papers(社区热门论文)AI 评分5454 ParSer 论文提出并行读取与深度推理解耦的长上下文智能体架构
论文提出 ParSer,用一批冻结的轻量子智能体并行读取文档块,由经强化学习训练的主导智能体通过多轮 scatter-gather 迭代推理,将阅读与推理解耦。在 7K 到 896K token 的多跳 QA 上,4B 主干平均超过最强顺序记忆基线 5.7 分,896K 时领先 12.0 分,9B 版超过 DeepSeek-V4-Pro 6.3 分,并将推理延迟最多降低 11 倍。
Rohan Paul@rohanpaul_aiAI 评分5151PayPal AI 论文《The Memory Trust Gap》研究持久记忆智能体在存储记忆过期时的表现,测试 Qwen3 0.6B/1.7B/4B/8B 模型。
AI at Meta@AIatMetaAI 评分5858
IT之家(RSS)AI 评分5959 研究称得克萨斯州大学毕业生失业率在 AI 快速发展期间升至异常高水平
《金融时报》9 月 2 日报道,达拉斯联邦储备银行研究发现,自 ChatGPT 发布以来,得克萨斯州受 AI 影响较高行业的招聘职位大幅减少,2025 年第一季度这类职位招聘减少约 8%,大学毕业生失业率升至异常高水平。
MarkTechPost(RSS)AI 评分5959 Adaption Labs 推出 Invent a Dataset:从任务描述直接生成训练数据
Adaption Labs 发布 Invent a Dataset 功能,可从对目标行为的文字描述生成可直接用于训练的数据集,无需种子语料、预定义 schema 或标注指南,现已通过 Adaption 应用、Python SDK 和 REST API 开放。
Hacker News 热门(buzzing.cc 中文翻译)AI 评分4545 为什么下一个令牌预测器是对 LLM 的错误思维模型
作者认为下一个令牌预测器只是对 LLM 的零阶近似,机制形态正确但不完整。现代后训练中的 RLVR 让模型通过自己探索生成的新序列并获得奖励来学习,类似会穷尽探索的象棋引擎而非模仿大师棋谱的下一步预测器,因此 RLHF 和 RLVR 编码的内容早已超出对现有文本的预测。
IT之家(RSS)AI 评分5252 小米发布并开源表格结构化数据大模型 Xiaomi-TabLDM,回归登顶 OpenML-CTR23
小米发布通用表格数据基础大模型 Xiaomi-TabLDM,以单一预训练模型和统一默认配置直接适配不同表格数据集,完成分类与回归预测,模型权重与代码已开源。模型基于结构因果模型生成的合成数据预训练,架构引入双流特征分组、轻量级注意力残差和稀疏混合专家,并探索 Test-Time Scaling。
TechCrunch:AI(RSS)AI 评分5353 XDOF 脱隐身不到三个月即洽谈 12 亿美元估值的 B 轮融资,由 8VC 领投
脱隐身不到三个月后,为通用机器人采集真实世界遥操作数据的初创公司 XDOF 正就约 12 亿美元估值的 B 轮融资进行后期洽谈,拟由 8VC 领投。
Epoch AI@EpochAIResearchAI 评分3838
Epoch AI@EpochAIResearchAI 评分5656Hacker News 热门(buzzing.cc 中文翻译)AI 评分6464 成人片制片人 Strike 3 指认 Meta Reality Labs 高管为“John Doe”种子下载者
Strike 3 Holdings 在向法院提交的动议中称,一起 John Doe BitTorrent 案的订阅者是 Meta Reality Labs 的一名高管,其住宅 IP 记录到近 20,000 个文件下载,包括 VR 成人内容,且下载时间与其首次向 Meta 律师发出侵权证据邮件仅相隔数小时。
Cohere@cohereAI 评分4848Cohere Labs 发布 Agentic Task Ecosystem 数据集,包含 69 万以上为 AI 智能体构建的工具。在测试工具能否独立完成一项职业任务的实验中,仅 2.6% 通过。
Rohan Paul@rohanpaul_aiAI 评分7171据 Bloomberg 报道,DeepSeek 计划在内蒙古吉瓦级数据中心部署 16 万颗华为 950DT 芯片,建成后将是已知最大规模的华为 AI 集群之一。
HuggingFace Daily Papers(社区热门论文)AI 评分4242 DRACO:用动态评分标准做长程智能体训练的细粒度信用分配
DRACO 提出在结果信号缺失的长程智能体训练中,动态生成评分标准并按轨迹打分,再把判断以闭式方法重分配到相关步骤,在 GRPO 中产生差异化逐步优势,不引入任何训练的归因模块。
a16z:News(RSS)AI 评分4343 a16z Charts:科技招聘重经验轻技能,AI 改写安全与就业格局
a16z Charts 汇总近期数据指出,自 2025 年 1 月以来科技招聘明显更偏好工作年限(约 5-10% 变化)而减少对技能数量的要求,作者认为这与 AI 带来的技能空白有关。
DAIR.AI@dair_aiAI 评分4848Qwen 团队发布 Terminal-Universe 论文,从既有 agent 轨迹回放文件操作以重建可执行终端环境,而非从零生成。
IT之家(RSS)AI 评分6161 Meta 为 Muse Spark 1.2 和 1.3 推出数据共享折扣计划,价格仅为原价的 1.3-8%
Meta 针对 Muse Spark 1.2 和 1.3 模型推出贡献者折扣计划,用户同意共享提示词和生成结果用于训练后续模型即可享受大幅降价。具体为每百万 Token 输入从 1.25 美元降至 0.10 美元(8%),缓存命中输入从 0.15 美元降至 0.002 美元(1.3%),输出从 4.25 美元降至 0.20 美元(4.7%)。
IT之家(RSS)AI 评分6969 华为何庭波发布 τ 定律论文,麒麟 2026 晶体管密度提升 55% 且功耗大降
华为工程师何庭波在 ChinaXiv 发布预印本论文《Huawei's τ Chip Was Supposed to Melt?》,披露 τ(韬)缩放定律原理及麒麟 2026 实测数据。
IT之家(RSS)AI 评分6262 消息称月之暗面最早年内赴港 IPO,拟融资最高 50 亿美元
彭博社援引知情人士消息称,月之暗面考虑最早今年年内赴港上市,融资规模有望达 30 亿至 50 亿美元,已聘请美国银行担任整体协调人,与中金公司、德意志银行和高盛共同参与。月之暗面近期完成 35 亿美元融资,估值 350 亿美元,并计划以 500 亿美元投前估值进行新一轮融资;7 月发布的开源模型 Kimi K3 受到全球关注。
Artificial Intelligence News(网页)AI 评分4545 调查显示50.5%美国人认为与AI的恋爱关系可算作出轨
AI Girlfriend Coach于2026年8月26日至27日通过SurveyMonkey对2150名美国成年人开展的AI恋爱调查显示,50.5%的人认为伴侣与AI的浪漫或性关系可算作出轨,加上21.2%虽不称出轨但感到不适,约七成人会对AI亲密关系设限。
HuggingFace Daily Papers(社区热门论文)AI 评分4141 Scal3R 提出多相对位姿查询方法,提升长视频在线 3D 重建稳定性
Scal3R 将在线 3D 重建重新表述为多参考相对位姿查询,用约占参数 1% 的可学习 token 通过非对称注意力注入冻结骨干,并结合带回环闭合的在线位姿图优化抑制长程漂移。
Rohan Paul@rohanpaul_aiAI 评分4747
Rohan Paul@rohanpaul_aiAI 评分4545elsewhere:文章(RSS)AI 评分2222 星尘智能发布 SmoothRL,让在线强化学习跟上大模型的异步推理
云启资本报道天使轮项目星尘智能发布 SmoothRL,定位是让在线强化学习跟上大模型的异步推理,提出机器人不能停下来等模型。原文正文仅此一句口号,未给出更多功能细节。
HuggingFace Daily Papers(社区热门论文)AI 评分5151 大模型 On-Policy Distillation 再思考 II:一条训练样本就够了
研究探讨 on-policy distillation(OPD)中训练数据的作用,发现仅用 1 条 query 训练即可持续提升数百步并恢复全量数据 OPD 的大部分增益。
HuggingFace Daily Papers(社区热门论文)AI 评分4646 Terminal-Universe:把智能体轨迹转化为可扩展的终端环境
Terminal-Universe 框架通过回放轨迹中的文件操作恢复原工作区,并借助补全智能体补齐缺失文件,将现有智能体轨迹重建为可复用、可执行的环境,在广度(跨代码库查询)和深度(多轮会话)两个方向合成新任务。
HuggingFace Daily Papers(社区热门论文)AI 评分4545 Environment Evolution:为终端 Agent 提供持续学习信号的环境进化方法
论文提出环境进化方法,通过 off-policy 地递进增加环境难度并按代调度,为终端 Agent 训练提供持续学习信号。
AK@_akhaliqAI 评分2525
Rohan Paul@rohanpaul_aiAI 评分4242Microsoft 与加州大学圣地亚哥分校的论文指出,模型在 SFT 后可能看起来更好,但因 SFT 会抹掉 RL 需要发现的罕见正确行为,反而是更差的 RL 起点。
Databricks:Blog(RSS)AI 评分2424 Databricks 讲解如何构建高质量且可信的数据产品
Databricks 发布博客,介绍组织在迈向 AI 与数据驱动时,如何借助 Databricks 构建高质量且可信的数据产品。正文从企业在 AI 和数据驱动转型中需要交付数据产品这一需求展开。
Databricks:Blog(RSS)AI 评分1919 Databricks:数据治理不止于安全, lakehouse 上的知识、上下文与本体
Databricks 发文讨论面向 AI 的数据治理,指出多数组织将治理等同于安全控制,而文章主张治理还应覆盖知识、上下文与本体层面。文章围绕 lakehouse 提出超越安全视角的治理思路,原文正文仅给出开篇部分。
🚨 AI News | TestingCatalog@testingcatalogAI 评分6161Google Research:Blog(网页)AI 评分4545 Google Research 研究跨人群多基因风险评分迁移学习,提出跨人群 GWAS 训练指南
Google Research 用 UK Biobank 约数十万欧洲样本与 Biobank Japan 近 20 万日本样本,在 8 项临床性状上评估多基因风险评分(PRS)的跨人群迁移效果。结果显示,目标人群样本达 15k 以上时,目标人群专属模型优于混合欧洲数据训练;遗传相关性高的性状可继续受益于欧洲数据至 25-40k+ 样本,而 HDL、LDL、血糖等高度人群特异性性状受益明显更小。
TechCrunch:AI(RSS)AI 评分6666 Meta 为 Muse Spark 模型推出贡献者定价,共享数据可获约 95% 折扣
Meta 针对面向编码和其他智能体的新模型 Muse Spark 提供贡献者定价,用户同意分享提示词和模型输出用于未来模型训练可获约 95% 的折扣。每百万输入 token 标准价为 $1.25,贡献者价 $0.10;输出 token 标准价 $4.25,贡献者价 $0.20。
Hacker News 热门(buzzing.cc 中文翻译)精选AI 评分7878 IFM 发布 K2 Horizon 六款开源模型,覆盖 0.9B 到 375B-A23B 并开放完整训练生命周期
IFM 发布 K2 Horizon 模型系列,共六个模型:375B-A23B、36B-A4B、32B、7B、3.7B 和 0.9B,均以 Apache 2.0 开源,其中 0.9B、3.7B 和 7B 宣称在其规模上达到 SOTA,36B-A4B 采用新提出的稀疏注意力架构 MoVA。
推荐理由:原文在发布模型之外还放出从预训练到智能体后训练的全流程产物,研究者可以据此复现和改造整套训练方法。
Tomer Tunguz 博客(VC 分析)精选AI 评分7373 Tom Tunguz 解析 Meta Muse Spark 双轨定价背后的数据换算力逻辑
Tom Tunguz 分析 Meta 发布 Muse Spark 模型及双轨 API 定价:Standard Tier(muse-spark-1.3)输入 $1.25/m。
推荐理由:作者用价差算出数据补贴的具体规模,把 Meta 双轨定价解读为 AI 数据供应链的垂直整合,提供了一种可迁移的分析视角。
DAIR.AI@dair_aiAI 评分4646
elvis@omarsar0AI 评分4040