全部AI 动态
全部动态
今日 6 条
Qwen@Alibaba_QwenAI 评分5757IT之家(RSS)AI 评分6363 阿里千问发布同声传译大模型 Qwen3.8-LiveTranslate,支持原文译文同帧同出
阿里千问发布同声传译大模型 Qwen3.8-LiveTranslate,基于 Hybrid MoE 的 Thinker–Talker 双模块设计,以 Interleave 架构重构实时同传,字均延迟(LAAL)从 2.8 秒降至 2.3 秒。
🚨 AI News | TestingCatalog@testingcatalogAI 评分5353
Artificial Analysis@ArtificialAnlysAI 评分5555MarkTechPost(RSS)AI 评分5959 Jina AI 发布 jina-ocr-v1:3.4B MoE 文档解析模型,内置投机解码面向低预算 GPU
Jina AI 发布端到端视觉文档解析模型 jina-ocr-v1,总参数 3.4B,每 token 激活约 570M,可将 PDF、扫描件、表格和发票一次转成 Markdown。
TechCrunch:AI(RSS)AI 评分6868 OpenAI前研究员创办的TypeSafe发布非LLM新模型Jev,输出校准概率而非文本
OpenAI前研究员、RLHF共同发明人Almeida创办的TypeSafe AI发布基于transformer的新模型Jev,它不输出文本而是产生概率形式的校准决策。
MarkTechPost(RSS)AI 评分6666 PrismML 发布 Ternary Bonsai 2 27B:5.93 GB 三值权重模型保留 Qwen3.8 27B 98.2% 的性能
PrismML 发布 Ternary Bonsai 2 27B,将 Qwen3.8 27B 转为三值权重,模型仅 5.93 GB(FP16 为 53.80 GB),Apache 2.0 开源,官方称在 20 个基准上保留母模型 98.2% 的平均分,支持文本与图像输入和 262K token 上下文。
Qwen:Blog Retrieval(API)精选AI 评分6969 Qwen 发布 Qwen3.8-LiveTranslate 实时同传模型,LAAL 降至 2.3 秒
Qwen 发布 Qwen3.8-LiveTranslate,采用 Interleave 架构与 Hybrid-MoE Thinker–Talker 设计重构实时同声传译,平均滞后(LAAL)从上一代的 2.8 秒降至 2.3 秒。
推荐理由:官方给出了架构设计、LAAL 从 2.8 秒到 2.3 秒的数字和多语言评测结果,读者可以据此评估其实时翻译能力的实际变化。
MarkTechPost(RSS)AI 评分7575 阿里 Qwen 发布 Qwen3.8-Omni-Flash:1M 上下文的全模态智能体模型
阿里 Qwen 团队发布 Qwen3.8-Omni-Flash,称其为首款围绕智能体能力构建的全模态模型,接受文本、图像、音频和视频输入并返回文本,上下文窗口为 1M tokens。
IT之家(RSS)AI 评分7474 阿里达摩院开源医疗影像 AI 模型 DAMO RADAR,可一次识别超 146 种病症并登上《科学》
阿里达摩院与浙江大学医学院附属第一医院等机构研发的通用医疗影像 AI 模型 DAMO RADAR 登上《科学》并正式开源,面向腹部增强 CT 诊断,评估覆盖 146 种病症、18 个器官,近 4 万次真实世界检查中 AUC 达 0.913。
🚨 AI News | TestingCatalog@testingcatalogAI 评分6161IT之家(RSS)AI 评分6161 PrismML 发布三值量化 Bonsai 2 27B,以不到 1/9 内存保留 Qwen3.8 27B 98.2% 性能
PrismML 宣布推出三值量化版本的 Bonsai 2 27B,基础模型升级至 Qwen3.8 27B,以不到 1/9 的内存占用在综合基准测试中达到基础模型 98.2% 的分数,整体表现好于 Qwen3.6 27B。
公众号:智谱(GLM)AI 评分6262 智谱上线 GLM-5.3-FlashX,推理速度最高 200 tokens/s
智谱正式推出 GLM-5.3-FlashX,在 GLM-5.3-Flash 基础上加大对 Infra 侧投入与推理优化,速度最高 200 tokens/s,算力基于 10 万张国产芯片。该模型此前曾以 Ox Alpha 之名面向开发者,官方称其长期保持同尺寸最强智能水平并具备高性价比,API 已上线,Model Key:GLM-5.3-FlashX。
IT之家(RSS)AI 评分7676 阿里发布全模态模型 Qwen3.8-Omni-Flash,支持 1M 上下文,百万 Token 图文音视频输入 0.8 元
阿里千问上线新一代原生全模态模型 Qwen3.8-Omni-Flash,可同时处理文本、图像、音频和视频输入,支持 1M 上下文。在 30 项评测上相比上一代 Qwen3.5-Omni-Plus 平均得分提升超过 26%,官方称音视频能力接近 Gemini 3.8 Flash、音频能力整体超过 Gemini 3.8 Flash。
Qwen@Alibaba_QwenAI 评分7373通义千问发布 Qwen3.8-Omni-Flash,是 Qwen 首个以智能体能力为核心构建的全模态模型,支持原生音视频理解、推理和工具调用。
HuggingFace Daily Papers(社区热门论文)精选AI 评分8585 DeepSeek-V4.1-Flash 发布:552B MoE 多模态模型主打 KV cache 压缩
DeepSeek 发布 DeepSeek-V4.1-Flash,一个 552B 参数的多模态 MoE 模型,支持最长 100 万 token 上下文,模型权重已在 Hugging Face 开放。
推荐理由:论文给出了每 token KV cache 字节数等具体压缩指标,并与上一代模型直接对比,可评估长上下文 Agent 部署成本变化。
IT之家(RSS)AI 评分6363 Figure 发布 Helix 2.5 模型,人形机器人可自主做家务
Figure 发布 Helix 2.5 模型,让人形机器人进入从未见过的家庭后立即自主完成整理客厅、折叠毛巾和整理床铺。Figure 在全球人类行为数据集 Index 上预训练该模型,并在湾区 30 户未收集过数据的家庭中实测;Index 预训练使任务成功率从 8% 提升到 56%,相比前代 Helix 02 只用一半任务专用数据即泛化到 30 个新环境。
karminski-牙医@karminski3AI 评分7272Hacker News 热门(buzzing.cc 中文翻译)AI 评分7070 PrismML 发布 Ternary Bonsai 2 27B:体积缩小 9 倍以上,保留 98.2% 基准性能
PrismML 发布 Ternary Bonsai 2 27B,基于 Qwen3.8 27B,采用三值权重加 FP16 分组缩放,有效每权重 1.76 bit,模型体积 5.9GB,比全精度模型小 9 倍以上,基准综合得分 83.9,保留全精度模型 98.2% 的性能。
TechCrunch:AI(RSS)AI 评分6060 PrismML 发布 Bonsai 2 27B:将 Qwen3.8 27B 压缩至 5.9 GB 可跑在 PC 上
AI 实验室 PrismML 发布 Bonsai 2 27B,将阿里开源模型 Qwen3.8 27B 压缩到 5.9 GB,内存较原版减少 9 到 10 倍,可放进 PC 甚至高端智能手机。
Rohan Paul@rohanpaul_aiAI 评分6060Qwen:Blog Retrieval(API)精选AI 评分7878 Qwen 发布原生全模态模型 Qwen3.8-Omni-Flash,主打音视频智能体任务交付
Qwen 发布下一代原生全模态模型 Qwen3.8-Omni-Flash,支持文本、图像、音频和视频输入及 1M token 上下文窗口,29 项评测平均分较 Qwen3.5-Omni-Plus 提升超过 25%,音频输入每小时价格下降超过 98%,音视频输入每小时价格下降超过 93%。
推荐理由:官方发布同时开放 API 和开源插件与运行时,读者可以据此评估音视频智能体在剪辑、会议、实时交互等工作流中的落地方式。
SenseTime@SenseTime_AIAI 评分5757
SenseTime@SenseTime_AIAI 评分5353蚂蚁 inclusionAI:GitHub 新仓库AI 评分5656 蚂蚁 inclusionAI 开源 Ming-Image-0.1-Design 系列设计图像生成模型
蚂蚁 inclusionAI 在 GitHub 开源 Ming-Image-0.1-Design 系列,包含两个 6B 参数模型:Ming-Image-0.1-Design 生成 UI、信息图、海报等文字丰富的完整视觉设计,Ming-Image-0.1-Design-Layer 将平面设计图分解为可独立编辑的透明图层。
公众号:面壁智能(MiniCPM)AI 评分6565 外部团队基于 MiniCPM-o 4.5 开源全模态交互智能体 Gander,让 Agent 边干活边对话
浙江大学等高校的外部研究者以 MiniCPM-o 4.5 为基座后训练,开源了端到端全模态交互智能体 Gander,论文、数据、代码和模型全部开放。
IT之家(RSS)AI 评分7272 智谱 GLM 公开递归自我改进实践,GLM-5.3-Flash 发布
智谱 GLM 团队披露递归自我改进方向首个工程化实践,由 GLM-5.3 驱动的 Infra Agent 完成了 GLM-5.3-Flash 推理基础设施的设计、调试与优化。
IT之家(RSS)AI 评分5252 OpenAI 前 RLHF 研究者 Diogo Almeida 创办 TypeSafe AI,发布不生成文本的结构化决策模型 Jev
TypeSafe AI 于 9 月 16 日发布 System One 模型 Jev,不生成文本,仅输出 Choice、Score、Noul 三类结构化决策,输入词元定价每百万 0.042 美元,输出词元免费。
MarkTechPost(RSS)AI 评分6363 Knowledgator 发布 GLiFormer:575M 参数编码器不生成 token 实现 91.10 F1 嵌套 JSON 提取
Knowledgator Engineering 发布 schema 条件化编码器框架 GLiFormer,单个模型可在推理时按标签和 schema 完成 NER、分类、关系抽取、嵌套 JSON 结构化和文本嵌入。
Rohan Paul@rohanpaul_aiAI 评分5656
🚨 AI News | TestingCatalog@testingcatalogAI 评分5151
Google AI:DEV 作者专属(RSS)AI 评分7070 Google 发布 Gemini 3.8 Live 与 3.5 Transcribe 实时语音模型
Google 在 Gemini API 和 Google AI Studio 发布 Gemini 3.8 Live 与 3.8 Live Extended Thinking 语音模型,支持异步函数调用、视觉上下文、97+ 语言和可配置思考,Extended Thinking 版位列 Artificial Analysis 语音到语音榜单第一。
NVIDIA Blog(RSS)AI 评分5151 NVIDIA Vera Rubin NVL72 首次亮相 MLPerf Inference v6.1,吞吐最高达 GB300 NVL72 的 3.7 倍
NVIDIA Vera Rubin NVL72 首次提交 MLPerf Inference v6.1 preview 结果,Qwen3-VL 上吞吐最高达 GB300 NVL72 的 3.7 倍,DeepSeek-R1 上最高 2.5 倍。
Mustafa Suleyman@mustafasuleyman精选AI 评分6969微软 AI CEO Mustafa Suleyman 发文反对“模型福利”理念,认为 AI 并无意识、不会感受或痛苦,赋予其受照料权会让对齐与管控更难甚至不可能。
Artificial Intelligence News(网页)AI 评分5151 ChatGPT 联合发明人创办的 TypeSafe 发布程序化决策模型 Jev
由 ChatGPT 联合发明人 Diogo Almeida 创办的 TypeSafe 结束隐身模式,发布专用于程序化决策的 System One Model Jev。
IT之家(RSS)AI 评分5959 科大讯飞发布基于全国产化算力训练的语音基座大模型 Spark-Audio-1.0-Preview
科大讯飞上线语音基座大模型 Spark-Audio-1.0-Preview,采用 0.65B Dense 音频编码器搭配 30B-A3B MoE 大语言模型,使用 1300 万小时音频数据基于纯国产算力集群训练。
蚂蚁 inclusionAI:HuggingFace 新模型AI 评分6161 蚂蚁 inclusionAI 开源全双工音视频交互模型 Realtime-Venus
蚂蚁集团 inclusionAI 在 Hugging Face 发布 Realtime-Venus,包含 Realtime-Venus-Omni 和 Realtime-Venus-Audio 两个 9B 检查点,基于 MiniCPM-o 4.5 / Omni-Flow 架构,语言骨干为 Qwen3-8B。
MarkTechPost(RSS)AI 评分6666 Prior Labs 发布 TabPFN-3.5:默认设置即超越 Otto Kaggle 冠军方案
Prior Labs 发布表格基础模型 TabPFN-3.5,参数量增至 220M,在 TabArena 等 7 个基准上排名第一。它在 2015 年 Otto Kaggle 竞赛上用原始数据和默认设置取得 0.375 的 private leaderboard log loss,优于冠军方案的 0.382,推理约 1 分钟。
MarkTechPost(RSS)AI 评分5656 Nums AI 发布表格基础模型 Causilo,单模型 Elo 登顶 TabArena
Nums AI 发布预训练表格基础模型 Causilo,支持分类和回归,在 TabArena 单模型中取得最高 Elo,总体 1792.9,领先 Google Research 的 TabFM(1764.4)和 EXAONE Tabular(1758.8)。
IT之家(RSS)AI 评分5656 豆包大模型 2.1 Pro 更新 0915 版本:Agent 交付与多模态 Coding 升级
火山引擎宣布豆包大模型 2.1 Pro 更新至 0915 版本,API 全量上线火山方舟,豆包 App 与 TRAE 已同步接入。