跳到正文
原文
DAIR.AI· @dair_ai · X·· 13 天前AI 评分70
AI 导读

Qwen 团队发布 Qwen3.8-Omni-Flash 报告,这是一个原生多模态模型,面向跨文本、音频和视频的长时程智能体任务,如视频编辑和长音频视频翻译。模型沿用 Qwen3.8-Next 的稀疏 MoE 架构,上下文窗口为 100 万 token,并通过协同训练策略在保持文本性能的同时把智能体能力迁移到音频和视频任务。

整理与数据来源:AIHOT

来源:DAIR.AI · x.com