Luma AI 官方宣布推出 FLUX Video Upscale,将视频分辨率提升至 2K 和 4K。推文配有一段演示视频,并称有些面孔值得 4K 分辨率,即使是六只眼睛的面孔。
#视频
#视频
今日 1 条
Luma@LumaLabsAIAI 评分4646
X.PIN@thexpinAI 评分5858IT之家(RSS)AI 评分4848 2026 年 8 月“AI 魔改”视频治理成果公布:清理违规视频近 14000 条、处置违规账号 30 余个
部分重点网络视听平台公布 2026 年 8 月“AI 魔改”视频专项治理处置情况,共清理违规视频近 14000 条、处置违规账号 30 余个。其中百度清理 3424 条、抖音 2897 条、快手 2824 条、微信 2633 条、哔哩哔哩 800 余条、小红书 1348 条并处置账号 25 个。
公众号:昆仑万维(天工)AI 评分2929 昆仑万维获2025年度新质企业金牛奖,AI业务进入商业兑现期
昆仑万维在中国证券报主办的2026科技创新与产业高质量发展大会上获颁2025年度新质企业金牛奖(人工智能)。公司2026年上半年营收53.59亿元,同比增长43.55%,归母净利润10.88亿元,同比增长227.17%;AI短剧平台单月流水超6500万美元,FreeReels位列出海短剧APP下载量第一。
elsewhere:文章(RSS)AI 评分4040 MiniMax H3 Max:AI 视频生成快于播放,24 小时 AI 直播上线
绿洲资本文章介绍 MiniMax H3 Max,称其 AI 视频生成快于播放,开启实时交互时代,并上线 24 小时 AI 直播。
HuggingFace Daily Papers(社区热门论文)AI 评分4848 DreamX-Creator 1.0 发布:7B 模型实现 2K 分辨率原生音视频联合生成
DreamX-Creator 1.0 是一个以 7B 生成器为核心的原生音视频联合生成系统,基于首帧和文本提示对音频与视频流联合去噪,通过 Gated Cross-Modal Attention 在网络后半段耦合两个模态。
vLLM 官方博客(RSS)AI 评分5151 vLLM-Omni 实现 MiniMax H3 实时音频视频生成,FastH3 四步蒸馏让完整 MP4 生成快于播放
vLLM-Omni 团队发布 MiniMax H3 生产级服务实践,先做系统级优化,再集成 FastVideo 的四步 FastH3 蒸馏学生模型,将去噪循环从 49 次 DiT 前向降到 4 次。
Luma@LumaLabsAIAI 评分3939Google DeepMind精选AI 评分7777 Gemini 上线智能体视频理解,按任务动态查看关键片段
Gemini API 上线智能体视频理解,可按问题动态检查画面、音频和字幕,支持上传视频与 YouTube 链接。功能适用于多款 Flash 模型,沿用标准 API 计价;谷歌测试中的节省幅度取决于任务,不能直接当作所有视频的成本承诺。
推荐理由:按问题选择视频片段改变了长视频分析的资源分配方式,开发者可据此设计更有针对性的检索和理解流程。
公众号:MiniMax(稀宇科技)精选AI 评分6969 基于 MiniMax H3 Max 的 24 小时 AI 直播网站上线了
MiniMax 将 H3 Max 768P、480P 接入开放平台和 MiniMax Design,海外开发者已借此搭建出 Twitch 直播和 24 小时“AI 电视台”。
推荐理由:原文给出 H3 Max 的生成速度、吞吐量提升和接入入口,并梳理了社区围绕它做实时直播的具体玩法。
Google DeepMind精选AI 评分7171 Google DeepMind 发布 Gemini Omni 1.1 Flash
Google DeepMind 发布 Gemini Omni 1.1 Flash,为开发者带来场景延长、首尾帧插值、360p 快速草稿和最高 4K 放大等生成视频控制能力。
推荐理由:官方给出场景延长、首尾帧插值与 4K 放大等具体能力与开放入口,可据此判断生成视频工作流的变化。
Google DeepMindAI 评分2222 Google DeepMind 与 A24 宣布首个此类研究合作
Google DeepMind 与 A24 宣布达成首个此类研究合作,将顶尖研究实验室与电影制作公司配对,帮助艺术家开发新工作流与技术。合作将跨越多个项目,让 A24 及其电影人直接参与塑造新技术,同时为 Google DeepMind 提供艺术家反馈。Google 还对 A24 进行了投资。
Google DeepMind精选AI 评分7878 Google DeepMind 发布 Nano Banana 2 Lite 与 Gemini Omni Flash
Google DeepMind 发布 Nano Banana 2 Lite 和 Gemini Omni Flash 两款模型。
推荐理由:两款新模型给出了延迟、单价与可用入口,读者可据此判断图像与视频生成链路的成本变化。
Google DeepMind精选AI 评分8282 Google DeepMind 发布 Gemini Omni Flash,支持对话式视频编辑
Google DeepMind 发布 Omni 家族首个模型 Gemini Omni Flash,可组合图像、音频、视频和文本输入生成高质量视频,并通过自然语言多轮编辑视频。
推荐理由:Gemini Omni Flash 把对话式视频编辑和多模态输入整合进 Gemini 应用与 YouTube Shorts,可据此判断生成视频工作流的变化。