#视频
#视频
今日 1 条
OpenRouter@OpenRouterAI 评分4949
Kling AI@Kling_aiAI 评分3333
-Zho-@ZHO_ZHO_ZHOAI 评分2626作者 Zho 发布 ENFINITY 演化系列视频作品《南瓜吸引子》。作者在引用中提到,用汉字阵做《攻壳机动队》(Ghost in the Shell)风格的转场再合适不过。
Dongxi 东锡 NLP@dongxi_nlpAI 评分5757
-Zho-@ZHO_ZHO_ZHOAI 评分2525Zho 发布 ENFINITY 汉字方系列作品,展示人类之子梵高主题内容,并在引用推文中提出用汉字阵做《攻壳机动队》(Ghost in the Shell)的转场再合适不过,附演示视频。
Artificial Analysis@ArtificialAnlysAI 评分7070HuggingFace Daily Papers(社区热门论文)AI 评分5050 SolarWM 发布开放数据与可扩展训练框架,仅用5秒序列训练实现小时级交互式视频世界模型
SolarWM 是一个全开源的交互式视频世界模型基础,包含可重构多源数据引擎和骨干原生适配框架,将10个数据集约143万片段(约25.85TB)转为统一的帧对齐训练契约,并基于 Wan2.2、LTX-2.5 和 MiniMax-H3 训练四个 5B–33B 模型。
MiniMax (official)@MiniMax_AIAI 评分4444
MiniMax (official)@MiniMax_AIAI 评分3131
MiniMax (official)@MiniMax_AIAI 评分5858
Hao AI Lab@haoailabAI 评分5555
Odyssey@odysseymlAI 评分1010Odyssey 发布一条配视频的推文,正文仅为 One of those evenings.,未给出具体产品或事件信息。
-Zho-@ZHO_ZHO_ZHOAI 评分2020HuggingFace Daily Papers(社区热门论文)AI 评分4040 DramaChain Bench 发布:覆盖短剧生成全流程的端到端基准
DramaChain Bench 是首个评估短剧生产完整链路(剧本、分镜、关键帧、镜头视频到成片)各阶段的基准,包含五条评估轴、63 个叶子维度。基准由 5785 个条目经三名专业标注者独立打分,产生 17,488 个有效评分和 255,925 条可追溯归因记录;人工标注证实上游缺陷会跨阶段级联,最终成片质量并非只由视频生成决定。
OpenRouter@OpenRouterAI 评分4444
-Zho-@ZHO_ZHO_ZHOAI 评分2323IT之家(RSS)AI 评分5656 国内首部 AIGC 长剧《后西游记》上线芒果 TV,制作周期较传统三维动画减少 70%
国内首部无真人演员的 AIGC 长剧《后西游记》于 8 月 31 日上线芒果 TV 并登陆湖南卫视黄金档。芒果超媒董事长蔡怀军称,该剧 30 集、单集 40 分钟,总成本约为同类 S 级真人剧几分之一,从策划到上线时间较传统三维动画压缩 70%;制作流程为导演定情绪基调、美术完成设计、AI 团队从文生图推进到图生视频。该剧也是“广电 21 条”发布后首部“边审边播”剧集。
公众号:昆仑万维(天工)AI 评分5454 昆仑万维 SkyProduction 天工工作台新版本上线,打通剧本到成片流程
昆仑万维 SkyProduction 天工工作台全新版本于8月31日上线,把剧本、资产、分镜、视频和后期整合为一条生产线。剧本环节提供剧本翻译、剧本评分和小说转剧本功能;Agent 流程可选 Seedance 2.0 智能创作或智能分镜模式,支持片段重拍和10分钟超长视频生成;Seedance 2.5 720P 无参考视频低至0.4元/秒,30秒视频生成成本最低12元。
公众号:卡尔的AI沃茨AI 评分6666 告别视频抽卡:用深度视频过滤参考视频无用信息的实操技巧
作者分享一个 AI 视频技巧:先把参考视频转成深度视频,再用深度视频驱动视频生成,可保留动作、运镜、人物站位和空间关系,同时减少原片人脸、服装、背景和画风的干扰。
Kling AI@Kling_aiAI 评分4141可灵 Kling AI 发布教程,讲解如何在 Kling MCP 中使用 Elements 功能,在不同镜头间保持角色身份一致,从而创作更连贯的 AI 生成故事。
IT之家(RSS)AI 评分6262 李飞飞 World Labs 发布多模态世界模型 Atlas,支持像素级相机控制生成 1440p 视频
李飞飞创办的 World Labs 发布多模态世界模型 Atlas,称其能以像素级精确相机控制生成图像和视频帧,并在 3D 中重建。Atlas 可输出最长 1 分钟的 1440p 视频,从一至数十张图像进行空间重建,支持时空模拟和文本生成图像与 360 度全景,部分合作伙伴已获抢先体验,未来几周内开放早期访问。
HuggingFace Daily Papers(社区热门论文)AI 评分4343 VeriPhy 提出面向世界模型评估与改进的智能体物理推理系统
论文提出 VeriPhy,一个可审计的物理验证系统:纯文本规划器在观察任何帧之前将提示词编译为带类型的物理义务和经静态验证的执行计划,执行时仅调用冻结的低层专家(分割与跟踪、计数、11 类物理测量、深度、OCR、音频事件检测),每个动作返回带溯源的证据记录,并映射为 supported、contradicted 或 unknown 三值判定。
HuggingFace Daily Papers(社区热门论文)AI 评分4444 Temporal Context Routing(TCR)让联合音视频生成模型按剧本时间轴精准对齐镜头与对白
论文提出 Temporal Context Routing(TCR),将结构化剧本中的镜头切换和对白时间映射到音视频生成的共享时间轴,并把各提示词引导路由到两种模态的对应位置。
MiniMax (official)@MiniMax_AIAI 评分5353
MiniMax (official)@MiniMax_AIAI 评分3535Hacker News 热门(buzzing.cc 中文翻译)AI 评分7070 World Labs 发布世界模型 Atlas:面向空间智能的多模态自回归扩散 Transformer
World Labs 发布新一代世界模型 Atlas,从零预训练,原生处理文本、图像、视频和 3D,架构为多模态自回归扩散 Transformer,输入以 3D 姿态形成空间上下文。模型支持相机控制生成(最长 1 分钟 1440p 视频)、稀疏视图 3D 重建、时空仿真和图像生成,在相机控制生成与 3D 重建任务上优于更专用的模型;现已开放早期访问申请,未来将驱动 Marble 等产品。
Krea@krea_aiAI 评分3434Runway:News(网页)AI 评分3939 Miro 如何用 Runway 制作 Canvas26 四城活动的开场视频
Miro 品牌团队分享如何完全用 Runway 制作 Canvas26 年度活动的开场视频,并本地化为四个城市的版本。此前年份依赖素材库加 3D 动效,今年每个镜头包括城市景观、人群和入场镜头都以 Runway 生成,再叠加基于 Miro Flows 节点连线设计的 3D 动效。
Hao AI Lab@haoailabAI 评分5050
Runway@runwaymlAI 评分4343
Logan Kilpatrick@OfficialLoganKAI 评分5656
Google AI Developers@googleaidevsAI 评分5151
Fei-Fei Li@drfeifeiAI 评分5757Google DeepMind:Blog(RSS)精选AI 评分7272 Google DeepMind 为 Gemini 推出 agentic 视频理解功能
Google DeepMind 为 Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite 推出 agentic video understanding,模型动态扫描视频片段,相比固定帧率处理 token 消耗最多降低 88%,成本最多降低 66%,准确率最多提升 7%。
推荐理由:官方说明列出 token、成本与准确率三项数字和开启方式,开发者可据此评估长视频分析是否换用该模式。
World Labs@theworldlabsAI 评分4848推出 Atlas: 全球首个多模态世界模型,可生成图像和视频帧,具备像素级精准的相机控制,并在 3D 中重建它们。 建模世界,移动相机,模拟空间与时间。
Rohan Paul@rohanpaul_aiAI 评分5757Visko 发布首个 Live Model「Orbis 1.0」,一个实时、可引导的视频生成模型,可实时流式生成持续进行的世界,具备持久记忆、交互性和基于物理的无限长度生成。
🚨 AI News | TestingCatalog@testingcatalogAI 评分6161
elvis@omarsar0AI 评分4949