Artcraft 用 Claude Opus 5.5 生成七款 Adobe 软件开源替代品
Artcraft 从可控 AI 图像视频编辑工具转向开源应用套件,用 Claude Opus 5.5 以 Rust 复刻 Photoshop、Illustrator、Premiere、Lightroom、After Effects、InDesign 和 Acrobat Pro 的界面与工具,并提供可在浏览器运行的 WebAssembly 版本。
Artcraft 从可控 AI 图像视频编辑工具转向开源应用套件,用 Claude Opus 5.5 以 Rust 复刻 Photoshop、Illustrator、Premiere、Lightroom、After Effects、InDesign 和 Acrobat Pro 的界面与工具,并提供可在浏览器运行的 WebAssembly 版本。
前 Ramp 工程师创立的 Melius 完成 2500 万美元融资,包括 CRV 领投的 2000 万美元 A 轮和 General Catalyst 领投的 500 万美元种子轮。该公司最初做 AI 效果营销工具,六個月后放弃原产品并重写全部代码,转向生成广告创意素材与营销活动的「创意工作智能体实验室」平台。Melius 称 7 月结束隐身状态后两个月内年化收入已超 100 万美元。
Reka AI 发布全模态模型 Rho-1 的研究预览版,这是一个 190 亿参数的模型,可在单一神经网络中处理并生成文本、图像、视频和机器人控制动作。与多数将任务分派给专用模型的系统不同,Rho-1 把所有模态作为 token 放在同一个共享上下文窗口中运行,无需工具调用或外部模型,可实时生成连续视频并即时响应新指令而无需重启。
Tavus 推出名为 Griffin 的 Human Interaction Model,可在实时视频通话中同时接收和生成语音、面部表情、语气、手势与停顿。
研究者提出 GEAR,一个以几何为 token 级地址来路由视觉记忆的注意力框架,用于长时程相机控制视频生成。
更多证据表明企鹅天生就会说唱 我们让这只衣冠楚楚的企鹅用 PixVerse Canvas 表演了 Yamê 的《Bécane》,效果太炸了 提示词如下
Nick & Judy 加入了 Raindance 趋势 用 PixVerse 重新演绎 Raindance。提示词见评论区 ↓
9 月 29 日,昆仑万维 SkyProduction(天工工作台)上线由火山引擎推出的 Seedance 2.5 样片模式:先出 480P 样片供预览,选定后再原生生成 1080P 正片,复用提示词、参考素材、seed、宽高比和时长。
GeoVerse 通过在预训练 3D 基础模型的几何隐空间中生成、并注入视频生成模型的外观先验,实现世界一致的新视角合成。它从 Wan2.2 VACE 提取多层级特征,经 ControlNet 式适配器注入几何隐扩散模型,并用全局空间记忆聚合已观测与合成内容以保持跨视角连贯。
WorldPlay2 是一个交互式世界模型,通过分解式混合控制接口与压缩记忆、稳定蒸馏的协同设计,兼顾长时一致性与实时响应。该接口将帧对齐动作控制与结构化语义控制结合,显式解耦场景外观、角色身份和动态语义事件;同时将历史上下文压缩为记忆 token,供自回归学生模型与双向教师模型共享,实现按片段进行记忆条件打分,大幅降低蒸馏开销。
EditWorld 是一个支持精准编辑与灵活引用的视频世界模型,可在自回归生成过程中流式接收编辑指令和参考图像,将世界建模从探索扩展到精准修改。它引入 Gated Causal Attention 处理时变编辑条件与参考图像,并用 Sparse Context 机制维持有界历史上下文以支持长时程推理。
世界杂耍联盟(WJF)创始人 Jason Garfield 用 Runway 为荷兰两日赛事的转播补全观众席:首日满座、次日侧机位空座,他用 Aleph 2.0 在原始素材中加入观众而不改动画面其他部分,仅一个极广角镜头退回 After Effects 处理。他还用 Runway 生成开场动画、选手资料卡、排行榜和舞台烟火,整档约一小时特别节目由他一人完成,单段生成时长上限约 15 秒。
法国适应原饮料品牌 Bonjour 的 15 人创意团队用 Runway 把一份脚本批量生成多种动画风格广告,从脚本到效果判定只需 4 到 5 天,成品动画批次 24 到 48 小时完成。团队已用 Runway 产出超过 500 个视频和图像变体,并称转向内部生成创意后省下逾 5 万欧元外部制作费用;改用 Runway 企业版后不再受 credits 限制,可继续加大测试投入。
OpenRouter 对比其平台上 Veo 3.1 系列、Seedance 2.5/2.0 系列、Kling v3.0 与 Grok Imagine Video 各模型的图生视频设置,涵盖分辨率、时长、首尾帧控制、音频和每秒价格,数据核查于 2026 年 9 月 11 日。
Seedance 2.5 草稿模式现已登陆 Krea。 用 480p 生成做实验——场景合适时再切换到 1080p。 立即试用 👇
快手可灵 AI 宣布 Kling 4.0 将于 10 月正式上线,Kling 4.0 Flash 已于 9 月 28 日向黑金年卡会员开放抢先体验。
一个提示词。一个精修视频。 Manus Studio 的炼金模式,感觉就像拥有一整支创意团队,在为你导演、编剧、分镜,并跟着音乐节奏剪辑每一个节拍。 视频、原始提示词和完整会话都在推文串里。
HN.watch 上线,为 Hacker News 每条帖子配一段短视频解说,点击标题即可观看。该站由 scrimba 制作,声明与 Y Combinator 无关,不设 cookie 与追踪脚本,仅做匿名每日聚合。
Google 与 XPRIZE、Range Media Partners 合办的 Future Vision XPRIZE 在洛杉矶揭晓,独立电影人 Jeff Synthesized 凭《The Gifted》从全球 2500 多件参赛作品中获得大奖。
可灵AI宣布全新升级的 Kling 4.0 将于 10 月正式上线,Kling 4.0 Flash 已于 9 月 28 日向黑金年卡会员开放小范围抢先体验。
等待结束。节奏回归。 THE BEAT,由 Kling 4.0 创作,讲述一位鼓手重返舞台的旅程。“WATCH ME PLAY。”
9月27日,昆仑万维旗下SkyProduction(天工工作台)上线三项新能力:开放AI MV创作功能;无限画布接入Mureka V8/V9/V9.5音乐生成模型;视频和图片支持智能配乐。用户可在同一画布完成从音乐分析、分镜规划到视频生成的全流程,并调用Seedance 2.5模型生成视频片段。
9月27日,字节跳动旗下火山引擎在平遥国际电影展期间发布 Seedance 影视合作计划。该计划面向全球专业影视项目提供 Token 补贴、宣发资源及技术支持,单个项目激励最高可达百万人民币。参与要求包括全片视频生成环节100%由 Seedance 实现,支持全 AI 生成或 AI+真人混合制作,且重点鼓励在制作方法与工作流程上实现创新突破的项目。
Google Research 推出 AI 视频联合导演,由 4 个智能体框架组成,运行在 Gemini 和 Veo 之上,用于解决多镜头 AI 视频中的身份漂移和级联错误问题。
VGGT-Diff 将 VGGT-Ω 的视觉几何 latent 路由进预训练视频扩散模型,用于稀疏视角新视角合成。每个视觉 token 关联 3D 点和置信度,经置信度感知的 Visual Geometry Router(VGR)转为查询对齐的 latent 条件,Point-Track Residual Consistency(PTRC)沿可靠 3D 轨迹正则化预测残差。
TT-VidT 通过将 DINOv3 初始化的 ViT-B/16 逐帧空间路径与紧凑 Temporal Transfer Layer 结合,用 Diff Compression 从首帧外观锚点和逐帧运动 token 重建目标帧。