跳到正文

#图像生成

今日 0 条
9月10日周四
9月9日周三
  1. OpenRouter:Announcements(RSS)64

    OpenRouter 教程:用代码调用 Nano Banana 2 编辑图像

    OpenRouter 发布教程,演示通过 API 向 google/gemini-3.1-flash-image(即 Nano Banana 2)发送源图和文本指令完成图像编辑,编辑结果以 base64 形式在响应中返回。教程给出 Python 和 TypeScript 示例、提示词写法、多轮小步编辑方法,以及更换模型只需改一个字段,并介绍了 Nano Banana 系列四个成员的价格与质量差异。

    推荐理由:原文给出完整可运行的图像编辑请求代码和提示词写法,读者可以照搬并把模型换成其他供应商做对比。

  2. Runway:News(网页)63

    Runway 推出 Adobe 插件,Premiere Pro 和 After Effects 内可直接生成和编辑

    Runway 发布 Runway Plugins,面板可直接嵌入 Premiere Pro 和 After Effects,无需导出导入即可在时间线内生成图像和视频、重渲染片段并一键放置结果。

    推荐理由:原文给出了插件的功能范围、付费条件与下载方式,剪辑工作流用户可据此评估是否把生成环节搬进时间线。

  3. OpenAI:官网动态(RSS · 排除企业/客户案例)79

    OpenAI 发布 ChatGPT Images 2.5 图像模型

    OpenAI 发布 ChatGPT Images 2.5 图像模型,生成延迟比 Images 2.0 降低最多 50%,细节、编辑精度、参考照片保真度和多轮编辑一致性均有提升。

    推荐理由:官方原文给出与 Images 2.0 的具体对比数据、新功能入口和 API 双模型分工,读者可以据此评估是否迁移现有图像工作流。

9月8日周二
9月7日周一
9月5日周六
  1. Microsoft AI:官方博客(网页)63

    Microsoft 发布 MAI-Image-2.6 与 MAI-Image-2.6-Flash 图像模型

    Microsoft 于 9 月 4 日发布 MAI-Image-2.6,称其为迄今最强的图像模型,并面向开发者上线 Microsoft Foundry,同时推出面向低延迟、高吞吐场景的 MAI-Image-2.6-Flash。

    推荐理由:原文给出排名、速度和效率数字,并说明两个版本分别面向精度与吞吐的不同场景,便于开发者按工作流选型。

9月4日周五
  1. Midjourney:Updates(RSS)51

    Midjourney alpha 站发布大型更新,v8.2 编辑模型上线 lightbox 编辑器

    Midjourney 向 alpha.midjourney.com 推送大型更新,新的 v8.2 编辑模型上线,lightbox 内置编辑器支持自然语言指令编辑、最多附 4 张参考图并集中查看会话编辑记录。同时测试 Change Style 风格探索功能,修复大量 bug,Niji 7 加 inpainting 已正常工作;下一步将设置默认参数和用提示词预览 sref。

9月3日周四
9月2日周三
7月1日周三
1月10日周六
  1. Berkeley AI Research22

    信息驱动的成像系统设计:Berkeley 提出基于互信息的成像评估框架

    Berkeley AI Research 提出一种直接评估和优化成像系统信息量的框架,通过互信息量化测量对物体的区分能力,统一了分辨率、噪声、采样等传统指标。该方法仅从测量数据和已知噪声模型估计信息量,在彩色摄影、射电天文、无透镜成像和显微镜四个领域验证,信息估计能预测解码器性能,优化后的设计达到端到端方法水平,且内存和计算需求更低、无需任务专用解码器。