跳到正文
9月28日周一
9月25日周五
  1. Google DeepMind(Veo)62

    Google DeepMind 推出 Gemini 3.8 Live with Live Avatar

    Google DeepMind 发布 Gemini 3.8 Live with Live Avatar,把近实时视频生成与语音对话结合,让企业智能体具备会听、会看、会说的动态视觉形象,即日起在 Gemini Enterprise 上线。

    推荐理由:官方给出 Live Avatar 的可用范围、多语言同步与自定义头像的开放条件,可据此判断能否接入企业对话场景。

9月24日周四
9月23日周三
  1. ComfyUI 官方博客62

    ComfyUI 推出 Comfy Router,用一个 API 调用前沿图像、视频、3D 与音频模型

    Comfy Router 已在 Comfy Developer Platform 上线,开发者只需集成一次即可调用前沿图像、视频、3D 和音频模型,首日接入 Seedance 2.5、MiniMax H3、Nano Banana Pro、GPT Image 2、Kling 和 Black Forest Labs。

    推荐理由:Comfy Router 把多家供应商的前沿图像、视频、3D、音频模型收进一个 API,读者可据此判断多供应商切换与排队重试是否适合自己的调用场景。

9月21日周一
9月20日周日
  1. ComfyUI 官方博客71

    Qwen-Image-2.1 在 ComfyUI 原生支持:开源权重图像生成与编辑,支持透明通道

    阿里 Qwen 团队的新图像模型 Qwen-Image-2.1 已在 ComfyUI 原生支持,开源权重、7B 参数,基于优化的 MMDiT 架构,可直接生成带 alpha 通道的 RGBA 图像。

    推荐理由:ComfyUI 原生支持 Qwen-Image-2.1,读者可了解其 RGBA 输出、原生 2K 与最多 10 张参考图在生成和编辑中的具体用法。

9月18日周五
  1. fal.ai Blog34

    H3 Max:基于 fal 推理与训练平台打造

    H3 Max 生成 5 秒视频耗时不到 3 秒,在针对十二个领先视频模型的人类偏好评测中,其质量、提示词理解与美学均排名第一,Artificial Analysis 和 Design Arena 的独立基准测试同样将其列为第一。该模型由 fal Research 团队在 fal Compute 上完成后期训练,训练集群为互联的 GB200 NVL72 节点,最终训练运行耗时约一周到十天。

9月17日周四
9月16日周三
9月10日周四
  1. Hugging Face Blog62

    Hugging Face 用 Gradio Workflow 重建 AUTOMATIC1111,Workflow1111 含 73 个节点

    Hugging Face 发布 Workflow1111,用 Gradio Workflow 把 AUTOMATIC1111 的大部分功能重建为一张工作流画布,由 11 条媒体管线和 73 个节点组成。

    推荐理由:原文完整拆解了 Workflow1111 的十一条管线与节点构成,可对照 ComfyUI 判断这类画布工作流的适用边界。

9月9日周三
9月8日周二
9月6日周日
9月5日周六
  1. ComfyUI 官方博客15

    ComfyUI 推出 Forward Deployed Creative 企业服务,帮团队把 AI 工作流送进生产管线

    ComfyUI 推出 Forward Deployed Creative(FDCT)企业服务,由 Comfy 专家嵌入企业团队,在客户自己的 Comfy Enterprise 环境中用其模型与素材构建工作流。服务分 Validate、Build、Enable、Own 四步,并以团队能否自行修改工作流而非只会点“run”来衡量赋能效果。工作流最终交付归企业所有,FDCT 支持线在企业协议下保持开放。

9月4日周五
9月2日周三
  1. Google DeepMind(Veo)66

    Google DeepMind 为 Gemini 3.7 Flash 等模型推出 agentic 视频理解

    Google DeepMind 在 Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite 上推出 agentic 视频理解,通过原生视频工具动态搜索、扫描和检查目标片段,替代固定帧率的静态处理。

    推荐理由:原文给出该功能在三个 Gemini 模型上的 token、成本与准确率变化区间,并说明 API 开启方式,便于开发者判断是否接入。

8月28日周五
  1. ComfyUI 官方博客71

    Gemini Omni 1.1 Flash 上线 ComfyUI,支持 4K 输出与视频编辑

    Gemini Omni 1.1 Flash 通过 Partner Nodes 接入 ComfyUI,在 Gemini Video Omni 节点中可选 Omni Flash 1.1,单个节点覆盖文生视频、图生视频、参考生视频、视频编辑和场景延展。

    推荐理由:原文给出 Gemini Omni 1.1 Flash 在 ComfyUI 节点中的任务类型、分辨率档位与提示词写法,可据此判断能否接入现有工作流。

  2. ComfyUI 官方博客58

    Comfy 成为 MiniMax H3 商用许可官方转售方

    Comfy 宣布成为 MiniMax H3 商用许可的首个官方转售方,用户可通过 Comfy 获取本地商用授权。许可包含输出内容的完整商用权利、微调与 LoRA 训练、客户及下游项目使用,并覆盖 MiniMax 的音频与音乐模型;分 Professional 和 Enterprise 两档,Enterprise 可使用包括未蒸馏权重在内的全部 H3 模型版本。

  3. fal.ai Blog83

    fal 发布 H3 Max:基于 MiniMax H3 后训练,5 秒视频约 3 秒生成

    fal Research 发布 H3 Max,这是基于开源权重 MiniMax H3 后训练的版本,由 fal 推理团队针对速度优化。官方称其 5 秒视频生成约需 3 秒,吞吐量约为官方 MiniMax H3 端点的 35 倍,并在整体质量、提示词理解和美学三个维度的人类偏好评测中排名第一。

    推荐理由:fal 公布 H3 Max 的偏好评测排名与生成速度数据,并说明后训练与推理协同优化的思路,可对照其与官方 H3 端点的差异。

8月25日周二
  1. ComfyUI 官方博客88

    Wan 3.0 上线 ComfyUI:原生 30 秒视频与 Omni-Reference 控制

    阿里最新视频生成模型 Wan 3.0 已在 ComfyUI 上线,可一次生成最长 30 秒视频,无需拼接。提示词输入扩展到 20000 字符,参考素材上限提升到 10 张图片、5 段视频和 5 段音频,并支持网页与文档解析,参考素材通过 @Image1、@Video2 等 @ 语法在提示词中指定用途。

    推荐理由:原文列出 Wan 3.0 在 ComfyUI 中的原生 30 秒时长、参考素材上限与分辨率档位,便于判断它能否直接接入现有工作流。

  2. Hugging Face Blog62

    Gradio 内置 gr.Workflow 上线,把 AI 流水线变成可拖拽画布与 REST API

    Gradio 内置的 gr.Workflow 把多步 AI 流水线变成可拖拽的节点画布,每个节点可运行、每个中间结果可见,同一张图同时是 REST API 并可一键部署到 Hugging Face Spaces。

    推荐理由:原文给出 gr.Workflow 的节点类型、并行 fan-out 用法与 REST 端点示例,读者可据此判断能否把多步生成流程搬进 Gradio。

8月20日周四
8月19日周三
8月12日周三
8月8日周六
  1. ComfyUI 官方博客82

    Wan Animate 2 在 ComfyUI 原生支持,新增两个节点

    Wan Animate 2 已在 ComfyUI 原生支持,该模型用端到端角色动画框架直接读取驱动视频,省去中间运动提取器,以提升运动保真度和角色身份一致性,并支持文本驱动的视角控制。

    推荐理由:原文说明了 Wan Animate 2 在 ComfyUI 的原生支持范围、两个新节点和实时延迟变体,读者可据此判断能否接入自己的角色动画流程。

  2. ComfyUI 官方博客82

    Seedance 2.5 通过 Partner Nodes 上线 ComfyUI

    Seedance 2.5 通过 Partner Nodes 在 ComfyUI 上线,一次生成可输出单段连续 30 秒视频,无需拼接短片。单次生成最多接受 50 个参考素材,包括 30 张图片、10 个视频和 10 个音频文件,参考素材可在提示词中内联指定。

    推荐理由:原文列出 Seedance 2.5 在 ComfyUI 中的单次 30 秒连续生成、50 个参考素材与时间轴级镜头控制,可据此判断长镜头工作流是否可行。

8月6日周四
  1. ComfyUI 官方博客82

    FLUX 3 Video 通过 ComfyUI Partner Nodes 上线

    FLUX 3 Video 已在 ComfyUI 通过 Partner Nodes 提供,目前上线的是视频生成,开放权重稍后发布。单次生成最长 20 秒,音频与画面同批原生产出,支持文生视频、图生视频、视频续写、单次生成内多场景与多语言对白口型。官方同时提供 I2V、T2V 和 Storyboard 三个工作流,更新 ComfyUI 或打开 Comfy Cloud 即可使用。

    推荐理由:ComfyUI 官方给出 FLUX 3 Video 在 Partner Nodes 的可用范围与三种工作流,读者可据此判断能否接入现有出片流程。

8月3日周一
  1. ComfyUI 官方博客88

    MiniMax H3 开源权重发布,ComfyUI 首日支持 2K 视频与原生立体声

    MiniMax H3 今日发布并开放权重,ComfyUI 当天完成原生支持。这是 MiniMax 第三代视频模型,前两代为 Hailuo 01 和 Hailuo 02,H3 是首个开放权重的版本,支持文生视频、图生视频、首尾帧控制和参考生视频,输出最高 2K、单段最长 15 秒,音频与视频同一次生成、原生立体声。

    推荐理由:ComfyUI 官方给出 H3 的本地部署路径与显存优化细节,读者可据此判断消费级显卡能否跑起 2K 视频生成。

7月27日周一
7月24日周五
  1. ComfyUI 官方博客39

    ComfyUI 推出 Comfy Team 团队协作计划

    ComfyUI 上线 Comfy Team 计划,将团队集中到一个共享工作区、一个共享 credit 池和一张账单中,管理员可管理账单、邮件邀请成员并随时移除访问权限。该计划不按席位定价,分五档月度 credit 承诺,从 $200 到 $2,500,年度方案最高可享 20% 折扣、月度最高 10% 折扣。后续将加入共享工作流与素材库、用户/项目/工作区级预算、按项目计费和自动充值。