MiniMax H3 一周动态:角色替换 LoRA 千步版、1980s 科幻 LoRA 与 ComfyUI 导演节点
MiniMax-H3-Character-Swap-LoRA 的 1000 步最终版已发布,并配套 REF2VA 工作流,可输入源视频与单张角色设定图完成角色替换,同时保留其余画面元素并迁移设定图的渲染风格,无需触发词,但近景面部表情常无法跟随。
MiniMax-H3-Character-Swap-LoRA 的 1000 步最终版已发布,并配套 REF2VA 工作流,可输入源视频与单张角色设定图完成角色替换,同时保留其余画面元素并迁移设定图的渲染风格,无需触发词,但近景面部表情常无法跟随。
Scumble 是一款免费开源(GPL-3.0)的局部重绘编辑器,已开放下载,支持涂抹或输入名称(如 sky、shirt)选择区域后写一行提示词生成。每次结果作为独立图层返回,原图不被改动,只有选区外框送入模型再按全分辨率拼回,并支持逐图层色彩匹配。
作者在 ComfyUI 中把 SeedVR2 的 VAE Encoder 跑通到 TensorRT,发布 ComfyUI-SeedVR2-VideoUpscaler-with-TensorRT v1.5.5,v1.5.4 修复了 TensorRT VAE Decoder 左上角伪影。
Comfy 官方发布 Comfy Router,用一个 API 接入前沿图像、视频、3D 和音频模型,模型字符串和参数保持不变,无需新 SDK、新密钥或重新部署。
ComfyUI 官方博客介绍 MiniMax H3 视频 VAE 的提速更新,编码最高约快 2.2 倍、解码快约 1.4-2.7 倍,1344x768、129 帧的编解码往返从 24.3 秒降到 12.7 秒。
推荐理由:原文给出 MiniMax H3 视频 VAE 在 ComfyUI 中的提速幅度、开启方式和画质数据,读者可据此判断是否值得升级。
Hugging Face 发布 Workflow1111,用 Gradio Workflow 把 AUTOMATIC1111 的大部分功能重建为一张工作流画布,由 11 条媒体管线和 73 个节点组成。
推荐理由:原文完整拆解了 Workflow1111 的十一条管线与节点构成,可对照 ComfyUI 判断这类画布工作流的适用边界。
Gradio 内置的 gr.Workflow 把多步 AI 流水线变成可拖拽的节点画布,每个节点可运行、每个中间结果可见,同一张图同时是 REST API 并可一键部署到 Hugging Face Spaces。
推荐理由:原文给出 gr.Workflow 的节点类型、并行 fan-out 用法与 REST 端点示例,读者可据此判断能否把多步生成流程搬进 Gradio。
ComfyUI 开源本地版 Comfy MCP,用户可将 Claude、Codex、Cursor 等智能体连接到本机安装的 ComfyUI,云端与本地合并为同一个 MCP。
推荐理由:Comfy MCP 从云端扩展到本地并开源,读者可以了解智能体如何读取本地 GPU、节点与模型来搭建工作流。
Diffusers 现已原生支持 Nunchaku 的 SVDQuant 4-bit 量化推理,加载量化 checkpoint 只需调用 from_pretrained(),无需本地编译 CUDA,也无需单独的推理引擎。
推荐理由:原文给出 Nunchaku Lite 在 Diffusers 中的加载方式、显存与延迟数据,读者可据此判断能否在消费级显卡上跑扩散模型。
ComfyUI 为 Comfy MCP 推出批量生成能力,新增 submit_batch、get_batch_status、get_batch_output 三个工具,单次调用最多提交 50 个任务,可混合合作方模型与自有工作流,返回一个 batch_id,且该 batch_id 可跨会话保留,提交后次日在新会话中仍能收集结果。
推荐理由:Comfy MCP 新增批量提交与收集工具,并给出角色拍摄、素材矩阵等真实生产用例,可据此判断批量出片能否接入现有流程。
fal.ai 发布 fal MCP Server,这是一个托管端点,让 Claude、Cursor、Windsurf 等 AI 助手在对话中搜索、运行并串联 1000+ 生成式 AI 模型,覆盖图像、视频、音频、3D 与超分。
推荐理由:原文给出 fal MCP Server 的接入命令与 9 个工具清单,读者可据此判断能否把自家模型调用接进对话式助手。