要不要给 H3 做个远程文本编码 API,把 32B 编码器从 GPU 上挪走?
ComfyUI 用户 frankmanbb 提议为 H3 做一个纯文本编码 API:本地只留 DiT 和 VAE,把提示词发给远程接口,返回 H3 兼容的 text conditioning 张量,从而不必在 24–32GB 显卡上同时装下约 20–25GB 的 DiT 和截断版 Qwen3-VL-32B 编码器。
ComfyUI 用户 frankmanbb 提议为 H3 做一个纯文本编码 API:本地只留 DiT 和 VAE,把提示词发给远程接口,返回 H3 兼容的 text conditioning 张量,从而不必在 24–32GB 显卡上同时装下约 20–25GB 的 DiT 和截断版 Qwen3-VL-32B 编码器。
一位只用过 Civitai 在线生图的用户,在 PC 上装 Stable Diffusion 后因性能不足,发帖求助该买什么样的电脑来本地生成 AI 图像。他倾向买整机但觉得偏贵,又完全不会自己装机,希望以尽量低的预算获得能流畅生图的性能,并顺带询问 Stable Diffusion 与 ComfyUI 哪个更好。
作者在 r/comfyui 发布 Face/Head Swap 工作流 v2.0 更新,并附带完整视频教程。材料抓取失败,除标题外无更多正文信息。
用户在 ComfyUI 上为 9070xt 优化 Minimax 图生视频,从最初超过 1 小时降到 22 分钟、约 65s/it。
作者测试了一套面向视觉决策的提示词模板,先用外部 LLM 把实际图像需求转成包含构图、层级、字体与版式决策的结构化提示词,再交给 Qwen Image 2.1 生成,并与多个闭源图像模型对比最终设计结果和使用体验。
一位 ComfyUI 用户分享用 MiniMax H3 制作短片的流程:让 Claude 写带时间轴的脚本提示词,用 Qwen 2.1 生成角色设定图,以尾帧截图作参考统一场景氛围,必要时在 Blender 搭简单 blockout 场景。
作者发布 Endless MiniMax H3(含 Endless LipSync)v1.5 工作流,用 ComfyUI-H3-Motion-Context 与自建 H3 Motion Context Clip Stitcher 节点拼接 MiniMax H3 片段,生成不限时长视频,并称在镜头稳定的多片段场景下退化明显减少。
一名 ComfyUI Cloud 新手在 r/comfyui 求助,希望用 Pinterest 真人照片作姿势/构图参考、自己的真实照片作身份参考,生成保留本人面部、发型和真实比例且带真实皮肤质感的照片,而非粗糙换脸或 AI 磨皮感。
ComfyUI 用户 No-Bad-4838 分享了一个名为 Krea2 Enhancer 的自定义节点,在纯 turbo 模型 8 步、不使用 LoRA 的情况下,提示词跟随和画质均有明显提升。
MiniMax-H3-Character-Swap-LoRA 的 1000 步最终版已发布,并配套 REF2VA 工作流,可输入源视频与单张角色设定图完成角色替换,同时保留其余画面元素并迁移设定图的渲染风格,无需触发词,但近景面部表情常无法跟随。
Scumble 是一款免费开源(GPL-3.0)的局部重绘编辑器,已开放下载,支持涂抹或输入名称(如 sky、shirt)选择区域后写一行提示词生成。每次结果作为独立图层返回,原图不被改动,只有选区外框送入模型再按全分辨率拼回,并支持逐图层色彩匹配。
作者在 r/comfyui 分享了一套角色设定表工作流,基于他人原始工作流修改,去掉了本地 LLM 节点,改为把一张参考图交给 Qwen chat 等 LLM,配合固定指令生成设定表提示词,再导入工作流出图。
作者在 ComfyUI 中把 SeedVR2 的 VAE Encoder 跑通到 TensorRT,发布 ComfyUI-SeedVR2-VideoUpscaler-with-TensorRT v1.5.5,v1.5.4 修复了 TensorRT VAE Decoder 左上角伪影。
Comfy 官方发布 Comfy Router,用一个 API 接入前沿图像、视频、3D 和音频模型,模型字符串和参数保持不变,无需新 SDK、新密钥或重新部署。
ComfyUI 官方博客介绍 MiniMax H3 视频 VAE 的提速更新,编码最高约快 2.2 倍、解码快约 1.4-2.7 倍,1344x768、129 帧的编解码往返从 24.3 秒降到 12.7 秒。
推荐理由:原文给出 MiniMax H3 视频 VAE 在 ComfyUI 中的提速幅度、开启方式和画质数据,读者可据此判断是否值得升级。
Hugging Face 发布 Workflow1111,用 Gradio Workflow 把 AUTOMATIC1111 的大部分功能重建为一张工作流画布,由 11 条媒体管线和 73 个节点组成。
推荐理由:原文完整拆解了 Workflow1111 的十一条管线与节点构成,可对照 ComfyUI 判断这类画布工作流的适用边界。
ComfyUI 开源本地版 Comfy MCP,用户可将 Claude、Codex、Cursor 等智能体连接到本机安装的 ComfyUI,云端与本地合并为同一个 MCP。
推荐理由:Comfy MCP 从云端扩展到本地并开源,读者可以了解智能体如何读取本地 GPU、节点与模型来搭建工作流。
ComfyUI 为 Comfy MCP 推出批量生成能力,新增 submit_batch、get_batch_status、get_batch_output 三个工具,单次调用最多提交 50 个任务,可混合合作方模型与自有工作流,返回一个 batch_id,且该 batch_id 可跨会话保留,提交后次日在新会话中仍能收集结果。
推荐理由:Comfy MCP 新增批量提交与收集工具,并给出角色拍摄、素材矩阵等真实生产用例,可据此判断批量出片能否接入现有流程。