2026-08-31 痛点归档
https://aigc.cygongju.cn/day/2026-08-31/
多人同框视频时角色脸和衣服互相串:三人晚餐场景一切全景就有两人同脸、衣服互换,没有可靠的多角色一致性方案
付费信号间接付费:影视专业场景(film student 做叙事短片),时间成本极高;同类需求者已在花云 GPU 费反复渲染
竞品格局Civitai 仅有图片向 multi-character consistency 工作流(Qwen 多角度 938↓ 等);RunComfy Consistent Character Creator 3.0 也是图片向;视频多角色一致性无成品方案——空白市场
现场证据与现有方案
场景ComfyUI 中用 MiniMax H3/LTX 等做多人视频(影视/漫剧/广告),单人镜头正常,多人同框即角色特征混洗;已做角色设定图和服装参考仍失效
时间成本评论区原话:『man i've been trying to crack this exact problem for weeks and it's maddening』——单项目以周计反复重抽
现有方案ref2video/H3 参考模式(单人有效、多人失效);角色 LoRA(单人);regional conditioning+comping(社区口头方案,无成品工具)
社区方案部分:评论区给出 masking prompts(comfy.org 博客链接)、regional conditioning + 合成路线,但均承认是绕路且视频向未验证
当前做法做角色设定图+服装参考图喂参考模式;固定机位+masking prompts 分区提示词;分段生成再后期合成(comping);评论区承认『regional conditioning plus comping 大致是终点』但流程极繁琐
跨框架 LoRA 在 ComfyUI 静默失效:FastVideo 的 4-step H3 加速 LoRA 加载后无报错也无效果,用户被迫自己写转换器
付费信号间接付费:低显存用户为省时间有强需求(3 步 LoRA 热捧);大量跟帖求转换文件=愿意为『开箱即用』付出注意力/金钱
竞品格局HF 官方论坛确认『Something that seems like it should exist, but doesn't』——无统一 Diffusers⇄Comfy LoRA 转换库;空白市场(半空白:零散脚本存在但无产品化工具)
现场证据与现有方案
场景第三方(Diffusers 生态)发布的 LoRA 丢进 ComfyUI 后 key 不匹配但不报错,权重实际没生效;开发者需逆向格式差异手写脚本重打包,普通用户只能干等别人转换上传
时间成本单个转换脚本开发数小时;每次新 LoRA 发布重复劳动;普通用户等待社区搬运 1-数天
现有方案散装 HF 脚本(convert_diffusers_sdxl_lora_to_webui.py 等,仅覆盖 SD/SDXL);DiffusersLoader(反向);无统一工具
社区方案是:楼主发布了转换流程并演示 6 步≈原 20 步 3 倍加速(2:45 vs 7:10),但每次新 LoRA/新模型组合都要重做
当前做法高阶用户手写 Python 转换脚本并手动上传转换产物(limewire 分享);普通用户在评论区『Waiting for someone to upload the file, i have desktop version』——被动等待
视频物体移除/去水印在 ComfyUI 找不到能用的可靠工作流:实测 Obscura Lora+LTX、VOID 模型效果『borderline unusable』,抖动严重一致性差
付费信号间接付费:专业清理场景(影视/Flame 用户)付费能力强;现有云端清理工具(Runway 等)按量收费即花钱绕过
竞品格局Civitai 有 4 个『video object removal』工作流(下载 181-641,量级小);comfy.org 官方 VOID 工作流存在但效果被用户否定——有竞品但用户强烈不满
现场证据与现有方案
场景视频后期清理(去穿帮物/水印/路人)是刚需,用户花一周测试现有模型组合全部失败:inpainting 抖动、时序一致性崩坏;专业影视社区(Flame 论坛)同样在找可靠方案
时间成本楼主原话『spent the last week trying to find a solution』——一周搜索+测试全部废弃
现有方案Obscura Lora(LTX)、VOID(Netflix)模型、DiffuEraser、MiniMax Object Remove——均存在但用户实测质量不合格
社区方案部分:评论区给出『mask pass + 独立 cleanup render』拆分思路,无成品工作流
当前做法放弃本地方案改用云端/专业软件;或按评论区建议拆成 mask pass+cleanup 两步手动流程(工程量大);『Its probably because video always takes so much resources… just not locally』
下载的中文教程工作流与网盘资源对不上:『网盘里的最新工作流不对,没有任何遮罩相关』『工作流对不上,大佬』,缺节点缺模型无从修起
付费信号间接付费:中文生态已有付费整合包/付费工作流售卖(B站教程引流网盘付费),售后成本直接吃掉利润
竞品格局Manager/Wonderful Launcher 解决节点安装一环;『工作流+模型+版本』一键对齐校验工具在中文分发场景空白——有竞品但覆盖不全
现场证据与现有方案
场景B站教程配套工作流(如 MiniMax H3 局部视频编辑 V7.2)经网盘分发,版本漂移后节点/模型文件对不上,红框 missing;观众只能加 QQ 群(评论区挂 QQ:1104337287)排队求 UP 主人工对版本
时间成本每条工作流对版本 30 分钟到数小时;UP 主侧每个教程数百人的售后请求
现有方案ComfyUI Manager『install missing nodes』(只装节点不对齐模型/版本);Wonderful Launcher(检测缺失但不解决中文网盘分发链路);comfy-pack 打包(BentoML 推广中,无中文生态渗透)
社区方案是:UP 主在简介放 QQ 群人工处理,纯人力不可规模化
当前做法加群@UP主人工售后;自己对照视频逐节点排查;重找别的教程——中文生态以『整合包+网盘+QQ群』人工售后运转
16GB 显存跑 10 秒 H3 视频仍爆显存;笔记本 5080 不加节点生成 720p 15 秒视频要 1 小时 20 分钟,交付周期被硬件拖死
付费信号明确付费:硬件升级讨论(5070ti/5080 ≈ 数千元决策)、云 GPU 租用、付费加速工作流(Civitai Ultra Fastest 4-step 工作流 7593 下载证明付费意愿)
竞品格局加速方案多(Turbo LoRA/TensorRT/SeedVR2+TensorRT 424↑ 帖)但都要求高阶配置能力;『低显存可用性』工程化产品空白——有竞品但门槛高
现场证据与现有方案
场景消费级显卡(16GB 及以下)跑 MiniMax H3 视频工作流:长一点的视频直接 OOM,不爆显存的路径速度慢到无法迭代(15 秒视频 80 分钟),重抽成本极高
时间成本15 秒 720p 视频 80 分钟生成(评论区原话);含重抽每个镜头半天起步
现有方案FastH3 4-step LoRA(需转换,见 pp-002)、H3 Turbo 工作流、分段生成、GGUF 量化
社区方案是:分段工作流、加速 LoRA(FastH3 4-step、Turbo)、TensorRT 方案均存在,但配置门槛高且质量有损
当前做法用分段工作流规避爆显存(B站 V7.2 教程核心卖点『分段之间不会爆显存』);买加速 LoRA/降低分辨率;或升级硬件/上云(评论区在讨论 RTX5070ti vs 5080 选卡)
图像编辑模型选型靠口口相传:Qwen/Krea2/Klein/H3 各有所长『winner changes by task』,没有任务级的本地模型评测基准
竞品格局官方对比工作流存在(需自己跑);ImagenWorld 基准(2025-10 发布,学术向未产品化)——评测基础设施半空白
现场证据与现有方案
场景创作者接到具体编辑任务(换背景/改文字/多人编辑/保持身份)不知道该用哪个模型:评论区手工总结各自经验(Qwen 强身份一致性、Krea2 尊重原图、Klein 会偏色),每次新模型发布经验全部作废重来
时间成本每次新模型发布需数天自行评测;选错模型重做任务每次浪费数小时
现有方案comfy.org 官方 all-in-one 图像编辑模型对比工作流(一次跑多模型);artificialanalysis.ai 编辑排行榜(偏 API 模型价格对比);本地开源模型的任务级(换背景/改文字/一致性)通过率评测缺失
社区方案是:评论区高赞给出任务级选型经验(7↑/6↑/4↑),但为纯文字经验,无法验证无法复现
当前做法在 Reddit 发帖问+自己逐个试;评论区人工综述各模型优劣(信息几周后过时)
给视频模型训角色 LoRA 全靠踩坑拼凑:Fizgig vs ai-toolkit 路线之争、AdamW 与 AdamW8bit、contrastive guidance 等细节决定成败,无标准流程
付费信号间接付费:训练 GPU 算力成本真实存在(本地电费/云训练);定制 LoRA 已是代练市场(civitai 上有人接单)
竞品格局ai-toolkit 是事实标准但无 H3 视频向预设与质检;『视频模型 LoRA 训练一键配方+效果验证』空白——工具存在、流程产品空白
现场证据与现有方案
场景为 MiniMax H3 训角色一致性 LoRA:数据集准备、训练工具选择(Fizgig/ai-toolkit/HF Playtime)、超参细节(必须 AdamW 不能 Adamw8bit、需 contrastive guidance)全靠社区口传,训废了不知道哪环出错
时间成本数据集准备+多轮试训以天计;训废一轮浪费数小时 GPU 时间
现有方案ai-toolkit、Fizgig、HF Playtime-ai、AI Toolkit B站中文教程([中配]用AI Toolkit训练MiniMax H3 Ref2VA LoRA)
社区方案是:评论区有高质量配方分享,但散落无验证、随模型版本失效
当前做法按评论区前辈经验逐条试错(9↑ 评论给出 ai-toolkit+AdamW+contrastive guidance 配方);用 ref2video 绕过训练(多人场景又失效,见 pp-001)
批量多视频生成没有参数管理界面:用户用 CSV 表格驱动工作流生成多视频(每行一组提示词+参数),电子表格成了批量生产的核心 UI
竞品格局CSV 方案已开源覆盖基础需求;带校验/预览/队列管理的批量生产面板(类似批量渲染农场 UI)仍空白——有竞品但原始
现场证据与现有方案
场景系列视频/漫剧批量生产:用 Load Any File 节点读 CSV,每行拼 prompt 与参数生成一段视频;表格是唯一能规模化改参的载体,说明原生批量参数管理缺失
时间成本此前每个镜头复制改参数分钟×N;CSV 方案后仍需手写表格无校验
现有方案ComfyUI-outputlists-combiner(CSV 驱动,免费)、表格节点类方案
社区方案是:楼主开源了 CSV 驱动方案(geroldmeisinger/ComfyUI-outputlists-combiner)
当前做法outputlists-combiner 免费节点(刚开源)+ 自备 CSV;更早只能复制多份工作流手改
版本升级后性能悄然回归:KREA2 等模型在新版 ComfyUI 比旧版明显变慢,无版本间性能基准可比,升级像开盲盒
竞品格局空白:『ComfyUI 版本性能基准/回归检测』工具不存在——市场空白但需求频率偏低
现场证据与现有方案
场景团队/个人升级 ComfyUI 后同工作流速度下降,无工具可在升级前后做性能 A/B 对比定位回归;与 #15884 内存问题叠加,长期性能劣化无人察觉
时间成本定位一次性能回归以小时计(二分版本+重复测试)
现有方案无版本级性能基准工具;NVIDIA Studio Driver 更新说明会提及 ComfyUI 性能优化(125↑ 帖)但用户侧无可验证手段
当前做法用户手动掐表对比;在 issue 里主观报告『significantly slower』
ComfyUI 长会话内存持续泄漏:同工作流内存从 24GB 涨到 32GB+ 直到 OOM,跑完还会全部卸载重新加载,批量长任务无法稳定运行
付费信号间接付费:渲染农场/直播用户为稳定性上大内存机器(64GB+)花钱绕过
竞品格局核心内存管理属上游工程,独立开发者不可做底层修复;但『内存监控+自动回收/重启守护进程』的运维工具层空白
现场证据与现有方案
场景批量挂机出图/出视频(多任务队列)时 RAM 无限增长直至系统 OOM;amido 更新后『grows and ooms』更严重;对 7x24 渲染农场/直播场景(FastH3 无限直播 278↑ 帖为反面成功案例)是稳定性硬伤
时间成本批量任务中断重启每次损失数分钟模型加载时间;长任务需人盯
现有方案无系统方案;社区靠 --reserve-vram 等参数微调
当前做法定时重启 ComfyUI;拆会话;忍受重复模型加载的时间浪费
新视频模型(MiniMax H3)缺 ControlNet 类控制资产:社区求官方支持 alibaba-pai/MiniMax-H3-Fun-Controlnet-Union,控制类工作流无米下锅
竞品格局官方适配通常数周内跟进(H3 支持迭代很快),窗口期短——上游依赖型机会,独立可做性低
现场证据与现有方案
场景视频创作者想对 H3 做精准控制(姿态/深度/边缘引导),ControlNet-Union 权重在 HF 发布但 ComfyUI 无原生支持节点,需等官方或自写加载适配
现有方案alibaba-pai 在 HF 已放出 ControlNet-Union 权重;ComfyUI 侧适配缺失
社区方案否:仅 +1 式跟帖(『Please!』),无社区方案
当前做法等待官方支持(issue 求助);用 reference 模式粗控替代