AIGC 需求雷达

2026-08-31 痛点归档

https://aigc.cygongju.cn/day/2026-08-31/
8.5
效率与质量 创作者 有付费意向
▲ 14 · 评 7 · 1 源

多人同框视频时角色脸和衣服互相串:三人晚餐场景一切全景就有两人同脸、衣服互换,没有可靠的多角色一致性方案

付费信号

间接付费:影视专业场景(film student 做叙事短片),时间成本极高;同类需求者已在花云 GPU 费反复渲染

竞品格局

Civitai 仅有图片向 multi-character consistency 工作流(Qwen 多角度 938↓ 等);RunComfy Consistent Character Creator 3.0 也是图片向;视频多角色一致性无成品方案——空白市场

现场证据与现有方案
场景

ComfyUI 中用 MiniMax H3/LTX 等做多人视频(影视/漫剧/广告),单人镜头正常,多人同框即角色特征混洗;已做角色设定图和服装参考仍失效

时间成本

评论区原话:『man i've been trying to crack this exact problem for weeks and it's maddening』——单项目以周计反复重抽

现有方案

ref2video/H3 参考模式(单人有效、多人失效);角色 LoRA(单人);regional conditioning+comping(社区口头方案,无成品工具)

社区方案

部分:评论区给出 masking prompts(comfy.org 博客链接)、regional conditioning + 合成路线,但均承认是绕路且视频向未验证

当前做法

做角色设定图+服装参考图喂参考模式;固定机位+masking prompts 分区提示词;分段生成再后期合成(comping);评论区承认『regional conditioning plus comping 大致是终点』但流程极繁琐

#工作流缺失 #LoRA缺失 #视频编辑 #人物一致性 原文 ↗
8
资产与工作流 工作流开发者 有付费意向
▲ 49 · 评 76 · 1 源

跨框架 LoRA 在 ComfyUI 静默失效:FastVideo 的 4-step H3 加速 LoRA 加载后无报错也无效果,用户被迫自己写转换器

付费信号

间接付费:低显存用户为省时间有强需求(3 步 LoRA 热捧);大量跟帖求转换文件=愿意为『开箱即用』付出注意力/金钱

竞品格局

HF 官方论坛确认『Something that seems like it should exist, but doesn't』——无统一 Diffusers⇄Comfy LoRA 转换库;空白市场(半空白:零散脚本存在但无产品化工具)

现场证据与现有方案
场景

第三方(Diffusers 生态)发布的 LoRA 丢进 ComfyUI 后 key 不匹配但不报错,权重实际没生效;开发者需逆向格式差异手写脚本重打包,普通用户只能干等别人转换上传

时间成本

单个转换脚本开发数小时;每次新 LoRA 发布重复劳动;普通用户等待社区搬运 1-数天

现有方案

散装 HF 脚本(convert_diffusers_sdxl_lora_to_webui.py 等,仅覆盖 SD/SDXL);DiffusersLoader(反向);无统一工具

社区方案

是:楼主发布了转换流程并演示 6 步≈原 20 步 3 倍加速(2:45 vs 7:10),但每次新 LoRA/新模型组合都要重做

当前做法

高阶用户手写 Python 转换脚本并手动上传转换产物(limewire 分享);普通用户在评论区『Waiting for someone to upload the file, i have desktop version』——被动等待

#LoRA兼容性 #格式转换 #加速 原文 ↗
7
效率与质量 创作者 有付费意向
▲ 1 · 评 2 · 1 源

视频物体移除/去水印在 ComfyUI 找不到能用的可靠工作流:实测 Obscura Lora+LTX、VOID 模型效果『borderline unusable』,抖动严重一致性差

付费信号

间接付费:专业清理场景(影视/Flame 用户)付费能力强;现有云端清理工具(Runway 等)按量收费即花钱绕过

竞品格局

Civitai 有 4 个『video object removal』工作流(下载 181-641,量级小);comfy.org 官方 VOID 工作流存在但效果被用户否定——有竞品但用户强烈不满

现场证据与现有方案
场景

视频后期清理(去穿帮物/水印/路人)是刚需,用户花一周测试现有模型组合全部失败:inpainting 抖动、时序一致性崩坏;专业影视社区(Flame 论坛)同样在找可靠方案

时间成本

楼主原话『spent the last week trying to find a solution』——一周搜索+测试全部废弃

现有方案

Obscura Lora(LTX)、VOID(Netflix)模型、DiffuEraser、MiniMax Object Remove——均存在但用户实测质量不合格

社区方案

部分:评论区给出『mask pass + 独立 cleanup render』拆分思路,无成品工作流

当前做法

放弃本地方案改用云端/专业软件;或按评论区建议拆成 mask pass+cleanup 两步手动流程(工程量大);『Its probably because video always takes so much resources… just not locally』

#工作流缺失 #视频编辑 #去水印 #视频修补 原文 ↗
7
资产与工作流 创作者 有付费意向
▲ 8 · 评 6 · 1 源

下载的中文教程工作流与网盘资源对不上:『网盘里的最新工作流不对,没有任何遮罩相关』『工作流对不上,大佬』,缺节点缺模型无从修起

付费信号

间接付费:中文生态已有付费整合包/付费工作流售卖(B站教程引流网盘付费),售后成本直接吃掉利润

竞品格局

Manager/Wonderful Launcher 解决节点安装一环;『工作流+模型+版本』一键对齐校验工具在中文分发场景空白——有竞品但覆盖不全

现场证据与现有方案
场景

B站教程配套工作流(如 MiniMax H3 局部视频编辑 V7.2)经网盘分发,版本漂移后节点/模型文件对不上,红框 missing;观众只能加 QQ 群(评论区挂 QQ:1104337287)排队求 UP 主人工对版本

时间成本

每条工作流对版本 30 分钟到数小时;UP 主侧每个教程数百人的售后请求

现有方案

ComfyUI Manager『install missing nodes』(只装节点不对齐模型/版本);Wonderful Launcher(检测缺失但不解决中文网盘分发链路);comfy-pack 打包(BentoML 推广中,无中文生态渗透)

社区方案

是:UP 主在简介放 QQ 群人工处理,纯人力不可规模化

当前做法

加群@UP主人工售后;自己对照视频逐节点排查;重找别的教程——中文生态以『整合包+网盘+QQ群』人工售后运转

#工作流缺失 #视频编辑 #中文生态 #节点缺失 原文 ↗
7
性能与成本 创作者 明确付费信号
▲ 6 · 评 5 · 1 源

16GB 显存跑 10 秒 H3 视频仍爆显存;笔记本 5080 不加节点生成 720p 15 秒视频要 1 小时 20 分钟,交付周期被硬件拖死

付费信号

明确付费:硬件升级讨论(5070ti/5080 ≈ 数千元决策)、云 GPU 租用、付费加速工作流(Civitai Ultra Fastest 4-step 工作流 7593 下载证明付费意愿)

竞品格局

加速方案多(Turbo LoRA/TensorRT/SeedVR2+TensorRT 424↑ 帖)但都要求高阶配置能力;『低显存可用性』工程化产品空白——有竞品但门槛高

现场证据与现有方案
场景

消费级显卡(16GB 及以下)跑 MiniMax H3 视频工作流:长一点的视频直接 OOM,不爆显存的路径速度慢到无法迭代(15 秒视频 80 分钟),重抽成本极高

时间成本

15 秒 720p 视频 80 分钟生成(评论区原话);含重抽每个镜头半天起步

现有方案

FastH3 4-step LoRA(需转换,见 pp-002)、H3 Turbo 工作流、分段生成、GGUF 量化

社区方案

是:分段工作流、加速 LoRA(FastH3 4-step、Turbo)、TensorRT 方案均存在,但配置门槛高且质量有损

当前做法

用分段工作流规避爆显存(B站 V7.2 教程核心卖点『分段之间不会爆显存』);买加速 LoRA/降低分辨率;或升级硬件/上云(评论区在讨论 RTX5070ti vs 5080 选卡)

#显存优化 #视频生成 #硬件决策 原文 ↗
6.5
效率与质量 创作者 有付费意向
▲ 23 · 评 30 · 1 源

图像编辑模型选型靠口口相传:Qwen/Krea2/Klein/H3 各有所长『winner changes by task』,没有任务级的本地模型评测基准

付费信号

无信号:讨论热烈但无人提到付费

竞品格局

官方对比工作流存在(需自己跑);ImagenWorld 基准(2025-10 发布,学术向未产品化)——评测基础设施半空白

现场证据与现有方案
场景

创作者接到具体编辑任务(换背景/改文字/多人编辑/保持身份)不知道该用哪个模型:评论区手工总结各自经验(Qwen 强身份一致性、Krea2 尊重原图、Klein 会偏色),每次新模型发布经验全部作废重来

时间成本

每次新模型发布需数天自行评测;选错模型重做任务每次浪费数小时

现有方案

comfy.org 官方 all-in-one 图像编辑模型对比工作流(一次跑多模型);artificialanalysis.ai 编辑排行榜(偏 API 模型价格对比);本地开源模型的任务级(换背景/改文字/一致性)通过率评测缺失

社区方案

是:评论区高赞给出任务级选型经验(7↑/6↑/4↑),但为纯文字经验,无法验证无法复现

当前做法

在 Reddit 发帖问+自己逐个试;评论区人工综述各模型优劣(信息几周后过时)

#图片编辑 #模型评测 #选型 原文 ↗
6.5
资产与工作流 工作流开发者 有付费意向
▲ 14 · 评 26 · 1 源

给视频模型训角色 LoRA 全靠踩坑拼凑:Fizgig vs ai-toolkit 路线之争、AdamW 与 AdamW8bit、contrastive guidance 等细节决定成败,无标准流程

付费信号

间接付费:训练 GPU 算力成本真实存在(本地电费/云训练);定制 LoRA 已是代练市场(civitai 上有人接单)

竞品格局

ai-toolkit 是事实标准但无 H3 视频向预设与质检;『视频模型 LoRA 训练一键配方+效果验证』空白——工具存在、流程产品空白

现场证据与现有方案
场景

为 MiniMax H3 训角色一致性 LoRA:数据集准备、训练工具选择(Fizgig/ai-toolkit/HF Playtime)、超参细节(必须 AdamW 不能 Adamw8bit、需 contrastive guidance)全靠社区口传,训废了不知道哪环出错

时间成本

数据集准备+多轮试训以天计;训废一轮浪费数小时 GPU 时间

现有方案

ai-toolkit、Fizgig、HF Playtime-ai、AI Toolkit B站中文教程([中配]用AI Toolkit训练MiniMax H3 Ref2VA LoRA)

社区方案

是:评论区有高质量配方分享,但散落无验证、随模型版本失效

当前做法

按评论区前辈经验逐条试错(9↑ 评论给出 ai-toolkit+AdamW+contrastive guidance 配方);用 ref2video 绕过训练(多人场景又失效,见 pp-001)

#LoRA训练 #视频编辑 #人物一致性 #配方 原文 ↗
6
效率与质量 工作流开发者
▲ 12 · 评 2 · 1 源

批量多视频生成没有参数管理界面:用户用 CSV 表格驱动工作流生成多视频(每行一组提示词+参数),电子表格成了批量生产的核心 UI

付费信号

无信号

竞品格局

CSV 方案已开源覆盖基础需求;带校验/预览/队列管理的批量生产面板(类似批量渲染农场 UI)仍空白——有竞品但原始

现场证据与现有方案
场景

系列视频/漫剧批量生产:用 Load Any File 节点读 CSV,每行拼 prompt 与参数生成一段视频;表格是唯一能规模化改参的载体,说明原生批量参数管理缺失

时间成本

此前每个镜头复制改参数分钟×N;CSV 方案后仍需手写表格无校验

现有方案

ComfyUI-outputlists-combiner(CSV 驱动,免费)、表格节点类方案

社区方案

是:楼主开源了 CSV 驱动方案(geroldmeisinger/ComfyUI-outputlists-combiner)

当前做法

outputlists-combiner 免费节点(刚开源)+ 自备 CSV;更早只能复制多份工作流手改

#批量自动化 #表格驱动 #视频生成 原文 ↗
6
性能与成本 其他用户
▲ 4 · 评 0 · 1 源

版本升级后性能悄然回归:KREA2 等模型在新版 ComfyUI 比旧版明显变慢,无版本间性能基准可比,升级像开盲盒

付费信号

无信号

竞品格局

空白:『ComfyUI 版本性能基准/回归检测』工具不存在——市场空白但需求频率偏低

现场证据与现有方案
场景

团队/个人升级 ComfyUI 后同工作流速度下降,无工具可在升级前后做性能 A/B 对比定位回归;与 #15884 内存问题叠加,长期性能劣化无人察觉

时间成本

定位一次性能回归以小时计(二分版本+重复测试)

现有方案

无版本级性能基准工具;NVIDIA Studio Driver 更新说明会提及 ComfyUI 性能优化(125↑ 帖)但用户侧无可验证手段

社区方案

当前做法

用户手动掐表对比;在 issue 里主观报告『significantly slower』

#性能回归 #版本管理 #基准测试 原文 ↗
5
性能与成本 其他用户 有付费意向
▲ 9 · 评 1 · 1 源

ComfyUI 长会话内存持续泄漏:同工作流内存从 24GB 涨到 32GB+ 直到 OOM,跑完还会全部卸载重新加载,批量长任务无法稳定运行

付费信号

间接付费:渲染农场/直播用户为稳定性上大内存机器(64GB+)花钱绕过

竞品格局

核心内存管理属上游工程,独立开发者不可做底层修复;但『内存监控+自动回收/重启守护进程』的运维工具层空白

现场证据与现有方案
场景

批量挂机出图/出视频(多任务队列)时 RAM 无限增长直至系统 OOM;amido 更新后『grows and ooms』更严重;对 7x24 渲染农场/直播场景(FastH3 无限直播 278↑ 帖为反面成功案例)是稳定性硬伤

时间成本

批量任务中断重启每次损失数分钟模型加载时间;长任务需人盯

现有方案

无系统方案;社区靠 --reserve-vram 等参数微调

社区方案

否:仅确认复现,无缓解方案

当前做法

定时重启 ComfyUI;拆会话;忍受重复模型加载的时间浪费

#内存泄漏 #稳定性 #批量任务 原文 ↗
5
资产与工作流 工作流开发者
▲ 7 · 评 1 · 1 源

新视频模型(MiniMax H3)缺 ControlNet 类控制资产:社区求官方支持 alibaba-pai/MiniMax-H3-Fun-Controlnet-Union,控制类工作流无米下锅

付费信号

无信号:纯功能请求

竞品格局

官方适配通常数周内跟进(H3 支持迭代很快),窗口期短——上游依赖型机会,独立可做性低

现场证据与现有方案
场景

视频创作者想对 H3 做精准控制(姿态/深度/边缘引导),ControlNet-Union 权重在 HF 发布但 ComfyUI 无原生支持节点,需等官方或自写加载适配

时间成本

等待窗口期以周计;期间控制类任务无法开展

现有方案

alibaba-pai 在 HF 已放出 ControlNet-Union 权重;ComfyUI 侧适配缺失

社区方案

否:仅 +1 式跟帖(『Please!』),无社区方案

当前做法

等待官方支持(issue 求助);用 reference 模式粗控替代

#工作流缺失 #视频编辑 #ControlNet #模型支持 原文 ↗