我在Reddit翻了30个帖子,发现了AI视频工具最大的谎言
我花了一个晚上,翻了 Reddit 上 30 多个帖子,覆盖 r/generativeAI、r/runwayml、r/KlingAI、r/comfyui 等十几个社区。
目的只有一个:搞清楚一件事——用户到底在用什么 AI 视频工具,又在骂什么。
结果比我想象的精彩得多。
角色一致性:AI视频赛道的「致命缺陷」
如果你在 Reddit 搜 “AI video”,每 10 个帖子里有 8 个会提到同一个问题:角色一致性。
一位 r/generativeAI 的用户这样描述他的困境:
“My biggest problem is that the character looks slightly or noticeably different in every clip. Different facial structure, lighting, sometimes clothing…”
(我最大的问题是,角色在每个镜头里看起来都略有不同。脸型变了、光影变了、有时候衣服都变了。)
这不是个别用户的抱怨。在 r/AI_UGC_Marketing 社区,一位做了大量测试的创作者直接下了结论:
“This is still the most broken part of AI video production in 2025… Kling has been the closest in my testing. Sora makes it basically impossible.”
(这仍然是 AI 视频制作中最崩坏的部分。Kling 是我测试中最接近的,Sora 基本不可能做到。)
r/midjourney 社区里更是一针见血:
“Without consistency there is no point and cref is not good enough.”
(没有一致性,其他一切都毫无意义,而 cref 还远远不够好。)
为什么这个问题这么致命?
想象你在做一条短视频广告,主角需要在 5 个场景中出现——街头、咖啡厅、办公室、公园、夜晚的天台。如果每个镜头里的主角长得不一样,观众的第一反应不是”画质好差”,而是”这是同一个人吗?”——叙事直接崩塌。
一位 SaaS 创业者甚至花了 6 个月时间构建平台来解决这个问题,他在 r/SaaS 写道:
“If you’re telling a story across 15-20 scenes, your main character can’t look different in every shot.”
(如果你要讲一个跨 15-20 个场景的故事,主角不能在每个镜头里都长得不一样。)
现有方案各有各的残缺:
- Runway 的 reference image 功能效果不稳定
- Kling Elements 是目前最接近的,但用户反馈”not perfect”
- ComfyUI + LoRA 技术上可行,但工作流复杂到劝退普通用户
- Midjourney cref 对角色一致性的控制力还不够精准
有技术高手在 Reddit 分享了自己的”解耦工作流”——先分离角色和背景、单独生成动作、再后期合成。这篇帖子获得了大量共鸣,但恰恰说明了一个尴尬的现实:即使是最硬核的用户,也需要花大量时间手工拆解。
Runway用户在逃亡:$95/月只能生成19个视频
如果说角色一致性是技术痛点,那 Runway 的定价就是商业痛点。
一位 r/runwayml 用户发现,Runway 悄悄取消了”无限计划”,改成了额度制:
“With that now gone, you’ll blow through 19 video generations very quickly.”
(无限计划没了,你很快就会烧完 19 个视频的额度。)
$95/月,19 个 15 秒视频。平均每个视频成本 $5。
但问题在于——AI 视频生成的成功率远没有想象中那么高。另一位用户的说法更直接:
“RunwayML does feel like a scam. It’s rarely a hit and 90% of the time a miss… you more often than not end up with a useless 5 second video that cost you around $1.50.”
(RunwayML 感觉像骗局。90%的时候都是失败的……你经常花 $1.50 得到一个没用的 5 秒视频。)
这不是个别现象。Runway 还被曝出暗中限速、突然取消 1080p 输出、排队时间越来越长等问题。Kling AI 的情况也不乐观——r/ArtificialInteligence 上有用户抱怨 credit 限制和排队时间让人抓狂。
核心矛盾很清楚:AI 视频需要大量迭代试错(10-20 次才能出一个满意的),但工具方按”成功生成”计费,用户实际上在为 80% 的废品买单。
ComfyUI用户的绝望:5秒视频,1小时渲染
在工作流层面,用户的痛苦更加具体。
r/comfyui 里有人这样形容现有的 AI 视频工作流:
“All of them are over complicated spaghetti messes that requires so many third party custom nodes.”
(全都是过度复杂的意大利面节点汤,需要一大堆第三方自定义节点。)
即使你搞定了节点,硬件也是一座大山。r/StableDiffusion 一位用了 RTX 4090 的用户说:
即使用 4090,生成 5 秒 720p 视频也要 15 分钟。
而另一位 ComfyUI 用户更惨——5 秒视频要等 1 小时。
r/comfyui 还有用户吐槽节点的 enable/disable 按钮根本不工作,大量时间花在重新连线上。
这就是 AI 视频工具市场的真实现状:
- ComfyUI 等开源工具:专业、灵活、免费——但复杂度极高,只有极客能用
- Runway/Kling 等商业工具:简单——但贵、限制多、角色不一致
- 中间缺一个:既简单又高质量,且不需要博士学位的工作流
30个帖子告诉我们的3个真相
从 30+ 个 Reddit 帖子中,我用需求信号矩阵(频率×情绪×现有方案空白×付费意愿)对每个痛点打分:
1. 角色一致性 — 19/20 分(顶级机会)
几乎每个 AI 视频讨论都会提到。用户用”most broken”、”fatal flaw”来形容。目前没有工具能真正解决。
2. 定价模式创新 — 17/20 分
Runway/Kling 用户正在流失。$95/月生成 19 个视频,90%是废品。用户明确表示愿意为”好结果”付费,但拒绝为”试错”买单。
3. 一键工作流 — 17/20 分
从一张图到一段好视频,中间隔了 5-10 个步骤和 3-4 个工具。用户要的是:上传图片→选风格→出片。
市场缺口
把 Reddit 上的声音汇总起来,一张清晰的市场缺口图浮出来了:
1 | 专业度高 ←→ 易用性高 |
中间地带——“既简单又高质量,且能保持角色一致”——目前几乎没有产品占据。
AI 视频这个赛道很热,但热不代表用户满意。恰恰相反,用户对现有工具的满意度极低——角色不连贯、定价不合理、工作流太复杂。
这不是我的判断,是 30 个帖子里用户的共识。
参考链接:
- r/generativeAI 角色一致性讨论:https://www.reddit.com/r/generativeAI/comments/1tw3jm1/
- r/AI_UGC_Marketing 哪个模型能做到角色一致:https://www.reddit.com/r/AI_UGC_Marketing/comments/1rskuar/
- r/runwayml 定价争议:https://www.reddit.com/r/runwayml/comments/1tb5xnv/
- r/runwayml “感觉像骗局”:https://www.reddit.com/r/runwayml/comments/1evrdj8/
- r/comfyui 工作流复杂度:https://www.reddit.com/r/comfyui/comments/1mdkjsn/
- r/StableDiffusion 4090也要15分钟:https://www.reddit.com/r/StableDiffusion/comments/1ms5x7p/
- r/generativeAI “解耦工作流”:https://www.reddit.com/r/generativeAI/comments/1rpqydv/
本文标题:我在Reddit翻了30个帖子,发现了AI视频工具最大的谎言
文章作者:AwesomeYang
发布时间:2026-06-24
最后更新:2026-07-30
原始链接:https://awesomeyang.com/2026/06/24/reddit_ai_video_demand_2026-06-25/
版权声明:未经允许禁止转载,请关注公众号联系作者
