WORK FILE / 03
研究交付 · 内部测试
AI 视频工具测试与能力梳理
我实测 AI 视频工具,记录生成中出现的问题,并比较不同产品的 工作流程。最后把视频生产整理成 8 个阶段、40 项能力。
- 时间
- 2026.06
- 角色
- 产品测试 / 竞品研究
- 交付
- 测试表、失败清单、能力池
轮次测试方式评分主要发现
01一句话 brief3.0能成片,但更像 AI App 概念动效
02结构化 brief3.1流程感增强,UI 乱码和错字明显
03加入 Logo / UI / 风格图3.5品牌风格更稳定,真实 UI 仍被重绘
048 秒以内编辑与修复2.8更像重新生成,未证明局部修复
用同一套标准测试 AI 视频工具,再把结果整理成失败清单、 能力地图和可以继续验证的产品建议。
40Video Skills
04平台实测轮次
30生成失败类型
40逐镜拆解数量
TEST EVIDENCE / FINDING → DECISION
从测试结果走到产品判断
每轮测试都记录输入方式、生成问题和下一步判断。下面展示三条 代表性结论,便于快速理解我的测试方法。
- 发现
- 流程感增强,但 UI 仍有乱码和错字
- 判断
- 结构化输入能帮助组织视频,文字仍需单独校对
- 发现
- 风格更稳定,真实 UI 仍会被模型重绘
- 判断
- 品牌素材能提高一致性,但不能替代人工检查
- 发现
- 输出更像重新生成,没有保留原镜头
- 判断
- 当前结果还不能证明工具具备可靠的局部修复能力
CAPABILITY POOL / 8 STAGES
把视频生产拆成 8 个阶段
每个阶段再列出需要测试的具体能力。这样可以直接记录问题, 也方便提出对应的产品改进建议。
01Brief 与规划5 项
02脚本5 项
03资产准备4 项
04生成7 项
05一致性控制6 项
06剪辑5 项
07质量检查5 项
08交付3 项
PLATFORM TEST / 4 ROUNDS
用同一套标准完成四轮测试
AniShort 当时未充值,因此我只记录能够直接看到的操作流程, 没有评价它的生成质量。这一点也写进了原始研究表。
一句话 brief
能成片,但更像 AI App 概念动效
结构化 brief
流程感增强,UI 乱码和错字明显
加入 Logo / UI / 风格图
品牌风格更稳定,真实 UI 仍被重绘
8 秒以内编辑与修复
更像重新生成,未证明局部修复
FAILURE LIST / 5 OF 30
整理 30 类常见生成问题
失败点分类具体表现风险
人物不一致人物 / 角色同一人物跨镜头出现脸型、服装或年龄漂移高
产品外观不一致产品 / 品牌包装、Logo、颜色或结构在镜头间变化高
字幕与品牌文字错误文字 / 信息乱码、错字、网址与活动信息出错高
镜头逻辑断裂叙事 / 连续性场景、动作或物体关系没有承接高
情绪不连续表演 / 叙事表情和台词无法接住上一镜头中高
测试方法设计 · AI 视频平台实测 · 竞品工作流研究 · 失败点归类 · 广告逐镜拆解 · Video Skill 能力池 · 产品优化建议