WORK FILE / 03

研究交付 · 内部测试

AI 视频工具测试与能力梳理

我实测 AI 视频工具,记录生成中出现的问题,并比较不同产品的 工作流程。最后把视频生产整理成 8 个阶段、40 项能力。

时间
2026.06
角色
产品测试 / 竞品研究
交付
测试表、失败清单、能力池
PLATFORM_TEST.xlsxAVG 3.1 / 5
轮次测试方式评分主要发现
01一句话 brief3.0能成片,但更像 AI App 概念动效
02结构化 brief3.1流程感增强,UI 乱码和错字明显
03加入 Logo / UI / 风格图3.5品牌风格更稳定,真实 UI 仍被重绘
048 秒以内编辑与修复2.8更像重新生成,未证明局部修复
一句话总结

用同一套标准测试 AI 视频工具,再把结果整理成失败清单、 能力地图和可以继续验证的产品建议。

40Video Skills
04平台实测轮次
30生成失败类型
40逐镜拆解数量

TEST EVIDENCE / FINDING → DECISION

从测试结果走到产品判断

每轮测试都记录输入方式、生成问题和下一步判断。下面展示三条 代表性结论,便于快速理解我的测试方法。

01 / 结构化 brief
发现
流程感增强,但 UI 仍有乱码和错字
判断
结构化输入能帮助组织视频,文字仍需单独校对
02 / 加入品牌资产
发现
风格更稳定,真实 UI 仍会被模型重绘
判断
品牌素材能提高一致性,但不能替代人工检查
03 / 局部编辑与修复
发现
输出更像重新生成,没有保留原镜头
判断
当前结果还不能证明工具具备可靠的局部修复能力

CAPABILITY POOL / 8 STAGES

把视频生产拆成 8 个阶段

每个阶段再列出需要测试的具体能力。这样可以直接记录问题, 也方便提出对应的产品改进建议。

01Brief 与规划5
02脚本5
03资产准备4
04生成7
05一致性控制6
06剪辑5
07质量检查5
08交付3

PLATFORM TEST / 4 ROUNDS

用同一套标准完成四轮测试

AniShort 当时未充值,因此我只记录能够直接看到的操作流程, 没有评价它的生成质量。这一点也写进了原始研究表。

ROUND 013.0

一句话 brief

能成片,但更像 AI App 概念动效

ROUND 023.1

结构化 brief

流程感增强,UI 乱码和错字明显

ROUND 033.5

加入 Logo / UI / 风格图

品牌风格更稳定,真实 UI 仍被重绘

ROUND 042.8

8 秒以内编辑与修复

更像重新生成,未证明局部修复

FAILURE LIST / 5 OF 30

整理 30 类常见生成问题

失败点分类具体表现风险
人物不一致人物 / 角色同一人物跨镜头出现脸型、服装或年龄漂移
产品外观不一致产品 / 品牌包装、Logo、颜色或结构在镜头间变化
字幕与品牌文字错误文字 / 信息乱码、错字、网址与活动信息出错
镜头逻辑断裂叙事 / 连续性场景、动作或物体关系没有承接
情绪不连续表演 / 叙事表情和台词无法接住上一镜头中高
我负责的部分

测试方法设计 · AI 视频平台实测 · 竞品工作流研究 · 失败点归类 · 广告逐镜拆解 · Video Skill 能力池 · 产品优化建议

BACK TO WORK ARCHIVE返回三项工作项目