小影马产品关联开发者在 X 上宣布,“深度视频”功能已经上线 yingma.tv,并称该工具可以在无限画布中直接免费使用。演示重点不是把一句提示词变成成片,而是先从原始视频提取主体动作、连续相对深度和多人前后关系,再把结果作为后续 AI 视频生成的参考。
先给结论:
- 深度视频目前被产品方描述为免费、无需积分;
- 原片要求不超过 30 秒;
- 输出是后续生成用的动态参考,不是最终短剧;
- 它不等于完整 3D 重建、骨骼动作捕捉或可导出的 Mocap 文件;
- 真正调用视频模型生成新镜头时,通常仍会消耗积分。
如果你正在做 AI 短剧、人物动作复刻或多人镜头一致性,这个工具值得用一段已获授权的短片测试;如果你期待上传视频后免费获得完整成片,就需要先理解它在工作流中的位置。
小影马是什么?
小影马是一款运行在浏览器中的 AI 短剧制作平台。官方页面提供两种主要创作方式:
Agent 流水线
适合已经有小说、剧本或连载计划的创作者。流程覆盖剧本创作、参考素材、分镜生成、镜头制作和剪辑成片,由模型先给初稿,创作者确认后进入下一步。
无限画布
适合已经知道要制作哪一段镜头、希望自己控制节点和参考素材的用户。创作者可以从空白画布开始,也可以载入现成工作流,再修改节点、提示词和连接关系。
两类项目创建后不能中途互换。Agent 流水线强调完整流程,无限画布强调节点级控制;“深度视频”位于无限画布的视频工具中。
深度视频到底是什么?
根据小影马无限画布官方页面,用户可以上传不超过 30 秒的原始视频,把它转换为包含主体动作和连续相对深度的视频参考,同时尽量保留多人之间的前后关系。
“相对深度”可以理解为画面中哪些物体更靠近镜头、哪些更远,以及这种关系如何随时间变化。与只上传第一帧或写动作提示词相比,深度视频能给后续模型提供更多动态结构信息。
它可能帮助表达:
- 人物转身、抬手、走动等连续动作;
- 两个人谁在前、谁在后;
- 身体与服装、头饰等元素的大致运动关系;
- 镜头内主体距离变化;
- 原视频中难以用文字逐帧描述的动作节奏。
需要强调的是,小影马没有公开底层深度估计模型、真实尺度精度、失败率或与同类产品的对比测试。发布者认为演示中的飘带、发簪、耳坠和转身细节提取得较好,这是单个案例的主观观察,不应扩写成“复杂细节可以零误差复刻”。
如何使用小影马深度视频?
官方说明对应的操作路径可以整理为六步:
- 注册并登录 yingma.tv;
- 新建一个无限画布项目;
- 上传一段不超过 30 秒的视频;
- 在画布中选中视频节点;
- 点击视频工具中的“深度视频”;
- 等待生成,并把输出连接到后续 AI 视频节点作为参考。
页面入口、按钮名称和免费政策可能调整,实际操作以当前工作台显示为准。官方建议使用桌面浏览器完成创作,手机更适合查看项目而不是搭建完整工作流。
测试素材怎么选?
第一次不要上传复杂商业项目。建议使用 5 至 10 秒、主体清楚、镜头稳定、版权属于自己的测试视频:
- 一个完整的转身或起身动作;
- 两个人前后交错走动;
- 宽松衣物随身体移动;
- 镜头轻微推进或后退;
- 背景与主体有明显距离层次。
同时保留原片,方便逐帧比较动作节奏、遮挡和边缘稳定性。
深度视频能解决哪些问题?
纯文字难以描述的动作
“人物自然转身并抬起右手”看似明确,但模型不知道动作持续多久、肩膀如何转动、重心何时改变。视频参考可以提供更连续的条件。
多人镜头的前后关系
两个人交叉走位时,单张参考图无法表达谁会挡住谁。连续深度有机会帮助模型理解遮挡变化。
角色与服装的动态关系
长发、披风、飘带和耳饰会随着动作产生滞后。它们仍可能生成失败,但动态参考通常比静态图片更接近原始节奏。
AI 短剧镜头复用
创作者可以先用真人或简单替身拍动作样片,再把动作结构用于已经定稿的虚拟角色。这样比完全依赖文字描述更容易形成可控镜头。
它不等于什么?
不是完整 3D 重建
官方描述强调的是连续相对深度,没有说明输出真实尺度的三维网格、点云、摄像机轨迹或可在 Blender 中直接编辑的场景。
不是骨骼动作捕捉
没有公开资料表明它会输出 BVH、FBX 或其他 Mocap 骨骼文件。把它写成“免费动作捕捉工具”会误导读者。
不是最终 AI 视频
深度视频是参考条件。后续仍需要选择模型、编写提示词、生成镜头、筛选结果并剪辑成片。
不保证一比一复刻
快速动作、强遮挡、镜面、烟雾、透明材质、低光和复杂配饰都可能造成深度判断不稳定。商业项目应先做小样测试。
它真的完全免费吗?
发布者在 2026 年 9 月 15 日的跟帖中表示,深度视频功能可以免费使用且无需积分。截至 2026 年 9 月 22 日,公开价目也没有单独列出“深度视频提取”的扣费项。
但这不等于小影马所有功能免费:
- 打开画布、调用工具界面或进行部分处理可能不扣积分;
- 节点中调用图片或视频生成模型通常会扣积分;
- 平台可能调整功能配额、模型和活动价格;
- “免费”不能自动理解成永久、无限次数或任意时长。
官方定价页显示,平台使用积分计费。截至核验日,基础换算约为 1 积分 ¥0.07,不同视频模型按秒和分辨率采用不同费率。使用参考视频时,公开公式为:
预计积分 =(参考视频秒数 + 计划生成秒数)× 对应模型每秒费率
例如,参考视频越长、生成视频越长、分辨率越高,消耗通常越大。模型价格和充值活动高度时效敏感,正式制作前应查看工作台的实时预估,不要只按照旧文章预算。
小影马完整短剧工作流
如果深度视频测试有效,可以把它放进更完整的制作链路:
- 剧本: 明确场景、人物目标、台词和镜头数量;
- 角色定稿: 固定人物外形、服装、道具和音色;
- 分镜: 决定景别、机位、运镜和每镜时长;
- 动作样片: 用已授权真人素材或自制参考拍摄复杂动作;
- 深度视频: 提取动态结构和前后关系;
- 镜头生成: 把角色、场景、提示词和动态参考组合;
- 人工筛选: 检查身份一致性、肢体、道具和遮挡;
- 剪辑成片: 配音、字幕、音乐和节奏调整;
- 发布: 添加 AI 内容标识并保存素材授权记录。
这比“输入一句话,一键生成短剧”更接近真实生产流程。
隐私、版权和商用边界
上传素材仍会经过平台与服务商处理
小影马隐私政策说明,视频、图片、剧本、提示词、生成结果和任务参数可能在提供服务过程中被处理,平台也可能使用模型或云存储服务商完成任务。
不要上传未经授权的人脸、声音、影视片段、商业机密或客户未同意交给第三方处理的素材。
“不用于无关训练”不等于零数据风险
公开条款表示,未经另行明确同意,不会把非公开输入或生成内容用于与提供服务无关的模型训练。但数据仍需为完成任务而上传、处理和存储,因此敏感项目还要核对保留时间、删除方式和企业数据要求。
生成内容不自动获得完整商用保障
小影马服务条款原则上允许用户在符合条款和法律的情况下使用生成内容,但不保证结果独创、唯一、可登记或绝对不侵权。
商用前仍需自行确认:
- 原始视频和人物肖像授权;
- 声音与配音授权;
- 音乐、字体和商标许可;
- 影视素材和角色 IP;
- AI 生成内容标识;
- 客户合同是否允许使用第三方模型服务。
适合谁,不适合谁?
适合:
- 想把真人动作参考转给虚拟角色的 AI 短剧创作者;
- 需要控制多人前后关系和连续动作的镜头;
- 已经在使用无限画布,希望增加动态条件的用户;
- 愿意先用短片测试,再决定是否购买生成积分的团队。
不适合:
- 需要精确骨骼文件或工业级 Mocap 数据的人;
- 期待自动恢复真实三维场景的 VFX 项目;
- 想免费生成任意长度、任意分辨率完整短剧的人;
- 无法确认原片版权和人物授权的商业项目。
常见问题
小影马深度视频现在免费吗?
产品关联开发者称该功能免费且无需积分,核验日的公开价目也未单列费用。但政策可能调整,使用前应查看工作台实时提示。
最长可以上传多少秒?
官方功能说明写的是 30 秒以内。
它会直接生成最终成片吗?
不会。深度视频是后续 AI 视频生成用的参考,最终镜头还需要模型生成、筛选和剪辑。
它等同于 3D 动作捕捉吗?
不等同。当前官方资料没有说明它输出骨骼动画、真实尺度 3D 模型或 Mocap 文件。
多个人物的前后关系可以保留吗?
官方称会保留多人前后关系,但没有公开准确率。复杂遮挡应使用自己的样片测试。
为什么深度视频免费,后续仍可能收费?
提取参考与调用生成模型是两个步骤。视频模型推理通常按时长、分辨率和模型费率扣积分。
手机可以完成整个流程吗?
官方建议用桌面浏览器进行完整创作,手机更适合查看项目。
生成结果可以商用吗?
条款允许在符合规则和法律的前提下使用,但不保证独创性或不侵权。商用前必须核对输入素材、人物、声音、音乐、字体和品牌授权。
总结
小影马深度视频的价值,是在纯文字提示与完整视频生成之间增加一层动态参考。它能把主体动作、相对深度和人物前后关系交给后续节点,降低复杂动作只能靠文字猜测的问题。
它目前适合被看成一项免费试验工具,而不是免费成片承诺。用 5 至 10 秒自有素材跑一个小样,比较动作、遮挡和服装边缘,再结合最终模型成本决定是否放进生产流程,远比直接投入整集短剧更稳。