动态

MEPPP 热点收录 @meppp_hot
收录
原帖正文 兄弟们,之前答应过你们,点赞过百开源我的MinMax H3 视频反推skill。由于前两天账号被盗影响了我发布节奏,现在重新发布下。首发我的开源项目:MiniMax H3 视频反推 Skill。我做视频反推时遇到过一种很隐蔽的错误:画面里的动作都描述对了,提示词却没抓住视频在表达什么。比如一只猫开心地跳舞,以为另一只猫正举着手机帮它录像。跳完凑近才发现,对方根本没开相机,而是在刷别的猫的视频。它随后生气地拍对方,笑点来自“认真表演”和“根本没被录下”的落差。如果提示词只写“跳舞→看手机→拍头”,动作顺序还在,故事已经变了。艺术视频也有类似问题。分布在不同空间深度的绘画笔触,随着视角转动而错开,回到特定角度又组成完整画像。这里需要描述的是笔触、深度和视点的关系;把“分层”理解成将平面图片切成薄片,就会生成另一种效果。这个 Skill 的原理是:
把视频转成有证据的事实,再把确认过的理解编译成提示词。1、先建立视频事实。
它检查完整时间线,找出真正的切镜,补看快速动作、接触、遮挡和最后一帧。人物外观、道具位置、主体动作、镜头运动、声音分别记录。单张截图只能证明某一刻的状态,不能凭它推断一整段动作。2、再对齐视频含义。
它先用中文复述“谁在做什么、期待什么、转折发生在哪里、最后停在什么状态”。对于艺术展示,则复述作品结构和视角变化带来的效果。拿不准的关系或原因会直接说出来,等你确认或纠正后才进入提示词阶段。你补充的设定会与画面中能直接确认的事实分开保存。3、从同一组事实生成不同路线。
要文生视频,就组织成完整的时间线;要图生视频,就把每个真实镜头的首帧状态与后续动作分开写。需要多段生成时,前一段结束的人物姿势、道具位置和未完成动作会传给下一段。这样修改一种输出形式时,不会凭空长出另一套剧情。4、最后检查边界。
时间线有没有漏掉结尾?接触和撤回有没有被合成一次动作?真实硬切有没有被误写成镜头运动?声音是否真的听过?事实或目标一旦改变,旧复核就会失效,需要重新检查。你可以安装后附上参考视频,直接调用 skill,它会先告诉你自己看懂了什么;
你可以直接回复“这里不是自拍,是在刷视频”或“这里是空间分层,不是切片”。
理解对齐后,再让它输出 MiniMax H3 可用的文生或逐镜图生视频提示词。项目附有教学示例和本地校验工具,目前通过了 94 项自动回归检查。
这些检查验证流程和提示词的结构约束;成片有多像,还需要实际生成对照。欢迎拿难反推的视频来试,也欢迎反馈它理解错的地方。开源地址见评论👇
引用自 X 原作者:知识猫AI实验室 原帖地址:https://x.com/i/status/2104242449132757398 原帖: 本站媒体副本
MiniMax H3 图生视频,反推还是用了我的专用H3反推skill,相当好用,点赞过100我就开源给大家。提示词👇
X 原帖图片,来自 @GeekCatX 查看原图
引用自 X 原作者:知识猫AI实验室 https://x.com/GeekCatX/status/2101740593298932026

0 条评论

还没有评论。第一条认真回应会很重要。