LibTV 上线 Agent ,看着做视频的难度又下降了?立马前去一探究竟。

这次主打视频的skill,体验下来易用性非常高,先选一个Skill,相当于请一位专门的导演——风格、镜头、剪辑套路全归他管,我们只管提需求。
一、外卖小哥怎么就上了世界杯决赛的门线
世界杯期间,整点乐子,选的 Skill 是"无厘头喜剧":
生成一个搞笑短片:世界杯决赛点球大战最后一轮,外卖小哥送餐误入球场,被当成替补守门员推上门线,他拎着麻辣烫完成了扑救,全场欢呼。要求转场丰富、带双语字幕、节奏快一点,给成片配有节奏感的音乐,时长30秒以上。

然后它反倒抛回来三个问题:角色形象怎么处理?场景要什么调性?包袱往哪儿抖?
我一个一个答:角色让它自己去生成,外卖小哥和裁判各出一版三视图;调性我选了"千禧年中式复古",就是那种港片、国产老剧的旧质感;包袱的方向我挑了"小题大做"——外卖小哥拎着麻辣烫扑救这么一件小事,非要用最史诗的慢镜头去伺候,越正经越好笑。

三个问题答完,它开始设计外卖小哥和裁判的形象,给我三视图确认。我确认了句"满意,继续";

然后出场景图。

接着它规划分镜并以文本形式给我展示。

继续生成分镜视频。之后同步生成背景音乐。最后合成成片。丝滑,一气到底,超出预期。
成片34秒,一支自带胶片颗粒感的复古搞笑短片。从我打下我得需求开始,到看见成片,没画过一张分镜图,需要我做的判断就是那两句"满意,继续",它给的选项真的都还..不错。意料之外。
二、门童每天下午四点,遛的是一只企鹅
Skill 换成"韦斯安德森电影美学",再来试试:做一支短片:酒店门童每天下午四点准时帮302房的客人遛一只企鹅,对称构图,糖果色调。要求带双语字幕、配俏皮的弦乐,时长30秒以上。

这支片子没有参考图,走的是从零设计的路子。我以为按照惯例接下来它会问我细节,结果它说我给的信息很明确!于是开始自己写一版短剧本,叫《四点整》,开场白是——
每天下午四点整,302房的企鹅先生准时出门散步。
它自己交了一份剧本。色板也是它定的,"暖糖喜剧"——腮红粉、奶油色、黄油黄,点一抹正红。门童造型出了四套,我选深酒红滚奶油边那套;走廊和台阶两个场景又各出四张图,挨个选了一遍。参数锁定:4:3老式画幅、1080p、30秒、双语字幕。

拍摄分两段,走廊15秒,台阶15秒。走廊拍完,它自己截了最后一帧画面,拿去跟台阶那段的开场对齐,颜色、造型、光线全对上——这个"接戏"的动作没人教它,自己补上的。两段拍完,配一条俏皮弦乐,加字幕,合成。

没有世界杯,没有反转,只剩对称构图、糖果色调那种一丝不苟。换一个 Skill,风格说变就变,好用。
三、世界杯决赛夜,一个队医的十五秒
"精品女频短剧一键成片" skill?

“故事发生在世界杯决赛的雨夜,体育场地下通道:国家队队医林晚正给队长陆沉舟缠绷带,队务总监赵总监走过来发难。”
剧本贴进去,它先问了两件事:视觉风格(选了"女频柔光写实")、画面比例——它建议竖屏更适配短剧的情绪表达,我采纳了。

它先把剧本里的每句台词逐字数了一遍,按字数去分配每个镜头该给多长时间。台词和口型对不上是短剧成片的老毛病,它把这道数学题解了。
角色设定图、场景图出齐,整支片子拆成三段十五秒:第一段队医缠绷带、总监发难;第二段队医反击、队长若有所思;第三段队长转身离开、灯光骤亮全场欢呼、队医攥紧绷带定格收尾。

没那么顺利。 第一段视频头一次生成,直接被拦了——触发了平台的版权检测。它没绕开硬闯,先做了个"最小修正":把可能触发检测的场景引用去掉,提示词精简一遍,重新提交,第二次过了。

紧接着又冒出个更隐蔽的问题:三段视频合出来一听,第二段第三段都带着完整对白,唯独第一段——全是缠绷带的动作戏——安安静静,没一句人声。它没拿假声音凑数,老实标了一句:"这段没有对白音轨,字幕需要后期配音才能加上。"先把音量和配乐处理好,能交的先交出来。

成片45秒,钢琴加弦乐,从冷峻一路积聚,到高潮处戛然而止。最后它自己做了一次体检,把定的规则挨个打勾——风格对不对、时长够不够、字幕烧上没有。"某段没有声音"的问题,它没漏没隐藏,老实标了个警告。

工具愿不愿意主动告诉你它哪里没做到,比它做对了多少更让人放心。
四、把自己这套打法,存成一个属于自己的教练
前三支片子,我借的都是别人调好的 Skill。第四支想更进一步:把自己一晚上反复在用的套路,存成一个自己的 Skill,取名"热点快闪短片"——接一个热点事件,配一个反差感十足的小人物,30秒左右,快节奏,自带双语字幕和卡点音乐。


创建时要填三块:什么场景下用(给一个热点+一个反差角色)、怎么用(不用写剧本,按固定三幕节奏自动展开)、最后产出什么(30到45秒、电影感调色、转场丰富的成片)。填完保存,拿它试了一把。
用 热点快闪短片 做一个视频:世界杯决赛之夜,一个加班到深夜的程序员在空无一人的办公室里,用键盘、椅子和垃圾桶复刻了决赛的制胜进球,最后瘫在椅子上对着窗外城市夜景欢呼。

它先把定义的三幕结构复述一遍:赛场全景开场,深夜办公室程序员用办公用品复刻进球,最后瘫在椅子上对夜景欢呼收尾——像是在确认理解得对不对。我说对,它接着规划了四个核心画面,写出一份13镜的分镜表,总时长33秒左右,开始并行生成。

这里又卡了一次。 前几个镜头顺利跑出来,其中两个生成失败——问题出在提示词里引用画面锚点的写法上。它自己定位出问题,改了一版重新提交,跑通了。剩下的镜头分批生成完,最后同步配上一条155秒的"世界杯快闪"BGM,合成收尾。
写在最后
一下午四支片子,喜剧、工整美学、情绪短剧、快闪热点,我没写过一行分镜脚本,做的判断基本都是"满意,继续"这个级别。同一个 Agent,换一个 Skill 就能换出一整套导演思路;两次真正卡壳的地方——版权检测、锚点报错——它都能自己定位、自己改、自己认,没糊弄。体验不错。
LibTV 同步启动了 Skill 超创激励计划,投入1000万元创作激励——想把自己的方法沉淀成一个 Skill 发出去,官方给流量、给现金、给长期收益,感兴趣可以去看那份激励方案。







