【铂程的票圈34】认真做菜

*可能一开始,就只是好奇,开始玩midjourney,接着玩suno。开始都没有想到要做视频,因为那个时候,也没有能做成哪怕5秒种的AI工具;

玩suno的时候,就想到,要分享出来,建立一个反馈系统。一个人偷偷玩,也不告诉谁,偶尔会在票圈贴几个。(现在我才意识到,其实,当时自己的耳朵是听不出什么好坏的。。。。)

喷嚏开始放一些早期的suno。也是想反馈。

一个纯粹的做系统的思维。我专门挑了两个自己完全零基础的行业开始,更能体现AI的能力的进步。

当时,也没想太多,想到就做了。

这就是你们刚开始看到的场景,我把suno和midjourney 联合起来用,为了合成为一个适合播放的视频,顺便把剪映也用了(用工具比较简单)。

我当时的想法是,这样两个东西就可以同时玩,而且每次,都可以交付一个结果。

这在系统的观点看,就闭环了。

剩下的事情,就观察AI如何迭代。

稀里糊涂地玩了一年,结果,发现自己也在迭代。用工具制作的过程,意识到,其实自己在学习一种全新的表达。

音乐的开头还是想法,图像的开头也是想法。那么,想法,最开头,不就是用文字表达的吗?

这么一想,胆子就大了。反正,试试看,又不会死人。

做suno的时候,为了找歌词,把唐诗宋词梳理了一遍,还看了辛波斯卡、布莱希特、冯至和穆旦等。这些,都是我以前没有打算看的。

本来是要看AI如何迭代的,结果,发现自己的知识,也在不停地以一种奇怪的方式在迭代。

到了去年,midjourney也开始推出可以无限做视频的版本时,我又觉得好玩。

要同时玩三样东西——音乐、绘图和视频。一个很小规模的结果,不就是MV吗?

一首MV,不会过短,15秒,全是AI干了,太不好玩了。做到几分钟内,又不长,不花太多的时间和费用。可以自己直接生产多巴胺。何乐而不为呢。

 

如何写字,我一直是知道的。现在,在玩了差不多三年的AI后,我觉得自己开始有点感觉,知道如何把文字视觉化了。

去年10月,我开始做小视频的时候,连 景别 这个专业词汇,都不知道。我是先做了一阵,买了一本电影方面的书看了才知道有这个词。看了几页,就把书放下了。我还是先做,再看吧。

但,前几年看了上千部电影,怎么运镜,什么是第一人称镜头。自己早知道了。我知道怎么用,但不知道,专业里面叫什么。

所以,我很清楚地记得以前看《让娜·迪尔曼》里面那个著名的 景别的感受。你管它叫什么,是景别,还是其他名字,其实,不重要。

而是一出来,你就能感受到它的与众不同。

有时,靠直觉,不一定是坏事。 

 

本质上,就这么一路玩下来了。

真的,没想太多,就只是玩玩而已。。。。

我现在会备份以前做的东西,回头看。我庆幸自己把时间浪费了在了多么美好的事物上。

 

我在自己以前从来没想过,甚至想都不敢想的领域里,玩得不亦乐乎。

人生居然有这么多好玩的,有这么多不可思议的可能性。

 

seedance 2 出来当天,和之后几天,做了些测试。 

 

20260212

seedance 2.0 测试 (5秒)
提示词:
演唱者视角,站在70年代黄昏的露天摇滚舞台上,面前是紧密挤在一起的人群,裸露的双手高举,长发与牛仔在节奏中晃动。没有手机,几乎没有相机——只有身体在摇、在拍手、在用最原始的方式齐唱。舞台结构简单,自然光逐渐转暖,观众的存在感强烈而贴近,纪录片式写实

(视频)

 

Seedance 2.0 测试 (15秒)
再来一个观众视角的——


提示词:
从70年代露天摇滚现场人群后方近景拍摄,肩膀彼此挤压,双手高举,所有人朝着简朴的露天舞台大声合唱。乐队在逐渐消退的日光下演出,灯光极少,全场像一个活着的整体一起拍手、摇摆、在副歌处吼唱。没有屏幕,没有记录设备,只有集体能量,复古纪录片质感

(视频)

20260213

seedance 2 test : 首尾帧用midjourney画的。seedance做的一个转场

(视频)

这段后来放入了,苏轼的 一叶舟轻,双桨鸿惊-suno。成片时,在剪映里面加了点调色

(视频)

 

20260413

在小云雀里面,用seedance 2 做一个测试,上传了一张图片,给了一个局部的剧本。它自动拆解,生成了一个21秒的视频片段,前面切菜,做饭,端上桌子,都是它自己添加的。参考图,就是最后大家都在桌子上。我传错了图,里面有个大bug。想修改,积分不够了。。。。

(*那个大Bug就是:后面居然出现了自来水龙头。。。不注意的话,可以忽略。) 

(视频)

这段视频,后来放入了  人生不相见,动如参与商-SunoMV

(视频)

 

20260504

有了gpt-image-2后,原来其他第三方平台的token用不完了。做了个seedance 2的猫视频来玩。现在做这种小视频,几乎不用动脑子了。。。

提示词:
主题:
一只认真到离谱的猫,在现代化家庭厨房里做番茄炒蛋,整个过程像史诗级料理任务,严肃又搞笑。
人物:
一只圆脸橘色虎斑猫,胖乎乎,表情极其严肃,像专业大厨一样专注。它站在灶台前,用猫爪握着木铲翻炒番茄炒蛋,动作笨拙但充满仪式感。
服装:
黑色小厨师围裙,围裙正面有白色中文文字。
重要:如出现文字,必须精确拼写为“认真做菜”,勿更改、勿翻译、勿变形。所有镜头中文字保持可见、可读、字体一致。不要出现其他文字。
环境:
现代化家用厨房,深色橱柜,干净石英台面,嵌入式燃气灶,暖色柜底灯,背景有锅具、鸡蛋、番茄、葱花、小碗和木质砧板。厨房整洁高级,但猫做菜的行为带来反差喜感。
氛围:
严肃、紧张、荒诞、可爱、电影感强。像一场决定命运的料理比赛,但主角是一只猫。节奏快速,动作清晰,笑点来自猫的认真表情和夸张的厨师姿态。
音乐:
严肃管弦乐 + 低音鼓点 + 轻微喜剧拨弦,约100 BPM。前半段像史诗任务,后半段加入滑稽节奏,最后以庄严收束音结束。
色彩逻辑:
主色为暖黄、深灰、番茄红、鸡蛋金黄。厨房背景偏高级冷灰,锅中番茄炒蛋颜色鲜亮,火焰和蒸汽营造热烈视觉中心。
风格:
电影广告质感,高清写实,轻微夸张喜剧风,快速剪辑,浅景深,动态运镜,食物特写诱人,猫的表情要连续一致。
逻辑规则:
保持同一只橘色虎斑猫;保持黑色围裙和“认真做菜”文字一致;保持现代厨房空间一致;不要加入人类或其他动物;不要切换到无关场景;整个视频控制在15秒左右;镜头切换快速但动作清晰;番茄炒蛋从下锅、翻炒到出锅形成完整递进。
镜头1:
近景,35mm,低机位缓慢推进 / 橘猫戴着黑色围裙站在灶台前,眼神严肃盯着锅 / 围裙文字“认真做菜”清晰可见 / 音效:低沉鼓点开始。
镜头2:
特写,85mm,俯拍 / 猫爪把切好的番茄推入热锅,油花轻微飞溅 / 红色番茄与黑色锅形成强对比 / 音效:滋啦声。
镜头3:
中近景,50mm,手持轻微晃动 / 猫双爪握木铲,笨拙但认真地翻炒番茄 / 猫脸严肃得像在执行重大任务 / 音效:管弦乐加强。
镜头4:
极近特写,100mm微距 / 金黄色鸡蛋液倒入锅中,迅速凝固,与番茄混合 / 食物色彩鲜亮诱人 / 音效:鼓点加快,轻微喜剧拨弦。
镜头5:
中景,35mm,横向跟拍 / 猫用力一翻锅,番茄炒蛋短暂腾空,动作夸张但不混乱 / 蒸汽升起,火焰跳动 / 音效:夸张“呼”的一声。
镜头6:
近景,70mm,快速推近 / 猫停顿一秒,眯眼审视锅里的菜,表情像严厉大师 / 严肃与可爱形成强反差 / 音效:音乐突然短暂停顿。
镜头7:
成品特写,50mm,缓慢下移 / 番茄炒蛋被盛入白色盘子,颜色红黄鲜亮,热气上升 / 猫爪把盘子推到镜头前 / 音效:庄严收束音。
镜头8:
正面中近景,35mm,轻微推进 / 橘猫站在盘子后面,仍然一脸严肃,像完成了伟大使命 / 围裙文字“认真做菜”最后一次清晰可见 / 音效:严肃管弦乐结尾加入一个滑稽小音符。

 

一只认真到离谱的猫,在现代化家庭厨房里做番茄炒蛋

(视频)

 

 下次,我讲一下,是如何手搓奥威尔的《动物农场》的SunoMV。你们会看到一个简单的SunoMV的完整制作过程,也包括思考的过程,一个具体而微的项目开发流程。这里面包含了所有的部分:文字从哪里来,角色如何设定,分镜如何画,最后剪辑是怎样完成的。创意和工具是如何配合实现产品的基本目标的。

其实,这是一种系统分析的办法,我从软件行业里获得经验,只不过这次移植到了玩耍的领域。

上面那个猫视频的提示词,是我蒸馏来的。我会告诉大家,一个通用的蒸馏方法。

 

版权声明:
作者:Zad
链接:https://www.techfm.club/p/237797.html
来源:TechFM
文章版权归作者所有,未经允许请勿转载。

THE END
分享
二维码
< <上一篇
下一篇>>