aigc 5

AI工具12 次阅读5 分钟

AIGC生成第5天,今天基本上把自己为那个UGC线下活动的片子,基本上我觉得完成了。中间又改了很多,加了拉了,又把之前的剧脚本故事又推翻了重新做。但中间也找了一个相对讨巧的方式,可能看多的人也能看出来,那我是感觉,我自己认为是在短视频现阶段在描述什么东西。然后做的时候也讨论了,我觉得印象最深刻的是,做的时候讨论了,跟我找了我的做后期编导的侄女,她帮我协助我剪辑。她在我们在后期在讨论新的想法,或者怎么让剧情能看得懂的时候,讨论了,讨论到的点之后,还延伸出更细致的,怎么让,怎么让那个我们想要的东西更能在镜头里面让人看得清楚、看得懂。然后但后来发现,这个短短一两秒的东西,里面所包含的信息和那些解释镜头可太多了。可能我们人太容易把很多信息,你从一个信息压缩感受,但是你作为一个用视频影像去传递的人来说,他就不仅仅是要压缩,在有限的时间线里面塞满可以让对方懂的信息,也是在做尽可能尽量写,但是你不能只有文字,只有画面,只有那些东西。除非你那个纸飞机是很纯粹的。所以我觉得那anyway,在上午讨论完,下午就把它基本上做成型了。后续晚上又想精益求精,就是说在这个稿件基础上就是增益它的清晰度。我这边也走了一些小小的体感。我这些素材是在三四个品牌里面做,有在Minimax Design,有在积木做,有在Bilibili TV做,它用不同模型,有的是用One三点零,有的用Minimax H三,有的用积木C杠三点五。也是不同的人做,这边也,我是目前是没看出来什么太多的差异啊,就是现阶段这个现阶段,但多多少少,反正他们各有千秋吧。然后我使用的是性价比,从性价比角度就是哪边有积分,我尽量用东西。出发的,后续发现还想就是把它基本定稿的精确,永远就想直接交了算了。因为当时我觉得也做了结尾,做了一些包装什么的。后续想想,我还做了音频克隆,我发现我音频克隆也是一件很简单的事,你要让,虽然都是同样的音色,你怎么让那些那个同样音色的人按照你想要的语气口吻去发音和读,也背后也是一个叫如何去control和操控的一个事。我今天上午只有短短的一句话,我就操控了五六分钟。那这个只是我作为初次来说可能需要去经历的必经之道。那我就很难想象那个之前我关注的或者我想那个他们团队他们在三年前做那个人物演讲的演讲,他们那个原则控制,让人家觉得虽然都是那些明星或者听,但是他说的腔调就让人家觉得就是那个人。那是那背后的学习还是有一门手法。我今天晚上本身不想,还想提前交稿,但是我想着能做好,不要后悔的情况,我就想着去把这些已经做好的片段镜头进行超分,就是清晰度提升。其实清晰度提升不是我自己这几天提满的时候应该也知道,它跟原生的生成还是有区别,超分和原生还是是有区别。然后不同平台它有不同的生成逻辑。我我自己试了几个,4K的,其实也看不清楚。我那画质比较弱,就是比较油,脸比较油,它这个还是油的,真的就还是很油的。因为本身人物脸没有做很好的控制,只是就给一个东西就过去了。但是那个提示词就很随机,量产,泛化的形式。第二个第二个是用了不同平台的超分,发现真的,MiniMax hub里面的超分,它有的是二十几兆,有的是10兆,同样时间真的看不明白。然后那个,那像在那个liblibli tv里面超分的4K的,然后我非要把数据拉到底,其实也都不知道到底有没有用。合不合适,拉到底之后,在画布里面是能读取,但读取也卡顿。最很有趣的是,我把它下到本地的时候,当时设置的超分4K120 FPS,结果在我的那个电脑下看,它是放慢速度看,我不太懂为什么,这个我先记着,估计后续是得研究一下。他当时也选,也有倍速调整,我没去研究,就自己想当然选了最低的。 哎呀,但是线上是消耗token的,都都交学费去了。就看明天拿到这些素材的我的我的职业最终剪出来是什么样的?那后续我会经过,我先今天先总结一下,一个点是,后续我会有时候是,前期在做研发的时候,在测提示词的大概的一个完成度和向往度的时候,我会倾向于拿低的消耗的API去测试,比方说,你可以拿本地做最简单的测试,然后再拿更便宜的,相对来说便宜点的API去做第一分辨率的测试。后续如果有把握了,或者基本上凑出来搞OK了,你再去超分。但反正超分的分辨率也不是那么高,它只是好那么一点点。或者说你可以尝试,如果你是觉得那个提示词已经把握度很高,或者它的约束已经基本上稳定了,那你再选择直升4K。当然这如果真的花得起的话,像直升4K一张真的是几十块钱啊,相当于。就花爆了,这个如果就废片,就相当于就是,为这个,但是也是为了叙事,就是就像这个这个片子太废了,废片。

继续阅读

基于全文检索与主题相似度