star33 在 LLM的力大砖飞时刻 中发帖

一力破万法! 
用之前注册的hark免费账户生成的mv,每张画都是让他去调用内置生图模型制作的(猜测是gpt image),歌词是hark内置的对话模型(猜测是opus5.5)写的,音乐由他自己调用suno制作。美中不足的是免费账户的日限额不多,现在这个mv的每秒换画数大概是4-5张,如果能每秒插12张画就很丝滑了。
等LLM的参数再大点,是不是可以碾压那些做多模态生成的模型呢?期待真正的agi时刻了。