8.26 怎么会有这种听不懂指令的模型?我甚至觉得它远不如豆包。 这真是匪夷所思。 使用了官方的提示词skill,我对Codex的指令也是按照动作、按照分镜、按照机位来设置的,它居然一点都听不懂啊。 其运动轨迹也毫无美感,直来直去丑死了。 我发了参考图给它,它都一点都不读啊,怎么会有这样的情况啊? 我一共试验了两个场景,一个人物相关的,一个是物品移动的。只有这个人物相关的,在我第三次抽卡的时候成功了,其他的一次都没出。真的是挫败感真的很强啊。 我猜是我的使用方法有问题。 8.27 我刷到b站一些工作流可以减少抽卡时间,质量也能提高,我之后试试。 一番折腾之后感觉Wrok-Fisher的工作流最好,20步速度都差不多。
最后使用下来制作出来一个比较听话的skill 但是ai对视听语言和动作设计还是很差,很多描述听不懂。Seedance目前还是更厉害,但是非常烧钱。 打算用gpt帮我做资产和blender里不会做的事情,让他进行超级拼装。