在Blender中建模一个虚拟角色,进行骨骼绑定,制作不同动作的动画,并逐帧捕捉。然后获取虚拟角色的精灵图以及对应的提示词。

接着,将这些精灵图和提示词,连同目标角色的图像,通过Image 2.5输入到ChatGPT中,以生成精灵图——感觉这样能得出相当可用的结果?

当然,我达到了Codex的上限,所以还没能测试这个方法。