现在各种模型跑分满天飞,但真用起来和榜单差距挺大。我觉得几个原因:
- 刷榜:有些厂商对着榜单优化,换个题就露馅
- 题目泄露:训练数据里可能混进了评测题
- 场景不对:榜单是通用题,你的场景可能是垂直的
所以我一直建议:别迷信榜单,拿你自己的真实任务,小样本测一下,比看一万个跑分都准。
现在各种模型跑分满天飞,但真用起来和榜单差距挺大。我觉得几个原因:
所以我一直建议:别迷信榜单,拿你自己的真实任务,小样本测一下,比看一万个跑分都准。
最近用 AI 做了个古风短剧,流程分享下:
最难的就是角色一致性,我的办法是:固定 seed + 详细的外貌描述(发色、服饰、额头的印记这种标志性特征都写死),每次出图都带上同一段描述。
这样出来的角色虽然不能 100% 一样,但观众基本认得出是同一个人。比之前动不动就「换脸」强多了。
分镜表示例:
第1集:
- 镜头1:主角站在山顶,俯瞰云海(远景)
- 镜头2:主角转身,眼神坚定(特写)
- 镜头3:主角拔剑,剑光闪烁(中景)
整个流程跑下来,虽然累,但看到成片的那一刻还是挺有成就感的。