我上周把 imgmov 现在真的在线的模型重新过了一遍,不是把以前的宣传稿再抄一遍。这句话很重要,因为旧文章里还写着 CogVideoX-Flash、Seedream 4.5、Seedance 2.0 和一些已经不准的价格。搜索引擎喜欢第一手经验,但读者更讨厌被旧价格骗进去,所以我先按当前模型列表重算了一遍。
我现在怎么分层
先把 Agnes Image 2.1 Flash 和 Agnes Video V2 当作试错层。前者适合看构图、色彩、主体位置,后者支持文字生成视频和图片生成视频。访客试用每天最多三次,输出有水印,1K,一次一个结果,也不用于商业交付。我不会在这个阶段追求完美,只回答一个问题,这个想法值不值得继续花积分。
图片生产层看三个模型。Seedream 5.0 Lite 和 Nano-Banana 2 每张 5 积分,都有八种比例,前者偏推理和复杂构图,后者偏自然的照片感。GPT Image 2 从 Standard 1K 的 2 积分开始,按画质和分辨率一路到 High 4K 的 80 积分。只要画面里有包装、标签、招牌这类文字,我就会先用 GPT Image 2 试一版,然后逐字检查。
视频生产层更贵,也更需要克制。Seedance 2.5 是按分辨率计价,480p 每秒 18 积分,720p 每秒 39 积分。Kling v3 Omni 每秒 39 积分,加原生音频是 49 积分每秒。Veo 3.1 按 4 秒 80 积分、6 秒 125 积分、8 秒 165 积分走。这个价格不是吓人,而是提醒我先想清楚动作。
我真正会重复的工作流
我会先写一个很短的句子,再把它砍到不能再砍。
A golden retriever running through a field of sunflowers, low tracking camera, golden hour light, shallow depth of field, natural grass movement, cinematic color
写完我会问自己,第 2 秒到第 5 秒到底发生了什么。如果我也说不出来,模型更说不出来。视频提示词不是描述一幅画,是描述时间和运动。
图片提示词反过来,先锁产品,再写场景。比如杯柄在左边,就写杯柄在左边。场景再漂亮,产品变了都是废图。
我踩过的坑
我以前把价格当后期才考虑的事。后来发现一个 5 秒 Seedance 2.5 720p 视频要 195 积分,生成完才发现提示词不对,这个学费太贵。所以我改成两段式。
- 用 Agnes 试用或便宜图片稿确认构图。
- 把一张确认过的图转成短视频。
- 最后才用 Seedance 2.5、Kling v3 Omni 或 Veo 3.1 出正式片。
这样做表面上慢,实际上省了反复重跑的钱。
FAQ
Q: 新手应该怎么开始?
A: 先用 Agnes Image 2.1 Flash 看构图,再用 Agnes Video V2 看运动,概念成立后再上付费模型。试用每天三次且有水印,所以要留着验证关键想法。
Q: 画面里有文字应该选哪个模型?
A: 先用 GPT Image 2。它在 imgmov 的图片模型里更擅长标签和包装文字,但生成后还是要逐字检查。
Q: 怎么预算积分?
A: 先按模型、时长、画质和分辨率算,再开始生成。Seedance 2.5 和 Kling v3 Omni 按秒计价,Veo 3.1 按时长分桶。