AI 视频模型对比:Cicadas.ai 全部模型(2026 年 9 月)
按模型逐一梳理 Cicadas.ai 截至 2026 年 9 月 27 日的 AI 视频模型:输入方式、时长、分辨率、音频与积分价格,附实测样片。

Cicadas.ai 支持十款可直接生成的 AI 视频模型,另外还有一个 Sora 2 页面,说明它下线后可以用什么替代。本篇对比截至 2026 年 9 月 27 日:每个模型的输入方式、时长、分辨率、音频处理方式和一个示例积分报价,以及一小批实测样片的真实画面与声音。这是一份用来挑选起点的参考,不是基准测试,也不是质量排名。
模型对比
| 模型 | 页面 | 输入方式 | 时长 | 分辨率 | 音频 | 示例报价 | |---|---|---|---|---|---|---| | Kling 3.0 Pro | /kling-3 | 文字、单张图片 | 5 秒、10 秒 | 无分辨率选项——实测输出为 1920×1080 | 可选,+50% 积分 | 5 秒静音 = 140 积分 | | Veo 3.1 Fast | /veo-3-1 | 文字、单张图片、首尾帧 | 4 秒、6 秒、8 秒 | 720p、1080p | 可选 | 4 秒 720p 带音频 = 150 积分 | | Seedance 2.5 | /seedance-2-5 | 文字、单张图片 | 4、5、10、15、30 秒 | 480p、720p | 可选 | 5 秒 720p = 592 积分 | | Seedance 2.0 | /seedance-2-0 | 文字、单张图片 | 4、5、10、15 秒 | 480p、720p | 可选 | 4 秒 720p = 303 积分 | | MiniMax H3 Max | /minimax-h3 · /hailuo-ai | 文字、单张图片 | 5、10、15 秒 | 480P、768P | 始终开启 | 5 秒 768P = 100 积分 | | Grok Imagine Video 1.5 | /grok-imagine-video | 文字、单张图片 | 5 秒、10 秒 | 480p、720p | 始终开启 | 5 秒 720p = 175 积分 | | Wan 2.7 | /wan-2-7 | 文字、单张图片 | 5 秒、10 秒 | 720p、1080p | 原生音轨,无开关 | 5 秒 720p = 125 积分 | | Wan 3.0 Prime | /wan-3 | 文字、单张图片 | 5 秒、10 秒 | 720p、1080p | 可选 | 5 秒 720p = 175 积分 | | Gemini Omni Flash 1.1 | /gemini-omni-flash | 文字、单张图片 | 4、6、8 秒 | 720p、1080p | 始终开启 | 4 秒 720p = 100 积分 | | LTX-2.5 Fast | /ltx-2-5 | 文字、单张图片 | 6、8、10 秒 | 720p、1080p | 可选 | 6 秒 720p = 135 积分 | | Sora 2 | /sora-2-alternative | — | — | — | — | 2026 年 9 月 24 日起不可用 |
十款可生成模型都只接受文字提示或一张参考图,目前都不支持多图、视频或音频作为输入。上表每个报价只对应一种时长/分辨率组合,不是该模型唯一的价格——Seedance 2.5 在 4 秒 480p 时报价 221 积分,Seedance 2.0 在 5 秒 480p 时报价 170 积分。积分是按 fal 的标价估算的;真正扣费的是你在对应模型页面上、按你实际设置看到的实时报价,不是上表的数字。
有两项需要单独说明。Kling 3.0 Pro 没有分辨率选项——不管选 5 秒还是 10 秒,实测输出都是 1920×1080。Wan 2.7 完全没有音频开关:每条样片都会返回原生音轨;这和 Gemini Omni Flash 1.1、Grok Imagine Video 1.5、MiniMax H3 Max 不同,后三者的音频同样始终开启,但是作为单独一层生成的,而不是「原生」音轨。
在找 Sora 2?
OpenAI 已于 2026 年 4 月 26 日关闭 Sora 2 应用,又于 2026 年 9 月 24 日关闭 Sora 2 API。它不在上面十款模型之列,本站或其他地方都没有让它恢复的办法。如果你是为它而来,看看现在可以用什么替代。
每个模型一条实测样片,自动化检查
2026 年 9 月 27 日,我们为每个模型各生成了一条样片,并用自动化流程检查了每条样片的音轨——由 google/gemini-3.5-flash-lite 描述它听到的内容,而不是人工听审。以下内容请当作对每个模型一条样片的方向性参考,不是认证记录,也不是基准测试:一个样本只能说明发生过一次什么,不能说明每次都会如此。
这一批样片包括:Seedance 2.5 拍摄夜市大火炒锅(低沉的轰鸣声)、MiniMax H3 Max 拍摄海边公路上的敞篷车(模型自行添加的钢琴风配乐)、MiniMax H3 Max 拍摄蜂鸟微距(环境电子音乐)、Grok Imagine Video 1.5 拍摄宇航员穿越火星红色沙丘(提示词要求了风声和脚步声,返回的却是平静的音乐)、Wan 2.7 拍摄荷叶下的锦鲤(轻微的水滴声)、Wan 3.0 Prime 拍摄火山岩上的海浪(很响的轰鸣声)、Gemini Omni Flash 1.1 拍摄雨中书店里的猫(提示词要求了雨声和雷声,返回的却是柔和的背景音乐)、LTX-2.5 Fast 拍摄潮湿街沟里的纸船(类似风声的沙沙声),以及 Seedance 2.5 480p 版本的粘土狐狸场景(轻柔的配乐)。另外还存档了两条更早的样片:Kling 3.0 Pro 由文字提示生成的月升场景(静音)、Veo 3.1 Fast 由文字提示生成的沙漠场景(带音频)。
其中四条,挑出来展示这个规律的两面:
上面两条「始终开启音频」的样片,加上的是一段配乐,而不是提示词要求的具体环境音;另外两条「可选音频」的样片是主动开启音频生成的,结果更接近字面描述的场景。九个模型九条样片并不能证明这个规律每次都成立——它只能提醒你:生成之后先听一遍,再决定要不要调整,而不是假定音频一定会符合你的描述。
先试哪一个
以下是基于上述数据给出的起点建议,不是排名:
- 长镜头一镜到底——Seedance 2.5 最长可以做到 30 秒不切镜,是这里时长最长的模型。
- 每秒成本最低——MiniMax H3 Max 报价 5 秒 768P 为 100 积分,相当于每秒 20 积分,是表中每秒成本最低的数字。
- 可选音频的草稿——LTX-2.5 Fast(6 秒 720p = 135 积分)或 Veo 3.1 Fast(4 秒 720p 带音频 = 150 积分),可以让你在不换模型的情况下对比同一个镜头的静音版和带音频版。
- 电影感运镜——Kling 3.0 Pro 围绕运镜和物理动作设计;具体怎么写提示词见提示词指南。
生成前请以每个模型页面上的实时报价和当前可用性为准——积分、时长和分辨率选项都可能变化。
关于怎么写提示词,包括这批实测样片给音频提示词的启发,见AI 视频提示词指南。两篇文章共用的实测方法说明见 /methodology。