最上位のVeoで見積もったら、15秒で約2,900円だった
先日、自社の音楽プロジェクトで、TikTokやリール向けの15秒の縦動画を作りました。
静止画を、AIで動かして映像にする。Googleの動画生成AI「Veo 3.1」の最上位モデルで、6カット分を見積もりました。結果は $19.20。1ドル150円で、約2,900円です。
高いと感じた理由は、単価よりも「長さ」でした。
Veo 3.1 で1080pの映像を作れるのは、8秒のクリップだけです。4秒や6秒は選べません。1本 $3.20。でも、15秒の動画を6カットで割ると、1カットで使うのは2秒ほど。残りの6秒は捨てることになります。

じゃあ、ほかのサービスならどうなのか。2026年9月26日時点で、主な12モデルを並べてみました。
比べ方:品質はランキング、値段は公式の料金表
品質は、Artificial Analysis の動画生成リーダーボードを使いました。2本の動画を見比べて、良いほうに投票する方式のランキングです。
そのなかでも「画像→動画・音声なし」部門の、人物(people)カテゴリのスコアを見ています。静止画から動かすこと、音は使わないこと、そして人の顔が主役であること。うちの使い方にいちばん近い物差しでした。
値段は、各社の公式の料金表とAPIのドキュメントから取りました。そのうえで、次の条件で1本分を計算しています。
- 15秒の縦動画を6カットで作る。1カットで使うのは2秒
- 720p級で、いちばん安く作れる設定を選ぶ
- モデルごとの「最短で作れる長さ」で計算する(2秒で作れないモデルは、最短の尺のぶん払う)
- 撮り直しは入れない(テイク1回分)
ランキング:Veoより上に、安いモデルが並んでいた

| モデル(提供元) | 人物スコア | 720p級の単価(1秒) | 最短の長さ | 1本(6カット) |
|---|---|---|---|---|
| Gemini Omni Flash(Google) | 1383 | 約$0.10 | 3秒 | $1.82 |
| Wan 3.0(Alibaba・東京リージョン) | 1379 | $0.083 | 2秒 | $0.99 |
| MiniMax H3 | 1362 | $0.08(768P) | 4秒 | $1.92 |
| Seedance 2.0(ByteDance) | 1356 | 約$0.15(概算) | 4秒 | 約$3.50 |
| PixVerse V6 | 1352 | $0.045 | 1秒 | $0.54 |
| Grok Imagine Video 1.5(xAI) | 1333 | $0.14 | 1秒 | $1.68 |
| Kling 3.0(音声なし) | 1294 | $0.084 | 3秒 | $1.51 |
| Veo 3.1 Fast(Google) | 1262 | $0.10 | 4秒 | $2.40 |
| Runway Gen-4.5 | 1259 | $0.12(720pのみ) | 2秒 | $1.44 |
| Veo 3.1(Google・最上位) | 1255 | $0.40 | 4秒(1080pは8秒のみ) | $9.60(1080pなら$19.20) |
| Veo 3.1 Lite(Google) | 1236 | $0.05 | 4秒 | $1.20 |
| Luma Ray3.2 | 1217(Ray 3の値) | $0.30/5秒 | 5秒 | $1.80 |
一番驚いたのは、Veo 3.1 が3種類とも中位以下だったことです。最上位・Fast・Liteのどれも、人物のスコアは1236〜1262。その上に、新しいモデルがいくつも並んでいました。
しかも上位のモデルの多くは、Veo最上位より1本あたり一桁安い。品質を上げながら、費用を10分の1以下にできる計算です。
上位のモデルで、実際どんな映像ができるのか
数字だけだと想像しにくいので、各社が出している映像を貼っておきます。どれも公式の発表に添えられていたものです。
Gemini Omni Flash(Google)
Google DeepMind の公式アカウントの投稿です。映像の編集や、画像・文字を組み合わせた生成の例が見られます。
Wan 3.0(Alibaba)
Wan の公式アカウントによる、Wan 3.0 公開時の投稿です。1回の生成で最大30秒まで作れるのが売りです。
Seedance 2.5(ByteDance)
6月末に ByteDance の発表会で公開された、Seedance 2.5 の紹介映像です。投稿は、映像を紹介した Deedy 氏のもの(ByteDance の公式アカウントではありません)。7〜8月は、このあたりの映像がタイムラインにあふれていました。
PixVerse V6 は、公式の動画が見つかりませんでした。作例はPixVerse の V6 紹介ページで見られます。
なお、ここに貼った映像はどれも、各社がいちばん見せたい作例です。自分の素材でも同じ仕上がりになるとは限りません。そこは後半の「自分の素材で試す」につながります。
目的別のおすすめは3つ
品質で選ぶなら:Gemini Omni Flash
人物スコアで1位。Googleの新しい動画モデル(公式ページ)で、Veoと同じ Gemini API から使えます。いまVeoを使っているなら、同じAPIキーのまま乗り換えられるのが大きいです。9:16の縦にも対応しています。
注意点は2つ。音声が必ず付いてくること(使わないなら消すだけです)。それと、1080pの単価がまだ公式の料金表に載っていないことです。
品質と値段のバランスなら:Wan 3.0
人物スコアは2位で、1位とほぼ差がありません(Alibaba Cloud Model Studio)。2秒から作れて、音声も止められる。東京リージョンなら1080pでも1秒$0.165です。今回の条件に、いちばん素直に合うモデルでした。ただし、まだパブリックベータなので、価格や仕様は変わるかもしれません。
とにかく安くなら:PixVerse V6
1本 $0.54、約80円(PixVerse 公式)。1秒から作れるので、捨てる尺がほとんど出ません。それでいて人物スコアはVeoのどれよりも上です。下書きや、カットの当たりをつける用途にちょうどいいと思いました。
SeedanceとVeo、それぞれの落とし穴
8月は、Seedance がかなり流行っていました。6月末に次の Seedance 2.5 が発表され、タイムラインで Seedance の映像を見かけない日がないくらいでした。
実際、Seedance 2.0 は人物スコアが1356と上位です。ただ、公式API(BytePlus)の仕様では、写実的な人物の顔が写った画像を、そのまま入力できません。例外は、自社モデルが作った画像か、許諾を取った本人の素材だけ。写真のような人物を動かしたい用途では、ここで止まります。料金もトークン単価なので、1秒あたりは概算です。
Veo 3.1 は、Fast(1秒$0.10)やLite($0.05)に下げれば、ぐっと安くなります。720pなら4秒から作れるので、最上位の1080pにこだわらなければ、1本 $1.20〜$2.40 です。ただ、1080pにすると、どのグレードでも8秒の縛りが戻ってきます。
もうひとつ。OpenAIの Sora 2 は、APIが2026年9月24日に終了しています。これから選ぶなら、候補から外してください。
ランキングは「同じ顔が崩れないか」までは測っていない
ここは正直に書いておきます。
今回使ったランキングは、見た人の好みを集めたものです。うちがいちばん困るのは「動かしたら別人の顔になる」ことですが、それを直接は測っていません。スコアの誤差も、上下10〜15くらいはあります。上位の3〜4モデルは、ほぼ横並びと見たほうがいいです。
なので、決め方はシンプルにしました。自分の静止画で、上位の3モデルを2本ずつ試す。費用は合わせて $2 もかかりません。ランキングで絞って、最後は自分の素材で決める。これがいちばん確実です。
で、結局どうしたか
今回の15秒は、実は0円で作りました。
以前、同じ作品のPV用に作っておいた動画素材が手元にあったので、それを縦に切り出して使いました。色の調整、字幕、カットの切り替えは、全部コードで計算しています。やり方は、前回のコラムで書いた「動画を計算で作る」仕組みと同じです。
新しく作る必要が出たら、次はまず上の3モデルを試します。AIの動画は、「一番いいモデル」が数か月で入れ替わる分野です。料金も、驚くほど変わります。半年前の「定番」をそのまま使い続けるのが、いちばん損をしやすいと感じました。
「うちの業務で、どのAIをどう使えばいいのか」という相談も受けています。比べるところから、一緒にやります。
▼関連リンク
『30分無料プロトタイプ提案』の相談
手を動かして学ぶ DX-NoCodeBootCamp®
まとめ
- Veo 3.1 最上位の1080pは8秒でしか作れない。15秒の動画で1カットに使うのは2秒なので、6秒ぶんは捨てることになる
- 人物の品質スコアでは、Gemini Omni Flash と Wan 3.0 がほぼ同率の首位。Veo 3.1 は3種類とも中位以下だった
- 15秒1本の費用は、Veo最上位の1080pで$19.20。PixVerse V6なら$0.54、Wan 3.0なら$0.99
- Seedance 2.0 は品質が高いが、写実的な人物の顔の画像を入力できない。Sora 2 はAPIが終了済み
- ランキングは「同じ顔が崩れないか」を測っていない。最後は自分の素材で2本ずつ試して決める
本記事の内容は2026年9月26日時点のものです。料金とランキングは頻繁に変わるので、使う前に各社の公式ページで確認してください。
参考:Artificial Analysis 画像→動画リーダーボード/Gemini API 料金(Veo・Omni)/Gemini Omni/Wan 3.0/PixVerse/MiniMax/BytePlus(Seedance)/Kling/Runway/Luma/xAI/OpenAI(Sora 2 のAPI終了)


