画像から動画へ テキストから動画へ $0.12 ~ / 動画
Pollo 2.5は、音声の同期、一貫性のあるキャラクター、そしてスタイル、動き、カメラワークの精密な制御により、まとまりのあるマルチショットビデオを作成します。
入力 価格を表示するには、必須項目を入力してください。
Text To Video · 720p · 5s
生成 モード オーディオ 長さ 解像度 タイプ 価格 basic はい 4s 720p 画像から動画へ $0.288 テキストから動画へ $0.288 1080p 画像から動画へ $0.384 テキストから動画へ $0.384 5s 720p 画像から動画へ $0.36 テキストから動画へ $0.36 1080p 画像から動画へ $0.48 テキストから動画へ $0.48 6s 720p 画像から動画へ $0.432 テキストから動画へ $0.432 1080p 画像から動画へ $0.576 テキストから動画へ $0.576 7s 720p 画像から動画へ $0.504 テキストから動画へ $0.504 1080p 画像から動画へ $0.672 テキストから動画へ $0.672 8s 720p 画像から動画へ $0.576 テキストから動画へ $0.576 1080p 画像から動画へ $0.768 テキストから動画へ $0.768 9s 720p 画像から動画へ $0.648 テキストから動画へ $0.648 1080p 画像から動画へ $0.864 テキストから動画へ $0.864 10s 720p 画像から動画へ $0.72 テキストから動画へ $0.72 1080p 画像から動画へ $0.96 テキストから動画へ $0.96 11s 720p 画像から動画へ $0.792 テキストから動画へ $0.792 1080p 画像から動画へ $1.056 テキストから動画へ $1.056 12s 720p 画像から動画へ $0.864 テキストから動画へ $0.864 1080p 画像から動画へ $1.152 テキストから動画へ $1.152 15s 720p 画像から動画へ $1.08 テキストから動画へ $1.08 1080p 画像から動画へ $1.44 テキストから動画へ $1.44 なし 4s 720p 画像から動画へ $0.12 テキストから動画へ $0.12 1080p 画像から動画へ $0.216 テキストから動画へ $0.216 5s 720p 画像から動画へ $0.15 テキストから動画へ $0.15 1080p 画像から動画へ $0.27 テキストから動画へ $0.27 6s 720p 画像から動画へ $0.18 テキストから動画へ $0.18 1080p 画像から動画へ $0.324 テキストから動画へ $0.324 7s 720p 画像から動画へ $0.21 テキストから動画へ $0.21 1080p 画像から動画へ $0.378 テキストから動画へ $0.378 8s 720p 画像から動画へ $0.24 テキストから動画へ $0.24 1080p 画像から動画へ $0.432 テキストから動画へ $0.432 9s 720p 画像から動画へ $0.27 テキストから動画へ $0.27 1080p 画像から動画へ $0.486 テキストから動画へ $0.486 10s 720p 画像から動画へ $0.30 テキストから動画へ $0.30 1080p 画像から動画へ $0.54 テキストから動画へ $0.54 11s 720p 画像から動画へ $0.33 テキストから動画へ $0.33 1080p 画像から動画へ $0.594 テキストから動画へ $0.594 12s 720p 画像から動画へ $0.36 テキストから動画へ $0.36 1080p 画像から動画へ $0.648 テキストから動画へ $0.648 pro はい 4s 720p 画像から動画へ $0.312 テキストから動画へ $0.312 1080p 画像から動画へ $0.408 テキストから動画へ $0.408 5s 720p 画像から動画へ $0.39 テキストから動画へ $0.39 1080p 画像から動画へ $0.51 テキストから動画へ $0.51 6s 720p 画像から動画へ $0.468 テキストから動画へ $0.468 1080p 画像から動画へ $0.612 テキストから動画へ $0.612 7s 720p 画像から動画へ $0.546 テキストから動画へ $0.546 1080p 画像から動画へ $0.714 テキストから動画へ $0.714 8s 720p 画像から動画へ $0.624 テキストから動画へ $0.624 1080p 画像から動画へ $0.816 テキストから動画へ $0.816 9s 720p 画像から動画へ $0.702 テキストから動画へ $0.702 1080p 画像から動画へ $0.918 テキストから動画へ $0.918 10s 720p 画像から動画へ $0.78 テキストから動画へ $0.78 1080p 画像から動画へ $1.02 テキストから動画へ $1.02 11s 720p 画像から動画へ $0.858 テキストから動画へ $0.858 1080p 画像から動画へ $1.122 テキストから動画へ $1.122 12s 720p 画像から動画へ $0.936 テキストから動画へ $0.936 1080p 画像から動画へ $1.224 テキストから動画へ $1.224 15s 720p 画像から動画へ $1.17 テキストから動画へ $1.17 1080p 画像から動画へ $1.53 テキストから動画へ $1.53 なし 4s 720p 画像から動画へ $0.144 テキストから動画へ $0.144 1080p 画像から動画へ $0.24 テキストから動画へ $0.24 5s 720p 画像から動画へ $0.18 テキストから動画へ $0.18 1080p 画像から動画へ $0.30 テキストから動画へ $0.30 6s 720p 画像から動画へ $0.216 テキストから動画へ $0.216 1080p 画像から動画へ $0.36 テキストから動画へ $0.36 7s 720p 画像から動画へ $0.252 テキストから動画へ $0.252 1080p 画像から動画へ $0.42 テキストから動画へ $0.42 8s 720p 画像から動画へ $0.288 テキストから動画へ $0.288 1080p 画像から動画へ $0.48 テキストから動画へ $0.48 9s 720p 画像から動画へ $0.324 テキストから動画へ $0.324 1080p 画像から動画へ $0.54 テキストから動画へ $0.54 10s 720p 画像から動画へ $0.36 テキストから動画へ $0.36 1080p 画像から動画へ $0.60 テキストから動画へ $0.60 11s 720p 画像から動画へ $0.396 テキストから動画へ $0.396 1080p 画像から動画へ $0.66 テキストから動画へ $0.66 12s 720p 画像から動画へ $0.432 テキストから動画へ $0.432 1080p 画像から動画へ $0.72 テキストから動画へ $0.72
終点
POST https://pollo.ai/api/platform/v1/generation/pollo-ai/pollo-v2-5/videoコピー モード
Text To Video Image To Video
APIドキュメント全体を表示 Pollo APIでPollo 2.5を実行
Pollo 2.5は、音声同期、キャラクターの一貫性、プロンプトで定義したカメラ動作に対応したマルチショット動画生成をサポートしています。
Pollo APIを通じて、開発者はPollo 2.5をtext-to-video、image-to-video、参照ガイド付きワークフローで活用でき、ストーリーテリング、広告、トレーニング、クリエイター向けアプリに利用できます。
Pollo 2.5 APIの主な機能
マルチショットの連続性
Pollo 2.5はつながりのあるシーン展開を処理し、各ショットを個別に扱うのではなく、短いシーケンス全体でキャラクター、環境、物語の文脈を揃えて維持します。
ネイティブ音響デザイン
このモデルは動画に合った音声を生成でき、環境音、セリフのきっかけ、効果音まで含めて、後付け感のない自然なアクション演出を実現します。
キャラクター同一性の安定性
参照ガイド付き生成により、顔、服装、認識しやすい特徴を保持しやすく、継続出演するプレゼンター、マスコット、連載型ストーリー形式に適しています。
指向性のあるカメラワーク
プロンプトでカメラ移動、フレーミング変更、オブジェクトの動きの演出を指定できるため、クリエイターはシーンの見せ方をより強くコントロールできます。
スタイル参照コントロール
Pollo 2.5はアートディレクション用のビジュアル参照に追従できるため、ブランドのムード、アニメーションスタイル、イラスト調の見た目を出力間で一貫させるのに役立ちます。
詳細なプロンプト理解
このモデルは、キャラクター、タイミング、ショット順、音の意図、動きの詳細を同じクリエイティブブリーフに含めた多層的な指示にも高い精度で応答します。
Pollo 2.5 APIのユースケース
連載キャラクター動画: エピソードクリップ、ブランド解説、クリエイターチャンネル向けに、シーンをまたいで同一性を保った継続キャラクターを作成。
絵コンテから動画へのプロトタイプ: ショットリストを、音声・カメラ演出・シーントランジション込みの初期動画ドラフトに変換。
UGCスタイルの対話広告: 発話タイミング、表情、背景音が重要な、プレゼンター風または顧客風の短いシーンを生成。
トレーニングシナリオ動画: 職場・医療・教室・安全分野で、複数手順の行動を映像と音で明確に示す例を構築。
参照ベースのブランドストーリー: キャンペーンのイラストスタイル、色彩世界、キャラクター外観を複数の動画素材で安定して維持。
ナラティブアプリのワークフロー: ユーザーがキャラクター、ショット順、ムード、音を1つのプロンプトで定義できる、ガイド付きストーリー生成をアプリに追加。
解説シーン生成: カメラの焦点制御、オブジェクト移動、ナレーション調の同期音声を備えた簡潔な視覚解説を作成。
Pollo 2.5 APIの使い方
APIキーを取得: Pollo APIアカウントを作成し、開発者ダッシュボードからAPIキーを生成。
モデルを選択: /generation/pollo/pollo-v2-5 にPOSTリクエストを送信。
入力を追加: プロンプト を指定し、必要に応じて 画像、長さ、解像度、アスペクト比、モード、音声生成 を追加。
生成と取得: タスクを送信し、返却されたタスクステータスをポーリングして、処理成功後に完成動画をダウンロード。
Pollo 2.5 APIのプロンプトベストプラクティス Pollo 2.5へのプロンプトは、簡潔な制作ブリーフとして書くのがおすすめです。ショット順、キャラクターの連続性、カメラ動作、音の意図、最後の物語ビートを含めましょう。
シンプルなプロンプト式 [ショット順] + [キャラクター/参照の詳細] + [カメラ動作] + [音声/セリフのキュー] + [連続性ルール] + [締めのビート]
注目すべきポイント
ショット構成: 1つの詰め込みすぎた瞬間を説明するのではなく、シーンを2〜3の明確なビートに分ける。
キャラクタールール: 服装、顔の輪郭、年齢、役割、象徴的な小物など、変えない要素を明示する。
音の目的: 環境音、話し声、音楽、効果音、または終わり前の特定の間が必要かを説明する。
カメラ意図: カメラ移動は演出の装飾ではなく、情報を見せるために使う。
スタイルの固定: 参照を使うときは、重視するスタイル特性(配色、質感、線画、照明、ムード)を説明する。
プロンプト例
アーカイブ室での発見 "ショット1:都市アーキビストが地下の資料室の鍵を開ける。蛍光灯がちらつく。ショット2:ラベル付きのテープ箱を見つけ、日付を小声で読み上げる。ショット3:回転するリールのクローズアップ。機械の低い駆動音、光の筋に舞う埃、緊張感のある静かな締め。"
交通安全訓練 "無人の地下鉄ホーム内で、3ショットのスタッフ訓練シーンを作成。監督者が非常用インターホンの操作を実演し、研修者が手順を繰り返し、その後カメラが緑に変わるインジケーターライトへ切り替わる。駅の環境音を明瞭に入れ、落ち着いた対話と安定した指導ペースにする。"
参照ベースのプレゼンタークリップ "アップロードしたプレゼンター参照を使い、小さなコミュニティスタジオで短い告知を作成。同じ顔、ジャケット、眼鏡を維持。ミディアムショットで始め、重要な文で寄り、柔らかな室内環境音を追加し、自信のあるうなずきで終える。"
科学実験室の解説 "ショット1:教師が透明な川モデルに色水を注ぐ。ショット2:カメラが小さな障害物の周囲を流れる水を追う。ショット3:水の流路が変わるのを見て生徒が指さす。穏やかなナレーション、机上の音、明確な教室の雰囲気を追加。"
Pollo 2.5 vs Vidu Q3 Pro vs Kling V3 Omni 機能 Pollo 2.5 Vidu Q3 Pro Kling V3 Omni マルチショットのストーリーテリング ✅ 高適合 ✅ 高適合 適合度良好 ネイティブ音声生成 ✅ 対応 ✅ 対応 ✅ 対応 参照を使ったキャラクター一貫性 ✅ 高適合 適合度良好 ✅ 高適合 スタイルとカメラ制御 ✅ 高適合 強力なビジュアル演出 強力なモーション制御 最適なワークフロー焦点 連続したストーリークリップ 音と映像を磨いた短尺シーン マルチモーダルなモーション生成 推奨用途 ナラティブアプリ、広告、解説、キャラクターワークフロー 音付きの完成度が高い短尺シーン モーション重視のマルチモーダル動画ツール
なぜPollo 2.5 APIを選ぶのか? Pollo 2.5は、ワークフローで単なる1枚の動く画像以上が必要なときに最適です。連続シーン、キャラクターの一貫性、音声、制御されたストーリービートに特に強みがあります。
Pollo APIを使えば、チームは1回の統合でPollo 2.5と300以上の主要な画像・動画モデルにアクセスでき、低コスト、分かりやすいドキュメント、スケーラブルなインフラ、高速生成、人によるサポートを利用できます。
ストーリー、音、キャラクター同一性を連動させた動画生成が必要な製品なら、Pollo APIでPollo 2.5を試してみてください。
Pollo 2.5 API FAQs
Pollo 2.5とは? Pollo 2.5は、音声同期、キャラクターの一貫性、マルチショットのストーリーテリング、制御されたカメラ動作を備えた連続短尺動画を作るための、Pollo AIのフラッグシップ動画モデルです。
Pollo 2.5 APIはどの入力に対応していますか? Pollo 2.5 APIはtext-to-video、image-to-video、参照ガイド付きワークフローに対応しており、プロンプト、アップロード画像、キャラクター参照、スタイル参照に活用できます。
Pollo 2.5は動画と同時に音声を生成できますか? はい。Pollo 2.5は、シーン演出に沿った環境音、セリフキュー、効果音を含む、動画に合った音声を生成できます。
Pollo 2.5はキャラクターの一貫性に向いていますか? はい。参照でガイドすれば、Pollo 2.5はショット間で認識しやすいキャラクター特徴を保持でき、プレゼンター、マスコット、継続役、連載コンテンツに役立ちます。
マルチショット動画向けにPollo 2.5へはどうプロンプトすべきですか? ショット順、キャラクター連続性ルール、カメラ演出、音の意図、締めのビートを明確にしたプロンプトを書いてください。無関係な動作を1シーンに詰め込みすぎないようにしましょう。
なぜPollo APIでPollo 2.5を使うべきですか? Pollo APIを使うと、開発者はPollo 2.5を本番ワークフローに統合し、生成タスクを管理し、近いモデルを比較し、単一のAPIプラットフォームで動画機能をスケールできます。