画像から動画へ テキストから動画へ $0.30 ~ / 動画
Kling O1ビデオモデルは、マルチモーダルな入力に対応した汎用性の高いワークフローを提供し、ショット間で安定したキャラクターの一貫性を保証します。
入力 価格を表示するには、必須項目を入力してください。
Text To Video · 5s
生成 モード 長さ タイプ 価格 pro 3s 画像から動画へ $0.30 テキストから動画へ $0.30 4s 画像から動画へ $0.36 テキストから動画へ $0.36 5s 画像から動画へ $0.48 テキストから動画へ $0.48 6s 画像から動画へ $0.60 テキストから動画へ $0.60 7s 画像から動画へ $0.72 テキストから動画へ $0.72 8s 画像から動画へ $0.84 テキストから動画へ $0.84 9s 画像から動画へ $0.96 テキストから動画へ $0.96 10s 画像から動画へ $1.08 テキストから動画へ $1.12
終点
POST https://pollo.ai/api/platform/v1/generation/kling-ai/kling-video-o1/videoコピー モード
Text To Video Image To Video
APIドキュメント全体を表示 Pollo APIでKling Video O1を実行する
Kling Video O1は、書かれたプロンプト、参照画像、または開始フレームと終了フレームのペアから、1回のリクエストで動画を生成します。
Pollo API上のKling Video O1を使えば、開発者はこのマルチモーダル生成器をアプリに組み込み、テキスト・画像・参照入力を送信し、呼び出しごとにアスペクト比とクリップ長を選べます。
Kling Video O1 APIの主な機能
マルチモーダル入力サポート
このモデルは1つのワークフローでテキスト、単一画像、または参照画像セットを読み取れるため、プロダクトは追加実装なしでアイデア先行生成とアセット先行生成を切り替えられます。
複数参照の一貫性
1回の生成に最大7枚の参照画像を使えるため、別々の静止画にあるキャラクター・小道具・スタイルを1つのシーンに同時に登場させつつ、特徴の持続性と同一性の一貫性を維持できます。
開始・終了フレーム制御
開始画像と終了画像を指定すると、モデルがその間の動きを補間し、ショットの始まり方と着地点を高精度にコントロールできます。
フレーム間の安定性
被写体、ライティング、構図がクリップ全体で安定するため、長めの動作中でも顔・物体・背景がフレーム間でずれたり変形したりしません。
マルチステッププロンプト
最大2,500文字の詳細なプロンプトで、連続する動作や演出を記述できます。これにより、モデルは静止した1瞬間ではなく、説明された出来事の順序を追えます。
柔軟なフレーミング
横長、縦長、正方形の出力すべてに対応しており、同じ生成結果をワイドスクリーンプレイヤー、縦型フィード、正方形配置に合わせられます。
Kling Video O1 APIのユースケース
複数キャラクターのシーン: 2〜3人のキャラクター参照静止画を組み合わせ、顔と衣装の一貫性を保ったまま1つのショットに収める。
参照主導のブランディング: ロゴ、製品、マスコット画像をまとめて入力し、生成するプロモーションクリップ全体でブランドアセットの一貫性を保つ。
ストーリーボードからモーションへ: 最初と最後のフレームからアニメーションショットを作成。previzツールやレイアウト主導パイプラインに有用。
連続アクションクリップ: 1つのプロンプトで複数ステップの動きを記述。例:人物が入ってきて座り、その後オフスクリーンの何かに反応する。
イラストストーリーのアニメ化: 参照アートの描画キャラクターを動くシーンに取り込み、児童書・コミック・webtoon向けツールに活用。
単一画像から製品をアニメ化し、形状・ラベル・色をクリップ全体で忠実に維持。
一貫した製品モーション:
縦型コンテンツ自動化: リクエストごとにテキストまたは1枚のガイド画像を使い、短尺フィード向け縦型クリップを大規模生成。
コンセプトから動画へのプロトタイピング: 参照アセットや制作時間を投入する前に、プロンプトで記述したショットをチームで事前確認。
Kling Video O1 APIの使い方
APIキーを取得: Pollo APIアカウントを作成し、開発者ダッシュボードでAPIキーを生成します。
モデルを選択: /generation/kling-ai/kling-video-o1 のKling Video O1エンドポイントにPOSTリクエストを送信します。
入力を追加: text-to-video(prompt)、image-to-video(image + 任意の imageTail)、reference-to-video(images 配列、最大7)向けに input オブジェクトを渡し、aspectRatio と length を設定します。
生成して取得: タスクを送信し、返却された taskId とステータスをポーリングして、処理成功後に動画をダウンロードします。
Kling Video O1 API向けプロンプト作成のベストプラクティス プロンプトはショットリストとして扱ってください。各参照に明確な名前を付け、動作の順序を並べて記述し、その後にフレーミング、動き、ムードを設定すると、モデルが追うべき完全な計画になります。
シンプルなプロンプト式 参照または被写体の設定 + 順序立てたアクションをステップごとに + カメラとフレーミング + 場面とライティング + スタイル
注意すべきポイント
参照にラベルを付ける: 複数画像を使うときは、どの被写体がどれかを説明し、モデルがシーン内で正しく配置できるようにします。
アクションを順序化する: 出来事を順番に書きます。モデルは、凍結した1瞬間ではなく複数ステップの演出を追えます。
終了フレームを固定する: 終了画像を使う場合は、そこにどう到達するかを記述し、補間に意図性を持たせます。
配置に合わせて比率を選ぶ: 横長・縦長・正方形を早めに決め、対象プレイヤーやフィードに合わせます。
被写体を明確に区別する: 参照キャラクターや物体に明確な特徴を与え、クリップ全体で一貫性を保ちます。
プロンプト例
複数参照のミートアップ "3枚の参照画像(若い発明家、銅のロボット、散らかった作業場)を使って、3者すべてを1つのシーンに配置する。発明家が手を振り、ロボットが応えるように首を傾ける。ゆっくりしたドリーイン、暖かいランプ光、手描きイラスト風スタイル。"
最初から最後のフレームへの遷移 "灯台の鉛筆スケッチから始まり、完成した水彩画版で終える。空が明るくなるにつれて、色と質感が左から右へフレーム全体に広がる。固定カメラ、柔らかな昼光、穏やかな絵画的トランジション。"
連続アクションビート "トレイを持ったパン職人がフレームに入り、カウンターに置き、手の小麦粉を払ってから、顔を上げて客に微笑む。ミディアムショット、朝の窓明かり、暖かいリアル系スタイル、安定したハンドヘルドカメラ。"
参照忠実な製品モーション "陶器のティーポットの単一参照画像から、立ちのぼる湯気とともにお茶をおそろいのカップに注ぐ。釉薬パターンと形状は正確に維持する。横からのクローズショット、柔らかなキッチン光、クリーンなリアル系スタイル。"
Kling Video O1 vs Vidu Q1 vs Runway Gen-4 機能 Kling Video O1 Vidu Q1 Runway Gen-4 複数参照入力 ✅ 最大7枚の参照画像 ✅ 複数参照被写体 ✅ 参照ガイド対応 開始・終了フレーム制御 ✅ 開始画像と終了画像 ✅ ❌ 限定的 テキスト・画像・参照を1モデルで対応 ✅ ✅ ✅ マルチステッププロンプト追従 ✅ 長文の順序付きプロンプト ✅ ✅ アスペクト比オプション 16:9、9:16、1:1 複数 16:9 と縦型 推奨用途 参照一貫性の高い連続ショット 複数被写体の参照シーン スタイライズされた監督主導クリップ
なぜKling Video O1 APIを選ぶのか? Kling Video O1は、1つのショットで複数参照を組み合わせ、すべての被写体の一貫性を保ち、孤立した1瞬間ではなく順序立てた動作シーケンスに従う必要がある場面で際立ちます。
Pollo API経由なら、Kling Video O1に加えて300以上の主要動画・画像モデルへ、1つのAPIキーでアクセス可能。分かりやすいドキュメント、タスクポーリング、Webhookも利用できます。
Pollo APIのKling Video O1エンドポイントから始めて、参照主導・マルチステップの動画機能を素早く提供し、その後Vidu、Runway、他のKlingモデルとも、統合を触らずに比較できます。
Kling Video O1 API よくある質問
Kling Video O1とは? Kling Video O1はKling AIのマルチモーダル動画モデルで、テキスト、単一画像、または最大7枚の参照画像からクリップを生成し、高いフレーム一貫性とマルチステッププロンプト対応を備えています。
Kling Video O1 APIは参照画像に対応していますか? はい。reference-to-videoでは1回のリクエストで最大7件の画像URLを受け付けるため、複数キャラクター・製品・スタイルを1つの一貫したシーンに同時に登場させられます。
ショットの開始と終了を制御できますか? はい。image-to-videoでは開始画像と終了画像の両方を指定でき、モデルが2フレーム間の動きを補間します。
利用できるアスペクト比と長さは? Kling Video O1は16:9、9:16、1:1で出力でき、リクエストごとに選ぶ入力モードに応じて、クリップ長は3〜10秒です。
連続アクションはどう処理しますか? 最大2,500文字のプロンプトで出来事を順序立てて記述できるため、モデルは単一の静止ビートではなく、複数ステップの動きを演出できます。
なぜPollo API経由でKling Video O1を実行するのですか? Pollo APIなら、Kling Video O1と他300以上のモデルを1つの統合で利用でき、ドキュメント、タスク追跡、Webhookが揃っています。