AI 이미지 생성 이미지 AI 변환 텍스트로 영상 만들기 레퍼런스 기반 영상 생성 이미지를 동영상으로 변환 $0.0308 / 이미지 당
Kling 3.0 Omni는 영화 같은 품질, 안정적인 캐릭터 이미지, 전문적인 이미지 시퀀스를 통해 일관성 있는 멀티씬 영상을 생성합니다.
입력 가격을 확인하려면 필수 입력란을 모두 작성하세요.
Text To Video · 5s
생성하기 모드 오디오 길이 해상도 유형 가격 — 예 output second 720p 레퍼런스 기반 영상 생성 $0.084 / s 1080p 레퍼런스 기반 영상 생성 $0.108 / s 4K 레퍼런스 기반 영상 생성 $0.318 / s 아니요 output second 720p 레퍼런스 기반 영상 생성 $0.066 / s — 1K 이미지 AI 변환 $0.0308 AI 이미지 생성 $0.0308 output second 1080p 레퍼런스 기반 영상 생성 $0.084 / s — 2K 이미지 AI 변환 $0.0308 AI 이미지 생성 $0.0308 4K 이미지 AI 변환 $0.0616 output second 4K 레퍼런스 기반 영상 생성 $0.318 / s — 4K AI 이미지 생성 $0.0616 4k 아니요 3s — 이미지를 동영상으로 변환 $0.954 텍스트로 영상 만들기 $0.954 4s — 이미지를 동영상으로 변환 $1.272 텍스트로 영상 만들기 $1.272 5s — 이미지를 동영상으로 변환 $1.59 텍스트로 영상 만들기 $1.59 6s — 이미지를 동영상으로 변환 $1.908 텍스트로 영상 만들기 $1.908 7s — 이미지를 동영상으로 변환 $2.226 텍스트로 영상 만들기 $2.226 8s — 이미지를 동영상으로 변환 $2.544 텍스트로 영상 만들기 $2.544 9s — 이미지를 동영상으로 변환 $2.862 텍스트로 영상 만들기 $2.862 10s — 이미지를 동영상으로 변환 $3.18 텍스트로 영상 만들기 $3.18 11s — 이미지를 동영상으로 변환 $3.498 텍스트로 영상 만들기 $3.498 12s — 이미지를 동영상으로 변환 $3.816 텍스트로 영상 만들기 $3.816 13s — 이미지를 동영상으로 변환 $4.134 텍스트로 영상 만들기 $4.134 14s — 이미지를 동영상으로 변환 $4.452 텍스트로 영상 만들기 $4.452 15s — 이미지를 동영상으로 변환 $4.77 텍스트로 영상 만들기 $4.77 pro 예 3s — 이미지를 동영상으로 변환 $0.324 텍스트로 영상 만들기 $0.324 4s — 이미지를 동영상으로 변환 $0.432 텍스트로 영상 만들기 $0.432 5s — 이미지를 동영상으로 변환 $0.54 텍스트로 영상 만들기 $0.54 6s — 이미지를 동영상으로 변환 $0.648 텍스트로 영상 만들기 $0.648 7s — 이미지를 동영상으로 변환 $0.756 텍스트로 영상 만들기 $0.756 8s — 이미지를 동영상으로 변환 $0.864 텍스트로 영상 만들기 $0.864 9s — 이미지를 동영상으로 변환 $0.972 텍스트로 영상 만들기 $0.972 10s — 이미지를 동영상으로 변환 $1.08 텍스트로 영상 만들기 $1.08 11s — 이미지를 동영상으로 변환 $1.188 텍스트로 영상 만들기 $1.188 12s — 이미지를 동영상으로 변환 $1.296 텍스트로 영상 만들기 $1.296 13s — 이미지를 동영상으로 변환 $1.404 텍스트로 영상 만들기 $1.404 14s — 이미지를 동영상으로 변환 $1.512 텍스트로 영상 만들기 $1.512 15s — 이미지를 동영상으로 변환 $1.62 텍스트로 영상 만들기 $1.62 아니요 3s — 이미지를 동영상으로 변환 $0.252 텍스트로 영상 만들기 $0.252 4s — 이미지를 동영상으로 변환 $0.336 텍스트로 영상 만들기 $0.336 5s — 이미지를 동영상으로 변환 $0.42 텍스트로 영상 만들기 $0.42 6s — 이미지를 동영상으로 변환 $0.504 텍스트로 영상 만들기 $0.504 7s — 이미지를 동영상으로 변환 $0.588 텍스트로 영상 만들기 $0.588 8s — 이미지를 동영상으로 변환 $0.672 텍스트로 영상 만들기 $0.672 9s — 이미지를 동영상으로 변환 $0.756 텍스트로 영상 만들기 $0.756 10s — 이미지를 동영상으로 변환 $0.84 텍스트로 영상 만들기 $0.84 11s — 이미지를 동영상으로 변환 $0.924 텍스트로 영상 만들기 $0.924 12s — 이미지를 동영상으로 변환 $1.008 텍스트로 영상 만들기 $1.008 13s — 이미지를 동영상으로 변환 $1.092 텍스트로 영상 만들기 $1.092 14s — 이미지를 동영상으로 변환 $1.176 텍스트로 영상 만들기 $1.176 15s — 이미지를 동영상으로 변환 $1.26 텍스트로 영상 만들기 $1.26 std 예 3s — 이미지를 동영상으로 변환 $0.252 텍스트로 영상 만들기 $0.252 4s — 이미지를 동영상으로 변환 $0.336 텍스트로 영상 만들기 $0.336 5s — 이미지를 동영상으로 변환 $0.42 텍스트로 영상 만들기 $0.42 6s — 이미지를 동영상으로 변환 $0.504 텍스트로 영상 만들기 $0.504 7s — 이미지를 동영상으로 변환 $0.588 텍스트로 영상 만들기 $0.588 8s — 이미지를 동영상으로 변환 $0.672 텍스트로 영상 만들기 $0.672 9s — 이미지를 동영상으로 변환 $0.756 텍스트로 영상 만들기 $0.756 10s — 이미지를 동영상으로 변환 $0.84 텍스트로 영상 만들기 $0.84 11s — 이미지를 동영상으로 변환 $0.924 텍스트로 영상 만들기 $0.924 12s — 이미지를 동영상으로 변환 $1.008 텍스트로 영상 만들기 $1.008 13s — 이미지를 동영상으로 변환 $1.092 텍스트로 영상 만들기 $1.092 14s — 이미지를 동영상으로 변환 $1.176 텍스트로 영상 만들기 $1.176 15s — 이미지를 동영상으로 변환 $1.26 텍스트로 영상 만들기 $1.26 아니요 3s — 이미지를 동영상으로 변환 $0.198 텍스트로 영상 만들기 $0.198 4s — 이미지를 동영상으로 변환 $0.264 텍스트로 영상 만들기 $0.264 5s — 이미지를 동영상으로 변환 $0.33 텍스트로 영상 만들기 $0.33 6s — 이미지를 동영상으로 변환 $0.396 텍스트로 영상 만들기 $0.396 7s — 이미지를 동영상으로 변환 $0.462 텍스트로 영상 만들기 $0.462 8s — 이미지를 동영상으로 변환 $0.528 텍스트로 영상 만들기 $0.528 9s — 이미지를 동영상으로 변환 $0.594 텍스트로 영상 만들기 $0.594 10s — 이미지를 동영상으로 변환 $0.66 텍스트로 영상 만들기 $0.66 11s — 이미지를 동영상으로 변환 $0.726 텍스트로 영상 만들기 $0.726 12s — 이미지를 동영상으로 변환 $0.792 텍스트로 영상 만들기 $0.792 13s — 이미지를 동영상으로 변환 $0.858 텍스트로 영상 만들기 $0.858 14s — 이미지를 동영상으로 변환 $0.924 텍스트로 영상 만들기 $0.924 15s — 이미지를 동영상으로 변환 $0.99 텍스트로 영상 만들기 $0.99 with video ref 아니요 output second 720p 레퍼런스 기반 영상 생성 $0.0954 / s 1080p 레퍼런스 기반 영상 생성 $0.1266 / s 4K 레퍼런스 기반 영상 생성 $0.4242 / s
엔드포인트
비디오 API 이미지 API
POST https://pollo.ai/api/platform/v1/generation/kling-ai/kling-v3-omni/video복사 모드
Text To Video Image To Video Reference To Video
전체 API 문서를 보려면 여기를 클릭하십시오. Pollo API에서 Kling 3.0 Omni 실행하기
Kling 3.0 Omni는 텍스트, 이미지, 피사체 세트, 소스 비디오, 오디오를 포함한 여러 입력 유형으로부터 단일 요청에서 최대 4K 비디오를 생성합니다.
Pollo API의 Kling 3.0 Omni를 사용하면 개발자는 다양한 가이드 유형을 조합해 레퍼런스 기반 영상 생성을 제어하고, 요청마다 클립 길이, 화면비, 필요 시 매칭 오디오까지 선택할 수 있습니다.
Kling 3.0 Omni API 주요 기능
옴니모달 레퍼런스 입력
이 모델은 한 번에 최대 7개의 레퍼런스를 받아들이며, 이미지, 소스 비디오, 피사체 세트, 오디오 큐를 결합해 단일 생성을 조정합니다.
피사체 일관성
캐릭터나 오브젝트의 이미지를 여러 장 제공하세요. 장면이 움직이는 동안에도 모델이 샷 전체에서 피사체 정체성을 유지합니다.
오디오 가이드 모션
오디오 레퍼런스를 제공하면 모델이 움직임, 리듬, 페이싱을 사운드에 맞추고, 클립 내 비트, 음성, 주변음 신호에 액션을 정렬합니다.
환경 시뮬레이션
공간 시뮬레이션은 카메라와 피사체가 공간을 이동할 때도 빛, 깊이, 환경 반응이 일관된 원테이크 장면을 렌더링합니다.
4K 볼류메트릭 출력
생성 결과는 최대 4K까지 지원하며, 고해상도에서도 미세한 텍스처와 깊이 단서를 유지하여 방송 및 대형 화면 활용에 적합합니다.
유연한 길이와 프레이밍
클립은 가로, 세로, 정사각형 비율에서 3초~15초로 생성할 수 있으므로, 하나의 통합으로 소셜, 제품, 풀프레임 전달까지 같은 모델에서 처리할 수 있습니다.
Kling 3.0 Omni API 사용 사례
반복 캐릭터 콘텐츠: 피사체 세트를 재사용하여 마스코트, 진행자, 아바타의 일관성을 에피소드형 클립 전반에서 유지하고, 매번 정체성을 다시 그릴 필요를 줄입니다.
오디오 싱크 퍼포먼스 클립: 댄서, 뮤지션, 스피커의 움직임을 업로드한 트랙에 맞춰 고정해 음악 및 립모션 툴에 유용합니다.
비디오 레퍼런스 리스타일링: 기존 클립을 레퍼런스로 넣고 새로운 연출로 재생성하되, 원본의 움직임과 스테이징은 유지합니다.
장면 연장 파이프라인: 이미지와 비디오 레퍼런스를 결합해 샷을 앞으로 확장하고, 긴 시퀀스에서도 환경과 피사체 연속성을 유지합니다.
멀티 레퍼런스 스토리보딩: 여러 이미지와 피사체를 하나의 프롬프트에 섞어, 전체 제작 패스로 넘어가기 전에 복잡한 장면을 미리 확인합니다.
고해상도 방송용 에셋: 해상도와 깊이가 중요한 사이니지, 스트리밍 인트로, 대형 디스플레이용 4K 원테이크 장면을 생성합니다.
로컬라이즈드 광고 변형: 하나의 피사체를 재사용하고 오디오 레퍼런스만 교체해, 페이싱은 맞추고 브랜딩은 일관되게 유지한 지역별 버전을 제작합니다.
몰입형 환경 데모: 안개, 물, 군중 움직임으로 공간이 채워지는 모습을 보여주고, 주변이 자연스럽게 반응하도록 해 부동산 또는 이벤트 프리뷰에 활용합니다.
Kling 3.0 Omni API 사용 방법
API 키 받기: Pollo API 계정을 만들고 개발자 대시보드에서 API 키를 생성하세요.
모델 선택: /generation/kling-ai/kling-v3-omni/ref2video의 Kling 3.0 Omni 엔드포인트로 요청을 보냅니다.
입력 추가: prompt와 1~7개의 refs(이미지, 피사체, 비디오, 또는 오디오)를 제공한 뒤, duration(3-15), aspectRatio, resolution(720P, 1080P, 또는 4K)을 설정합니다.
생성 및 가져오기: 작업을 제출하고 반환된 작업 상태를 폴링한 다음 완성된 비디오를 다운로드하세요. 필요하면 generateAudio로 매칭 사운드트랙도 생성할 수 있습니다.
Kling 3.0 Omni API 프롬프팅 모범 사례 프롬프트는 처음부터 묘사하는 글이라기보다 레퍼런스를 연출하는 지시라고 생각하세요. 각 레퍼런스의 역할, 원하는 동작, 피사체 주변 장면이 어떻게 반응해야 하는지를 명확히 적어주세요.
간단한 프롬프트 공식 피사체와 해당 레퍼런스 역할 + 구체적인 동작 + 장면 및 환경 반응 + 카메라 움직임 + 오디오 또는 페이싱 신호
확인해야 할 포인트
레퍼런스 역할 지정: 어떤 레퍼런스가 피사체인지, 어떤 것이 배경 설정인지, 어떤 것이 오디오를 이끄는지 알려줘야 가이드가 서로 충돌하지 않습니다.
피사체를 명확하게 유지: 한 캐릭터의 깨끗하고 다양한 이미지를 제공하여 생성 샷 전체에서 정체성이 흔들리지 않게 하세요.
환경 반응 설명: 이 모델은 평면 배경이 아니라 공간을 시뮬레이션하므로 빛, 날씨, 주변 변화가 어떻게 바뀌는지 명시하세요.
오디오와 동작 매칭: 오디오 레퍼런스를 쓸 때는 어떤 움직임과 동기화할지 지정하여 페이싱이 사운드를 따르도록 하세요.
목적에 맞는 해상도 선택: 방송 및 대형 화면은 4K, 빠른 초안과 반복 작업은 더 낮은 설정을 선택하세요.
한 장면 유지: 각 생성은 하나의 일관된 순간으로 제한해야 클립이 처음부터 끝까지 연속성을 유지합니다.
프롬프트 예시
일관된 마스코트 에피소드 "스카우트 유니폼을 입은 빨간 여우 일러스트 피사체 레퍼런스를 사용하세요. 여우가 햇살 비치는 도서관을 걸어가다 높은 책장에서 빛나는 책을 꺼내기 위해 멈추고 미소 짓습니다. 느린 돌리 인, 따뜻하고 먼지가 감도는 빛."
오디오 싱크 스트리트 댄서 "업로드한 드럼 트랙에 맞춰 피사체 댄서를 애니메이션화하세요. 날카로운 발동작과 팔 동작이 황혼의 콘크리트 지하차도에서 각 비트에 정확히 맞고, 차가운 푸른 그림자, 베이스 맥박이 커지며 핸드헬드 카메라가 원을 그리며 움직입니다."
환경 시뮬레이션 리빌 "새벽의 석조 안뜰이 천천히 구르는 지면 안개로 채워지고, 오래된 기둥을 감싸며 첫 햇빛을 받습니다. 카메라는 크레인 업으로 전체 장면을 드러내고, 조용한 주변 톤, 차분하고 사실적인 스타일."
비디오 레퍼런스 리스타일 "해안 도로를 달리는 자전거 이용자 레퍼런스 클립을 가져와 손그림 스타일로 재생성하세요. 같은 경로와 페달링 동작은 유지하고, 바람에 흔들리는 풀과 스쳐 지나가는 갈매기를 추가하며, 부드러운 오후 빛을 적용합니다."
Kling 3.0 Omni vs Veo 3.1 vs Sora 2 기능 Kling 3.0 Omni Veo 3.1 Sora 2 멀티 레퍼런스 입력(이미지, 비디오, 피사체, 오디오) ✅ 최대 7개의 혼합 레퍼런스 ✅ 이미지 및 프롬프트 가이드 ✅ 프롬프트 및 레퍼런스 가이드 이미지 세트 기반 피사체 일관성 ✅ 멀티 이미지 피사체 세트 ✅ ✅ 오디오 가이드 모션 ✅ 오디오 레퍼런스 싱크 ✅ 생성 오디오 ✅ 싱크 오디오 최대 해상도 최대 4K 최대 1080P 최대 1080P 클립 길이 3초~15초 짧은 연출 클립 짧은 연출 클립 추천 대상 레퍼런스 블렌딩 기반 고해상도 원테이크 장면 프롬프트 중심 내러티브 샷 물리 기반 크리에이티브 장면
왜 Kling 3.0 Omni API를 선택해야 하나요? Kling 3.0 Omni는 에셋 기반으로 구축하는 제품에 잘 맞으며, 샷마다 감으로 프롬프트를 쓰기보다 피사체, 소스 클립, 오디오를 결합해 일관된 고해상도 장면을 만들 수 있습니다.
Pollo API를 통해서는 하나의 API 키로 Kling 3.0 Omni와 300개 이상의 주요 비디오·이미지 모델에 접근할 수 있고, 깔끔한 문서, 작업 폴링, 웹훅도 함께 제공됩니다.
Pollo API의 Kling 3.0 Omni 엔드포인트부터 시작해 레퍼런스 기반 4K 대응 비디오 기능을 출시하고, 그다음 통합을 건드리지 않고도 Veo, Sora 및 다른 Kling 모델과 비교해보세요.
Kling 3.0 Omni API FAQ
Kling 3.0 Omni는 무엇인가요? Kling 3.0 Omni는 텍스트, 이미지, 피사체, 비디오, 오디오 레퍼런스를 결합해 생성하는 Kling AI 영상 모델로, 최대 4K의 일관된 원테이크 장면을 만듭니다.
Kling 3.0 Omni API는 어떤 입력을 결합할 수 있나요? 하나의 요청에서 최대 7개의 레퍼런스를 받아들이며, 텍스트 프롬프트와 함께 이미지, 소스 비디오, 피사체 이미지 세트, 오디오 큐를 혼합할 수 있습니다.
피사체 일관성은 어떻게 동작하나요? 한 캐릭터나 오브젝트의 소규모 이미지 세트를 제공하면, 장면이 움직여도 모델이 생성된 클립 전반에서 해당 피사체를 알아볼 수 있게 유지합니다.
어떤 해상도와 길이를 지원하나요? Kling 3.0 Omni API는 720P, 1080P, 4K를 출력하며, 클립 길이는 3초~15초에서 선택할 수 있고 가로, 세로, 정사각 프레이밍을 지원합니다.
매칭 오디오도 생성할 수 있나요? 네. 출력 비디오용으로 자연스러운 오디오를 생성할 수 있고, 오디오 레퍼런스로 화면 내 움직임의 타이밍과 리듬을 가이드할 수도 있습니다.
왜 Pollo API를 통해 Kling 3.0 Omni를 실행하나요? Pollo API는 Kling 3.0 Omni와 300개 이상의 다른 모델을 하나의 통합으로 제공하며, 문서, 작업 추적, 웹훅을 지원합니다.