curl-X POST 'https://pollo.ai/api/platform/v1/generation/alibaba/wan-v2-1/video'\-H'Content-Type: application/json'\-H'x-api-key: YOUR_API_KEY'\-d'{ "input": { "prompt": "A cinematic shot of a golden retriever running through a field of sunflowers at sunset, warm rim light, shallow depth of field", "mode": "fast", "duration": 5, "aspectRatio": "16:9" }}'
{"input":{"prompt":"A cinematic shot of a golden retriever running through a field of sunflowers at sunset, warm rim light, shallow depth of field","mode":"fast","duration":5,"aspectRatio":"16:9"},"webhookUrl":"https://example.com/webhooks/pollo"}
แผนผัง
ช่องป้อนข้อมูลสำหรับปลายทางและโหมดที่เลือก
สนาม
ประเภท
ที่จำเป็น
คำอธิบาย
prompt
string
ใช่
Text prompt describing the content to generate.
mode
string
เลขที่
Generation mode of the model (e.g. a faster or higher-quality tier).
Wan 2.1 คือโมเดล AI ขั้นสูงที่พัฒนาโดยทีม Wan ของ Alibaba สำหรับสร้างวิดีโอคุณภาพสูงจากคำบรรยายข้อความหรือภาพ
เมื่อใช้ Wan 2.1 บน Pollo API นักพัฒนาสามารถเพิ่มความสามารถ text-to-video และ image-to-video เข้าในแอปได้ โดยเลือกโหมดร่างที่รวดเร็วหรือโหมด pro ที่ความเที่ยงตรงสูงกว่า สำหรับคลิปความยาวห้าวินาทีในหลายอัตราส่วนภาพ
ฟีเจอร์หลักของ Wan 2.1 API
เอฟเฟกต์ข้อความสองภาษา
Wan 2.1 วาดตัวอักษรจีนและอังกฤษลงในช็อตโดยตรง ทำให้ชื่อเรื่อง ป้ายกำกับ และคำบรรยายยังคงรูปทรงชัดเจน แทนที่จะค่อย ๆ เพี้ยนเป็นสัญญาณรบกวนเมื่อเฟรมเดินหน้า
Wan 2.1 โดดเด่นเมื่อช็อตเดียวต้องมีทั้งคำที่อ่านได้จริงและการเคลื่อนไหวที่น่าเชื่อถือพร้อมกัน ตั้งแต่คำบรรยายสองภาษาและป้าย ไปจนถึงแอ็กชันที่ขับเคลื่อนด้วยฟิสิกส์ในคลิปเดียว
ผ่าน Pollo API คุณเข้าถึง Wan 2.1 ได้ด้วย API key เดียว ควบคู่กับโมเดลวิดีโอและภาพชั้นนำกว่า 300+ รุ่น พร้อมเอกสารที่ชัดเจน การติดตามสถานะงาน และการสร้างที่มีต้นทุนต่ำกว่า Fal AI
เริ่มที่ endpoint ของ Wan 2.1 บน Pollo API เพื่อส่งมอบฟีเจอร์วิดีโอสองภาษาที่เข้าใจฟิสิกส์ แล้วเปรียบเทียบกับ Kling และ Hunyuan ได้โดยไม่ต้องแตะการเชื่อมต่อเดิมของคุณ
คำถามที่พบบ่อยเกี่ยวกับ Wan 2.1 API
Wan 2.1 คืออะไร?
Wan 2.1 คือโมเดลวิดีโอพื้นฐานแบบมัลติโหมดของ Alibaba Cloud ที่เด่นเรื่องฟิสิกส์สมจริง การเคลื่อนไหวซับซ้อน และการเรนเดอร์ข้อความจีนและอังกฤษภายในวิดีโอที่สร้างจากอินพุตข้อความหรือภาพ