เวอร์ชันเก่าของหน้านี้พยายามเอาชนะด้วยขนาด: ดราม่าจาก benchmark, การคาดเดาราคา, คำกล่าวอ้างกว้าง ๆ เกี่ยวกับทุกฟีเจอร์ของ Veo ที่ Google เคยแสดง, และถ้อยคำจำนวนมากที่ไม่ได้สอดคล้องอย่างชัดเจนกับเส้นทางที่ผู้คนเปิดใช้งานจริงบน Cleep นี่คือโครงสร้างที่ไม่ถูกต้องสำหรับหน้าประเภท route ที่มีประโยชน์ หน้าที่แข็งแรงสำหรับ /generate/video/veo31-video ควรเริ่มจากสองชั้นที่ยึดโยงกับความจริง: สิ่งที่ Google จัดทำเอกสารอย่างเป็นทางการสำหรับ Veo 3.1 ในวันนี้ และสิ่งที่ route ปัจจุบันของ Cleep เปิดให้ใช้งานจริง
ในฝั่งของ Google เอกสาร Vertex AI Veo 3.1 documentation ปัจจุบันมีรายละเอียดชัดเจน ตารางความสามารถหลักของ 3.1 Generate และ 3.1 Fast Generate อธิบายการรองรับสำหรับ text-to-video, image-to-video, การเขียน prompt ใหม่, และ วิดีโอจากเฟรมแรกและเฟรมสุดท้าย พร้อมทั้ง 16:9 และ 9:16, 720 และ 1080, 24 FPS, ภาษา prompt เป็นภาษาอังกฤษ, และจำนวนสูงสุด 4 วิดีโอที่ส่งกลับต่อหนึ่งคำขอ นอกจากนี้ Google ยังอธิบายกลยุทธ์การเขียน prompt ของ Veo ไว้อย่างชัดเจนมาก: official Veo prompt guide อย่างเป็นทางการกล่าวถึงการจัดเฟรม, การเคลื่อนกล้อง, สไตล์, แสง, รายละเอียดตัวละคร, สถานที่, การกระทำ, บทสนทนา, และเสียง อยู่ซ้ำ ๆ
ในฝั่งของ Cleep route นี้แคบกว่าและใช้งานได้จริงมากกว่าเรื่องราวทั้งหมดของตระกูล Veo การตั้งค่า veo31-video ปัจจุบันเปิดให้ใช้ text-to-video, image-to-video, first-last-to-video, และเส้นทาง reference-to-video รวมถึง multishot, อินพุตรูปภาพสูงสุดสามภาพ, ความยาวคลิปที่แสดงไว้ 8 วินาที, ความละเอียดที่แสดงไว้ 720p และ 1080p, ทั้ง 16:9 และ 9:16, และเวลาประมวลผลโดยประมาณราว 3 ถึง 5 นาที สิ่งนี้ทำให้การตีความอย่างตรงไปตรงมาง่ายขึ้นมาก: Veo 3.1 บน Cleep เหมาะที่สุดเมื่อมองว่าเป็น route ระดับพรีเมียมสำหรับการวางแผนคลิปสั้น 8 วินาทีที่กำกับอย่างกระชับ ไม่ใช่ในฐานะบทสรุปแบบครอบจักรวาลของทุก workflow ของ Veo ที่ Google จัดทำเอกสารไว้ในทุกพื้นผิวการใช้งาน
เริ่มต้นด้วย Veo 3.1 เมื่อภารกิจจริงไม่ใช่ "สร้างวิดีโอ AI แบบไหนก็ได้" แต่เป็น "วางแผนช็อต 8 วินาทีที่ขัดเกลาอย่างดีและมีการกำกับที่ชัดเจน" บน Cleep route นี้มีประโยชน์เป็นพิเศษเมื่อคุณต้องการทั้ง ผลลัพธ์แนวตั้งและแนวนอน, ต้องการสลับระหว่าง workflow แบบ ข้อความ, รูปภาพ, อิง reference, หรือ เฟรมแรก-เฟรมสุดท้าย, หรืออยากได้พื้นที่วางแผนที่พรีเมียมกว่าที่ route แบบสั้นที่เรียบง่ายกว่าจะมอบให้
กรอบความเข้าใจที่ตรงไปตรงมาที่สุด คือสิ่งนี้: หน้า Veo 3.1 ของ Cleep ทำงานคล้ายกับ ช่องทาง Veo สำหรับการสร้างอย่างรวดเร็วที่มีอินพุตสำหรับการวางแผนเพิ่มเข้ามา มากกว่าจะเป็นเมทริกซ์ผลิตภัณฑ์แบบเต็มรูปแบบ มันยอดเยี่ยมมากสำหรับคลิปสั้นที่ตั้งใจออกแบบอย่างชัดเจน แต่มันไม่ใช่หน้าที่เหมาะจะสัญญาเรื่องการตัดต่อ long-form อัตโนมัติ, การเขียน prompt หลายภาษาแบบครอบจักรวาล, หรือทุกฟีเจอร์พรีวิวในสแตก Veo ที่กว้างกว่าของ Google
สิ่งที่แข็งแกร่งที่สุดของ route นี้ไม่ใช่สเปกใดสเปกหนึ่งแบบแยกเดี่ยว แต่เป็นการผสมกันระหว่างคุณภาพระดับพรีเมียมสำหรับงาน short-form และพื้นผิวอินพุตที่เน้นการวางแผนมากกว่า route ใกล้เคียงจำนวนมากให้ทางเข้าเพียงแบบเดียว: อาจเป็นข้อความ, อาจเป็นรูปภาพหนึ่งภาพ, อาจเป็นทรานซิชันจากเฟรมแรกไปเฟรมสุดท้าย แต่ Veo 3.1 บน Cleep ให้หลายวิธีในการเริ่มต้นโดยไม่เปลี่ยนหน้าให้กลายเป็น editor แบบเต็มรูปแบบ
โครงสร้างแบบคงที่ที่ 8 วินาที สำคัญกว่าที่เห็นในตอนแรก เพราะมันบังคับให้การออกแบบช็อตดีขึ้น แทนที่จะพยายามยัดเรื่องเล่าทั้งหมดลงในการสร้างครั้งเดียว คุณสามารถวางแผนการเผยให้เห็นที่คมชัด, ช่วงเวลาของสินค้า, จังหวะแฟชั่น, motion plate แบบ stylized, หรือทรานซิชันสั้นสำหรับแบรนด์ที่มีจุดเริ่ม กลาง และจบอย่างชัดเจน ซึ่งมักจะเป็นสิ่งที่งาน social หรือแคมเปญแบบ short-form ระดับพรีเมียมต้องการพอดี
route นี้ยังอยู่ในเลนการผลิตที่ใช้งานได้จริงด้วย: 720p หรือ 1080p, 16:9 หรือ 9:16, เวลาทำเสร็จโดยประมาณ 3 ถึง 5 นาที, และมีอินพุตรูปภาพมากพอที่จะก้าวข้ามคำว่า "มีแต่ข้อความ" สิ่งนี้ทำให้มันมีประโยชน์มากขึ้นสำหรับทีมที่รู้ลุคที่ต้องการอยู่แล้ว และต้องการให้ route นี้ยึด brief, ภาพนิ่ง, เฟรมเริ่มต้นและเฟรมสิ้นสุด, หรือแผน multishot แบบเรียบง่ายไว้ได้
ข้อจำกัด 8 วินาทีคือฟีเจอร์ ไม่ใช่แค่ข้อจำกัด
มันผลักให้เส้นทางนี้มุ่งสู่การออกแบบช็อตที่คมชัด: หนึ่งการเผยให้เห็น หนึ่งการเคลื่อนไหว หนึ่งทรานซิชัน หนึ่งจังหวะอารมณ์ หนึ่งช่วงเวลาโฆษณา วินัยแบบนั้นมักให้ผลงานวิดีโอสั้นระดับพรีเมียมที่ดีกว่าคำสั่งกว้าง ๆ แบบ "make me a longer video" ที่คลุมเครือ
Veo 3.1 รองรับทั้งเอาต์พุตสำหรับโซเชียลและแนวนอน
เพราะเส้นทางที่มองเห็นได้รองรับทั้ง 9:16 และ 16:9 จึงใช้ได้ทั้งกับงานคัตดาวน์แคมเปญแนวตั้งและช็อตแนวนอนมาตรฐาน โดยไม่บังคับให้คุณต้องย้ายไปใช้ตระกูลเส้นทางที่ต่างออกไปโดยสิ้นเชิง
เส้นทางนี้เน้นการวางแผนอย่างหนักในแบบที่มีประโยชน์
ข้อความ ภาพนิ่ง เฟรมแรก-สุดท้าย อินพุตสไตล์ภาพอ้างอิง และ multishot ล้วนสำคัญสำหรับบรีฟคนละแบบ สิ่งนี้ทำให้ Veo 3.1 มีโครงสร้างการผลิตมากกว่าหน้าแบบง่าย ๆ ที่เป็นเพียง "ใส่ข้อความ แล้วได้คลิปออกมา"
พฤติกรรมของพรอมต์เป็นส่วนหนึ่งของผลิตภัณฑ์ ไม่ใช่สิ่งที่ค่อยมาเติมทีหลัง
เอกสาร Veo ของ Google มองว่าการเขียนพรอมต์ใหม่และรายละเอียดของพรอมต์เป็นพฤติกรรมหลัก บนเส้นทางนี้ การเขียนพรอมต์ให้ดีขึ้นไม่ใช่งานขัดเงาเพิ่มเติมที่ทำหรือไม่ทำก็ได้ แต่มันเป็นส่วนหนึ่งของการทำให้เส้นทางนี้ทำงานได้เหมือนเครื่องมือระดับพรีเมียม
หน้า Veo ที่ดีควรแยก ข้อเท็จจริงระดับตระกูลโมเดล ออกจาก ข้อเท็จจริงระดับเส้นทาง Google อธิบายตระกูล Veo 3.1 ผ่าน Vertex AI และ DeepMind จากนั้น Cleep จึงเปิดเผยเส้นทางที่แคบกว่าและใช้งานได้จริงมากบนชั้นด้านบน ความแตกต่างนี้สำคัญ เพราะช่วยให้หน้าเนื้อหาซื่อตรง เมื่อเอกสารที่กว้างกว่าของ Google กล่าวถึงความสามารถที่อาจยังเป็นเพียง preview หรือยังไม่ได้ถูกแสดงเป็น flow ที่มองเห็นได้บนเส้นทางนี้โดยตรง
| หัวข้อ | แหล่งข้อมูลทางการ | ความหมายในที่นี้ |
|---|---|---|
| ความสามารถหลักของ 3.1 | หน้า Vertex AI Veo 3.1 ระบุ text-to-video, image-to-video, การเขียนพรอมต์ใหม่ และการสร้างแบบ first/last-frame สำหรับโมเดลหลัก 3.1 Generate และ Fast Generate | เส้นทางของ Cleep สอดคล้องอย่างมากกับโครงสร้างหลักนั้น: ข้อความ การทำให้ภาพนิ่งเคลื่อนไหว และการวางแผนแบบ first-last ล้วนเป็นแกนสำคัญของการใช้งานหน้านี้ |
| reference image to video | เอกสาร preview ของ Veo 3.1 ในวงกว้างของ Google อธิบาย reference image to video ไว้ภายใต้ตารางความสามารถแบบ preview มากกว่ารายการ GA แบบตรงไปตรงมา | Cleep มีการเปิดเผยเส้นทางสไตล์ reference อยู่จริง แต่การตีความที่ปลอดภัยที่สุดคือมองว่ามันเป็นเวิร์กโฟลว์ที่แคบกว่า ซึ่งควรทดสอบอย่างระมัดระวังกับบรีฟของคุณโดยตรง โดยเฉพาะเมื่อภาพอ้างอิงต้องแบกรับภาระด้านความคิดสร้างสรรค์เป็นหลัก |
| การต่อขยายวิดีโอ | Google ระบุ extend-video ไว้ในตารางความสามารถแบบ preview ไม่ใช่เป็นส่วนหนึ่งของรายการ Generate / Fast Generate พื้นฐาน | เส้นทาง Cleep นี้ไม่ควรถูกอธิบายว่าเป็นพื้นผิวสำหรับ extend-video ปัจจุบันยังไม่มี flow สำหรับ extend-video ที่มองเห็นได้บนเส้นทางนี้ |
| ภาษาของพรอมต์ | ตารางความสามารถของ Veo 3.1 ของ Google ระบุ English เป็นภาษาของพรอมต์ | แม้ว่าบทความจะถูกแปลเป็นภาษาท้องถิ่น แต่เส้นทางนี้ก็ควรถูกมองว่าเป็นเวิร์กโฟลว์ที่ให้ความสำคัญกับ English-prompt เป็นหลักเพื่อผลลัพธ์ที่ดีที่สุด |
| ความยาวคลิป | Google ระบุว่า Veo 3.1 รองรับ 4, 6, หรือ 8 วินาที โดยมีการอธิบาย reference-image-to-video ไว้อย่างแคบกว่า | ขณะนี้ Cleep เปิดเผยค่า 8 วินาที บนเส้นทางนี้ ซึ่งยิ่งตอกย้ำแนวคิดว่าหน้านี้มุ่งเน้นคลิปสั้นที่ควบคุมได้สูง ไม่ใช่ความยืดหยุ่นด้านระยะเวลาที่กว้างขวาง |
| ความละเอียด | Google ระบุ 720 และ 1080 สำหรับเส้นทางหลักของ 3.1 Generate / Fast Generate | เส้นทางปัจจุบันตรงกับเลนการผลิตที่มองเห็นได้นั้นด้วย 720p และ 1080p ดังนั้นจึงไม่มีเหตุผลให้หน้านี้สัญญาว่าจะรองรับความละเอียดที่กว้างกว่านี้ |
| อัตราส่วนภาพ | Google ระบุ 16:9 และ 9:16 สำหรับตระกูลเส้นทางหลัก | Cleep เปิดเผยทั้งสองแบบ ทำให้เส้นทางนี้ใช้งานได้จริงทั้งสำหรับช็อตแนวนอนมาตรฐานและงานโซเชียลแนวตั้ง |
| อัตราเฟรม | เอกสาร Veo 3.1 อย่างเป็นทางการระบุ 24 FPS | เส้นทางนี้ควรถูกอธิบายว่าเป็นเส้นทางสร้างวิดีโอสั้นเชิงภาพยนตร์ ไม่ใช่พื้นที่ทดลองอัตราเฟรมที่หลากหลาย |
| จำนวนผลลัพธ์ | ตารางความสามารถของ Google ระบุจำนวนสูงสุด 4 วิดีโอที่ส่งกลับต่อหนึ่งคำขอ | สิ่งนี้สอดคล้องกับแนวคิดเรื่องการทำซ้ำแบบมีทิศทาง: สร้างชุดเล็ก ๆ ประเมินว่าช็อตใดใกล้ที่สุด แล้วค่อยปรับละเอียดต่อ |
| การเขียนพรอมต์ใหม่ | เอกสารทางการเกี่ยวกับ prompt rewriter ระบุว่า Veo 3 และ 3.1 ไม่ อนุญาตให้ปิดการเขียนพรอมต์ใหม่ และพรอมต์ที่ถูกเขียนใหม่จะถูกส่งกลับมาเฉพาะเมื่อพรอมต์ต้นฉบับมีความยาวน้อยกว่า 30 คำเท่านั้น | พฤติกรรมของพรอมต์เป็นส่วนหนึ่งของเส้นทางนี้ คุณไม่ควรมอง Veo 3.1 ว่าเป็นตัวแปลพรอมต์ดิบที่ไม่เปลี่ยนแปลง เพราะมันช่วยจัดรูปทรงของอินพุตอย่างจริงจัง |
| องค์ประกอบของพรอมต์ | คู่มือพรอมต์ Veo อย่างเป็นทางการ ย้ำอยู่เสมอถึงการจัดเฟรม การเคลื่อนกล้อง สไตล์ แสง รายละเอียดของตัวละคร สถานที่ แอ็กชัน บทสนทนา และเสียง | คำแนะนำนี้มีประโยชน์โดยตรงบน Cleep พรอมต์ที่ดีขึ้นคือหนึ่งในคันโยกด้านคุณภาพที่ใหญ่ที่สุดที่เส้นทางนี้มอบให้คุณ |
Veo 3.1 ไม่ได้มีรูปแบบการโต้ตอบเพียงแบบเดียว คำถามที่มีประโยชน์ที่สุดไม่ใช่ "Veo ดีไหม?" แต่คือ "ฉันรู้รายละเอียดของช็อตนี้อยู่แล้วมากแค่ไหน?" ถ้าคุณรู้บรรยากาศแต่ยังไม่รู้ภาพเฟรม ให้ใช้ text-to-video ถ้าคุณมีเฟรมแรกหรือภาพลักษณ์หลักอยู่แล้ว ให้ใช้ image-to-video ถ้าคุณรู้ทั้งภาพเปิดและภาพปิด first-last อาจใช้งานได้จริงกว่าการพยายามอธิบายส่วนโค้งทั้งหมดด้วยพรอมต์ยาวเพียงอันเดียว และถ้าบรีฟของคุณมีหลายจังหวะอยู่แล้ว พื้นผิว multishot ของเส้นทางนี้สามารถช่วยให้คุณคิดแบบตรรกะการผลิต แทนการส่งคำขอขนาดใหญ่ที่คลุมเครือเพียงครั้งเดียว
เนื่องจาก Google ระบุ Veo 3.1 ว่าเป็นตระกูลโมเดล English-prompt ตัวอย่างพรอมต์ด้านล่างจึงตั้งใจคงไว้เป็นภาษา English นี่ไม่ใช่ความบังเอิญ แต่สะท้อนภาษาพรอมต์ที่มีการระบุไว้ในเอกสารของโมเดล ไม่ใช่แค่ตัวเลือก SEO แบบทั่วไป
Text-to-video
เหมาะที่สุดเมื่อคอนเซ็ปต์ของฉากชัดเจน แต่เฟรมเริ่มต้นทางภาพยังเปิดกว้างอยู่
ช็อตโปรโมตแฟชั่นมุมต่ำ นางแบบก้าวลงจากแท็กซี่สีเหลืองเข้าสู่แสงนีออนที่สะท้อนพื้นเปียก กล้องถอยตามอย่างต่อเนื่อง แสงฟุ้งจากเลนส์อย่างนุ่มนวล โทนสตรีทลักชัวรีระดับพรีเมียม เสียงฟ่อของการจราจรที่อยู่ไกลและบรรยากาศเมืองที่แผ่วเบา
Image-to-video
เหมาะที่สุดเมื่อเฟรมแรกแก้โจทย์ด้านสไตลิง อัตลักษณ์ หรือองค์ประกอบสินค้าไว้แล้ว
ทำให้ภาพนิ่งผลิตภัณฑ์สกินแคร์ที่อัปโหลดเคลื่อนไหวด้วยการดันกล้องเข้าอย่างช้า ๆ เงาสะท้อนบนกระจกที่นุ่มนวล ไอหมอกลอยอ่อน ๆ แสงด้านข้างสีทองอย่างสง่างาม จังหวะแบบโฆษณาความงามระดับลักชัวรี
First-last-to-video
เหมาะที่สุดเมื่อรู้ทั้งสถานะเปิดและสถานะท้ายแล้ว และงานจริง ๆ คือการเชื่อมระหว่างสองจุดนั้น
เริ่มจากเฟรมแรกที่อัปโหลดอย่างตรงเป๊ะและจบที่เฟรมสุดท้ายที่อัปโหลด รักษารองเท้าให้อยู่กึ่งกลาง สร้างทรานซิชันในสตูดิโอที่ลื่นไหลด้วยความต่อเนื่องของแสงที่แม่นยำและความรู้สึกแบบแคมเปญพรีเมียมที่สะอาดคมชัด
Reference-led planning
เหมาะที่สุดเมื่อคุณต้องการเส้นทางที่ปกป้องลุค mood board หรืออัตลักษณ์ทางภาพได้แน่นกว่าที่ข้อความเพียงอย่างเดียวจะทำได้
ใช้ภาพ reference เพื่อคงสไตลิงและพาเลตสีของนางเอก จากนั้นสร้างช็อตทางเดินไซไฟแบบภาพยนตร์ความยาว 8 วินาที พร้อมการเคลื่อนกล้องแบบแฮนด์เฮลด์ที่ระมัดระวังและความตึงเครียดที่ถูกควบคุมอย่างพอดี
Multishot setup
เหมาะที่สุดเมื่อบรีฟมีหลายบีตอยู่แล้ว แทนที่จะเป็นเพียงช่วงภาพเดี่ยว ๆ หนึ่งช่วง
ช็อต 1: รายละเอียดสินค้าแบบใกล้ในความมืด ช็อต 2: เผยสินค้าบนแท่นเงามันพร้อมแสงด้านข้างที่พุ่งเร็ว ช็อต 3: แพ็กฮีโร่พร้อมเงาสะท้อนสีแบรนด์และการค้างเฟรมสุดท้ายที่สะอาดคมชัด
| เส้นทางอินพุต | เหมาะที่สุดเมื่อ | สิ่งที่ควรล็อกให้ชัดเจน |
|---|---|---|
| Text-to-video | คุณยังอยู่ระหว่างสำรวจช็อต และรู้หลัก ๆ แค่โทน ฉากแวดล้อม และพลังของการเคลื่อนไหว | การจัดเฟรม แอ็กชันหลักหนึ่งอย่าง การเคลื่อนกล้อง แสง และสไตล์ภาพ |
| Image-to-video | เฟรมแรกมีความสำคัญอยู่แล้ว และเส้นทางควรเป็นการทำให้ภาพเคลื่อนไหวมากกว่าการคิดฉากใหม่ | อะไรควรคงที่ อะไรขยับได้ และการเคลื่อนไหวควรรู้สึกละเอียดอ่อนหรือแสดงออกมากแค่ไหน |
| First-last-to-video | คุณรู้สถานะภาพตอนต้นและตอนจบแล้ว และต้องการให้เส้นทางออกแบบสะพานเชื่อมระหว่างสองสิ่งนี้ | ความต่อเนื่อง จังหวะ อัตลักษณ์ทางภาพ และสิ่งที่ห้ามเพี้ยนไประหว่างต้นกับจบ |
| Reference-led path | ลุค โลกของแบรนด์ หรืออัตลักษณ์ของตัวละครสำคัญมากพอที่ข้อความอย่างเดียวไม่เพียงพอ | สัญญาณภาพที่ต้องปกป้องไว้: ใบหน้า สไตลิง ซิลูเอต พาเลตสี อาร์ตไดเรกชัน หรือการจัดวางสินค้า |
| Multishot | บรีฟมีหลายบีต และคลิปควรรู้สึกเหมือนถูกวางแผนมา ไม่ใช่ด้นสด | ลำดับของบีต สิ่งที่เปลี่ยนไประหว่างบีต และผลลัพธ์ทางอารมณ์หรือภาพที่ต้องการในตอนจบ |
หนึ่งในวิธีที่ง่ายที่สุดในการใช้ Veo 3.1 อย่างสิ้นเปลือง คือการใช้ซอฟต์แวร์วิดีโอระดับพรีเมียมกับพรอมป์ที่ให้ข้อมูลต่ำ เอกสารพรอมป์ของ Google มีความเป็นรูปธรรมอย่างผิดคาดในจุดนี้ คู่มือพรอมป์ของ Veo ไม่ได้บอกผู้ใช้แบบนามธรรมว่าให้ "สร้างสรรค์" แต่ผลักให้ระบุการจัดเฟรม การเคลื่อนไหว สไตล์ แสง รายละเอียดตัวละคร สถานที่ แอ็กชัน บทพูด และเสียง เอกสาร Vertex AI prompt-rewriter แยกต่างหากก็ย้ำประเด็นเดียวกันจากอีกมุมหนึ่ง: Veo 3 และ 3.1 จะเขียนพรอมป์ใหม่อย่างแอ็กทีฟ และคุณไม่สามารถปิดพฤติกรรมนั้นได้
ผลเชิงปฏิบัตินั้นเรียบง่ายมาก หากเส้นทางมีความสำคัญพอที่จะใช้ Veo 3.1 พรอมป์ก็ควรอ่านเหมือนคำกำกับช็อต ไม่ใช่ถุงคีย์เวิร์ดขี้เกียจ ยิ่งคุณทำแผนที่กล้อง การเคลื่อนไหว วัตถุ สภาพแวดล้อม และโทนได้ดีเท่าไร เส้นทางก็จะยิ่งทำงานเหมือนเครื่องมือวางแผนระดับพรีเมียม แทนที่จะเป็นตัวสร้างคลิปทั่วไป
ไม่ควรขาย Veo 3.1 ว่าเป็นคำตอบเริ่มต้นสำหรับทุกคำขอวิดีโอสั้น มันแข็งแกร่งที่สุดเมื่อบรีฟได้ประโยชน์จากพื้นผิวการวางแผนแบบ short-form ระดับพรีเมียมของมัน หากงานนั้นเกี่ยวกับการเลือกความยาวสั้นที่ยืดหยุ่นกว่า การวนซ้ำสไตล์ Hailuo ที่ง่ายกว่า หรือการควบคุมกล้องแบบเน้นแก้ไขก่อน เส้นทางอื่นอาจเหมาะกว่า
ใช้ Veo 3.1 ต่อไป
เมื่อคุณต้องการคลิประดับพรีเมียม 8 วินาทีที่กำกับอย่างพิถีพิถัน ต้องการทั้งเอาต์พุตแนวตั้งและแนวนอน และให้ความสำคัญกับการสลับระหว่างการวางแผนแบบ text, image, first-last, reference-led หรือ multishot ภายในเส้นทางเดียว
เปรียบเทียบกับ Hailuo Standard
เมื่อคุณต้องการ workflow แบบ Hailuo สำหรับ short-form ที่กว้างกว่า พร้อมตัวเลือก 6 และ 10 วินาทีที่มองเห็นได้ชัด และเรื่องราวการวางแผน first-last ที่เรียบง่ายกว่า
เปรียบเทียบกับ Hailuo Pro
เมื่องานเป็นคลิปสั้นระดับพรีเมียมที่เฉพาะทางมากกว่า และคุณไม่ต้องการพื้นผิวการวางแผนที่กว้างกว่าของ Veo
เปรียบเทียบกับ Seedance Pro
เมื่อคุณต้องการบุคลิกเชิงสร้างสรรค์ที่ต่างออกไปสำหรับการสร้างแบบขับเคลื่อนด้วยข้อความ และกำลังทดสอบว่าตระกูลโมเดลใดให้สุนทรียะที่ใช้งานได้มากกว่าสำหรับแคมเปญ
เปรียบเทียบกับ Kling Motion Control
เมื่อการควบคุมการเคลื่อนไหวหรือการตัดต่ออย่างชัดเจนสำคัญกว่าความรู้สึกของช็อตกำกับระดับพรีเมียมแบบ Veo
ส่งคลิปที่ชนะเข้าสู่สแตกตัดต่อของคุณ
เมื่อการสร้างไม่ใช่ส่วนที่ยากอีกต่อไป และงานถัดไปคือซับไตเติล ดนตรี จังหวะ VO เวอร์ชันตัดย่อ หรือการประกอบบนไทม์ไลน์
งานเขียนใหม่นี้อ้างอิงจากเอกสารหลักของ Google และการตั้งค่าเส้นทางที่ใช้งานจริงภายใน Cleep ข้อเท็จจริงมาจาก ตารางความสามารถ Veo 3.1 อย่างเป็นทางการของ Vertex AI, เอกสาร prompt-rewriter อย่างเป็นทางการ, คู่มือพรอมต์ Veo อย่างเป็นทางการ และการตั้งค่าเส้นทาง veo31-video ปัจจุบันที่เปิดเผยระยะเวลา 8 วินาที, 720p และ 1080p, 16:9 และ 9:16, เส้นทาง text/image/first-last/reference, multishot และรองรับอินพุตภาพได้สูงสุดสามภาพ ตัวเลขเปรียบเทียบที่ไม่รองรับ ข้ออ้างเรื่องราคาเชิงคาดเดา และคำสัญญาแบบกว้าง ๆ ที่มองไปยังอนาคต ถูกลบออกโดยตั้งใจ
บน Cleep ควรมองว่า Veo 3.1 เป็นตัวเลือกวิดีโอแบบสั้นระดับพรีเมียมสำหรับคลิปความยาว 8 วินาทีที่มีการวางแผนมาอย่างรอบคอบ โดยผสานคุณภาพการสร้างวิดีโอของตระกูล Veo เข้ากับจุดเริ่มต้นการใช้งานที่ใช้งานได้จริงหลายรูปแบบ เช่น ข้อความ, ภาพนิ่ง, การวางแผนเฟรมแรก-เฟรมสุดท้าย, อินพุตที่อิงจากภาพอ้างอิง และ multishot
เส้นทางปัจจุบันรองรับ text-to-video, image-to-video, first-last-to-video และเส้นทางแบบ reference-style รวมถึง multishot และการป้อนภาพได้สูงสุดสามภาพ
เส้นทางที่มองเห็นได้ในปัจจุบันถูกกำหนดไว้ที่ 8 วินาที แม้ว่าเอกสาร Veo 3.1 ของ Google ในภาพรวมจะกล่าวถึงการรองรับ 4, 6 และ 8 วินาทีในระดับตระกูลโมเดลก็ตาม
ขณะนี้เส้นทางนี้รองรับ 720p และ 1080p รวมถึง 16:9 และ 9:16 ซึ่งทำให้เหมาะสำหรับงานแคมเปญทั้งแนวนอนและแนวตั้ง
ใช่ ตารางความสามารถของ Veo 3.1 ของ Google ในปัจจุบันระบุว่าภาษาอังกฤษเป็นภาษาสำหรับพรอมป์ ดังนั้นเวิร์กโฟลว์ที่ปลอดภัยที่สุดคือการเขียน generation prompt เป็นภาษาอังกฤษ แม้ว่าตัวหน้าเพจเองจะถูกแปลเป็นภาษาท้องถิ่นก็ตาม
ไม่ได้ เอกสาร Vertex AI อย่างเป็นทางการของ Google ระบุว่าไม่สามารถปิด prompt rewriting สำหรับโมเดล Veo 3 และ 3.1 ได้
รองรับ ปัจจุบันเส้นทางของ Cleep เปิดให้ใช้เส้นทางแบบ reference-style ในขณะเดียวกัน เอกสาร Veo 3.1 ของ Google เองก็อธิบาย reference-image-to-video ในขอบเขตที่แคบกว่ารายการฟีเจอร์ GA พื้นฐาน ดังนั้นจึงควรทดสอบเส้นทางนี้อย่างรอบคอบหากเป็นบรีฟที่มีความสำคัญต่อภารกิจ
ให้ปฏิบัติตามแนวทางการเขียนพรอมป์ของ Google เอง: ระบุการจัดเฟรม, การเคลื่อนกล้อง, สไตล์, แสง, รายละเอียดตัวละคร, สถานที่, การกระทำ และบทสนทนาหรือสัญญาณเสียงสำคัญใด ๆ ให้มองว่าพรอมป์คือคำกำกับช็อต ไม่ใช่แค่คีย์เวิร์ดแบบหลวม ๆ
ไม่ เรื่องราวของตระกูล Veo ในภาพรวมกว้างกว่าเส้นทางนี้ ตัวอย่างเช่น หน้านี้ไม่ควรถูกอธิบายว่าเป็นพื้นผิว extend-video ที่มองเห็นได้ และความสามารถบางอย่างในลักษณะพรีวิวก็เป็นของเวิร์กโฟลว์ที่เฉพาะเจาะจงกว่าตาราง Generate / Fast Generate หลัก
ให้เปรียบเทียบเส้นทางอื่นเมื่อคุณต้องการตัวเลือกความยาววิดีโอแบบสั้นที่มากกว่าเดิม, การวนแก้ไขที่ง่ายกว่า, การควบคุมการเคลื่อนไหวหรือพฤติกรรมแบบแก้ไขก่อนที่ชัดเจนกว่า, หรือเวิร์กโฟลว์ที่ไม่ได้มีศูนย์กลางอยู่ที่ช็อตกำกับความยาว 8 วินาทีระดับพรีเมียม