หน้าแรก/คู่มือ AI/AI สร้างวิดีโอจากข้อความ
อัปเดต 7 ส.ค. 2026

AI สร้างวิดีโอจากข้อความ

เลือกเครื่องมือ เขียน prompt ให้ได้ภาพที่คิดไว้ และเอาไปใช้งานจริงโดยไม่มีปัญหาตามหลัง

ปี 2026 การพิมพ์ข้อความแล้วได้คลิปพร้อมเสียงกลายเป็นเรื่องปกติ แต่ระยะห่างระหว่าง “คลิปที่ดูสนุกในฟีด” กับ “คลิปที่ส่งลูกค้าได้” ยังกว้างมาก คู่มือนี้ว่าด้วยการปิดระยะนั้น — เขียน prompt อย่างไรให้ได้ช็อตที่ต้องการ ทำคลิปยาวกว่าที่โมเดลสร้างได้ครั้งเดียวอย่างไร และมีอะไรบ้างที่ต้องเช็กก่อนกดเผยแพร่

หมายเหตุเรื่องความสด: วงการนี้เปลี่ยนเร็วมาก ชื่อรุ่น ความยาวที่สร้างได้ ราคา และโควตาของแต่ละแผนเปลี่ยนได้ตลอด บทความนี้จึงเน้นหลักการที่ใช้ได้ข้ามเครื่องมือ ส่วนตัวเลขและเงื่อนไขให้เช็กจากหน้าเอกสารทางการที่ลิงก์ไว้ท้ายบทความก่อนตัดสินใจสมัคร

“สร้างวิดีโอ” ไม่ใช่ “ตัดต่อวิดีโอ”#

สองงานนี้ใช้เครื่องมือคนละกลุ่มและแก้ปัญหาคนละอย่าง ถ้าเลือกผิดตั้งแต่ต้นจะเสียเวลาไปมาก:

AI สร้างวิดีโอ (บทความนี้)AI ช่วยตัดต่อ
เริ่มจากข้อความหรือภาพนิ่งฟุตเทจที่ถ่ายมาแล้ว
เหมาะกับภาพที่ถ่ายจริงไม่ได้หรือไม่คุ้มถ่ายคลิปพูด สัมภาษณ์ vlog
จุดแข็งb-roll ภาพประกอบ ฉากสมมติ ภาพสินค้าในบริบทใส่ซับ ตัดช่วงเงียบ ทำแนวตั้ง
จุดอ่อนคุมรายละเอียดยาก ตัวละครไม่คงที่ ข้อความในภาพเพี้ยนสร้างภาพที่ไม่ได้ถ่ายไม่ได้

ถ้างานของคุณคือคลิปที่ตัวเองพูดหน้ากล้อง ให้ข้ามไปที่ AI ช่วยตัดต่อวิดีโอและ vlog จะตรงกว่า ส่วนบทความนี้เหมาะกับคนที่ต้องการภาพซึ่งไม่มีฟุตเทจอยู่ในมือ — ฉากโรงงานที่เข้าไปถ่ายไม่ได้ ภาพสินค้าลอยกลางอากาศ หรือ b-roll ประกอบคลิปที่ถ่ายเองไว้แล้ว

เครื่องมือหลักและเลือกอย่างไร#

เครื่องมือจุดเด่นเหมาะกับ
Sora (OpenAI)สร้างวิดีโอพร้อมเสียงในตัว มีแอปที่เป็นฟีดโซเชียลให้รีมิกซ์งานกันได้ เปิดใช้ในไทยแล้วคอนเทนต์โซเชียล ทดลองไอเดียเร็ว
Veo (Google)สร้างเสียงพูด เสียงประกอบ และเสียงบรรยากาศในตัว มีฟังก์ชันต่อความยาวคลิป ใช้ผ่านแอป Gemini หรือ Flowงานที่ต้องคุมช็อตและต่อเป็นเรื่อง
Kling / Runway และค่ายอื่นฟีเจอร์เฉพาะทางต่างกันไป เช่น การคุมกล้องหรือการต่อภาพเป็นวิดีโอคนที่ต้องการทางเลือกเมื่อสองเจ้าแรกให้ผลไม่ตรงใจ

คำแนะนำที่ประหยัดเวลาที่สุด: อย่าเพิ่งสมัครรายปี ลองงานจริงชิ้นเดียวกันด้วยสองเครื่องมือ แล้วดูว่าค่ายไหนเข้ากับสไตล์งานของคุณ เพราะโมเดลแต่ละตัวมี “รสนิยมภาพ” ต่างกันชัดเจน และเปลี่ยนทุกครั้งที่ออกรุ่นใหม่

โครง prompt วิดีโอ 6 องค์ประกอบ#

ความผิดพลาดอันดับหนึ่งของมือใหม่คือเขียน prompt แบบสั่งภาพนิ่ง — บอกว่ามีอะไรอยู่ในเฟรม แต่ไม่บอกว่าอะไรเคลื่อนไหวและกล้องทำอะไร ผลคือได้คลิปที่เหมือนภาพนิ่งขยับเล็กน้อย

โครงที่ใช้ได้กับทุกเครื่องมือ:

องค์ประกอบตอบว่าตัวอย่าง
1. ซับเจกต์ใครหรืออะไรอยู่ในเฟรม รายละเอียดพอให้จำได้ช่างเชื่อมหญิงวัย 40 สวมชุดกันไฟสีกรม
2. แอ็กชันเคลื่อนไหวอะไรตลอดช็อตยกหน้ากากขึ้น หันมามองกล้อง แล้วยิ้มเล็กน้อย
3. ฉากและเวลาที่ไหน ช่วงเวลาไหนโรงงานผลิตชิ้นส่วน ช่วงเช้า มีฝุ่นลอยในลำแสง
4. กล้องระยะภาพ มุม และการเคลื่อนกล้องmedium close-up ระดับสายตา กล้องดอลลี่เข้าช้า ๆ
5. แสงและโทนบรรยากาศและสไตล์ภาพแสงธรรมชาติจากหน้าต่างสูง โทนอบอุ่น ฟิล์มเกรนบาง ๆ
6. เสียงบทพูด เสียงประกอบ เสียงบรรยากาศเสียงเครื่องจักรเป็นจังหวะเบา ๆ ไม่มีดนตรี

เขียนรวมเป็นย่อหน้าเดียวจะได้ผลดีกว่าเขียนเป็นบุลเล็ตในเครื่องมือส่วนใหญ่:

Medium close-up ระดับสายตา ช่างเชื่อมหญิงวัยราว 40 สวมชุดกันไฟสีกรม
ยืนอยู่หน้าเครื่องจักรในโรงงานผลิตชิ้นส่วน ช่วงเช้า
เธอยกหน้ากากเชื่อมขึ้นช้า ๆ หันมามองกล้อง แล้วยิ้มเล็กน้อย
กล้องดอลลี่เข้าหาเธออย่างช้าและนิ่ง
แสงธรรมชาติจากหน้าต่างสูงด้านซ้าย มีฝุ่นลอยในลำแสง โทนอบอุ่น
มีฟิล์มเกรนบาง ๆ ให้ดูเหมือนถ่ายด้วยกล้องจริง
เสียง: เครื่องจักรเป็นจังหวะเบา ๆ อยู่ไกล ๆ ไม่มีดนตรีประกอบ

สองข้อที่คนลืมบ่อยที่สุดคือ ข้อ 4 กับ ข้อ 6 — ถ้าไม่บอกเรื่องกล้อง โมเดลจะเลือกให้เอง มักได้ช็อตที่แพนไปมาโดยไม่มีเหตุผล และถ้าไม่บอกเรื่องเสียง จะได้ดนตรีสต็อกที่ไม่เข้ากับงาน

อีกเทคนิคที่ช่วยได้มาก: บอกสิ่งที่ไม่ต้องการด้วย เช่น “ไม่มีข้อความบนจอ ไม่มีโลโก้ ไม่มีคนอื่นในเฟรม ไม่มีการตัดภาพระหว่างช็อต” เพราะการตัดภาพที่โมเดลใส่มาเองคือสาเหตุที่ทำให้คลิปเอาไปต่อกับงานอื่นไม่ได้

เสียงและบทพูด#

โมเดลรุ่นใหม่สร้างเสียงได้ในตัวสามประเภท: บทพูด ที่ระบุในเครื่องหมายคำพูด เสียงประกอบ ที่บรรยายให้ชัด และ เสียงบรรยากาศ ที่กำหนดพื้นหลังของฉาก

...ชายวัยกลางคนยืนหลังเคาน์เตอร์ร้านกาแฟ
เขาพูดกับลูกค้าว่า "Your usual, right?" แล้วหันไปหยิบแก้ว
เสียงประกอบ: เครื่องบดกาแฟดังสั้น ๆ ตอนต้นคลิป เสียงถ้วยกระทบจานรอง
เสียงบรรยากาศ: ร้านที่มีคนคุยกันเบา ๆ อยู่ด้านหลัง ไม่มีดนตรี

ข้อเท็จจริงที่ต้องยอมรับสำหรับงานภาษาไทย: คุณภาพเสียงพูดไทยยังตามหลังภาษาอังกฤษอยู่มาก โดยเฉพาะการขยับปากให้ตรงคำ สำหรับงานที่ส่งลูกค้า วิธีที่ได้ผลกว่าคือ

  1. ให้ AI สร้างภาพและเสียงบรรยากาศ โดยไม่ต้องมีบทพูด
  2. ออกแบบช็อตให้ไม่เห็นปากชัด เช่น ถ่ายจากด้านหลัง มุมข้าง หรือระยะไกล
  3. อัดเสียงพากย์ไทยแยก แล้ววางในขั้นตอนตัดต่อ

วิธีนี้คุมคำ จังหวะ และการออกเสียงชื่อแบรนด์ได้ทั้งหมด ซึ่งเป็นสิ่งที่ลูกค้ามักขอแก้มากที่สุด

ทำคลิปให้ยาวกว่าที่โมเดลสร้างได้ครั้งเดียว#

คลิปที่สร้างได้ต่อครั้งมักสั้นระดับไม่กี่วินาที เช่น ในแอป Gemini สร้างคลิปพร้อมเสียงได้ราว 8 วินาทีต่อครั้ง มีสามวิธีทำให้ยาวขึ้น:

  1. ใช้ฟังก์ชันต่อคลิป เช่น Extend ของ Veo ที่ต่อความยาวออกไปจากคลิปเดิมได้ เหมาะกับช็อตที่ต้องการให้แอ็กชันเดินต่อเนื่อง
  2. สร้างหลายช็อตแล้วตัดต่อเอง — วิธีที่งานจริงส่วนใหญ่ใช้ เพราะคุมจังหวะ เสียง และความยาวได้ทั้งหมด
  3. ใช้เฟรมสุดท้ายของช็อตก่อนเป็นภาพตั้งต้นของช็อตถัดไป ทำให้ภาพต่อเนื่องกันเนียนขึ้นมาก

คำแนะนำเชิงปฏิบัติ: คิดเป็นช็อตตั้งแต่ต้น อย่าคิดเป็นคลิปเดียวยาว ๆ เขียน shot list ก่อน แล้วสร้างทีละช็อต โฆษณา 15 วินาทีที่ดีคือ 4–6 ช็อต ไม่ใช่ช็อตเดียว 15 วินาที

ช่วยแตกไอเดียโฆษณานี้เป็น shot list สำหรับคลิป 15 วินาที แนวตั้ง 9:16
สินค้า: [ใส่สินค้า]  ผู้ชม: [ใส่กลุ่มเป้าหมาย]  สิ่งที่ต้องการให้จำ: [ใส่ข้อความหลัก]

แต่ละช็อตระบุ: ความยาว / สิ่งที่เห็น / การเคลื่อนกล้อง / เสียง
และเขียน prompt สำหรับสร้างช็อตนั้นแยกให้ด้วย

ช็อตแรกต้องหยุดนิ้วคนดูใน 1 วินาทีแรก
ห้ามใส่ข้อความบนภาพในช็อตที่สร้างด้วย AI ฉันจะใส่ตอนตัดต่อเอง

บรรทัดสุดท้ายสำคัญ เพราะข้อความที่โมเดลสร้างลงในภาพมักสะกดเพี้ยน โดยเฉพาะภาษาไทย ให้ใส่ตัวหนังสือในขั้นตอนตัดต่อเสมอ

เริ่มจากภาพแทนข้อความ เมื่อต้องคุมหน้าตา#

ปัญหาที่ทำให้คนเลิกใช้มากที่สุดคือ ตัวละครหน้าเปลี่ยนทุกช็อต หรือ สินค้าหน้าตาไม่ตรงของจริง สาเหตุคือทุกครั้งที่สั่งสร้าง โมเดลเริ่มใหม่จากศูนย์ ไม่ได้จำอะไรจากช็อตก่อน

ทางแก้คืออย่าเริ่มจากข้อความล้วน:

  • ใช้ image-to-video โดยให้ภาพสินค้าจริงหรือภาพตัวละครที่ล็อกไว้แล้วเป็นเฟรมตั้งต้น
  • ใช้ฟังก์ชันที่รับภาพอ้างอิงหลายภาพเข้าไปประกอบเป็นฉากเดียว
  • ถ้าจำเป็นต้องเริ่มจากข้อความ ให้เขียนคำบรรยายตัวละครชุดเดิมเป๊ะ ๆ ทุกช็อต แล้วคัดลอกวางซ้ำ
  • ออกแบบให้เลี่ยงปัญหา เช่น ถ่ายจากด้านหลัง ระยะไกล หรือให้เห็นแค่มือ

สำหรับงานสินค้า การใช้ภาพจริงเป็นจุดตั้งต้นไม่ได้แค่แก้ปัญหาความคงที่ แต่ยังลดความเสี่ยงเรื่องการโฆษณาเกินจริงด้วย เพราะสิ่งที่คนดูเห็นคือของจริง ไม่ใช่ของที่โมเดลจินตนาการขึ้น

ถ้าต้องสร้างภาพนิ่งตั้งต้นก่อน อ่านต่อที่ AI สร้างรูปภาพสำหรับงานจริง

สูตรงานจริง 3 แบบ#

แบบที่ 1: b-roll ประกอบคลิปที่ถ่ายเอง#

คุ้มที่สุดและเสี่ยงน้อยที่สุด เพราะเนื้อหาหลักยังเป็นของจริง AI แค่เติมภาพประกอบที่ถ่ายไม่ได้

ช็อต b-roll 5 วินาที ไม่มีคนในเฟรม
มือหยิบเมล็ดกาแฟจากกระสอบ ปล่อยให้เมล็ดร่วงกลับลงไปช้า ๆ
โคลสอัพมาก ระยะชัดตื้น กล้องนิ่งบนขาตั้ง
แสงข้างจากหน้าต่าง โทนอบอุ่น พื้นหลังเบลอเป็นสีน้ำตาลเข้ม
เสียง: เสียงเมล็ดกาแฟร่วงเท่านั้น ไม่มีดนตรี
ไม่มีข้อความ ไม่มีโลโก้ ไม่มีการตัดภาพ

แบบที่ 2: คลิปโฆษณาสั้นแนวตั้ง#

ใช้ shot list จากหัวข้อก่อนหน้า แล้วสร้างทีละช็อต โดยยึดหลัก

  • ช็อตแรกต้องมีการเคลื่อนไหวชัดเจนใน 1 วินาทีแรก
  • สินค้าใช้ภาพจริงเป็นจุดตั้งต้นเสมอ
  • ข้อความและโลโก้ใส่ตอนตัดต่อ ไม่ใช่ให้ AI สร้าง
  • เตรียมช็อตสำรองไว้อย่างน้อยหนึ่งเวอร์ชันต่อช็อต เพราะจะมีบางช็อตที่ใช้ไม่ได้แน่นอน

แบบที่ 3: ภาพประกอบคอนเทนต์ให้ความรู้#

เหมาะกับคลิปอธิบายที่ต้องเห็นภาพสถานการณ์ เช่น อธิบายขั้นตอนทำงานหรือปัญหาที่ลูกค้าเจอ — ให้ AI สร้างฉากจำลอง แล้วพากย์ทับ

ช็อต 6 วินาที มุมสูงเล็กน้อย มองลงมาที่โต๊ะทำงานที่มีเอกสารกองสูงสองกอง
มือคนค่อย ๆ วางแฟ้มเพิ่มลงบนกองที่สูงกว่า จนกองเอียงเล็กน้อย
กล้องนิ่ง แสงออฟฟิศธรรมดาออกโทนเย็น
เสียง: เสียงกระดาษและเสียงแอร์เบา ๆ
ไม่มีคนให้เห็นหน้า ไม่มีข้อความบนภาพ

“ไม่มีคนให้เห็นหน้า” ทำสองอย่างพร้อมกัน: เลี่ยงปัญหาใบหน้าที่ AI สร้างดูแปลก และเลี่ยงประเด็นสิทธิในภาพลักษณ์บุคคล

อาการที่เจอบ่อยและวิธีแก้#

อาการสาเหตุวิธีแก้
คลิปเหมือนภาพนิ่งขยับนิดเดียวไม่ได้ระบุแอ็กชันและการเคลื่อนกล้องใส่ข้อ 2 และ 4 ของโครง prompt ให้ชัด
ตัวละครหน้าเปลี่ยนทุกช็อตเริ่มจากข้อความล้วนทุกครั้งใช้ภาพอ้างอิงเป็นจุดตั้งต้น หรือเลี่ยงให้เห็นหน้า
ตัวหนังสือในภาพสะกดเพี้ยนโมเดลยังทำข้อความในภาพได้ไม่ดี โดยเฉพาะไทยสั่งไม่ให้มีข้อความ แล้วใส่ตอนตัดต่อ
มือ นิ้ว หรือการเดินดูผิดธรรมชาติข้อจำกัดของโมเดลกับการเคลื่อนไหวซับซ้อนเลี่ยงช็อตที่เห็นมือชัดหรือคนเดินเต็มตัว ใช้ระยะใกล้หรือไกลแทน
มีการตัดภาพเองกลางช็อตไม่ได้ห้ามไว้ โมเดลจึงจัดให้เป็นซีนระบุ "single continuous shot, no cuts"
ได้ดนตรีประกอบที่ไม่ต้องการไม่ได้ระบุเรื่องเสียงระบุเสียงที่ต้องการ และเขียนว่าไม่มีดนตรี
สินค้าหน้าตาไม่ตรงของจริงสร้างจากคำบรรยายใช้ image-to-video จากภาพสินค้าจริง
สร้างไม่ผ่าน ติดนโยบายเนื้อหาprompt พาดพิงบุคคลจริง แบรนด์ หรือตัวละครมีลิขสิทธิ์เปลี่ยนเป็นคำบรรยายลักษณะทั่วไปแทนการระบุชื่อ

คุมต้นทุนและเวลา#

ทุกเครื่องมือคิดค่าใช้จ่ายตามจำนวนและคุณภาพของคลิปที่สร้าง ไม่ว่าจะเรียกว่าเครดิตหรือโควตา และต้นทุนจริงของงานหนึ่งชิ้นคือจำนวนครั้งที่ต้องสร้างซ้ำ ไม่ใช่จำนวนช็อตในงาน สิ่งที่ช่วยได้:

  • ทดลองที่ความละเอียดต่ำก่อน จนได้องค์ประกอบที่ถูกใจ แล้วค่อยสร้างซ้ำที่ความละเอียดสูงเฉพาะช็อตที่จะใช้จริง
  • แก้ทีละตัวแปร ถ้าเปลี่ยนทั้งกล้อง แสง และแอ็กชันพร้อมกัน คุณจะไม่รู้ว่าอะไรทำให้ดีขึ้น
  • เก็บ prompt ที่ใช้ได้ผลไว้เป็นไลบรารี พร้อมโน้ตว่าใช้กับเครื่องมือไหนรุ่นไหน
  • ตั้งเพดานไว้ล่วงหน้า เช่น ช็อตละไม่เกิน 5 ครั้ง ถ้ายังไม่ได้ให้เปลี่ยนวิธีเล่าแทนการสร้างซ้ำ

ข้อสุดท้ายสำคัญกับงานลูกค้า เพราะช็อตที่ “เกือบได้” มักกินเวลาและเงินมากกว่าการออกแบบช็อตใหม่ที่ง่ายกว่า

กฎที่ต้องรู้ก่อนเผยแพร่#

  • ลายน้ำและข้อมูลกำกับในไฟล์ — หลายบริการใส่ลายน้ำที่มองเห็นได้ และบางแผนของผู้ใช้แบบเสียเงินดาวน์โหลดไฟล์ที่ไม่มีลายน้ำได้ แต่ไฟล์มักฝังข้อมูลมาตรฐาน C2PA ที่ระบุว่าสร้างด้วย AI ไว้อยู่ดี อย่าวางแผนงานบนสมมติฐานว่าไม่มีใครรู้
  • ใบหน้าและเสียงของบุคคลจริงต้องได้รับความยินยอม — รวมถึงตัวคุณเองในกรณีที่งานนั้นเป็นของลูกค้า การสร้างคลิปที่คนดูเข้าใจว่าเป็นบุคคลจริงพูดสิ่งที่เขาไม่ได้พูด เป็นความเสี่ยงทั้งทางกฎหมายและชื่อเสียง
  • ตัวละคร โลโก้ และแบรนด์มีเจ้าของ — การใส่ชื่อตัวละครหรือแบรนด์ลงใน prompt มักติดนโยบายเนื้อหาอยู่แล้ว และถึงสร้างได้ก็ไม่ได้แปลว่าใช้เชิงพาณิชย์ได้
  • เช็กสิทธิ์เชิงพาณิชย์ในแผนที่คุณจ่าย — แต่ละบริการให้สิทธิ์ต่างกันและเปลี่ยนเงื่อนไขได้ ถ้าเป็นงานลูกค้า ให้ระบุในใบเสนอราคาไปเลยว่าส่วนไหนสร้างด้วย AI
  • แจ้งผู้ชมตามข้อกำหนดของแพลตฟอร์ม — แพลตฟอร์มโซเชียลหลายแห่งกำหนดให้ติดป้ายกำกับคอนเทนต์ที่สร้างหรือดัดแปลงด้วย AI โดยเฉพาะเนื้อหาที่ดูสมจริง เช็กกฎของแต่ละแพลตฟอร์มก่อนโพสต์
  • โฆษณาต้องไม่ทำให้เข้าใจผิดในสาระสำคัญ — ภาพที่ AI สร้างขึ้นต้องไม่แสดงสรรพคุณหรือผลลัพธ์ที่สินค้าทำไม่ได้จริง นี่เป็นเรื่องของกฎหมายคุ้มครองผู้บริโภค ไม่ใช่แค่มารยาท
  • อย่าใส่ข้อมูลลับลงใน prompt — สเปกสินค้าที่ยังไม่เปิดตัว แผนแคมเปญ หรือข้อมูลลูกค้า ควรอยู่นอก prompt เสมอ ดูแนวทางที่ ใช้ AI อย่างปลอดภัยกับข้อมูลงาน

เวิร์กโฟลว์คลิปโฆษณาหนึ่งชิ้น#

ขั้นทำอะไรใช้อะไร
1ตกลงข้อความหลักและกลุ่มเป้าหมายคุยกับลูกค้า ไม่ใช่ AI
2แตกเป็น shot list 4–6 ช็อตClaude หรือแชตที่ถนัด
3เตรียมภาพตั้งต้นของสินค้าภาพถ่ายจริง หรือ AI สร้างภาพนิ่ง
4สร้างทีละช็อตที่ความละเอียดต่ำเครื่องมือสร้างวิดีโอ
5คัดช็อตที่ใช้ได้ แล้วสร้างซ้ำที่ความละเอียดสูงเครื่องมือเดิม
6ตัดต่อ ใส่ข้อความ โลโก้ และเสียงพากย์ไทยโปรแกรมตัดต่อ
7ตรวจก่อนส่ง: สิทธิ์ ใบหน้า คำโฆษณา ป้ายกำกับ AIเช็กลิสต์ในหัวข้อก่อนหน้า

FAQ#

AI สร้างวิดีโอทำคลิปยาวเท่าไรได้?#

คลิปที่สร้างได้ในครั้งเดียวมักสั้นระดับไม่กี่วินาที เช่น ในแอป Gemini สร้างคลิปพร้อมเสียงได้ราว 8 วินาทีต่อครั้ง วิธีทำคลิปยาวกว่านั้นคือใช้ฟังก์ชันต่อคลิป เช่น Extend ของ Veo ที่ต่อความยาวออกไปได้ หรือสร้างหลายช็อตแล้วนำมาตัดต่อเรียงกันในโปรแกรมตัดต่อ ซึ่งเป็นวิธีที่งานจริงส่วนใหญ่ใช้ เพราะคุมจังหวะและเสียงได้ดีกว่า

วิดีโอที่ AI สร้างมีลายน้ำไหม และบอกได้ไหมว่าสร้างด้วย AI?#

ขึ้นกับเครื่องมือและแผนที่ใช้ หลายบริการใส่ลายน้ำที่มองเห็นได้ในไฟล์ที่ดาวน์โหลด และผู้ใช้แบบเสียเงินบางแผนดาวน์โหลดไฟล์ที่ไม่มีลายน้ำได้ แต่ถึงไม่มีลายน้ำที่มองเห็น ไฟล์มักฝังข้อมูลกำกับมาตรฐาน C2PA ที่ระบุว่าสร้างด้วย AI ไว้ในไฟล์อยู่ดี ดังนั้นอย่าวางแผนงานบนสมมติฐานว่าจะไม่มีใครรู้ ให้แจ้งผู้ชมตามข้อกำหนดของแพลตฟอร์มแทน

ใส่บทพูดภาษาไทยในวิดีโอ AI ได้ไหม?#

โมเดลรุ่นใหม่สร้างเสียงพูด เสียงประกอบ และเสียงบรรยากาศได้ในตัว โดยระบุบทพูดในเครื่องหมายคำพูด แต่คุณภาพภาษาไทยยังไม่เท่าภาษาอังกฤษ โดยเฉพาะการขยับปากให้ตรงคำ วิธีที่ได้ผลกว่าสำหรับงานส่งลูกค้าคือให้ AI สร้างภาพและเสียงบรรยากาศ แล้วอัดเสียงพากย์ไทยแยกมาวางในขั้นตอนตัดต่อ ซึ่งคุมคำและจังหวะได้ทั้งหมด

ใช้วิดีโอที่ AI สร้างในงานโฆษณาเชิงพาณิชย์ได้ไหม?#

ต้องดูสามชั้น หนึ่งคือเงื่อนไขการใช้งานของเครื่องมือว่าให้สิทธิ์ใช้เชิงพาณิชย์แค่ไหนในแผนที่คุณจ่าย สองคือเนื้อหาในคลิปต้องไม่ละเมิดสิทธิ์ผู้อื่น เช่น ใบหน้าบุคคลจริง ตัวละครหรือโลโก้ที่มีลิขสิทธิ์ และสามคือข้อกำหนดการเปิดเผยของแพลตฟอร์มที่จะเผยแพร่ ถ้าเป็นงานลูกค้าให้ระบุในใบเสนอราคาไปเลยว่าส่วนไหนสร้างด้วย AI

ทำไมตัวละครในคลิปหน้าเปลี่ยนไปทุกช็อต?#

เพราะแต่ละครั้งที่สั่งสร้าง โมเดลเริ่มใหม่จากศูนย์ ไม่ได้จำตัวละครจากช็อตก่อน วิธีแก้คือให้ภาพอ้างอิงเป็นจุดตั้งต้นแทนการเริ่มจากข้อความล้วน ใช้ฟังก์ชันที่รับภาพหรือองค์ประกอบอ้างอิงเข้าไปด้วย และเขียนลักษณะตัวละครแบบละเอียดชุดเดิมทุกช็อต หรือออกแบบให้เลี่ยงการเห็นหน้าชัด เช่น ถ่ายจากด้านหลังหรือระยะไกล

อ่านต่อ#

แหล่งอ้างอิง#