ผมทำภาพปกวิดีโอ YouTube 8 ภาพด้วย AI: ขนาด การจัดองค์ประกอบ และสี่ภาพที่ต้องทิ้ง

ผมทำภาพปกวิดีโอ YouTube 8 ภาพด้วย AI: ขนาด การจัดองค์ประกอบ และสี่ภาพที่ต้องทิ้ง

กรณีศึกษาตีพิมพ์บน

วิดีโอจะถูกคลิกหรือไม่ ขึ้นอยู่กับภาพปกมากกว่าที่คนส่วนใหญ่คิด ผมใช้เวลาบ่ายหนึ่งวันผลิตชุดภาพปกวิดีโอ YouTube ครบ 8 ภาพด้วยการสร้างภาพด้วย AI ระหว่างทางมีสี่ภาพที่ต้องทิ้ง มีผลลัพธ์หนึ่งที่หักล้างคำแนะนำซึ่งผมเชื่อมาตลอด และผมยังทำความผิดพลาดที่ลึกกว่านั้นซึ่งควรมีหัวข้อของตัวเอง

วัดสเปกให้ชัดก่อนจะเริ่มสร้างภาพ

ขนาดภาพปกวิดีโอ YouTube ที่แนะนำคือ 1280×720 หรืออัตราส่วน 16:9 ตัวเลขนี้หลายคนรู้ แต่มีอีกสองเรื่องที่มีผลต่อชิ้นงานจริงมากกว่า

เรื่องแรก มุมขวาล่างจะถูกป้ายบอกความยาววิดีโอทับไว้ เทียบกับกรอบ 1280×720 แล้วกินพื้นที่ราว 132×36 อะไรที่วางตรงนั้นจะหายไปครึ่งหนึ่ง

เรื่องที่สองซึ่งลืมกันง่ายกว่า คือภาพปกไม่เคยถูกแสดงในขนาดจริงบนหน้าฟีด หน้าแรกบนคอมพิวเตอร์แสดงที่ความกว้างราว 360px ส่วนฟีดแนะนำบนมือถือมักเหลือแค่ประมาณ 168px ผมย่อภาพปก YouTube ภาพเดียวกันลงมาทั้งสามขนาดแล้ววางเรียงกัน ที่ 360px ยังอ่านพร็อพและสีหน้าออก แต่ที่ 168px เหลือแค่ก้อนสีกับเงาร่างคนเท่านั้น

พื้นที่ปลอดภัยของภาพปก YouTube และขนาดแสดงผลจริงทั้งสามระดับ

ผมจึงตั้งกฎสองข้อไว้ก่อนเริ่มสร้างภาพ เก็บตัวแบบและทุกอย่างที่สำคัญไว้ในพื้นที่ปลอดภัยกลางกรอบโดยเว้นขอบ 6% ทั้งสี่ด้าน และปล่อยมุมขวาล่างให้ว่าง จากนั้นกันพื้นที่สะอาดหนึ่งจุดในเฟรมไว้สำหรับวางหัวเรื่องภายหลัง

เริ่มจากภาพแคสติ้งก่อน มันคือฐานรากของทั้งชุด

ส่วนที่ยากที่สุดของงานทั้งหมดคือคนในภาพปกทั้งแปดต้องเป็นคนเดียวกัน

วิธีของผมคือสร้างเฟรมอ้างอิงที่สะอาดขึ้นมาก่อนหนึ่งภาพด้วย การสร้างภาพด้วย AI หันหน้าตรง ระดับสายตา ไม่แต่งหน้า ไม่มีอารมณ์บนใบหน้า พื้นหลังสีเทา แสงแบนและสม่ำเสมอ เหมือนภาพถ่ายแคสติ้ง ภาพนี้ไม่สวยเลยและไม่เคยตั้งใจจะเผยแพร่ หน้าที่เดียวของมันคือเป็นภาพอ้างอิงให้ทุกเฟรมที่ตามมา

เฟรมอ้างอิงที่ล็อกตัวละครไว้: หันหน้าตรง ไม่แต่งหน้า แสงสม่ำเสมอ

แล้วก็มาถึงความผิดพลาด

รอบแรกผมล็อกการจัดองค์ประกอบไว้ด้วย ตัวแบบอยู่หนึ่งในสามด้านซ้าย มีเส้นขอบขาวตัดรอบตัว มีแสงแฉกกระจายด้านหลังศีรษะ และบล็อกสีแบนเต็มครึ่งขวา สิ่งเดียวที่เปลี่ยนได้คือสีหน้ากับสีพื้นหลัง ผ่านไปแปดภาพ ใบหน้าไม่เพี้ยนเลยแม้แต่น้อย แต่ทั้งชุดกลับดูเหมือนตารางแสดงอารมณ์มากกว่าภาพปกแปดภาพ เปลี่ยนหน้า เปลี่ยนสี แค่นั้นเอง

เหตุผลง่ายมาก ภาพปกจริงถูกออกแบบรอบเรื่องที่วิดีโอพูดถึง แต่ตัวแปรเดียวที่ผมให้โมเดลคือสีหน้า มันไม่มีอะไรให้ออกแบบ จึงทำได้แค่ทำซ้ำเทมเพลตของผมแปดครั้ง

ทางแก้คือคืนงานออกแบบให้มัน บล็อกคงที่ตอนนี้ล็อกเฉพาะสิ่งที่ต้องล็อกจริง ๆ คือคนเดิม ใบหน้าได้แสงและไม่ถูกบัง และมีครึ่งตัวบนอยู่ในเฟรม ส่วนฉาก พร็อพ องค์ประกอบกราฟิก ชุดสี แสง มิติความลึก และการจัดเฟรม ปล่อยให้โมเดลตัดสินใจเอง บล็อกตัวแปรเหลือประโยคเดียวคือ วิดีโอตอนนี้พูดเรื่องอะไร

ตัวแปรทั้งแปดคือ ลาออกจากงานประจำ ไมโครโฟนราคาพันบาทที่ดีกว่าตัวหมื่นบาท ติดอยู่ที่ยอดวิวสองร้อย ตัดต่อวิดีโอร้อยคลิปในหนึ่งสัปดาห์ อัปโหลดตอนตีสามติดกันหนึ่งเดือน ชุดอุปกรณ์ถ่ายทำทั้งชุดที่ถูกกว่าโทรศัพท์หนึ่งเครื่อง พรีเซ็ตแต่งสีห้าตัวที่ควรเลิกใช้ และเขียนสคริปต์จบภายในสิบสองนาที

สิ่งที่ได้กลับมาไม่ได้อยู่ในระดับเดียวกับรอบแรกเลย ลูกศรสีเหลืองคั่นระหว่างไมค์มือถือสีแดงกับไมค์คอนเดนเซอร์ เส้นสีแดงที่ดิ่งลงบนจอพร้อมกากบาทแดงข้าง ๆ แถวภาพตัวอย่างพรีเซ็ตที่ถูกขีดฆ่าทีละอัน นาฬิกาแขวนผนังตัดกับเส้นขอบฟ้าเมืองยามตีสาม ไม่มีภาษาภาพชุดนี้อยู่ในคำสั่งของผมเลย โมเดลภาพ AI คิดขึ้นมาเองทั้งหมด

ชุดภาพปกวิดีโอ YouTube ที่เสร็จสมบูรณ์ทั้ง 8 ภาพ

ผมคิดว่ามันเขียนตัวอักษรไม่ได้ แต่มันเขียนได้

มีคำแนะนำที่พูดกันบ่อยมากเกี่ยวกับการสร้างภาพด้วย AI ว่าโมเดลเขียนตัวอักษรที่อ่านออกไม่ได้ ตัวหนังสือในผลลัพธ์จะเพี้ยนเสมอ ผมยึดตามนั้นมาตลอด และทุกคำสั่งจะจบด้วยข้อกำหนดว่าห้ามมีตัวอักษรในเฟรม

ตอนท้ายผมลองทดสอบดู โดยให้โมเดลเขียนหัวเรื่องลงในพื้นที่ว่างโดยตรง

มันเขียนถูก ไม่มีตัวอักษรผิดแม้แต่ตัวเดียว รูปทรงสะอาด น้ำหนักตัวอักษรเหมาะสม และตัดบรรทัดสามบรรทัดได้สมเหตุสมผล กฎเก่าข้อนี้แทบใช้ไม่ได้แล้วกับโมเดลภาพ AI ในปัจจุบัน

แต่ผมก็ไม่ได้เปลี่ยนใจ เพราะการทดสอบครั้งที่สองเผยปัญหาที่แท้จริง ผมเปลี่ยนเลข 200 ในหัวเรื่องเป็น 500 โดยไม่แตะคำอื่นเลยแล้วรันใหม่ ตัวอักษรยังถูกต้อง แต่ทั้งเฟรมถูกจัดฉากใหม่หมด จากที่เธอนั่งหันข้างกลายเป็นหันหน้าตรงอยู่กลางภาพ จอมอนิเตอร์ย้ายจากขอบซ้ายสุดไปอยู่ด้านหลังเธอพอดี และขนาดกับตำแหน่งตัวอักษรก็เปลี่ยนตาม วางสองภาพเทียบกันแล้วไม่เหมือนอยู่ชุดเดียวกันเลย

เปลี่ยนตัวเลขเพียงตัวเดียวในคำสั่ง แล้วทั้งเฟรมถูกจัดฉากใหม่

ข้อสรุปจึงยังยืนอยู่ แต่เหตุผลเปลี่ยนไป ปัญหาไม่ใช่ว่ามันเขียนไม่ได้ แต่คือเลย์เอาต์ทำซ้ำไม่ได้ ถ้าคุณกำลังทำภาพปก YouTube ทั้งชุดและคิดจะเปลี่ยนหัวเรื่องหรือทำ A/B เทสต์ในภายหลัง ให้เก็บตัวอักษรไว้นอกภาพแล้ววางซ้อนแยกต่างหาก แต่ถ้าเป็นภาพเดี่ยวที่ไม่คิดจะแก้อีก ปล่อยให้โมเดลเขียนไปเลยจะประหยัดไปหนึ่งขั้นตอน

สี่ภาพที่ต้องทิ้ง

การยกอำนาจออกแบบให้โมเดลภาพ AI มีราคาที่ต้องจ่าย มันจะใส่ของที่คุณไม่เคยขอลงในเฟรมอย่างสบายใจ สี่ภาพที่ต้องทำใหม่ แบ่งเป็นความผิดพลาดสามแบบ

แบรนด์จริง ในภาพเรื่องลาออกจากงาน มันยื่นไมโครโฟนที่มีชื่อผู้ผลิตจริงพิมพ์อยู่ข้างตัวให้เธอถือ ส่วนภาพเรื่องตัดต่อร้อยคลิป มันวางกระป๋องเครื่องดื่มชูกำลังที่จำได้ทันทีสองกระป๋องไว้บนโต๊ะ ทั้งสองอย่างนี้อยู่ในภาพที่จะเผยแพร่ไม่ได้

ตัวแบบถูกทำซ้ำ ผมเพิ่มข้อห้ามเรื่องแบรนด์แล้วรันภาพลาออกใหม่ ปรากฏว่าได้เธอมาสองคน คนหนึ่งนั่งพิมพ์อยู่ที่โต๊ะ อีกคนยืนข้าง ๆ พร้อมกล่องกระดาษในอ้อมแขน โมเดลตีความว่า "ออกจากออฟฟิศ" เป็นฉากที่ต้องใช้นักแสดงสองคน

ตัวอักษรโผล่บนพร็อพ ในภาพชุดอุปกรณ์ราคาถูก มันเขียนคำภาษาอังกฤษสองคำอย่างเรียบร้อยบนกล่องกระดาษ ข้อนี้หนักที่สุดในบริบทนี้ เพราะภาพประกอบใช้ร่วมกันทั้ง 21 ภาษา ตัวอักษรภาษาใดภาษาหนึ่งจึงกลายเป็นสิ่งรบกวนสำหรับผู้อ่านอีกยี่สิบภาษา

ความผิดพลาดสามแบบ: แบรนด์จริง ตัวแบบถูกทำซ้ำ ตัวอักษรบนพร็อพ

ทั้งสามข้อถูกเพิ่มเข้าไปในบล็อกคงที่ในภายหลัง และต้องเขียนให้เจาะจง คำว่า "ห้ามมีตัวอักษร" ยังไม่พอ ต้องระบุว่าห้ามมีตัวอักษรบนหน้าจอ บรรจุภัณฑ์ ป้ายฉลาก อุปกรณ์ และป้ายร้าน ส่วนคำว่า "มีคนเดียว" ก็ยังไม่พอ ต้องตัดทั้งตัวเธอคนที่สอง เงาสะท้อนของเธอ และภาพเหมือนของเธอที่อยู่ในฉากหลังออกไปด้วย

โครงสร้างคำสั่งที่ลอกไปใช้ได้เลย

บล็อกคงที่จะถูกวางลงในทุกคำสั่งโดยไม่แก้ไข เนื้อความประมาณนี้

ใช้คนคนเดียวกับในภาพอ้างอิง ทรงผมเดิม เธอต้องจำได้ทันทีว่าเป็นคนเดียวกัน ใบหน้าได้รับแสง ไม่ถูกบัง และหันเข้าหากล้องโดยประมาณ มีครึ่งตัวบนอยู่ในเฟรม คุณคือผู้กำกับศิลป์ที่กำลังออกแบบภาพปกวิดีโอ YouTube ซึ่งต้องคว้าคลิกให้ได้ที่ความกว้าง 168 พิกเซล ทุกอย่างนอกจากตัวตนของเธอคุณตัดสินใจเองทั้งหมด ทั้งฉาก พร็อพ องค์ประกอบกราฟิก ชุดสี แสง มิติความลึก และการจัดเฟรม ทำให้กล้า คอนทราสต์สูง และเจาะจงกับหัวข้อนี้ ไม่ใช่ภาพบุคคลบนพื้นหลังสีเรียบ เว้นพื้นที่สะอาดหนึ่งจุดในเฟรมไว้สำหรับหัวเรื่องที่จะเติมภายหลัง ห้ามมีตัวอักษร ตัวหนังสือ หรือตัวเลขในทุกจุด รวมถึงบนหน้าจอ บรรจุภัณฑ์ ป้ายฉลาก อุปกรณ์ และป้ายร้าน ห้ามมีโลโก้แบรนด์หรือเครื่องหมายการค้าที่จำได้ พร็อพทุกชิ้นต้องไม่มีตราสินค้า และในเฟรมต้องมีคนเพียงคนเดียวเท่านั้น

บล็อกตัวแปรมีประโยคเดียวคือ วิดีโอตอนนี้พูดเรื่องอะไร

ข้อห้ามสามข้อสุดท้ายถูกเพิ่มหลังจากต้องทำภาพใหม่ทั้งสิ้น หนึ่งข้อต่อหนึ่งความผิดพลาด โครงสร้างนี้ย้ายไปใช้กับโมเดลภาพ AI ตัวอื่นได้โดยไม่ต้องแก้ ต่างกันแค่สำนวนการเขียนเท่านั้น

ภาพปกหนึ่งภาพ ใช้ได้สองครั้ง

เมื่อทั้งแปดภาพนิ่งแล้ว ภาพนิ่งจาก AI ยังมีงานให้ทำอีกอย่าง ผมเอาภาพตอนตีสามมาเป็นเฟรมแรก แล้วใช้ การสร้างวิดีโอจากเฟรมแรกและเฟรมสุดท้าย ทำอินโทรความยาวห้าวินาที

อินโทรที่สร้างขึ้นจากภาพปก YouTube ภาพหนึ่ง

ตรงนี้มีหลุมพรางจริงเช่นกัน คลิปที่ได้จัดเฟรมใหม่ ทำให้พื้นที่สะอาดที่ผมตั้งใจกันไว้ให้หัวเรื่องถูกกินไปเกือบหมด ถ้าเป็นอินโทรก็ไม่เป็นไร แต่ถ้าจะใช้เป็นการ์ดปิดท้ายก็ต้องจัดเลย์เอาต์ใหม่

ถ้าจะรันทั้งชุดพร้อมกัน การกระจายงานภาพ AI ทั้งแปดชิ้นไว้บน ผ้าใบสร้างสรรค์ สะดวกกว่าทำทีละภาพ เพราะเห็นได้ในพริบตาว่าจะเก็บภาพไหนและทำภาพไหนใหม่ ถ้าไม่อยากเขียนคำสั่งตั้งแต่ต้น ใน แม่แบบ มีสไตล์ภาพบุคคลสำเร็จรูปให้เลือกใช้ได้ทันที

แปดภาพสุดท้ายในบ่ายเดียว

ชุดภาพปกวิดีโอ YouTube ทั้งหมดใช้เวลาหนึ่งบ่ายตั้งแต่รันครั้งแรกจนได้ภาพนิ่งครบแปดภาพ โดยทิ้งไปสี่ภาพ ส่วนที่กินเวลาไม่ใช่การสร้างภาพหรือการรีทัช แต่คือการคิดให้ออกว่าควรมอบอะไรให้โมเดล ตอนแรกผมกำแน่นเกินไป ตอกการจัดองค์ประกอบไว้ตายตัว แล้วได้ภาพแปดภาพที่หน้าตาเหมือนกันหมด

ถ้าจะทำตาม ลำดับคือ วัดพื้นที่ปลอดภัยและขนาดแสดงผลจริงทั้งสามระดับ สร้างเฟรมอ้างอิงที่ไม่สวยแต่สะอาดหนึ่งภาพ ตัดบล็อกคงที่ให้เหลือแค่ตัวบุคคลกับข้อห้ามไม่กี่ข้อ แล้วใช้หัวข้อของแต่ละภาพเป็นตัวแปรเพียงอย่างเดียว ส่วนเรื่องตัวอักษร ถ้าทำทั้งชุดให้เติมทีหลัง ถ้าทำภาพเดี่ยวก็ปล่อยให้โมเดลเขียนไปเลย

ชุดภาพปกวิดีโอ YouTube ทั้งหมดใช้เครื่องมือภาพ AI เพียงสองตัวเท่านั้น คือ การสร้างภาพด้วย AI และ การแก้ไขภาพด้วย AI

แบ่งปัน