วิธีเปลี่ยนภาพจาก GPT Image 2.5 ให้เป็นวิดีโอบน Felo
GPT Image 2.5 สร้างเฟรมแรกที่เชื่อถือได้ วิธีทำให้ภาพเคลื่อนไหวด้วย Image to Video AI ของ Felo — คำสั่งเคลื่อนไหว เฟรมแรกและสุดท้าย และค่าใช้จ่ายจริง
เครื่องมือสร้างวิดีโอสร้างการเคลื่อนไหว แต่ไม่ได้สร้างเฟรม
สำหรับฟุตเทจแบบนามธรรมอาจเพียงพอ แต่จะใช้ไม่ได้ทันทีที่คลิปต้องแสดงสินค้า ตัวละคร ถนน หรือพาดหัวข่าวที่อ่านได้ Text-to-video ให้โมเดลสร้างโลกและขยับมันในครั้งเดียว โลกที่สร้างขึ้นเปลี่ยนไปแต่ละเทค
การสร้างวิดีโอจากภาพเริ่มต้นเปลี่ยนลำดับขั้นตอน สร้างเฟรม ตรวจสอบ แก้ไข แล้วค่อยส่งต่อให้สร้างภาพเคลื่อนไหว ใส่ภาพเดียว ได้วิดีโอหนึ่งช็อต
GPT Image 2.5 ที่ OpenAI เปิดตัวเมื่อ 8 กันยายน 2026 ทำให้กระบวนการนี้ใช้งานจริง จุดเด่นคือจับตัวแบบให้นิ่ง — หน้าเดิม ขวดเดิม พาดหัวเดิม — ซึ่งเฟรมแรกต้องการ Image to Video AI ของ Felo รับเฟรมนั้นไปสร้างการเคลื่อนไหว
คู่มือนี้พาเดินครบทุกขั้นตอน: สร้างภาพนิ่ง กำกับช็อต คุมตอนจบ และรู้ค่าใช้จ่ายก่อนกดสร้าง

ภาพหน้าปกของโพสต์นี้สร้างด้วย GPT Image 2.5 บน Felo ไม่มีกราฟิกซ้อนทับ
ทำไมต้องเริ่มจากภาพนิ่ง
โมเดลวิดีโออ่านเฟรมแรกเหมือนสัญญา ตัวตนของแบบ องค์ประกอบ วัสดุ และทิศทางสีมาจากภาพ คำสั่งกำหนดแค่สิ่งที่จะเปลี่ยน
จุดนี้ทำให้เวิร์กโฟลว์แบบเริ่มจากภาพนิ่งเหมาะกับงานเชิงพาณิชย์ ทุกสิ่งที่เห็นในภาพ — ฉลากขวด ทรงรองเท้า ทรงเสื้อ — อยู่ครบ เพราะไม่ได้ให้โมเดลวิดีโอจินตนาการเอง โมเดลมีหน้าที่เดียว: ขยับสิ่งต่าง ๆ
GPT Image 2.5 เหมาะกับงานนี้เพราะพัฒนาขึ้น ภาพอ้างอิงยังดูออกในแต่ละรุ่น แก้ไขเปลี่ยนเฉพาะจุดที่สั่ง รอบรีวิวดึงไปจุดที่ต้องการ แสงและพื้นผิวดูเหมือนวัสดุจริง ไม่ใช่แค่พื้นผิว ลดความผิดเพี้ยนที่เคยทำให้วิดีโอ AI ดูแปลก OpenAI ลดเวลาสร้างภาพลงสูงสุด 50% เมื่อเทียบกับ Images 2.0 และรุ่น Flare เร็วกว่า GPT Image 2 ประมาณ 2 ถึง 4 เท่าในผลทดสอบของ OpenAI
เวิร์กโฟลว์นี้ขยับจากแค่เก็บพรอมต์ไปสู่การผลิตจริง เห็นได้ในทีมที่มีภาพอนุมัติอยู่แล้ว: หน้าสินค้าที่ต้องการเวอร์ชันเคลื่อนไหวสำหรับโซเชียล ภาพหลักแคมเปญที่ต้องใช้แนวตั้งใน Reels ฟิล์มพรีเซนต์ที่ต้องมีพรีวิวช็อตแบบเคลื่อนไหว ภาพนิ่งคือสินทรัพย์ วิดีโอคือรูปแบบส่งมอบ

ภาพนิ่งที่ใช้เริ่มตัวอย่างในคู่มือนี้ สร้างด้วย GPT Image 2.5 บน Felo ไม่มีกราฟิกซ้อนทับ
กระบวนการโดยสังเขป
- สร้างเฟรม สร้างภาพเปิดในอัตราส่วนที่ต้องการเผยแพร่ ขั้นตอนนี้ GPT Image 2.5 แสดงศักยภาพ
- ส่งต่อให้ Image to Video AI อัปโหลดภาพนิ่ง ระบุสิ่งที่ควบคุม และอธิบายช็อต
- เลือกความยาวและคุณภาพ ระยะเวลาและความละเอียดกำหนดราคา ทั้งสองอย่างแสดงก่อนกดสร้าง
- เปลี่ยนทีละตัวแปรต่อรอบ ขอบเขตการเคลื่อนไหว ความเร็วกล้อง หรือท่าจบทีละอย่าง
ส่วนที่เหลือของคู่มือนี้จะอธิบายแต่ละขั้นตอน
ขั้นตอนที่ 1: สร้างเฟรมแรกด้วย GPT Image 2.5
เฟรมที่นำไปสร้างภาพเคลื่อนไหวกำหนดผลลัพธ์เกือบทั้งหมด ให้ความสำคัญกับการสร้างเฟรมนี้
เฟรมแรกควรมี:
- ตัวแบบชัดเจน คน สินค้า หรือสถานที่ควรดูออกทันที โมเดลวิดีโอจะรักษาสิ่งที่อ่านได้
- พื้นที่สำหรับเคลื่อนไหว ถ้าตัวแบบเต็มเฟรมและไม่มีอะไรอื่น ไอน้ำไม่มีที่ลอย กล้องไม่มีที่เคลื่อนที่ ควรเหลือพื้นผิว ท้องฟ้า หรือฉากหลังให้เกิดแอ็กชัน
- อัตราส่วนภาพที่เหมาะสม ภาพนิ่งที่แนบมาจะถูกใช้: การสร้างวิดีโอจากภาพจะคงเฟรมภาพเดิม ต้องการแนวตั้งสำหรับ Reel หรือ TikTok ให้สร้างแนวตั้ง ต้องการ YouTube หรือฮีโร่เว็บ ให้สร้างแนวกว้างก่อนสร้างวิดีโอ
- ข้อความสั้น อ่านง่าย GPT Image 2.5 สร้างพาดหัวและฉลากสั้น ๆ ได้แม่นยำ ให้ข้อความบนจอไม่เกินสองสามคำ เพราะข้อความในเฟรมจะเบลอเมื่อเคลื่อนไหว
ถ้าต้องการเทคนิคการเขียนพรอมต์สำหรับภาพนิ่งที่แข็งแรง คู่มือพรอมต์ GPT Image 2.5 มีโครงสร้าง 7 ส่วนและพรอมต์สำเร็จ 12 แบบ Felo workspace ให้ใช้โมเดลฟรีในเบราว์เซอร์ ไม่ต้องใช้ API key ไม่มีลายน้ำ ส่งออกได้ถึง 4K พร้อมสิทธิ์เชิงพาณิชย์
แนวคิดสำคัญ: หน้าเครื่องมืออธิบายไว้ดี — ให้มองภาพต้นฉบับเป็นเฟรมแรก ไม่ใช่กระดานอารมณ์ กระดานอารมณ์ทำให้โมเดลเดา เฟรมแรกบอกจุดเริ่มต้นของช็อต
ขั้นตอนที่ 2: กำหนดหน้าที่ของเฟรมใน Image to Video AI
เปิด Image to Video AI แล้วเริ่มด้วยภาพนิ่ง เครื่องมือนี้ใช้ได้กับผู้ใช้ Pro และคิดเครดิตตามความยาวและคุณภาพของคลิปที่สร้าง
ภาพเดียวครอบคลุมกรณีทั่วไป: กำหนดตัวแบบ องค์ประกอบ และเฟรมเปิด พรอมต์กำหนดสิ่งที่จะเคลื่อนไหวและวิธีที่กล้องติดตาม
เครื่องมือนี้ยังรองรับกรณีที่ต้องการความแม่นยำของต้นฉบับ:
- เฟรมแรกและสุดท้าย อัปโหลดภาพเปิดและภาพจบ แล้วอธิบายการเปลี่ยนผ่าน จุดนี้ GPT Image 2.5 แสดงศักยภาพ ส่วนถัดไปจะอธิบายละเอียด
- อ้างอิงหลายภาพ ใส่ได้สูงสุด 9 ภาพ กำหนดตัวละคร รายละเอียดสินค้า เสื้อผ้า ฉาก สไตล์ หรือเฟรมจบ ระบุสิ่งที่แต่ละภาพควบคุม
- ภาพ วิดีโอ และเสียงร่วมกัน วิดีโออ้างอิงให้การเคลื่อนไหวหรือมุมกล้อง เสียงให้เสียงพูด เอฟเฟกต์ หรือจังหวะ คำขอหนึ่งครั้งแนบไฟล์อ้างอิงได้สูงสุด 12 ไฟล์
นิสัยการติดป้ายสำคัญกว่าการตั้งค่าใด ๆ คำอธิบายสั้น ๆ ที่ระบุหน้าที่ของแต่ละไฟล์ — "Image 1 คือเฟรมเปิด Image 2 คือเฟรมจบ Image 3 กำหนดเสื้อผ้าตัวละคร" — โมเดลเข้าใจง่าย และแก้ไขง่ายเมื่อเทคไม่ตรง
ขั้นตอนที่ 3: เขียนพรอมต์การเคลื่อนไหวแบบช็อต
หน้าเครื่องมือแบ่งพรอมต์สองแบบ แบบหนึ่งขอแอ็กชัน อีกแบบอธิบายช็อต
กว้างเกินไป: ให้ไอน้ำกาแฟเคลื่อนไหว
ช็อตกำกับ: ไอน้ำลอยจากปากกาแฟดำด้านบนเคาน์เตอร์วอลนัทเข้มยามเช้า ก่อตัวเป็นเกลียวช้า ๆ รับแสงหน้าต่าง กล้องเคลื่อนจากมุมกว้างเข้าใกล้ แล้วหยุด แสงเปลี่ยนจากเทา-ฟ้าเย็นเป็นเหลืองอำพันเมื่อช็อตดำเนินไป แก้วสองใบเต็มด้วยกาแฟดำ ช็อตเดียวต่อเนื่อง จังหวะสงบ จบด้วยเฟรมฮีโร่นิ่ง
เวอร์ชันที่สองตอบห้าคำถามที่เวอร์ชันแรกไม่ตอบ: ตัวแบบทำอะไร กล้องไปไหน สิ่งแวดล้อมเปลี่ยนอย่างไร ช็อตดำเนินเร็วแค่ไหน และจบตรงไหน
สองกฎลดค่าใช้จ่ายการแก้ไข:
- ใช้พรอมต์กำกับการเปลี่ยน ใช้ภาพยึดตัวตน ภาพนิ่งกำหนดใครและอะไรอยู่บนจอ พรอมต์กำหนดสิ่งที่จะเกิดขึ้นต่อ
- สั้นดีกว่าครอบคลุม พรอมต์ที่มีการเคลื่อนไหวชัดเจนหนึ่งอย่าง ตัดสินง่าย แก้ง่ายกว่ารายการแอ็กชันหลายอย่าง
ขั้นตอนที่ 4: เลือกความยาว คุณภาพ และสิ่งที่จะเปลี่ยนต่อไป
คลิปยาว 4 ถึง 15 วินาที ความยาวที่เลือกกำหนดค่าใช้จ่าย มีสองระดับคุณภาพ:
- 768P ที่ 86 เครดิตต่อวินาที ประมาณ 0.09 ดอลลาร์สหรัฐต่อวินาที เหมาะกับโซเชียลและเวอร์ชันร่าง
- 2K ที่ 138 เครดิตต่อวินาที ประมาณ 0.14 ดอลลาร์สหรัฐต่อวินาที เหมาะกับช็อตฮีโร่ หน้าสินค้า หรือชิ้นงานที่ลูกค้าขยายดู
การสร้างใช้เวลาหลายนาที คำขอแต่ละครั้งได้วิดีโอหนึ่งคลิป จังหวะนี้เปลี่ยนวิธีวนซ้ำ แทนที่จะสุ่มพรอมต์เดิม ให้ดูเทคแล้วเปลี่ยนทีละอย่าง: ขอบเขตการเคลื่อนไหว ความเร็วกล้อง หรือท่าจบ ทีละตัวแปรจะรู้ว่าอะไรทำให้ผลต่าง
ขั้นสูง: ให้ GPT Image 2.5 กำกับตอนจบ
เวิร์กโฟลว์เฟรมแรกสร้างภาพเคลื่อนไหวของช่วงเวลา เวิร์กโฟลว์เฟรมแรกและสุดท้ายสร้างการเปลี่ยนผ่าน — เปิดกล่อง ประกอบสินค้า เปลี่ยนฉากกลางวันเป็นกลางคืน — และเหมาะที่สุดกับการสร้างทั้งสองเฟรมด้วย GPT Image 2.5
วิธีทำ: สร้างเฟรมเปิด จากนั้นสร้างเฟรมจบโดยใช้อ้างอิงจากเฟรมเปิด: เครื่องกาแฟเดิม เคาน์เตอร์เดิม มุมกล้องเดิม ไอน้ำลอยเป็นเกลียว แสงเปลี่ยนเป็นอุ่น เพราะโมเดลรักษาตัวแบบข้ามรุ่น สองเฟรมนี้ต่อเนื่องเหมือนช่วงเวลาเดียว ไม่ใช่สองภาพคนละแบบ

เฟรมจบ สร้างโดยใช้อ้างอิงจากเฟรมเปิด อัปโหลดทั้งสองใน Image to Video AI แล้วอธิบายการเปลี่ยนผ่าน
จากนั้นอธิบายการเดินทาง ไม่ใช่จุดหมาย: อะไรเปลี่ยนแปลง เร็วแค่ไหน กล้องทำอะไรระหว่างนั้น หน้าเครื่องมือแนะนำการเปิดตัวสินค้า การเปลี่ยนแปลง และการเปลี่ยนฉาก — ช็อตที่เคยต้องทีมงาน รางกล้อง และเวลาทั้งบ่าย
ขั้นสูง: สตอรี่บอร์ดสู่ซีเควนซ์
คลิปเดียวคือช็อต ซีเควนซ์คือเรื่องราว เวิร์กโฟลว์สตอรี่บอร์ดของ GPT Image 2.5 เติมช่องว่างนี้โดยไม่ต้องใช้แท็บเล็ตวาด

สตอรี่บอร์ดหกช่อง สร้างด้วย GPT Image 2.5 บน Felo แต่ละช่องคือหนึ่งช็อต: สร้างแต่ละช่อง สร้างภาพเคลื่อนไหวทีละช่อง แล้วตัดต่อคลิปเข้าด้วยกัน
ให้โมเดลฉากและอ้างอิงตัวละคร โมเดลจะคืนกริดช่องพร้อมมุมกล้องและอารมณ์ — สตอรี่บอร์ดแบบภาพยนตร์ กริด 3x3 และชีทตัวละครเป็นเวิร์กโฟลว์ใน workspace แต่ละช่องกลับมาสอดคล้อง เพราะโมเดลรักษาสไตล์และตัวแบบข้ามรุ่น
จากนั้นกระบวนการเป็นกลไก สร้างภาพเคลื่อนไหวช่องหนึ่ง ช่องสอง ช่องสาม ให้แต่ละคลิปเป็นช่วงเวลาต่อเนื่อง ตัดต่อรวมกัน ได้ซีเควนซ์ที่ทุกเฟรมผ่านการอนุมัติก่อนเคลื่อนไหว
ค่าใช้จ่าย
สร้างภาพใน GPT Image 2.5 workspace ฟรี — มีเครดิตรายวัน ไม่ต้องใช้บัตร ไม่มีลายน้ำ พร้อมสิทธิ์เชิงพาณิชย์ สร้างวิดีโอเป็นฟีเจอร์ Pro แต่ละคลิปใช้เครดิตตามวินาที:
| ความยาววิดีโอ | 2K | 768P |
|---|---|---|
| 5 วินาที | 690 เครดิต · ประมาณ 0.69 ดอลลาร์สหรัฐ | 430 เครดิต · ประมาณ 0.43 ดอลลาร์สหรัฐ |
| 10 วินาที | 1,380 เครดิต · ประมาณ 1.38 ดอลลาร์สหรัฐ | 860 เครดิต · ประมาณ 0.86 ดอลลาร์สหรัฐ |
| 15 วินาที | 2,070 เครดิต · ประมาณ 2.07 ดอลลาร์สหรัฐ | 1,290 เครดิต · ประมาณ 1.29 ดอลลาร์สหรัฐ |
เรทการ์ดใช้ประมาณ 1,000 เครดิตเท่ากับ 1 ดอลลาร์สหรัฐ และอัตรานี้เป็นโปรโมชันชั่วคราว หน้า workspace แสดงราคาประเมินก่อนกดสร้าง
เปรียบเทียบกับวิธีดั้งเดิม ช็อตสินค้าสิบวินาทีที่ต้องใช้ทีมงาน สถานที่ และตัดต่อ มีค่าใช้จ่ายมากกว่าค่าโปรแกรมทั้งเดือนของหลายทีม — และใช้เวลาหนึ่งสัปดาห์ ไม่ใช่แค่บ่ายเดียว คลิป 768P สิบวินาทีที่นี่ใช้ประมาณ 0.86 ดอลลาร์สหรัฐ
ภาพนิ่งที่อนุมัติแก้ง่ายกว่าวิดีโอผิดหนึ่งคลิป นี่คือเหตุผลหลักที่ควรสร้างเฟรมก่อน
คำถามที่พบบ่อย
GPT Image 2.5 ใช้ฟรีหรือไม่?
ใช่ โมเดลนี้ใช้ฟรีบน Felo มีเครดิตรายวัน ไม่ต้องใช้บัตร สร้างวิดีโอใช้ได้กับผู้ใช้ Pro และคิดเครดิตตามความยาวและคุณภาพคลิป
ภาพต้นฉบับควรใช้อัตราส่วนเท่าไร?
เฟรมของภาพนิ่งเป็นตัวกำหนด การสร้างวิดีโอจากภาพจะคงองค์ประกอบเดิม สร้างแนวตั้งสำหรับ Reels, Shorts, TikTok และแนวกว้างสำหรับ YouTube โฆษณา และฮีโร่เว็บ
คลิปหนึ่งใช้เวลานานแค่ไหน?
หลายนาที คำขอหนึ่งครั้งได้วิดีโอหนึ่งคลิป ผลลัพธ์จะปรากฏใน workspace เมื่อพร้อม
สามารถใช้ตัวละครหรือสินค้าชุดเดิมในหลายคลิปได้หรือไม่?
ได้ แนบภาพอ้างอิงได้สูงสุด 9 ภาพ และระบุสิ่งที่แต่ละภาพควบคุม จุดแข็งของ GPT Image 2.5 คือความแม่นยำของอ้างอิง: สร้างตัวละครครั้งเดียว แล้วใช้ตัวตนนั้นในทุกช็อต
เริ่มต้นด้วยภาพนิ่ง
โมเดลวิดีโอขยับได้เฉพาะสิ่งที่เฟรมให้มา ดังนั้นให้ความสำคัญกับเฟรม: ตัวแบบชัด พื้นที่เคลื่อนไหว อัตราส่วนเหมาะกับช่องทาง ข้อความสั้นพอรอดจากการเคลื่อนไหว
สร้างเฟรมแรก ฟรีบน Felo — แล้วนำไปที่ Image to Video AI เพื่อกำกับห้าวินาทีถัดไป
บทความนี้มีให้อ่านในภาษาต่อไปนี้ด้วย: English, 简体中文, 日本語, 한국어, 繁體中文, हिन्दी, Français, العربية, Русский, اردو, Bahasa Indonesia, Deutsch, Tiếng Việt, Türkçe, Italiano, Español, বাংলা and Português