Skip to main content

คู่มือการเขียนพรอมต์ GPT Image 2.5: วิธีเขียนพรอมต์ที่ใช้งานได้จริง

· อ่าน 23 นาที
Felo Search Tips Buddy
Committed to answers at your fingertips

คู่มือการเขียนพรอมต์ GPT Image 2.5 แบบใช้งานจริง: โครงพรอมต์เจ็ดส่วน, 12 พรอมต์พร้อมใช้งาน, กฎการแก้ไข และการตั้งค่าที่สำคัญ ทดลองฟรีบน Felo

GPT Image 2.5 ตัดข้ออ้างออกไปเกือบหมด

โมเดลนี้ทำตามคำสั่งได้ใกล้เคียงกว่าเดิม ใบหน้า ผลิตภัณฑ์ หรือคาแรกเตอร์ยังคงจำได้เมื่อแก้ไข ภาพที่มีข้อความสั้นอ่านได้จริง และสร้างภาพเร็วขึ้นถึง 50% เมื่อเทียบกับ GPT Image 2 คุณจึงทดลองได้หลายแนวทางในเวลาเดียวกัน

ดังนั้นเมื่อภาพที่สร้างออกมายังผิด โมเดลมักไม่ใช่ปัญหา แต่เป็นพรอมต์

คู่มือการสร้างคำสั่งภาพของ OpenAI สรุปไว้ในประโยคเดียว: เริ่มต้นด้วยภาพที่คุณต้องการ จากนั้นอธิบายถึงหัวข้อ องค์ประกอบ สไตล์ และข้อจำกัดต่าง ๆ ฟังดูอ่านง่ายแต่กลับทำได้ยากอย่างน่าประหลาด และรายละเอียดในระดับคำสั่งนี่แหละคือส่วนสำคัญที่ควรเก็บไว้

ดังนั้นนี่คือเวอร์ชันที่ใช้งานได้จริง: อธิบายหน้าที่ของแต่ละส่วนในคำสั่ง ตัวอย่างคำสั่งทั้งสิบสองแบบที่คุณสามารถนำไปใช้ได้ทันที และกฎเกณฑ์ที่ช่วยแยกภาพที่ใช้งานได้จริงออกจากภาพที่ได้มาโดยบังเอิญ

ถ้าต้องการทดลองพรอมต์เหล่านี้ขณะอ่าน พื้นที่ทำงาน GPT-Image 2.5 ของ Felo ใช้งานฟรีผ่านเบราว์เซอร์ ไม่ต้องใช้ API key

หน้าปก: การ์ดพรอมต์วางข้างภาพที่สร้างด้วย GPT-Image 2.5 บน Felo

ทุกภาพในคู่มือนี้สร้างด้วย GPT-Image 2.5 บน Felo รวมถึงหน้าปก ไม่มีการตกแต่งเพิ่มเติม

สิ่งที่เปลี่ยนไปใน GPT Image 2.5

มีการอัปเกรดสี่อย่างที่สำคัญสำหรับการเขียนพรอมต์ เพราะแต่ละอย่างเปลี่ยนสิ่งที่คุณขอได้

  • แสงและพื้นผิวธรรมชาติ ผิวหนัง ผ้า โลหะ และแก้วดูเหมือนวัสดุจริง อธิบายได้ตรงและได้ผลลัพธ์ตามนั้น
  • ความแม่นยำของอ้างอิง อัปโหลดภาพถ่ายแล้วลักษณะเฉพาะของหัวข้อยังคงอยู่เมื่อเปลี่ยนฉาก สไตล์ หรือองค์ประกอบ ทำให้สร้างซีรีส์คาแรกเตอร์หรือผลิตภัณฑ์ได้
  • การแก้ไขหลายรอบที่เสถียร เมื่อเปลี่ยนหลายรอบ ส่วนที่ไม่ได้พูดถึงยังคงอยู่เหมือนเดิม การแก้ไขก่อนหน้าหยุดหลุดลอย
  • ข้อความอ่านได้ ข้อความสั้น — หัวข้อ ฉลาก บรรจุภัณฑ์ UI — แสดงผลได้แม่นยำขึ้น โดยเฉพาะเมื่อใส่เครื่องหมายอ้างอิงและระบุตำแหน่ง

เบื้องหลัง API มีสองโมเดล เลือกตามความเร็วหรือความแม่นยำ:

ModelBuilt forTrade-off
GPT-Image-2.5 Flareสร้างภาพทั่วไป เนื้อหาสังคม ผลิตภัณฑ์ ทดลองรวดเร็ว ปริมาณมากคุณภาพใกล้เคียง GPT Image 2 แต่เร็วขึ้นถึง 50%
GPT-Image-2.5 Sunburstงานสร้างสรรค์จริง แก้ไขแม่นยำ รายละเอียดแน่น งานลูกค้าคุณภาพสูงกว่า GPT Image 2 แต่ช้ากว่าต่อภาพ

ทั้งสองคิดราคาเท่ากันต่อโทเคน ถ้าไม่แน่ใจว่าต้องใช้แบบไหน ให้สร้างพรอมต์เดียวกันบนทั้งสองแล้วเปรียบเทียบสิ่งที่สำคัญ — มักเป็นความแม่นยำของข้อความหรือความคงที่ของใบหน้า ไม่ใช่ความสวยโดยรวม รายละเอียดเปิดตัวอยู่ใน GPT-Image 2.5 บน Felo

โครงพรอมต์ GPT Image 2.5 เจ็ดส่วน

พรอมต์ส่วนใหญ่ล้มเหลวเพราะอธิบายแค่หัวข้อแล้วลืมส่วนอื่น โมเดลจึงเลือกให้เอง และผลลัพธ์มักไม่ตรงใจ

เติมทั้งเจ็ดส่วนนี้ ผลลัพธ์จะไม่สุ่มอีกต่อไป:

  1. งาน — ภาพนี้ใช้ทำอะไร ภาพสินค้า โปสเตอร์งาน แผ่นคาแรกเตอร์ สไลด์ บรรทัดเดียวนี้เปลี่ยนองค์ประกอบ
  2. หัวข้อ — ใครหรืออะไรอยู่ในภาพ อธิบายรายละเอียดที่ระบุได้: อายุ วัสดุ สี รอยใช้งาน ผิวสัมผัส
  3. การกระทำและปฏิสัมพันธ์ — กำลังเกิดอะไรขึ้น มืออยู่ไหน สายตาไปทางไหน ถือวัตถุอย่างไร
  4. องค์ประกอบ — การจัดเฟรม มุมกล้อง พื้นที่ที่หัวข้อใช้ และพื้นที่ว่างสำหรับข้อความ
  5. แสง วัสดุ และพื้นผิว — คำอธิบายทางกายภาพ แสงนุ่มจากหน้าต่าง อะลูมิเนียมขัด กระดาษหยาบ ถนนเปียก
  6. สไตล์และสื่อ — เหมือนภาพถ่ายจริง ภาพถ่ายนิตยสาร ภาพเวกเตอร์เรียบ สีน้ำ เรนเดอร์ 3D ขอ "เหมือนภาพถ่ายจริง" หรือ "ภาพถ่ายจริง" เมื่อเป็นเป้าหมาย
  7. ข้อความและข้อจำกัด — ข้อความที่แน่นอนในเครื่องหมายอ้างอิง ตำแหน่ง จำนวนครั้ง และสิ่งที่ต้องไม่มี: ข้อความเพิ่มเติม โลโก้ ลายน้ำ รีทัชหนัก

ถ้าภาพซับซ้อนกว่าหัวข้อเดียว ให้จัดกลุ่มเป็นส่วนที่มีชื่อ คู่มือของ OpenAI แนะนำโครงสร้าง scene / subject / details / constraints และเป็นรูปแบบที่แก้ไขได้หลายรอบ:

Scene: ฉาก เวลา สภาพแวดล้อม
Subject: หัวข้อของภาพ
Details: องค์ประกอบ แสง วัสดุ สไตล์ ข้อความที่แน่นอน
Constraints: สิ่งที่ต้องไม่เปลี่ยนหรือไม่ปรากฏ

พรอมต์อ่อน vs. พรอมต์ใช้งานได้

แนวคิดเดียวกันในสองระดับรายละเอียด

อ่อน:

ถุงกาแฟพรีเมี่ยมบนโต๊ะ แสงสวย

คุณจะได้ ถุงกาแฟ แต่ไม่ใช่ ถุงกาแฟของคุณ มุมที่ต้องการ พร้อมฉลากที่อ่านได้

ใช้งานได้:

ภาพถ่ายสินค้าถุงกาแฟกระดาษคราฟท์ด้าน 250 กรัม ตั้งตรงบนโต๊ะไม้สีวอลนัทเข้ม
ฉลากด้านหน้าหันตรงกล้องและอ่านได้เต็มที่
ข้อความฉลาก (แน่นอน): "MORNING BLEND" เป็นหัวข้อ "Dark Roast · 250 g" ด้านล่าง
องค์ประกอบ: ตรงกลาง สูงสามในสี่ มีพื้นที่ว่างด้านบนสำหรับหัวข้อ
แสง: แสงนุ่มจากหน้าต่างซ้าย เงาสัมผัสอ่อนใต้ถุง สมดุลสีอบอุ่น
สไตล์: ภาพถ่ายสินค้า e-commerce พรีเมี่ยม ชัดลึกตื้น เกรนฟิล์มละเอียด
ข้อจำกัด: ไม่มีข้อความเพิ่มเติม ไม่มีโลโก้ ไม่มีลายน้ำ ไม่มีมือ ไม่มีพร็อพเกะกะ

ใช้โมเดลเดียวกัน ตั้งค่าเดียวกัน ได้สินทรัพย์ต่างกันโดยสิ้นเชิง

การตั้งค่าที่ไม่ควรใส่ในพรอมต์

ถ้าสร้างผ่าน OpenAI API ขนาด คุณภาพ และพื้นหลังเป็นพารามิเตอร์ ไม่ใช่ประโยค บอกโมเดลว่า "ทำเป็น 4K" ในพรอมต์คือข้อเสนอ ตั้งค่า size คือการรับประกัน

Parameterตั้งเป็นอะไรใช้เมื่อไหร่
modelgpt-image-2.5-flare หรือ gpt-image-2.5-sunburstความเร็วหรือความแม่นยำ ตามงาน
qualitylow, medium, high, xhigh, maxข้อความเล็ก แผนภาพแน่น ส่งงานสุดท้าย
size1024x1024, 1536x1024, 1024x1536, 2048x2048, 2048x1152, 3840x2160, 2160x3840, หรือ WIDTHxHEIGHT ที่กำหนดเองงานพิมพ์ สไลด์ ฟอร์แมตโซเชียลแนวตั้ง
backgroundauto, opaque, หรือ transparentตัดภาพ สติ๊กเกอร์ โลโก้ งานประกอบ

ขนาดกำหนดเองมีข้อกำหนด: แต่ละด้านต้องเป็นจำนวนคูณของ 16 ไม่มีด้านไหนเกิน 3,840 px อัตราส่วนยาวต่อสั้นไม่เกิน 3:1 และจำนวนพิกเซลรวมต้องอยู่ระหว่าง 655,360 ถึง 8,294,400 ผลลัพธ์เกิน 3,686,400 พิกเซล — เกิน 2560×1440 — ถือเป็นทดลอง ตรวจสอบก่อนใช้งาน

สองนิสัยที่ทำให้การตั้งค่าคุณภาพคุ้มค่า:

  • ร่างต่ำ เสร็จสูง ทดลององค์ประกอบที่ low หรือ medium แล้วรันพรอมต์ที่ชนะที่ high หรือสูงกว่า ระดับคุณภาพเปลี่ยนโทเคนออก และระดับสูงสุดแพงกว่าระดับต่ำสุดประมาณ 36 เท่า
  • ไต่ระดับเพื่อแก้ปัญหา ขยับขึ้นเมื่อข้อความเล็กเบลอหรือป้ายแผนภาพพัง ไม่ใช่เพราะคิดว่าระดับสูงปลอดภัย ระดับสูงไม่รับประกันภาพดีขึ้นทุกพรอมต์

บน Felo ข้ามขั้นตอนนี้ เลือก GPT-Image 2.5 เลือกฟอร์แมตและความละเอียด แล้วสร้างภาพ พื้นที่ทำงานจัดการพารามิเตอร์ให้ พรอมต์คือสิ่งเดียวที่ต้องทำให้ถูก

12 พรอมต์พร้อมใช้งาน

เหล่านี้คือจุดเริ่มต้นที่ใช้งานได้ ไม่ใช่สูตรตายตัว เปลี่ยนหัวข้อแต่คงโครงสร้าง

1. ภาพถ่ายบุคคลเหมือนจริง ไม่ดูสังเคราะห์

สร้างภาพถ่ายบุคคลเหมือนจริงของช่างซ่อมจักรยานหญิงวัยปลาย 40
เช็ดมือด้วยผ้าในร้านซ่อมแคบ
พื้นผิวผิวหนัง: รูขุมขน กระ ฝ้าเล็กบนแขน หมึกจางบนข้อนิ้ว
ผ้ากันเปื้อนยีนส์ขอบนุ่ม
ถ่ายเหมือนฟิล์ม 35 มม. ระยะกลาง ระดับสายตา เลนส์ 50 มม.
แสง: แสงกลางวันผ่านประตูโรงรถเปิด ตกแสงนุ่ม ไม่มีไฮไลท์แรง
สี: ธรรมชาติและหม่น เกรนละเอียด
บรรยากาศ: ไม่จัดท่า วัสดุจริง ของใช้ประจำวัน
ข้อจำกัด: ไม่แต่งสวย ไม่รีทัชหนัก ไม่ใช้แสงสตูดิโอ ไม่มีข้อความ

เหตุผลที่ใช้ได้: ระบุงาน (ภาพถ่ายบุคคล) แสง และอ้างอิงฟิล์ม พร้อมปฏิเสธการรีทัชที่โมเดลมักเติม

2. ภาพสินค้าสำหรับ e-commerce พร้อมฉลากอ่านได้

ภาพถ่ายสินค้าขวดเซรั่มแก้วฝ้า 50 ml ฝาทองขัดวางบนแท่นหินสีอ่อน ฉากหลังเบจนุ่ม
ข้อความฉลาก (แน่นอน): "LUMEN" เป็นแบรนด์ "Hydrating Serum · 50 ml" ด้านล่าง
แสดงข้อความฉลากครั้งเดียว ตรงกล้อง ชัดและอ่านได้เต็มที่
องค์ประกอบ: ตรงกลาง ขวดเต็มเฟรม มีพื้นที่ว่างด้านขวา
แสง: ซอฟต์บ็อกซ์ใหญ่จากขวาบน ไล่แสงนุ่ม เงาสัมผัสสะอาด
สไตล์: ภาพถ่ายสินค้า beauty e-commerce พรีเมี่ยม รายละเอียดคม ไม่มีพร็อพ
ข้อจำกัด: ไม่มีข้อความเพิ่มเติม ไม่มีโลโก้ ไม่มีลายน้ำ ไม่มีเงาสตูดิโอ

เหตุผลที่ใช้ได้: ข้อความสั้น อ้างอิงตรง ตำแหน่งและจำนวน — สามสิ่งที่ทำให้ข้อความในภาพอยู่ครบ

3. โปสเตอร์พร้อมหัวข้ออ่านได้

ออกแบบโปสเตอร์งานดนตรีอิเล็กทรอนิกส์แบบโดดเด่น
หัวข้อ (แน่นอน, ครั้งเดียว): "CITY LIGHTS FESTIVAL"
ซับไลน์ (แน่นอน, ครั้งเดียว): "SAT 14 NOV · DOCK 9 · 22:00"
ภาพ: สกายไลน์กลางคืนดูโทนสีครามเข้มและเหลืองอำพันอุ่น พื้นผิวเกรน องค์ประกอบแนวทแยงแรง หัวข้ออยู่ในส่วนบนสงบ
ตัวอักษร: sans-serif หนาแน่น คอนทราสต์สูงกับพื้นหลัง เคอร์นิ่งกว้าง
ฟอร์แมต: โปสเตอร์แนวตั้ง คุณภาพพิมพ์
ข้อจำกัด: ไม่มีข้อความเพิ่มเติม ไม่มีโลโก้สปอนเซอร์ ไม่มีลายน้ำ ไม่มีคนภาพสต็อก

เหตุผลที่ใช้ได้: แยกงานศิลป์ออกจากบรีฟตัวอักษร ระบุข้อความทั้งสอง และข้อความสั้นพอสำหรับโปสเตอร์

4. แผ่นอ้างอิงคาแรกเตอร์สำหรับซีรีส์

สร้างแผ่นอ้างอิงคาแรกเตอร์ต้นฉบับ
คาแรกเตอร์: เจ้าหน้าที่ป่าไม้หนุ่ม ผมสั้นเข้ม กระบนจมูก แจ็คเก็ตผ้าใบสีเขียวมอส ผ้าพันคอสีส้มไหม้ รองเท้าหนังขูด
เนื้อหาแผ่น: สามมุม — ด้านหน้า สามส่วนสี่ และด้านข้าง — พร้อมภาพใกล้ปมผ้าพันคอ
สไตล์: ภาพประกอบ concept-art เรียบ เงา cel นุ่ม น้ำหนักเส้นคงที่ พื้นหลังเทาอ่อน
เลย์เอาต์: ฟิกเกอร์จัดระยะเท่ากัน สัดส่วนเท่ากันทุกมุม ไม่มีแขนขาทับกัน
ข้อจำกัด: ออกแบบต้นฉบับ ไม่มีคาแรกเตอร์ลิขสิทธิ์ ไม่มีข้อความ ไม่มีลายน้ำ

เหตุผลที่ใช้ได้: แผ่นอ้างอิงคือฟอร์แมต ไม่ใช่ภาพ ระบุมุมและรายละเอียดคงที่ทำให้ใช้ซ้ำได้ในฉากต่อไป

5. การ์ตูนสี่ช่องคาแรกเตอร์คงที่

สร้างการ์ตูนสี่ช่องแนวนอน คาแรกเตอร์เดียวกันทุกช่อง
ความคงที่ของคาแรกเตอร์: ใบหน้าเหมือนกัน แจ็คเก็ตแดงสั้น ทรงผมบ็อบดำ สัดส่วนและน้ำหนักเส้นเหมือนกันทุกช่อง
ช่อง 1: เธอเปิดประตูหน้าหันกลับไปในอพาร์ตเมนต์
ช่อง 2: ประตูปิด แมวอยู่คนเดียวหันช้า ๆ ไปทางห้องว่าง
ช่อง 3: แมวนอนบนโซฟาในแสงบ่าย
ช่อง 4: ประตูเปิดอีกครั้ง แมวนั่งเรียบร้อยตรงทางเข้า
สไตล์: ภาพประกอบการ์ตูนเรียบ พาเลตต์จำกัด เส้นดำบาง
ข้อจำกัด: ไม่มีฟองคำ ไม่มีข้อความ ไม่มีลายน้ำ ไม่มีสไตล์เปลี่ยนระหว่างช่อง

เหตุผลที่ใช้ได้: ระบุช่องชัดเจน และย้ำความคงที่แทนที่จะสมมติ

6. อินโฟกราฟิกอธิบายกระบวนการ

สร้างอินโฟกราฟิกเรียบชื่อ "How a Heat Pump Heats a House" สำหรับผู้ชมทั่วไป
แสดงสี่ขั้นตอนเชื่อมด้วยลูกศร: หน่วยนอกบ้านดูดความร้อนจากอากาศ → สารทำความเย็นถูกอัด → ปล่อยความร้อนในบ้าน → สารทำความเย็นขยายและวนกลับ
ติดป้ายแต่ละขั้นด้วยคำบรรยายสั้น และป้ายส่วนสำคัญ: หน่วยนอกบ้าน คอมเพรสเซอร์ วาล์วขยาย คอยล์ในบ้าน
สไตล์: ภาพเวกเตอร์เรียบ พาเลตต์น้ำเงินหม่นและส้มอุ่น พื้นหลังขาว ไอคอนสไตล์เดียวกัน พื้นที่ขาวกว้าง ป้ายอ่านง่าย
ข้อจำกัด: ไม่มีข้อความเล็ก ไม่มีของตกแต่ง ไม่มีลายน้ำ

เหตุผลที่ใช้ได้: มองภาพเป็นบรีฟออกแบบสื่อ — ผู้ชม ขั้นตอน ป้าย ระบบภาพ — ไม่ใช่แค่คำขอภาพประกอบ

7. สไลด์ pitch-deck พร้อมตัวเลขจริง

สร้างสไลด์ pitch-deck ชื่อ "Market Opportunity" สไตล์ Series A deck เรียบ
เลย์เอาต์: หัวข้อซ้ายบน แผนภาพวงกลม TAM/SAM/SOM สีฟ้าและเทาหม่น แผนภูมิแท่งด้านล่างแสดงการเติบโต 2021-2026 และฟุตเตอร์เงียบ
ใช้ตัวเลขนี้เท่านั้น: TAM $42B, SAM $8.7B, SOM $340M
ฟุตโน้ต (แน่นอน): "Source: internal analysis"
สไตล์: พื้นหลังขาว ตัวอักษร sans-serif ทันสมัย ขอบกว้าง ลำดับข้อมูลคม ไม่มีเงา ไม่มีไล่สี
ข้อจำกัด: ไม่มีคลิปอาร์ต ไม่มีภาพสต็อก ไม่มีของตกแต่ง ไม่มีข้อความเพิ่มเติม

เหตุผลที่ใช้ได้: ระบุสิ่งที่ต้องส่ง (สไลด์เดียว) ผ้าใบ ลำดับ และข้อมูลจริง พร้อมระบุฟุตโน้ตเป็นข้อความ เพราะตรงนั้นโมเดลมักแต่งเอง

8. Mockup UI แอปที่ดูเหมือนใช้งานจริง

สร้าง mockup UI แอปมือถือสำหรับตลาดเกษตรกรชุมชน
หน้าจอ: หัวข้อเรียบ รายชื่อผู้ขายพร้อมภาพเล็กและป้ายหมวดหมู่ ส่วน "Today's specials" มีสองรายการ ฟุตเตอร์แสดงที่ตั้งและเวลาเปิด
สไตล์: พื้นหลังขาว สี accent ธรรมชาติอ่อน สเกลตัวอักษรชัด ตกแต่งน้อย ระยะห่างและเป้าสัมผัสสมจริง ดูเหมือนผลิตภัณฑ์ใช้งานจริง ออกแบบดี
แสดงหน้าจอในกรอบโทรศัพท์ทันสมัย ตรงกล้อง พื้นหลังอ่อนเรียบ
ข้อจำกัด: ไม่มีสไตล์ concept-art ไม่มีโลโก้แบรนด์แต่ง ไม่มีลายน้ำ

เหตุผลที่ใช้ได้: อธิบายผลิตภัณฑ์เหมือนมีอยู่แล้ว ขอความสมจริงของ UI ไม่ใช่ concept art

9. ตัดภาพสินค้าพื้นหลังโปร่งใส

ตัดสินค้าจากภาพอ้างอิงและแยกบนพื้นหลังโปร่งใสเต็มที่
ผลลัพธ์: สินค้าตรงกลาง เงารอบคม ขอบ alpha สะอาด ไม่มีเงาหรือขอบเบลอ
รักษารูปทรง สัดส่วน และความอ่านได้ของฉลากให้เหมือนเดิม
ขัดเงาเบา ๆ เท่านั้น ไม่เพิ่มพื้นหลังทึบ ตารางหมากรุก ฉาก ทิวทัศน์ พื้น หรือเงา
ไม่เปลี่ยนสไตล์สินค้า
ข้อจำกัด: ความโปร่งใสต้องเป็น alpha จริง ไม่ใช่พื้นหลังวาด

เหตุผลที่ใช้ได้: ขอหัวข้อแยก และ พื้นหลังโปร่งใส พร้อมระบุปัญหาที่มักเกิด — ตารางหมากรุกและขอบเบลอ — ก่อนเกิด

10. ย้ายสไตล์ไปหัวข้อใหม่

ใช้สไตล์ภาพอ้างอิง — พาเลตต์ พื้นผิว สื่อ — กับหัวข้อใหม่: ประภาคารบนชายฝั่งหินยามพลบค่ำ
คงช่วงสี การปัดแปรง และระดับรายละเอียดของสไตล์
เปลี่ยนแค่หัวข้อ ไม่คัดลอกองค์ประกอบหรือวัตถุต้นฉบับ
ข้อจำกัด: ไม่มีข้อความ ไม่มีลายน้ำ ไม่มีลายเซ็น ไม่มีกรอบ

เหตุผลที่ใช้ได้: ให้ภาพอ้างอิงมีบทบาทเฉพาะ — พาเลตต์ พื้นผิว สื่อ — ไม่ใช่แค่ "สไตล์เดียวกัน" ซึ่งกว้างจนโมเดลคัดลอกทั้งภาพ

11. แก้ไขเฉพาะจุดแม่นยำ

ในภาพห้องนี้ เปลี่ยนเก้าอี้รับประทานอาหารขาวเป็นเก้าอี้ไม้โอ๊คอ่อนเท่านั้น
รักษาส่วนอื่นให้เหมือนเดิม: มุมกล้อง สีผนัง ลายพรม โต๊ะ โคมไฟ แสงหน้าต่าง เงาพื้น และวัตถุรอบข้าง
ตรงกับมุมมองเดิมและแสงกลางวันนุ่ม เพิ่มเงาสัมผัสและลายไม้สมจริง
ข้อจำกัด: เปลี่ยนเฉพาะเก้าอี้ ไม่เพิ่มของตกแต่ง ไม่มีข้อความ

เหตุผลที่ใช้ได้: เปลี่ยนหนึ่งอย่าง รายการรักษายาว เมื่อผลลัพธ์ยังหลุด มักเป็นเพราะขาดรายการนั้น ไม่ใช่คำสั่งยาวขึ้น

12. แปลดีไซน์โดยไม่เปลี่ยนเลย์เอาต์

แปลข้อความในอินโฟกราฟิกจากอังกฤษเป็นสเปน
ไม่เปลี่ยนส่วนอื่นของภาพ: เลย์เอาต์ ไอคอน สี ตัวอักษร น้ำหนักเส้น ระยะห่าง สไตล์ภาพประกอบทั้งหมดคงเดิม
ขนาดตัวอักษรและจัดวางต้องตรงต้นฉบับเพื่อให้ข้อความแปลพอดีพื้นที่เดิม
ข้อจำกัด: ไม่มีคำอังกฤษหลงเหลือ ไม่มีข้อความเพิ่ม ไม่มีลายน้ำ

เหตุผลที่ใช้ได้: พรอมต์แปลมักล้มเหลวเพราะเปลี่ยนเลย์เอาต์ "แปล ไม่ออกแบบใหม่" พร้อมรายการสิ่งที่คงที่ ทำให้สินทรัพย์ใช้ซ้ำได้

ผลลัพธ์ของพรอมต์ใช้งานได้จากคู่มือนี้: ถุงกาแฟกระดาษคราฟท์ติดฉลาก MORNING BLEND พร้อมข้อความฉลากครบ

วิธีเขียนข้อความให้แสดงผลจริง

ข้อความเคยเป็นวิธีเร็วที่สุดที่ทำให้ภาพ AI ดูปลอม ตอนนี้ดีขึ้น แต่ต้องให้ข้อมูลที่ใช้งานได้

  • อ้างอิงข้อความตรง headline reads "CITY LIGHTS FESTIVAL" ดีกว่า "เพิ่มข้อความงาน"
  • ระบุจำนวนครั้งที่ปรากฏ "แสดง tagline ครั้งเดียว" ป้องกันข้อความซ้ำ
  • สะกดสิ่งผิดปกติ สำหรับชื่อแบรนด์หรือคำสะกดแปลก ให้ตัวอักษร แล้วตรวจผลลัพธ์ทีละตัว
  • ระบุสไตล์ตัวอักษร หนา แน่น sans-serif ตรงกลาง เคอร์นิ่งกว้าง คอนทราสต์สูง
  • ข้อความสั้น หัวข้อ ฉลาก ราคา ข้อความสั้น ๆ ย่อหน้าเหมาะกับเครื่องมือเลย์เอาต์
  • ปิดช่อง จบด้วย "ไม่มีข้อความเพิ่มเติม ไม่มีลายน้ำ ไม่มีโลโก้" ไม่เช่นนั้นโมเดลอาจแต่งคำบรรยายหรือป้าย
  • เพิ่มคุณภาพสำหรับข้อความเล็ก ป้ายแน่น ตำนาน แกน ฟุตโน้ต ใช้ high หรือสูงกว่า พร้อมขนาดแนวนอนให้พื้นที่

สองข้อควรตรวจสอบก่อนใช้: อ่านทุกคำในภาพ และอ่านทุกตัวเลข แผนภูมิและแผนภาพคือจุดที่ข้อผิดพลาดดูน่าเชื่อรอดการตรวจ

ภาพอ้างอิงต้องมีบทบาท ไม่ใช่แค่บรรยากาศ

เมื่ออัปโหลดหลายภาพ ให้ระบุหมายเลขและหน้าที่ "ใช้ภาพอ้างอิง" เปิดช่องให้โมเดลผสมทุกอย่าง ระบุบทบาทช่วยให้คงที่

ภาพ 1 คืออ้างอิงตัวตน — รักษาใบหน้า ลักษณะ สัดส่วน
ภาพ 2 คืออ้างอิงเสื้อผ้า — แต่งตัวตามนี้
ภาพ 3 คืออ้างอิงฉากหลัง — วางในสภาพแวดล้อมนี้
ตรงกับแสงและอุณหภูมิสีของภาพ 3 และคงท่าทางจากภาพ 1
ข้อจำกัด: ไม่เปลี่ยนใบหน้า รูปร่าง หรือทรงผม ไม่เพิ่มเครื่องประดับ ข้อความ หรือโลโก้

สองกฎทำให้เชื่อถือได้:

  1. ระบุสิ่งที่เปลี่ยนและสิ่งที่คงที่ "วางหมาจากภาพ 2 ข้างหญิงในภาพ 1 ตรงกับแสงเดิม" คือบรีฟประกอบ "รวมกัน" คือคำขอ
  2. ย้ำจุดยึดทุกครั้ง สำหรับงานซีรีส์ ย้ำรายละเอียดระบุ — สีเสื้อ ใบหน้า สัดส่วน พาเลตต์ — แม้จะดูชัดเจน โมเดลหลุดเมื่อข้อจำกัดหยุดย้ำ

สำหรับคาแรกเตอร์และผลิตภัณฑ์ที่ใช้ซ้ำ อนุมัติภาพพื้นฐานหนึ่งภาพแล้วใช้เป็นอ้างอิงทุกฉากใหม่ เมื่อเวอร์ชันหลังหลุด ยังมีภาพที่อนุมัติไว้

แก้ไขโดยไม่หลุด

GPT Image 2.5 แก้ไขหลายรอบได้ดีกว่าเวอร์ชันก่อน แต่ "ดีกว่า" ไม่ใช่ "อัตโนมัติ" รูปแบบที่ใช้ได้:

  1. เปลี่ยนหนึ่งอย่างต่อรอบ แสง ฉากหลัง หรือข้อความ ไม่ใช่ทั้งหมด ไม่เช่นนั้นตรวจไม่ได้ว่าอะไรได้ผล
  2. ใช้สูตรเปลี่ยนอย่างเดียว "เปลี่ยนเฉพาะ X" ตามด้วยรายการรักษา สำหรับส่วนที่ต้องเหมือนเดิมทุกพิกเซล ให้ประกอบกลับแทนพึ่งพรอมต์
  3. ใส่ผลลัพธ์ก่อนหน้ากลับเข้าไป แก้ไขภาพที่อนุมัติแล้วแทนการอธิบายฉากใหม่
  4. เก็บเวอร์ชันที่อนุมัติ เมื่อแก้ไขทำให้ภาพเสีย ต้องมีเวอร์ชันกลับ ไม่ใช่แค่จำได้
  5. จบงานตัวอักษรละเอียดในเครื่องมืออื่น 5% สุดท้ายของเคอร์นิ่งและระยะห่างทำในเครื่องมือเลย์เอาต์เร็วกว่ารันใหม่สามครั้ง

วงรอบ 15 นาที

ความต่างระหว่างคนที่ได้ภาพใช้งานกับคนที่ได้ภาพโดยบังเอิญไม่ใช่คำศัพท์พรอมต์ แต่เป็นวงรอบ

  1. พื้นฐาน (2 นาที) เขียนทั้งเจ็ดส่วน สร้างภาพหนึ่งที่คุณภาพร่าง
  2. ตรวจสอบ (2 นาที) เช็คห้าสิ่ง: หัวข้อ องค์ประกอบ แสง ข้อความ ข้อจำกัด ระบุปัญหาหลักออกเสียง
  3. เปลี่ยนหนึ่งอย่าง (2 นาที) แก้เฉพาะส่วนที่ทำให้เกิดปัญหา ส่วนอื่นคงเดิมเพื่อให้เปรียบเทียบได้
  4. ล็อก (1 นาที) เมื่อภาพใช้ได้ บันทึกและระบุพรอมต์เวอร์ชันที่สร้างภาพนั้น เวอร์ชันนั้นคืออ้างอิง
  5. เสร็จ (5 นาที) รันพรอมต์ที่ชนะที่คุณภาพสูงและความละเอียดเต็ม ตรวจผลลัพธ์ที่ขนาดจริง — บนฟีดมือถือ ในสไลด์ หรือพิมพ์ — ไม่ใช่ซูมบนจอ

คนส่วนใหญ่ข้ามขั้นตอนที่ 3 และเขียนพรอมต์ใหม่ทุกครั้ง นั่นคือวิธีใช้เวลาชั่วโมงและไม่รู้ว่าโมเดลตอบสนองอะไร

แผนภาพวงรอบการปรับพรอมต์ห้าขั้นตอน สร้างด้วย GPT-Image 2.5 บน Felo

ปัญหาพบบ่อยและวิธีแก้

อาการสาเหตุจริงวิธีแก้
ผิวและพื้นผิวดูพลาสติกพรอมต์ขอ "สมบูรณ์แบบ" "ขัดมัน" แต่ไม่ขอพื้นผิวระบุผิว รูขุมขน รอยใช้งาน วัสดุ เพิ่ม "ไม่รีทัชหนัก" หรือ "ไม่แต่งสวย"
ข้อความผิดหรือซ้ำข้อความถูกสรุป หรือไม่ระบุจำนวนอ้างอิงข้อความ ระบุ "ครั้งเดียว" เพิ่มคุณภาพสำหรับข้อความเล็ก
คาแรกเตอร์เปลี่ยนระหว่างภาพรายละเอียดคงที่หยุดย้ำใช้ภาพอนุมัติเป็นอ้างอิงและย้ำรายละเอียดทุกครั้ง
การแก้ไขเปลี่ยนมากกว่าที่ขอไม่มีรายการรักษาระบุสิ่งที่คงที่ และประกอบส่วนเหมือนเดิมกลับ
รายละเอียดเดิมผิดซ้ำรันพรอมต์ใหม่ทั้งชุดทุกครั้งเปลี่ยนหนึ่งส่วน ส่วนอื่นคงเดิม แล้วเปรียบเทียบ
PNG "โปร่งใส" มีตารางหมากรุกเทาพื้นหลังถูกวาดแทนถูกลบขอความโปร่งใสชัดเจน ส่งออก PNG หรือ WebP ตรวจช่อง alpha
ภาพ 4K ข้อความเล็กเบลอข้อความเล็กสร้างที่คุณภาพร่างสร้างภาพข้อความแน่นที่ high หรือสูงกว่า ตรวจที่ขนาดใช้งานจริง
ทุกภาพดูเหมือนภาพสต็อกพรอมต์อธิบายหมวดหมู่ ไม่ใช่เหตุการณ์เฉพาะเพิ่มงาน สถานที่ เวลา และรายละเอียดที่น่าสนใจหนึ่งอย่าง

ทดลองพรอมต์เหล่านี้บน Felo

ทุกพรอมต์ในคู่มือใช้งานผ่าน OpenAI API ด้วย key ของคุณเอง การจัดการค่าใช้จ่ายและพารามิเตอร์ ถ้าต้องการใช้เวลากับพรอมต์มากกว่าระบบ Felo นำ GPT-Image 2.5 มาไว้ในเบราว์เซอร์:

  • เริ่มฟรี เครดิตรายวัน ไม่ต้องใช้บัตรเครดิต ไม่ต้องใช้ API key
  • ไม่มีลายน้ำ สิทธิ์เชิงพาณิชย์เต็ม รวมถึงแผนฟรี
  • ผลลัพธ์สูงสุด 4K 3840×2160 จริง ภาพแรกคือสินทรัพย์สุดท้ายได้
  • สไตล์ภาพกว่า 50 แบบและข้อความกว่า 50 ภาษา เหมาะกับโปสเตอร์ บรรจุภัณฑ์ เมนู และแคมเปญหลายภาษา
  • ทุกโมเดลชั้นนำในพื้นที่เดียว GPT-Image 2.5, GPT-Image 2, Nano Banana Pro, Nano Banana 2 Lite, Grok Imagine 2.0, Gemini 3.1 Flash Image และอื่น ๆ — สลับโมเดลตามงาน
  • เวิร์กโฟลว์นำทาง สตอรี่บอร์ด แผ่นแสดงอารมณ์ ลำดับหัวข้อ และ sprite sheet ที่เริ่มต้นด้วยโครงพรอมต์ใช้งานได้

ในพื้นที่ทำงานมีพรอมต์พร้อมใช้ให้ยิงก่อนเขียนเอง — สตอรี่บอร์ดหกช่อง โปสเตอร์งาน บรรจุภัณฑ์สินค้า การ์ตูน อินโฟกราฟิก และโฆษณาหลากหลาย ใช้เป็นการปรับเทียบ: รันหนึ่ง อ่านผลลัพธ์ แล้วนำโครงเจ็ดส่วนไปใช้กับโปรเจกต์ของคุณ

FAQ

วิธีเขียนพรอมต์ GPT Image 2.5 ที่ดีที่สุดคืออะไร? อธิบายภาพเหมือนบรีฟนักออกแบบ: การใช้งาน หัวข้อ การกระทำ องค์ประกอบ แสงและวัสดุ สไตล์ ข้อความและข้อจำกัด รวมเป็นส่วนที่มีชื่อสำหรับภาพซับซ้อน และเปลี่ยนทีละอย่างเมื่อปรับ

ควรใช้ GPT-Image-2.5 Flare หรือ Sunburst? เริ่มที่ Flare เมื่อความเร็วสำคัญและผลลัพธ์ตรวจเร็ว ใช้ Sunburst สำหรับงานสร้างสรรค์ รายละเอียดแน่น และแก้ไขแม่นยำ ทั้งสองราคาเท่ากัน เลือกตามคุณภาพและความเร็ว ไม่ใช่ราคา

ทำอย่างไรให้ข้อความในภาพ AI อ่านได้? อ้างอิงข้อความตรง ระบุตำแหน่งและจำนวน ระบุสไตล์ตัวอักษร ข้อความสั้น และเพิ่ม "ไม่มีข้อความเพิ่มเติม" แล้วอ่านทุกคำในผลลัพธ์ ใช้คุณภาพสูงขึ้นเมื่อข้อความเล็ก

ทำอย่างไรให้คาแรกเตอร์หรือผลิตภัณฑ์คงที่ระหว่างภาพ? อนุมัติภาพพื้นฐานหนึ่งภาพ อัปโหลดเป็นอ้างอิงทุกฉากใหม่ ระบุบทบาท และย้ำรายละเอียดทุกพรอมต์ ความคงที่มาจากข้อจำกัดซ้ำและอ้างอิงคงที่ ไม่ใช่โชค

ทำไมการแก้ไขเปลี่ยนส่วนที่ไม่ได้พูดถึง? เพราะพรอมต์ระบุแค่สิ่งที่เปลี่ยน ไม่ระบุสิ่งที่คงที่ ระบุ "เปลี่ยนเฉพาะ X" แล้วระบุสิ่งที่ต้องคงไว้: มุมกล้อง แสง รูปร่าง ฉลาก วัตถุพื้นหลัง

ต้องใช้ OpenAI API เพื่อใช้พรอมต์เหล่านี้ไหม? ไม่ เทคนิคพรอมต์ใช้กับโมเดล และพื้นที่ทำงาน GPT-Image 2.5 ของ Felo รันโมเดลในเบราว์เซอร์โดยไม่ต้องใช้ API key สามารถวางพรอมต์จากคู่มือแล้วสร้างภาพทันที

ภาพที่สร้างด้วย GPT Image 2.5 ใช้เชิงพาณิชย์ได้ฟรีไหม? บน Felo ได้ — ภาพมีสิทธิ์เชิงพาณิชย์เต็ม ไม่มีลายน้ำ รวมถึงแผนฟรี

เขียนบรีฟ ไม่ใช่คำขอ

ช่องว่างระหว่างภาพธรรมดากับสินทรัพย์ใช้งานได้แทบไม่เคยเป็นคำวิเศษ แต่เป็นคำอธิบายงาน องค์ประกอบ แสง วัสดุ ข้อความอ้างอิง และรายการสิ่งที่ต้องไม่เปลี่ยน

เขียนทั้งเจ็ดส่วนครั้งเดียวแล้วจะเห็นความต่าง จากนั้นเปลี่ยนทีละส่วนแล้วดูโมเดลตอบสนอง

เปิดพื้นที่ทำงาน วางพรอมต์จากคู่มือ แล้วดู GPT-Image 2.5 ทำงานกับบรีฟจริง

ทดลอง GPT-Image 2.5 บน Felo — ฟรี →



บทความนี้มีให้อ่านในภาษาต่อไปนี้ด้วย: English, 简体中文, 日本語, 한국어, 繁體中文, हिन्दी, Français, العربية, Русский, اردو, Bahasa Indonesia, Deutsch, Tiếng Việt, Türkçe, Italiano, Español, বাংলা and Português