← กลับหน้าภาพรวม
🎨 สร้างรูปภาพ · IMAGE

การสร้างรูปภาพใน Perplexity: ฟีเจอร์เสริมที่จำกัดและ routing ไปโมเดลภายนอก

Perplexity สร้างรูปภาพได้ก็จริง แต่มันเป็นแค่ฟีเจอร์แถมมาให้ (แบบที่เรียกว่า enhanced query) ไม่ใช่โปรแกรมสร้างภาพเต็มตัว จุดที่ต้องเข้าใจก่อนเลยคือ Perplexity ไม่ได้มีโมเดลวาดรูปเป็นของตัวเอง แต่มันส่งคำสั่งของเราต่อไปให้โมเดลของเจ้าอื่นทำแทน (routing) เราเลือกได้เองว่าจะให้ใครวาด โดยไปที่ Settings → Preferences → Image generation model ตัวเลือกก็มี GPT Image 1 (ของ OpenAI), Nano Banana (โมเดลภาพของ Google Gemini ส่วน Nano Banana Pro มีให้เฉพาะแพ็กเกจ Max กับ Enterprise Max), FLUX.1, DALL·E 3 และ Seedream (ของ ByteDance) หรือจะเลือก Default ให้มันเลือกโมเดลที่เหมาะกับแต่ละคำสั่งให้อัตโนมัติก็ได้ เรื่องที่ต้องรู้คือการสร้างภาพมีโควตาจำกัด (quota) ต่างกันไปตามแพ็กเกจ (แบบฟรีได้น้อยมาก, Pro ได้จำกัด, Max ได้เยอะสุด) แล้วเวลากดสร้างใหม่ (regenerate) มันก็นับรวมเข้าโควตาด้วยนะ บทเรียนนี้จะสอนให้ใช้แบบเข้าใจว่ามันทำได้แค่ไหน อย่าไปคาดหวังคุณภาพหรือการควบคุมภาพละเอียดเท่าเครื่องมือระดับ Midjourney

🛠 Image Generation (routing ไปยัง GPT Image 1, Nano Banana, FLUX.1, DALL·E 3, Seedream)

เข้าใจว่าใครเป็นคนวาดให้ และเลือกโมเดลยังไง

เพราะ Perplexity แค่ส่งงานต่อไปให้เจ้าอื่นวาด (routing) คุณภาพและสไตล์ของภาพเลยขึ้นอยู่กับว่าเราเลือกโมเดลไหน โดยแต่ละตัวก็ถนัดไม่เหมือนกัน อย่าง GPT Image 1 กับ DALL·E 3 จะเก่งเรื่องอ่านคำสั่ง (prompt) ที่เราบรรยายยาว ๆ แล้วเข้าใจตามได้ดี ส่วน FLUX.1 เด่นเรื่องความสมจริงเหมือนภาพถ่าย และ Nano Banana ก็เป็นโมเดลภาพของ Gemini ลองใช้คำสั่งเดียวกันสลับโมเดลไปเรื่อย ๆ ดู จะได้รู้ว่าตัวไหนเหมาะกับงานแบบไหน แล้วก็ต้องเข้าใจด้วยว่าการคุมภาพแบบละเอียด ๆ (เช่นการล็อกค่า seed หรือจัดวางองค์ประกอบในภาพเป๊ะ ๆ) ทำได้น้อยกว่าเครื่องมือที่ออกแบบมาเพื่อสร้างภาพโดยเฉพาะ

ตัวอย่าง PROMPT
สร้างภาพประกอบสไตล์ flat illustration สำหรับสไลด์นำเสนอ หัวข้อ 'การเติบโตของพลังงานสะอาด' โทนสีเขียว-ฟ้า มีกังหันลมและแผงโซลาร์ องค์ประกอบเรียบง่าย พื้นที่ว่างด้านขวาสำหรับใส่ข้อความ

เทคนิคเขียนคำสั่งสร้างรูปให้ได้ผลกับ Perplexity

เคล็ดลับคือบอกให้ครบทั้ง 5 อย่างในคำสั่งเดียว คือ (1) บอกประเภทหรือสไตล์ของภาพ เช่น ภาพวาดแบบเรียบ ๆ (flat illustration), ภาพเหมือนถ่ายจริง (photorealistic) หรือภาพสีน้ำ (watercolor) (2) บอกตัวเอกของภาพให้ชัด ๆ ว่าอยากได้อะไรเป็นจุดเด่น (3) บอกโทนสีและอารมณ์ที่อยากได้ (4) บอกการจัดวางในภาพและตรงไหนที่อยากเว้นว่างไว้ (5) บอกด้วยว่าจะเอาไปใช้ทำอะไร เช่น เอาไปทำสไลด์หรือทำแบนเนอร์ เพราะ Perplexity คุมภาพได้จำกัด เราเลยควรบรรยายให้ครบตั้งแต่คำสั่งแรกเลย ดีกว่าไปหวังค่อย ๆ กดปรับทีละรอบ (เพราะกดสร้างใหม่ทีก็เปลืองโควตาทีนึง)

ตัวอย่าง PROMPT
สร้างภาพ hero banner แนว photorealistic สำหรับเว็บไซต์คาเฟ่ ภาพกาแฟลาเต้อาร์ตบนโต๊ะไม้ แสงธรรมชาติอบอุ่นยามเช้า มุมมองจากด้านบนเล็กน้อย พื้นหลังเบลอนุ่มนวล อัตราส่วนแนวนอนกว้าง เว้นพื้นที่ด้านซ้ายสำหรับข้อความหัวเรื่อง

ข้อจำกัดที่ต้องรู้ไว้ก่อน

ต้องย้ำกันตรง ๆ ว่านี่คือฟีเจอร์แถม (add-on) ที่มีโควตาจำกัดตามแพ็กเกจ ไม่ใช่เครื่องมือสำหรับผลิตงานสร้างสรรค์แบบจริงจัง คุณภาพและการคุมภาพก็ขึ้นอยู่กับว่าเลือกโมเดลของเจ้าไหนมาวาด แถมยังไม่มีฟีเจอร์แต่งภาพขั้นสูง หรือแบบที่ระบายลบ-เติมส่วนของภาพได้ (inpainting) เหมือนโปรแกรมมืออาชีพ แล้วถ้าสร้างภาพเยอะ ๆ ก็จะชนเพดานโควตาเร็วมาก สรุปคือถ้าต้องการงานภาพแบบเอาจริง แนะนำให้ไปใช้เครื่องมือที่ทำมาเพื่อสร้างภาพโดยเฉพาะ แล้วเก็บ Perplexity ไว้ใช้ทำภาพประกอบง่าย ๆ ตอนที่กำลังค้นคว้าหาข้อมูลอยู่ก็พอ

ตัวอย่าง PROMPT
ทดลอง: ใช้ prompt เดียวกันสร้างภาพด้วย 3 โมเดลที่ต่างกัน (เช่น GPT Image 1, FLUX.1, DALL·E 3) แล้วเปรียบเทียบผลลัพธ์ จดว่าโมเดลใดเข้าใจ prompt ได้ตรงที่สุด และแต่ละครั้งกินโควตาอย่างไร
← กลับหน้าภาพรวมหลักสูตร Perplexity