NERD TEST / 001 · HOW IT WAS MADE

รูป 2 รูป + prompt 1 ย่อหน้า
= คลิปพูดไทย 8 วินาที

หน้านี้ไม่สอนทฤษฎี — เอาของที่ใส่เข้าไปจริงมาวางให้ดูทั้งหมด รูปที่ใช้ prompt ที่พิมพ์ ค่าที่ตั้ง แล้วผลที่ได้ออกมาเป็นอย่างนี้ ใครอยากทำตามก็ก๊อปไปได้เลย

01 · INPUT — รูป 2 รูป
รูปพรีเซนเตอร์ที่ใช้เป็นรูปอ้างอิง
คน1 รูป · หน้าชัด
รูปบ้านที่ใช้เป็นรูปอ้างอิง
บ้าน1 รูป · หน้าโครงการ
role: image_referencesไม่ต้องตัดพื้น ไม่ต้องรีทัช
+
02 · PROMPT — 1 ย่อหน้า
UGC-style vertical selfie video. The young Thai woman from the reference photo stands in front of the luxury two-story grey house from the reference photo at dusk, holding the phone at arm's length, natural handheld movement, warm evening light. She smiles and speaks to camera in clear natural Thai with accurate lip sync, friendly excited tone. She says in Thai: "สวัสดีค่ะ วันนี้พามาดูบ้านหลังนี้ค่ะ …" Native Thai speech audio only, soft ambient evening sound, no music, no subtitles.
ภาษาอังกฤษ ยกเว้นบทพูด6 ส่วน · ดูด้านล่าง ↓
03 · OUTPUT — คลิป
9:16 · 8s · 720p24 credits~3 นาที
PASS

โมเดล: Gemini Omni Flash 1.1 (โหมด reference-to-video) ผ่าน Higgsfield · สั่งงานผ่าน Claude Cowork · ไม่มีการตัดต่อเพิ่ม ไม่มีการเลือกเทคจากหลายรอบ — นี่คือรอบแรก

02แกะ prompt ทีละส่วน

prompt ทั้งหมดมี 6 ส่วน เรียงตามนี้ทุกครั้ง — ส่วนที่คนมักลืมคือ ส่วน 4 กับ 6 แล้วก็สงสัยว่าทำไมได้สำเนียงเพี้ยนกับมีเพลงโผล่มา

UGC-style vertical selfie video. The young Thai woman from the reference photo stands in front of the luxury two-story grey house from the reference photo at dusk, holding the phone at arm's length, natural handheld movement, warm evening light. She smiles and speaks to camera in clear natural Thai with accurate lip sync, friendly excited tone. She says in Thai: "สวัสดีค่ะ วันนี้พามาดูบ้านหลังนี้ค่ะ สองชั้น สไตล์คลาสสิก หน้าบ้านกว้างมาก จอดรถได้สองคันสบายๆ ใครสนใจทักมาได้เลยนะคะ" Native Thai speech audio only, soft ambient evening sound, no music, no subtitles.
1 · รูปแบบบอกว่าเป็นคลิปแบบไหน — UGC selfie แนวตั้ง ถ้าไม่บอก จะได้ภาพโฆษณาเนี้ยบๆ ที่ดูไม่จริง
2 · คน + ฉากต้องพูดว่า "from the reference photo" ทั้งคนและบ้าน ไม่งั้นโมเดลเจนคนใหม่/บ้านใหม่ให้เอง
3 · การเคลื่อนไหวมือถือ กล้องสั่นนิดๆ แสงเย็น — ตัวที่ทำให้ดูเป็นคนถ่ายเอง
4 · ภาษา + lip sync"clear natural Thai" ต้องมี — ตัวที่ลืมส่วนนี้ได้สำเนียงเขมรมาแล้ว
5 · บทพูดใส่ในเครื่องหมายคำพูด นำด้วย She says in Thai: · 8 วิ ≈ 25–30 คำ เกินนี้พูดไม่ทัน
6 · เสียงno music, no subtitles — ไม่บอก บางโมเดลใส่เพลงกับซับให้เองแล้วแก้ไม่ได้
03ค่าที่ตั้งตอนสั่งเจน

ไม่มีค่าลับ ตั้งแค่นี้

ModelGemini Omni Flash 1.1ผ่าน Higgsfield
Modereference-to-videoรับหลายรูปในรอบเดียว
Aspect9:16Reels / TikTok / Shorts
Duration8sพอสำหรับบทพูด 1 ประโยคยาว
Resolution720pพอสำหรับมือถือ · 1080p แพงกว่าไม่คุ้ม
Cost24credits ต่อรอบ
04ลำดับที่ทำจริง
  1. อัปโหลดรูป 2 รูปได้ media id กลับมา 2 ตัว — ไม่ต้องบอกว่ารูปไหนคน รูปไหนบ้าน โมเดลดูออกเอง
  2. เขียนบทพูดไทยก่อน แล้วค่อยเขียน prompt ล้อมรอบบทพูดคือสิ่งเดียวที่ลูกค้าจะฟัง ที่เหลือคือคำสั่งกล้อง
  3. สั่งเจน 1 รอบ รอ ~3 นาทีไม่ต้องสั่ง 4 รอบแล้วเลือก — ถ้า prompt ครบ 6 ส่วน รอบแรกก็มักผ่าน
  4. เช็ค 3 อย่างก่อนใช้ไทยชัดไหม · ปากตรงไหม · หน้าเหมือนรูปไหม — ไม่ผ่านข้อใด เจนใหม่ (24 credits) ถูกกว่านั่งแก้

ประเด็นที่คนมองข้าม — ความยากไม่ได้อยู่ที่ prompt แต่อยู่ที่เลือกโมเดล prompt เดียวกันนี้ใส่โมเดลอื่นได้ผลตั้งแต่ "ดีพอ" จนถึง "พูดเขมร" ดูผลทั้ง 11 ตัวได้ที่ Model Compare

อย่าลืมเรื่องสิทธิ์รูป — รูปคนที่ใช้ต้องได้รับอนุญาตแล้ว รูปในหน้านี้ใช้เพื่อการทดสอบ ถ้าจะทำจริงให้ใช้รูปพรีเซนเตอร์หรือพนักงานของโครงการเอง

ใช้ต่อได้เลย — prompt เต็มพร้อมช่อง [ ] ให้แก้ อยู่ที่ Prompt #1 · ขั้นตอนแบบเต็มอยู่ที่ Use Case 01