การสร้างภาพกราฟิกด้วย Google Gemini AI

Gemini นับได้ว่าเป็นผู้ช่วย AI ของค่าย Google ที่ได้รับการพูดถึงมากตัวหนึ่ง เป็น AI แบบ Multimodal Transformer ที่สามารถทำความเข้าใจข้อมูลได้หลากหลายประเภท ทั้งข้อความ รูปภาพ เสียง วิดีโอและโค้ด สามารถทำงานที่ซับซ้อนได้อย่างดี สร้างผลงานได้ตรงตามคำสั่ง Prompt ที่ระบุ โดยคำสั่งทำงานในเชิงโต้ตอบ

การใช้งาน Gemini ทำได้โดยเปิดเบราว์เซอร์ แล้วเข้าเว็บ https://gemini.google.com/ หรือเข้าแอพ Gemini ทั้งนี้จะต้องเป็นสมาชิกหรือล็อคอินด้วย GMail และปรากฏจอภาพพร้อมทำงานดังนี้

จากจอภาพการทำงานของ Gemini สามารถป้อนคำสั่งหรือ Prompt ตามต้องการ และปรับคำสั่ง Prompt ในลักษณะเชิงโต้ตอบได้ง่าย สะดวก ดังตัวอย่าง ต้องการให้ Gemini สร้างผลงานภาพของ Panda ก็ป้อนคำสั่งง่าย เป็น create image of cute panda

โดย create image เป็นคำสั่งให้รู้ว่าต้องการสร้างรูปภาพ และ cute panda คือเรื่องที่ต้องการ ซึ่งก็คือ ภาพหมีแพนด้าน่ารัก นั่นเอง … สามารถปรับ Cute panda เป็นเรื่องอื่นๆ ได้ตามต้องการ

ขั้นต่อไปก็อาจจะเลือก Style ของภาพ กรณีนี้ก็คือ Style ของหมีแพนด้า เช่น ภาพ 3 มิติ ภาพวาดสีน้ำ ภาพย้อนยุคปี 1900 ตัวอย่าง create image 3d model of cute panda จะได้ผลงานดังนี้

หรือใช้คำสั่ง create image water-color painting of cute panda 

ลองอีกคำสั่งนะครับ create image of 3d Ghibli-style model of cute panda in the cute Chinese-style cafe …. คำสั่งนี้ จะใช้ Style ของภาพเป็น ภาพสามมิติสไตล์การ์ตูนแนว Ghibli และให้แพนด้าอยู่ในคาเฟ่สไตล์จีน ซึ่งเป็นการบ่งบอกตำแหน่งที่ตั้งเพิ่มเข้าไป

ลองเพิ่มองค์ประกอบ ดังคำสั่ง create image of 3d Ghibli-style model of cute panda and cute boy in the cute Chinese-style cafe at the chinese-style library

น่าจะเห็นภาพได้ชัดขึ้นนะครับ อ้อ Gemini รองรับภาษาไทย ดังเช่นคำสั่ง “สร้างภาพกราฟิกของหมู 3 ตัวในลักษณะ 3D Ghibli-style ตัวหนึ่งนั่ง อีกสองตัวอยู่ในท่านอนอ่านหนังสือ ในสวนที่มีหลากหลายของดอกไม้” จะได้ผลงาน ดังนี้

Unknown's avatar

ฺBoonlert Aroonpiboon

เก็บบันทึกเรื่องราวและความทรงจำ

You may also like...

Discover more from Boonlert Aroonpiboon

Subscribe now to keep reading and get access to the full archive.

Continue reading