สร้างรูปภาพใน Claude Code: ตั้งค่า MCP ใน 2 นาที
สร้างรูปภาพใน Claude Code หรือ Claude Desktop ผ่าน remote MCP server: ไม่ต้องติดตั้ง ไม่ต้องมี Google API key เริ่มต้น $0.03 ตั้งค่าจริง ค่าใช้จ่ายจริง

เซิร์ฟเวอร์ MCP สำหรับสร้างรูปภาพคือส่วนเติมเต็มที่ช่วยให้ Claude สามารถเสกรูปภาพขึ้นมาได้ เพราะโดยปกติแล้ว Claude จะเขียน prompt และเรียกใช้งานเครื่องมือ generate_image จากนั้นเซิร์ฟเวอร์จะเรนเดอร์ผลลัพธ์บนโมเดลจริงๆ (ซึ่งก็คือโมเดลตระกูล Nano Banana ของ Google นั่นเอง) แล้วส่ง URL กลับคืนมา เนื่องจาก Claude เองวาดรูปไม่เป็น และ Anthropic ก็ไม่เคยเปิดตัวโมเดลสร้างรูปภาพเลย ทำให้ Claude Code และ Claude Desktop อ่านรูปภาพได้สบายๆ แต่กลับสร้างรูปภาพเองไม่ได้เลย
สำหรับใครที่ต้องการคำตอบแบบด่วนที่สุด: แค่สร้าง API key ใน โปรไฟล์ BananaBanana ของคุณ แล้วรันคำสั่งนี้เพียงคำสั่งเดียวในเทอร์มินัล:
claude mcp add --transport http bananabanana https://bananabanana.pro/api/mcp \
--header "Authorization: Bearer bb_live_YOUR_KEY"
ขั้นตอนการติดตั้งมีแค่นี้จริงๆ ครับ ไม่ต้องมีเซิร์ฟเวอร์ในเครื่อง (local server) ไม่ต้องสมัครบัญชี Google Cloud และไม่ต้องจ่ายค่าบริการรายเดือน ภาพแต่ละภาพจะคิดค่าบริการเริ่มต้นที่ $0.03 หักจากยอดเงินที่คุณเติมไว้ล่วงหน้า (prepaid balance) ส่วนวิดีโอเริ่มต้นที่ $0.10 และเพื่อความโปร่งใสของคู่มือนี้: ภาพประกอบทุกภาพในบทความนี้ถูกสร้างขึ้นโดย Claude Code ผ่านเซิร์ฟเวอร์ตัวนี้เป๊ะๆ ในขณะที่มันกำลังเขียนบทความนี้อยู่ โดยค่าใช้จ่ายทั้งหมดสำหรับสื่ออยู่ที่ $1.29 (รวมการสุ่มสร้างใหม่ 1 ครั้งแล้ว) ดูใบเสร็จได้ที่ท้ายบทความครับ
ทำไม Claude ถึงสร้างรูปภาพเองไม่ได้?
Anthropic เน้นพัฒนาโมเดลข้อความและการคิดวิเคราะห์ ส่วนความสามารถด้านการมองเห็น (Vision) นั้นทำงานแบบทิศทางเดียว คือ Claude สามารถมองและวิเคราะห์ภาพถ่ายหรือภาพหน้าจอของคุณได้ แต่ในตระกูลโมเดลของพวกเขาไม่มีโมเดลสร้างรูปภาพเลย และยังไม่มีการประกาศใดๆ ด้วย ในขณะที่ ChatGPT มาพร้อมกับโมเดลสร้างภาพในตัว แต่ Claude ไม่มี
ทางออกของฝั่งชุมชนนักพัฒนาคือการใช้เซิร์ฟเวอร์ MCP แบบโลคัล (local MCP servers) ซึ่งบน GitHub มีให้เลือกเพียบและใช้งานได้จริง แต่คำว่า "ติดตั้ง" ในที่นี้หมายถึงคุณต้องรันโปรเซสในเครื่องตัวเอง ต้องลง Node หรือ Python คอยเชื่อมเซิร์ฟเวอร์เข้ากับไฟล์คอนฟิกในทุกๆ เครื่อง และจุดเปลี่ยนสำคัญคือ คุณต้องนำ Google API key ของตัวเองมาใช้ด้วย ทำให้ค่าใช้จ่ายไปโผล่ที่บัญชี Google ของคุณ พร้อมโควตาและแดชบอร์ดเฉพาะตัว ซึ่งถ้าเป็นนักพัฒนาที่แค่อยากทดลองเล่นบนแล็ปท็อปเครื่องเดียวก็คงพอไหว แต่สำหรับคนทั่วไปแล้ว มันแทบจะกลายเป็นการทำโปรเจกต์โครงสร้างพื้นฐานขนาดย่อมๆ เลยทีเดียว
แต่เซิร์ฟเวอร์ MCP แบบระยะไกล (remote MCP server) จะเปลี่ยนเรื่องนี้ไปโดยสิ้นเชิง เพราะเซิร์ฟเวอร์รันอยู่ฝั่งเราเรียบร้อยแล้ว โดยมีเบื้องหลังการทำงานเดียวกับที่ใช้ขับเคลื่อน เครื่องสร้างรูปภาพ BananaBanana คุณแค่ยืนยันตัวตนด้วยคีย์เดียว จ่ายค่าบริการต่อการสร้างแต่ละครั้งจากยอดเงินที่เติมไว้ล่วงหน้า และตั้งค่าแบบเดียวกันเป๊ะทั้งบน Claude Code ในแล็ปท็อป บน Claude Desktop ในเครื่องของเพื่อนร่วมงาน หรือบน claude.ai ในเบราว์เซอร์ สรุปคือคุณไม่ต้องคอยดูแลระบบใดๆ เลยแม้แต่น้อย

วิธีเชื่อมต่อ Claude Code เข้ากับเซิร์ฟเวอร์ MCP สำหรับสร้างรูปภาพ
ใช้เวลาแค่ 2 นาทีกับ 3 ขั้นตอนครับ ขั้นแรกให้ สมัครสมาชิก แล้วไปที่ โปรไฟล์ (Profile) → MCP API Keys จากนั้นสร้างคีย์ขึ้นมา คีย์นี้จะแสดงให้เห็นเพียงครั้งเดียว โดยเริ่มต้นด้วย bb_live_ และถูกเก็บไว้ในรูปแบบแฮช (hashed) ในระบบฝั่งเรา ดังนั้นกรุณาคัดลอกเก็บไว้ทันที บัญชีใหม่จะได้รับเงินทดลองใช้ฟรีเริ่มต้น $0.20 ซึ่งเพียงพอสำหรับการทดสอบสร้างรูปภาพ 6 ภาพบนโมเดลที่ถูกที่สุด ก่อนที่คุณจะตัดสินใจเติมเงินเพิ่ม
Claude Code
รันคำสั่งเดียวตามด้านล่างนี้เลยครับ:
claude mcp add --transport http bananabanana https://bananabanana.pro/api/mcp \
--header "Authorization: Bearer bb_live_YOUR_KEY"
สำหรับรายละเอียดของแฟลกต่างๆ สามารถดูได้จาก เอกสารประกอบ Claude Code MCP โดย HTTP เป็นวิธีรับส่งข้อมูล (transport) ที่แนะนำสำหรับเซิร์ฟเวอร์ระยะไกล ให้รัน /mcp ในเซสชันเพื่อตรวจสอบว่าการเชื่อมต่อพร้อมใช้งานหรือไม่ คุณควรจะเห็นเครื่องมือทั้งหมด 7 ตัว ตั้งแต่ list_models ไปจนถึง get_result หลังจากนั้น คำสั่งอย่าง "สร้างรูปภาพหน้าปกขนาด 16:9 สำหรับโพสต์นี้" ก็จะเป็นคำสั่งที่ Claude Code สามารถจัดการให้คุณได้ทันที
Claude Desktop และ claude.ai
บน Claude Desktop และ claude.ai ให้ไปที่การตั้งค่าโดยไปที่ Settings → Connectors → Add custom connector จากนั้นวาง URL เซิร์ฟเวอร์เป็น https://bananabanana.pro/api/mcp สำหรับคีย์ ให้เปิดส่วน Request headers แล้วเพิ่มส่วนหัว Authorization พร้อมใส่ค่าเป็น Bearer bb_live_YOUR_KEY โดยต้องพิมพ์ค่าทั้งหมดรวมถึงคำว่า Bearer และเว้นวรรคให้ครบถ้วนด้วย เพราะข้อมูลจาก เอกสารประกอบตัวเชื่อมต่อของ Anthropic ระบุว่า Claude จะส่งส่วนหัวนี้ไปตรงๆ ตามที่พิมพ์โดยไม่มีการเพิ่มคำนำหน้าใดๆ เอง
ข้อควรระวังประการหนึ่ง: ฟีเจอร์การยืนยันตัวตนผ่านส่วนหัวคำขอ (request-header auth) ในตัวเชื่อมต่อ (connectors) ยังคงอยู่ในช่วงเบต้า และ Anthropic กำลังทยอยเปิดใช้งาน ดังนั้นบัญชีของคุณอาจจะยังไม่แสดงส่วนดังกล่าว วิธีแก้ขัดที่สามารถใช้งานได้ทุกที่ที่ Claude Desktop รันอยู่คือการเพิ่มเซิร์ฟเวอร์ผ่านบริดจ์ mcp-remote ในไฟล์ claude_desktop_config.json (ไปที่ Settings → Developer → Edit Config) ซึ่งในกรณีนี้เครื่องของคุณจำเป็นต้องติดตั้ง Node.js ไว้ด้วย:
{
"mcpServers": {
"bananabanana": {
"command": "npx",
"args": [
"-y", "mcp-remote", "https://bananabanana.pro/api/mcp",
"--header", "Authorization: Bearer bb_live_YOUR_KEY"
]
}
}
}
ทั้งสองวิธี รวมถึงตัวอย่าง JSON-RPC ดิบสำหรับการปรับแต่งแบบอื่นๆ สามารถดูได้ที่ หน้าเซิร์ฟเวอร์ MCP:

สามารถใช้งานภายนอก Claude ได้หรือไม่?
ได้แน่นอนครับ เนื่องจาก MCP เป็นโปรโตคอลแบบเปิด (open protocol) ดังนั้นไคลเอนต์ใดๆ ก็ตามที่รองรับ Streamable HTTP และสามารถส่งส่วนหัว Authorization ไปด้วยได้ ก็จะเชื่อมต่อไปยังเอนพอยต์เดียวกันนี้ได้ทั้งหมด ไม่ว่าจะเป็น Gemini CLI, ZCode ของ Z.ai สำหรับโมเดล GLM-5.2, เครื่องมือช่วยเหลือสำหรับการเขียนโค้ด (editor agents) และหลังจากที่ Codex เริ่มรองรับ remote MCP แล้ว แอปเดสก์ท็อป ChatGPT, Codex CLI ตลอดจนปลั๊กอินสำหรับ IDE ต่างๆ ก็สามารถใช้งานได้ด้วยเช่นกัน ผ่านการแชร์การตั้งค่าในไฟล์ config.toml เพียงจุดเดียว (ระบุ url และ bearer_token_env_var ตาม เอกสารประกอบ Codex MCP) สำหรับ xAI API จะทำการแนบเซิร์ฟเวอร์ MCP เข้ามาในแต่ละคำขอผ่าน server_url ส่วนบริการที่อาจจะยังล้าหลังอยู่บ้างก็คือหน้าต่างเว็บที่ยังคงอิงอยู่กับระบบ OAuth แทนการวางคีย์ตรงๆ เช่น ตัวเชื่อมต่อเว็บบน ChatGPT และอาจรวมถึงตัวเชื่อมต่อแบบอิง URL บน grok.com ทั้งนี้ เราได้จัดทำและคอยอัปเดตตารางสรุปข้อมูลตามไคลเอนต์แต่ละประเภทพร้อมตัวอย่างการตั้งค่าไว้ให้ที่ หน้าเซิร์ฟเวอร์ MCP แล้ว แต่อย่างไรก็ตาม บทความนี้จะขอเน้นโฟกัสที่ Claude เป็นหลักก่อนครับ
ตัวอย่างการใช้งานที่ 1: ภาพหน้าปกสำหรับบทความที่คุณกำลังเขียน
นี่คือตัวอย่างการใช้งานที่พบบ่อยในชีวิตประจำวันครับ เมื่อคุณกำลังร่างบทความบล็อกใน Claude Code แล้วพบว่าจำเป็นต้องใช้ภาพหน้าปก คุณแค่สั่งว่า: "generate a 16:9 editorial hero about database caching, library metaphor" แล้ว Claude จะจัดการเรียบเรียง prompt และส่งคำขอไปดังนี้:
→ generate_image {"prompt": "Editorial illustration for a developer blog post
about database caching: a small librarian robot placing three glowing books
onto a tiny fast bookshelf in the foreground, a huge dim archive hall
stretching far behind it, soft pastel background, dark ink details, accents
of violet and warm amber, clean minimal composition, generous negative
space, no text", "model": "nano-banana-pro", "aspect_ratio": "16:9"}
← {"job_id": "cmxq…", "status": "processing", "cost_charged_usd": 0.11,
"balance_remaining_usd": 4.89}
→ get_result {"job_id": "cmxq…"}
← {"status": "completed", "files": [{"url": "https://bananabanana.pro/api/files/…"}]}
และนี่คือผลลัพธ์ที่ได้จากการส่ง prompt ดังกล่าวตั้งแต่ครั้งแรกโดยไม่ต้องสั่งรันซ้ำเลยครับ:

ค่าใช้จ่าย: $0.11 บนโมเดล Nano Banana Pro ที่ความละเอียด 1K โดยเอเจนต์จะทำการดาวน์โหลดไฟล์จาก URL ที่เซ็นชื่อแบบจำกัดเวลา (signed URL) แล้วบันทึกลงในที่เก็บไฟล์ของคุณ (repo) จากนั้นก็เขียนคำอธิบายรูปภาพ (alt text) ให้เสร็จสรรพ ลิงก์ดังกล่าวจะมีอายุการใช้งาน 24 ชั่วโมง ซึ่งหลังจากหมดอายุการเรียกใช้ get_result ก็จะมอบลิงก์ชุดใหม่ให้
ตัวอย่างการใช้งานที่ 2: ภาพถ่ายผลิตภัณฑ์โดยไม่ต้องจ้างช่างภาพ
ภาพจำลองเพื่อการตลาด (marketing mockups) คือจุดที่การเขียน prompt สไตล์ช่างภาพมืออาชีพจะแสดงประสิทธิภาพออกมาได้อย่างเต็มที่ ให้คุณลองอธิบายภาพในแบบที่ช่างภาพใช้คุยงาน เช่น ตัวแบบ, พื้นผิวสัมผัส, แหล่งกำเนิดแสง และเลนส์ที่ใช้
→ generate_image {"prompt": "A photorealistic product photo of a matte
sage-green ceramic pour-over coffee set on a pale linen tablecloth, soft
diffused daylight from a window on the left, gentle shadows, shallow depth
of field, eye-level shot with a 50mm lens, minimal warm styling, no text",
"model": "nano-banana-pro", "aspect_ratio": "1:1"}

ขอเปิดเผยตรงๆ เลยว่าภาพนี้ต้องสร้างถึงสองรอบครับ การเรนเดอร์ในครั้งแรกนั้นดูสวยงามดีเมื่อมองผ่านๆ แต่พอลองซูมดูใกล้ๆ กลับพบว่าถ้วยกาแฟละลายติดเป็นเนื้อเดียวกับจานรองจนดูคล้ายกับฝาปิด ซึ่งเรื่องรูปทรงเรขาคณิตของวัตถุนั้นเป็นจุดที่โมเดลแนวเสมือนจริง (photorealistic) ยังมีข้อผิดพลาดอยู่บ่อยครั้ง และงานถ่ายภาพสินค้านี่แหละคือส่วนที่คุณจำเป็นต้องซูมตรวจสอบก่อนนำไปใช้งานจริง แต่การกดสร้างซ้ำ (reroll) อีกรอบด้วย prompt เดิมก็ช่วยแก้ปัญหาได้ทันที รวมแล้วจ่ายไป $0.22 สำหรับทั้งสองภาพแทนที่จะเป็น $0.11 ส่วนที่ผมชอบมากที่สุดไม่ใช่ตัวรูปภาพหรอกครับ แต่เป็นขั้นตอนหลังจากนั้นต่างหาก นั่นคือเครื่องมือ edit_image สามารถรับค่า job_id ของภาพที่สร้างเสร็จแล้ว และทำตามคำสั่ง เช่น "ช่วยทำพื้นหลังให้เป็นสีขาวบริสุทธิ์และใส่เงาแบบนุ่มๆ ให้หน่อย" ซึ่งทำให้เกิดการปรับแต่งรูปภาพแบบโต้ตอบได้หลายรอบ (multi-turn refinement) โดยไม่ต้องคอยเขียนคำอธิบายฉากหลังใหม่ทั้งหมด และแต่ละรอบจะคิดค่าบริการเท่ากับการสร้างภาพหนึ่งภาพ สำหรับงานทำแคตตาล็อกสินค้าแล้ว ลูปการทำงานแบบนี้แหละที่เป็นเส้นแบ่งระหว่างเครื่องมือระดับโปรกับการเป็นแค่ของเล่นแก้เบื่อ
ตัวอย่างการใช้งานที่ 3: การควบคุมตัวละครให้มีความสม่ำเสมอในทุกรูปภาพ
มาสคอตของแบรนด์, ช่องการ์ตูนช่อง หรือสตอรี่บอร์ด ต่างก็ต้องการให้ตัวละครเดิมปรากฏตัวในรูปภาพถัดๆ ไปอย่างสม่ำเสมอ เมื่อใช้งานผ่าน MCP เทคนิคการทำงานที่แนะนำคือการใช้ Character Sheet หรือบล็อกข้อความอธิบายลักษณะตัวละครแบบคงที่ เพื่อให้เอเจนต์นำไปวางแปะลงในทุกๆ prompt สำหรับตัวละครของเราคือ "a small courier robot with a round matte-teal head, one large friendly amber eye, boxy cream-white body with visible brass screws, and a canvas messenger bag with a brass buckle" รันไปสองฉากด้วยการส่งคำขอสองครั้ง ค่าใช้จ่ายครั้งละ $0.11:


สารภาพตามตรงเกี่ยวกับผลลัพธ์เลยครับ: ถือว่าทำได้ดีแต่ยังไม่ถึงขั้นสมบูรณ์แบบร้อยเปอร์เซ็นต์ ตัวกระเป๋า, ดวงตาสีอำพัน และตัวเครื่องสีครีมพร้อมสกรูทองเหลืองนั้นยังอยู่ครบถ้วน แต่รูปทรงส่วนหัวนั้นเพี้ยนจากทรงกลมไปคล้ายหมวกกันน็อก และภาพตอนพลบค่ำก็กลายเป็นสไตล์เส้นกราฟิกที่เด่นชัดขึ้น ซึ่งนี่คือข้อจำกัดที่หลีกเลี่ยงไม่ได้ของการคุมตัวละครด้วยข้อความเพียงอย่างเดียว (text-only anchoring) การใช้ภาพอ้างอิง (Reference images) จะช่วยแก้ปัญหานี้ได้ดีกว่ามาก ซึ่งบน เครื่องสร้างรูปภาพบนเว็บ จะสามารถใส่ภาพอ้างอิงตัวละครได้สูงสุดถึง 5 ภาพบนโมเดล Nano Banana Pro แต่เนื่องจากเครื่องมือ generate_image บน MCP ในตอนนี้ยังไม่รองรับการส่งภาพเข้าไปเป็นอินพุต หากสนใจศึกษาข้อมูลอย่างละเอียด คุณสามารถเข้าไปอ่าน คู่มือฉบับย่อสำหรับการคุมตัวละครให้คงเส้นคงวา ซึ่งจะครอบคลุมเนื้อหาทั้งสองวิธี รวมถึงบอกด้วยว่ารายละเอียดจุดใดที่มักจะเพี้ยนไปก่อนเพื่อน
ตัวอย่างการใช้งานที่ 4: การสร้างคลิปวิดีโอจากห้องแชทเดียวกัน
การสร้างวิดีโอก็สามารถรันผ่านเซิร์ฟเวอร์ตัวเดียวกันนี้ได้เช่นกัน โดยมีระบบรักษาความปลอดภัยเพิ่มเข้ามาอีกหนึ่งชั้น เนื่องจากคลิปวิดีโอมีค่าใช้จ่ายที่สูงกว่ารูปภาพปกติ (สูงสุดถึง $4.40 สำหรับการเรนเดอร์คุณภาพสูงด้วย Veo 3.1) ดังนั้นเครื่องมือ generate_video จะไม่มีการหักยอดเงินในการส่งคำขอครั้งแรกเด็ดขาด แต่ระบบจะประเมินราคา (quote) ส่งกลับมาก่อน เพื่อให้เอเจนต์กดยืนยันยอดเงินที่แท้จริงเพื่อทำรายการต่อ:
→ generate_video {"prompt": "Aerial drone shot rising slowly over terraced tea
fields at sunrise, thin mist drifting in the valleys, golden light catching
the ridges, smooth cinematic camera motion, wide shot",
"model": "veo-3.1-fast", "duration": 6, "resolution": "720p"}
← {"status": "confirmation_required", "quoted_cost_usd": 0.52, …}
→ generate_video {…same arguments…, "confirm_cost": 0.52}
← {"job_id": "cmxr…", "status": "processing", "cost_charged_usd": 0.52}
และนี่คือผลลัพธ์ที่ได้: วิดีโอไม่มีเสียง ความยาว 6 วินาที ความละเอียด 720p จากโมเดล Veo 3.1 Fast สร้างเสร็จในรอบเดียวครับ:
กระบวนการสร้างวิดีโอจะใช้เวลาประมาณ 1 ถึง 10 นาที ดังนั้นระหว่างนั้นเอเจนต์จะคอยเช็กผลลัพธ์ผ่าน get_result อยู่เบื้องหลังขณะที่คุณทำงานอื่นไปพลางๆ ได้ และหากคุณต้องการให้มีเสียงประกอบด้วย โมเดล Omni Flash ก็พร้อมให้บริการผ่านเครื่องมือเดียวกันนี้ในราคา $0.10 ต่อวินาที โดยจะเปิดเสียงไว้เสมอ และคุณสามารถกำหนดความยาวเองได้ — ตั้งแต่ 3 ถึง 10 วินาที นอกจากนี้ยังรองรับการรับภาพเป็นอินพุตด้วย: เพียงส่ง job_id ของภาพที่คุณสร้างไว้แล้ว (หรือลิงก์สาธารณะ) เป็นเฟรมแรก, เพิ่มภาพอ้างอิงได้สูงสุดสิบภาพเพื่อรักษาความสอดคล้องของตัวละคร, แล้วเอเจนต์จะทำการสร้างแอนิเมชันให้ อย่างไรก็ตาม เฟรมสุดท้ายและลูปยังคงต้องใช้งานบนเครื่องสร้างรูปภาพบนเว็บ
รูปภาพทุกรูปในบทความนี้ถูกสร้างขึ้นด้วยเวิร์กโฟลว์นี้
ถ้าผมเป็นคนอ่านบทความนี้ ผมก็คงอยากเห็นหลักฐานเพื่อพิสูจน์เรื่องนี้เหมือนกัน นี่คือลูปการทำงานที่เป็นรูปธรรมจริงๆ ครับ ระหว่างที่ Claude Code กำลังเขียนหัวข้อต่างๆ ของบทความนี้ มันก็ได้เรียบเรียง prompt สำหรับสร้างรูปภาพตามสไตล์ของ BananaBanana ไปด้วย จากนั้นก็เรียกใช้เครื่องมือสร้างรูปภาพ รอประมาณยี่สิบกว่าวินาที ตรวจสอบภาพที่ส่งกลับมา แล้วจึงแทรกโค้ด Markdown พร้อมคำอธิบายภาพ (alt text) ก่อนที่จะเขียนหัวข้อถัดไป ในโพสต์นี้มีการเรียกใช้เครื่องมือสร้างสื่อทั้งหมด 8 ครั้ง โดยภาพ 6 ภาพและวิดีโอ 1 คลิปผ่านการอนุมัติและใช้งานได้ทันทีตั้งแต่รอบแรก มีเพียงชุดกาแฟดริปเท่านั้นที่ต้องสั่งรันซ้ำอีกหนึ่งรอบหลังจากตรวจสอบพบความผิดพลาดเรื่องถ้วยและจานรองกาแฟ ซึ่งการทำงานที่ผิดพลาดเพียงแค่ 1 ครั้งจากทั้งหมด 8 ครั้งนี้ถือว่าเกินความคาดหมายของผมไปมาก สำหรับไฟล์สื่อเพียงอย่างเดียวที่ไม่ได้มาจากการเจนเนอเรตด้วย AI ก็คือภาพหน้าจอของหน้าเอกสารประกอบ ซึ่งจับภาพโดยใช้เครื่องมือของเบราว์เซอร์
รูปภาพเหล่านั้นอาจจะไม่ได้สมบูรณ์แบบไร้ที่ติ (อย่างหัวของหุ่นยนต์ส่งของที่ชอบเบี้ยวไปตามจินตนาการของมันเอง) แต่ประเด็นสำคัญคือขั้นตอนการ "วาดภาพประกอบ" ไม่ใช่ขั้นตอนการผลิตที่แยกส่วนออกไปอีกต่อไปแล้ว เพราะเซสชันการทำงานเดียวกันที่เขียนเนื้อหา ก็เป็นเซสชันเดียวกับที่สร้างภาพและส่งมอบสื่อออกมา และที่สำคัญคือค่าใช้จ่ายทั้งหมดนี้มีราคาพอๆ กับตั๋วรถโดยสารประจำทางเพียงหนึ่งใบเท่านั้นเองครับ
ค่าใช้จ่ายจริงสำหรับการสร้างสื่อในบทความนี้มีมูลค่าเท่าใด?
ค่าใช้จ่ายทั้งหมดด้านล่างนี้ถูกคำนวณตามราคามาตรฐานต่อการสร้างแต่ละครั้งจาก หน้าอัตราค่าบริการ ของเรา ซึ่งเป็นตัวเลขเดียวกับที่เครื่องมือ list_models รายงานให้เอเจนต์ทราบ โดยไม่มีส่วนลดพิเศษสำหรับพนักงานใดๆ ทั้งสิ้น
| ชิ้นงาน | โมเดล | ราคา |
|---|---|---|
| ภาพหน้าปกหลัก | Nano Banana Pro, 1K | $0.11 |
| ภาพประกอบหุ่นยนต์นักเขียนกับหุ่นยนต์จิตรกร | Nano Banana Pro, 1K | $0.11 |
| ภาพหน้าปกเรื่องการแคชข้อมูล (ตัวอย่างการใช้งานที่ 1) | Nano Banana Pro, 1K | $0.11 |
| ภาพจำลองชุดกาแฟดริป, สร้าง 2 รอบรวมสุ่มใหม่หนึ่งรอบ (ตัวอย่างการใช้งานที่ 2) | Nano Banana Pro, 1K | $0.22 |
| ซีรีส์หุ่นยนต์ส่งของ, จำนวน 2 ภาพ (ตัวอย่างการใช้งานที่ 3) | Nano Banana Pro, 1K | $0.22 |
| คลิปวิดีโอทุ่งชา, ความยาว 6 วินาที ไม่มีเสียง 720p (ตัวอย่างการใช้งานที่ 4) | Veo 3.1 Fast | $0.52 |
| ภาพหน้าจอหน้าเอกสารประกอบ | เบราว์เซอร์, ไม่ใช่การสร้างด้วย AI | $0.00 |
| ยอดรวมทั้งหมด | $1.29 |
เราเลือกใช้โมเดลสร้างรูปภาพตัวท็อปที่สุดสำหรับทุกชิ้นงาน เนื่องจากรูปภาพเหล่านี้ต้องถูกนำมาเผยแพร่บนหน้าเว็บสาธารณะ การใช้โมเดลแบบร่างอย่าง Nano Banana 2 Lite ในราคาภาพละ $0.03 จะช่วยลดค่าบริการส่วนรูปภาพลงจาก $0.77 เหลือเพียง $0.21 เท่านั้น ซึ่งคุณสามารถศึกษาข้อมูลเพื่อพิจารณาความเหมาะสมได้จาก คู่มือการใช้งานรุ่น Lite ของเรา
พร้อมที่จะลองสัมผัสด้วยตัวเองหรือยังครับ? มาร่วม เชื่อมต่อเซิร์ฟเวอร์ BananaBanana MCP แล้วเอ่ยปากสั่ง Claude ให้สร้างรูปภาพภาพแรกของคุณได้เลย
คำถามที่พบบ่อย (FAQ)
เซิร์ฟเวอร์ BananaBanana MCP สามารถใช้งานกับไคลเอนต์อื่นๆ ที่ไม่ใช่ Claude ได้หรือไม่?
ใช้งานได้ครับ โดยสามารถทำงานร่วมกับไคลเอนต์ MCP ใดๆ ก็ตามที่สนับสนุน Streamable HTTP และอนุญาตให้ระบุส่วนหัว Authorization เพิ่มเข้าไปได้ เช่น Claude Code, Claude Desktop, Gemini CLI, ZCode ของ Z.ai สำหรับโมเดล GLM-5.2, เอเจนต์ของโปรแกรมแก้ไขโค้ดอย่าง Cursor หรือ VS Code และยังรองรับการทำงานร่วมกับแอปพลิเคชันเดสก์ท็อป ChatGPT, Codex CLI ตลอดจนปลั๊กอิน IDE ของค่ายต่างๆ ผ่านทางระบบซัพพอร์ต remote MCP ของ Codex ซึ่งทั้งหมดแชร์ข้อมูลคอนฟิกจุดเดียวกันในไฟล์ config.toml ด้วยตัวแปร url และ bearer_token_env_var นอกจากนี้ xAI API ยังสามารถระบุแนบเซิร์ฟเวอร์ MCP ประจำในแต่ละหน้าต่างคำขอผ่านทาง server_url ได้อีกด้วย ทว่าส่วนที่ยังคงไม่มีความแน่นอนก็คือ ตัวเชื่อมต่อเว็บของ ChatGPT ซึ่งใช้วิธียืนยันสิทธิ์ผ่าน OAuth แทนที่จะเป็นการคัดลอกและวางคีย์ตรงๆ และฝั่งหน้าต่างกรอกตัวเชื่อมต่อที่สร้างเองของ grok.com ที่รับข้อมูลเฉพาะช่อง URL โดยไม่ระบุช่องกรอกคีย์ข้อมูลเอกสาร ซึ่งทั้งสองรายนี้คาดว่าอาจต้องรอให้ระบบฝั่งเราเพิ่มการรองรับมาตรฐาน OAuth 2.1 ที่มีแผนพัฒนาในอนาคตก่อนครับ ทั้งนี้ คุณสามารถเข้าไปตรวจสอบความคืบหน้าของตารางข้อมูลเปรียบเทียบตามแต่ละไคลเอนต์พร้อมโค้ดสั้นสำหรับเตรียมใช้งานได้ที่ หน้าเซิร์ฟเวอร์ MCP ส่วนโปรเจกต์ใดๆ ก็ตามที่คุณสร้างขึ้นมาเอง ก็จะสามารถเชื่อมต่อได้โดยตรงผ่านระบบโปรโตคอล JSON-RPC ได้ในทันที
ฉันจำเป็นต้องใช้ Google API key หรือบัญชี Google Cloud หรือไม่?
ไม่จำเป็นเลยครับ และนั่นคือเหตุผลสำคัญที่สุดที่เราพัฒนาเซิร์ฟเวอร์ตัวนี้ขึ้นมา โดยปกติเซิร์ฟเวอร์ MCP สำหรับสร้างรูปภาพแบบติดตั้งในเครื่อง (local) ทั่วไปที่แจกฟรีบน GitHub จะทำการยิงหา Gemini API โดยตรง จึงต้องการคีย์ Google AI Studio ส่วนตัวของคุณเพื่อไปบริหารจัดการโควตาและเรื่องเงินๆ ทองๆ ด้วยตัวเอง แต่สำหรับที่นี่ การสร้างรูปภาพจะรันผ่านกลุ่มคีย์ Vertex AI ที่คอยดูแลโดย BananaBanana ทำให้ข้อมูลรับรองสิทธิ์เพียงอย่างเดียวที่คุณต้องใช้ก็คือ คีย์ bb_live_ จากหน้าโปรไฟล์ของคุณเท่านั้น โดยที่คุณไม่ต้องเข้าไปยุ่งเกี่ยวกับหน้าคอนโซลของ Google และ Google จะไม่มีวันเรียกเก็บเงินจากคุณแน่นอน หากจะให้บอกกันตรงๆ จุดแลกเปลี่ยนก็คือ คุณจะไม่ได้จ่ายในราคาทุนดิบของ Google API และไม่ได้ตั้งค่าพารามิเตอร์แบบเจาะลึกด้วยตัวเอง แต่สิ่งที่คุณจะได้รับกลับคืนมาคือ อัตราค่าบริการต่อครั้งแบบไม่มีกำหนดขั้นต่ำ ระบบช่วยสลับหมุนเวียนคีย์โดยอัตโนมัติ และการรวมกระเป๋าเงินใบเดียวกันไว้แชร์ใช้งานร่วมกันได้ทั้งหมด ไม่ว่าจะเป็นเซิร์ฟเวอร์ MCP, เครื่องสร้างรูปภาพบนหน้าเว็บ หรือแอปพลิเคชันบน Telegram นอกเหนือจากนี้ หากพบว่าคีย์ของคุณรั่วไหลออกไปสู่สาธารณะ คุณก็แค่กดปิดใช้งาน (revoke) คีย์เดิมทิ้งด้วยการคลิกเพียงครั้งเดียว โดยไม่ส่งผลกระทบใดๆ กับส่วนการทำงานส่วนอื่นเลย
ระบบการเรียกเก็บเงินของเซิร์ฟเวอร์ MCP ทำงานอย่างไร?
ระบบของเราเป็นแบบเติมเงินล่วงหน้า (Prepaid) คิดราคาตามจำนวนครั้งที่สร้างจริง และไม่มีค่าบริการรายเดือนผูกมัดครับ เมื่อคุณทำการเติมเงิน การสร้างแต่ละครั้งจะไปหักยอดเงินคงเหลือตามราคาที่ระบุไว้ เช่น รูปภาพเริ่มต้นที่ $0.03 ถึง $0.20 ขึ้นอยู่กับโมเดลและความละเอียดภาพ วิดีโอเริ่มต้นที่ $0.10 ถึง $4.40 ขึ้นอยู่กับโมเดล, ความยาวคลิป, ความละเอียด และการมีเสียงประกอบ ซึ่งเอเจนต์จะทราบราคาที่ต้องจ่ายล่วงหน้าเสมอเนื่องจากฟังก์ชัน list_models จะให้ข้อมูลตัวเลขล่าสุดแบบเรียลไทม์ และสำหรับการเรียกใช้สร้างวิดีโอ (รวมถึงการสร้างรูปภาพแบบชุดใหญ่พร้อมกันหลายรูป) ทุกรายการจะต้องผ่านขั้นตอนส่งเสนอราคาประเมิน (quote) และให้ผู้ใช้กดยืนยันผ่าน confirm_cost ก่อน ยอดเงินจึงจะถูกหักออกไป นอกจากนี้ในทุกๆ ผลลัพธ์ที่ตอบกลับมาจะแสดงรายงาน cost_charged_usd และ balance_remaining_usd เสมอ ทำให้คุณสามารถตรวจสอบและควบคุมต้นทุนระหว่างการสนทนาได้อย่างง่ายดาย และหากเกิดกรณีการสร้างภาพล้มเหลว ระบบจะทำการคืนเงินเข้าบัญชีให้โดยอัตโนมัติทันที ยิ่งไปกว่านั้น หากคุณกังวลว่าเอเจนต์ AI อาจจะทำงานเกินขอบเขตจนใช้เงินบานปลาย คุณก็สามารถกำหนดวงเงินจำกัดการใช้งานรายวัน (daily USD cap) ประจำในแต่ละคีย์ได้ที่ โปรไฟล์ → MCP API Keys รวมถึงตรวจสอบบันทึกประวัติการใช้งานอย่างละเอียดที่จะเก็บข้อมูลทั้งเครื่องมือที่เรียกใช้, โมเดล, ค่าใช้จ่าย และตัวอย่าง prompt ของแต่ละรายการไว้ให้ตรวจสอบย้อนหลังได้ตลอดเวลา
จะเกิดอะไรขึ้นหากยอดเงินคงเหลือหมดลงระหว่างทำภารกิจค้างอยู่?
เมื่อยอดเงินหมดลง การเรียกใช้งานเครื่องมือแบบเสียค่าบริการในครั้งถัดไปจะแจ้งข้อผิดพลาดอย่างตรงไปตรงมาด้วยโค้ด INSUFFICIENT_BALANCE พร้อมส่งแนบลิงก์สำหรับกดเติมเงินมาด้วย ซึ่งเอเจนต์จะรายงานปัญหานี้ให้คุณทราบทันที โดยจะไม่มีการหักยอดเงินจนติดลบ ไม่มีระบบเบิกเงินเกินบัญชี หรือส่งใบเสร็จเรียกเก็บเงินย้อนหลังมาสร้างความตกใจให้คุณแน่นอน ส่วนเครื่องมือฟรีต่างๆ (list_models, get_account, get_result, list_generations) จะยังคงทำงานได้ตามปกติ ดังนั้นข้อมูลใดๆ ที่เคยสร้างเสร็จสมบูรณ์แล้วจะยังคงสามารถเข้าไปกดดาวน์โหลดมาดูได้เช่นเดิม และภาพใดๆ ที่ได้เริ่มกระบวนการสร้างไปก่อนที่ยอดเงินจะหมดลงก็จะยังคงเรนเดอร์ต่อไปจนเสร็จเรียบร้อย เนื่องจากเราเก็บเงินเพียงครั้งเดียวตอนเริ่มงาน ในทางปฏิบัติเมื่อยอดเงินไม่พอ Claude จะเพียงแค่รายงานปัญหาการทำงานล้มเหลวพร้อมส่ง URL เติมเงินมาให้คุณแล้วสลับไปทำงานส่วนอื่นที่ค้างอยู่ต่อ และหากคุณต้องการเตรียมยอดเงินสำรองเพื่อป้องกันไม่ให้ระบบหยุดทำงานกะทันหัน แนะนำให้สังเกตยอดเงินคงเหลือจากรายงาน balance_remaining_usd ในทุกครั้ง หรือจะสั่งให้เอเจนต์คอยรันตรวจสอบผ่าน get_account ก่อนจะเริ่มสั่งรันงานล็อตใหญ่ๆ ก็ได้ครับ
ตัวกรองเนื้อหา (Content Filter) จะบล็อกเนื้อหาประเภทใดบ้าง และฉันต้องจ่ายเงินสำหรับ prompt ที่โดนบล็อกหรือไม่?
เนื่องจากโมเดลต้นทางของ Google มีตัวกรองความปลอดภัยเป็นของตัวเอง ดังนั้นเมื่อการสร้างรูปภาพหรือวิดีโอถูกปฏิเสธ เซิร์ฟเวอร์จะส่งคืนรหัสข้อผิดพลาด SAFETY_FILTERED แบบรวมจุดเดียวกลับมา แทนที่จะแสดงประเภทโค้ดยิบย่อยของฝั่ง Google ซึ่งหมวดหมู่ที่ถูกบล็อกหลักๆ ก็จะเป็นไปตามข้อตกลงนโยบายของ Gemini และ Veo ทั่วไป ได้แก่ เนื้อหาทางเพศที่เกี่ยวข้องกับผู้เยาว์, ความรุนแรงที่โจ่งแจ้ง, ภาพดัดแปลงเสมือนจริงของบุคคลจริง (deepfakes) และอื่นๆ ในทำนองเดียวกัน อย่างไรก็ดี บางครั้งระบบคัดกรองความปลอดภัยก็อาจจะทำงานผิดพลาด (false positives) กับคำสั่งปกติที่ไม่มีเจตนาร้ายได้ ซึ่งเรื่องนี้อยู่นอกเหนือการควบคุมของเรา และเราคงไม่ขอแก้ตัวใดๆ ส่วนระบบการหักค่าบริการนั้นตรงไปตรงมามากครับ: หากรายการคำสั่งสร้างถูกบล็อกโดยตัวกรองทั้งหมด ระบบจะโอนเงินคืนให้ในทันทีโดยอัตโนมัติ และสำหรับวิดีโอที่ในบางกรณีทาง Google อาจเลือกคัดกรองสกรีนบล็อกออกไปเฉพาะบางส่วนของคลิป ระบบก็จะทำการคำนวณสัดส่วนและคืนเงินให้บางส่วนตามจริง สรุปคือคุณจะจ่ายเฉพาะค่าสื่อที่คุณได้รับเท่านั้น หากพบว่า prompt ของคุณถูกตัวกรองดีดกลับมาซ้ำๆ แนะนำให้ลองปรับเปลี่ยนการเลือกใช้คำหรือลบรายละเอียดเฉพาะบางจุดที่อาจมีความเสี่ยงออกไป แทนที่จะส่งข้อความเดิมซ้ำๆ เข้ามาครับ
ใครเป็นเจ้าของลิขสิทธิ์รูปภาพที่ถูกสร้างขึ้นผ่านเซิร์ฟเวอร์ MCP?
คุณคือเจ้าของลิขสิทธิ์ทั้งหมดครับ ภายใต้ ข้อตกลงการใช้งาน ของเรา รูปภาพและวิดีโอทั้งหมดที่ถูกสร้างขึ้นเป็นสิทธิ์ของคุณโดยสมบูรณ์ ทั้งสำหรับการนำไปใช้งานส่วนตัวและในเชิงพาณิชย์ โดยจะเป็นไปตามข้อกำหนดนโยบายของผู้ให้บริการโมเดลต้นทางนั้นๆ ทางเราจะไม่มีสิทธิ์ความเป็นเจ้าของในเนื้อหาใดๆ ของคุณ และ prompt ที่คุณส่งเข้ามาก็ยังคงเป็นสิทธิ์ของคุณเช่นเดิม แต่ในทางปฏิบัติมีข้อควรระวังเรื่องการจัดเก็บไฟล์อยู่ 2 ประการด้วยกันครับ อย่างแรกคือ URL ที่ส่งคืนมาจากฟังก์ชัน get_result จะเป็นลิงก์ที่ได้รับการรับรองความปลอดภัยแบบกำหนดเวลาใช้ได้ 24 ชั่วโมงเท่านั้น ดังนั้นขอแนะนำให้รีบดาวน์โหลดผลงานที่คุณให้ความสำคัญเก็บไว้ หรือเรียกใช้เครื่องมือ get_result อีกรอบเพื่อขอรับลิงก์อัปเดตใหม่ และประเด็นที่สองคือ ไฟล์สื่อที่ถูกสร้างขึ้นจะถูกจัดเก็บไว้ในเซิร์ฟเวอร์เพียง 30 วันก่อนจะถูกลบออกไปถาวร เนื่องจากระบบเซิร์ฟเวอร์ MCP ทำหน้าที่เป็นเพียงท่อสำหรับประมวลผลงานสร้างสรรค์ไม่ใช่ระบบคลังเก็บข้อมูล ทั้งนี้ ทุกรายการผลงานที่คุณสั่งสร้างผ่านระบบ MCP จะปรากฏอยู่ในหน้ารายการประวัติการสร้างรูปภาพในบัญชีเว็บของคุณด้วยเช่นกัน ทำให้คุณสามารถเข้าไปเปิดชมและเลือกดาวน์โหลดไฟล์กลับมาได้ผ่านหน้าเว็บไซต์หลักภายในระยะเวลาที่กำหนดเก็บรักษาไฟล์ครับ