چگونه از Nano Banana در Google AI Studio و Gemini استفاده کنیم

به‌روزرسانی شده در 5 سپتامبر 2025

1 دقیقه


1. مقدمه

Nano Banana مدل پیشرفته تولید و ویرایش تصویر گوگل است که به‌طور رسمی با نام Gemini 2.5 Flash Image شناخته می‌شود. این فناوری پیشگامانه نه تنها تصاویر واقع‌گرایانه‌ای بر اساس دستورات زبان طبیعی ایجاد می‌کند، بلکه امکان ویرایش دقیق و ویژگی‌های ترکیبی پیشرفته را که پیش‌تر برای هوش مصنوعی چالش‌برانگیز بود، فراهم می‌آورد. با ترکیب قدرت تکنیک‌های مختلف پردازش تصویر — از جمله ادغام چند تصویر، تغییر سبک و حفظ ثبات شخصیت‌ها — Nano Banana نحوه برخورد توسعه‌دهندگان، طراحان و تولیدکنندگان محتوا با وظایف دستکاری و تولید تصویر را متحول کرده است.
در این راهنما، یک آموزش جامع و گام‌به‌گام ارائه می‌دهیم که نحوه استفاده از Nano Banana در Google AI Studio و از طریق API Gemini را توضیح می‌دهد. ما نحوه دسترسی به ابزار، تولید تصویر از دستورات توصیفی، ویرایش تصاویر موجود با حفظ ثبات شخصیت‌ها و بهره‌گیری از ویژگی‌های پیشرفته مانند ادغام چند تصویر و انتقال سبک را بررسی خواهیم کرد. هر مرحله در این راهنما با توضیحات دقیق، مثال‌های کد عملی و مصورسازی‌ها پشتیبانی شده است تا فرآیند را برای شما قابل فهم کرده و این منبع را برای حرفه‌ای‌ها و علاقه‌مندان ضروری سازد.

2. آشنایی با Nano Banana و Gemini 2.5 Flash Image

Nano Banana که گاهی با نام رمز «nano-banana» شناخته می‌شود، نمایانگر یک تحول مهم در ویرایش و تولید تصویر مبتنی بر هوش مصنوعی است. این ابزار که به‌عنوان بخشی از به‌روزرسانی Gemini 2.5 Flash Image معرفی شده، به‌صورت یکپارچه با Google AI Studio و خدمات Vertex AI ادغام می‌شود و نیازهای توسعه‌دهندگان و کاربران سازمانی را پوشش می‌دهد. ویژگی‌های پیشرفته آن شامل:
تولید هدفمند تصویر: تولید تصاویر فوتورئالیستی از دستورات متنی با استفاده از زبان طبیعی.
ویرایش بی‌وقفه تصویر: انجام ویرایش‌های دقیق مانند تغییرات هدفمند، تعویض پس‌زمینه یا افزودن اشیاء خاص بدون نیاز به تنظیمات دستی.
ثبات شخصیت‌ها: حفظ یکپارچگی بصری سوژه‌ها در تصاویر متعدد برای اطمینان از ثبات برند و شخصیت در داستان‌سرایی.
ادغام چند تصویر: ترکیب چندین تصویر در یک صحنه فوتورئالیستی منسجم که با زمینه‌های طراحی مختلف سازگار است.
انتقال سبک: تبدیل تصاویر به سبک‌های هنری مختلف (مانند آبرنگ، نوستالژیک یا مینیمالیسم مدرن) در حالی که عناصر ساختاری حفظ می‌شوند.
این قابلیت‌ها همراه با سرعت و مقرون‌به‌صرفه بودن مدل (با هزینه ۳۰ دلار برای هر یک میلیون توکن و هزینه تقریبی هر تصویر حدود ۰.۰۳۹ دلار به دلیل مصرف حدود ۱۲۹۰ توکن)، Nano Banana را به ابزاری ایده‌آل برای حرفه‌ای‌های خلاق، بازاریابان و توسعه‌دهندگانی تبدیل کرده که به دنبال کارایی و دقت هستند.

3. شروع کار با Google AI Studio

Google AI Studio یک رابط وب کاربرپسند ارائه می‌دهد که به کاربران امکان می‌دهد بدون نیاز به دانش عمیق برنامه‌نویسی، با Nano Banana آزمایش کنند. در اینجا نحوه شروع کار آمده است:

3.1 ورود و دسترسی به مدل

دسترسی به Google AI Studio: مرورگر وب خود را باز کنید و به پرتال Google AI Studio مراجعه کنید. با حساب Google خود وارد شوید.
انتخاب مدل Gemini: پس از ورود، به بخش اختصاص داده شده به مدل‌های Gemini بروید. به دنبال «Gemini 2.5 Flash Image» (که به نام nano-banana نیز شناخته می‌شود) بگردید و روی آن کلیک کنید. این بخش حالت «ساخت» ساده‌ای را ارائه می‌دهد که می‌توانید ویژگی‌های تولید و ویرایش تصویر را مستقیماً از مرورگر تست کنید.
کاوش در برنامه‌های قالب: Google AI Studio همچنین برنامه‌های قالبی دارد که ویژگی‌های کلیدی مانند حفظ ثبات شخصیت و ترکیب چند تصویر را نشان می‌دهند. این برنامه‌ها قابل سفارشی‌سازی هستند و به شما نگاهی مستقیم به قابلیت‌های Nano Banana می‌دهند بدون اینکه نیاز باشد کد بنویسید.

3.2 استفاده از رابط استودیو

در رابط Google AI Studio:
تولید مبتنی بر پرامپت: یک پرامپت طبیعی و دقیق را در فیلد ورودی متن مشخص شده وارد کنید. به عنوان مثال، می‌توانید وارد کنید: "نمایی فوتورئالیستی از داخل یک کافه مدرن با نورپردازی گرم و بافت‌های نرم."
آپلود تصویر برای ویرایش: اگر می‌خواهید یک تصویر موجود را ویرایش کنید، به سادگی آن را با استفاده از آپلودر تصویر ارائه شده بارگذاری کنید و سپس تغییرات مورد نیاز خود را توصیف کنید. برای مثال، «افکت آبرنگی ملایم اضافه کن و روشنایی را افزایش بده» ورودی قابل قبولی خواهد بود.
تولید و ریمیکس: این رابط به شما امکان می‌دهد نه تنها تصاویر را تولید کنید بلکه آن‌ها را ریمیکس، تکرار و اصلاح کنید و با اعمال ویرایش‌های بیشتر، اطمینان حاصل کنید که محصول نهایی به طور کامل با دید خلاقانه شما هماهنگ است.
گوگل بازخوردی درباره کیفیت پرامپت ارائه می‌دهد و حتی پیش‌نمایش زنده‌ای از ریمیکس را فراهم می‌کند تا ببینید تصویر چگونه با هر تغییر تکامل می‌یابد. این روند کاری به ویژه زمانی مفید است که قصد دارید ثبات شخصیت را در چندین تصویر حفظ کنید یا کنترل دقیقی بر عناصر بصری خاص داشته باشید.

4. استفاده از API Gemini برای تولید و ویرایش تصویر

برای توسعه‌دهندگان و کسانی که با برنامه‌نویسی راحت هستند، API Gemini دسترسی برنامه‌نویسی به Nano Banana را فراهم می‌کند. این API انعطاف‌پذیری و قابلیت‌های یکپارچه‌سازی با برنامه‌های سفارشی، اپلیکیشن‌های موبایل و سایر پلتفرم‌های سازمانی را ارائه می‌دهد.

4.1 راه‌اندازی محیط

قبل از نوشتن کد، باید محیط توسعه خود را تنظیم کنید:
نصب بسته‌های مورد نیاز: از دستور زیر برای نصب کتابخانه‌های پایتون لازم استفاده کنید: هدف بسته google-genai کلاینت رسمی برای دسترسی به مدل‌های Gemini python-dotenv ذخیره و دسترسی امن به کلیدهای API PIL (Pillow) قابلیت‌های پردازش و ذخیره تصویر دستور نمونه ترمینال: pip install google-genai python-dotenv pillow این دستور تمام بسته‌های لازم را نصب می‌کند تا بتوانید اتصال به API Gemini را آغاز کنید.
کلید API را امن کنید: یک فایل .env ایجاد کنید تا کلید API خود را به‌صورت امن ذخیره کنید: GEMINI_API_KEY=your_actual_api_key اطمینان حاصل کنید که این فایل در .gitignore قرار گرفته باشد تا از افشای تصادفی اطلاعات حساس جلوگیری شود.

4.2 نوشتن کد پایه

در ادامه یک اسکریپت ساده پایتون آورده شده که نحوه تولید تصویر با استفاده از Nano Banana در Gemini API را نشان می‌دهد:
from google import genai
from PIL import Image
from io import BytesIO
import os
from dotenv import load_dotenv
load_dotenv() # بارگذاری کلید API از فایل .env
client = genai.Client(api_key=os.getenv("GEMINI_API_KEY"))
# تعریف متن ورودی برای تولید تصویر
prompt = "نمای شهری آینده‌نگر در غروب با چراغ‌های نئون که روی خیابان‌های خیس از باران بازتاب می‌یابند"
# درخواست تولید تصویر از Gemini 2.5 Flash Image
response = client.models.generate_content(
model="gemini-2.5-flash-image-preview",
contents=[prompt]
)
# استخراج و ذخیره تصویر تولید شده
for part in response.candidates[0].content.parts:
if part.inline_data is not None:
image = Image.open(BytesIO(part.inline_data.data))
image.save("generated_image.png")
print("تصویر با نام generated_image.png ذخیره شد")
این اسکریپت نمونه نشان می‌دهد چگونه می‌توان با استفاده از Gemini API در پایتون کار کرد. این اسکریپت:
کلید API را بارگذاری می‌کند
یک نمونه از کلاینت می‌سازد
یک متن طبیعی برای تولید تصویر ارسال می‌کند
پاسخ را تجزیه کرده و تصویر را به صورت PNG ذخیره می‌کند.

4.3 ویرایش تصویر موجود

می‌توان از همان API برای ویرایش تصاویر نیز استفاده کرد. برای مثال، اگر تصویری به‌صورت محلی ذخیره شده و بخواهید با Nano Banana آن را ویرایش کنید، می‌توانید چنین بنویسید:
from PIL import Image
from io import BytesIO
# بارگذاری تصویر موجود برای ویرایش
image_to_edit = Image.open("path/to/your/image.png")
# تعریف متن ویرایش
edit_prompt = "با استفاده از تصویر ارائه شده، سبک قدیمی با رنگ‌های گرم سپیا و پس‌زمینه کمی مات اضافه کن"
response = client.models.generate_content(
model="gemini-2.5-flash-image-preview",
contents=[edit_prompt, image_to_edit]
)
# پردازش پاسخ برای ذخیره تصویر ویرایش شده
for part in response.candidates[0].content.parts:
if part.inline_data is not None:
edited_image = Image.open(BytesIO(part.inline_data.data))
edited_image.save("edited_image.png")
print("تصویر ویرایش شده با نام edited_image.png ذخیره شد")
این قطعه کد نشان می‌دهد چگونه می‌توان هم یک پرامپت و هم یک تصویر را به مدل ارائه داد، تا مدل تصویر ورودی را بر اساس مشخصات شما تغییر دهد در حالی که عناصر بصری مهم مانند حالت چهره شخصیت‌ها یا جزئیات پس‌زمینه حفظ شود.

۵. راهنمای جامع: فرآیند تولید تصویر

در این بخش، یک راهنمای جامع برای تولید تصویر جدید با استفاده از Nano Banana در Google AI Studio و API جیمنی ارائه می‌دهیم. مراحل زیر فرآیند را از طراحی اولیه پرامپت تا خروجی نهایی تصویر شرح می‌دهد.

۵.۱ طراحی پرامپت

تولید مؤثر تصویر با یک پرامپت خوب و دقیق آغاز می‌شود. پرامپت باید جزئی و مشخص باشد تا مدل بتواند نتیجه مطلوب را درک کند. به‌عنوان مثال، این پرامپت را در نظر بگیرید:
«یک تصویر فوتورئالیستی از یک کلبه آرام در کنار دریاچه در پاییز تولید کن. صحنه باید شامل درختان رنگارنگ پاییزی، موج‌های ملایم روی دریاچه و نور گرم تابیده شده از پنجره‌های کلبه باشد که حس آرامش را القا کند.»
این پرامپت توصیف واضحی از عناصر مورد نظر ارائه می‌دهد—کلبه، محیط کنار دریاچه، رنگ‌های پاییزی، آب بازتاب‌دهنده و نورپردازی جوی. هرچه توصیف دقیق‌تر باشد، احتمال تولید تصویری که مطابق انتظار شما باشد بیشتر است.

۵.۲ استفاده از Google AI Studio برای تولید تصویر

وارد کردن پرامپت: به بخش Gemini 2.5 Flash Image در Google AI Studio بروید. پرامپت خود را در کادر متنی وارد کنید.
تولید تصویر: دکمه «Generate» را فشار دهید. سیستم پرامپت زبان طبیعی شما را پردازش کرده و پیش‌نمایشی از تصویر تولید شده را نمایش می‌دهد. هوش مصنوعی با استفاده از دانش گسترده جهان جیمنی، جزئیاتی مانند نورپردازی، بافت و رنگ را به دقت بازتولید می‌کند.
بازبینی و تکرار: اگر تصویر تولید شده کاملاً مطابق معیارهای شما نیست، پرامپت را اصلاح کنید. جزئیاتی مانند شرایط نوری یا ترکیب اشیاء را تنظیم کنید تا به نتیجه مطلوب برسید. این فرآیند تکراری برای دستیابی به خروجی‌های با کیفیت بالا در پروژه‌های خلاقانه اهمیت دارد.

۵.۳ ذخیره و بهبود خروجی

پس از رضایت از پیش‌نمایش، می‌توانید تصویر را مستقیماً از Google AI Studio ذخیره کنید. این پلتفرم همچنین گزینه‌هایی برای ویرایش بیشتر خروجی با استفاده از پرامپت‌های اضافی ارائه می‌دهد—فرآیندی که امکان تنظیم دینامیک محتوا را فراهم می‌کند.
نمونه نتیجه
تصوری از تصویری که دقیقاً چشم‌انداز شما را به تصویر می‌کشد: کلبه‌ای کنار دریاچه با نوری نرم و گرم که روی آب ملایم موج‌دار بازتاب می‌یابد، احاطه شده توسط جنگلی که با رنگ‌های پاییزی می‌درخشد. هر عنصر—از بافت چوب کلبه تا ظرافت‌های برگ‌های فصلی—با دقت بالا بازسازی شده است.

۶. راهنمای جامع: ویرایش تصویر با Nano Banana

ویرایش یک تصویر موجود یکی از نقاط قوت برجسته Nano Banana است. چه بخواهید عناصر جدید اضافه کنید، رنگ‌ها را تغییر دهید یا ویژگی‌های خاصی را اصلاح کنید، این فرآیند ساده است.

۶.۱ بارگذاری تصویر پایه

تصویر خود را انتخاب کنید: در Google AI Studio، از قابلیت بارگذاری تصویر استفاده کنید تا تصویری که می‌خواهید ویرایش کنید را وارد کنید. به‌عنوان مثال، ممکن است یک پرتره یا یک عکس منظره بارگذاری کنید.
تعریف نیاز ویرایش: به‌طور واضح و دقیق توضیح دهید چه چیزی باید تغییر کند. یک درخواست مفید می‌تواند این باشد: «با استفاده از تصویر ارائه شده، یک عینک مطالعه باریک و شیک به چهره سوژه اضافه کنید در حالی که نورپردازی و سبک اصلی حفظ شود.»

6.2 پردازش ویرایش از طریق Gemini API

هنگام استفاده از Gemini API برای ویرایش‌ها، مراحل زیر را دنبال کنید:
بارگذاری تصویر: از کتابخانه Pillow برای خواندن تصویر از سیستم فایل محلی خود استفاده کنید.
ارائه درخواست ویرایش: تصویر را همراه با یک متن دقیق که ویرایش مورد نظر را مشخص می‌کند، ارسال کنید. این می‌تواند شامل دستورالعمل‌هایی برای تغییرات سبک (مانند افزودن فیلترهای قدیمی یا تغییر مدل مو) باشد تا سیستم زمینه را به‌خوبی درک کند.
استخراج نسخه ویرایش شده: API داده‌های تصویر ویرایش شده را برمی‌گرداند و شما می‌توانید به‌راحتی با استفاده از کدی مشابه نمونه تولید قبلی، این تصویر را استخراج و ذخیره کنید.

6.3 حفظ هماهنگی بصری

یکی از نوآوری‌های قابل توجه در Nano Banana توانایی حفظ ثبات شخصیت است. هنگام ویرایش، حتی تغییرات شدید در پس‌زمینه، نورپردازی یا سبک، ویژگی‌های اصلی سوژه حفظ می‌شود. این ویژگی به‌ویژه برای موارد زیر مفید است:
ویرایش پرتره: تغییر پس‌زمینه یا افزودن لوازم جانبی در حالی که ویژگی‌های چهره یکسان باقی می‌ماند.
برندسازی و بازاریابی: اطمینان از اینکه لوگوها، شخصیت‌های نمایشی یا کاراکترهای کلیدی در تصاویر مختلف هماهنگ باقی می‌مانند.
با دادن دستوری مانند «این شخصیت دقیق را با همان ویژگی‌های چهره و حالت نشان بده»، از توانایی مدل در شناسایی و بازتولید جزئیات تصویر بهره‌مند می‌شوید.
نمونه کد برای حفظ ثبات
from PIL import Image
from io import BytesIO
base_image = Image.open("path/to/your/portrait.png")
consistency_prompt = "Generate a new image using the provided portrait as reference. The subject should be smiling and looking directly at the camera, with the same facial features and style."
response = client.models.generate_content(
model="gemini-2.5-flash-image-preview",
contents=[consistency_prompt, base_image]
)
for part in response.candidates[0].content.parts:
if part.inline_data is not None:
consistent_image = Image.open(BytesIO(part.inline_data.data))
consistent_image.save("consistent_image.png")
print("تصویر هماهنگ با نام consistent_image.png ذخیره شد")
این اسکریپت تضمین می‌کند که هر تغییری که اعمال می‌شود، هویت اصلی سوژه را تغییر ندهد.

7. ویژگی‌های پیشرفته: ترکیب چند تصویر، انتقال سبک و حفظ ثبات شخصیت

Nano Banana فراتر از تولید و ویرایش ساده می‌رود — قابلیت‌های پیشرفته آن واقعاً آن را متمایز می‌کند.

7.1 ادغام چند تصویر

ادغام چند تصویر فرآیند ترکیب عناصر از تصاویر مختلف در یک تصویر یکپارچه است. این روش به‌ویژه برای عکاسی محصول، ساخت کلاژ و پروژه‌های طراحی پیچیده مفید است.
نحوه عملکرد:
ورودی چند تصویر: تا سه تصویر را به عنوان ورودی ارائه دهید. برای مثال، یک تصویر می‌تواند به عنوان پس‌زمینه، تصویر دیگر به عنوان موضوع اصلی و سوم به عنوان پوشش یا اکسسوری باشد.
جزئیات فرآیند ادغام: از یک دستور جامع مانند «این تصاویر را ترکیب کن تا یک صحنه فوتورئالیستی ایجاد شود که محصول به‌طور یکپارچه در یک محیط شهری مدرن قرار گرفته باشد.» استفاده کنید.
تولید ادغام: API Gemini عناصر بصری را به‌صورت هوشمندانه ادغام می‌کند و اطمینان حاصل می‌کند که سایه‌ها، بافت‌ها و نورپردازی به‌درستی ترکیب شده‌اند.
نمونه کد ادغام
from PIL import Image
from io import BytesIO
# بارگذاری چند تصویر
background = Image.open("path/to/background.png")
product = Image.open("path/to/product.png")
fusion_prompt = "پس‌زمینه را با تصویر محصول ترکیب کن. محصول را به‌طور طبیعی در صحنه قرار بده و اطمینان حاصل کن که نور و سایه‌ها هماهنگ باشند."
response = client.models.generate_content(
model="gemini-2.5-flash-image-preview",
contents=[fusion_prompt, background, product]
)
for part in response.candidates[0].content.parts:
if part.inline_data is not None:
fusion_image = Image.open(BytesIO(part.inline_data.data))
fusion_image.save("fused_image.png")
print("تصویر ادغام شده با نام fused_image.png ذخیره شد")

7.2 انتقال سبک

انتقال سبک به شما امکان می‌دهد ظاهر یک تصویر را تغییر دهید در حالی که موضوع اصلی آن حفظ می‌شود. برای مثال، ممکن است بخواهید یک عکس را به نقاشی آبرنگ یا تصویرسازی قدیمی تبدیل کنید.
مراحل انتقال سبک:
انتخاب تصویر پایه: با یک تصویر واضح و با کیفیت بالا شروع کنید.
توصیف سبک مورد نظر: دستور شما باید جزئیاتی مانند «این تصویر را به یک نقاشی آبرنگ ظریف روی کاغذ سرد پرس با لبه‌های نرم و تفاوت‌های بافتی ظریف تبدیل کن.» را شامل شود.
اعمال سبک: مدل دستور را همراه با تصویر دریافت می‌کند و یک تصویر جدید با سبک هنری مورد نظر تولید می‌کند در حالی که ویژگی‌های کلیدی تصویر اصلی حفظ می‌شوند.

7.3 حفظ ثبات پیشرفته شخصیت

برای پروژه‌هایی که نیاز است یک موضوع در چندین زمینه مختلف ظاهر شود (مانند برندینگ یا داستان‌سرایی متوالی)، Nano Banana تضمین می‌کند که ویژگی‌های بصری کلیدی بین تولیدات یا ویرایش‌ها تغییر نکند. این کار با دستور دادن واضح به مدل با عباراتی مانند «حفظ ویژگی‌های صورت یکسان»، «نگه داشتن دقیق همین شخصیت» یا «حفظ DNA بصری موضوع» انجام می‌شود.
این قابلیت یکی از نقاط قوت اصلی Nano Banana را برجسته می‌کند و به خالقان امکان می‌دهد داستان بصری یکپارچه‌ای را در قالب‌های مختلف رسانه‌ای بسازند.

8. بهترین شیوه‌های مهندسی پرامپت

یکی از عوامل حیاتی که کیفیت تولید و ویرایش تصویر را تعیین می‌کند، نحوه فرموله کردن پرامپت‌ها است. در اینجا چند بهترین شیوه برای اطمینان از نتایج بهینه آورده شده است:

8.1 توصیفی و مشخص باشید

تمرکز بر زمینه: در پرامپت خود به جزئیات محیط، نورپردازی و حالت توجه کنید. برای مثال، «یک دفتر مدرن با نورپردازی محیطی» زمینه بیشتری نسبت به صرفاً «یک دفتر» ارائه می‌دهد.
شامل توصیف‌های فنی شوید: از اصطلاحاتی مانند «لنز پرتره 85 میلی‌متر»، «f/2 برای عمق میدان کم» یا «درخشش نرم و گرم» استفاده کنید تا سبک عکاسی خروجی را تحت تأثیر قرار دهید.

8.2 پالایش تدریجی

با یک پرامپت پایه شروع کنید تا نتیجه اولیه را بگیرید، سپس به تدریج آن را بهبود دهید:
اعمال تغییرات مشخص در مراحل تدریجی، برای مثال «اول لوازم جانبی را اضافه کن، سپس نور پس‌زمینه را تنظیم کن.»
از روش‌های ویرایش متوالی استفاده کنید تا جزئیات را بدون شروع از ابتدا هر بار اصلاح کنید.

8.3 استفاده از پرامپت‌های مثبت معنایی

به جای گفتن به مدل آنچه نمی‌خواهید، بر آنچه می‌خواهید تمرکز کنید. برای مثال، به جای گفتن «سایه تاریک را حذف کن»، بگویید «نور نرم و پخش شده‌ای اضافه کن تا ویژگی‌های سوژه برجسته شود.» این جهت مثبت به ویرایش‌های طبیعی‌تر و قابل باورتر منجر می‌شود.

8.4 حفظ یکنواختی بصری در ویرایش‌های چند مرحله‌ای

هنگام برنامه‌ریزی یک سری ویرایش روی همان تصویر:
هر بار همان مرجع بصری را ارائه دهید.
به وضوح مشخص کنید که هویت سوژه نباید تغییر کند با عباراتی مانند «این شخصیت دقیقاً» یا «حفظ ویژگی‌های یکسان.»

8.5 جدول مقایسه نمونه‌های پرامپت

جنبه
پرامپت کلی
پرامپت دقیق
توصیف صحنه
«کلبه‌ای کنار دریاچه»
«تصویر فوتورئالیستی از کلبه‌ای روستایی کنار دریاچه در پاییز با برگ‌های رنگارنگ و موج‌های آرام آب»
انتقال سبک
«ظاهر هنری به آن بده»
«این تصویر را به نقاشی ظریف آبرنگی با لبه‌های نرم و بافت کاغذی ملایم تبدیل کن»
ثبات شخصیت
«همان فرد را حفظ کن»
«تصویری با استفاده از پرتره ارائه شده بساز، به طوری که این شخصیت دقیقاً ویژگی‌های صورت یکسانی داشته باشد»
این جدول نشان می‌دهد که افزایش دقت چگونه به نتایج دقیق‌تر منجر می‌شود.

9. نمونه‌های کاربردی و نکات یکپارچه‌سازی

Nano Banana بسیار چندمنظوره است و در سناریوهای مختلف کاربرد دارد. در اینجا چند مثال عملی آورده شده است:

9.1 بازاریابی و برندینگ

دارایی‌های برند یکپارچه: بازاریابان می‌توانند از Nano Banana برای تولید تصاویر با کیفیت بالا استفاده کنند که ظاهر و احساس یکسانی را در کمپین‌های مختلف حفظ می‌کند. به عنوان مثال، تولید تصاویر محصول با ویژگی‌های ثابت یا ایجاد هویت بصری متحد برای نماد برند.
سازگارسازی کمپین: با ویرایش چندمرحله‌ای، یک تصویر می‌تواند به سرعت برای پیام‌های بازاریابی مختلف تطبیق یابد. برای مثال، تغییر سبک از فوتورئالیستی به نسخه‌ای هنری‌تر (مثلاً وینتیج یا مینیمالیستی) برای کمپین‌های گوناگون.

9.2 ایجاد محتوا برای شبکه‌های اجتماعی

نمونه‌سازی سریع تصاویر: تولیدکنندگان محتوا می‌توانند به‌راحتی تصاویر جذاب برای پلتفرم‌هایی مانند اینستاگرام، تیک‌تاک یا یوتیوب ایجاد کنند. سرعت Nano Banana (با تأخیر کم و پردازش مقرون‌به‌صرفه) تضمین می‌کند که ایده‌های محتوا به سرعت به واقعیت تبدیل شوند.
ویرایش پویا تصاویر: هنگامی که بازخورد دنبال‌کنندگان تغییرات جزئی مانند افزودن یا حذف عناصر را درخواست می‌کند، Nano Banana امکان تنظیمات مبتنی بر دستور را با حفظ کیفیت و هماهنگی بصری فراهم می‌آورد.

9.3 ویرایش حرفه‌ای تصویر و طراحی

بهبود تدریجی در عکاسی محصول: طراحان می‌توانند از قابلیت‌های ویرایش تکراری برای بهبود تصاویر محصول استفاده کنند—چه تنظیم نورپردازی و سایه‌ها باشد یا افزودن لوازم جدید به صحنه.
ترکیب چند تصویر برای پروژه‌های خلاقانه: عکاسان می‌توانند تصاویر را ترکیب کنند تا عکس‌های مرکبی بسازند که در غیر این صورت نیازمند ویرایش دستی پیچیده بود. به‌عنوان مثال، ادغام پس‌زمینه‌های مختلف با تصویر محصول برای شبیه‌سازی محیط‌های گوناگون.

9.4 ادغام در جریان‌های کاری موجود

Nano Banana به‌طور یکپارچه با ابزارهای خلاقانه محبوب ادغام می‌شود:
ادغام با Photoshop: برخی افزونه‌های توسعه‌یافته توسط جامعه امکان استفاده مستقیم از Nano Banana در Photoshop را فراهم می‌کنند. این ادغام «آخرین مرحله» به طراحان کمک می‌کند جریان کاری آشنا را حفظ کرده و در عین حال از توانایی‌های هوش مصنوعی برای ویرایش‌های پیچیده بهره‌مند شوند.
استقرار سازمانی با Vertex AI: برای پروژه‌های بزرگ‌مقیاس، شرکت‌ها می‌توانند Nano Banana را از طریق Vertex AI ادغام کنند، که راه‌حلی مقیاس‌پذیر برای تولید و ویرایش انبوه تصاویر ارائه می‌دهد—مناسب برای خطوط تولید محتوای خودکار در بازاریابی دیجیتال.

9.5 نمونه ادغام کد

در ادامه یک نمونه جامع نشان داده شده است که چگونه می‌توان با استفاده از Python و API Gemini تصاویر را تولید و ویرایش کرد:
from google import genai
from PIL import Image
from io import BytesIO
import os
from dotenv import load_dotenv
load_dotenv()
client = genai.Client(api_key=os.getenv("GEMINI_API_KEY"))
# مرحله 1: تولید تصویر بر اساس متن ورودی
generation_prompt = "غروب آرام بر فراز دریاچه‌ای آرام با ابرهای نرم و رنگ‌های گرم"
response_gen = client.models.generate_content(
model="gemini-2.5-flash-image-preview",
contents=[generation_prompt]
)
for part in response_gen.candidates[0].content.parts:
if part.inline_data is not None:
gen_image = Image.open(BytesIO(part.inline_data.data))
gen_image.save("sunset_lake.png")
print("تصویر تولید شده با نام sunset_lake.png ذخیره شد")
# مرحله 2: ویرایش تصویر موجود با افزودن یک شیء
base_image = Image.open("sunset_lake.png")
edit_prompt = "با استفاده از تصویر ارائه شده، یک قایق کوچک چوبی را به آرامی در حال حرکت روی دریاچه آرام وارد کنید، با بازتاب‌های واقعی."
response_edit = client.models.generate_content(
model="gemini-2.5-flash-image-preview",
contents=[edit_prompt, base_image]
)
for part in response_edit.candidates[0].content.parts:
if part.inline_data is not None:
edited_image = Image.open(BytesIO(part.inline_data.data))
edited_image.save("sunset_lake_boat.png")
print("تصویر ویرایش شده با نام sunset_lake_boat.png ذخیره شد")
این نمونه کد هم قابلیت تولید تصویر و هم ویرایش آن را با استفاده از Nano Banana ترکیب می‌کند و نشان می‌دهد که چگونه می‌توان ویرایش‌های پیشرفته را به صورت برنامه‌نویسی شده به آسانی انجام داد.

10. تجسم‌ها و نمودارهای جریان کاری

تجسم جریان کاری و مقایسه داده‌ها می‌تواند درک نحوه عملکرد Nano Banana در زمینه‌های مختلف را به طور قابل توجهی افزایش دهد. در ادامه سه تجسم ارائه شده است که جنبه‌های کلیدی این فرایند را به تصویر می‌کشند.

شکل 1: جدول مقایسه روش‌های دسترسی

پلتفرم
روش دسترسی
ویژگی‌های کلیدی
Google AI Studio
رابط وب
کاربرپسند؛ دارای سطح رایگان؛ برنامه‌های قالب برای دموها
Gemini API
برنامه‌نویسی (پایتون و غیره)
ادغام سفارشی؛ توسعه انعطاف‌پذیر با کلید API امن
Vertex AI
راه‌حل سازمانی
مقیاس‌پذیر؛ قوی برای استقرارهای بزرگ‌مقیاس؛ ادغام با جریان‌های کاری سازمانی
جدول 1: این جدول پلتفرم‌های مختلفی که Nano Banana از طریق آن‌ها قابل دسترسی است را مقایسه می‌کند و ویژگی‌ها و موارد استفاده منحصر به فرد هر کدام را برجسته می‌سازد.

شکل 2: نمودار جریان کاری برای استفاده از Nano Banana

نمودار جریان TD
A["شروع: تعریف نیازمندی‌ها"]
B["انتخاب پلتفرم: AI Studio یا Gemini API"]
C["ورود به حساب و دسترسی به تصویر فلش Gemini 2.5"]
D["وارد کردن درخواست توصیفی / بارگذاری تصویر"]
E["تولید تصویر اولیه"]
F["بررسی خروجی"]
G["تکرار: اصلاح درخواست یا ویرایش تصویر"]
H["نهایی‌سازی تصویر و ذخیره خروجی"]
A --> B
B --> C
C --> D
D --> E
E --> F
F --> G
G --> H
شکل ۲: این نمودار جریان فرآیند متوالی از تعریف نیازمندی‌ها تا نهایی‌سازی تصویر با استفاده از Nano Banana را نشان می‌دهد. این روند کاری بر اصلاحات تکراری و پردازش چند مرحله‌ای تأکید دارد.

شکل ۳: جریان یکپارچه‌سازی کد

نمودار جریان TD
A["شروع: راه‌اندازی محیط"]
B["نصب بسته‌های مورد نیاز"]
C["ایمن‌سازی کلید API (.env)"]
D["نوشتن اسکریپت پایتون با استفاده از google-genai"]
E["تعریف درخواست و/یا بارگذاری تصویر"]
F["فراخوانی Gemini API برای تولید/ویرایش"]
G["پردازش پاسخ و استخراج تصویر"]
H["ذخیره و بررسی خروجی"]
A --> B
B --> C
C --> D
D --> E
E --> F
F --> G
G --> H
شکل ۳: این نمودار جریان یکپارچه‌سازی کد برای راه‌اندازی محیط و استفاده از Gemini API جهت تولید یا ویرایش تصاویر با Nano Banana را نشان می‌دهد.

۱۱. نتیجه‌گیری

Nano Banana که با نام تجاری Gemini 2.5 Flash Image شناخته می‌شود، گامی تحول‌آفرین در حوزه تولید و ویرایش تصویر با هوش مصنوعی است. با ترکیب پردازش زبان طبیعی و ویژگی‌های پیشرفته بصری مانند ترکیب چند تصویر، انتقال سبک و حفظ سازگاری شخصیت، گوگل ابزاری را در اختیار توسعه‌دهندگان و طراحان قرار داده است که روندهای خلاقانه را ساده‌تر کرده و در عین حال کیفیت و دقت بالایی را حفظ می‌کند.

یافته‌های کلیدی:

یکپارچگی بی‌نقص: Nano Banana از طریق Google AI Studio، Gemini API و Vertex AI در دسترس است و امکان آزمایش‌های ساده تا پیاده‌سازی‌های سازمانی را فراهم می‌کند.
قابلیت‌های پیشرفته ویرایش: کاربران نه تنها می‌توانند تصاویر را از درخواست‌های دقیق تولید کنند، بلکه ویرایش‌های دقیقی مانند تغییر سبک، حفظ سازگاری شخصیت و ترکیب اشیاء را بدون از دست دادن اصالت بصری انجام دهند.
اصلاحات تکراری: فرآیند ویرایش تکراری امکان بهبود تدریجی را فراهم می‌کند تا تصاویر در جلسات متعدد به دقت تنظیم شوند.
اهمیت مهندسی درخواست: تهیه درخواست‌های دقیق و مثبت که شامل توصیفات فنی باشد، برای بهره‌برداری کامل از مدل ضروری است.
کاربردهای دنیای واقعی: از بازاریابی و برندینگ گرفته تا تولید محتوا و طراحی حرفه‌ای، Nano Banana انعطاف‌پذیری لازم برای پاسخگویی به طیف گسترده‌ای از نیازها را ارائه می‌دهد.

خلاصه مزایای اصلی:

سهولت استفاده: رابط کاربری وب شهودی Google AI Studio به کاربران امکان می‌دهد به‌راحتی تصاویر را تولید و ویرایش کنند.
انعطاف‌پذیری API: API Gemini رویکردی مقیاس‌پذیر و برنامه‌پذیر برای ادغام Nano Banana در برنامه‌های سفارشی فراهم می‌کند.
صرفه‌جویی در هزینه: قیمت‌گذاری مبتنی بر توکن قابل پیش‌بینی تضمین می‌کند که پروژه‌های خلاقانه در محدوده بودجه باقی بمانند.
ثبات و کیفیت: حفظ ثبات بصری در ویرایش‌ها و تضمین خروجی‌های تصویری با کیفیت بالا از جمله بهبودهای کلیدی نسبت به مدل‌های قبلی است.
Nano Banana معیار جدیدی در خلق تصاویر مبتنی بر هوش مصنوعی ایجاد کرده است. این نه تنها یک دستاورد فنی چشمگیر است، بلکه ابزاری کاربردی است که به خالقان امکان می‌دهد به سرعت نمونه‌سازی، تکرار و تولید تصاویر حرفه‌ای با حداقل دخالت دستی بپردازند.
در خلاصه، چه شما توسعه‌دهنده‌ای باشید که ویرایش تصویر پیشرفته را در برنامه خود ادغام می‌کند، چه طراح ایجادکننده تصاویر برند یکدست، یا تولیدکننده محتوا که به دنبال کشف رسانه‌های هنری جدید است، مجموعه جامع امکانات Nano Banana می‌تواند فرآیند خلاقانه شما را به طور قابل توجهی بهبود بخشد. پذیرش این فناوری اکنون می‌تواند راه را برای داستان‌سرایی بصری کارآمدتر و نوآورانه‌تر در آینده هموار کند.

با دنبال کردن دقیق این راهنمای گام‌به‌گام و اعمال بهترین روش‌های مطرح‌شده، می‌توانید پتانسیل کامل Nano Banana را در Google AI Studio و پلتفرم Gemini آزاد کنید. هر مرحله از فرایند — از ورود و راه‌اندازی محیط تا بهبود دستورات و پردازش خروجی‌ها — به گونه‌ای طراحی شده است که هم کیفیت بالا و هم سهولت ادغام را تضمین کند و بدین ترتیب جریان‌های کاری تصویر دیجیتال را برای طیف گسترده‌ای از کاربردها متحول نماید.

این راهنمای جامع کاملاً بر اساس اطلاعات پشتیبان و مثال‌های عملی از وبلاگ Google Developers، مقالات ImagineArt، و آموزش‌های گام‌به‌گام مختلف درباره Nano Banana تهیه شده است. تمامی جنبه‌های ابزار — از عملیات پایه تا تکنیک‌های خلاقانه پیشرفته — توسط ویژگی‌های مستند و تجربیات کاربران پشتیبانی می‌شود.