اگر در حوزه تدریس، تولید محتوا، طراحی گرافیک، طراحی سایت و هر حوزه دیگری که با عکس و طرحهای گرافیکی سروکار دارد، مشغول به کار هستید، حتما با چالش پیدا کردن تصاویر مناسب دستوپنجه نرم میکنید. در دنیای فناوری امروز، هوش مصنوعی ساخت عکس میتواند تاثیر به سزایی در پیشبرد اهداف ما داشته باشد. پس تا دیر نشده بهتر است این تکنولوژی شگفتانگیز را وارد چرخه فعالیتهای خود کنید.
تولید تصویر از یک توصیف متنی ساده، یکی از جاافتادهترین کاربردهای هوش مصنوعی است و دهها ابزار تولید تصویر مبتنی بر هوش مصنوعی در دسترس هستند که طیف گستردهای از امکانات، ویژگیها، و سبکهای بصری را ارائه میدهند.
در کمتر از دو سال، شاهد پیشرفت ابزارهایی مثل Midjourney بودهایم؛ از تولید تصاویر کمکیفیت و تقریبا غیرقابل شناسایی از انسان، تا خلق تصاویر واقعگرایانه با کیفیت بالا که بهسختی از عکسهای واقعی قابل تشخیص هستند.
در این مقاله به بررسی و معرفی بهترین ابزارهای هوش مصنوعی ساخت عکس میپردازیم. پس تا آخر این مقاله با ما همراه باشید.
۱. ساخت عکسهایی خارقالعاده با هوش مصنوعی جدید متا
شرکت متا (مالک اینستاگرام، واتساپ و فیسبوک) همچنان یکی از سخاوتمندترین گزینههای رایگان برای ساخت عکس با هوش مصنوعی است و پس از اولین عرضه، نحوه استفاده از آن همچنان به همان شکل آسان است: «کافی است به وبسایت meta.ai (که حالا با آدرس imagine.meta.com هم در دسترس است) بروید، با حساب فیسبوک یا اینستاگرام خود لاگین کنید، و عکس دلخواهتان را بسازید».
برای تولید عکس هنوز میتوانید با کلمه «Imagine» یا حتی سادهتر با عبارت «create an image» پرامپت خود را شروع کنید (مثلا: Imagine Tehran in 2050) و هوش مصنوعی چهار نسخه از تصویر را در عرض چند ثانیه تحویل میدهد تا هرکدام را که پسندیدید دانلود کنید. گزینه Edit برای نزدیکتر کردن خروجی به تصور ذهنیتان هم همچنان در دسترس است.
دسترسی و قابلیتها
علاوه بر وبسایت، میتوانید مستقیما داخل اینستاگرام، واتساپ و مسنجر هم با تگ کردن Meta AI در چت، عکس بسازید؛ همان بکاند مشترک؛ فقط در بستر متفاوت.
متا یک قابلیت جدید به نام Vibes اضافه کرده که اجازه میدهد تصویر تولیدشده را به یک ویدیو کوتاه و متحرک (با صدا یا صحبت) نیز تبدیل کنید؛ نه فقط یک عکس ثابت.
در ژوئن ۲۰۲۶، متا مدل تصویرسازی جدیدتری به نام Muse Image معرفی کرد که کاربردهایی مثل تبلیغات و دکوراسیون را هدف قرار داده است؛ البته این معرفی با واکنشهای انتقادی کاربران درباره نحوه استفاده از عکسهای شخصی همراه بود.
همچنان هیچ محدودیت روزانه مشخصی برای تعداد پرامپت وجود ندارد و نیازی به کارت اعتباری نیست؛ هیچ تضمینی نیست که رایگانبودن این ابزار، برای همیشه ادامه پیدا کند.
2. ساخت عکس با هوش مصنوعی GPT Image 2
شاید بتوان گفت بسیاری از مردم، انقلاب هوش مصنوعی را با شرکت OpenAI و ChatGPT شناختند. یکی از ابزارهای مهم این شرکت در حوزه تولید تصویر نیز DALL·E 3 بود که سالها بهعنوان موتور تولید تصویر ChatGPT مورد استفاده قرار میگرفت. بااینحال، این مدل اکنون بازنشسته شده است.
OpenAI در ۴ مارس ۲۰۲۶ بهطور رسمی DALL·E 3 را کنار گذاشت و در ۲۱ آوریل ۲۰۲۶، مدل جدید GPT Image 2 را بهعنوان سومین نسل از مدلهای پرچمدار تولید تصویر خود معرفی کرد. پیش از آن نیز دو نسخه میانی با نامهای gpt-image-1 و gpt-image-1.5 عرضه شده بودند.
تفاوت با نسخههای قبلی
تفاوت GPT Image 2 با نسلهای قبلی فقط به کیفیت بالاتر تصاویر محدود نمیشود. مدلهای DALL·E بر پایه معماری diffusion ساخته شده بودند؛ اما مدلهای GPT Image، از معماری autoregressive استفاده میکنند. این تغییر معماری به مدل اجازه میدهد درک دقیقتری از دستور کاربر داشته باشد و کنترل بیشتری روی جزئیات تصویر ارائه دهد.
قابلیتهای دیگر GPT Image 2
در GPT Image 2 میتوان تصویر موجود را ویرایش و به تصویر دیگری تبدیل کرد، تصاویر واقعگرایانهتری ساخت و دستورهای پیچیده را با دقت بیشتری اجرا کرد. یکی از قابلیتهای قابلتوجه این مدل، حالت Thinking است. در این حالت، مدل میتواند پیش از تولید تصویر، برای یافتن اطلاعات موردنیاز در وب جستوجو کند و سپس بر اساس همان اطلاعات تصویر را بسازد. همچنین میتواند از یک پرامپت واحد، چند تصویر هماهنگ تولید کند؛ برای مثال، مجموعهای از تصاویر با سبک و شخصیتهای یکسان برای یک کمپین تبلیغاتی.
GPT Image 2 بهصورت بومی از تولید تصویر با وضوح 2K پشتیبانی میکند و نسخه بتای تولید تصویر با وضوح 4K نیز از ماه می ۲۰۲۶ ارائه شده است. یکی دیگر از پیشرفتهای مهم آن، نمایش دقیقتر متن داخل تصاویر است؛ قابلیتی که در مدلهای قبلی، از جمله DALL·E، یکی از نقاط ضعف شناختهشده محسوب میشد.

3. تولید تصویر با Fotor
به کمک هوش مصنوعی ساخت عکس Fotor، کلمات و جملات مورد نظر خود را به تصاویر شگفتانگیز تبدیل کنید. Fotor دیگر یک ابزار تکمدله نیست؛ در حال حاضر بهعنوان یک هاب چندمدله عمل میکند و به کاربران اجازه میدهد بین چند موتور ساخت عکس از جمله GPT Image 2 ،Nano Banana Pro (گوگل)، Flux AI و Gemini AI یکی را انتخاب کنند و همچنین سبکهای مختلفی مثل عکسهای هنری، کارتونی، رنگ روغن، سهبعدی و… بسازند.
نسخه رایگان
نکته مهمی که باید درباره نسخهی رایگان بدانید این است اعتبار رایگان Fotor نسبت به قبل محدودتر شده است. در حال حاضر کاربران تازهوارد، چیزی حدود ۶ تا ۸ اعتبار رایگان (بسته به نوع ابزار) برای ساخت عکس دریافت میکنند.
برخلاف قبل، بخش اصلی قابلیت تولید تصویر با هوش مصنوعی، عملا به پلنهای پولی Pro+ منتقل شده؛ در این پلن حدود ۱۰۰ اعتبار در ماه (هر اعتبار مساوی یک تصویر) با رزولوشن تا ۲۰۴۸×۲۰۴۸ پیکسل در اختیار کاربر قرار میگیرد، و تصاویر تولیدشده در پلن رایگان معمولا واترمارک دارند.
Fotor علاوه بر ابزارهای هوش مصنوعی ساخت عکس، همچنان مجموعه بزرگی از ابزارهای ویرایش تصویر مثل حذف پسزمینه، حذف اشیا، آپاسکیل کردن، تبدیل عکس به ویدیو و ابزارهای طراحی گرافیک را هم در اختیارتان قرار میدهد.

4. ساخت عکس با غول ادوبی Adobe Firefly
Adobe Firefly در ابتدا یک ابزار اختصاصی برای تولید تصویر با هوش مصنوعی بود؛ اما در سال ۲۰۲۶، نقش آن بهطور قابلتوجهی تغییر کرده است. Firefly حالا بیشتر از یک مدل تولید تصویر است و میتوان آن را یک استودیو خلاقانه همهکاره مبتنی بر هوش مصنوعی دانست.
مهمترین تغییر Firefly این است که دیگر به مدلهای اختصاصی ادوبی محدود نیست. از اوایل سال ۲۰۲۶، ادوبی مدلهای شرکتهای دیگر را نیز به این پلتفرم اضافه کرده است. برای مثال، کاربران میتوانند از مدلهایی مانند Google Nano Banana Pro ،GPT Image شرکت OpenAI ،Runway Gen-4 و Flux از Black Forest Labs در محیط Firefly استفاده کنند. در مجموع، بیش از ۲۵ تا ۳۰ مدل مختلف در این پلتفرم در دسترس قرار گرفتهاند و کاربر میتواند بدون خروج از Firefly، مدل مناسب را انتخاب و بین مدلها جابهجا شود.
به بیان ساده، Firefly تلاش میکند تجربهای شبیه به یک مرکز واحد برای ابزارهای مختلف تولید محتوای هوش مصنوعی ایجاد کند؛ بهجای اینکه برای استفاده از هر مدل، به یک وبسایت یا ابزار جداگانه بروید.
قابلیتهای جدید Firefly در سال ۲۰۲۶
Firefly علاوه بر تولید تصویر، قابلیتهای جدیدی برای ویرایش و تولید محتوای خلاقانه نیز ارائه کرده است:
ویرایش مکالمهای در Photoshop
با دستیار هوش مصنوعی فتوشاپ، میتوانید بهجای کار کردن با ابزارهای پیچیده، تغییر موردنظر خود را با زبان طبیعی بیان کنید؛ مثلاً بگویید «فرد سمت چپ را حذف کن» یا «آسمان را دراماتیکتر کن» و هوش مصنوعی این تغییر را برایتان انجام دهد.
Custom Models
این قابلیت اجازه میدهد یک مدل شخصیسازیشده بر اساس مجموعه تصاویر خودتان ایجاد کنید. در نتیجه، مدل میتواند سبک بصری یا ویژگیهای خاص موردنظر شما را بهتر درک کند.
Firefly AI Assistant
ک دستیار هوش مصنوعی است که میتواند مانند یک همکار خلاق در فرایند تولید و ویرایش محتوا کمک کند.
ارتباط با ابزارهای حرفهای ادوبی
Firefly بیش از گذشته با نرمافزارهایی مانند Photoshop ،Premiere Pro و After Effects یکپارچه شده است. همین موضوع باعث میشود Firefly برای طراحان، تدوینگران و تولیدکنندگان محتوایی که از اکوسیستم Adobe استفاده میکنند، کاربرد ویژهای داشته باشد.

5. هوش مصنوعی ساخت عکس رایگان Bing Image Creator
ابزاری که پیشتر با نام Bing Image Creator شناخته میشد، طی چند مرحله برندسازی مجدد توسط مایکروسافت، دیگر با همین نام مستقل عرضه نمیشود. مایکروسافت چت بینگ را به Copilot تغییر نام داد و در ادامه، خود ابزار Image Creator را هم بهعنوان بخشی از برند Microsoft Designer با نام «Image Creator from Designer» ادغام کرد. با این حال آدرس bing.com/create همچنان کار میکند و سادهترین راه دسترسی به این ابزار است، فارغ از اینکه مایکروسافت این فصل چه نامی رویش گذاشته باشد.
برای استفاده کافی است با مرورگر Edge (یا هر مرورگر دیگری) به آدرس bing.com/create بروید، یا از اپلیکیشن Copilot در ویندوز، موبایل یا حتی داخل Word و Paint به آن دسترسی پیدا کنید. ورود با حساب کاربری مایکروسافت هنوز لازم است تا از سهمیه کامل بهرهمند شوید.
محدودیت تولید تصویر در Microsoft Copilot
در مورد محدودیت استفاده از Copilot، یک نکته مهم وجود دارد: «عدد قدیمی ۱۳ پرامپت در روز، دیگر معیار دقیقی برای توضیح محدودیت این سرویس نیست. سازوکار فعلی، بیشتر بر اساس مفهوم Boost کار میکند».
کاربران رایگان معمولا هر هفته حدود ۱۵ Boost دریافت میکنند. Boost در واقع سهمیه تولید سریع تصویر است؛ یعنی تا زمانی که Boost داشته باشید، درخواستهای تولید تصویر با سرعت بیشتری پردازش میشوند. هر پرامپت نیز معمولا چند نسخه از تصویر، مثلا چهار خروجی، تولید میکند.
اما تمام شدن Boost به این معنی نیست دیگر نمیتوانید تصویر بسازید. پس از پایان این سهمیه، تولید تصویر همچنان امکانپذیر است؛ اما درخواستها وارد صف پردازش کندتر میشوند. در این حالت، ممکن است تولید هر تصویر چند دقیقه زمان ببرد و محدودیت مشخصی برای تعداد تولید در روز یا هفته وجود نداشته باشد.

۶. کار با Midjourney برای ساخت عکس
Midjourney دیگر فقط یک بات در Discord نیست. این شرکت از سال ۲۰۲۴، یک وباپلیکیشن مستقل در midjourney.com راهاندازی کرده که در سال ۲۰۲۶ به نسخه نهایی رسیده است. در این محیط میتوانید از بخش Create برای تولید تصویر، از Explore برای دیدن آثار و پرامپتهای کاربران و از ابزارهای ویرایش تصویر مانند inpainting و outpainting استفاده کنید. بنابراین، دیگر نیازی به استفاده از Discord ندارید؛ هرچند بات Discord همچنان فعال است.
از نظر مدل، V7 مدتی مدل پیشفرض Midjourney بود و قابلیتهایی مانند رندر دقیقتر متن و Omni Reference را ارائه میکرد؛ اما از ۱۱ ژوئن ۲۰۲۶، مدل جدیدتر V8.1 به مدل استاندارد تبدیل شده است. Midjourney همچنین از سال ۲۰۲۵، امکان تولید ویدیو را نیز فراهم کرده و میتواند تصاویر ثابت را به کلیپهای کوتاه تبدیل کند.
هزینه این ابزار
Midjourney پلن رایگان دائمی ندارد و هزینه اشتراک بر اساس میزان استفاده از GPU تعیین میشود:
- Basic: ماهانه ۱۰ دلار
- Standard: ماهانه ۳۰ دلار
- Pro: ماهانه ۶۰ دلار، با قابلیت Stealth برای خصوصی نگه داشتن پروژهها
- Mega: ماهانه ۱۲۰ دلار برای استفاده سنگین
پرداخت سالانه نیز حدود ۲۰ درصد ارزانتر است. همه پلنها به وباپلیکیشن، Discord و جدیدترین مدل دسترسی دارند و تفاوت اصلی آنها در سرعت و میزان استفاده از GPU است؛ نه کیفیت تصویر. Midjourney همچنان یکی از ابزارهای محبوب برای تولید تصاویر هنری، واقعگرایانه و سینمایی است و در حوزههایی مانند بازیسازی، فیلمسازی و طراحی بصری کاربرد گستردهای دارد.

7. هوش مصنوعی Leonardo.ai برای ساخت عکس
Leonardo.ai همچنان یکی از سخاوتمندترین ابزارها از نظر سهمیه رایگان است؛ همان عدد ۱۵۰ اعتبار (token) رایگان روزانه هنوز پابرجاست و بدون تاریخ انقضا در دسترس کاربران قرار دارد (تنها نکته اینکه تصاویر ساختهشده در پلن رایگان بهصورت عمومی قابل مشاهدهاند).
Leonardo در ۲۹ ژوئن ۲۰۲۴ توسط کانوا (Canva) خریداری شد؛ اما همچنان بهعنوان یک محصول مستقل با پلنهای اعتباری خودش فعالیت میکند و مدلهای آن همزمان موتور برخی ابزارهای Magic Studio در خود کانوا را تشکیل میدهند.
انواع مدلها
مدل PhotoReal که پیشتر پرچمدار Leonardo برای فتورئالیسم بود، دیگر مدل اصلی این پلتفرم نیست. در حال حاضر خانواده مدلهای اختصاصی Leonardo شامل Phoenix (بهترین گزینه برای پیروی دقیق از پرامپت، صحنههای چندعنصری پیچیده و رندر تصویر از طرح دستی) و Lucid Origin / Lucid Realism (برای فتورئالیسم و رندر متریالها) است.
علاوه بر این، مدلهای ثالث مثل FLUX (Dev و Schnell)، Nano Banana Pro ،Veo ،Kling و Sora هم مستقیما در همان محیط Leonardo قابل استفاده هستند.
ابزار Realtime Canvas
Realtime Canvas یک بوم طراحی زنده در Leonardo.ai است. روی آن طرحی دستی میکشید یا شکلهای ساده را جابهجا میکنید، هوش مصنوعی همزمان و تقریبا بیدرنگ، (حدود ۲ ثانیه به ازای هر ضربهقلم) آن را به یک تصویر کامل و باکیفیت تبدیل میکند. این یعنی بهجای نوشتن یک پرامپت و منتظر ماندن برای نتیجه، ترکیببندی و فرم صحنه را با دست میسازید و مدل همزمان جزئیات، نور و بافت را روی آن اضافه میکند.
قیمتگذاری
از نظر قیمتگذاری، پلنهای پولی از حدود ۱۲ دلار در ماه (Essential/Apprentice) شروع میشوند و در پلنهای Premium و Ultimate، تولید در حالت «relax» روی مدلهای اختصاصی Leonardo (Phoenix، Lucid) نامحدود میشود؛ اما مدلهای ثالث پریمیوم مثل Veo ،Kling، Sora و Nano Banana Pro، همیشه از اعتبار (token) کم میکنند؛ صرفنظر از سطح اشتراک.

۸. ساخت عکس و عکسنوشته با Ideogram
Ideogram یکی از بهترین گزینهها برای ساخت تصاویری است که متن بخش مهمی از آنهاست؛ مثلا پوستر، تبلیغات، کارت تبریک یا محتوای شبکههای اجتماعی. البته سهمیه رایگان این ابزار نسبت به گذشته کاهش پیدا کرده است. عدد قدیمی ۲۵ پرامپت در روز دیگر معتبر نیست و کاربران رایگان اکنون حدود ۱۰ اعتبار کند (Slow) در هفته دریافت میکنند.
کاربران رایگان همچنان میتوانند قابلیتهایی مانند Style، Remix و Magic Fill را امتحان کنند؛ اما تصاویر آنها عمومی است و امکان آپلود تصویر مرجع نیز ندارند.
Ideogram 4.0
در ۲۲ ژوئیه ۲۰۲۶، Ideogram 4.0 معرفی شد که همچنان یکی از قدرتمندترین مدلها برای رندر دقیق متن داخل تصویر محسوب میشود. قابلیت Magic Prompt نیز همچنان فعال است و با بهبود خودکار پرامپت، به تولید نتیجه بهتر کمک میکند.
اگر امکانات نسخه رایگان کافی نیست، پلنهای پولی از ۸ دلار در ماه شروع میشوند و تا ۲۰ دلار برای Plus و ۶۰ دلار برای Pro ادامه دارند. در پلنهای پولی، تولید در حالت Slow نامحدود است، هرچند ممکن است به دلیل صف پردازش تا حدود ۲۰ دقیقه زمان ببرد و علاوه بر آن، مقدار مشخصی اعتبار Fast نیز در اختیار کاربر قرار میگیرد.

۹. ساخت عکس با هوش مصنوعی رایگان؛ Pixilart AI
Pixilart یک پلتفرم خلاقانه برای هنرمندان دیجیتال و بهخصوص علاقهمندان به Pixel Art است که ابزارهای هوش مصنوعی را نیز در اختیار کاربران قرار میدهد.
مزیت اصلی Pixilart، سادگی و ترکیب ابزار AI با یک ویرایشگر کامل Pixel Art است. البته امسال ابزارهای تخصصیتری مانند Sprite AI و PixelLab نیز وارد این حوزه شدهاند و امکانات پیشرفتهتری، مانند تبدیل یک شخصیت به نماهای مختلف یا ساخت مستقیم Sprite Sheet، ارائه میدهند.
بااینحال، اگر دنبال ابزاری ساده و رایگان هستید که تولید تصویر با هوش مصنوعی را با ویرایش دستی Pixel Art در یک محیط ترکیب کند، Pixilart همچنان گزینه مناسبی است.

۱۰. هوش مصنوعی حرفهای Runway؛ اکنون Gen-4.5
اگر در نسخه قبلی مقاله با Gen-2 آشنا شدهاید، باید بدانید Runway از آن زمان تغییرات زیادی کرده است. مدلهای فعلی این شرکت شامل Gen-4 ،Gen-4 Turbo و Gen-4.5 هستند و Gen-4.5 جدیدترین و باکیفیتترین مدل آن محسوب میشود.
Gen-4 بیشتر برای تبدیل تصویر به ویدیو استفاده میشود؛ یعنی یک تصویر و پرامپت متنی به مدل میدهید و یک کلیپ کوتاه دریافت میکنید. قابلیت Text-to-Video بدون نیاز به تصویر ورودی، از Gen-4.5 به بعد ارائه شده است.
Runway علاوه بر کنترل دقیق حرکت، سرعت، دوربین و سبک بصری، قابلیتهای پیشرفتهتری نیز دارد. برای مثال، Aleph امکان ویرایش ویدیو با دستورهای متنی را فراهم میکند و Act-Two میتواند حرکات و اجرای یک بازیگر را به شخصیت دیگری منتقل کند. همچنین Runway Media Router امکان دسترسی به برخی مدلهای شخص ثالث مانند Google Veo و Kling را از داخل همین پلتفرم فراهم میکند.
هزینه این ابزار
پلنهای پولی Runway از حدود ۱۲ دلار در ماه برای Standard شروع میشوند و تا ۲۸ دلار برای Pro و ۷۶ دلار برای Max ادامه دارند. یک پلن رایگان محدود نیز برای آزمایش اولیه وجود دارد. Runway امروز یکی از ابزارهای مهم تولید و ویرایش ویدیو با هوش مصنوعی است و بهخصوص برای تولیدکنندگان محتوای حرفهای، فیلمسازان و طراحان بصری کاربرد زیادی دارد.

۱۱. هوش مصنوعی Niji Journey
Niji Journey همچنان یکی از گزینههای محبوب برای تولید تصاویر با سبک انیمه، فانتزی و شخصیتمحور است. این ابزار برای ساخت شخصیتها، صحنههای فانتزی و آثار با سبک ژاپنی طراحی شده و بخش زیادی از قابلیتهای اصلی آن همچنان پابرجاست.
تغییر مهم این است که Niji Journey دیگر فقط از طریق Discord قابل استفاده نیست و اکنون یک اپلیکیشن مستقل برای iOS و Android نیز دارد. اگر اشتراک خود را از طریق Discord تهیه کرده باشید، میتوانید حساب Discord را به اپلیکیشن متصل کنید و همان اشتراک را در هر دو محیط داشته باشید. کاربران جدید نیز میتوانند مستقیما از طریق حساب Apple یا Google در اپلیکیشن ثبتنام کنند.

۱۲. هوش مصنوعی Nano Banana؛ اکنون با نسخه حرفهای Nano Banana Pro
Nano Banana نامی است که گوگل برای مدلهای تصویرسازی خود استفاده میکند و برخلاف تصور برخی کاربران، یک وبسایت مستقل رسمی ندارد. نسخه اصلی این مدل همچنان برای ویرایشهای سریع، مانند حذف پسزمینه، اصلاح رنگ و تغییرات ساده، کاربردی است.
اما در نوامبر ۲۰۲۵، گوگل نسخه قدرتمندتری با نام Nano Banana Pro معرفی کرد که نام رسمی آن Gemini 3 Pro Image است. این مدل از قابلیت Thinking استفاده میکند؛ یعنی پیش از تولید تصویر، ساختار و ترکیببندی آن را بهتر تحلیل میکند.
Nano Banana Pro میتواند تصاویری با کیفیت تا 4K تولید کند، چندین تصویر مرجع را در یک درخواست ترکیب کند و با استفاده از اطلاعات جستوجوی گوگل، برای مواردی مانند طراحی اینفوگرافیک یا بازسازی مکانهای واقعی، خروجی دقیقتری ارائه دهد. همچنین در رندر متن داخل تصویر عملکرد بسیار خوبی دارد.
دسترسی و سهمیه استفاده
برای استفاده از این مدل میتوانید به Google AI Studio یا اپلیکیشن Gemini مراجعه کنید. کاربران رایگان Gemini سهمیه محدودی برای تولید تصویر دارند و پس از پایان آن، به نسخه عادی Nano Banana بازمیگردند. کاربران پلنهای پولی Google AI نیز سهمیه بیشتری دریافت میکنند.
در نهایت، هنگام جستوجوی Nano Banana مراقب وبسایتهای غیررسمی با نامهای مشابه باشید. برای اطمینان، بهتر است استفاده از این مدل را از مسیرهای رسمی ارائهشده توسط Google انجام دهید.

پاسخ به سوالات رایج درباره ساخت عکس با هوش مصنوعی
ساخت عکس با هوش مصنوعی برای بسیاری از افراد هنوز موضوعی تازه و همراه با پرسشهای مختلف است. در ادامه، به چند سوال رایج درباره نحوه کار این فناوری، واقعی بودن تصاویر و مسائل اخلاقی آن پاسخ میدهیم.
۱. هوش مصنوعی چگونه تصاویر را میسازد؟
امروزه بیشتر ابزارهای ساخت تصویر با هوش مصنوعی از فناوریهایی مانند Diffusion و Autoregressive استفاده میکنند. برخلاف گذشته که GANها فناوری اصلی این حوزه بودند، مدلهای جدید روشهای متفاوت و پیشرفتهتری برای ساخت تصویر دارند.
مدلهای Diffusion
در مدلهای Diffusion، فرایند تولید تصویر را میتوان شبیه بیرون کشیدن یک تصویر از دل نویز تصور کرد. هوش مصنوعی کار را با یک تصویر پر از نویز شروع میکند و سپس در چند مرحله، نویزهای اضافی را کنار میزند تا به تصویری برسد که با توضیح یا Prompt شما مطابقت داشته باشد.
مدلهای Autoregressive
مدلهای Autoregressive روش متفاوتی دارند. این مدلها تصویر را مرحلهبهمرحله پیشبینی و تکمیل میکنند؛ روشی که از جهاتی شبیه نحوه تولید متن توسط مدلهای زبانی است.
برخی از مدلهای جدید نیز پیش از تولید تصویر، مرحلهای برای Thinking یا استدلال دارند. در این مرحله، مدل میتواند ابتدا درخواست شما را تحلیل و ترکیببندی تصویر را برنامهریزی کند و سپس سراغ تولید نهایی برود. نتیجه این فرایند، معمولا کنترل بهتر جزئیات و تطابق بیشتر تصویر با دستور شما است.
در هر دو روش، مدل با استفاده از حجم بسیار زیادی از دادههای آموزشی، الگوهایی مانند شکل اشیا، رنگها، سبکهای بصری و ارتباط میان کلمات و تصاویر را یاد گرفته است.
۲. آیا تصاویر ساختهشده با هوش مصنوعی واقعی هستند؟
خیر. حتی اگر یک تصویر تولیدشده با هوش مصنوعی کاملا واقعی به نظر برسد، عکس واقعی بهمعنای ثبت یک لحظه در دنیای واقعی نیست.
مدل هوش مصنوعی هنگام تولید تصویر، از الگوهایی که در فرایند آموزش یاد گرفته استفاده میکند و بر اساس درخواست شما تصویری جدید ایجاد میکند؛ بنابراین ممکن است تصویری از فرد، مکان یا رویدادی بسازد که هرگز در دنیای واقعی وجود نداشته است.
البته مدلهای جدید به حدی پیشرفته شدهاند که تشخیص برخی تصاویر تولیدشده با AI از عکسهای واقعی، حتی برای انسانها نیز دشوار است. به همین دلیل، هنگام مشاهده تصاویر بسیار واقعی در اینترنت، نمیتوان صرفا بر اساس ظاهر آنها درباره واقعی بودنشان قضاوت کرد.
۳. آیا استفاده از تصاویر ساختهشده با هوش مصنوعی اخلاقی است؟
صرف استفاده از هوش مصنوعی برای ساخت تصویر لزوما غیراخلاقی نیست؛ مسئله اصلی، نحوه استفاده از آن است.
برای مثال، استفاده از AI برای طراحی یک پوستر، تصویرسازی یک مقاله یا ایدهپردازی بصری میتواند کاملا کاربردی و مسئولانه باشد؛ اما ساخت Deepfake، جعل تصویر یک فرد واقعی، انتشار تصاویر گمراهکننده یا استفاده از آثار دیگران بدون توجه به حقوق مالکیت معنوی، میتواند مشکلات جدی اخلاقی و حقوقی ایجاد کند.
موضوع دیگری که در سالهای اخیر اهمیت بیشتری پیدا کرده، امکان تشخیص محتوای تولیدشده با هوش مصنوعی است. برای مثال، فناوریهایی مانند SynthID گوگل میتوانند اطلاعاتی نامرئی را در برخی تصاویر تولیدشده با هوش مصنوعی قرار دهند تا در آینده امکان شناسایی منشأ آنها وجود داشته باشد.
بنابراین، هنگام استفاده از تصاویر هوش مصنوعی بهتر است علاوه بر کیفیت تصویر، به حقوق مالکیت معنوی، حریم خصوصی، احتمال ایجاد اطلاعات نادرست و شفافیت درباره منشأ محتوا نیز توجه کنیم. استفاده مسئولانه از این فناوری فقط به این معنا نیست که بتوانیم تصویر موردنظرمان را بسازیم؛ بلکه باید بدانیم کجا، چگونه و با چه هدفی از آن استفاده کنیم.
آینده هوش مصنوعی در تولید تصاویر
بسیاری از پیشبینیهایی که چند سال پیش درباره آینده تولید تصویر با هوش مصنوعی مطرح میشد، در سال ۲۰۲۶ دیگر پیشبینی نیستند؛ بلکه به قابلیتهای واقعی و روزمره ابزارهای هوش مصنوعی تبدیل شدهاند.
تخصصی شدن و شخصیسازی
زمانی تصور میشد در آینده، مدلهای هوش مصنوعی برای کاربردهای تخصصیتر ساخته میشوند و کاربران بتوانند آنها را مطابق نیاز خود شخصیسازی کنند. این اتفاق اکنون رخ داده است.
برای مثال، Midjourney علاوه بر مدلهای عمومی، مدل تخصصی Niji را برای تولید تصاویر انیمه و فانتزی ارائه میکند. ابزارهایی مانند Leonardo.ai و Adobe Firefly نیز امکان ساخت Custom Models را فراهم کردهاند؛ یعنی میتوان مدل را بر اساس مجموعهای از تصاویر دلخواه آموزش داد تا خروجیها با سبک یا ویژگیهای موردنظر کاربر هماهنگتر شوند.
تولید محتوای تعاملی
ایدهای که زمانی آیندهنگرانه به نظر میرسید، یعنی طراحی یک طرح اولیه و تبدیل همزمان آن به یک تصویر کامل، اکنون در برخی ابزارها عملی شده است.
قابلیتهایی مانند Realtime Canvas در Leonardo.ai و AI Markup در Adobe Firefly به کاربر اجازه میدهند طرحی ساده ایجاد کند و هوش مصنوعی تقریبا همزمان آن را به تصویری کاملتر تبدیل کند. در نتیجه، فاصله میان ایده اولیه و نتیجه نهایی بسیار کمتر شده است.
پرامپتنویسی؛ از یک مهارت تخصصی تا فرایندی سادهتر
Prompt Engineering در ابتدا یکی از مهارتهای مهم برای کار با ابزارهای تولید تصویر بود؛ اما ابزارهای جدید بهتدریج نیاز به نوشتن پرامپتهای پیچیده را کاهش دادهاند.
برای مثال، Magic Prompt در Ideogram و قابلیت Thinking در مدلهایی مانند Nano Banana Pro میتوانند درخواست ساده کاربر را تحلیل و تکمیل کنند. بهاینترتیب، حتی اگر کاربر نتواند پرامپت دقیقی بنویسد، هوش مصنوعی میتواند بخشی از این کار را خودش انجام دهد.
چالشهای اخلاقی؛ از نگرانی به راهکارهای عملی
مسائلی مانند کپیرایت، مالکیت معنوی و Deepfake که زمانی بیشتر بهعنوان نگرانیهای آینده مطرح میشدند، اکنون به موضوعاتی جدی و عملی تبدیل شدهاند.
برای نمونه، Adobe برای برخی مشتریان سازمانی خود IP Indemnification ارائه میدهد و Google نیز با استفاده از فناوری SynthID امکان شناسایی منشأ هوش مصنوعی برخی تصاویر را فراهم میکند. این اقدامات نشان میدهند صنعت هوش مصنوعی، بهتدریج در حال ایجاد راهکارها و چارچوبهایی برای استفاده مسئولانهتر از محتوای تولیدشده با AI است.
آیندهای در انتظار ما؛ همکاری یا جایگزینی؟
با وجود تمام این پیشرفتها، یک نکته همچنان پابرجاست: «هوش مصنوعی جایگزین درک انسانی از احساسات، فرهنگ، سلیقه و هدف یک پروژه نشده است».
اتفاقی که در حال رخ دادن است، بیشتر شبیه شکلگیری یک همکاری جدید میان انسان و ماشین است. پلتفرمهایی مانند Adobe Firefly و Leonardo.ai نیز دیگر صرفا ابزارهایی برای «تولید تصویر» نیستند و بیشتر بهعنوان استودیوی خلاقانه یا فضای کار خلاقانه عمل میکنند.
در این مدل، انسان ایده، جهت، سلیقه و تصمیم نهایی را تعیین میکند و هوش مصنوعی بخش زیادی از اجرای فنی و زمانبر کار را با سرعت بیشتری انجام میدهد.
بنابراین، آینده تولید تصویر احتمالاً نه درباره انتخاب میان انسان یا هوش مصنوعی، بلکه درباره این است که چگونه میتوان از تواناییهای هر دو در کنار یکدیگر استفاده کرد. هرچه ابزارهای هوش مصنوعی قدرتمندتر شوند، نقش انسان از «اجراکننده» به طراح، کارگردان و تصمیمگیرنده خلاق نزدیکتر خواهد شد.
در حقیقت، آینده نه در رقابت؛ بلکه در همکاری میان انسان و ماشین است. طراحان گرافیک و هنرمندانی که این ابزارها را میپذیرند و یاد میگیرند چگونه از آنها به بهترین شکل استفاده کنند، پیشگامان نسل جدید خلاقیت خواهند بود.
برای اطلاعات بیشتر و رفع ابهامات در مورد آینده شغلی طراحان گرافیک در عصر هوش مصنوعی، پیشنهاد میکنیم مقاله «آیا هوش مصنوعی میتواند جایگزین طراحان گرافیک شود؟» را مطالعه کنید.
میانگین امتیاز 4.6 / 5. تعداد آرا: 46

13 دیدگاه برای “12 هوش مصنوعی ساخت عکس”
بسیار عالی. ممنون
در ابتدا تشکر میکنم بابت مطلب کامل و دقیقتون.
برای دوستانی که باز گیج شدن بین این چند تا که معرفی شده کدوم بهتره بنده به عنوان کسی که نزدیک به یک سال شده که سروکار دارم با خلق تصویر توسط هوش مصنوعی میگم راحت ترین ابزار یکی freepik و یکی Dall-E در چت GPTهست. اگر پیشرفته تر میخوان (به شرط پرامپت دقیق و خوب) هوش مصنوعی Midjourney گزینه بهتری برای حرفه ای ها هست. برای مدرس ها به نظرم همون freepik کفایت میکنه.
سپاسگزارم بسیار عالی وبا ارزش بود
ممنونم
خیلی خوب بود. درود بر شما استاد
بسيار عالي و آموزنده.ممنونم
چقدر کاربردی بود
کاربردی بود
خیلی کامل و عالی
آموزشهای استاد بقوسیان واقعاً کارآمد و موثر هستند از آموزشهای مفید مدیر سبز نهایت سپاس و قدردانی دارم.
دنیا داره عجیب تر و جالب تر میشه
بسیار جالب بود ممنون
بسیار عالی. ممنون
تولید تصاویر به وسیله هوش مصنوعی بسیار جذابه و خیلی در طراحی ها میتونه کمک کنه.
شاد و موفق باشید استاد