FLUX AI چیست؟ معرفی FLUX 3 و آموزش ساخت تصویر با API درواره

FLUX خانواده‌ای از مدل‌های مولد تصویر و ویدئو متعلق به Black Forest Labs است که برای تولید تصاویر واقع‌گرایانه، طراحی تبلیغاتی، ویرایش عکس، نمایش دقیق متن و استفاده از تصاویر مرجع کاربرد دارد. در این راهنما با FLUX 3، مدل‌های FLUX.2 و روش ساخت سرویس تولید تصویر با API درواره آشنا می‌شوید.

Share
FLUX AI چیست؟ معرفی FLUX 3 و آموزش ساخت تصویر با API درواره

FLUX یکی از شناخته‌شده‌ترین خانواده‌های مدل هوش مصنوعی برای تولید و ویرایش تصویر است. این مدل‌ها توسط شرکت Black Forest Labs توسعه داده شده‌اند و برای کاربردهایی مانند ساخت تصویر از متن، ویرایش عکس، تولید تصاویر تبلیغاتی، عکاسی محصول، طراحی رابط کاربری و ایجاد تصاویر دارای نوشته استفاده می‌شوند.

نسل‌های جدید FLUX تنها یک ابزار ساده تبدیل متن به عکس نیستند. این خانواده به‌تدریج به یک مجموعه چندوجهی برای تولید و درک تصویر، ویدئو و صوت تبدیل شده است.

در سال ۲۰۲۶، Black Forest Labs مدل FLUX 3 را به‌عنوان نسل جدید این خانواده معرفی کرد. FLUX 3 یک معماری چندوجهی برای تولید و درک تصویر، ویدئو، صوت و حتی پیش‌بینی عمل است. قابلیت ویدئویی آن می‌تواند کلیپ‌هایی تا ۲۰ ثانیه همراه با صدای هماهنگ تولید کند.

در کنار FLUX 3، مدل‌های FLUX.2 همچنان برای تولید و ویرایش تصویر در محیط‌های عملیاتی پشتیبانی می‌شوند. بنابراین کسب‌وکارها، طراحان و توسعه‌دهندگان می‌توانند براساس نوع پروژه از نسخه مناسب استفاده کنند.

در این مقاله بررسی می‌کنیم:

  • مدل FLUX چیست؟
  • FLUX را چه شرکتی ساخته است؟
  • تفاوت FLUX 3، FLUX.2 و FLUX.1 چیست؟
  • نسخه‌های Max، Pro، Flex، Dev و Klein چه تفاوتی دارند؟
  • FLUX برای چه کاربردهایی مناسب است؟
  • چگونه برای FLUX پرامپت حرفه‌ای بنویسیم؟
  • چگونه با Python و JavaScript یک برنامه تولید تصویر بسازیم؟
  • چگونه از مدل‌های تصویری از طریق API درواره استفاده کنیم؟
  • چگونه هزینه و کیفیت تولید تصویر را مدیریت کنیم؟

مدل FLUX چیست؟

FLUX مجموعه‌ای از مدل‌های هوش مصنوعی مولد است که می‌تواند براساس توضیح متنی، تصویر یا سایر ورودی‌های چندرسانه‌ای محتوای بصری تولید و ویرایش کند.

در ساده‌ترین حالت، کاربر یک توصیف متنی وارد می‌کند:

یک کافه مدرن ایرانی در یک صبح بارانی، پنجره‌های بزرگ،
نور طبیعی ملایم، طراحی داخلی مینیمال، عکاسی واقع‌گرایانه

مدل این توضیح را تحلیل و تصویری متناسب با آن تولید می‌کند.

در کاربردهای پیشرفته‌تر می‌توان از FLUX برای موارد زیر استفاده کرد:

  • ویرایش تصویر با دستور متنی
  • تغییر پس‌زمینه
  • جایگزینی اشیا
  • تغییر رنگ و جنس محصول
  • ساخت چند نمای تبلیغاتی از یک محصول
  • حفظ ظاهر یک شخصیت در تصاویر مختلف
  • تولید تصویر براساس چند عکس مرجع
  • ساخت پوستر و تصویر دارای نوشته
  • طراحی Mockup
  • تولید Storyboard
  • ساخت ویدئو از متن یا تصویر

سازنده FLUX چه شرکتی است؟

FLUX توسط Black Forest Labs توسعه داده شده است. این شرکت روی مدل‌های مولد و هوش بصری کار می‌کند و خانواده FLUX را در نسخه‌های مختلف تجاری و دارای وزن باز ارائه می‌دهد.

نام Black Forest Labs از منطقه جنگل سیاه آلمان گرفته شده است. این شرکت با تمرکز بر مدل‌های تولید تصویر شناخته شد، اما براساس مستندات رسمی Black Forest Labs، دامنه محصولات FLUX اکنون تولید و ویرایش تصویر و ویدئو، ایجاد صوت هماهنگ و کاربردهای چندوجهی دیگر را نیز شامل می‌شود.

FLUX 3 چیست؟

FLUX 3 نسل جدید خانواده FLUX است. برخلاف نسل‌های قبلی که بیشتر با تولید تصویر شناخته می‌شدند، FLUX 3 به‌عنوان یک مدل پایه چندوجهی طراحی شده است.

براساس صفحه رسمی FLUX 3، این خانواده برای تولید و درک موارد زیر توسعه یافته است:

  • تصویر
  • ویدئو
  • صوت
  • پیش‌بینی عمل

قابلیت‌های اعلام‌شده برای بخش ویدئویی FLUX 3 عبارت‌اند از:

  • تبدیل متن به ویدئو
  • تبدیل تصویر به ویدئو
  • ویرایش ویدئو با متن
  • ادامه‌دادن ویدئوی موجود
  • استفاده از فریم شروع و پایان
  • استفاده از چند Keyframe
  • تولید چند صحنه در یک کلیپ
  • تولید گفت‌وگوی چندزبانه
  • هماهنگی حرکت لب با گفتار
  • ساخت افکت صوتی و صدای محیط
  • تولید کلیپ تا ۲۰ ثانیه
  • خروجی از HD تا 4K
  • ساخت نسخه Draft پیش از رندر نهایی

عرضه قابلیت‌های خانواده FLUX 3 مرحله‌ای است. بنابراین دسترسی به تولید تصویر، ویدئو، Action Prediction یا وزن‌های باز ممکن است در زمان‌ها و سرویس‌های متفاوتی فراهم شود.

پیش از پیاده‌سازی، فهرست مدل‌های فعلی ارائه‌دهنده را بررسی کنید.

FLUX.2 چیست؟

FLUX.2 نسل قدرتمند مدل‌های تصویر Black Forest Labs است و برای تولید و ویرایش تصاویر حرفه‌ای استفاده می‌شود. این خانواده در مقایسه با نسل قبل، در مواردی مانند دنبال‌کردن پرامپت، واقع‌گرایی، نمایش نوشته و استفاده از تصاویر مرجع پیشرفت کرده است.

قابلیت‌های اصلی FLUX.2 عبارت‌اند از:

  • تولید تصویر با کیفیت بالا
  • ویرایش تصویر
  • پشتیبانی از چند تصویر مرجع
  • حفظ ظاهر شخصیت و محصول
  • نمایش دقیق‌تر نوشته
  • دنبال‌کردن دستورهای پیچیده
  • کنترل بهتر سبک و ترکیب‌بندی
  • تولید تصویر تبلیغاتی
  • عکاسی محصول
  • ساخت Infographic و Mockup

طبق اطلاعات رسمی Black Forest Labs، بعضی نسخه‌های FLUX.2 می‌توانند هم‌زمان از چند تصویر مرجع استفاده کنند و در کاربردهایی مانند کمپین تبلیغاتی یا تولید مجموعه تصاویر یک شخصیت، هماهنگی بیشتری ایجاد کنند.

تفاوت FLUX 3، FLUX.2 و FLUX.1

خانوادهتمرکز اصلیکاربرد مناسب
FLUX 3مدل چندوجهی تصویر، ویدئو، صوت و عملویدئو، تولید چندرسانه‌ای و جریان‌های کاری نسل جدید
FLUX.2تولید و ویرایش حرفه‌ای تصویرتبلیغات، عکاسی محصول، طراحی و ویرایش عکس
FLUX.1نسل اولیه تولید و ویرایش تصویرپروژه‌های قدیمی‌تر، مدل‌های متن‌باز و گردش‌های کاری موجود

FLUX.2 همچنان برای تولید تصویر در محیط عملیاتی پشتیبانی می‌شود. جدیدبودن FLUX 3 الزاماً به این معنا نیست که تمام پروژه‌های تصویری باید فوراً به آن منتقل شوند.

برای یک سرویس تولید عکس فروشگاهی، ممکن است FLUX.2 انتخاب باثبات‌تری باشد؛ درحالی‌که برای ساخت کلیپ تبلیغاتی همراه با صدا، FLUX 3 گزینه مرتبط‌تری است.

نسخه‌های مختلف FLUX.2

خانواده FLUX.2 در نسخه‌هایی با اهداف متفاوت عرضه شده است.

FLUX.2 Max

نسخه Max برای بیشترین کیفیت، دنبال‌کردن دقیق دستور و هماهنگی بهتر در وظایف پیچیده طراحی شده است.

کاربردهای مناسب:

  • کمپین تبلیغاتی حرفه‌ای
  • خروجی نهایی با کیفیت بالا
  • ویرایش‌های پیچیده
  • حفظ دقیق عناصر مرجع
  • پروژه‌هایی که کیفیت بر هزینه اولویت دارد

FLUX.2 Pro

نسخه Pro تعادلی میان کیفیت، سرعت و هزینه ارائه می‌کند و برای استفاده عملیاتی مناسب است.

کاربردهای مناسب:

  • تولید تصاویر سایت
  • عکاسی محصول
  • تبلیغات شبکه‌های اجتماعی
  • ساخت تصویر مقاله
  • تولید محتوای تجاری

FLUX.2 Flex

نسخه Flex بر کنترل بیشتر، جزئیات کوچک و نمایش دقیق‌تر نوشته تمرکز دارد.

کاربردهای مناسب:

  • پوستر
  • طراحی دارای تایپوگرافی
  • بسته‌بندی
  • Mockup رابط کاربری
  • Infographic
  • تصویری که نوشته بخش مهمی از آن است

FLUX.2 Dev

نسخه Dev برای توسعه‌دهندگان، پژوهشگران و جریان‌های کاری قابل استقرار ارائه شده است. شرایط استفاده و مجوز هر نسخه باید پیش از استفاده تجاری بررسی شود.

FLUX.2 Klein

نسخه Klein برای سرعت بیشتر و اجرای سبک‌تر طراحی شده است. این نسخه برای آزمایش پرامپت، ساخت Preview و تولید تعداد زیادی تصویر اولیه مناسب است.

نسخهاولویتکاربرد پیشنهادی
Maxبیشترین کیفیتخروجی نهایی و پروژه حساس به کیفیت
Proتوازن کیفیت و سرعتاستفاده عمومی و تجاری
Flexکنترل و نوشتهپوستر، UI و طراحی دارای متن
Devتوسعه و استقرارپروژه‌های فنی و سفارشی
Kleinسرعت و هزینه کمترنمونه اولیه و تولید انبوه Preview

نام و شناسه دقیق مدل‌ها ممکن است بین ارائه‌دهندگان متفاوت باشد. همیشه شناسه مدل را از فهرست همان سرویس انتخاب کنید.

FLUX چه کاربردهایی دارد؟

عکاسی محصول با هوش مصنوعی

می‌توان تصویر ساده محصول را به صحنه‌ای حرفه‌ای تبدیل کرد.

برای مثال، یک عکس ساعت روی زمینه سفید می‌تواند به تصویر تبلیغاتی زیر تبدیل شود:

ساعت مچی موجود در تصویر مرجع را بدون تغییر در شکل صفحه،
رنگ بند و لوگو، روی یک سطح سنگی تیره قرار بده. نورپردازی
استودیویی از سمت چپ، پس‌زمینه مشکی مات، بازتاب بسیار ظریف،
سبک عکاسی تبلیغاتی کالای لوکس.

ساخت تصاویر فروشگاه اینترنتی

برای هر محصول می‌توان چند نسخه تولید کرد:

  • تصویر روی پس‌زمینه ساده
  • تصویر Lifestyle
  • تصویر مناسب بنر
  • نمای نزدیک از جزئیات
  • تصویر عمودی برای شبکه اجتماعی
  • تصویر افقی برای صفحه محصول

طراحی تبلیغات

FLUX می‌تواند برای ساخت Concept اولیه تبلیغات، تصویر کمپین و پس‌زمینه بنر استفاده شود.

بهتر است نوشته‌های نهایی، قیمت و دکمه فراخوان در نرم‌افزار طراحی به تصویر اضافه شوند؛ مگر اینکه مدل و نسخه انتخابی در تولید متن عملکرد مناسبی داشته باشد.

حفظ شخصیت در چند تصویر

با استفاده از تصاویر مرجع می‌توان یک شخصیت را در موقعیت‌ها، لباس‌ها و محیط‌های مختلف بازآفرینی کرد.

این قابلیت برای موارد زیر کاربرد دارد:

  • داستان مصور
  • تولید محتوای سریالی
  • تبلیغات دارای شخصیت ثابت
  • آموزش تصویری
  • طراحی بازی
  • Storyboard

طراحی داخلی و معماری

یک تصویر ساده از اتاق می‌تواند برای آزمایش سبک‌های مختلف تغییر کند:

  • مینیمال
  • کلاسیک
  • اسکاندیناوی
  • صنعتی
  • مدرن ایرانی
  • ژاپنی
  • روستیک

طراحی رابط کاربری

نسخه‌های دارای توانایی بهتر در نمایش متن می‌توانند برای ساخت Concept رابط، داشبورد، صفحه فرود و Mockup اپلیکیشن استفاده شوند.

خروجی مدل باید به‌عنوان طرح اولیه در نظر گرفته شود. رابط نهایی همچنان باید در Figma یا محیط توسعه بازسازی شود.

ساخت تصویر شاخص مقاله

مدل FLUX برای تولید تصویر شاخص وبلاگ، تصویر آموزشی و تصویر مفهومی مناسب است؛ به‌ویژه زمانی که ترکیب‌بندی، فضای خالی برای عنوان و نسبت تصویر دقیق در پرامپت تعریف شوند.

چگونه برای FLUX پرامپت بنویسیم؟

پرامپت خوب فقط نام موضوع نیست. یک دستور تصویری حرفه‌ای باید عناصر صحنه، ترکیب‌بندی، نور، سبک، زاویه دوربین و محدودیت‌های خروجی را مشخص کند.

قالب پیشنهادی:

موضوع اصلی + محیط + ترکیب‌بندی + نورپردازی + زاویه دوربین +
سبک بصری + رنگ‌ها + جنس و جزئیات + نسبت تصویر + کاربرد نهایی

مثال ضعیف

یک عکس از کفش

مثال بهتر

عکاسی تبلیغاتی واقع‌گرایانه از یک کتانی سفید مینیمال روی سکوی
بتنی روشن، زاویه سه‌ربع از روبه‌رو، نور نرم استودیویی از سمت چپ،
سایه طبیعی، پس‌زمینه خاکستری بسیار روشن، جزئیات دقیق بافت پارچه
و بندها، ترکیب‌بندی خلوت، مناسب بنر فروشگاه اینترنتی، نسبت 16:9

اجزای یک پرامپت حرفه‌ای FLUX

موضوع اصلی

مشخص کنید چه چیزی باید در مرکز تصویر باشد:

یک بطری عطر شیشه‌ای با درپوش طلایی

محیط

روی میز سنگ مرمر مشکی در یک استودیوی تاریک

نورپردازی

نور باریک طلایی از پشت و نور نرم از سمت راست

زاویه دوربین

نمای نزدیک، لنز 85 میلی‌متری، زاویه کمی پایین‌تر از محصول

سبک

عکاسی تجاری لوکس و واقع‌گرایانه

رنگ‌بندی

پالت مشکی، طلایی و کهربایی

ترکیب‌بندی

محصول در یک‌سوم چپ تصویر و فضای خالی در سمت راست برای تیتر

محدودیت

فقط یک بطری، بدون دست، بدون اشیای اضافی، لوگوی محصول تغییر نکند

پرامپت کامل:

عکاسی تجاری واقع‌گرایانه از یک بطری عطر شیشه‌ای با درپوش طلایی
روی میز سنگ مرمر مشکی در استودیوی تاریک. نمای نزدیک با لنز
85 میلی‌متری و زاویه کمی پایین‌تر از محصول. نور باریک طلایی از
پشت و نور نرم از سمت راست، پالت مشکی، طلایی و کهربایی.
محصول در یک‌سوم چپ تصویر قرار داشته باشد و سمت راست فضای خالی
تمیز برای تیتر تبلیغاتی داشته باشد. فقط یک بطری نمایش داده شود،
بدون دست و اشیای اضافی. نسبت تصویر 16:9.

آیا FLUX از Negative Prompt پشتیبانی می‌کند؟

طبق راهنمای رسمی پرامپت‌نویسی FLUX، مدل‌های FLUX از Negative Prompt به شکل رایج در بعضی مدل‌های دیگر استفاده نمی‌کنند.

به‌جای نوشتن فهرست بلند از موارد منفی، خروجی مطلوب را با عبارت مثبت و روشن توصیف کنید.

به‌جای:

بدون شلوغی، بدون تارشدگی، بدون چند محصول، بدون پس‌زمینه رنگی

بنویسید:

ترکیب‌بندی مینیمال با یک محصول، فوکوس کاملاً واضح و پس‌زمینه
ساده خاکستری روشن

اگر وجود یک عنصر ممنوع اهمیت زیادی دارد، می‌توانید محدودیت را کوتاه و مستقیم بیان کنید؛ اما بخش اصلی پرامپت باید روی چیزی متمرکز باشد که می‌خواهید در تصویر دیده شود.

چند پرامپت آماده برای FLUX

تصویر محصول

عکاسی حرفه‌ای از یک هدفون مشکی مدرن روی میز چوبی تیره،
نورپردازی نرم استودیویی، نمای سه‌ربع، جزئیات دقیق بافت بدنه،
پس‌زمینه خاکستری تیره با عمق میدان کم، سبک تبلیغات فناوری،
ترکیب‌بندی خلوت، نسبت 4:5

تصویر شاخص مقاله

تصویر مفهومی مدرن درباره مدل‌های مولد تصویر، یک قاب دیجیتال
در سمت چپ که منظره‌ای واقع‌گرایانه از آن شکل می‌گیرد، پس‌زمینه
روشن با طیف فیروزه‌ای و نارنجی، فضای خالی زیاد در سمت راست برای
عنوان فارسی، طراحی مینیمال و حرفه‌ای، بدون نوشته، نسبت 16:9

طراحی داخلی

بازطراحی این اتاق نشیمن به سبک مدرن ایرانی، دیوارهای کرم روشن،
چوب گردویی، فرش ایرانی با رنگ‌های خنثی، نور طبیعی صبحگاهی،
مبلمان مینیمال، حفظ کامل ابعاد اتاق، محل پنجره‌ها و زاویه دوربین
تصویر مرجع، عکاسی معماری واقع‌گرایانه

عکس غذا

عکاسی حرفه‌ای از یک بشقاب زرشک‌پلو با مرغ، نمای 45 درجه،
برنج با جزئیات واضح، زرشک براق و خلال پسته، ظرف سرامیکی سفید،
میز چوبی روشن، نور طبیعی از کنار پنجره، پس‌زمینه محو،
سبک عکاسی منوی رستوران، نسبت 4:5

پوستر دارای نوشته

پوستر تبلیغاتی مینیمال برای یک کافه مدرن، فنجان قهوه در مرکز،
پس‌زمینه کرم و قهوه‌ای، سایه‌های نرم و هندسی. عبارت انگلیسی
“FRESH COFFEE” با حروف بزرگ و خوانا در بالای تصویر،
ترکیب‌بندی حرفه‌ای چاپ، نسبت 3:4

برای نوشته فارسی بهتر است چند خروجی آزمایشی تولید شود و متن نهایی در نرم‌افزار طراحی بازبینی یا اضافه شود.

استفاده از FLUX در درواره

درواره دسترسی یکپارچه به مدل‌های مختلف هوش مصنوعی را از طریق API فراهم می‌کند. توسعه‌دهنده می‌تواند بدون ایجاد اتصال و حساب جداگانه برای هر ارائه‌دهنده، مدل مناسب را از فهرست فعلی مدل‌ها انتخاب کند.

آدرس پایه API درواره:

https://api.darvareh.ir/v1

مراحل کلی استفاده:

  1. در درواره ثبت‌نام کنید.
  2. کیف پول را شارژ کنید.
  3. یک API Key بسازید.
  4. فهرست مدل‌های فعلی را بررسی کنید.
  5. شناسه مدل تصویری موردنظر را انتخاب کنید.
  6. درخواست تولید تصویر ارسال کنید.
  7. خروجی را در فضای ذخیره‌سازی برنامه خود نگه دارید.

شناسه مدل‌های FLUX ممکن است براساس نسخه و مسیر ارائه متفاوت باشد. به همین دلیل در نمونه‌های زیر از متغیر DARVAREH_IMAGE_MODEL استفاده می‌کنیم.

ساخت تصویر با FLUX و Python

ابتدا کتابخانه OpenAI را نصب کنید:

pip install openai

متغیرهای محیطی را تنظیم کنید:

Linux و macOS

export DARVAREH_API_KEY="YOUR_API_KEY"
export DARVAREH_IMAGE_MODEL="YOUR_FLUX_MODEL_ID"

Windows PowerShell

$env:DARVAREH_API_KEY="YOUR_API_KEY"
$env:DARVAREH_IMAGE_MODEL="YOUR_FLUX_MODEL_ID"

کد Python:

import base64
import os
from pathlib import Path

from openai import OpenAI


client = OpenAI(
    api_key=os.environ["DARVAREH_API_KEY"],
    base_url="https://api.darvareh.ir/v1",
)

MODEL_ID = os.environ["DARVAREH_IMAGE_MODEL"]


def generate_product_image(prompt: str) -> Path:
    result = client.images.generate(
        model=MODEL_ID,
        prompt=prompt,
        size="1024x1024",
        n=1,
    )

    image = result.data[0]
    output_path = Path("flux-product-image.png")

    if getattr(image, "b64_json", None):
        output_path.write_bytes(
            base64.b64decode(image.b64_json)
        )
        return output_path

    if getattr(image, "url", None):
        print(f"Image URL: {image.url}")
        return output_path

    raise ValueError("No image data was returned.")


prompt = """
عکاسی تبلیغاتی واقع‌گرایانه از یک ماگ سرامیکی سرمه‌ای
روی میز چوبی روشن، نور طبیعی نرم از پنجره، نمای سه‌ربع،
پس‌زمینه مینیمال کرم، سایه طبیعی، جزئیات دقیق سرامیک،
مناسب صفحه محصول فروشگاه اینترنتی، فقط یک ماگ در تصویر
"""

path = generate_product_image(prompt)
print(f"Saved to: {path}")

نوع پاسخ مدل ممکن است URL یا داده Base64 باشد. کد بالا هر دو حالت رایج را بررسی می‌کند. ساختار دقیق پارامترها و پاسخ را براساس مستندات مدل انتخاب‌شده تطبیق دهید.

ساخت تصویر با JavaScript و Node.js

ابتدا پروژه را ایجاد و کتابخانه را نصب کنید:

npm init -y
npm install openai dotenv

فایل .env:

DARVAREH_API_KEY=YOUR_API_KEY
DARVAREH_IMAGE_MODEL=YOUR_FLUX_MODEL_ID

فایل generate-image.mjs:

import "dotenv/config";
import fs from "node:fs/promises";
import OpenAI from "openai";

const client = new OpenAI({
  apiKey: process.env.DARVAREH_API_KEY,
  baseURL: "https://api.darvareh.ir/v1",
});

const result = await client.images.generate({
  model: process.env.DARVAREH_IMAGE_MODEL,
  prompt: `
    عکاسی حرفه‌ای از یک کیف چرمی قهوه‌ای روی پایه سنگی روشن،
    نور استودیویی نرم، پس‌زمینه بژ، نمای سه‌ربع، جزئیات دقیق
    چرم و دوخت، سبک تبلیغات کالای لوکس، نسبت تصویر مربع
  `,
  size: "1024x1024",
  n: 1,
});

const image = result.data[0];

if (image.b64_json) {
  await fs.writeFile(
    "flux-image.png",
    Buffer.from(image.b64_json, "base64")
  );

  console.log("Image saved as flux-image.png");
} else if (image.url) {
  console.log("Image URL:", image.url);
} else {
  throw new Error("No image data was returned.");
}

اجرا:

node generate-image.mjs

ساخت API تولید تصویر برای وب‌سایت

کلید API نباید مستقیماً در مرورگر یا اپلیکیشن سمت کاربر قرار گیرد. بهتر است درخواست کاربر ابتدا به Backend شما ارسال شود.

معماری پیشنهادی:

کاربر
  ↓
فرم تولید تصویر
  ↓
Backend برنامه
  ↓
اعتبارسنجی درخواست
  ↓
API درواره
  ↓
مدل FLUX
  ↓
ذخیره نتیجه
  ↓
نمایش تصویر به کاربر

نمونه Backend با FastAPI:

pip install fastapi uvicorn openai pydantic

فایل main.py:

import os
from typing import Literal

from fastapi import FastAPI, HTTPException
from openai import OpenAI
from pydantic import BaseModel, Field


app = FastAPI(title="FLUX Image Generator")

client = OpenAI(
    api_key=os.environ["DARVAREH_API_KEY"],
    base_url="https://api.darvareh.ir/v1",
)

MODEL_ID = os.environ["DARVAREH_IMAGE_MODEL"]


class ImageRequest(BaseModel):
    prompt: str = Field(min_length=10, max_length=2000)
    size: Literal[
        "1024x1024",
        "1536x1024",
        "1024x1536",
    ] = "1024x1024"


@app.post("/api/images")
def create_image(payload: ImageRequest):
    try:
        result = client.images.generate(
            model=MODEL_ID,
            prompt=payload.prompt,
            size=payload.size,
            n=1,
        )

        image = result.data[0]

        return {
            "url": getattr(image, "url", None),
            "b64_json": getattr(image, "b64_json", None),
            "revised_prompt": getattr(
                image,
                "revised_prompt",
                None,
            ),
        }

    except Exception as error:
        raise HTTPException(
            status_code=502,
            detail="Image generation failed.",
        ) from error

اجرای برنامه:

uvicorn main:app --reload

نمونه درخواست:

curl -X POST http://127.0.0.1:8000/api/images \
  -H "Content-Type: application/json" \
  -d '{
    "prompt": "عکاسی واقع‌گرایانه از یک کفش ورزشی سفید روی سکوی بتنی، نور استودیویی نرم، پس‌زمینه خاکستری روشن",
    "size": "1024x1024"
  }'

پارامترهای اندازه قابل پشتیبانی به مدل و endpoint انتخاب‌شده بستگی دارند. پیش از قراردادن آن‌ها در رابط کاربری، مقادیر مجاز مدل را از مستندات بررسی کنید.

نمونه واقعی: ساخت ابزار تولید عکس محصول

فرض کنید یک فروشگاه اینترنتی می‌خواهد برای محصولات خود تصاویر Lifestyle بسازد.

فرم کاربر می‌تواند اطلاعات زیر را دریافت کند:

  • نام محصول
  • دسته‌بندی
  • رنگ اصلی
  • جنس
  • محیط موردنظر
  • سبک نورپردازی
  • نسبت تصویر
  • توضیحات اضافی

Backend این اطلاعات را به یک پرامپت استاندارد تبدیل می‌کند.

def build_product_prompt(
    product: str,
    color: str,
    material: str,
    environment: str,
    aspect: str,
) -> str:
    return f"""
    عکاسی حرفه‌ای و واقع‌گرایانه از {product}.
    رنگ اصلی محصول: {color}.
    جنس و بافت: {material}.
    محیط: {environment}.
    نورپردازی نرم و طبیعی، جزئیات دقیق محصول،
    ترکیب‌بندی تبلیغاتی خلوت، فقط یک محصول،
    بدون نوشته داخل تصویر، نسبت تصویر {aspect}.
    """

استفاده:

prompt = build_product_prompt(
    product="کیف دستی زنانه",
    color="زرشکی تیره",
    material="چرم طبیعی با دوخت ظریف",
    environment="میز سنگی روشن در استودیوی مینیمال",
    aspect="4:5",
)

مزیت این روش آن است که کاربران لازم نیست پرامپت‌نویسی حرفه‌ای بلد باشند. برنامه ورودی ساده را به دستور استاندارد تبدیل می‌کند.

استفاده از تصویر مرجع

در پروژه‌هایی مانند عکاسی محصول، حفظ شخصیت یا طراحی داخلی، فقط پرامپت متنی کافی نیست. باید تصویر مرجع نیز به مدل ارائه شود.

جریان کلی:

  1. کاربر تصویر را بارگذاری می‌کند.
  2. Backend نوع و اندازه فایل را بررسی می‌کند.
  3. فایل در فضای ذخیره‌سازی قرار می‌گیرد.
  4. آدرس یا داده تصویر همراه درخواست ویرایش ارسال می‌شود.
  5. مدل تغییر موردنظر را اعمال می‌کند.
  6. نتیجه در حساب کاربر ذخیره می‌شود.

پرامپت ویرایش باید دقیقاً مشخص کند چه چیزی تغییر کند و چه چیزی ثابت بماند:

محصول اصلی، شکل، رنگ، لوگو و نسبت‌های آن کاملاً ثابت بمانند.
فقط پس‌زمینه را به یک آشپزخانه مدرن روشن تغییر بده.
نور محصول را با محیط جدید هماهنگ کن. زاویه دوربین و جایگاه
محصول تغییر نکند.

چگونه خروجی‌های یکدست تولید کنیم؟

یکسان‌ماندن خروجی‌ها برای فروشگاه و کمپین تبلیغاتی اهمیت زیادی دارد.

قالب پرامپت ثابت بسازید

به‌جای نوشتن پرامپت جدید برای هر تصویر، ساختار ثابتی تعریف کنید:

نوع تصویر:
زاویه:
نور:
پس‌زمینه:
پالت رنگ:
موقعیت محصول:
فضای خالی:
نسبت تصویر:
موارد ثابت:

از تصویر مرجع استفاده کنید

برای حفظ شخصیت، محصول یا زبان بصری برند، یک یا چند تصویر تأییدشده به‌عنوان مرجع قرار دهید.

تنظیمات مدل را ثابت نگه دارید

در یک مجموعه تصویر، مدل، اندازه، نسبت، کیفیت و سایر پارامترها را بدون دلیل تغییر ندهید.

خروجی را مرحله‌ای تولید کنید

ابتدا تصاویر کم‌هزینه یا Draft تولید و جهت بصری را انتخاب کنید. سپس خروجی منتخب را با کیفیت بالاتر بسازید.

پرامپت تأییدشده را ذخیره کنید

نسخه پرامپت، مدل، پارامترها و نتیجه را ثبت کنید تا تولید تصاویر مشابه قابل تکرار باشد.

انتخاب نسبت تصویر

کاربردنسبت پیشنهادی
پست مربعی1:1
پست عمودی4:5
استوری و Reels9:16
تصویر شاخص وبلاگ16:9
بنر سایت16:9 یا عریض‌تر
عکس محصول1:1 یا 4:5
پوستر2:3 یا 3:4
تصویر ارائه16:9

نسبت تصویر را براساس محل انتشار انتخاب کنید. بریدن یک تصویر مربعی برای بنر عریض معمولاً ترکیب‌بندی را خراب می‌کند.

FLUX برای متن فارسی مناسب است؟

نسخه‌های جدید FLUX در نمایش متن نسبت به بسیاری از مدل‌های قدیمی پیشرفت کرده‌اند، اما تولید دقیق متن فارسی همچنان باید آزمایش شود.

برای نتیجه بهتر:

  • متن کوتاه باشد.
  • عبارت دقیق داخل علامت نقل‌قول قرار گیرد.
  • تعداد نوشته‌ها محدود باشد.
  • محل متن مشخص شود.
  • از فونت پیچیده درخواست نشود.
  • چند خروجی تولید و مقایسه شود.

نمونه:

یک پوستر مینیمال با پس‌زمینه سرمه‌ای. عبارت فارسی
«فروش ویژه» با حروف بزرگ سفید و کاملاً خوانا در مرکز تصویر.
فقط همین عبارت در تصویر نوشته شود.

برای طراحی تجاری، مطمئن‌ترین روش این است که تصویر اصلی بدون نوشته تولید و متن نهایی با ابزار طراحی اضافه شود.

چگونه هزینه تولید تصویر را کاهش دهیم؟

ابتدا با کیفیت معمولی آزمایش کنید

تا زمانی که ترکیب‌بندی نهایی نشده، خروجی با بیشترین وضوح تولید نکنید.

تعداد خروجی را محدود کنید

به‌جای تولید ده‌ها تصویر در یک درخواست، ابتدا یک یا دو تصویر بسازید و پرامپت را اصلاح کنید.

نسخه مناسب مدل را انتخاب کنید

برای نمونه‌سازی از مدل سریع‌تر و اقتصادی‌تر و برای خروجی نهایی از مدل باکیفیت‌تر استفاده کنید.

ابعاد را براساس کاربرد انتخاب کنید

تصویر کوچک صفحه محصول به خروجی 4K نیاز ندارد. وضوح بیش از نیاز، هزینه و زمان پردازش را افزایش می‌دهد.

پرامپت‌های موفق را ذخیره کنید

تکرار آزمون‌وخطا یکی از عوامل افزایش هزینه است. برای هر کاربرد یک قالب تأییدشده نگه دارید.

هزینه هر قابلیت را جدا ثبت کنید

اگر برنامه چند ابزار دارد، مصرف هر بخش را جداگانه اندازه‌گیری کنید:

  • تولید تصویر محصول
  • تعویض پس‌زمینه
  • تولید تصویر شاخص
  • ساخت پوستر
  • تولید چند نسخه تبلیغاتی

اشتباهات رایج در استفاده از FLUX

پرامپت بسیار کوتاه

عبارت «یک تبلیغ زیبا بساز» اطلاعات کافی درباره محصول، نور، محیط و ترکیب‌بندی ارائه نمی‌کند.

ترکیب چند هدف متفاوت

در یک درخواست از مدل نخواهید هم تصویر محصول، هم پوستر، هم لوگو و هم Infographic تولید کند.

نادیده‌گرفتن نسبت تصویر

نسبت خروجی باید پیش از تولید مشخص شود، نه پس از آماده‌شدن تصویر.

تغییر هم‌زمان تمام متغیرها

برای بهبود خروجی هر بار فقط یک یا دو عامل مانند نور یا زاویه را تغییر دهید. در غیر این صورت مشخص نمی‌شود کدام تغییر نتیجه را بهتر کرده است.

درخواست تعداد زیادی نوشته

هرچه متن داخل تصویر طولانی‌تر باشد، احتمال خطا بیشتر می‌شود.

استفاده از یک مدل برای تمام مراحل

ممکن است یک مدل برای پیش‌نمایش سریع و مدل دیگری برای خروجی نهایی مناسب باشد.

قراردادن مستقیم کلید API در Frontend

کلید API باید در Backend نگهداری شود. مرورگر فقط باید با API برنامه شما ارتباط برقرار کند.

خطاهای رایج API

خطای 401

کلید API اشتباه، منقضی یا ارسال نشده است.

هدر استاندارد:

Authorization: Bearer YOUR_API_KEY

خطای 404 یا Model Not Found

شناسه مدل را از فهرست فعلی مدل‌های درواره کپی کنید. نام نمایشی مدل الزاماً با Model ID یکسان نیست.

خطای 400

ممکن است اندازه، تعداد خروجی یا پارامتر دیگری توسط مدل پشتیبانی نشود. درخواست را با حداقل پارامترها آزمایش کنید.

خطای 429

تعداد درخواست‌ها از محدودیت نرخ عبور کرده است. از صف، Retry با فاصله افزایشی و محدودیت هم‌زمانی استفاده کنید.

Timeout

تولید تصویر ممکن است بیشتر از درخواست متنی زمان ببرد. Timeout سمت سرور را متناسب تنظیم و برای پردازش‌های طولانی از Job Queue استفاده کنید.

پاسخ بدون URL

بعضی مدل‌ها تصویر را به‌صورت Base64 برمی‌گردانند. برنامه باید هر دو نوع پاسخ URL و Base64 را مدیریت کند.

پرسش‌های متداول

FLUX AI چیست؟

FLUX خانواده‌ای از مدل‌های مولد Black Forest Labs برای تولید و ویرایش تصویر، ویدئو و سایر داده‌های بصری است.

FLUX 3 چیست؟

FLUX 3 نسل چندوجهی این خانواده است که تصویر، ویدئو، صوت و پیش‌بینی عمل را در یک معماری ترکیب می‌کند.

آیا FLUX 3 ویدئو همراه با صدا تولید می‌کند؟

براساس اطلاعات رسمی Black Forest Labs، FLUX 3 می‌تواند ویدئو را همراه با گفتار، افکت صوتی و صدای محیط تولید کند.

حداکثر طول ویدئوی FLUX 3 چقدر است؟

قابلیت فعلی معرفی‌شده می‌تواند در یک نسل کلیپ‌هایی تا ۲۰ ثانیه تولید کند. امکانات و محدودیت‌ها ممکن است براساس نسخه و مسیر دسترسی متفاوت باشند.

FLUX.2 برای چه کاری مناسب است؟

FLUX.2 برای تولید و ویرایش تصویر، عکاسی محصول، تبلیغات، طراحی دارای نوشته، استفاده از تصاویر مرجع و ایجاد تصاویر واقع‌گرایانه مناسب است.

بهترین نسخه FLUX کدام است؟

پاسخ به کاربرد بستگی دارد. Max برای کیفیت بالا، Pro برای استفاده عمومی حرفه‌ای، Flex برای کنترل و تایپوگرافی، Klein برای سرعت و Dev برای توسعه و استقرار مناسب است.

آیا FLUX متن فارسی را درست می‌نویسد؟

کیفیت تولید متن فارسی باید روی نسخه و پرامپت موردنظر آزمایش شود. برای نوشته‌های حساس بهتر است متن نهایی بعداً در نرم‌افزار طراحی اضافه شود.

آیا FLUX متن‌باز است؟

همه نسخه‌های FLUX شرایط یکسانی ندارند. بعضی نسخه‌ها با وزن قابل دریافت ارائه می‌شوند و بعضی فقط از طریق API در دسترس‌اند. مجوز هر مدل را جداگانه بررسی کنید.

آیا می‌توان FLUX را روی کامپیوتر شخصی اجرا کرد؟

نسخه‌های دارای وزن باز را می‌توان با سخت‌افزار مناسب اجرا کرد. برای بسیاری از کاربران، استفاده از API ساده‌تر از تهیه و مدیریت GPU است.

چگونه از FLUX در سایت استفاده کنیم؟

یک Backend بسازید که درخواست کاربر را دریافت و به API مدل ارسال کند. نتیجه در فضای ذخیره‌سازی قرار می‌گیرد و آدرس آن به رابط کاربری برگردانده می‌شود.

آیا درواره API تولید تصویر دارد؟

درواره دسترسی به مدل‌های مختلف هوش مصنوعی را از طریق API فراهم می‌کند. برای مشاهده مدل‌های تصویری فعال، شناسه‌ها، پارامترهای قابل پشتیبانی و قیمت فعلی باید فهرست مدل‌ها و مستندات API درواره را بررسی کنید.

جمع‌بندی

FLUX از یک خانواده مدل تولید تصویر به یک مجموعه گسترده برای هوش بصری و تولید چندرسانه‌ای تبدیل شده است. FLUX.2 همچنان گزینه مهمی برای تولید و ویرایش تصویر محسوب می‌شود و FLUX 3 قابلیت‌هایی مانند تولید ویدئو، صوت هماهنگ، چند صحنه، Keyframe و خروجی تا 4K را به نسل جدید این خانواده اضافه می‌کند.

برای انتخاب درست:

  1. کاربرد نهایی را مشخص کنید.
  2. مدل را براساس کیفیت، سرعت و هزینه انتخاب کنید.
  3. نسبت تصویر را پیش از تولید تعیین کنید.
  4. پرامپت را با جزئیات بصری بنویسید.
  5. برای محصول و شخصیت از تصویر مرجع استفاده کنید.
  6. ابتدا Preview و سپس خروجی نهایی بسازید.
  7. نتیجه مدل‌های مختلف را روی ورودی یکسان مقایسه کنید.
  8. مصرف و هزینه هر قابلیت را جداگانه ثبت کنید.

با استفاده از API درواره، توسعه‌دهندگان ایرانی می‌توانند از یک حساب، یک کیف پول ریالی و یک زیرساخت یکپارچه برای اتصال برنامه‌های خود به مدل‌های هوش مصنوعی استفاده کنند.

برای مشاهده مدل‌های فعلی و شروع پیاده‌سازی به مستندات API درواره مراجعه کنید.

مقالات مرتبط

منابع

این مقاله صرفاً با هدف آموزش و اطلاع‌رسانی تهیه شده است. پیش از استفاده عملی، مستندات رسمی سرویس‌ها و صفحه سلب مسئولیت را مطالعه کنید.

Read more

تبدیل عکس سیاه‌وسفید قدیمی به عکس رنگی با هوش مصنوعی

رنگی کردن عکس سیاه‌وسفید با هوش مصنوعی؛ آموزش کامل و رایگان

در این راهنمای جامع یاد می‌گیرید چگونه عکس‌های سیاه‌وسفید قدیمی را با هوش مصنوعی به تصاویر رنگی طبیعی تبدیل کنید؛ از آماده‌سازی و ترمیم اولیه عکس تا انتخاب ابزار، نوشتن پرامپت، اصلاح رنگ پوست و اجرای خودکار با API درواره.

آموزش ساخت موزیک ویدیو با هوش مصنوعی از آهنگ تا تدوین نهایی

ساخت موزیک ویدیو با هوش مصنوعی؛ آموزش کامل از آهنگ تا کلیپ

در این راهنمای جامع یاد می‌گیرید چگونه با هوش مصنوعی یک موزیک ویدیو حرفه‌ای بسازید؛ از تحلیل آهنگ، انتخاب ایده و نوشتن سناریو تا ساخت استوری‌بورد، تولید نماهای هماهنگ، تدوین روی ضرب موسیقی و خودکارسازی مراحل با API درواره. عنوان متا: ساخت موزیک ویدیو با هوش مصنوعی؛ آموزش کامل و عملی

آموزش پرامپت ساخت عکس با هوش مصنوعی همراه با نمونه‌های آماده

پرامپت ساخت عکس با هوش مصنوعی؛ آموزش کامل و ۵۰ پرامپت آماده

چگونه برای ساخت عکس با هوش مصنوعی پرامپت حرفه‌ای بنویسیم؟ در این راهنما فرمول پرامپت‌نویسی تصویر، تنظیم نور، سبک، زاویه دوربین و ترکیب‌بندی را همراه با ۵۰ پرامپت آماده برای عکس پرتره، محصول، معماری، غذا، تبلیغات و شبکه‌های اجتماعی یاد می‌گیرید.

آموزش نصب OpenHands و اتصال ایجنت برنامه‌نویسی هوش مصنوعی به API درواره

OpenHands چیست؟ آموزش نصب ایجنت برنامه‌نویسی و اتصال به API درواره

OpenHands یک ایجنت برنامه‌نویسی متن‌باز است که می‌تواند مخزن کد را بررسی کند، فایل‌ها را تغییر دهد، فرمان‌های ترمینال را اجرا کند و برای توسعه قابلیت، رفع خطا و نوشتن تست به کار رود. در این آموزش، OpenHands و Agent Canvas را نصب و به مدل‌های هوش مصنوعی از طریق API درواره متصل می‌کنیم.