هوش مصنوعی در پریمیر پرو؛ آموزش کامل تدوین ویدئو با Adobe Premiere AI

در این راهنمای عملی با ابزارهای هوش مصنوعی پریمیر آشنا می‌شوید و تدوین متنی، جست‌وجوی ویدئو، بهبود صدا، زیرنویس، Auto Reframe و Generative Extend را یاد می‌گیرید.

Share
هوش مصنوعی در پریمیر پرو؛ آموزش کامل تدوین ویدئو با Adobe Premiere AI

تدوین ویدئو معمولاً فرایندی زمان‌بر است. تدوینگر باید ساعت‌ها فایل را مرور کند، قسمت‌های مناسب را پیدا کند، سکوت‌ها و اشتباهات را حذف کند، صدا را بهبود دهد، زیرنویس بسازد، نسبت تصویر را برای شبکه‌های اجتماعی تغییر دهد و گاهی چند فریم کمبود یک نما را نیز جبران کند.

هوش مصنوعی در پریمیر پرو بخشی از این فعالیت‌ها را سریع‌تر کرده است. اکنون می‌توان ویدئو را از روی متن پیاده‌شده تدوین کرد، میان ساعت‌ها فایل تصویری جست‌وجوی مفهومی انجام داد، صدای گفتگو را بهبود بخشید، زیرنویس تولید کرد، کادر را برای ویدئوی عمودی تغییر داد و انتهای بعضی نماها را با Generative Extend کمی گسترش داد.

این قابلیت‌ها به این معنا نیستند که هوش مصنوعی جای تدوینگر را گرفته است. هوش مصنوعی بیشتر شبیه یک دستیار تدوین عمل می‌کند: کارهای تکراری را سریع‌تر انجام می‌دهد، اما تصمیم درباره روایت، ریتم، احساس، انتخاب نما و کیفیت نهایی همچنان به انسان نیاز دارد.

در این مقاله، مهم‌ترین قابلیت‌های هوش مصنوعی Adobe Premiere را به‌صورت عملی بررسی می‌کنیم و یک گردش‌کار کامل برای ساخت ویدئوی حرفه‌ای ارائه می‌دهیم.

هوش مصنوعی پریمیر پرو چیست؟

هوش مصنوعی پریمیر مجموعه‌ای از قابلیت‌های تحلیل، تشخیص، تولید و خودکارسازی است که در نرم‌افزار Adobe Premiere قرار گرفته‌اند.

این قابلیت‌ها می‌توانند:

  • محتوای تصویری فایل‌ها را تحلیل کنند.
  • دیالوگ را به متن تبدیل کنند.
  • ویدئو را از طریق ویرایش متن تدوین کنند.
  • کلمات یا بخش‌های مشخص را در گفتگو پیدا کنند.
  • نماهای مورد نیاز را با توضیح متنی جست‌وجو کنند.
  • صدای گفتگو را واضح‌تر کنند.
  • نویز پس‌زمینه را کاهش دهند.
  • زیرنویس بسازند و ترجمه کنند.
  • کادر را برای نسبت‌های مختلف تنظیم کنند.
  • برش‌های موجود در یک ویدئوی نهایی را تشخیص دهند.
  • چند فریم جدید برای ادامه یک کلیپ بسازند.
  • فرایند مرتب‌سازی و انتخاب فایل‌ها را سریع‌تر کنند.

در نسخه‌های جدید، نام محصول در برخی صفحات رسمی به شکل Adobe Premiere نمایش داده می‌شود، اما کاربران فارسی همچنان بیشتر از عبارت Premiere Pro یا پریمیر پرو استفاده می‌کنند.

مهم‌ترین قابلیت‌های هوش مصنوعی Premiere

قابلیتکاربرد اصلیمناسب برای
Media Intelligenceجست‌وجوی مفهومی در ویدئوهاپروژه‌های دارای فایل زیاد
Text-Based Editingتدوین ویدئو از روی متنمصاحبه، پادکست و آموزش
Speech to Textتبدیل گفتگو به متنزیرنویس و متن ویدئو
Enhance Speechواضح‌ترکردن صدای گفتگوویدئوهای ضبط‌شده با صدای متوسط
Auto Reframeتبدیل کادر افقی به عمودی یا مربعیاینستاگرام، Shorts و شبکه‌های اجتماعی
Generative Extendافزودن چند فریم به ابتدا یا انتهای نمااصلاح ریتم و انتقال
Scene Edit Detectionتشخیص برش‌های یک فایل تدوین‌شدهبازتدوین ویدئوی خروجی‌گرفته‌شده
Translate Captionsترجمه خودکار زیرنویسانتشار چندزبانه
AI Assistantراهنمایی و انجام بعضی عملیات از طریق دستوریادگیری و سرعت‌بخشیدن به کار
Auto Color و Color Managementاصلاح و مدیریت سریع‌تر رنگیکدست‌کردن نماها

همه قابلیت‌ها ممکن است در تمام نسخه‌ها، پلن‌ها، زبان‌ها یا مناطق به‌شکل یکسان در دسترس نباشند. پیش از شروع پروژه مهم، نسخه فعلی Premiere و امکانات حساب خود را بررسی کنید.

Media Intelligence چیست؟

در پروژه‌های بزرگ ممکن است ده‌ها ساعت فایل خام داشته باشید. پیدا کردن نمایی مانند «فردی که کنار پنجره ایستاده»، «نمای نزدیک محصول» یا «خودرویی که در خیابان حرکت می‌کند» به مرور دستی تمام فایل‌ها نیاز دارد.

Media Intelligence محتوای ویدئو را تحلیل می‌کند و امکان جست‌وجوی معنایی در میان فایل‌ها را فراهم می‌سازد.

Premiere می‌تواند نتیجه را بر اساس موارد زیر پیدا کند:

  • محتوای بصری
  • کلمات گفته‌شده
  • متن پیاده‌شده
  • متادیتای فایل
  • تاریخ ضبط
  • اطلاعات دوربین
  • موقعیت‌های علامت‌گذاری‌شده
  • نماهای مشابه

طبق مستندات رسمی Adobe، بخش Search می‌تواند نتایج مربوط به تصویر، صدا، متن و Metadata را هم‌زمان نمایش دهد. جست‌وجوی بصری در وضعیت فعلی با عبارت‌های انگلیسی کار می‌کند. راهنمای رسمی Media Intelligence در Premiere

چگونه از Media Intelligence استفاده کنیم؟

  1. فایل‌های پروژه را وارد Premiere کنید.
  2. اجازه دهید فرایند تحلیل در پس‌زمینه کامل شود.
  3. از بالای محیط Premiere، پنل Search را باز کنید.
  4. توضیح نمای مورد نظر را به انگلیسی بنویسید.
  5. نتایج Visuals، Audio، Text و Metadata را بررسی کنید.
  6. روی نتیجه دوبار کلیک کنید تا بخش مربوط در Source Monitor باز شود.
  7. نمای مورد نظر را به Timeline بکشید.

نمونه عبارت‌های جست‌وجو:

person speaking in front of a laptop
close-up shot of a product on a table
wide shot of a modern office
people walking in a busy street at night
hands typing on a computer keyboard

چگونه جست‌وجوی دقیق‌تری انجام دهیم؟

عبارت بیش از حد عمومی:

office

عبارت بهتر:

wide shot of an empty modern office with large windows

هرچه نوع نما، سوژه، فعالیت و محیط را دقیق‌تر توضیح دهید، احتمال رسیدن به نتیجه مناسب بیشتر می‌شود.

پیدا کردن نماهای مشابه

گاهی یک نمای مناسب پیدا کرده‌اید، اما به دنبال برداشت دیگری با ترکیب‌بندی نزدیک هستید. Media Intelligence می‌تواند نماهای مشابه را نیز جست‌وجو کند.

این قابلیت برای موارد زیر مفید است:

  • پیدا کردن برداشت جایگزین
  • یافتن B-roll مشابه
  • انتخاب نمایی با حرکت کمتر
  • پیدا کردن نسخه‌ای با نور بهتر
  • یافتن فریم نزدیک در فایل‌های طولانی

Adobe توضیح می‌دهد که جست‌وجوی نماهای مشابه می‌تواند بخش‌هایی از فایل‌ها را بدون مرور دستی تمام ویدئو پیدا کند. راهنمای جست‌وجوی نماهای مشابه

Text-Based Editing چیست؟

Text-Based Editing یا تدوین مبتنی بر متن، یکی از کاربردی‌ترین قابلیت‌های هوش مصنوعی Premiere برای ویدئوهای گفتگو‌محور است.

Premiere ابتدا دیالوگ را به متن تبدیل می‌کند. متن به تایم‌کد ویدئو متصل است؛ بنابراین وقتی جمله‌ای را در متن حذف یا جابه‌جا می‌کنید، بخش متناظر آن در Timeline نیز ویرایش می‌شود.

به بیان ساده، به‌جای اینکه تمام ویدئو را فقط از روی موج صدا و تصویر تدوین کنید، می‌توانید آن را مانند یک سند متنی ویرایش کنید.

این قابلیت برای محتوای زیر بسیار مفید است:

  • مصاحبه
  • پادکست تصویری
  • دوره آموزشی
  • وبینار
  • ویدئوی یوتیوب
  • محتوای آپارات
  • ویدئوی معرفی محصول
  • ویدئوهای Talking Head
  • گزارش و مستند گفتگو‌محور

طبق راهنمای Adobe، متن و Timeline به‌صورت پویا با یکدیگر هماهنگ‌اند و حذف یا جابه‌جایی متن می‌تواند کلیپ‌های مرتبط را در Timeline نیز تغییر دهد. راهنمای رسمی Text-Based Editing

آموزش تدوین ویدئو از روی متن

مرحله اول: ساخت Transcript

  1. ویدئو را وارد پروژه کنید.
  2. از منوی Window، پنل Text را باز کنید.
  3. وارد بخش Transcript شوید.
  4. گزینه ساخت Transcript را انتخاب کنید.
  5. زبان گفتگو را مشخص کنید.
  6. در صورت وجود چند گوینده، قابلیت تشخیص گوینده را تنظیم کنید.
  7. فرایند Transcribe را شروع کنید.
  8. متن نهایی را با صدای اصلی تطبیق دهید.

مسیر کلی:

Window > Text > Transcript

مرحله دوم: اصلاح متن

قبل از تدوین، اشتباه‌های مهم Transcript را اصلاح کنید:

  • نام اشخاص
  • نام برند
  • اصطلاحات تخصصی
  • اعداد
  • کلمات فارسی و انگلیسی ترکیبی
  • نام محصول
  • عبارات مشابه از نظر آوایی

اصلاح متن باعث می‌شود جست‌وجو و زیرنویس نهایی دقیق‌تر باشد.

مرحله سوم: ساخت Rough Cut

بخش‌های مورد نظر را در Transcript انتخاب و به Timeline اضافه کنید. این کار برای ساخت نسخه اولیه مصاحبه یا ویدئوی آموزشی بسیار سریع‌تر از مرور خطی همه فایل‌ها است.

مرحله چهارم: حذف بخش‌های اضافی

می‌توانید بخش‌های زیر را از طریق متن پیدا و حذف کنید:

  • تکرار جمله
  • اشتباه گوینده
  • مکث طولانی
  • توضیح خارج از موضوع
  • شروع‌های ناموفق
  • قسمت‌های کم‌اهمیت

مرحله پنجم: بازبینی تصویری

بعد از تدوین متنی، Timeline را به‌صورت کامل تماشا کنید. حذف یک جمله ممکن است از نظر متن درست باشد، اما در تصویر باعث پرش، تغییر ناگهانی حالت چهره یا قطع نامناسب صدا شود.

برای پوشاندن Jump Cut می‌توانید از موارد زیر استفاده کنید:

  • B-roll
  • نمای نزدیک‌تر
  • تغییر کادر
  • تصویر محصول
  • اسکرین‌شات
  • نمودار
  • تیتر متحرک
  • نمای دست یا محیط
  • برش به دوربین دوم

آیا Premiere از زیرنویس فارسی پشتیبانی می‌کند؟

فهرست زبان‌های Speech to Text و Translate Captions ممکن است با نسخه Premiere و بسته‌های زبانی موجود تغییر کند. بنابراین بهتر است در پنجره Language بررسی کنید که فارسی در نسخه نصب‌شده شما وجود دارد یا خیر.

حتی در صورت وجود زبان فارسی، خروجی خودکار باید بازبینی شود. موارد زیر معمولاً به اصلاح نیاز دارند:

  • نیم‌فاصله
  • علائم نگارشی
  • کلمات انگلیسی
  • اسامی خاص
  • اعداد
  • اصطلاحات فنی
  • تفاوت زبان رسمی و محاوره
  • تشخیص گوینده
  • جمله‌بندی زیرنویس

اگر زبان فارسی در نسخه شما وجود نداشت یا دقت کافی نبود، می‌توانید صدا را با یک مدل Speech to Text تبدیل به فایل SRT کرده و سپس SRT را وارد Premiere کنید.

ساخت زیرنویس خودکار در Premiere

روش داخلی Premiere

  1. پنل Text را باز کنید.
  2. Transcript را ایجاد کنید.
  3. متن را بازبینی کنید.
  4. گزینه Create Captions را انتخاب کنید.
  5. قالب و طول زیرنویس را تنظیم کنید.
  6. Caption Track ساخته‌شده را بررسی کنید.
  7. فونت، رنگ، اندازه و موقعیت متن را تنظیم کنید.

تنظیمات مهم زیرنویس

برای خوانایی بهتر، به این موارد توجه کنید:

  • هر زیرنویس بیش از حد طولانی نباشد.
  • جمله در محل طبیعی شکسته شود.
  • زیرنویس مدت کافی روی صفحه بماند.
  • متن با پس‌زمینه کنتراست داشته باشد.
  • زیرنویس روی عناصر مهم تصویر قرار نگیرد.
  • فاصله آن از لبه پایین مناسب باشد.
  • اعداد و عبارت‌های انگلیسی درست نمایش داده شوند.
  • در ویدئوی عمودی، رابط کاربری پلتفرم روی زیرنویس را نپوشاند.

زیرنویس کلمه‌به‌کلمه

در نسخه‌های جدید Premiere امکان ساخت Captionهایی که هر بار یک کلمه را نمایش می‌دهند نیز وجود دارد. این سبک برای ویدئوهای سریع شبکه‌های اجتماعی استفاده می‌شود، اما برای همه محتواها مناسب نیست.

در ویدئوهای آموزشی یا رسمی، زیرنویس جمله‌ای معمولاً خواناتر و حرفه‌ای‌تر است.

ترجمه خودکار زیرنویس

بعد از ساخت Caption می‌توانید از قابلیت Translate Captions برای تولید نسخه‌های زبانی دیگر استفاده کنید. Adobe این قابلیت را برای ترجمه Caption و گسترش دسترسی محتوای چندزبانه ارائه کرده است. راهنمای رسمی ترجمه زیرنویس در Premiere

ترجمه خودکار باید قبل از انتشار بررسی شود؛ به‌ویژه اگر ویدئو شامل موارد زیر است:

  • اصطلاحات تخصصی
  • نام محصول
  • نام اشخاص
  • شوخی یا کنایه
  • عبارات فرهنگی
  • زبان محاوره
  • جمله‌های ناقص
  • ترکیب فارسی و انگلیسی

Enhance Speech چیست؟

صدای نامناسب می‌تواند حتی یک ویدئوی تصویری باکیفیت را غیرحرفه‌ای نشان دهد. Enhance Speech از هوش مصنوعی برای واضح‌ترکردن گفتگو و کاهش بخشی از نویز و مشکلات ضبط استفاده می‌کند.

این قابلیت برای فایل‌هایی مناسب است که:

  • با میکروفن موبایل ضبط شده‌اند.
  • نویز محیط دارند.
  • صدای گوینده ضعیف است.
  • فاصله میکروفن زیاد بوده است.
  • وضوح کلمات پایین است.
  • صدای اتاق روی گفتگو اثر گذاشته است.

Adobe توضیح می‌دهد Enhance Speech برای افزایش وضوح و حضور صدای گفتگو و کاهش نویز پس‌زمینه طراحی شده است. راهنمای رسمی Enhance Speech

آموزش بهبود صدای گفتگو

  1. کلیپ صوتی را در Timeline انتخاب کنید.
  2. پنل Essential Sound را باز کنید.
  3. نوع فایل را روی Dialogue قرار دهید.
  4. Enhance Speech را فعال کنید.
  5. منتظر بمانید تا تحلیل کامل شود.
  6. مقدار شدت بهبود را تنظیم کنید.
  7. نتیجه را با صدای اولیه مقایسه کنید.
  8. با هدفون و اسپیکر معمولی خروجی را بررسی کنید.

مسیر کلی:

Window > Essential Sound

شدت Enhance Speech را بیش از حد بالا نبرید

افزایش شدید مقدار Enhance ممکن است باعث شود صدا:

  • مصنوعی شود.
  • حالت فلزی پیدا کند.
  • تنفس‌ها غیرطبیعی شوند.
  • بعضی حروف تیز شنیده شوند.
  • تفاوت میان بخش‌های مختلف صدا بیشتر شود.

مقدار مناسب به کیفیت فایل اولیه بستگی دارد. همیشه نسخه پردازش‌شده را با فایل خام مقایسه کنید.

ترتیب پیشنهادی اصلاح صدا

برای بیشتر پروژه‌ها می‌توانید از ترتیب زیر استفاده کنید:

  1. تنظیم Gain اولیه
  2. کاهش نویز
  3. Enhance Speech
  4. کاهش Reverb در صورت نیاز
  5. EQ محدود
  6. Compression ملایم
  7. تنظیم بلندی نهایی
  8. کنترل Peak
  9. گوش‌دادن با چند دستگاه

هوش مصنوعی نمی‌تواند تمام مشکلات یک ضبط بسیار ضعیف، کلیپ‌شده یا دارای اعوجاج شدید را به‌طور کامل اصلاح کند.

Auto Reframe چیست؟

Auto Reframe به‌صورت خودکار سوژه یا بخش مهم تصویر را تشخیص می‌دهد و کادر را برای نسبت‌های مختلف تغییر می‌دهد.

برای مثال، می‌توانید یک ویدئوی افقی 16:9 را به موارد زیر تبدیل کنید:

  • ویدئوی عمودی 9:16
  • ویدئوی مربعی 1:1
  • پست عمودی 4:5
  • خروجی سفارشی برای یک پلتفرم

طبق راهنمای Adobe، Auto Reframe می‌تواند یک کلیپ یا Sequence کامل را برای نسبت جدید تنظیم و حرکت سوژه را دنبال کند. راهنمای رسمی Auto Reframe

آموزش تبدیل ویدئوی افقی به عمودی

  1. تدوین نسخه افقی را کامل کنید.
  2. Sequence را در Project Panel انتخاب کنید.
  3. از منوی Sequence گزینه Auto Reframe Sequence را بزنید.
  4. نسبت 9:16 را انتخاب کنید.
  5. نام مناسبی برای Sequence جدید بنویسید.
  6. Motion Tracking را تنظیم کنید.
  7. Sequence جدید را بازبینی کنید.
  8. Keyframeهای اشتباه را به‌صورت دستی اصلاح کنید.

مسیر کلی:

Sequence > Auto Reframe Sequence

Premiere یک Sequence جدید می‌سازد و نسخه اصلی را حفظ می‌کند.

تنظیم Motion Tracking

گزینهمناسب برای
Slower Motionمصاحبه و سوژه تقریباً ثابت
Defaultبیشتر ویدئوهای عمومی
Faster Motionورزش، حرکت سریع و اکشن

مشکلات رایج Auto Reframe

  • سوژه اشتباه را دنبال می‌کند.
  • بین دو نفر مدام جابه‌جا می‌شود.
  • متن یا محصول از کادر خارج می‌شود.
  • حرکت کادر بیش از حد است.
  • در نمای باز، کادر بیش از حد نزدیک می‌شود.
  • چند سوژه مهم هم‌زمان در تصویر وجود دارند.

Auto Reframe نقطه شروع خوبی است، اما خروجی نهایی باید کلیپ‌به‌کلیپ بررسی شود.

Generative Extend چیست؟

Generative Extend قابلیتی مبتنی بر Adobe Firefly است که می‌تواند چند فریم جدید به ابتدا یا انتهای بعضی کلیپ‌های ویدئویی یا صوتی اضافه کند.

کاربردهای اصلی:

  • کمی طولانی‌ترکردن نمای واکنش
  • ایجاد فرصت برای پایان جمله راوی
  • تکمیل یک Transition
  • پوشاندن حرکت ناخواسته دوربین
  • ادامه کوتاه صدای محیط
  • هماهنگ‌کردن تصویر با ضرب یا Cue صوتی
  • جلوگیری از Cut زودهنگام

این قابلیت برای ساخت یک صحنه طولانی جدید طراحی نشده است. کاربرد اصلی آن اضافه‌کردن زمان کوتاه و حل مشکلات کوچک تدوین است.

طبق مستندات Adobe، Generative Extend بخشی کوتاه از کلیپ را برای تحلیل به مدل ابری ارسال می‌کند و نتیجه را به شکل کلیپی جدید برمی‌گرداند؛ فایل اصلی بدون تغییر باقی می‌ماند. راهنمای رسمی Generative Extend

آموزش استفاده از Generative Extend

  1. کلیپ را در Timeline قرار دهید.
  2. فضای خالی لازم را در ابتدا یا انتهای کلیپ مشخص کنید.
  3. ابزار Generative Extend را فعال کنید.
  4. لبه کلیپ را به اندازه مورد نیاز بکشید.
  5. منتظر بمانید تا پردازش ابری کامل شود.
  6. کلیپ تولیدشده را مشاهده کنید.
  7. اتصال میان بخش واقعی و تولیدشده را بررسی کنید.
  8. در صورت نیاز نتیجه دیگری ایجاد کنید.

بهترین نماها برای Generative Extend

این قابلیت معمولاً روی نماهای زیر نتیجه مناسب‌تری دارد:

  • سوژه نسبتاً ثابت
  • حرکت آرام دوربین
  • پس‌زمینه قابل پیش‌بینی
  • نمای واکنش
  • طبیعت و محیط
  • حرکت ساده
  • صدای محیط یکنواخت

نماهای دشوار

  • حرکت بسیار سریع
  • دست و انگشت در نمای نزدیک
  • لب‌خوانی و گفتگو
  • متن داخل تصویر
  • لوگوی متحرک
  • حرکت پیچیده دوربین
  • صحنه دارای چند سوژه متحرک
  • تغییر ناگهانی نور
  • موسیقی و ساختار ریتمیک

محدودیت مهم صوت

Generative Extend برای ساخت یا ادامه دیالوگ گفتاری طراحی نشده است. طبق مستندات Adobe، هنگام گسترش، گفتگوی موجود می‌تواند بی‌صدا شود و فایل‌های حاوی موسیقی نیز برای این فرایند مناسب نیستند. این ابزار بیشتر برای ادامه صدای محیط کاربرد دارد.

Scene Edit Detection چیست؟

گاهی فقط فایل خروجی نهایی یک ویدئو را دارید و Timeline اصلی در دسترس نیست. Scene Edit Detection می‌تواند نقاط برش موجود در ویدئو را تشخیص دهد و کلیپ را در همان نقاط تقسیم کند.

این قابلیت برای موارد زیر مفید است:

  • بازتدوین یک ویدئوی قدیمی
  • اصلاح رنگ صحنه‌به‌صحنه
  • حذف بخشی از خروجی نهایی
  • اضافه‌کردن Transition جدید
  • استخراج نماها
  • ساخت نسخه کوتاه‌تر

روش استفاده

  1. فایل نهایی را وارد Timeline کنید.
  2. روی کلیپ کلیک راست کنید.
  3. Scene Edit Detection را انتخاب کنید.
  4. گزینه افزودن Cut در نقاط شناسایی‌شده را فعال کنید.
  5. تحلیل را شروع کنید.
  6. برش‌های ساخته‌شده را بازبینی کنید.

نتیجه ممکن است در Fade، Flash، حرکت سریع یا Transitionهای پیچیده نیاز به اصلاح دستی داشته باشد.

پروژه عملی: تدوین یک مصاحبه برای یوتیوب و اینستاگرام

فرض کنید یک مصاحبه ۴۵ دقیقه‌ای دارید و می‌خواهید از آن یک ویدئوی ۱۰ دقیقه‌ای و چند کلیپ عمودی کوتاه بسازید.

مرحله اول: سازمان‌دهی فایل‌ها

ساختار پیشنهادی Binها:

01_Footage
02_Audio
03_Music
04_Broll
05_Graphics
06_Sequences
07_Captions
08_Exports

فایل‌ها را نام‌گذاری کنید:

CAM_A_Interview
CAM_B_Closeup
Audio_Lavalier
Audio_Recorder
Broll_Office
Broll_Product

مرحله دوم: همگام‌سازی صدا و تصویر

صدای دوربین و رکوردر را همگام کنید. قبل از استفاده از هوش مصنوعی، مطمئن شوید فایل صوتی درست به ویدئو متصل شده است.

مرحله سوم: ساخت Transcript

گفتگو را به متن تبدیل کنید. اشتباه‌های مربوط به نام‌ها و اصطلاحات تخصصی را اصلاح کنید.

مرحله چهارم: انتخاب بخش‌های مهم

از Transcript برای پیدا کردن پاسخ‌های اصلی استفاده کنید. بخش‌هایی که اطلاعات تکراری دارند حذف کنید.

مرحله پنجم: ساخت Rough Cut

جمله‌های منتخب را در Timeline قرار دهید و ساختار روایت را ایجاد کنید:

  1. شروع جذاب
  2. معرفی موضوع
  3. بیان مسئله
  4. توضیح راه‌حل
  5. مثال
  6. نتیجه‌گیری
  7. دعوت به اقدام

مرحله ششم: حذف مکث‌ها و اشتباه‌ها

مکث‌های طولانی و شروع‌های ناموفق را حذف کنید، اما تمام تنفس‌ها و فاصله‌ها را از بین نبرید. تدوین بیش از حد فشرده می‌تواند طبیعی‌بودن گفتگو را کاهش دهد.

مرحله هفتم: افزودن B-roll

روی Jump Cutها و بخش‌های توضیحی، تصاویر مکمل قرار دهید:

  • نمای محیط
  • تصویر محصول
  • نمودار
  • اسکرین‌شات
  • نمای دست
  • ویدئوی مرتبط
  • عنوان یا نقل‌قول

برای پیداکردن سریع نماها می‌توانید از Media Intelligence استفاده کنید.

مرحله هشتم: بهبود صدا

صدای گفتگو را با Enhance Speech و ابزارهای Essential Sound اصلاح کنید. میزان پردازش را کنترل کنید تا صدا مصنوعی نشود.

مرحله نهم: ساخت زیرنویس

Transcript را اصلاح و Caption ایجاد کنید. زیرنویس را از نظر زمان‌بندی، جمله‌بندی و نمایش حروف فارسی بررسی کنید.

مرحله دهم: ساخت نسخه عمودی

از Sequence اصلی یک نسخه Auto Reframe با نسبت 9:16 بسازید. موقعیت کادر و زیرنویس را در تمام کلیپ‌ها بررسی کنید.

مرحله یازدهم: اصلاح کمبود نما

اگر یکی از نماها کمی زود تمام می‌شود، Generative Extend را برای چند فریم آزمایش کنید. اگر نتیجه طبیعی نبود، از B-roll، Freeze Frame یا تغییر تدوین استفاده کنید.

مرحله دوازدهم: خروجی‌گرفتن

نسخه‌های زیر را خروجی بگیرید:

  • ویدئوی کامل افقی
  • نسخه کوتاه افقی
  • کلیپ عمودی
  • نسخه دارای زیرنویس چسبیده
  • نسخه بدون زیرنویس
  • فایل SRT جداگانه

گردش‌کار پیشنهادی برای تولید Shorts و Reels

برای تبدیل یک ویدئوی طولانی به چند کلیپ کوتاه:

  1. Transcript کامل را بسازید.
  2. بخش‌های دارای نکته مستقل را پیدا کنید.
  3. هر بخش را بین ۳۰ تا ۹۰ ثانیه تنظیم کنید.
  4. شروع هر کلیپ را با جمله جذاب آغاز کنید.
  5. توضیحات اضافی قبل از نکته اصلی را حذف کنید.
  6. Auto Reframe را روی 9:16 اجرا کنید.
  7. زیرنویس خوانا اضافه کنید.
  8. B-roll محدود و مرتبط قرار دهید.
  9. موسیقی را با صدای کم استفاده کنید.
  10. پایان کلیپ را کامل و روشن نگه دارید.
  11. خروجی را روی موبایل بازبینی کنید.

نمونه ساختار کلیپ کوتاه

0 تا 3 ثانیه: هوک
3 تا 10 ثانیه: معرفی مسئله
10 تا 45 ثانیه: توضیح اصلی
45 تا 60 ثانیه: نتیجه یا CTA

مدت دقیق به محتوا و پلتفرم بستگی دارد.

استفاده از API درواره کنار Premiere

Premiere ابزار تدوین است، اما بعضی مراحل تولید محتوا را می‌توان پیش از ورود به Premiere یا خارج از آن با API خودکار کرد.

با استفاده از API درواره می‌توانید گردش‌کارهایی مانند موارد زیر بسازید:

  • تبدیل صدای فارسی به متن
  • تولید فایل زیرنویس
  • اصلاح نگارشی Transcript
  • خلاصه‌سازی ویدئو
  • استخراج موضوعات مهم
  • پیدا کردن بخش‌های مناسب برای کلیپ کوتاه
  • ساخت عنوان و توضیحات ویدئو
  • تولید سناریو
  • ترجمه زیرنویس
  • تولید صدای گوینده
  • ساخت تصویر کاور
  • تولید B-roll با مدل ویدئویی
  • تحلیل فریم‌های ویدئو
  • دسته‌بندی آرشیو ویدئویی

درواره نرم‌افزار تدوین یا چت‌بات نیست؛ بلکه زیرساخت دسترسی به مدل‌های مختلف هوش مصنوعی از طریق API است.

برای مشاهده مدل‌های صوتی، متنی، تصویری و ویدئویی، Model ID و قیمت جاری آن‌ها به صفحه مدل‌های درواره مراجعه کنید.

ساخت زیرنویس فارسی برای Premiere با API درواره

اگر مدل انتخاب‌شده از رابط سازگار با Speech to Text پشتیبانی کند، می‌توانید فایل صوتی را برای تبدیل به متن یا SRT ارسال کنید.

مرحله اول: خروجی‌گرفتن از صدای Premiere

صدای گفتگو را با تنظیمات مناسب خروجی بگیرید:

Format: WAV
Sample Rate: 16000 Hz یا 48000 Hz
Channels: Mono برای گفتگوی تک‌کاناله
Bit Depth: 16-bit یا 24-bit

مرحله دوم: ارسال فایل برای تبدیل گفتار به متن

نمونه کلی درخواست:

curl https://api.darvareh.ir/v1/audio/transcriptions \
  -H "Authorization: Bearer YOUR_DARVAREH_API_KEY" \
  -F "file=@dialogue.wav" \
  -F "model=YOUR_MODEL_ID" \
  -F "language=fa" \
  -F "response_format=srt"

پارامترهای language و response_format باید توسط مدل انتخاب‌شده پشتیبانی شوند. قبل از پیاده‌سازی، قابلیت‌ها و قالب ورودی مدل را در مستندات و صفحه مدل‌ها بررسی کنید.

مرحله سوم: بازبینی SRT

موارد زیر را اصلاح کنید:

  • تایم‌کدها
  • املای نام‌ها
  • نیم‌فاصله
  • علائم نگارشی
  • اصطلاحات انگلیسی
  • طول خطوط
  • محل شکستن جمله
  • هم‌زمانی متن با صدا

مرحله چهارم: واردکردن SRT به Premiere

فایل SRT را وارد Project Panel کنید و آن را روی Timeline قرار دهید. سپس Style زیرنویس را تنظیم و نتیجه را روی اندازه واقعی خروجی بررسی کنید.

تحلیل Transcript با مدل متنی

بعد از تبدیل گفتگو به متن، می‌توانید Transcript را برای استخراج کلیپ‌های مناسب به یک مدل متنی ارسال کنید.

نمونه دستور:

این Transcript مربوط به یک مصاحبه ۴۵ دقیقه‌ای است.

۵ بخش مناسب برای تبدیل به ویدئوی کوتاه انتخاب کن.

برای هر بخش ارائه بده:
- تایم شروع
- تایم پایان
- موضوع
- جمله شروع جذاب
- دلیل مناسب‌بودن برای کلیپ کوتاه
- عنوان پیشنهادی
- متن کوتاه روی کاور

هر کلیپ باید مستقل، قابل فهم و بین ۳۰ تا ۹۰ ثانیه باشد.
جمله‌ها را تغییر نده و فقط از متن واقعی Transcript استفاده کن.

این خروجی باید توسط تدوینگر بررسی شود؛ زیرا مدل ممکن است مرز زمانی یا پیوستگی معنایی را دقیق تشخیص ندهد.

تولید عنوان و توضیحات ویدئو

پس از نهایی‌شدن Transcript می‌توانید از مدل متنی بخواهید:

  • عنوان یوتیوب
  • عنوان آپارات
  • توضیحات ویدئو
  • فصل‌بندی
  • هشتگ
  • کپشن شبکه اجتماعی
  • متن Thumbnail
  • CTA
  • خلاصه مقاله
  • خبرنامه مرتبط

نمونه پرامپت:

بر اساس Transcript زیر، برای یک ویدئوی آموزشی فارسی ارائه کن:

1. پنج عنوان جذاب و غیرکلیک‌بیتی
2. توضیحات ۲۰۰ کلمه‌ای
3. فصل‌بندی همراه با تایم‌کد
4. سه متن کوتاه برای Thumbnail
5. پنج هشتگ مرتبط
6. یک CTA کوتاه

هیچ ادعایی خارج از Transcript اضافه نکن.

ساخت B-roll با مدل‌های ویدئویی

اگر نمای مکمل مناسب در آرشیو ندارید، می‌توانید با مدل ویدئویی B-roll تولید کنید و آن را وارد Premiere کنید.

نمونه پرامپت:

Cinematic close-up of a software developer typing on a laptop
in a modern dark office, subtle purple and blue ambient lighting,
slow camera push-in, realistic hands, shallow depth of field,
clean professional technology commercial, 16:9

برای هماهنگی بهتر B-roll با پروژه، این موارد را مشخص کنید:

  • نسبت تصویر
  • طول نما
  • حرکت دوربین
  • سوژه
  • محیط
  • نور
  • رنگ
  • سرعت حرکت
  • میزان واقع‌گرایی
  • فضای خالی
  • سبک کلی پروژه

قابلیت، زمان تولید، فرمت خروجی و قیمت مدل‌های ویدئویی متفاوت است. اطلاعات به‌روز در صفحه مدل‌های درواره قرار دارد.

هوش مصنوعی کدام بخش تدوین را نباید بدون بازبینی انجام دهد؟

تصمیم درباره روایت

مدل می‌تواند بخش‌های مهم را پیشنهاد کند، اما درک هدف، مخاطب و احساس نهایی بر عهده تدوینگر است.

زیرنویس نهایی

زیرنویس خودکار باید از نظر معنا، زمان‌بندی و نگارش بررسی شود.

اصلاح رنگ نهایی

Auto Color نقطه شروع است. تطبیق پوست، محصول و هویت بصری برند به کنترل انسانی نیاز دارد.

حذف تمام مکث‌ها

مکث همیشه اضافه نیست. گاهی بخشی از ریتم، احساس یا تأکید گوینده است.

انتخاب موسیقی

هماهنگی موسیقی با روایت، مخاطب، برند و ریتم ویدئو فقط با یک پیشنهاد خودکار کامل نمی‌شود.

خروجی نهایی

قبل از انتشار باید تمام ویدئو از ابتدا تا انتها دیده شود. فقط بررسی چند نقطه از Timeline کافی نیست.

اشتباهات رایج در استفاده از هوش مصنوعی Premiere

اعتماد کامل به Transcript

مدل ممکن است اسامی، اعداد و اصطلاحات تخصصی را اشتباه تشخیص دهد.

حذف متن بدون بررسی تصویر

حذف جمله ممکن است Jump Cut یا تغییر ناگهانی حالت سوژه ایجاد کند.

استفاده بیش از حد از Enhance Speech

صدای بیش از حد پردازش‌شده ممکن است مصنوعی و فلزی شود.

اعتماد کامل به Auto Reframe

در نماهای چندنفره یا پرتحرک، کادر باید دستی اصلاح شود.

استفاده از Generative Extend برای صحنه‌های طولانی

این ابزار برای افزودن زمان کوتاه طراحی شده است، نه تولید یک سکانس کامل.

تولید زیرنویس‌های بسیار طولانی

کاربر موبایل فرصت خواندن پاراگراف‌های طولانی را ندارد.

نادیده‌گرفتن فایل اصلی

همیشه Sequence و فایل‌های خام را حفظ کنید.

استفاده از هوش مصنوعی بدون هدف

قبل از اجرای هر ابزار مشخص کنید چه مشکلی را می‌خواهید حل کنید. استفاده بی‌هدف از قابلیت‌های مولد ممکن است زمان پروژه را بیشتر کند.

چک‌لیست خروجی نهایی ویدئو

تصویر

  • رزولوشن Sequence درست است.
  • نسبت تصویر با پلتفرم هماهنگ است.
  • کادر سوژه در تمام نماها بررسی شده است.
  • رنگ پوست طبیعی است.
  • نور نماها بیش از حد متفاوت نیست.
  • فریم‌های Generative Extend ایراد آشکار ندارند.
  • B-roll با محتوای گوینده هماهنگ است.
  • متن و لوگو در محدوده امن قرار دارند.

صدا

  • صدای گفتگو واضح است.
  • نویز آزاردهنده وجود ندارد.
  • Enhance Speech بیش از حد اعمال نشده است.
  • موسیقی روی گفتگو غلبه نمی‌کند.
  • تغییر بلندی میان کلیپ‌ها شدید نیست.
  • ابتدا و انتهای صدا قطع نشده است.
  • Peak خروجی کنترل شده است.

زیرنویس

  • متن با صدا هماهنگ است.
  • کلمات فارسی درست نوشته شده‌اند.
  • نیم‌فاصله‌ها بررسی شده‌اند.
  • نام‌های خاص صحیح هستند.
  • خطوط بیش از حد طولانی نیستند.
  • زیرنویس با پس‌زمینه کنتراست دارد.
  • رابط کاربری پلتفرم روی متن را نمی‌پوشاند.

محتوا

  • شروع ویدئو جذاب است.
  • توضیح اضافه حذف شده است.
  • روایت پیوستگی دارد.
  • CTA واضح است.
  • اطلاعات مهم حذف نشده‌اند.
  • ادعای خارج از محتوای اصلی اضافه نشده است.

پرسش‌های متداول

هوش مصنوعی پریمیر پرو چه کارهایی انجام می‌دهد؟

می‌تواند در جست‌وجوی فایل‌ها، تبدیل گفتار به متن، تدوین متنی، بهبود صدای گفتگو، ساخت زیرنویس، ترجمه Caption، تغییر کادر و گسترش کوتاه کلیپ کمک کند.

Text-Based Editing چیست؟

قابلیتی است که Transcript ویدئو را به Timeline متصل می‌کند. با حذف یا جابه‌جایی متن، بخش مرتبط ویدئو نیز ویرایش می‌شود.

آیا Premiere زیرنویس فارسی می‌سازد؟

این موضوع به زبان‌های پشتیبانی‌شده در نسخه و بسته‌های زبانی نصب‌شده بستگی دارد. اگر فارسی در دسترس نباشد یا دقت کافی نداشته باشد، می‌توانید فایل SRT را با مدل Speech to Text بسازید و وارد Premiere کنید.

چگونه صدای بد را در Premiere بهتر کنیم؟

کلیپ گفتگو را انتخاب و از Enhance Speech در پنل Essential Sound استفاده کنید. شدت پردازش را کنترل و خروجی را با فایل اصلی مقایسه کنید.

آیا می‌توان ویدئوی افقی را به عمودی تبدیل کرد؟

بله. Auto Reframe می‌تواند Sequence را به نسبت 9:16 یا نسبت‌های دیگر تبدیل و سوژه را دنبال کند. نتیجه باید به‌صورت دستی بازبینی شود.

Generative Extend چه کاری انجام می‌دهد؟

چند فریم جدید به ابتدا یا انتهای بعضی کلیپ‌ها اضافه می‌کند تا Transition، نمای واکنش یا صدای محیط کمی طولانی‌تر شود.

آیا Generative Extend می‌تواند دیالوگ را ادامه دهد؟

خیر. این قابلیت برای تولید یا ادامه گفتگوی انسانی طراحی نشده است و بیشتر برای تصویر و صدای محیط کاربرد دارد.

آیا برای Generative Extend اینترنت لازم است؟

بله. پردازش این قابلیت از مدل ابری استفاده می‌کند و به اتصال اینترنت نیاز دارد.

آیا هوش مصنوعی می‌تواند ویدئو را کامل تدوین کند؟

ابزارها می‌توانند بخش زیادی از کارهای تکراری را سریع‌تر کنند، اما روایت، ریتم، انتخاب نما و کنترل کیفیت همچنان به تدوینگر نیاز دارد.

چگونه زیرنویس ساخته‌شده با API را وارد Premiere کنیم؟

زیرنویس را در قالب SRT ذخیره کنید، آن را وارد Project Panel کرده و روی Timeline قرار دهید. سپس ظاهر، زمان‌بندی و متن را بازبینی کنید.

هزینه استفاده از مدل‌های هوش مصنوعی درواره چقدر است؟

قیمت به مدل، نوع ورودی، مدت صدا یا ویدئو، تعداد توکن و کیفیت خروجی بستگی دارد. برای مشاهده Model ID و قیمت جاری به صفحه مدل‌های درواره مراجعه کنید.

جمع‌بندی

هوش مصنوعی در Premiere می‌تواند بسیاری از مراحل زمان‌بر تدوین را سریع‌تر کند. Media Intelligence یافتن نماها را آسان‌تر می‌کند، Text-Based Editing تدوین مصاحبه و پادکست را سرعت می‌دهد، Enhance Speech کیفیت گفتگو را بهتر می‌کند، Auto Reframe ساخت نسخه عمودی را ساده‌تر می‌سازد و Generative Extend می‌تواند کمبود چند فریم را جبران کند.

برای رسیدن به نتیجه حرفه‌ای بهتر است:

  • ابتدا فایل‌ها را منظم کنید.
  • Transcript را قبل از تدوین اصلاح کنید.
  • تدوین متنی را با بازبینی تصویری ترکیب کنید.
  • پردازش صدا را کنترل‌شده انجام دهید.
  • Auto Reframe را کلیپ‌به‌کلیپ بررسی کنید.
  • از Generative Extend فقط برای ادامه کوتاه نما استفاده کنید.
  • زیرنویس فارسی را به‌طور کامل بازبینی کنید.
  • خروجی نهایی را از ابتدا تا انتها تماشا کنید.

اگر قصد دارید مراحل تبدیل صدا به متن، ساخت زیرنویس، خلاصه‌سازی ویدئو، تولید سناریو، تحلیل Transcript یا تولید محتوای تصویری و ویدئویی را خودکار کنید، می‌توانید از API درواره استفاده کنید.

فهرست مدل‌های متنی، صوتی، تصویری و ویدئویی، قابلیت هر مدل، Model ID و قیمت‌های جاری در صفحه مدل‌های درواره قابل مشاهده است.

مقالات مرتبط

برای مطالعه شرایط استفاده و محدودیت‌های مسئولیت، صفحه «سلب مسئولیت» را مشاهده کنید.

Read more

اتوماسیون هوش مصنوعی چیست؟ کاربردها و آموزش ساخت AI Automation

اتوماسیون هوش مصنوعی چیست؟ کاربردها و آموزش ساخت AI Automation

اتوماسیون هوش مصنوعی با ترکیب گردش‌کارهای خودکار و مدل‌های هوش مصنوعی، پردازش متن، دسته‌بندی، استخراج اطلاعات و تصمیم‌های پیشنهادی را خودکار می‌کند. در این راهنما، معماری و ساخت نمونه عملی آن با API درواره را می‌آموزید.

Agentic Commerce چیست؟ آینده خرید با ایجنت هوش مصنوعی

Agentic Commerce چیست؟ آینده خرید با ایجنت هوش مصنوعی

Agentic Commerce شیوه‌ای جدید برای خرید اینترنتی است که در آن ایجنت هوش مصنوعی می‌تواند نیاز کاربر را بفهمد، محصولات را جست‌وجو و مقایسه کند و فرایند خرید را پیش ببرد. در این راهنما با معماری، UCP، ACP و پیاده‌سازی آن با API درواره آشنا می‌شوید.