چین از بزرگ‌ترین مدل هوش مصنوعی آموزش‌دیده با تراشه‌های داخلی رونمایی کرد؛ Meituan مدل LongCat-2.0 را متن‌باز کرد

LongCat-2.0 دارای ۱.۶ تریلیون پارامتر و پنجرۀ متنی (Context Window) یک میلیون توکنی است؛ مشخصاتی که آن را هم‌رده با جدیدترین مدل پرچم‌دار DeepSeek قرار می‌دهد.

Share
چین از بزرگ‌ترین مدل هوش مصنوعی آموزش‌دیده با تراشه‌های داخلی رونمایی کرد؛ Meituan مدل LongCat-2.0 را متن‌باز کرد

شرکت چینی Meituan، یکی از بزرگ‌ترین پلتفرم‌های خدمات آنلاین و سفارش غذا در چین، از مدل زبانی جدید خود با نام LongCat-2.0 رونمایی کرد؛ مدلی که به گفته این شرکت، بزرگ‌ترین مدل هوش مصنوعی چین است که به‌طور کامل با تراشه‌های ساخت داخل آموزش دیده است.

این خبر می‌تواند نقطه عطفی برای صنعت هوش مصنوعی چین باشد؛ زیرا تاکنون بسیاری از مدل‌های پیشرفته چینی برای مرحلۀ آموزش (Training) همچنان به پردازنده‌های گرافیکی شرکت‌های خارجی، به‌ویژه NVIDIA، وابسته بودند.

LongCat-2.0 چه مشخصاتی دارد؟

مدل LongCat-2.0 از نظر ابعاد و توان پردازشی در سطح پیشرفته‌ترین مدل‌های متن‌باز جهان قرار می‌گیرد.

مهم‌ترین ویژگی‌های این مدل عبارت‌اند از:

  • ۱.۶ تریلیون پارامتر (Parameters)
  • پنجرۀ متنی (Context Window) برابر با ۱ میلیون توکن
  • متن‌باز (Open Source)
  • آموزش و اجرای کامل با تراشه‌های هوش مصنوعی ساخت چین

از نظر مقیاس، این مدل با DeepSeek-V4-pro، یکی از قدرتمندترین مدل‌های زبانی چین، قابل مقایسه است.

تفاوت مهم با DeepSeek

آنچه LongCat-2.0 را متمایز می‌کند، صرفاً تعداد پارامترها نیست.

بر اساس اعلام Meituan، مدل DeepSeek-V4-pro تنها در مرحلۀ Inference (پاسخ‌گویی به کاربران) از تراشه‌های داخلی استفاده می‌کند.

اما LongCat-2.0 تمام مراحل زیر را با سخت‌افزار بومی انجام داده است:

  • پیش‌آموزش (Pre-training)
  • آموزش مدل
  • استنتاج (Inference)

این موضوع از نظر فنی اهمیت بسیار زیادی دارد؛ زیرا مرحلۀ Pre-training پرهزینه‌ترین و پیچیده‌ترین بخش توسعۀ یک مدل زبانی بزرگ محسوب می‌شود و نیازمند توان پردازشی بسیار بالاست.

آموزش روی خوشه‌ای متشکل از ۵۰ هزار تراشه

Meituan اعلام کرده است که LongCat-2.0 روی یک خوشۀ پردازشی شامل ۵۰ هزار شتاب‌دهندۀ هوش مصنوعی داخلی آموزش داده شده است.

به گفتۀ این شرکت، این نخستین مدل تریلیون‌پارامتری صنعت است که کل فرایند آموزش و استنتاج را روی چنین زیرساخت بومی انجام داده است.

استفاده از تراشه‌های ASIC

طبق اعلام Meituan، این مدل روی خوشه‌های بزرگی از AI ASIC Superpods توسعه یافته است.

ASIC یا Application-Specific Integrated Circuit نوعی تراشه است که برای انجام یک وظیفۀ مشخص طراحی می‌شود و برخلاف پردازنده‌های عمومی، برای بارهای کاری خاص مانند آموزش مدل‌های هوش مصنوعی بهینه شده است.

استفاده از این معماری نشان می‌دهد چین به‌دنبال توسعۀ زیرساخت‌هایی است که بدون وابستگی به پردازنده‌های خارجی، امکان آموزش مدل‌های بسیار بزرگ را فراهم کنند.

چرا این خبر اهمیت دارد؟

عرضه LongCat-2.0 تنها معرفی یک مدل جدید نیست؛ بلکه نشان می‌دهد چین در حال عبور از مرحلۀ استفاده از تراشه‌های داخلی صرفاً برای اجرای مدل‌ها (Inference) است و اکنون می‌تواند مدل‌های تریلیون‌پارامتری را نیز با سخت‌افزار بومی آموزش دهد.

اگر این ادعا در عمل نیز تأیید شود، می‌تواند گام مهمی در کاهش وابستگی صنعت هوش مصنوعی چین به سخت‌افزارهای خارجی و افزایش رقابت در بازار جهانی مدل‌های زبانی بزرگ باشد.


منبع: South China Morning Post (SCMP)

Read more

اتوماسیون هوش مصنوعی چیست؟ کاربردها و آموزش ساخت AI Automation

اتوماسیون هوش مصنوعی چیست؟ کاربردها و آموزش ساخت AI Automation

اتوماسیون هوش مصنوعی با ترکیب گردش‌کارهای خودکار و مدل‌های هوش مصنوعی، پردازش متن، دسته‌بندی، استخراج اطلاعات و تصمیم‌های پیشنهادی را خودکار می‌کند. در این راهنما، معماری و ساخت نمونه عملی آن با API درواره را می‌آموزید.

Agentic Commerce چیست؟ آینده خرید با ایجنت هوش مصنوعی

Agentic Commerce چیست؟ آینده خرید با ایجنت هوش مصنوعی

Agentic Commerce شیوه‌ای جدید برای خرید اینترنتی است که در آن ایجنت هوش مصنوعی می‌تواند نیاز کاربر را بفهمد، محصولات را جست‌وجو و مقایسه کند و فرایند خرید را پیش ببرد. در این راهنما با معماری، UCP، ACP و پیاده‌سازی آن با API درواره آشنا می‌شوید.