» اخبار اقتصادی و عمومی » تکنولوژی » علی‌بابا از قدرتمندترین مدل هوش مصنوعی خود با نام Qwen3.8-Max رونمایی کرد

علی‌بابا از قدرتمندترین مدل هوش مصنوعی خود با نام Qwen3.8-Max رونمایی کرد

مرداد ۱۲, ۱۴۰۵ 001

شرکت چینی علی‌بابا از بزرگ‌ترین و قدرتمندترین مدل هوش مصنوعی خود تا به امروز با نام Qwen3.8-Max رونمایی کرد. این مدل از نظر ابعاد و مقیاس فاصله چندانی با جدیدترین محصول رقیب چینی خود، یعنی Kimi K3 از شرکت Moonshot AI ندارد. شرکت‌های فناوری چین که سهم مهمی در توسعه مدل‌های هوش مصنوعی وزن‌باز در سطح جهان دارند، وارد رقابتی فشرده و سریع شده‌اند تا بدون تحمیل هزینه‌های پردازشی کمرشکن، سیستم‌های قدرتمندتری بسازند.

مدل Qwen3.8-Max دارای ۲٫۴ تریلیون پارامتر است. برای مقایسه، مدل Kimi K3 شرکت Moonshot از ۲٫۸ تریلیون پارامتر بهره می‌برد. هرچند تعداد بالاتر پارامترها لزوماً به‌معنای برتری یک مدل نیست، اما این ویژگی به معیاری مهم برای سنجش حجم محاسبات و داده‌های پشت سیستم‌های پیشرفته هوش مصنوعی تبدیل شده است.

معماری و ویژگی‌های فنی مدل Qwen3.8-Max

شرکت‌های چینی تمایل زیادی به اعلام تعداد پارامترهای مدل‌های خود دارند تا توجه جامعه توسعه‌دهندگان را جلب کنند. اکثر این سیستم‌ها به‌صورت وزن‌باز عرضه می‌شوند؛ یعنی تنظیمات پایه‌ای که به توسعه‌دهندگان اجازه اجرای مستقیم یا سفارشی‌سازی مدل را می‌دهد، به‌صورت عمومی قابل دانلود است. در مقابل، شرکت‌های آمریکایی مانند OpenAI، آنتروپیک و گوگل تعداد پارامترهای مدل‌های بسته‌ خود را فاش نمی‌کنند.

بنچمارک مدل Qwen3.8-Max

مدل Qwen3.8-Max در پلتفرم مقایسه Arena.AI توانست رتبه نخست را در میان تمام مدل‌های متنی چینی کسب کند، هرچند همچنان در رتبه‌بندی کلی پس از مدل Claude Fable 5 و سه نسخه Opus شرکت آنتروپیک قرار دارد. اما در بخش پردازش و تحلیل تصاویر و محتوای بصری، این مدل توانست رتبه دوم جهانی را پس از یکی از متغیرهای Claude Fable 5 به دست آورد.

علی‌بابا از قدرتمندترین مدل هوش مصنوعی خود با نام Qwen3.8-Max رونمایی کرد
READ  باتری گلکسی اس 8 و اس 8 پلاس نسبت به پرچمداران گذشته طول عمر مفید بیشتری دارد

هر دو مدل Qwen3.8-Max و Kimi K3 توانایی پردازش متن، تصویر و ویدیو را دارند و می‌توانند تا ۱ میلیون توکن را به‌صورت هم‌زمان پردازش کنند. توکن‌ها قطعات کوچکی از داده‌ها مانند بخشی از کلمات هستند و پشتیبانی از حجم بالای آنها به این معناست که مدل می‌تواند متون بسیار طولانی مانند پرونده‌های حقوقی سنگین، کدهای نرم‌افزاری پیچیده یا سندهای چندصد صفحه‌ای را یک‌جا دریافت کند.

علی‌بابا اعلام کرده که این مدل از معماری «ترکیب متخصصان» (MoE) بهره می‌برد. این روش به‌جای فعال‌سازی کل مدل برای هر درخواست، کارها را میان بخش‌های تخصصی تقسیم می‌کند؛ به‌طوری‌که در هر درخواست تنها ۹۵ میلیارد پارامتر فعال می‌شوند که این موضوع هزینه‌ها و تأخیر در پاسخ‌دهی را به میزان چشمگیری کاهش می‌دهد. به گفته علی‌بابا، این مدل توانسته است یک پروژه کامل مهندسی نرم‌افزار را ظرف مدت ۱۶ روز به پایان برساند.

قرار است Qwen3.8-Max هفته آینده از طریق پلتفرم Model Studio در دسترس قرار بگیرد.

به این نوشته امتیاز بدهید!

دیدگاهتان را بنویسید

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *

  • ×