CoreTech

تراشه ۵ نانومتری علی‌بابا حالا مدل ۲۷ میلیارد پارامتری Qwen-3.8 را اجرا می‌کند

ابوالفضل | ۱ ساعت پیش

علی‌بابا پشتیبانی روز صفر از Qwen-3.8 27B را روی تراشه RISC-V خود، XuanTie C950 فراهم کرده است؛ تراشه‌ای که گفته می‌شود با فناوری ۵ نانومتری TSMC ساخته شده و اکنون این مدل ۲۷ میلیارد پارامتری را با سرعت ۳۰ توکن بر ثانیه اجرا می‌کند. زمان رسیدن به نخستین توکن نیز تنها ۱.۹ ثانیه اعلام شده است. Qwen-3.8 27B می‌تواند با ۳۲ گیگابایت VRAM اجرا شود.

XuanTie C950 در مارس ۲۰۲۶ معرفی شد و برخلاف بسیاری از راهکارهای شتاب‌دهی هوش مصنوعی، برای اجرای این بارهای کاری به GPU متکی نیست. این محصول در اصل پردازنده‌ای ۶۴ بیتی مبتنی بر معماری متن‌باز RISC-V در سطح سرور است که ۶۴ هسته پردازشی را روی یک قطعه سیلیکون جای داده و فرکانس آن تا ۳.۲۰ گیگاهرتز می‌رسد. هسته‌ها در کلاسترهای هشت‌تایی قرار گرفته‌اند و با رابط‌های پرسرعت AMBA CHI به هم متصل می‌شوند.

علی‌بابا برای پردازش بارهای کاری هوش مصنوعی، موتورهای شتاب‌دهنده ماتریسی و برداری را مستقیماً داخل C950 قرار داده است. این تراشه از کش L1 استاندارد، کش L2 انعطاف‌پذیر و قابل‌پیکربندی و امکان استفاده از کش L3 مشترک بهره می‌برد تا ارتباط میان هسته‌ها دچار گلوگاه نشود. همچنین الگوریتم‌های پیش‌خوانی هوشمند در سطح سخت‌افزار، داده‌ها را پیش از درخواست موتور اجرا به سلسله‌مراتب کش منتقل می‌کنند.

معماری C950 علاوه بر شتاب‌دهنده‌های اختصاصی، از Decode هشت‌دستوری و پایپ‌لاین ۱۶ مرحله‌ای استفاده می‌کند. طراحی ۱۶ مرحله‌ای با تقسیم هر دستور به بخش‌های متعدد، میان دستیابی به فرکانس بالا و اجرای کارآمد پردازش‌های پیچیده سروری و هوش مصنوعی تعادل ایجاد می‌کند. استفاده از ISA متن‌باز RISC-V نیز به علی‌بابا امکان می‌دهد از هزینه‌های صدور مجوز معماری‌های x86 و ARM دور بماند و آزادی بیشتری برای سفارشی‌سازی داشته باشد.

به گفته اطلاعات منتشرشده، C950 نخستین پردازنده RISC-V طراحی‌شده برای اجرای کاملاً بومی مدل‌های زبانی بزرگ با میلیاردها پارامتر محسوب می‌شود؛ یعنی برای اجرای عملیات اصلی مدل‌های کوچک و متوسط، به شبیه‌سازی یا لایه ترجمه نیاز ندارد. البته این پردازنده مانند GPUها برای هم‌زمانی گسترده طراحی نشده و در هر سوکت تنها یک رشته استنتاج اجرا می‌کند. همین ویژگی، کاربرد آن را بیشتر به استقرار لبه‌ای و استنتاج خصوصی نزدیک می‌کند.

مدل Qwen-3.8 27B که اکنون پشتیبانی روز صفر از آن برای C950 فراهم شده، یک مدل هوش مصنوعی با وزن‌های باز و ۲۷ میلیارد پارامتر است. در منبع، توانایی‌های کدنویسی آن مشابه Opus 4.5 توصیف شده و گفته می‌شود مدل می‌تواند روی یک مک‌بوک واحد اجرا شود. اجرای این مدل روی تراشه اختصاصی علی‌بابا، امکان استفاده مستقیم از خانواده Qwen روی سخت‌افزار خود شرکت را فراهم کرده است.

علی‌بابا می‌تواند C950 را در مراکز داده خود در کنار شتاب‌دهنده‌های دیگر هوش مصنوعی به کار بگیرد و پردازش‌های استنتاجی را میان این منابع تقسیم کند. چنین رویکردی علاوه بر ایجاد انعطاف بیشتر در زیرساخت محاسباتی، به شرکت اجازه می‌دهد بخش بیشتری از نرم‌افزار و سخت‌افزار موردنیاز مدل‌های Qwen را در اکوسیستم خودش کنترل کند. با این حال، ساخت C950 با لیتوگرافی ۵ نانومتری TSMC هنوز از سوی علی‌بابا رسماً تأیید نشده است.

منبع

ابوالفضل | ۱ ساعت پیش

دیدگاهتان را بنویسید