
تراشه ۵ نانومتری علیبابا حالا مدل ۲۷ میلیارد پارامتری Qwen-3.8 را اجرا میکند
علیبابا پشتیبانی روز صفر از Qwen-3.8 27B را روی تراشه RISC-V خود، XuanTie C950 فراهم کرده است؛ تراشهای که گفته میشود با فناوری ۵ نانومتری TSMC ساخته شده و اکنون این مدل ۲۷ میلیارد پارامتری را با سرعت ۳۰ توکن بر ثانیه اجرا میکند. زمان رسیدن به نخستین توکن نیز تنها ۱.۹ ثانیه اعلام شده است. Qwen-3.8 27B میتواند با ۳۲ گیگابایت VRAM اجرا شود.
XuanTie C950 در مارس ۲۰۲۶ معرفی شد و برخلاف بسیاری از راهکارهای شتابدهی هوش مصنوعی، برای اجرای این بارهای کاری به GPU متکی نیست. این محصول در اصل پردازندهای ۶۴ بیتی مبتنی بر معماری متنباز RISC-V در سطح سرور است که ۶۴ هسته پردازشی را روی یک قطعه سیلیکون جای داده و فرکانس آن تا ۳.۲۰ گیگاهرتز میرسد. هستهها در کلاسترهای هشتتایی قرار گرفتهاند و با رابطهای پرسرعت AMBA CHI به هم متصل میشوند.

علیبابا برای پردازش بارهای کاری هوش مصنوعی، موتورهای شتابدهنده ماتریسی و برداری را مستقیماً داخل C950 قرار داده است. این تراشه از کش L1 استاندارد، کش L2 انعطافپذیر و قابلپیکربندی و امکان استفاده از کش L3 مشترک بهره میبرد تا ارتباط میان هستهها دچار گلوگاه نشود. همچنین الگوریتمهای پیشخوانی هوشمند در سطح سختافزار، دادهها را پیش از درخواست موتور اجرا به سلسلهمراتب کش منتقل میکنند.
معماری C950 علاوه بر شتابدهندههای اختصاصی، از Decode هشتدستوری و پایپلاین ۱۶ مرحلهای استفاده میکند. طراحی ۱۶ مرحلهای با تقسیم هر دستور به بخشهای متعدد، میان دستیابی به فرکانس بالا و اجرای کارآمد پردازشهای پیچیده سروری و هوش مصنوعی تعادل ایجاد میکند. استفاده از ISA متنباز RISC-V نیز به علیبابا امکان میدهد از هزینههای صدور مجوز معماریهای x86 و ARM دور بماند و آزادی بیشتری برای سفارشیسازی داشته باشد.
به گفته اطلاعات منتشرشده، C950 نخستین پردازنده RISC-V طراحیشده برای اجرای کاملاً بومی مدلهای زبانی بزرگ با میلیاردها پارامتر محسوب میشود؛ یعنی برای اجرای عملیات اصلی مدلهای کوچک و متوسط، به شبیهسازی یا لایه ترجمه نیاز ندارد. البته این پردازنده مانند GPUها برای همزمانی گسترده طراحی نشده و در هر سوکت تنها یک رشته استنتاج اجرا میکند. همین ویژگی، کاربرد آن را بیشتر به استقرار لبهای و استنتاج خصوصی نزدیک میکند.
مدل Qwen-3.8 27B که اکنون پشتیبانی روز صفر از آن برای C950 فراهم شده، یک مدل هوش مصنوعی با وزنهای باز و ۲۷ میلیارد پارامتر است. در منبع، تواناییهای کدنویسی آن مشابه Opus 4.5 توصیف شده و گفته میشود مدل میتواند روی یک مکبوک واحد اجرا شود. اجرای این مدل روی تراشه اختصاصی علیبابا، امکان استفاده مستقیم از خانواده Qwen روی سختافزار خود شرکت را فراهم کرده است.
علیبابا میتواند C950 را در مراکز داده خود در کنار شتابدهندههای دیگر هوش مصنوعی به کار بگیرد و پردازشهای استنتاجی را میان این منابع تقسیم کند. چنین رویکردی علاوه بر ایجاد انعطاف بیشتر در زیرساخت محاسباتی، به شرکت اجازه میدهد بخش بیشتری از نرمافزار و سختافزار موردنیاز مدلهای Qwen را در اکوسیستم خودش کنترل کند. با این حال، ساخت C950 با لیتوگرافی ۵ نانومتری TSMC هنوز از سوی علیبابا رسماً تأیید نشده است.




