
ورود شیائومی به زیرساخت هوش مصنوعی: AI Cube برای اجرای لوکال مدلها رونمایی شد
شیائومی از یک مینیپیسی مفهومی به نام AI Cube رونمایی کرده است که برای اجرای محلی مدلهای زبانی بزرگ با حداکثر ۱۲۰ میلیارد پارامتر طراحی شده است. این دستگاه به سه تراشه Xring O3، Xring O100 و Xring D100 مجهز شده و برای اجرای مدلهای متنی، کدنویسی و صوتی شیائومی طراحی شده است، البته AI Cube هنوز نمونه اولیه است و زمان عرضه یا قیمت آن مشخص نشده است.
قلب پردازشی AI Cube تراشه جدید Xring O3 است که یک پردازنده مرکزی ۱۰ هستهای با تمام هستههای قدرتمند، پردازنده گرافیکی ۱۶ هستهای G2-Ultra NX و یک NPU کممصرف با توان ۲۰۰ تاپس دارد. در کنار آن، Xring O100 بهعنوان شتابدهنده هوش مصنوعی با پهنای باند بالا استفاده میشود. این تراشه با فناوری انباشت سهبعدی ویفر در سطح ۶ نانومتر ساخته شده و ۲۸۶۷۲ خط داده مؤثر دارد.
Xring O100 همچنین از پهنای باند محاسباتی نزدیک به حافظه تا سقف ۱.۲۲ ترابایت بر ثانیه پشتیبانی میکند؛ قابلیتی که برای پردازش مدلهای بزرگ اهمیت دارد. تراشه سوم، XRING D100، با لیتوگرافی ۳ نانومتری ساخته شده و برای وظایف مرتبط با رانندگی هوشمند در نظر گرفته شده است. این تراشه پردازنده ۲۰ هستهای قدرتمند، NPU شانزده هستهای و پشتیبانی از حداکثر ۱۶۰ گیگابایت حافظه را ارائه میدهد.
شیائومی برای بدنه AI Cube سراغ ساختار یکپارچه از آلومینیوم با استاندارد هوافضا رفته است و به گفتهی شرکت روی این بدنه ۳۳۸۷۴ برش دقیق CNC ایجاد شده و سیستم میتواند توان مصرفی مداوم تا ۱۵۰ وات را حفظ کند. از نظر نرمافزاری و کاربردی، دستگاه امکان اجرای محلی مدلهایی با اندازه ۳ تا ۱۲۰ میلیارد پارامتر را دارد و کاربر میتواند با یک گزینه، بین حالتهای سریع و کند سیستم متناسب با نوع وظیفه جابهجا شود.
از نظر ابعاد کاربردی، AI Cube به محصولی مانند Tiiny AI Pocket Lab شباهت دارد که آن هم اجرای محلی مدلهای ۱۲۰ میلیارد پارامتری را در فرمفاکتوری کوچک ممکن میکند؛ با این تفاوت که شیائومی در نمونه خود از تراشههای اختصاصی استفاده کرده است. این دستگاه در کنفرانس ارتباطات فناوری تراشه XRING معرفی شد، اما هنوز مشخص نیست به محصول نهایی تبدیل میشود یا صرفاً بهعنوان یک نمایش فنی باقی خواهد ماند.




