CoreTech

آرم Mali G2-Ultra NX و C2-Ultra به همراه C2-Pro

آرم از سری معماری C2 و Mali G2-Ultra NX با جهش هوش مصنوعی و رهگیری پرتو رونمایی کرد

ابوالفضل | ۱ روز پیش

آرم از پلتفرم پرچم‌دار جدید خود با نام CSS for Mobile 2 رونمایی کرد؛ مجموعه‌ای که C2-Ultra و C2-Pro را در بخش پردازنده و Mali G2-Ultra NX را در بخش گرافیک دارد. این پلتفرم با تمرکز بر هوش مصنوعی، تا ۱.۷ برابر عملکرد بهتر در مدل‌های آزمایش‌شده و تا ۱۵ درصد کارایی تک‌هسته‌ای بیشتر ارائه می‌کند، رهگیری پرتو و قابلیت‌های گرافیکی نیز در نسل تازه ارتقا یافته‌اند.

آرم در این نسل ظاهراً نام‌گذاری Lumex را کنار گذاشته است؛ تنها یک سال پس از آنکه این برند را جایگزین Cortex برای معرفی IP پردازنده‌های موبایلی کرد. همچنین مانند برخی نسل‌های گذشته، خبری از نسخه تازه هسته‌های E نیست و هسته میانی Lumex C1 Premium نیز ظاهراً به‌روزرسانی نشده است. CSS for Mobile 2 علاوه بر CPU و GPU جدید، رابط اتصال سیستمی و پشته نرم‌افزاری به‌روزشده دارد.

C2-Ultra هسته پردازشی پرقدرت جدید آرم است و C2-Pro به‌عنوان هسته میان‌رده پایین‌تر، یک سطح بالاتر از Lumex C1-Nano قرار می‌گیرد. آزم می‌گوید نسل جدید تا ۱۵ درصد عملکرد تک‌هسته‌ای و ۱۲ درصد عملکرد چند‌هسته‌ای بیشتری دارد. وب‌گردی نیز تا ۱۵ درصد سریع‌تر شده و زمان اجرای برنامه‌ها تا ۱۲ درصد کاهش یافته است. تمرکز مهم‌تر اما به افزایش توان پردازش هوش مصنوعی مربوط می‌شود.

در یک پیکربندی نمونه پرچم‌دار، دو هسته C2-Ultra، شش هسته C2-Pro و دو واحد SME2 کنار هم قرار می‌گیرند. این ساختار دو برابر نسل قبل ظرفیت SME2 دارد و برای مدل‌های محلی و وظایف عامل‌محور طراحی شده است. Arm می‌گوید کلاستر جدید در مدل‌های هوش مصنوعی آزمایش‌شده تا ۱.۷ برابر عملکرد بالاتری دارد و پیکربندی دو C2-Ultra با دو SME2، یک فرآیند کامل را ۲۴ درصد سریع‌تر انجام می‌دهد، این پلتفرم قابل تنظیم است.

آرم این توان را برای پردازش گفتار روی دستگاه، بازیابی اطلاعات، استدلال و دیگر وظایف حساس به تأخیر در نظر گرفته است. در معماری جدید، CPU نقش هماهنگ‌کننده یک عامل را دارد؛ زمینه و وضعیت وظیفه را حفظ می‌کند و تشخیص می‌دهد هر مرحله با برنامه محلی، مدل روی دستگاه، شتاب‌دهنده یا سرویس ابری اجرا شود. عملکرد تک‌هسته‌ای بالاتر تأخیر مراحل را کاهش می‌دهد و توان چند‌هسته‌ای اجرای هم‌زمان بازیابی و استنتاج را ممکن می‌کند.

ادعاهای رسمی آرم در رابطه با CSS for Mobile 2:

این پردازنده‌ها به رابط سیستمی SI L2 متصل می‌شوند که انسجام داده، کنترل کیفیت سرویس و ارتباط پرظرفیت‌تر و کم‌تأخیرتر میان منابع پردازشی را فراهم می‌کند. Arm همچنین بهینه‌سازی‌های خود را تا مرحله پیاده‌سازی فیزیکی ادامه داده است تا شرکا بتوانند پیش از ادغام IP، عملکرد، مساحت و مصرف توان را ارزیابی کنند. سازندگان تراشه نیز می‌توانند اجزای پلتفرم را مستقل استفاده یا با IP شرکت‌های دیگر ترکیب کنند.

Mali G2-Ultra NX به‌عنوان نخستین GPU مالی Arm با رویکرد AI-native معرفی شده و شتاب‌دهنده‌های عصبی اختصاصی را مستقیماً در هسته‌های شیدر جای می‌دهد. این شتاب‌دهنده‌ها از سیستم حافظه، کش‌های منسجم و ساختارهای کنترلی مشترک با سخت‌افزار گرافیکی استفاده می‌کنند تا جابه‌جایی داده کاهش یابد. سه فناوری اصلی آن شامل نمونه‌برداری فوق‌العاده عصبی یا NSS، ارتقای نرخ فریم عصبی یا NFRU و NSS همراه با حذف نویز یا NSSD است.

NSS تصویر با وضوح بالاتر را از رندر پایین‌تر بازسازی می‌کند، NFRU فریم‌های میانی می‌سازد و NSSD ارتقای وضوح را با بازسازی پرتو و حذف نویز برای صحنه‌های سنگین رهگیری پرتو ترکیب می‌کند. در دموی Neural Dawn، ترکیب NFRU و NSSD تا چهار برابر بهره‌وری عملکرد بالاتر و حداکثر ۷۰ درصد ترافیک حافظه خارجی کمتر از رندر بومی داشت. Arm می‌گوید این روش می‌تواند قابلیت‌هایی مانند MegaLights در Unreal Engine را روی موبایل عملی‌تر کند.

برای نمونه، NFRU می‌تواند رندر ۳۰ فریم‌برثانیه را به خروجی ۶۰ فریم‌برثانیه تبدیل کند. Arm همچنین این فناوری را مسیری برای دستیابی پایدار به ۱۲۰ فریم‌برثانیه در بازی‌های موبایلی می‌داند، بدون اینکه همه فریم‌ها به‌صورت سنتی رندر شوند. بااین‌حال، افزایش عملکرد G2-Ultra NX فقط به رندر عصبی محدود نیست؛ موتور اجرای آن بازطراحی شده و Arm این تغییر را بزرگ‌ترین تحول معماری مجموعه دستورهای Mali طی هفت نسل اخیر می‌داند.

در طراحی جدید تعداد رجیسترها برای شیدرهای پیچیده تا دو برابر شده است و Arm تا ۲۴ درصد عملکرد بالاتر در بنچمارک‌ها و تا ۱۴ درصد عملکرد بهتر در بازی‌های غیرهوش مصنوعی نسبت به نسل قبل اعلام می‌کند. G2-Ultra NX به نسل سوم واحد Ray Tracing Arm مجهز است و از Opacity Micromaps پشتیبانی سخت‌افزاری دارد تا هندسه‌های شفاف پیچیده را با هزینه کمتر پردازش کند.

منبع

ابوالفضل | ۱ روز پیش

دیدگاهتان را بنویسید