CoreTech

تراشه A20 پرو اجرای مدل هوش مصنوعی ۲۷ میلیارد پارامتری را دو برابر سریع‌تر کرد

پوریا | ۸ ساعت پیش

تراشه A20 پرو در آیفون ۱۸ پرو توانسته است یک مدل هوش مصنوعی با ۲۷ میلیارد پارامتر را با سرعتی دو برابر بیشتر از آیفون ۱۷ پرو مجهز به A19 پرو اجرا کند. این نتیجه در آزمایشی با مدل Bonsai 27B به نمایش گذاشته شده و نشان می‌دهد ارتقای سخت‌افزار اپل، به‌ویژه در بخش پردازش هوش مصنوعی، می‌تواند اجرای مدل‌های بزرگ را مستقیماً روی گوشی و بدون نیاز به اینترنت سریع‌تر کند.

در این آزمایش Adrien Grondin مدل Bonsai 27B را روی آیفون ۱۸ پرو اجرا کرده، سرعت تولید توکن‌ها در دستگاه جدید به‌وضوح بیشتر از نسل قبلی به نظر می‌رسد و اختلاف عملکرد، به دو برابر می‌رسد. این پیشرفت تنها به پردازنده اصلی مربوط نیست؛ حافظه سریع‌تر و تغییرات گسترده در واحد پردازش عصبی نیز در افزایش سرعت اجرای مدل‌های هوش مصنوعی روی گوشی نقش دارند.

اپل در A20 پرو برای نخستین‌بار در تاریخ تراشه‌های اختصاصی خود از Neural Engine دوگانه با مجموع ۳۲ هسته، در قالب دو واحد ۱۶ هسته‌ای، استفاده کرده. این ساختار برای پردازش وظایف هوش مصنوعی طراحی شده و در بارهای کاری ویژه NPU، حداکثر توان پردازشی آن از پردازنده گرافیکی ۷ هسته‌ای تراشه نیز فراتر می‌رود. چنین تغییری می‌تواند اجرای مدل‌های متراکم‌تر را روی گوشی امکان‌پذیرتر کند.

هر دو مدل آیفون ۱۸ پرو و آیفون ۱۸ پرو مکس به ۱۲ گیگابایت حافظه LPDDR5X با رابط ۹۶ بیتی مجهز شده‌اند؛ حافظه‌ای که سرعت بسیار بیشتری از پیکربندی به‌کاررفته در آیفون ۱۷ پرو و آیفون ۱۷ پرو مکس دارد. پهنای باند حافظه یکپارچه در این نسل به ۱۱۵.۲ گیگابایت‌برثانیه می‌رسد و در کنار Neural Engine جدید، به بهبود عملکرد مدل‌های هوش مصنوعی کمک می‌کند.

با وجود این پیشرفت‌ها، اجرای مدل‌های بزرگ‌تر همچنان با محدودیت‌هایی همراه است. در توضیحات آزمایش اشاره شده که پس از انتشار Bonsai 2، ممکن است ادامه استفاده از نسخه قبلی چندان منطقی به نظر نرسد؛ اما نسخه جدید با کوانتیزه‌سازی ۲ بیتی، آن‌قدر حجیم است که نمی‌تواند به‌طور کامل روی آیفون ۱۸ پرو جای بگیرد. این محدودیت در اجرای محلی، باعث افت عملکرد می‌شود و نشان می‌دهد ظرفیت حافظه همچنان عامل تعیین‌کننده‌ای است.

در مقابل Bonsai از کوانتیزه‌سازی یک‌بیتی استفاده می‌کند و به همین دلیل می‌تواند حتی روی دستگاه‌هایی با ۴ گیگابایت رم اجرا شود. گوشی‌های مجهز به ۸ یا ۱۲ گیگابایت حافظه نیز فضای مناسبی برای اجرای آن دارند. آیفون ۱۸ پرو با ترکیب A20 پرو، حافظه سریع‌تر، پهنای باند ۱۱۵.۲ گیگابایت‌برثانیه و Neural Engine جدید، می‌تواند Bonsai 27B را بدون افت محسوس سرعت اجرا کند؛ البته این موضوع به مدل انتخاب‌شده و حجم آن وابسته است.

اجرای مدل ۲۷ میلیارد پارامتری به‌صورت محلی، بدون اتصال اینترنت، گام مهمی در توانایی گوشی‌های هوشمند برای پردازش هوش مصنوعی محسوب می‌شود؛ بااین‌حال، آزمایش حاضر نشان می‌دهد که افزایش توان پردازشی به‌تنهایی برای اجرای همه مدل‌ها کافی نیست. حتی با سخت‌افزار سریع‌تر، محدودیت ظرفیت حافظه می‌تواند مانع استفاده از مدل‌های حجیم‌تر شود و انتخاب نسخه و سطح کوانتیزه‌سازی همچنان اهمیت زیادی دارد.

در نهایت، انتظار می‌رود با افزایش ظرفیت حافظه در نسل‌های آینده آیفون، امکان اجرای مدل‌های متراکم‌تر هوش مصنوعی نیز فراهم شود. در حال حاضر، ترکیب سخت‌افزاری آیفون ۱۸ پرو اجرای Bonsai 27B را با سرعت بیشتری نسبت به نسل قبل ممکن کرده، اما پشتیبانی از مدل‌های بزرگ‌تر همچنان به فضای حافظه موردنیاز آن‌ها وابسته است، تغییرات آینده در پیکربندی حافظه می‌تواند این محدودیت را کاهش دهد.

منبع

پوریا | ۸ ساعت پیش

دیدگاهتان را بنویسید