
تراشه A20 پرو اجرای مدل هوش مصنوعی ۲۷ میلیارد پارامتری را دو برابر سریعتر کرد
تراشه A20 پرو در آیفون ۱۸ پرو توانسته است یک مدل هوش مصنوعی با ۲۷ میلیارد پارامتر را با سرعتی دو برابر بیشتر از آیفون ۱۷ پرو مجهز به A19 پرو اجرا کند. این نتیجه در آزمایشی با مدل Bonsai 27B به نمایش گذاشته شده و نشان میدهد ارتقای سختافزار اپل، بهویژه در بخش پردازش هوش مصنوعی، میتواند اجرای مدلهای بزرگ را مستقیماً روی گوشی و بدون نیاز به اینترنت سریعتر کند.
در این آزمایش Adrien Grondin مدل Bonsai 27B را روی آیفون ۱۸ پرو اجرا کرده، سرعت تولید توکنها در دستگاه جدید بهوضوح بیشتر از نسل قبلی به نظر میرسد و اختلاف عملکرد، به دو برابر میرسد. این پیشرفت تنها به پردازنده اصلی مربوط نیست؛ حافظه سریعتر و تغییرات گسترده در واحد پردازش عصبی نیز در افزایش سرعت اجرای مدلهای هوش مصنوعی روی گوشی نقش دارند.
اپل در A20 پرو برای نخستینبار در تاریخ تراشههای اختصاصی خود از Neural Engine دوگانه با مجموع ۳۲ هسته، در قالب دو واحد ۱۶ هستهای، استفاده کرده. این ساختار برای پردازش وظایف هوش مصنوعی طراحی شده و در بارهای کاری ویژه NPU، حداکثر توان پردازشی آن از پردازنده گرافیکی ۷ هستهای تراشه نیز فراتر میرود. چنین تغییری میتواند اجرای مدلهای متراکمتر را روی گوشی امکانپذیرتر کند.
هر دو مدل آیفون ۱۸ پرو و آیفون ۱۸ پرو مکس به ۱۲ گیگابایت حافظه LPDDR5X با رابط ۹۶ بیتی مجهز شدهاند؛ حافظهای که سرعت بسیار بیشتری از پیکربندی بهکاررفته در آیفون ۱۷ پرو و آیفون ۱۷ پرو مکس دارد. پهنای باند حافظه یکپارچه در این نسل به ۱۱۵.۲ گیگابایتبرثانیه میرسد و در کنار Neural Engine جدید، به بهبود عملکرد مدلهای هوش مصنوعی کمک میکند.
با وجود این پیشرفتها، اجرای مدلهای بزرگتر همچنان با محدودیتهایی همراه است. در توضیحات آزمایش اشاره شده که پس از انتشار Bonsai 2، ممکن است ادامه استفاده از نسخه قبلی چندان منطقی به نظر نرسد؛ اما نسخه جدید با کوانتیزهسازی ۲ بیتی، آنقدر حجیم است که نمیتواند بهطور کامل روی آیفون ۱۸ پرو جای بگیرد. این محدودیت در اجرای محلی، باعث افت عملکرد میشود و نشان میدهد ظرفیت حافظه همچنان عامل تعیینکنندهای است.
در مقابل Bonsai از کوانتیزهسازی یکبیتی استفاده میکند و به همین دلیل میتواند حتی روی دستگاههایی با ۴ گیگابایت رم اجرا شود. گوشیهای مجهز به ۸ یا ۱۲ گیگابایت حافظه نیز فضای مناسبی برای اجرای آن دارند. آیفون ۱۸ پرو با ترکیب A20 پرو، حافظه سریعتر، پهنای باند ۱۱۵.۲ گیگابایتبرثانیه و Neural Engine جدید، میتواند Bonsai 27B را بدون افت محسوس سرعت اجرا کند؛ البته این موضوع به مدل انتخابشده و حجم آن وابسته است.
اجرای مدل ۲۷ میلیارد پارامتری بهصورت محلی، بدون اتصال اینترنت، گام مهمی در توانایی گوشیهای هوشمند برای پردازش هوش مصنوعی محسوب میشود؛ بااینحال، آزمایش حاضر نشان میدهد که افزایش توان پردازشی بهتنهایی برای اجرای همه مدلها کافی نیست. حتی با سختافزار سریعتر، محدودیت ظرفیت حافظه میتواند مانع استفاده از مدلهای حجیمتر شود و انتخاب نسخه و سطح کوانتیزهسازی همچنان اهمیت زیادی دارد.
در نهایت، انتظار میرود با افزایش ظرفیت حافظه در نسلهای آینده آیفون، امکان اجرای مدلهای متراکمتر هوش مصنوعی نیز فراهم شود. در حال حاضر، ترکیب سختافزاری آیفون ۱۸ پرو اجرای Bonsai 27B را با سرعت بیشتری نسبت به نسل قبل ممکن کرده، اما پشتیبانی از مدلهای بزرگتر همچنان به فضای حافظه موردنیاز آنها وابسته است، تغییرات آینده در پیکربندی حافظه میتواند این محدودیت را کاهش دهد.




