CoreTech

آنتروپیک از Claude Fable 5.1 و Mythos 5.1 با جهشی در توانایی‌های علمی و برنامه‌نویسی رونمایی کرد

پوریا | ۱۰ ساعت پیش

آنتروپیک از مدل‌های Claude Fable 5.1 و Claude Mythos 5.1 رونمایی کرده؛ دو نسخه از یک مدل با سطوح متفاوت محافظت که به‌گفته شرکت پیشرفته‌ترین مدل‌های آن برای برنامه‌نویسی و کارهای دانش‌محور هستند. Claude Fable 5.1 برای عموم عرضه شده و Mythos 5.1 فقط در برنامه‌های دسترسی مورد اعتماد ارائه می‌شود. قابلیت‌های پژوهشی این مدل‌ها نیز می‌تواند نقش آینده هوش مصنوعی در پیشرفت علمی را نشان دهد.

Claude Fable 5.1 هم‌زمان با افزایش توانایی‌ها به چند انتقاد مشتریان پاسخ می‌دهد و آنتروپیک قیمت استفاده معمولی را در سرویس‌های مبتنی بر توکن حدود ۲۵ درصد پایین آورده و برای کارهای بسیار عامل‌محور کاهش هزینه می‌تواند به حدود ۴۵ درصد برسد. علت اصلی کاهش قیمت خواندن کش است؛ یعنی زمانی که مدل از ورودی‌هایی استفاده می‌کند که پیش‌تر پردازش و ذخیره شده‌اند که این تغییر در استفاده‌های پیچیده اثر بیشتری دارد.

آنتروپیک Claude Fable 5.1:

قیمت خواندن کش Claude Fable 5.1 اکنون ۷۵ درصد کمتر و برابر با ۰.۲۵ دلار به‌ازای هر یک میلیون توکن است، قیمت سایر بخش‌ها تغییری نکرده و ورودی یک میلیون توکن ۱۰ دلار و خروجی یک میلیون توکن ۵۰ دلار هزینه دارد. انتروپیک می‌گوید در چهار هفته استفاده واقعی در اوت ۲۰۲۶ هزینه بارهای معمولی حدود ۲۵ درصد و کارهای سنگین و عامل‌محور تا حدود ۴۵ درصد کمتر شده.

Claude Fable 5.1

در بخش حریم خصوصی سامانه جدید EFS قرار است بدون واگذاری داده‌ها به آنتروپیک سطحی از حریم خصوصی معادل سیاست نگهداری صفر داده ارائه کند که داده‌ها در زیرساخت ابری کاملاً تحت کنترل مشتری ذخیره می‌شوند و هم‌زمان سازوکارهای مقابله با استفاده خصمانه حفظ می‌شوند. EFS از اواخر پاییز به‌صورت مرحله‌ای برای مشتریان سازمانی فعال خواهد شد و تا آن زمان کاربران واجد شرایط می‌توانند از نگهداری صفر داده استفاده کنند.

آنتروپیک همچنین محافظ‌های Claude Fable 5.1 را برای کاهش هشدارهای اشتباه بهبود داده تا در حوزه امنیت سایبری محافظ‌های جدید نسبت به گذشته ۶۰ درصد خطای مثبت کاذب کمتری ایجاد کنند. Fable 5.1 اکنون می‌تواند آسیب‌پذیری‌های نرم‌افزاری را شناسایی کند هرچند برای ساخت اکسپلویت آن‌ها استفاده نمی‌شود، این تغییر بخشی از تلاش شرکت برای حفظ ایمنی بدون مسدود کردن فعالیت‌های مشروع کاربران است.

در یک نمونه واقعی از توانایی برنامه‌نویسی Fable 5.1 هنگام آزمایش توسط یک شرکت سرمایه‌گذاری توانست علت یک کرش نادر در سامانه‌های داخلی این شرکت را پیدا کند؛ مشکلی که مهندسان و حتی مدل‌های دیگر پس از چند سال تلاش نتوانسته بودند توضیح دهند، آنتروپیک می‌گوید مدل برای حل مسائل نرم‌افزاری به میانبرهایی که کیفیت نتیجه را کاهش می‌دهند متکی نیست و می‌تواند ریشه مشکل را هدف بگیرد.

Claude Fable 5.1 با فعال بودن محافظ‌های تولیدی در آزمون‌های مختلف ارزیابی شده و هرجا محافظ‌ها مداخله کردند Fable 5.1 و Fable 5 در OSWorld 2.0 امتیاز صفر گرفتند و Fable 5 نیز در AutomationBench به صفر رسید. در دیگر مداخلات وظایف امنیت سایبری با Claude Opus 4.8 و وظایف زیست‌شناسی با Claude Opus 5 انجام شدند؛ بنابراین این محدودیت‌ها احتمالاً امتیاز مدل‌ها را کاهش داده‌اند.

در Terminal-Bench-Science 0.1 خطای استاندارد هر مدل حدود ۳.۵ تا ۴.۵ امتیاز است، رتبه‌بندی عمومی با سه اجرای هر وظیفه و مهار Claude Code امتیاز ۳۰ درصد را برای Claude Opus 5 و ۲۱.۴ درصد را برای Claude Fable 5 گزارش می‌کند؛ تنظیمات آنتروپیک نیز به‌ترتیب ۲۹ و ۲۴.۷ درصد به دست آورده‌اند که هر دو در محدوده خطای آزمون قرار می‌گیرند که این ارقام مستقیماً قطعی نیستند.

در OSWorld 2.0 نتایج بر اساس مجموعه وظایف منتشرشده در اوت ۲۰۲۶ به دست آمده‌اند و Fable 5 و Opus 5 با شرایط یکسان دوباره اجرا شده‌اند؛ چون فایل‌های وظایف با نسخه‌های قبلی متفاوت‌اند، مقایسه مستقیم این اعداد با نتایج قبلی منتشرشده ممکن نیست و به همین دلیل امتیاز رقبا در جدول ارائه نشده، این توضیحات برای تفسیر درست عملکرد مدل در آزمون‌ها اهمیت دارد.

آنتروپیک Claude Mythos 5.1:

Mythos 5.1

بخش مهم دیگری از معرفی توانایی‌های علمی مدل‌ها است که آنتروپیک می‌گوید شرکای دسترسی زودهنگام علاوه بر افزایش عملکرد بهبودهای کیفی خروجی‌ها را نیز گزارش کرده‌اند. این شرکت قابلیت‌های پژوهشی Claude Fable 5.1 وClaude Mythos 5.1 را در حوزه‌های متنوع علمی آزمایش کرده و نتیجه را نشانه‌ای از نزدیک شدن زمانی می‌داند که مدل‌های هوش مصنوعی بتوانند در کشف‌های علمی نقش مهمی ایفا کنند.

در طراحی مولکولی Claude Mythos 5.1 به ابزارهای متن‌باز طراحی و تاخوردگی پروتئین دسترسی داشت و طرح‌های تولیدشده برای اعتبارسنجی آزمایشگاهی به دو سازمان خارجی ارسال شدند. مدل توانست اتصال‌دهنده‌هایی با میل ترکیبی بسیار بالا طراحی کند و در سه هدف عملکردی بهتر از بهترین طرح‌های شرکت‌کنندگان در رقابت‌های طراحی پروتئین Adaptyv Bio نشان داد.

در آزمایش طراحی پروتئین، نرخ موفقیت Claude Mythos 5.1 یعنی سهم طرح‌هایی که واقعاً اتصال‌دهنده قابل‌استفاده بودند برای ۱۲ هدف به نزدیک ۵۰ درصد رسید؛ رقمی که آنتروپیک آن را بالاترین نرخ ثبت‌شده خود می‌داند. این شرکت می‌گوید نرخ‌های معمول در طراحی پروتئین امروزی حدود ۱۰ تا ۱۵ درصد هستند، تمام طرح‌های نمایش‌داده‌شده در ویدئوی همراه آزمایش نیز در آزمایشگاه توانستند به هدف مربوط متصل شوند.

آنتروپیک برای این نمونه‌ها ساختارهای پروتئینی را با پیش‌بینی‌های ESMFold2 نمایش داده و طرح‌های کلاد را با رنگ نارنجی در برابر اهداف خاکستری نشان داده. شرکت در ادامه نمونه‌ای از تحلیل محاسباتی را درباره زهره ارائه می‌کند که Claude Fable 5.1 یک شبکه عصبی آموزش داد تا نقشه ارتفاعی جدید و با وضوح بالاتر برای حدود یک‌سوم سطح زهره ایجاد کند؛ کاری که بر داده‌های راداری مأموریت Magellan ناسا متکی بود.

نقشه جدید زهره از تصاویر راداری مأموریت Magellan که بیش از ۳۰ سال پیش ثبت شده‌اند و نقشه‌ای موجود برای یک‌پنجم سیاره استفاده می‌کند. وضوح آن اکنون جزئیاتی در مقیاس ۲ تا ۳ کیلومتر را نشان می‌دهد درحالی‌ که نقشه قبلی جزئیات را در محدوده ۱۰ تا ۲۰ کیلومتر ارائه می‌کردرو همچنین ارتفاع‌ها تا ۲۵ درصد دقیق‌تر از گذشته نمایش داده می‌شوند و آنتروپیک نقشه را پیش از مأموریت‌های آینده منتشر می‌کند.

این نقشه زهره تحت مجوز Creative Commons منتشر می‌شود تا پیش از مأموریت‌های VERITAS ناسا و EnVision آژانس فضایی اروپا در دسترس باشد. هدف شرکت آنتروپیک این است که داده جدید بتواند به دانشمندان برای تعیین ویژگی‌های زمین‌شناختی مناسب جهت مشاهده‌های آینده کمک کند. که این اقدام بخشی از نمونه‌هایی است که شرکت برای نشان دادن کاربرد مدل‌های خود در پژوهش‌های محاسباتی و علمی ارائه کرده.

در زیست‌شناسی محاسباتی Claude Mythos 5.1 برای افزایش سرعت هفت مدل یادگیری عمیق متن‌باز کرنل‌های سفارشی GPU نوشت و نتایج میانی را کش کرد. مدل توانست اجرای این مدل‌ها را روی گرافیک‌های انویدیا H100 تا ۲.۵ برابر سریع‌تر کند درحالی‌ که خروجی‌ها بدون تغییر باقی ماندند؛ چنین بهینه‌سازی‌هایی در پژوهش اهمیت زیادی دارند زیرا زیست‌شناسان ممکن است هر مدل را در یک آزمایش هزاران بار اجرا کنند.

آنتروپیک برآورد می‌کند در تحلیل‌هایی مانند بررسی همه جهش‌های ممکن در نزدیکی هر ژن انسانیزمدل‌های بهینه‌شده می‌توانند هزینه گرافیک را حدود ۳۰ تا ۶۰ درصد کاهش دهند. این سطح از بهینه‌سازی معمولاً به تیمی از مهندسان عملکرد و هفته‌ها زمان نیاز دارد و برای بسیاری از آزمایشگاه‌های دانشگاهی مقرون‌به‌صرفه نیست. Claude Mythos 5.1 با استفاده از کد منبع عمومی این کار را طی چند روز انجام داد و آنتروپیک قصد دارد بهینه‌سازی‌ها را متن‌باز کند.

سرمایه‌گذاری آنتروپیک در علم به این نمونه‌ها محدود نیست چرا که شرکت هفته گذشته Model Hardware Standard را معرفی کرد که امکان می‌دهد کلاد تجهیزات آزمایشگاهی را به‌طور مستقیم و ایمن کنترل کند. همچنین برنامه AI for Science برای پژوهشگران پروژه‌های علمی با اثرگذاری بالا اعتبار رایگان فراهم می‌کند و طرح جدید Claude Team برای دانشمندان استفاده از مدل‌ها را با تخفیف قابل‌توجه ارائه می‌دهد؛ این اقدامات هم‌زمان با توسعه توان علمی مدل‌ها انجام می‌شوند.

آنتروپیک برای سخت‌تر کردن حملات تقطیر مدل نیز تغییری در حساب‌های API اعمال کرده و از امروز حساب‌های جدید دیگر نمی‌توانند زمینه قبلی Claude را در یک گفت‌وگوی چندمرحله‌ای به‌صورت دستی ویرایش کنند درحالی‌که متن فرآیند فکری قبلی مدل حفظ شود؛ این روش یکی از تکنیک‌های تقطیر مستندسازی‌شده برای استخراج غیرمجاز فرایند فکری Claude بود، تغییر به‌تدریج اجرا می‌شود تا اختلال برای کاربران کاهش یابد.

حساب‌های موجود فعلاً تحت تأثیر محدودیت جدید نیستند اما آنتروپیک می‌گوید این قاعده برای همه کاربران در عرضه مدل‌های آینده اعمال خواهد شد. تعداد کمی از مشتریان نیز به‌دلیل یکپارچه‌سازی‌های سفارشی ممکن است نیاز به تغییر داشته باشند؛ شرکت برای توضیح جزئیات و اصلاحات لازم برای توسعه‌دهندگان، مقاله‌ای در مرکز راهنمای خود منتشر کرده. هدف این تغییر، دشوارتر کردن استخراج و انتقال غیرمجاز توانایی‌های مدل است.

Claude Mythos 5.1 از نظر مدل با Claude Fable 5.1 یکسان است اما برای افراد و سازمان‌های احراز‌شده، محافظ‌های بازتری در زمینه امنیت سایبری و علوم زیستی دارد. این نسخه از طریق دو برنامه دسترسی مورداعتماد ارائه می‌شود، نخستین راه Cyber Verification Program یا CVP است که اکنون برخی مدل‌های کلاس Opus و Sonnet را با محافظ‌های سایبری کاهش‌یافته برای دفاع امنیتی ارائه می‌کند و قرار است در آینده نزدیک مدل‌های کلاس Mythos را نیز شامل شود.

دومین مسیر Life Sciences Verification Program یا LSVP است که برای متخصصان علوم زیستی طراحی شده تا از Claude Mythos 5.1 با محافظ‌های متناسب با فعالیت‌های حرفه‌ای پژوهش و توسعه استفاده کنند، سایر محافظ‌ها همچنان برقرار هستند. این برنامه با همکاری دولت آمریکا شکل گرفته، نخستین شرکت‌کنندگان را پذیرفته و قرار است دسترسی آن به جامعه گسترده‌تری از متخصصان علوم زیستی توسعه یابد، Mythos فعلاً فقط در اختیار مجموعه‌ای از سازمان‌های آمریکایی است.

آنتروپیک می‌گوید برای گسترش دسترسی Claude Mythos 5.1 به شرکای داخلی و بین‌المللی با دولت آمریکا همکاری می‌کند و در کنار این برنامه‌ها محصول Claude Security که کدبیس‌ها را برای یافتن آسیب‌پذیری اسکن و برای بررسی انسانی پیشنهاد اصلاح ارائه می‌کند اکنون از Mythos 5.1 نیرو می‌گیرد.

در زمینه مقررات هوش مصنوعی آنتروپیک در ژوئیه ۲۰۲۶ همراه با ۱۹۰ امضاکننده دیگر ازجمله چند ارائه‌دهنده بزرگ مدل‌های هوش مصنوعی، Code of Practice on Transparency of AI-Generated Content قانون هوش مصنوعی اتحادیه اروپا را امضا کرد. این تعهد شرکت را ملزم کرد برای مدل‌های عرضه‌شده پس از ۲ اوت ۲۰۲۶ واترمارکی عددی به خروجی‌ها اضافه کند که احتمال مشارکت کلاد در نگارش متن را مشخص می‌کند.

واترمارک جدید برای کاربری که به API تشخیص دسترسی ندارد نامرئی است و طبق توضیح آنتروپیک هیچ اثر عملی بر کیفیت یا محتوای خروجی ندارد و اطلاعاتی درباره کاربر، سازمان یا گفت‌وگوهای او در خود نگه نمی‌دارد. قانون همچنین شرکت را ملزم کرده روشی برای بررسی احتمال وجود واترمارک در متن فراهم کند، به همین دلیل این برند آمریکایی یک API تشخیص را در مرحله پیش‌نمایش خصوصی عرضه کرده.

Claude Fable 5.1 از امروز در همه پلتفرم‌ها، ازجمله Amazon Web Services، گوگل کلود و Microsoft Azure در دسترس است. توسعه‌دهندگان نیز می‌توانند آن را با شناسه claude-fable-5-1 در API کلاد آغاز کنند. آنتروپیک در همین حال می‌گوید روی انتقال بسیاری از پیشرفت‌های Claude Fable 5.1 به سایر اعضای خانواده مدل‌های خود ادامه می‌دهد هرچند Mythos 5.1 همچنان به دسترسی مورداعتماد و احراز‌شده محدود است و مسیر عمومی ندارد.

منبع

پوریا | ۱۰ ساعت پیش

دیدگاهتان را بنویسید