
گوگل Gemini 3.8 Flash و مدل Cyber را با تمرکز بر کدنویسی و عاملهای خودمختار معرفی کرد
گوگل از دو مدل جدید Gemini 3.8 Flash و Gemini 3.8 Flash Cyber رونمایی کرد؛ دو مدل با هسته هوش مشترک که برای نیازهای متفاوت طراحی شدهاند. این معرفی تنها سه هفته پس از Gemini 3.7 Flash و سومین عرضه مدل Flash گوگل در شش هفته اخیر محسوب میشود. ۳.۸ فلش برای کدنویسی، عاملهای خودمختار و استدلال چندمرحلهای ساخته شده و با همان سرعت و قیمت 3.7 Flash عرضه میشود.
قیمت جمنای ۳.۸ فلش همان قیمت اولیه 3.7 Flash است: ۰.۷۵ دلار به ازای هر یک میلیون توکن ورودی و ۳.۷۵ دلار برای هر یک میلیون توکن خروجی. این مدل در DeepSWE v1.1، بنچمارک مهندسی نرمافزار طولانیمدت، بیشتر مدلهای پیشرو بزرگتر را در حل مستقل مسائل پشت سر گذاشته است. در Vals Finance Agent V2 و Harvey’s Legal Agent Benchmark عملکرد بهتری از 3.7 Flash و دیگر مدلهای پیشرو دارد.
جمنای ۳.۸ فلش در HLE-Verified نیز به امتیاز ۵۴.۹ درصد رسیده و توانایی استدلال چندمرحلهای در علوم، علوم انسانی و حوزههای حرفهای را نشان داده است. گوگل میگوید این مدل در وظایف پیچیده، مراحل استدلال بیشتری انجام میدهد و ابزارها را بهصورت تکرارشونده فراخوانی میکند. حلقههای عاملمحور طولانیمدت نیز مدل را به ارزیابی و اصلاح مکرر خود وامیدارند و ممکن است در سطوح تلاش بالاتر، توکن بیشتری مصرف کند.
برای کارهای بهرهوری محاسباتی توسعهدهندگان میتوانند سطح تلاش Gemini 3.8 Flash را پایین بیاورند یا از Gemini 3.7 Flash استفاده کنند که برای بارهای کاری مبتنی بر بهرهوری پشتیبانی میشود. در مقابل Gemini 3.8 Flash Cyber برای امنیت سایبری طراحی شده و از طریق برنامه Fairwind در اختیار مدافعان مورد اعتماد قرار میگیرد. این مدل روی کشف آسیبپذیری و وصلهگذاری تمرکز دارد و عملکردی در سطح مدلهای پیشرو دارد.
نتایج بنچمارکهای منتشر شده از Gemini 3.8 Flash و مدل سایبر به همراه مقایسه با رقبا:






در CyberGym، بنچمارک استاندارد صنعت برای کشف آسیبپذیری، نسخهی ۳۰.۸ فلش Cyber هم Gemini 3.5 Flash Cyber و هم مدلهای پیشرو و بسیار بزرگتر را پشت سر گذاشته است. گوگل برای سنجش نیازهای واقعی دفاع سایبری، ارزیابی داخلی گستردهتری نیز انجام داده که کدبیسهای پیچیده در ۲۰ زبان برنامهنویسی را پوشش میدهد؛ Flash Cyber در این آزمون به نرخ موفقیت بیش از ۷۰ درصد رسیده است.
گوگل میگوید در جمنای ۳.۸ فلش Cyber از ابتدا رفع آسیبپذیری را بر قابلیتهای تهاجمی مانند بهرهبرداری از آسیبپذیریها ترجیح داده است. در CWE-Bench، بنچمارک خارجی وصلهگذاری که Collinear آن را اجرا میکند، مدل با pass@1 برابر ۴۷.۲ درصد در مرز پارتو قرار گرفته است؛ یک مدل پیشرو ۴۷.۸ درصد ثبت کرده، اما گوگل میگوید Flash Cyber هزینه بسیار پایینتری دارد، این بنچمارک توانایی مدل در اصلاح کد آسیبپذیر را میسنجد.
استفاده عملی از جمنای ۳.۸ فلش سایبر نیز در گزارش گوگل مطرح شده است و تیم امنیتی کروم اعلام کرده این مدل نسبت به بهترین مدلهای تجاری بسیار بزرگتر، ۲.۶ برابر وصله صحیح بیشتری برای آسیبپذیریهای Chrome تولید کرده است. Wiz نیز در بنچمارک داخلی تست نفوذ خود، Recall را ۷.۵ تا ۹.۷ درصد افزایش داده و هزینه را در مقایسه با مدلهای پیشرو ۲.۳ تا ۵.۲ برابر پایینتر گزارش کرده است.
تیم Cloud Vulnerability Research گوگل با استفاده از مدل Cyber یک آسیبپذیری حیاتی را در کمتر از دو ساعت کشف کرده است؛ کاری که تحقیق و کشف آن معمولاً ماهها زمان میبرد. مدلهای Gemini 3.8 Flash همچنین در سنجش Gray Swan، مقاومت بسیار بیشتری در برابر Prompt Injection نشان دادهاند. هر دو مدل با تدابیر حفاظتی در برابر سوءاستفاده در حوزههای CBRN و عملیات تهاجمی سایبری عرضه میشوند.
جمنای ۳.۸ فلش برای استفادههای مفید مطابق Frontier Safety Framework طراحی شده، اما Flash Cyber بهدلیل تدابیر سهلگیرانهتر در امنیت سایبری فقط به مدافعان مورد اعتماد ارائه میشود. توسعهدهندگان میتوانند از مدل فلش در Google Antigravity، Gemini API از طریق Google AI Studio و Android Studio یا Stitch بهره ببرند. این مدل برای Gemini Enterprise و مشترکان Google AI Pro و اولترا نیز در دسترس است.
دسترسی به Gemini 3.8 Flash Cyber از طریق Fairwind به نهادهای دولتی مورد اعتماد، اپراتورهای زیرساختهای حیاتی و نگهدارندگان نرمافزار اختصاص مییابد و این گروهها میتوانند برای دسترسی درخواست دهند. در سمت مصرفکننده، Gemini 3.8 Flash در اپلیکیشن جمنای، حالت AI در Google Search و Gemini در Google Sheets برای مشترکان Google AI Pro و Ultra ارائه شده است. این عرضه همزمان دسترسی توسعهدهندگان و کاربران عادی را پوشش میدهد.




