گوگل از جمینای ۳.۸ فلش و ۳.۸ فلش سایبر رونمایی کرد؛ قدرت بالاتر با همان قیمت قبلی
تنها سه هفته پس از معرفی نسخه ۳.۷ و در ادامه انتشار سریع مدلهای سبک، گوگل رسماً مدل هوش مصنوعی جمینای ۳.۸ را به عنوان قدرتمندترین محصول خود در زمینه استدلال منطقی و کدنویسی معرفی کرد. این سومین نسل از خانواده Flash طی تنها شش هفته محسوب میشود و شامل دو نسخه مجزا با نامهای جمینای ۳.۸ فلش و جمینای ۳.۸ فلش Cyber است که با حفظ سرعت بالا و ساختار هزینهای نسخه پیشین، جهش محسوسی در کارایی ارائه میدهند.
مدل استاندارد جمینای ۳.۸ فلش با تمرکز بر اجرای وظایف ایجنتمحور، تحلیلهای چندمرحلهای و پروژههای پیچیده مهندسی نرمافزار توسعه یافته است. این نسخه با همان قیمت ابتدایی نسخه پیشین یعنی ۰.۷۵ دلار به ازای هر یک میلیون توکن ورودی و ۳.۷۵ دلار به ازای هر یک میلیون توکن خروجی عرضه میشود.
در کنار آن، مدل جمینای ۳.۸ فلش سایبر قرار دارد که پیشرفتهترین ابزار امنیتی این شرکت به حساب میآید و برای کشف خودکار رخنههای امنیتی و ایجاد پچهای اصلاحی طراحی شده است. دسترسی به این نسخه خاص تنها از طریق برنامهای ویژه تحت عنوان Fairwind Program برای نهادهای دفاعی و امنیتی مورد تأیید فراهم است.
هر دو نسخه بر پایه یک زیرساخت پردازشی مشترک شکل گرفتهاند و با اتکا به چرخههای ایجنتمحور طولانی، به صورت پیوسته عملکرد خود را بازبینی و تقویت میکنند. بخشی از توانمندیهای کدنویسی و استدلال این مدلها حاصل آموزشهای فشرده و ارزیابیهای سختگیرانه در محیطهای عملیاتی امنیت سایبری است.
ارتقای کدنویسی در جمینای ۳.۸ فلش
در ارزیابیهای مربوط به مهندسی نرمافزار در بازههای طولانیمدت نظیر DeepSWE v1.1، مدل هوش مصنوعی جمینای ۳.۸ فلش موفق شده در حل مستقل مسائل مهندسی نرمافزار، از بسیاری از مدلهای پیشرو و گرانقیمت بازار پیشی بگیرد.
علاوهبراین، مدل جدید در حوزههای محاسباتی و تخصصی نیازمند به تجزیهوتحلیل دادهها مانند بنچمارک مالی Vals Finance Agent V2 و بنچمارک حقوقی Harvey عملکردی به مراتب بهتر از نسخه ۳.۷ به جا گذاشته است. این مدل همچنین در آزمون دشوار استدلال چندمرحلهای رشتههای علمی و انسانی HLE-Verified به امتیاز ۵۴.۹ درصد دست یافته است.

دلیل اصلی این پیشرفت، نحوه مدیریت پردازش در این مدل عنوان شده است؛ نسخه ۳.۸ برای ارائه بالاترین دقت، مراحل منطقی بیشتری را پشت سر میگذارد و فراخوانی ابزارها را با سختکوشی بیشتری تکرار میکند. برای سناریوهایی که صرفهجویی در مصرف منابع محاسباتی اولویت نخست توسعهدهندگان است، امکان تنظیم سطوح پردازش در مقادیر پایینتر وجود دارد یا میتوان کماکان از مدل پیشین استفاده کرد.
نسخه امنیتی Gemini 3.8 Flash Cyber نیز در آزمون استاندارد شناسایی آسیبپذیریها موسوم به CyberGym توانسته علاوهبر نسخه ۳.۵ Flash Cyber، مدلهای پرچمدار رقبا را نیز پشت سر بگذارد. در بنچمارک داخلی مربوط به شناسایی نقصهای امنیتی در کدهایی با ۲۰ زبان برنامهنویسی مختلف نیز این مدل نرخ موفقیتی فراتر از ۷۰ درصد ثبت کرده است.
در بخش اصلاح آسیبپذیریها، تمرکز گوگل بهجای قابلیتهای تهاجمی روی توانمندسازی مدافعان سایبری متمرکز بوده است. در آزمون سختگیرانه CWE-Bench، این نسخه با ثبت نرخ موفقیت ۴۷.۲ درصد عملاً همتراز با مطرحترین مدلهای پیشتاز قرار گرفته است، اما هزینه اجرای آن بسیار کمتر است.
در آزمایشهای واقعی، تیم امنیت مرورگر کروم تأیید کرده که این مدل ۲.۶ برابر بیش از مدلهای تجاری بزرگ موفق به تولید پچهای امنیتی کامپایلپذیر و صحیح شده است. همچنین تیم تحقیقاتی فضای ابری گوگل موفق شده با کمک آن یک نقص بحرانی ریشهای را در مدتزمانی کمتر از دو ساعت کشف کند؛ فرایندی که معمولاً چندین ماه طول میکشید.
مدلهای سری جمینای ۳.۸ به لایههای حفاظتی سختگیرانهای برای جلوگیری از سوءاستفادههای بیولوژیکی، رادیواکتیو، شیمیایی و حملات سایبری مخرب مجهز شدهاند و مقاومت آنها در برابر حملات تزریق دستور براساس ارزیابیهای شرکت Gray Swan به شکل چشمگیری افزایش یافته است.
نسخه تجاری اکنون برای توسعهدهندگان از طریق محیطهای برنامهنویسی و API، برای کاربران شرکتی در چارچوب بستههای سازمانی و برای مشترکان پلنهای اشتراکی در اپلیکیشن اختصاصی و موتور جستجو در دسترس قرار گرفته است.

