تهران آرت آکادمی

گوگل از جمینای ۳.۸ فلش و ۳.۸ فلش سایبر رونمایی کرد؛ قدرت بالاتر با همان قیمت قبلی

گوگل از جمینای ۳.۸ فلش و ۳.۸ فلش سایبر رونمایی کرد؛ قدرت بالاتر با همان قیمت قبلی

تنها سه هفته پس از معرفی نسخه ۳.۷ و در ادامه انتشار سریع مدل‌های سبک، گوگل رسماً مدل هوش مصنوعی جمینای ۳.۸ را به عنوان قدرتمندترین محصول خود در زمینه استدلال منطقی و کدنویسی معرفی کرد. این سومین نسل از خانواده Flash طی تنها شش هفته محسوب می‌شود و شامل دو نسخه مجزا با نام‌های جمینای ۳.۸ فلش و جمینای ۳.۸ فلش Cyber است که با حفظ سرعت بالا و ساختار هزینه‌ای نسخه پیشین، جهش محسوسی در کارایی ارائه می‌دهند.

مدل استاندارد جمینای ۳.۸ فلش با تمرکز بر اجرای وظایف ایجنت‌محور، تحلیل‌های چندمرحله‌ای و پروژه‌های پیچیده مهندسی نرم‌افزار توسعه یافته است. این نسخه با همان قیمت ابتدایی نسخه پیشین یعنی ۰.۷۵ دلار به ازای هر یک میلیون توکن ورودی و ۳.۷۵ دلار به ازای هر یک میلیون توکن خروجی عرضه می‌شود.

در کنار آن، مدل جمینای ۳.۸ فلش سایبر قرار دارد که پیشرفته‌ترین ابزار امنیتی این شرکت به حساب می‌آید و برای کشف خودکار رخنه‌های امنیتی و ایجاد پچ‌های اصلاحی طراحی شده است. دسترسی به این نسخه خاص تنها از طریق برنامه‌ای ویژه تحت عنوان Fairwind Program برای نهادهای دفاعی و امنیتی مورد تأیید فراهم است.

هر دو نسخه بر پایه یک زیرساخت پردازشی مشترک شکل گرفته‌اند و با اتکا به چرخه‌های ایجنت‌محور طولانی، به صورت پیوسته عملکرد خود را بازبینی و تقویت می‌کنند. بخشی از توانمندی‌های کدنویسی و استدلال این مدل‌ها حاصل آموزش‌های فشرده و ارزیابی‌های سخت‌گیرانه در محیط‌های عملیاتی امنیت سایبری است.

ارتقای کدنویسی در جمینای ۳.۸ فلش

در ارزیابی‌های مربوط به مهندسی نرم‌افزار در بازه‌های طولانی‌مدت نظیر DeepSWE v1.1، مدل هوش مصنوعی جمینای ۳.۸ فلش موفق شده در حل مستقل مسائل مهندسی نرم‌افزار، از بسیاری از مدل‌های پیشرو و گران‌قیمت بازار پیشی بگیرد.

علاوه‌بر‌این، مدل جدید در حوزه‌های محاسباتی و تخصصی نیازمند به تجزیه‌وتحلیل داده‌ها مانند بنچمارک مالی Vals Finance Agent V2 و بنچمارک حقوقی Harvey عملکردی به مراتب بهتر از نسخه ۳.۷ به جا گذاشته است. این مدل همچنین در آزمون دشوار استدلال چندمرحله‌ای رشته‌های علمی و انسانی HLE-Verified به امتیاز ۵۴.۹ درصد دست یافته است.

بنچمارک جمینای ۳.۸ فلش

دلیل اصلی این پیشرفت، نحوه مدیریت پردازش در این مدل عنوان شده است؛ نسخه ۳.۸ برای ارائه بالاترین دقت، مراحل منطقی بیشتری را پشت سر می‌گذارد و فراخوانی ابزارها را با سخت‌کوشی بیشتری تکرار می‌کند. برای سناریوهایی که صرفه‌جویی در مصرف منابع محاسباتی اولویت نخست توسعه‌دهندگان است، امکان تنظیم سطوح پردازش در مقادیر پایین‌تر وجود دارد یا می‌توان کماکان از مدل پیشین استفاده کرد.

نسخه امنیتی Gemini 3.8 Flash Cyber نیز در آزمون استاندارد شناسایی آسیب‌پذیری‌ها موسوم به CyberGym توانسته علاوه‌‌بر نسخه ۳.۵ Flash Cyber، مدل‌های پرچمدار رقبا را نیز پشت سر بگذارد. در بنچمارک داخلی مربوط به شناسایی نقص‌های امنیتی در کدهایی با ۲۰ زبان برنامه‌نویسی مختلف نیز این مدل نرخ موفقیتی فراتر از ۷۰ درصد ثبت کرده است.

در بخش اصلاح آسیب‌پذیری‌ها، تمرکز گوگل به‌جای قابلیت‌های تهاجمی روی توانمندسازی مدافعان سایبری متمرکز بوده است. در آزمون سخت‌گیرانه CWE-Bench، این نسخه با ثبت نرخ موفقیت ۴۷.۲ درصد عملاً هم‌تراز با مطرح‌ترین مدل‌های پیشتاز قرار گرفته است، اما هزینه اجرای آن بسیار کمتر است.

در آزمایش‌های واقعی، تیم امنیت مرورگر کروم تأیید کرده که این مدل ۲.۶ برابر بیش از مدل‌های تجاری بزرگ موفق به تولید پچ‌های امنیتی کامپایل‌پذیر و صحیح شده است. همچنین تیم تحقیقاتی فضای ابری گوگل موفق شده با کمک آن یک نقص بحرانی ریشه‌ای را در مدت‌زمانی کمتر از دو ساعت کشف کند؛ فرایندی که معمولاً چندین ماه طول می‌کشید.

مدل‌های سری جمینای ۳.۸ به لایه‌های حفاظتی سخت‌گیرانه‌ای برای جلوگیری از سوءاستفاده‌های بیولوژیکی، رادیواکتیو، شیمیایی و حملات سایبری مخرب مجهز شده‌اند و مقاومت آنها در برابر حملات تزریق دستور براساس ارزیابی‌های شرکت Gray Swan به شکل چشمگیری افزایش یافته است.

نسخه تجاری ‌اکنون برای توسعه‌دهندگان از طریق محیط‌های برنامه‌نویسی و API، برای کاربران شرکتی در چارچوب بسته‌های سازمانی و برای مشترکان پلن‌های اشتراکی در اپلیکیشن اختصاصی و موتور جستجو در دسترس قرار گرفته است.

ارسال دیدگاه

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *

7 + 4 =