خانهعمومیDecrypt
Decryptعمومی۳۰ تیر ۱۴۰۵·۰ بازدید

گوگل مدل‌های جدید Gemini Flash را عرضه کرد، اما نسخه پرو هنوز غایب است

گوگل امروز سه مدل هوش مصنوعی جدید عرضه کرد، اما نسخه پرو از Gemini 3.5 همچنان در تعویق است. مدل 3.6 Flash نسبت به نسخه قبل، کارایی بهتر و هزینه کمتری دارد و گوگل در حال پیش‌تربیت نسخه بعدی، Gemini 4، است.

گوگل مدل‌های جدید Gemini Flash را عرضه کرد، اما نسخه پرو هنوز غایب است

گوگل امروز سه مدل جدید هوش مصنوعی از جمله Gemini 3.6 Flash، 3.5 Flash-Lite و 3.5 Flash Cyber را عرضه کرد. این مدل‌ها کارآیی بهتر و هزینه کمتری نسبت به نسخه 3.5 Flash دارند، اما نسخه Pro از Gemini 3.5 که وعده آن در کنفرانس I/O 2026 شده بود و قرار بود در ژوئن عرضه شود، هنوز در مرحله آزمایش است و به دلیل ناکامی در دستیابی به اهداف داخلی به تعویق افتاده است. مدل 3.6 Flash نسبت به 3.5 Flash، 17% تعداد توکن‌های خروجی کمتری تولید می‌کند و قیمت هر میلیون توکن خروجی را از 9 دلار به 7.50 دلار کاهش داده است، که باعث صرفه‌جویی در هزینه‌های اجرای عامل‌های هوشمند در مقیاس وسیع می‌شود. گوگل تأیید کرده است که پیش‌تربیت Gemini 4 آغاز شده است و آن را «پرمحتواترین دوره پیش‌تربیت تاکنون» می‌نامد.

مدل‌های جدید شامل Gemini 3.6 Flash، 3.5 Flash-Lite و 3.5 Flash Cyber هستند. این‌ها آن چیزی نبود که اکثر افراد انتظار داشتند. پس از معرفی Gemini 3.5 Flash در کنفرانس Google I/O 2026 در مه و وعده عرضه نسخه پرو در عرض یک ماه، گوگل به طور ضمنی از مهلت خود گذشت. نسخه Pro به دلیل ناکامی در رسیدن به اهداف داخلی، به ویژه در وظایف برنامه‌نویسی، متوقف شد. تلاش‌های اخیری که در اواخر ژوئن برای اصلاح آن با به‌روزرسانی داده‌های آموزشی انجام شد، نتایج ناامیدکننده‌ای داشت و سهام Alphabet با کاهش تقریبی 4.4% مواجه شد، که معادل حدود 200 میلیارد دلار کاهش ارزش بازار در یک روز بود.

آخرین مدل در رده Pro، Gemini 3.1 Pro بود که در فوریه عرضه شد. سری Flash مدل‌های سریع و اقتصادی گوگل هستند که برای عامل‌های هوشمند طراحی شده‌اند، برنامه‌هایی که به صورت نیمه‌خودکار وظایفی مانند مدیریت اسناد، پردازش داده‌ها و جستجو در وب را انجام می‌دهند. مدل‌های Pro برای انجام وظایف پیچیده‌تر و استدلال‌های عمیق‌تر ساخته شده‌اند، هرچند کندتر و گران‌تر هستند.

مدل Gemini 3.6 Flash اصلی‌ترین نسخه است که نسبت به نسخه 3.5 Flash، 17 درصد توکن‌های خروجی کمتری تولید می‌کند و هزینه آن برای هر میلیون توکن خروجی را از 9 دلار به 7.50 دلار کاهش می‌دهد. در معیارهای استاندارد ارزیابی هوش مصنوعی، 3.6 Flash در تست‌های مختلف عملکرد خوبی نشان داده است؛ مثلا در DeepSWE v1.1، نمره آن 49٪ است که در مقایسه با 37٪ برای 3.5 Flash است. در آزمون MLE-Bench، نمره آن 63.9٪ برابر با 49.7٪ است. در آزمون OSWorld-Verified، که در آن هوش مصنوعی کنترل صفحه کامپیوتر را در اختیار می‌گیرد تا وظایف واقعی را انجام دهد، نمره 83.0٪ را کسب کرده است، بالاتر از Claude Sonnet 5 (81.2٪) و GPT-5.6 Luna (72.6٪).

در مقابل، رقبا در برخی معیارهای دیگر همچنان پیشتاز هستند؛ مانند GPT-5.6 Luna که 67٪ در DeepSWE کسب می‌کند و 84.7٪ در Terminal-Bench 2.1، که به ارزیابی توانایی‌های برنامه‌نویسی عامل‌ها می‌پردازد. Claude Sonnet 5 در محاسبات مربوط به تولید ناخالص داخلی (GDPval-AA v2) بر پایه امتیاز Elo، با نمره 1607 بالاتر از 3.6 Flash قرار دارد.

در تجربه‌های ما، عملکرد مدل در برنامه‌نویسی رضایت‌بخش نبود. نتیجه کدهای تولید شده قابل استفاده نبود، عناصر صفحه نادرست رندر می‌شدند و تلاش‌های بعدی برای رفع مشکلات هم بی‌نتیجه ماند.

ما از Deepseek خواستیم تا با اصلاح چند مشکل، نسخه قابل بازی پایه را بهبود دهد و در نتیجه موفق شد یک بازی نسبتا خوب بسازد. اصلاحات کوچک Deepseek نشان داد که اساسا فکر مدل درست است، اما جزئیات و نواقص باعث شد نتیجه نهایی کاربردی نباشد. بنابراین، اگر قصد دارید از این مدل برای برنامه‌نویسی استفاده کنید، باید زمان زیادی صرف کنید و انتظار کیفیت پایین‌تری داشته باشید.

مدل سوم که Google عرضه کرده، Gemini 3.5 Flash-Lite است که صرفاً برای حجم بالا طراحی شده است، بدین معنی که در هر ثانیه 350 توکن خروجی تولید می‌کند و هزینه آن 0.30 دلار برای هر میلیون ورودی و 2.50 دلار برای هر میلیون خروجی است. این مدل برای پردازش سریع اسناد در مقیاس وسیع یا سیستم‌های جستجوی عامل‌محور مناسب است و نسبت به نسخه قدیمی‌تر 3 Flash برتری قابل توجهی در وظایف برنامه‌نویسی دارد.

مدل چهارم، Gemini 3.5 Flash Cyber، به صورت عمومی عرضه نخواهد شد و تنها در اختیار دولت‌ها و شرکای مورد تایید قرار گرفته است که نیازمند کشف و رفع آسیب‌پذیری‌های نرم‌افزاری هستند؛ زیرا این مدل برای کاربردهای دوگانه طراحی شده و گوگل از انتشار عمومی آن می‌ترسد.

در همین حال، تیم DeepMind گوگل فعالیت‌های خود را ادامه می‌دهد. این شرکت در بیانیه رسمی اعلام کرده است که پیش‌تربیت «پرمحتواترین دوره تاکنون» برای Gemini 4 را آغاز کرده است و تیم به شدت در حال تبلیغ آن است. در حال حاضر، مدل‌های 3.6 Flash و 3.5 Flash-Lite در برنامه Gemini، استودیو هوش مصنوعی گوگل و همچنین از طریق API در دسترس هستند. اما نسخه Pro، طبق گفته گوگل، «به محض آماده بودن عرضه خواهد شد»، هر زمان که آماده شود.

برچسب‌ها:گوگلهوش مصنوعیGeminiمدل‌های AIپیش‌تربیتصنعت فناوری
این خبر چطور بود؟
مطالب مرتبط
← بازگشت به صفحه اصلی