گوگل مدل Gemini 3.6 Flash را با عملکرد ناامیدکننده منتشر کرد
شرکت گوگل به تازگی از مدل هوش مصنوعی جدید خود با نام Gemini 3.6 Flash رونمایی کرده است. با این حال، به نظر میرسد زمانبندی این معرفی چندان مناسب نبوده است، زیرا درست پس از عرضه مدلهای متنباز و قدرتمند چینی مانند Kimi K3 از شرکت Moonshot انجام میشود که علاوه بر کاهش چشمگیر هزینهها، عملکردی در سطح پیشگامان این صنعت ارائه میدهند. بسیاری از کارشناسان معتقدند که مدل جدید Google احتمالا ضعیفترین محصول این شرکت تا به امروز به شمار میرود.
هوش مصنوعی Gemini 3.6 Flash به یک پنجره زمینه با ظرفیت 1 میلیون توکن مجهز شده است. این میزان معادل پردازش 1500 صفحه استاندارد A4 متن، 30000 خط کد برنامهنویسی یا یک ساعت محتوای ویدیویی است. هزینه استفاده از این مدل برای هر 1 میلیون توکن خروجی برابر با 7.5 دلار تعیین شده و از ورودیهای متنوعی شامل متن، تصویر، گفتار و ویدیو پشتیبانی میکند. همچنین طبق اعلام Google، این مدل در جریانهای کاری چندمرحلهای، حدود 17 درصد توکن خروجی کمتری مصرف میکند.
با وجود این مشخصات، نقطه ضعف اصلی Gemini 3.6 Flash در بخش عملکرد نمایان میشود. این مدل در شاخص هوش تحلیلی مصنوعی (Artificial Analysis Intelligence Index) که تواناییهای عاملی، عمومی، برنامهنویسی و استدلال علمی مدلهای هوش مصنوعی را میسنجد، تنها موفق به کسب امتیاز 50 شده است. این نمره نشاندهنده عملکردی بسیار ضعیفتر در مقایسه با رقبایی نظیر Meta Spark 1.1، مدل GLM-5.2، مدل GPT-5.6 Luna، مدل Sonnet 5، مدل Grok 4.5 و مدل GPT-5.6 Terra است.
بررسیهای دقیقتر روی بنچمارکها نشان میدهد که Gemini 3.6 Flash غالبا از مدلهای قدیمیتر و ارزانتر شکست میخورد. به عنوان مثال، در بنچمارک عمومی SWE-Bench Pro، این محصول عملکرد ضعیفتری نسبت به Grok 4.5 دارد که در تاریخ 08 جولای معرفی شده بود. همچنین در ارزیابی MLE Bench، مدل Claude Sonnet 5 به راحتی نماینده گوگل را مغلوب میکند.
در کنار این محصول، Google نسخههای دیگری را نیز در دسترس قرار داده است. مدل Gemini 3.5 Flash-Lite با توانایی تولید 350 توکن خروجی در ثانیه به عنوان گزینهای مقرونبهصرفه معرفی شده و نسخه Gemini 3.5 Flash Cyber نیز به صورت ویژه برای کاربردهای مرتبط با امنیت سایبری توسعه یافته است.
