رکوردشکنی در بنچمارکهای صنعتی
جمنای ۳ پرو با کسب امتیاز 1501 در جدول LMArena، اولین مدل هوشمصنوعی است که مرز 1500 را درهم میشکند. این دستاورد نشان میدهد که گوگل توانسته در زمینه استدلال متنی، از تمام رقبای خود پیشی بگیرد. اما آیا واقعاً این آمارها در دنیای واقعی معنادار خواهند بود؟
در آزمونهای تخصصیتر، این مدل عملکرد چشمگیری داشته است: 91.9 درصد در GPQA Diamond برای استدلال سطح دکترا، 37.5 درصد در آزمون Humanity's Last Exam بدون استفاده از ابزار، و 23.4 درصد در MathArena Apex. با این حال، شاید جالبتوجهترین بخش، توانایی چندوجهی این مدل باشد که با امتیاز 81 درصد در MMMU-Pro و 87.6 درصد در Video-MMMU، استانداردهای جدیدی را تعریف کرده است.
قابلیتهای کدنویسی و توسعه نرمافزار
برای توسعهدهندگان نرمافزار، جمنای ۳ میتواند یک تحول واقعی باشد. این مدل با کسب امتیاز 1487 Elo در جدول WebDev Arena و 54.2 درصد در Terminal-Bench 2.0، توانایی استفاده از ابزارها و کنترل رایانه از طریق ترمینال را نشان داده است. چیزی که گوگل آن را "بهترین مدل vibe coding" مینامد، در واقع به معنای ساخت برنامهها با دستورات زبان طبیعی است.
گوگل همچنین پلتفرم Google Antigravity را معرفی کرد؛ یک محیط کدنویسی چندپنجرهای که ترکیبی از پنجره پرامپت، رابط خط فرمان و مرورگر است. این ابزار به توسعهدهندگان اجازه میدهد تا کدهای پیچیده را با کمک هوش مصنوعی بنویسند و نتایج را بلافاصله مشاهده کنند.
رابطهای تعاملی و تجربه کاربری جدید
یکی از نوآوریهای جالب جمنای ۳، قابلیت ساخت "رابطهای تولیدی" است. این سیستم میتواند بهطور خودکار یک رابط کاربری تعاملی و کاملاً سفارشیشده برای هر درخواست طراحی و کدنویسی کند. تصور کنید از هوش مصنوعی میخواهید موضوعی را توضیح دهد و بهجای یک متن ساده، یک صفحه وب تعاملی با عکسها، نمودارها و ابزارهای قابل تنظیم دریافت کنید.
برای مثال، وقتی درباره فیزیک سؤال میکنید، جمنای ۳ میتواند یک شبیهسازی فیزیکی تعاملی بسازد، یا هنگام محاسبه وام مسکن، یک ماشینحساب تعاملی ایجاد کند که بتوانید نرخ بهره و پیشپرداخت را تغییر دهید. این قابلیتها نشان میدهند که هوش مصنوعی دیگر فقط به تولید متن محدود نمیشود.
جمنای ۳ دیپ تینک؛ قدم بلندتر به سوی AGI
گوگل همچنین حالت Gemini 3 Deep Think را معرفی کرد؛ یک نسخه پیشرفتهتر برای مسائل پیچیده که نیازمند استدلال عمیقتری هستند. این حالت در آزمون Humanity's Last Exam به 41 درصد، در GPQA Diamond به 93.8 درصد و در ARC-AGI-2 به 45.1 درصد رسیده است. این آمارها نشان میدهند که گوگل در مسیر ساخت هوش مصنوعی عمومی (AGI) گامهای جدی برمیدارد.
مجله تخصصی هوش مصنوعی آرتین معتقد است که جمنای ۳ نقطه عطفی در تاریخ هوش مصنوعی است. این مدل نهتنها در بنچمارکها عملکرد برتری دارد، بلکه با قابلیتهایی مانند رابطهای تولیدی و کدنویسی تعاملی، تعریف جدیدی از هوش مصنوعی ارائه میدهد.
در دسترس بودن و قیمتگذاری
جمنای ۳ از امروز در اپلیکیشن Gemini برای کاربران عادی و در AI Mode برای مشترکان Google AI Plus، Pro و Ultra در دسترس است. برای توسعهدهندگان، این مدل با قیمت 2 دلار برای هر میلیون توکن ورودی و 12 دلار برای هر میلیون توکن خروجی در Google AI Studio و Vertex AI قابل دسترس است.
گوگل اعلام کرده که اپلیکیشن Gemini اکنون 650 میلیون کاربر فعال ماهانه دارد و AI Overviews به 2 میلیارد کاربر در ماه رسیده است. این آمارها نشان میدهند که گوگل توانسته هوش مصنوعی خود را در مقیاس وسیعی به دست کاربران برساند.
رقابت با OpenAI و Anthropic
این اعلان در حالی صورت میگیرد که OpenAI در ماه اوت GPT-5 را معرفی کرده و ChatGPT به 700 میلیون کاربر هفتگی رسیده است. با این وجود، سازمان مستقل Artificial Analysis، جمنای ۳ پرو را با امتیاز 73 در صدر جدول جهانی قرار داده و برای اولین بار گوگل را بهعنوان صاحب هوشمندترین مدل هوش مصنوعی معرفی کرده است.
آیا این رقابت به نفع کاربران است؟ قطعاً بله. با هر مدل جدید، مرزهای امکانپذیر گسترش مییابند و ابزارهای قدرتمندتری در اختیار عموم قرار میگیرند. جمنای ۳ نشان میدهد که گوگل قصد دارد نهتنها در این رقابت باقی بماند، بلکه جایگاه رهبری را نیز به دست آورد.
مجله تخصصی هوش مصنوعی آرتین
🔗 بیشتر بخوانید در وبسایت آرتین
📌 اگر این مطلب برای شما مفید بود، آن را با دوستان خود به اشتراک بگذارید. نظرات و پیشنهادات خود را در بخش دیدگاهها با ما در میان بگذارید و با لایک کردن از ما حمایت کنید!
🔔 برای دریافت آخرین اخبار و مقالات تخصصی هوش مصنوعی، عضو کانال مجله آرتین شوید.
📱 ما را در شبکههای اجتماعی دنبال کنید: @ArtinMag


