پرش به محتوای اصلی
آخرین اخبار
۲ وایر پاداش مطالعه

گوگل با مدل قدرتمند Gemini 4 Argon برگشت؛ برابری با GPT-6 با ۶۰ درصد هزینه کم‌تر!

انتشار:۹ مهر ۱۴۰۵(۲ ساعت پیش)
۴ دقیقه زمان مطالعه
۰ دیدگاه

گوگل با رونمایی از مدل قدرتمند Gemini 4 Argon پس از ماه‌ها سکوت، دوباره جایگاهش را در میان سه آزمایشگاه برتر هوش مصنوعی جهان پس گرفت. این مدل پرچمدار در شاخص‌های استدلال و هوش با GPT-6 Astra برابری می‌کند و در عین حال هزینه‌ای به‌مراتب کم‌تر و توانایی بالاتری در سناریوهای ایجنتی دارد.

گوگل با مدل قدرتمند Gemini 4 Argon برگشت؛ برابری با GPT-6 با ۶۰ درصد هزینه کم‌تر!

در یک نگاه (نکات کلیدی خبر)

خلاصه مهم‌ترین نکات و تحولات این گزارش برای مطالعه سریع

  • مدل جدید Gemini 4 Argon اولین مدل رده‌بالای گوگل دیپ‌مایند بعد از ۷ ماه است که توانسته در شاخص‌های استدلال و هوش با امتیاز ۵۳، با پرچمدار اوپن‌ای‌آی یعنی GPT-6 Astra برابری کند.
  • گوگل به لطف تخفیف اولیه ۵۰ درصدی، هزینه اجرای هر تسک را به ۱.۹۹ دلار رسانده که حدود ۶۰ درصد هزینه رقیبش است و آن را به گزینه‌ای بسیار اقتصادی تبدیل می‌کند.
  • بزرگ‌ترین برگ برنده آرگون، عملکرد عالی در تسک‌های ایجنتی و کم‌ترین نرخ توهم در میان مدل‌های پیشتاز (تنها ۱۵ درصد در برابر بیش از ۵۰ درصد در GPT-6) است.

مدل جدید Gemini 4 Argon گوگل با ۶۰ درصد هزینه کمتر، از نظر هوش و استدلال پا‌به‌پای GPT-6 Astra رقابت می‌کند

مدل Gemini 4 Argon اولین مدل اختصاصی و پرچمدار گوگل دیپ‌مایند فراتر از رده Flash در بیش از ۷ ماه گذشته است. این مدل با فعال بودن بالا‌ترین سطح استدلال (high reasoning)، توانسته در شاخص معتبر ارزیابی هوش امتیاز ۵۳ را به دست آورد؛ یعنی دقیقاً هم‌سطح GPT-6 Astra (با امتیاز ۵۳) و حتی یک پله بالا‌تر از GPT-6.1 Sol (با امتیاز ۵۲). این جهش بزرگ گوگل بیش‌تر مدیون کاهش چشمگیر خطای توهم (Hallucination) و تقویت اساسی توانایی‌های ایجنتی در مدل جدید است.

گوگل با در نظر گرفتن تخفیف ۵۰ درصدی اولیه و افزایش تخفیف کش به ۹۵ درصد، هزینه اجرای هر تسک در این شاخص را به ۱.۹۹ دلار رسانده است؛ یعنی فقط ۶۰ درصد هزینه GPT-6 Astra، هرچند همچنان حدود ۲.۷ برابر گران‌تر از GPT-6.1 Sol به حساب می‌آید. البته پس از پایان این دوره تخفیف، قیمت هر تسک به ۳.۹۸ دلار خواهد رسید (حدود ۱.۲ برابر GPT-6 Astra).

در حال حاضر مدل Gemini 4 Argon به صورت مرحله‌ای برای کاربران منتخب فعال می‌شود و هنوز در دسترس عموم قرار نگرفته است. تخفیف ۵۰ درصدی هم یک پیشنهاد تبلیغاتی آغازین به شمار می‌رود و گوگل هنوز تاریخ پایانی برای آن اعلام نکرده است.

نتایج کلیدی بنچمارک‌ها برای مدل Gemini 4 Argon با استدلال بالا:

➤ بازگشت گوگل به جمع سه آزمایشگاه برتر هوش دنیا: مدل Gemini 4 Argon در حالت استدلال بالا (high) به امتیاز ۵۳ در شاخص هوش دست یافته که با GPT-6 Astra برابر است و یک امتیاز بالا‌تر از GPT-6.1 Sol می‌ایستد. این نتیجه نسبت به مدل قبلی رده‌بالای گوگل یعنی Gemini 3.1 Pro Preview پیشرفتی ۲۳ امتیازی را نشان می‌دهد و حتی ۱۲ امتیاز از Gemini 3.8 Flash بالا‌تر است.

➤ تخفیف ۵۰ درصدی عرضه و هزینه کاملاً رقابتی به ازای هر تسک: با قیمت‌گذاری تخفیف‌خورده فعلی، هزینه هر تسک برای Gemini 4 Argon به ۱.۹۹ دلار می‌رسد که در مقایسه با هزینه ۳.۲۶ دلاری GPT-6 Astra (با سطح هوش مشابه)، حدود ۴۰ درصد ارزان‌تر تمام می‌شود. جالب است بدانید این صرفه اقتصادی به خاطر قیمت پایین‌تر توکن‌هاست، نه کاهش مصرف توکن؛ چرا که آرگون برای هر تسک به طور میانگین ۶۲ هزار توکن خروجی تولید می‌کند، در حالی که این رقم برای رقیبش ۲۷ هزار توکن است. گوگل هنوز زمان پایان این تخفیف را اعلام نکرده، اما با بازگشت به قیمت عادی، هزینه هر تسک به ۳.۹۸ دلار خواهد رسید.

➤ عملکرد به مراتب قوی‌تر در سناریوهای ایجنتی: کار‌های ایجنتی همیشه پاشنه آشیل مدل‌های قبلی جمنای به حساب می‌آمد، اما Gemini 4 Argon پیشرفت چشمگیری در تمام ارزیابی‌های مربوط به ایجنت‌ها نشان داده است. این مدل با امتیاز ۷۸ درصد در بنچمارک اتوماسیون (AutomationBench) رتبه اول را از آن خود کرده و ۷ امتیاز جلوتر از Claude Sonnet 5.5 ایستاده است. در آزمون Terminal Bench 4 هم امتیاز ۵۷ درصد را ثبت کرده که نسبت به نسخه قبلی پرو، ۵۳ امتیاز جهش داشته و تنها پشت سر Claude Sonnet 5.5 (با ۶۴ درصد)، Claude Opus 5.5 (با ۶۰ درصد) و GPT-6 Astra (با ۵۹ درصد) قرار می‌گیرد. در بنچمارک Briefcase نیز این مدل به ریتینگ ۱۴۹۴ Elo رسیده است؛ رقمی که حاصل نرخ قبولی کم‌نظیر ۶۵ درصدی در معیارهای ارزیابی است (بالا‌ترین رکوردی که تاکنون ثبت شده)، هرچند کیفیت تحلیلی (۱۵۷۶ Elo) و نحوه ارائه (۱۳۰۸ Elo) در آن کمی پایین‌تر است.

➤ کم‌ترین نرخ توهم در میان تمام مدل‌های پیشتاز: در بنچمارک سنجش دقت Omniscience، نرخ توهم Gemini 4 Argon تنها ۱۵ درصد بوده که پایین‌ترین میزان توهم در بین تمام مدل‌های بالای ۴۵ امتیاز در شاخص هوش است. برای مقایسه، نرخ توهم GPT-6 Astra به ۵۱ درصد و GPT-6.1 Sol به ۵۴ درصد می‌رسد! این یعنی آرگون وقتی جواب سؤالی را نداند، خیلی صادقانه اعتراف می‌کند که پاسخش را نمی‌داند، به جای اینکه شروع به حدس‌های نادرست و ارائه اطلاعات غلط کند. از نظر دقت خام، امتیاز آرگون ۵۰ درصد است (۵ امتیاز کم‌تر از Gemini 3.1 Pro Preview و ۱۳ امتیاز کم‌تر از GPT-6 Astra با ۶۳ درصد). با این حال به خاطر توهم بسیار کم، امتیاز کلی آن در این بنچمارک روی عدد ۴۲ می‌ایستد که کاملاً هم‌پای GPT-6 Astra (با ۴۳) و GPT-6.1 Sol (با ۴۲) است.

مشخصات کلیدی مدل:

➤ پنجره زمینه (Context Window): پشتیبانی از ۱ میلیون توکن

➤ چندوجهی بودن (Multimodality): پذیرش ورودی‌های متنی، تصویر، ویدیو و صوت، همراه با خروجی متنی

➤ قیمت‌گذاری: در حالت عادی ۴ دلار برای هر ۱ میلیون توکن ورودی و ۲۰ دلار برای هر ۱ میلیون توکن خروجی است که فعلاً با تخفیف ۵۰ درصدی دست‌کم به مدت یک ماه، به ۲ دلار و ۱۰ دلار کاهش یافته است. همچنین توکن‌های کش‌شده ورودی از ۹۵ درصد تخفیف برخوردارند (۱۰ سنت به ازای هر ۱ میلیون توکن در دوره تخفیف)، که نسبت به تخفیف ۹۰ درصدی Gemini 3.8 Flash ارتقا یافته است.

➤ قابلیت Long Decode Continuation: در بررسی‌های انجام‌شده، مدل Gemini 4 Argon با قابلیت جدید Long Decode Continuation مورد ارزیابی قرار گرفت؛ قابلیتی در API جمنای که به مدل اجازه می‌دهد پاسخ‌های طولانی را متوقف کند و در درخواست‌های بعدی بدون قطعی و تایم‌اوت، روند استدلال را تا ۱ میلیون توکن خروجی ادامه دهد.

دیدگاه ها و گفتگوی تخصصی

نظرات خود را با جامعه مخاطبان وایر ای آی در میان بگذارید

۰ دیدگاه

هنوز دیدگاهی برای این مطلب ثبت نشده است

اولین نفری باشید که دیدگاه، تحلیل یا دیدگاه خود را درباره این موضوع با دیگران به اشتراک می گذارد.

مطالب مرتبط و پیشنهادی

خط قرمز کالیفرنیا برای کارفرماها: اخراج کارمندان با هوش مصنوعی رسماً ممنوع شد!
آخرین اخبار

خط قرمز کالیفرنیا برای کارفرماها: اخراج کارمندان با هوش مصنوعی رسماً ممنوع شد!

ایالت کالیفرنیا با تصویب یک بسته قانونی تازه، دست کارفرماها را در استفاده بی‌رویه از هوش مصنوعی بست و اخراج کارکنان صرفاً بر اساس تصمیم الگوریتم‌ها را ممنوع اعلام کرد. این قانون علاوه بر الزام به شفافیت در تعدیل‌های نیرو، استفاده از هوش مصنوعی برای نظارت تصویری در سرویس‌های بهداشتی محل کار را هم قدغن کرده است. فرماندار کالیفرنیا با دفاع از نیروی کار، ادعای امکان خودتنظیم‌گری شرکت‌های هوش مصنوعی را بی‌اساس خواند.

۲ دقیقه مطالعه
۰
۹ مهر
طوفان هوش مصنوعی در بازار حافظه؛ رکورد تاریخی درآمد ۵۴ میلیارد دلاری میکرون در یک فصل!
آخرین اخبار

طوفان هوش مصنوعی در بازار حافظه؛ رکورد تاریخی درآمد ۵۴ میلیارد دلاری میکرون در یک فصل!

عطش سیری‌ناپذیر غول‌های فناوری برای توسعه هوش مصنوعی، درآمد فصلی شرکت میکرون را با جهشی باورنکردنی به بیش از ۵۴ میلیارد دلار رساند تا وال‌استریت شگفت‌زده شود. این غول تراشه‌سازی با ثبت درآمد سالانه ۱۳۳ میلیارد دلاری رکورد تاریخ خود را شکست و حالا با تقاضای انفجاری برای حافظه‌های پیشرفته، چشم به آینده‌ای درخشان‌تر دوخته است.

۲ دقیقه مطالعه
۰
۹ مهر
خداحافظی گوگل با Opal؛ جمزها به «اسکیل‌های جمینای» برای تمام کاربران تبدیل می‌شوند!
آخرین اخبار

خداحافظی گوگل با Opal؛ جمزها به «اسکیل‌های جمینای» برای تمام کاربران تبدیل می‌شوند!

گوگل در اقدامی تازه برای یکپارچه‌سازی ابزار‌های هوش مصنوعی، سرویس Opal را بازنشسته کرده و دستیارهای اختصاصی جمز را به «اسکیل‌های جمینای» تبدیل می‌کند. این قابلیت که پیش از این در انحصار کاربران اشتراکی بود، حالا با پیروی از استاندارد مشترک ایجنت‌ها و به کمک دستورهای ساده اسلش، به رایگان در دسترس همه کاربران قرار می‌گیرد.

۴ دقیقه مطالعه
۰
۹ مهر