پرش به محتوای اصلی
آخرین اخبار
۲ وایر پاداش مطالعه

رونمایی OpenAI و Anthropic از مدل‌های هوش مصنوعی قدرتمندتر و ارزان‌تر

انتشار:۳۱ شهریور ۱۴۰۵(۵ روز پیش)
۳ دقیقه زمان مطالعه
۰ دیدگاه

با وجود بحث‌های فراوان پیرامون کاهش سرعت توسعه هوش مصنوعی، دو غول این صنعت از مدل‌های زبانی جدید، قدرتمندتر و مقرون‌به‌صرفه‌تر خود رونمایی کردند.

رونمایی OpenAI و Anthropic از مدل‌های هوش مصنوعی قدرتمندتر و ارزان‌تر

در یک نگاه (نکات کلیدی خبر)

خلاصه مهم‌ترین نکات و تحولات این گزارش برای مطالعه سریع

  • معرفی مدل Opus 5.5 توسط Anthropic با تمرکز بر پردازش‌های پیچیده سازمانی و کاهش هزینه‌ها.
  • رونمایی OpenAI از مدل‌های GPT-6 Sol و GPT-6 Luna با بهبود دقت و کاهش ۵۰ درصدی هزینه‌ها.
  • رقابت تنگاتنگ دو شرکت در ارائه مدل‌های کارآمدتر و ارزان‌تر برای توسعه‌دهندگان و کسب‌وکارها.

پس از بحث و گمانه‌زنی‌های فراوان درباره کاهش سرعت توسعه هوش مصنوعی، هر دو شرکت از مدل‌های جدید خود رونمایی کردند.

گفتمان غالب در صنعت هوش مصنوعی تا حد زیادی بر کاهش سرعت توسعه یا «کنترل مرزهای فناوری» متمرکز بوده است، اما ظاهراً این موضوع مانع از عرضه مدل‌های جدید توسط Anthropic و OpenAI نمی‌شود. هر دو شرکت در حال بهبود نسخه‌های پیشین خود یعنی Fable 5.1 و GPT-6 Astra هستند و مدل‌های جدیدی را معرفی کرده‌اند که عملکرد مشابهی را با هزینه کمتر ارائه می‌دهند.

در مورد Claude، شرکت Anthropic اعلام کرده است که مدل جدید Opus 5.5 در انجام کارهای پیچیده، «یافتن و رفع ناکارآمدی‌ها در نرم‌افزار» و تحلیل‌های مالی و تجاری عملکرد بهتری دارد؛ قابلیت‌هایی که مستقیماً مشتریان سازمانی Anthropic را هدف قرار داده‌اند. بر اساس بنچمارک‌های Anthropic، مدل Opus 5.5 در زمینه کدنویسی با هوش مصنوعی نسبت به GPT-6 Astra در هر دو آزمون Terminal-Bench 4.0 و FrontierCode v1.1 برتری دارد که می‌تواند جذابیت آن را برای توسعه‌دهندگان افزایش دهد.

این بهبودها فراتر از توانایی‌های مدل در انجام وظایف است و نحوه عملکرد آن را نیز شامل می‌شود. شرکت Anthropic ادعا می‌کند که Opus 5.5 متن‌های قابل‌فهم‌تری تولید می‌کند و حدود ۸۵ درصد کمتر از مدل‌های قبلی سعی در دور زدن محدودیت‌ها داشته است؛ موضوعی که نشان‌دهنده کاهش نافرمانی آن از دستورالعمل‌هاست. همچنین، هزینه استفاده از این مدل کاهش یافته است (۴ دلار برای توکن‌های ورودی و ۲۰ دلار برای توکن‌های خروجی، در مقایسه با ۵ دلار ورودی و ۲۵ دلار خروجی در مدل Opus 5).

مدل‌های جدید OpenAI یعنی GPT-6 Sol و GPT-6 Luna نیز تمرکز مشابهی بر کارایی دارند. این مدل‌ها با روش‌های مشابه GPT-6 Astra آموزش دیده‌اند و پیشرفت‌هایی در کارهای حرفه‌ای، کدنویسی و استفاده از رایانه ارائه می‌دهند، اما قیمت آن‌ها تا ۵۰ درصد ارزان‌تر از نسخه‌های GPT-5.6 است. به طور دقیق، هزینه توکن‌های ورودی GPT-6 Sol معادل ۲ دلار و خروجی آن ۱۰ دلار است. برای مدل Luna نیز این ارقام به ترتیب ۰.۱۰ و ۰.۵۰ دلار تعیین شده است.

از نظر بهبود عملکرد، طبق گفته OpenAI، هر دو مدل جدید GPT-6 در ارائه حقایق دقیق‌تر عمل می‌کنند، به طوری که مدل Sol حدود نیمی از خطاهای نسخه قبلی خود را دارد. در زمینه کدنویسی نیز این شرکت می‌گوید GPT-6 Sol توانسته با هزینه کمتر به عملکرد Fable 5.1 برسد. این مدل‌ها ارتباط شفاف‌تری برقرار می‌کنند و به لطف بهبود در کش پرامپت، می‌توانند زمینه بیشتری را بازیافت کرده و سریع‌تر پاسخ دهند.

شرکت OpenAI اعلام کرده است که مدل‌های GPT-6 بر اساس آزمایش‌های داخلی، همسویی بیشتری با دستورات دارند. برای مثال، آن‌ها کمتر درباره نتایج کدهای خود دروغ می‌گویند و در برابر دستورات ناامن، مقاومت بیشتری در دور زدن تدابیر امنیتی نشان می‌دهند. مانند Anthropic، شرکت OpenAI نیز معیارهای پیشنهادی خود را برای ارزیاب‌های شخص ثالث جهت سنجش پیشرفت و امنیت توسعه هوش مصنوعی ارائه کرده است. با این حال، هنوز مشخص نیست که آیا این پیشنهادها به یک استاندارد جامع در صنعت تبدیل خواهند شد یا خیر.

مدل Opus 5.5 شرکت Anthropic هم‌اکنون از طریق Claude، Amazon Web Services، Google Cloud و Microsoft Azure در دسترس توسعه‌دهندگان است. مدل‌های GPT-6 Sol و GPT-6 Luna شرکت OpenAI نیز در ChatGPT Work و Codex برای مشتریان Plus، Pro، Business و Enterprise قابل استفاده هستند. کاربران رایگان و مشترکان Go تنها به GPT-6 Luna در اپلیکیشن دسکتاپ این شرکت دسترسی خواهند داشت.

دیدگاه ها و گفتگوی تخصصی

نظرات خود را با جامعه مخاطبان وایر ای آی در میان بگذارید

۰ دیدگاه

هنوز دیدگاهی برای این مطلب ثبت نشده است

اولین نفری باشید که دیدگاه، تحلیل یا دیدگاه خود را درباره این موضوع با دیگران به اشتراک می گذارد.

مطالب مرتبط و پیشنهادی

رکورد ۸۳۳ هزار دانلود ماهانه برای LEGAL-BERT؛ وقتی توسعه‌دهنده‌ها قید مدل‌های گران‌قیمت را می‌زنند!
آخرین اخبار

رکورد ۸۳۳ هزار دانلود ماهانه برای LEGAL-BERT؛ وقتی توسعه‌دهنده‌ها قید مدل‌های گران‌قیمت را می‌زنند!

مدل زبانی تخصصی LEGAL-BERT با ثبت بیش از ۸۳۳ هزار دانلود در ماه روی پلتفرم هاگینگ فیس حسابی خبرساز شده است. این ابزار جمع‌وجور و تخصصی نشان می‌دهد که برای پردازش و تحلیل متون حقوقی، حتماً نیازی به مدل‌های غول‌پیکر و پرهزینه ندارید و گزینه‌های بهینه همچنان در اوج هستند.

۲ دقیقه مطالعه
۰
۶ مهر
جاسوسی هوش مصنوعی در محل کار؛ کارمندان می‌گویند کارفرماها باید قانوناً مچ‌گیری‌هایشان را لو بدهند!
آخرین اخبار

جاسوسی هوش مصنوعی در محل کار؛ کارمندان می‌گویند کارفرماها باید قانوناً مچ‌گیری‌هایشان را لو بدهند!

نظرسنجی‌های تازه نشان می‌دهد که بیشتر کارمندان حس می‌کنند مدیرانشان با ابزارهای هوش مصنوعی تمام حرکات آن‌ها را زیر نظر گرفته‌اند. حالا بیش از ۸۰ درصد شاغلان خواستار تصویب قانونی شده‌اند که شرکت‌ها را مجبور کند هرگونه مچ‌گیری و نظارت هوش مصنوعی در محیط کار را رسماً اعلام کنند.

۳ دقیقه مطالعه
۰
۶ مهر
گزارش داغ مایکروسافت از نفوذ جهانی هوش مصنوعی؛ امارات در صدر و رتبه عجیب آمریکا!
آخرین اخبار

گزارش داغ مایکروسافت از نفوذ جهانی هوش مصنوعی؛ امارات در صدر و رتبه عجیب آمریکا!

مایکروسافت در تازه‌ترین گزارش خود از ضریب نفوذ هوش مصنوعی در جهان پرده برداشت؛ آماری شگفت‌انگیز که نشان می‌دهد امارات و سنگاپور با فاصله‌ای خیره‌کننده پیشتاز دنیا هستند و در مقابل، آمریکا در رتبه ۲۱ جا مانده است. همچنین الگوی استفاده از هوش مصنوعی میان کشورهای غربی و کشورهای در حال توسعه، از تفاوتی عمیق میان کاربردهای روزمره و آموزش پرده برمی‌دارد.

۳ دقیقه مطالعه
۰
۶ مهر