رونمایی OpenAI و Anthropic از مدلهای هوش مصنوعی قدرتمندتر و ارزانتر
با وجود بحثهای فراوان پیرامون کاهش سرعت توسعه هوش مصنوعی، دو غول این صنعت از مدلهای زبانی جدید، قدرتمندتر و مقرونبهصرفهتر خود رونمایی کردند.

در یک نگاه (نکات کلیدی خبر)
خلاصه مهمترین نکات و تحولات این گزارش برای مطالعه سریع
- معرفی مدل Opus 5.5 توسط Anthropic با تمرکز بر پردازشهای پیچیده سازمانی و کاهش هزینهها.
- رونمایی OpenAI از مدلهای GPT-6 Sol و GPT-6 Luna با بهبود دقت و کاهش ۵۰ درصدی هزینهها.
- رقابت تنگاتنگ دو شرکت در ارائه مدلهای کارآمدتر و ارزانتر برای توسعهدهندگان و کسبوکارها.
پس از بحث و گمانهزنیهای فراوان درباره کاهش سرعت توسعه هوش مصنوعی، هر دو شرکت از مدلهای جدید خود رونمایی کردند.
گفتمان غالب در صنعت هوش مصنوعی تا حد زیادی بر کاهش سرعت توسعه یا «کنترل مرزهای فناوری» متمرکز بوده است، اما ظاهراً این موضوع مانع از عرضه مدلهای جدید توسط Anthropic و OpenAI نمیشود. هر دو شرکت در حال بهبود نسخههای پیشین خود یعنی Fable 5.1 و GPT-6 Astra هستند و مدلهای جدیدی را معرفی کردهاند که عملکرد مشابهی را با هزینه کمتر ارائه میدهند.
در مورد Claude، شرکت Anthropic اعلام کرده است که مدل جدید Opus 5.5 در انجام کارهای پیچیده، «یافتن و رفع ناکارآمدیها در نرمافزار» و تحلیلهای مالی و تجاری عملکرد بهتری دارد؛ قابلیتهایی که مستقیماً مشتریان سازمانی Anthropic را هدف قرار دادهاند. بر اساس بنچمارکهای Anthropic، مدل Opus 5.5 در زمینه کدنویسی با هوش مصنوعی نسبت به GPT-6 Astra در هر دو آزمون Terminal-Bench 4.0 و FrontierCode v1.1 برتری دارد که میتواند جذابیت آن را برای توسعهدهندگان افزایش دهد.
این بهبودها فراتر از تواناییهای مدل در انجام وظایف است و نحوه عملکرد آن را نیز شامل میشود. شرکت Anthropic ادعا میکند که Opus 5.5 متنهای قابلفهمتری تولید میکند و حدود ۸۵ درصد کمتر از مدلهای قبلی سعی در دور زدن محدودیتها داشته است؛ موضوعی که نشاندهنده کاهش نافرمانی آن از دستورالعملهاست. همچنین، هزینه استفاده از این مدل کاهش یافته است (۴ دلار برای توکنهای ورودی و ۲۰ دلار برای توکنهای خروجی، در مقایسه با ۵ دلار ورودی و ۲۵ دلار خروجی در مدل Opus 5).
مدلهای جدید OpenAI یعنی GPT-6 Sol و GPT-6 Luna نیز تمرکز مشابهی بر کارایی دارند. این مدلها با روشهای مشابه GPT-6 Astra آموزش دیدهاند و پیشرفتهایی در کارهای حرفهای، کدنویسی و استفاده از رایانه ارائه میدهند، اما قیمت آنها تا ۵۰ درصد ارزانتر از نسخههای GPT-5.6 است. به طور دقیق، هزینه توکنهای ورودی GPT-6 Sol معادل ۲ دلار و خروجی آن ۱۰ دلار است. برای مدل Luna نیز این ارقام به ترتیب ۰.۱۰ و ۰.۵۰ دلار تعیین شده است.
از نظر بهبود عملکرد، طبق گفته OpenAI، هر دو مدل جدید GPT-6 در ارائه حقایق دقیقتر عمل میکنند، به طوری که مدل Sol حدود نیمی از خطاهای نسخه قبلی خود را دارد. در زمینه کدنویسی نیز این شرکت میگوید GPT-6 Sol توانسته با هزینه کمتر به عملکرد Fable 5.1 برسد. این مدلها ارتباط شفافتری برقرار میکنند و به لطف بهبود در کش پرامپت، میتوانند زمینه بیشتری را بازیافت کرده و سریعتر پاسخ دهند.
شرکت OpenAI اعلام کرده است که مدلهای GPT-6 بر اساس آزمایشهای داخلی، همسویی بیشتری با دستورات دارند. برای مثال، آنها کمتر درباره نتایج کدهای خود دروغ میگویند و در برابر دستورات ناامن، مقاومت بیشتری در دور زدن تدابیر امنیتی نشان میدهند. مانند Anthropic، شرکت OpenAI نیز معیارهای پیشنهادی خود را برای ارزیابهای شخص ثالث جهت سنجش پیشرفت و امنیت توسعه هوش مصنوعی ارائه کرده است. با این حال، هنوز مشخص نیست که آیا این پیشنهادها به یک استاندارد جامع در صنعت تبدیل خواهند شد یا خیر.
مدل Opus 5.5 شرکت Anthropic هماکنون از طریق Claude، Amazon Web Services، Google Cloud و Microsoft Azure در دسترس توسعهدهندگان است. مدلهای GPT-6 Sol و GPT-6 Luna شرکت OpenAI نیز در ChatGPT Work و Codex برای مشتریان Plus، Pro، Business و Enterprise قابل استفاده هستند. کاربران رایگان و مشترکان Go تنها به GPT-6 Luna در اپلیکیشن دسکتاپ این شرکت دسترسی خواهند داشت.
برچسب های مرتبط
مطالب مرتبط و پیشنهادی

رکورد ۸۳۳ هزار دانلود ماهانه برای LEGAL-BERT؛ وقتی توسعهدهندهها قید مدلهای گرانقیمت را میزنند!
مدل زبانی تخصصی LEGAL-BERT با ثبت بیش از ۸۳۳ هزار دانلود در ماه روی پلتفرم هاگینگ فیس حسابی خبرساز شده است. این ابزار جمعوجور و تخصصی نشان میدهد که برای پردازش و تحلیل متون حقوقی، حتماً نیازی به مدلهای غولپیکر و پرهزینه ندارید و گزینههای بهینه همچنان در اوج هستند.

جاسوسی هوش مصنوعی در محل کار؛ کارمندان میگویند کارفرماها باید قانوناً مچگیریهایشان را لو بدهند!
نظرسنجیهای تازه نشان میدهد که بیشتر کارمندان حس میکنند مدیرانشان با ابزارهای هوش مصنوعی تمام حرکات آنها را زیر نظر گرفتهاند. حالا بیش از ۸۰ درصد شاغلان خواستار تصویب قانونی شدهاند که شرکتها را مجبور کند هرگونه مچگیری و نظارت هوش مصنوعی در محیط کار را رسماً اعلام کنند.

گزارش داغ مایکروسافت از نفوذ جهانی هوش مصنوعی؛ امارات در صدر و رتبه عجیب آمریکا!
مایکروسافت در تازهترین گزارش خود از ضریب نفوذ هوش مصنوعی در جهان پرده برداشت؛ آماری شگفتانگیز که نشان میدهد امارات و سنگاپور با فاصلهای خیرهکننده پیشتاز دنیا هستند و در مقابل، آمریکا در رتبه ۲۱ جا مانده است. همچنین الگوی استفاده از هوش مصنوعی میان کشورهای غربی و کشورهای در حال توسعه، از تفاوتی عمیق میان کاربردهای روزمره و آموزش پرده برمیدارد.
دیدگاه ها و گفتگوی تخصصی
نظرات خود را با جامعه مخاطبان وایر ای آی در میان بگذارید
هنوز دیدگاهی برای این مطلب ثبت نشده است
اولین نفری باشید که دیدگاه، تحلیل یا دیدگاه خود را درباره این موضوع با دیگران به اشتراک می گذارد.