پرش به محتوای اصلی
آخرین اخبار
۲ وایر پاداش مطالعه

آنتروپیک با Claude Haiku 5.5 به جنگ اوپن‌ای‌آی رفت: کاهش ۹۰ درصدی هزینه API برای رقابت شانه به شانه با GPT-6 Luna

انتشار:۱۵ مهر ۱۴۰۵(۱ ساعت پیش)
۵ دقیقه زمان مطالعه
۰ دیدگاه

آنتروپیک با معرفی مدل سبک و سریع Claude Haiku 5.5 و کاهش ۹۰ درصدی قیمت API، زنگ خطر را برای رقبا به صدا درآورد. این مدل با تعرفه پایه ۰.۱۰ دلاری مستقیماً به مصاف GPT-6 Luna شرکت OpenAI رفته تا پردازش‌های روزمره، وظایف سازمانی و کار‌های سبک ایجنت‌ها را با هزینه‌ای فوق‌العاده پایین‌تر انجام دهد.

آنتروپیک با Claude Haiku 5.5 به جنگ اوپن‌ای‌آی رفت: کاهش ۹۰ درصدی هزینه API برای رقابت شانه به شانه با GPT-6 Luna

در یک نگاه (نکات کلیدی خبر)

خلاصه مهم‌ترین نکات و تحولات این گزارش برای مطالعه سریع

  • آنتروپیک از مدل Claude Haiku 5.5 با کاهش قیمت چشمگیر ۹۰ درصدی برای درخواست‌های زیر ۱۰۰ هزار توکن رونمایی کرد؛ حرکتی که مستقیماً تعرفه پایه مدل GPT-6 Luna شرکت OpenAI را هدف گرفته است.
  • با نرخ پایه ۰.۱۰ دلار برای ورودی و ۰.۵۰ دلار برای خروجی، آنتروپیک برآورد کرده که هزینه کلی پردازش‌ها برای شرکت‌ها حدود ۷۵ درصد نسبت به نسخه قبلی یعنی هایکو ۴.۵ ارزان‌تر تمام می‌شود.
  • این مدل به عنوان دستیار مکمل برای مدل‌های بزرگ‌تری مثل Sonnet و Opus عمل می‌کند و هم‌زمان با عرضه آن، هزینه کشینگ Sonnet 5.5 هم ۵۰ درصد کاهش یافته و اعتبار ماهانه API برای مشترکان در نظر گرفته شده است.

آنتروپیک امروز رسماً از مدل Claude Haiku 5.5 رونمایی کرد؛ مدلی که قیمت توکن‌هایش برای درخواست‌های زیر ۱۰۰ هزار توکن تا ۹۰ درصد کاهش یافته است. هدف اصلی این مدل ارزان‌قیمت، به دست گرفتن کار‌های پرتکراری است که در مقیاس‌های بزرگ هزینه هوش مصنوعی سازمانی را به شدت بالا می‌برند؛ کار‌هایی مثل خلاصه‌سازی اسناد، دسته‌بندی اطلاعات، کوئری زدن به پایگاه داده و انجام تسک‌های سبک‌تر برای ایجنت‌های هوشمند قدرتمندتر.

قیمت پایه این مدل از ۰.۱۰ دلار به ازای هر یک میلیون توکن ورودی و ۰.۵۰ دلار برای هر یک میلیون توکن خروجی شروع می‌شود که دقیقاً با قیمت مدل GPT-6 Luna متعلق به OpenAI برابری می‌کند. محاسبات آنتروپیک نشان می‌دهد با در نظر گرفتن ابعاد درخواست‌ها و تغییرات مصرف توکن، اجرای تسک‌ها روی هایکو ۵.۵ حدود ۷۵ درصد ارزان‌تر از هایکو ۴.۵ تمام می‌شود.

البته این رونمایی فراتر از یک مدل اقتصادی ساده است؛ آنتروپیک هزینه کشینگ مدل Sonnet 5.5 را هم کاهش داده و برای مشترکان طرح‌های Max و Team اعتبار ماهانه API در نظر گرفته است.

نقش مکمل برای ایجنت‌های هوش مصنوعی سازمانی

آنتروپیک مدل هایکو را به عنوان یک نیروی کمکی و پشتیبان برای Opus و Sonnet در نظر گرفته است؛ مدل‌هایی که هنوز هم گزینه‌های اصلی و پیشنهادی این شرکت برای پروژه‌های سنگین کدنویسی هستند. طبق مثالی که شرکت فین‌تک Rogo ارائه کرده، یک مدل بزرگ‌تر می‌تواند کل اسلایدهای یک گزارش مالی را آماده کند، در حالی که هایکو فقط عدد درآمد مورد نیاز برای یکی از اسلایدها را پیدا کرده و استخراج می‌کند.

الکس وانگ، از متخصصان هوش مصنوعی کاربردی در شرکت Rogo، در بیانیه‌ای که از سوی آنتروپیک منتشر شده می‌گوید: «دقت هایکو آن‌قدر بالا هست که برای چنین کار‌هایی به آن اعتماد کنیم، و از طرفی آن‌قدر سریع و اقتصادی است که می‌توانیم بدون نگرانی از هزینه‌ها، مدام اجرایش کنیم.»

بیش‌ترین تخفیف برای درخواست‌های کوتاه‌تر

این تعرفه‌ها یک مرز مهم دارند: برای درخواست‌های بالا‌تر از ۱۰۰ هزار توکن، قیمت هایکو ۵.۵ به ۰.۵۰ دلار برای هر میلیون توکن ورودی و ۲.۵۰ دلار برای هر میلیون توکن خروجی می‌رسد. این رقم نشان‌دهنده کاهش ۵۰ درصدی نسبت به هایکو ۴.۵ است، در حالی که تخفیف زیر آستانه ۱۰۰ هزار توکن به ۹۰ درصد می‌رسید.

تعرفه به ازای هر یک میلیون توکن

هایکو ۵.۵: زیر ۱۰۰ هزار توکن

هایکو ۵.۵: بالای ۱۰۰ هزار توکن

هایکو ۴.۵

ورودی (Input)

۰.۱۰ دلار

۰.۵۰ دلار

۱.۰۰ دلار

خروجی (Output)

۰.۵۰ دلار

۲.۵۰ دلار

۵.۰۰ دلار

خواندن از کش (Cache reads)

۰.۰۱ دلار

۰.۰۵ دلار

۰.۱۰ دلار

نوشتن در کش (Cache writes)

۰.۱۲۵ دلار

۰.۶۲۵ دلار

۱.۲۵ دلار

آنتروپیک می‌گوید حدود ۹۰ درصد از درخواست‌های کاربران در هایکو ۴.۵ در همین دسته درخواست‌های کوتاه‌تر قرار می‌گیرند. در تخمین کاهش ۷۵ درصدی هزینه‌ها، اثرات توکنایزر جدید (مکانیزمی که متون را به واحدهای توکن قابل محاسبه تبدیل می‌کند) نیز لحاظ شده است؛ توکنایزری که برای انجام کاری مشابه، توکن‌های کمی بیشتری مصرف می‌کند.

مقایسه قیمت هایکو با مدل‌های OpenAI، گوگل و Grok

این تعرفه‌های پایین‌تر، هایکو را به گزینه‌ای بسیار رقابتی در برابر سایر مدل‌های تجاری تبدیل کرده است، اما همچنان آن را به ارزان‌ترین گزینه کل بازار بدل نمی‌کند. مدل Luna متعلق به OpenAI در هر چهار بخش تعرفه‌های سطح پایه هایکو (از جمله کشینگ) قیمت کاملاً برابری دارد.

مدل

ورودی به ازای هر میلیون توکن

خروجی به ازای هر میلیون توکن

شرایط قیمت‌گذاری

آنتروپیک Claude Haiku 5.5

۰.۱۰ دلار

۰.۵۰ دلار

درخواست‌های زیر ۱۰۰ هزار توکن

اوپن‌ای‌آی GPT-6 Luna

۰.۱۰ دلار

۰.۵۰ دلار

تعرفه پایه؛ تعرفه بالا‌تر برای بیش از ۲۷۲ هزار توکن ورودی

گوگل Gemini 3.5 Flash-Lite

۰.۳۰ دلار

۲.۵۰ دلار

قیمت‌گذاری استاندارد

آنتروپیک Claude Haiku 5.5

۰.۵۰ دلار

۲.۵۰ دلار

درخواست‌های بالای ۱۰۰ هزار توکن

گوگل Gemini 3.8 Flash

۰.۷۵ دلار

۳.۷۵ دلار

تعرفه پروموشن استاندارد تا ۳۱ دسامبر ۲۰۲۶

Grok 4.3

۱.۲۵ دلار

۲.۵۰ دلار

زیر ۲۰۰ هزار توکن پرامپت

Grok 4.7

۲.۰۰ دلار

۶.۰۰ دلار

زیر ۲۰۰ هزار توکن پرامپت

اوپن‌ای‌آی GPT-6.1 Sol

۲.۰۰ دلار

۱۰.۰۰ دلار

تعرفه استاندارد پایه

آنتروپیک Claude Sonnet 5.5

۲.۰۰ دلار

۱۰.۰۰ دلار

تعرفه رسمی در جدول زمان عرضه

منابع: اطلاعات رسمی آنتروپیک و قیمت‌گذاری اعلام‌شده برای GPT-6 Luna، GPT-6.1 Sol، Gemini و Grok (بررسی‌شده در ۷ اکتبر). ارقام اعلام‌شده بدون احتساب کشینگ، تخفیف پردازش دسته‌ای، ابزار‌ها و تعرفه‌های توافقی هستند و صرفاً قیمت‌ها را مقایسه می‌کنند، نه قابلیت‌های فنی یکسان را.

آستانه پنجره متنی اهمیت زیادی دارد: تعرفه پله بالا‌تر هایکو ۵ برابر نرخ پایه آن است، در حالی که افزایش قیمت لونا از ورودی‌های بالای ۲۷۲ هزار توکن آغاز می‌شود. علاوه بر این، قیمت توکن به تنهایی هزینه تمام‌شده یک تسک را تعیین نمی‌کند؛ مواردی مانند میزان مصرف توکن، تلاش‌های مجدد و دقت مدل هم مستقیماً روی هزینه نهایی اثر می‌گذارند.

پیشرفت چشمگیر در بنچمارک‌ها و نکته مهم درباره سطح پردازش

جدول بنچمارک‌های منتشرشده توسط آنتروپیک از برتری هایکو ۵.۵ نسبت به هایکو ۴.۵ و پیشی گرفتن از GPT-6 Luna در ارزیابی‌های منتخب زیر خبر می‌دهد؛ هرچند Sonnet 5.5 همچنان جلوتر است. البته فراموش نکنید این نتایج توسط خود شرکت اعلام شده و هنوز توسط مراجع مستقل راستی‌آزمایی نشده است.

ارزیابی

هایکو ۵.۵

هایکو ۴.۵

GPT-6 Luna

Sonnet 5.5

بنچمارک GDPval-AA v2.1: کار‌های دانشی

۱,۶۲۰

۷۳۵

۱,۴۳۷

۱,۸۴۰

بنچمارک AA-Briefcase v1.1: کار‌های دانشی

۱,۵۷۸

۶۱۴

۱,۳۳۶

۱,۸۲۴

بنچمارک OSWorld 2.1 (بخش آفلاین): کار با کامپیوتر

۷۲.۴٪

۱۵.۷٪

۴۸.۹٪

۸۳.۹٪

بنچمارک Terminal-Bench 4.0: کدنویسی مبتنی بر ایجنت

۳۹.۲٪

۰.۰٪

۱۶.۴٪

۷۰.۶٪

بنچمارک FrontierCode 1.1: ارزیابی اصلی

۴۶.۴٪

—

۴۲.۴٪

۵۲.۱٪*

هایکو ۵.۵ قابلیت تنظیم سطح توان پردازشی و تلاش مدل (Effort Level) را معرفی کرده که حالت پیش‌فرض آن روی Medium قرار دارد. این تفاوت در تحلیل نتایج بسیار مهم است؛ چرا که امتیاز حدود ۳۹ درصدی هایکو در بنچمارک Terminal-Bench با حداکثر توان پردازشی (Maximum Effort) به دست آمده، در حالی که در حالت پیش‌فرض Medium این امتیاز در حدود ۲۰ درصد ثبت شده است.

مشتریان از سرعت بالا‌تر می‌گویند؛ ابهام در نرخ دقیق خروجی توکن

آنتروپیک هایکو را سریع‌ترین مدل خود در سرعت‌های استاندارد معرفی می‌کند، هرچند اعتراف کرده که مدل Opus در حالت Fast Mode سرعت بالاتری ارائه می‌دهد. با این حال، در مستندات رسمی هیچ رقم مشخصی برای تعداد توکن بر ثانیه اعلام نشده است.

گزارش‌های مشتریان اولیه شواهد جزئی‌تری به دست می‌دهد. یاشودا باونانی، معاون محصولات هوش مصنوعی در شرکت Box، از بهبود ۱۱ امتیازی نسبت به هایکو ۴.۵ و کاهش تقریباً ۵۰ درصدی تأخیر خبر داده، اما مقیاس امتیازدهی را مشخص نکرده است. آرون وین، مهندس ارشد نرم‌افزار در Asana، گزارش کرده که زمان تکمیل تسک‌ها بیش از ۳۰ درصد کاهش یافته و سرعت استنتاج در هر نوبت تعامل ایجنت، تا ۲.۵ برابر در مقایسه با یک مدل نامشخص سریع‌تر شده است.

زئِو کلاپو، مهندس برجسته نرم‌افزار در HubSpot، نیز میانگین امتیاز ۹۲.۸ درصدی را در سه بار اجرای ارزیابی CRM خود ثبت کرده که بالا‌ترین نتیجه در میان مدل‌های بررسی‌شده توسط این شرکت بوده است. البته این تمجیدهای منتشرشده از سوی مشتریان، معیار مقایسه دقیقی برای توان خروجی و پهنای باند عملیاتی (Throughput) در برابر سایر ارائه‌دهندگان به حساب نمی‌آیند.

کاهش قیمت Sonnet و اعتبارات تازه API برای مشترکان

در کنار هایکو، هزینه خواندن از کش برای مدل Sonnet 5.5 نیز با ۵۰ درصد کاهش، از ۰.۲۰ دلار به ۰.۱۰ دلار به ازای هر یک میلیون توکن رسیده است.

آنتروپیک برآورد می‌کند که این تغییر در بارهای کاری معمول ایجنت‌ها باعث حدود ۲۰ درصد صرفه‌جویی در هزینه‌ها شود؛ هرچند میزان دقیق این صرفه‌جویی به این بستگی دارد که یک برنامه تا چه حد از داده‌های ذخیره‌شده در کانتکست مجدداً استفاده می‌کند.

اعتبارات ماهانه API نیز از همین هفته فعال می‌شوند: ۱۰۰ دلار برای مشترکان پلن Max 5x، ۲۰۰ دلار برای مشترکان Max 20x و تا سقف ۵۰۰ دلار اعتبار مشترک برای کاربران پلن تیمی (Team). این اعتبارها برای اجرای تمام مدل‌ها در پلتفرم آنتروپیک قابل استفاده خواهند بود، گرچه در پیش‌نویس اولیه نحوه تقسیم اعتبار تیمی یا شرایط انتقال آن به ماه‌های بعد توضیح داده نشده است.

دسترسی در سرویس‌های ابری و نکات فنی استقرار

به گفته آنتروپیک، مدل هایکو علاوه بر پلتفرم اختصاصی این شرکت، از طریق سرویس‌های ابری AWS، گوگل کلاد و مایکروسافت آژور با شناسه claude-haiku-5-5 در دسترس قرار می‌گیرد. به‌روزرسانی‌های جدید SDK در پایتون و تایپ‌اسکریپت هم قابلیت‌های آزمایشی بتایی برای کنترل مرورگرها و کار با کامپیوتر اضافه کرده‌اند. برخی از مشتریان فعلی آژور و گوگل کلاد نیز تخفیف کشینگ مدل Sonnet را در روز‌های آینده دریافت خواهند کرد.

این مدل محدودیت‌های امنیت سایبری سخت‌گیرانه‌تری را هم در مقایسه با هایکو ۴.۵ اعمال کرده است؛ از جمله اینکه انجام آزمون نفوذ (Penetration Testing) تحت تدابیر امنیتی پیش‌فرض آن مسدود شده است. سازمان‌هایی که برای کار‌های امنیت سایبری یا تحقیقات زیستی به دسترسی‌های بازتری نیاز دارند، می‌توانند از طریق برنامه‌های تأیید صلاحیت آنتروپیک درخواست دهند.

برای توسعه‌دهندگان سازمانی، آزمون واقعی این است که آیا هایکو می‌تواند وظایف مشخص و محدود را با پایداری کافی برای استفاده‌های مداوم انجام دهد یا خیر. قیمت‌های فوق‌العاده پایین‌تر و جهش‌های عملکردی اعلام‌شده، بررسی و آزمایش این مدل را بسیار جذاب کرده است؛ با این حال، نتایج بنچمارک‌ها همچنان نشان می‌دهند که برای پروژه‌های پیچیده‌تر، باید کار را به مدل‌های بزرگ‌تر سپرد.

دیدگاه ها و گفتگوی تخصصی

نظرات خود را با جامعه مخاطبان وایر ای آی در میان بگذارید

۰ دیدگاه

هنوز دیدگاهی برای این مطلب ثبت نشده است

اولین نفری باشید که دیدگاه، تحلیل یا دیدگاه خود را درباره این موضوع با دیگران به اشتراک می گذارد.

مطالب مرتبط و پیشنهادی

دردسرهای فنی OpenAI Dots و ظهور شبیه‌سازهای متن‌باز؛ وقتی ایجنت همیشه‌روشن به این سادگی‌ها نیست!
آخرین اخبار

دردسرهای فنی OpenAI Dots و ظهور شبیه‌سازهای متن‌باز؛ وقتی ایجنت همیشه‌روشن به این سادگی‌ها نیست!

سرویس جدید OpenAI Dots با وعده ایجنت‌های ابری همیشه‌روشن عرضه شد، اما بروز اختلالات فنی متعدد و قطعی‌های پی‌درپی حسابی صدای کاربران را درآورده است. هم‌زمان، توسعه‌دهندگان مستقل با عرضه پروژه‌های متن‌بازی چون OpenDots و Open Dot در تلاش‌اند جایگزین‌هایی ارزان‌تر، آزادتر و بدون محدودیت در اختیار همگان بگذارند.

۳ دقیقه مطالعه
۰
۱۶ مهر
دانشمندان آزمایشگاه آرگون میکروسکوپ پرتو ایکس سخنگویی ساختند که با زبان طبیعی فرمان می‌گیرد و زوم می‌کند!
آخرین اخبار

دانشمندان آزمایشگاه آرگون میکروسکوپ پرتو ایکس سخنگویی ساختند که با زبان طبیعی فرمان می‌گیرد و زوم می‌کند!

پژوهشگران آزمایشگاه ملی آرگون با اتصال ایجنت‌های هوش مصنوعی به خط باریکه نانوپروب پرتو ایکس، میکروسکوپی توسعه داده‌اند که دانشمندان می‌توانند به زبان ساده و گفتاری با آن مکالمه کنند و از دستگاه بخواهند روی نقاط دلخواه نمونه زوم کند. این نوآوری با بازسازی بلادرنگ داده‌های سنگین تایکوگرافی، افق‌های تازه‌ای در تحقیقات مواد پیشرفته و ساخت نیمه‌هادی‌ها می‌گشاید.

۴ دقیقه مطالعه
۰
۱۶ مهر
استارتاپ هوش مصنوعی ورنیک راهی اروپا شد؛ تأسیس نخستین مقر در لوکزامبورگ
آخرین اخبار

استارتاپ هوش مصنوعی ورنیک راهی اروپا شد؛ تأسیس نخستین مقر در لوکزامبورگ

استارتاپ هوش مصنوعی ورنیک (Verneek) که توسط نسرین مصطفی‌زاده و امید بخشنده تأسیس شده، قصد دارد با راه‌اندازی نخستین دفتر اروپایی خود در لوکزامبورگ فعالیت‌هایش را گسترش دهد. این شرکت فعال در حوزه هوش مصنوعی سازمانی، با پلتفرم اختصاصی خود به غول‌های خرده‌فروشی کمک می‌کند تا داده‌های پراکنده را یکپارچه کرده و بهره‌وری را افزایش دهند.

۳ دقیقه مطالعه
۰
۱۶ مهر