آنتروپیک با Claude Haiku 5.5 به جنگ اوپنایآی رفت: کاهش ۹۰ درصدی هزینه API برای رقابت شانه به شانه با GPT-6 Luna
آنتروپیک با معرفی مدل سبک و سریع Claude Haiku 5.5 و کاهش ۹۰ درصدی قیمت API، زنگ خطر را برای رقبا به صدا درآورد. این مدل با تعرفه پایه ۰.۱۰ دلاری مستقیماً به مصاف GPT-6 Luna شرکت OpenAI رفته تا پردازشهای روزمره، وظایف سازمانی و کارهای سبک ایجنتها را با هزینهای فوقالعاده پایینتر انجام دهد.

در یک نگاه (نکات کلیدی خبر)
خلاصه مهمترین نکات و تحولات این گزارش برای مطالعه سریع
- آنتروپیک از مدل Claude Haiku 5.5 با کاهش قیمت چشمگیر ۹۰ درصدی برای درخواستهای زیر ۱۰۰ هزار توکن رونمایی کرد؛ حرکتی که مستقیماً تعرفه پایه مدل GPT-6 Luna شرکت OpenAI را هدف گرفته است.
- با نرخ پایه ۰.۱۰ دلار برای ورودی و ۰.۵۰ دلار برای خروجی، آنتروپیک برآورد کرده که هزینه کلی پردازشها برای شرکتها حدود ۷۵ درصد نسبت به نسخه قبلی یعنی هایکو ۴.۵ ارزانتر تمام میشود.
- این مدل به عنوان دستیار مکمل برای مدلهای بزرگتری مثل Sonnet و Opus عمل میکند و همزمان با عرضه آن، هزینه کشینگ Sonnet 5.5 هم ۵۰ درصد کاهش یافته و اعتبار ماهانه API برای مشترکان در نظر گرفته شده است.
آنتروپیک امروز رسماً از مدل Claude Haiku 5.5 رونمایی کرد؛ مدلی که قیمت توکنهایش برای درخواستهای زیر ۱۰۰ هزار توکن تا ۹۰ درصد کاهش یافته است. هدف اصلی این مدل ارزانقیمت، به دست گرفتن کارهای پرتکراری است که در مقیاسهای بزرگ هزینه هوش مصنوعی سازمانی را به شدت بالا میبرند؛ کارهایی مثل خلاصهسازی اسناد، دستهبندی اطلاعات، کوئری زدن به پایگاه داده و انجام تسکهای سبکتر برای ایجنتهای هوشمند قدرتمندتر.
قیمت پایه این مدل از ۰.۱۰ دلار به ازای هر یک میلیون توکن ورودی و ۰.۵۰ دلار برای هر یک میلیون توکن خروجی شروع میشود که دقیقاً با قیمت مدل GPT-6 Luna متعلق به OpenAI برابری میکند. محاسبات آنتروپیک نشان میدهد با در نظر گرفتن ابعاد درخواستها و تغییرات مصرف توکن، اجرای تسکها روی هایکو ۵.۵ حدود ۷۵ درصد ارزانتر از هایکو ۴.۵ تمام میشود.
البته این رونمایی فراتر از یک مدل اقتصادی ساده است؛ آنتروپیک هزینه کشینگ مدل Sonnet 5.5 را هم کاهش داده و برای مشترکان طرحهای Max و Team اعتبار ماهانه API در نظر گرفته است.
نقش مکمل برای ایجنتهای هوش مصنوعی سازمانی
آنتروپیک مدل هایکو را به عنوان یک نیروی کمکی و پشتیبان برای Opus و Sonnet در نظر گرفته است؛ مدلهایی که هنوز هم گزینههای اصلی و پیشنهادی این شرکت برای پروژههای سنگین کدنویسی هستند. طبق مثالی که شرکت فینتک Rogo ارائه کرده، یک مدل بزرگتر میتواند کل اسلایدهای یک گزارش مالی را آماده کند، در حالی که هایکو فقط عدد درآمد مورد نیاز برای یکی از اسلایدها را پیدا کرده و استخراج میکند.
الکس وانگ، از متخصصان هوش مصنوعی کاربردی در شرکت Rogo، در بیانیهای که از سوی آنتروپیک منتشر شده میگوید: «دقت هایکو آنقدر بالا هست که برای چنین کارهایی به آن اعتماد کنیم، و از طرفی آنقدر سریع و اقتصادی است که میتوانیم بدون نگرانی از هزینهها، مدام اجرایش کنیم.»
بیشترین تخفیف برای درخواستهای کوتاهتر
این تعرفهها یک مرز مهم دارند: برای درخواستهای بالاتر از ۱۰۰ هزار توکن، قیمت هایکو ۵.۵ به ۰.۵۰ دلار برای هر میلیون توکن ورودی و ۲.۵۰ دلار برای هر میلیون توکن خروجی میرسد. این رقم نشاندهنده کاهش ۵۰ درصدی نسبت به هایکو ۴.۵ است، در حالی که تخفیف زیر آستانه ۱۰۰ هزار توکن به ۹۰ درصد میرسید.
تعرفه به ازای هر یک میلیون توکن | هایکو ۵.۵: زیر ۱۰۰ هزار توکن | هایکو ۵.۵: بالای ۱۰۰ هزار توکن | هایکو ۴.۵ |
|---|---|---|---|
ورودی (Input) | ۰.۱۰ دلار | ۰.۵۰ دلار | ۱.۰۰ دلار |
خروجی (Output) | ۰.۵۰ دلار | ۲.۵۰ دلار | ۵.۰۰ دلار |
خواندن از کش (Cache reads) | ۰.۰۱ دلار | ۰.۰۵ دلار | ۰.۱۰ دلار |
نوشتن در کش (Cache writes) | ۰.۱۲۵ دلار | ۰.۶۲۵ دلار | ۱.۲۵ دلار |
آنتروپیک میگوید حدود ۹۰ درصد از درخواستهای کاربران در هایکو ۴.۵ در همین دسته درخواستهای کوتاهتر قرار میگیرند. در تخمین کاهش ۷۵ درصدی هزینهها، اثرات توکنایزر جدید (مکانیزمی که متون را به واحدهای توکن قابل محاسبه تبدیل میکند) نیز لحاظ شده است؛ توکنایزری که برای انجام کاری مشابه، توکنهای کمی بیشتری مصرف میکند.
مقایسه قیمت هایکو با مدلهای OpenAI، گوگل و Grok
این تعرفههای پایینتر، هایکو را به گزینهای بسیار رقابتی در برابر سایر مدلهای تجاری تبدیل کرده است، اما همچنان آن را به ارزانترین گزینه کل بازار بدل نمیکند. مدل Luna متعلق به OpenAI در هر چهار بخش تعرفههای سطح پایه هایکو (از جمله کشینگ) قیمت کاملاً برابری دارد.
مدل | ورودی به ازای هر میلیون توکن | خروجی به ازای هر میلیون توکن | شرایط قیمتگذاری |
|---|---|---|---|
آنتروپیک Claude Haiku 5.5 | ۰.۱۰ دلار | ۰.۵۰ دلار | درخواستهای زیر ۱۰۰ هزار توکن |
اوپنایآی GPT-6 Luna | ۰.۱۰ دلار | ۰.۵۰ دلار | تعرفه پایه؛ تعرفه بالاتر برای بیش از ۲۷۲ هزار توکن ورودی |
گوگل Gemini 3.5 Flash-Lite | ۰.۳۰ دلار | ۲.۵۰ دلار | قیمتگذاری استاندارد |
آنتروپیک Claude Haiku 5.5 | ۰.۵۰ دلار | ۲.۵۰ دلار | درخواستهای بالای ۱۰۰ هزار توکن |
گوگل Gemini 3.8 Flash | ۰.۷۵ دلار | ۳.۷۵ دلار | تعرفه پروموشن استاندارد تا ۳۱ دسامبر ۲۰۲۶ |
Grok 4.3 | ۱.۲۵ دلار | ۲.۵۰ دلار | زیر ۲۰۰ هزار توکن پرامپت |
Grok 4.7 | ۲.۰۰ دلار | ۶.۰۰ دلار | زیر ۲۰۰ هزار توکن پرامپت |
اوپنایآی GPT-6.1 Sol | ۲.۰۰ دلار | ۱۰.۰۰ دلار | تعرفه استاندارد پایه |
آنتروپیک Claude Sonnet 5.5 | ۲.۰۰ دلار | ۱۰.۰۰ دلار | تعرفه رسمی در جدول زمان عرضه |
منابع: اطلاعات رسمی آنتروپیک و قیمتگذاری اعلامشده برای GPT-6 Luna، GPT-6.1 Sol، Gemini و Grok (بررسیشده در ۷ اکتبر). ارقام اعلامشده بدون احتساب کشینگ، تخفیف پردازش دستهای، ابزارها و تعرفههای توافقی هستند و صرفاً قیمتها را مقایسه میکنند، نه قابلیتهای فنی یکسان را.
آستانه پنجره متنی اهمیت زیادی دارد: تعرفه پله بالاتر هایکو ۵ برابر نرخ پایه آن است، در حالی که افزایش قیمت لونا از ورودیهای بالای ۲۷۲ هزار توکن آغاز میشود. علاوه بر این، قیمت توکن به تنهایی هزینه تمامشده یک تسک را تعیین نمیکند؛ مواردی مانند میزان مصرف توکن، تلاشهای مجدد و دقت مدل هم مستقیماً روی هزینه نهایی اثر میگذارند.
پیشرفت چشمگیر در بنچمارکها و نکته مهم درباره سطح پردازش
جدول بنچمارکهای منتشرشده توسط آنتروپیک از برتری هایکو ۵.۵ نسبت به هایکو ۴.۵ و پیشی گرفتن از GPT-6 Luna در ارزیابیهای منتخب زیر خبر میدهد؛ هرچند Sonnet 5.5 همچنان جلوتر است. البته فراموش نکنید این نتایج توسط خود شرکت اعلام شده و هنوز توسط مراجع مستقل راستیآزمایی نشده است.
ارزیابی | هایکو ۵.۵ | هایکو ۴.۵ | GPT-6 Luna | Sonnet 5.5 |
|---|---|---|---|---|
بنچمارک GDPval-AA v2.1: کارهای دانشی | ۱,۶۲۰ | ۷۳۵ | ۱,۴۳۷ | ۱,۸۴۰ |
بنچمارک AA-Briefcase v1.1: کارهای دانشی | ۱,۵۷۸ | ۶۱۴ | ۱,۳۳۶ | ۱,۸۲۴ |
بنچمارک OSWorld 2.1 (بخش آفلاین): کار با کامپیوتر | ۷۲.۴٪ | ۱۵.۷٪ | ۴۸.۹٪ | ۸۳.۹٪ |
بنچمارک Terminal-Bench 4.0: کدنویسی مبتنی بر ایجنت | ۳۹.۲٪ | ۰.۰٪ | ۱۶.۴٪ | ۷۰.۶٪ |
بنچمارک FrontierCode 1.1: ارزیابی اصلی | ۴۶.۴٪ | — | ۴۲.۴٪ | ۵۲.۱٪* |
هایکو ۵.۵ قابلیت تنظیم سطح توان پردازشی و تلاش مدل (Effort Level) را معرفی کرده که حالت پیشفرض آن روی Medium قرار دارد. این تفاوت در تحلیل نتایج بسیار مهم است؛ چرا که امتیاز حدود ۳۹ درصدی هایکو در بنچمارک Terminal-Bench با حداکثر توان پردازشی (Maximum Effort) به دست آمده، در حالی که در حالت پیشفرض Medium این امتیاز در حدود ۲۰ درصد ثبت شده است.
مشتریان از سرعت بالاتر میگویند؛ ابهام در نرخ دقیق خروجی توکن
آنتروپیک هایکو را سریعترین مدل خود در سرعتهای استاندارد معرفی میکند، هرچند اعتراف کرده که مدل Opus در حالت Fast Mode سرعت بالاتری ارائه میدهد. با این حال، در مستندات رسمی هیچ رقم مشخصی برای تعداد توکن بر ثانیه اعلام نشده است.
گزارشهای مشتریان اولیه شواهد جزئیتری به دست میدهد. یاشودا باونانی، معاون محصولات هوش مصنوعی در شرکت Box، از بهبود ۱۱ امتیازی نسبت به هایکو ۴.۵ و کاهش تقریباً ۵۰ درصدی تأخیر خبر داده، اما مقیاس امتیازدهی را مشخص نکرده است. آرون وین، مهندس ارشد نرمافزار در Asana، گزارش کرده که زمان تکمیل تسکها بیش از ۳۰ درصد کاهش یافته و سرعت استنتاج در هر نوبت تعامل ایجنت، تا ۲.۵ برابر در مقایسه با یک مدل نامشخص سریعتر شده است.
زئِو کلاپو، مهندس برجسته نرمافزار در HubSpot، نیز میانگین امتیاز ۹۲.۸ درصدی را در سه بار اجرای ارزیابی CRM خود ثبت کرده که بالاترین نتیجه در میان مدلهای بررسیشده توسط این شرکت بوده است. البته این تمجیدهای منتشرشده از سوی مشتریان، معیار مقایسه دقیقی برای توان خروجی و پهنای باند عملیاتی (Throughput) در برابر سایر ارائهدهندگان به حساب نمیآیند.
کاهش قیمت Sonnet و اعتبارات تازه API برای مشترکان
در کنار هایکو، هزینه خواندن از کش برای مدل Sonnet 5.5 نیز با ۵۰ درصد کاهش، از ۰.۲۰ دلار به ۰.۱۰ دلار به ازای هر یک میلیون توکن رسیده است.
آنتروپیک برآورد میکند که این تغییر در بارهای کاری معمول ایجنتها باعث حدود ۲۰ درصد صرفهجویی در هزینهها شود؛ هرچند میزان دقیق این صرفهجویی به این بستگی دارد که یک برنامه تا چه حد از دادههای ذخیرهشده در کانتکست مجدداً استفاده میکند.
اعتبارات ماهانه API نیز از همین هفته فعال میشوند: ۱۰۰ دلار برای مشترکان پلن Max 5x، ۲۰۰ دلار برای مشترکان Max 20x و تا سقف ۵۰۰ دلار اعتبار مشترک برای کاربران پلن تیمی (Team). این اعتبارها برای اجرای تمام مدلها در پلتفرم آنتروپیک قابل استفاده خواهند بود، گرچه در پیشنویس اولیه نحوه تقسیم اعتبار تیمی یا شرایط انتقال آن به ماههای بعد توضیح داده نشده است.
دسترسی در سرویسهای ابری و نکات فنی استقرار
به گفته آنتروپیک، مدل هایکو علاوه بر پلتفرم اختصاصی این شرکت، از طریق سرویسهای ابری AWS، گوگل کلاد و مایکروسافت آژور با شناسه claude-haiku-5-5 در دسترس قرار میگیرد. بهروزرسانیهای جدید SDK در پایتون و تایپاسکریپت هم قابلیتهای آزمایشی بتایی برای کنترل مرورگرها و کار با کامپیوتر اضافه کردهاند. برخی از مشتریان فعلی آژور و گوگل کلاد نیز تخفیف کشینگ مدل Sonnet را در روزهای آینده دریافت خواهند کرد.
این مدل محدودیتهای امنیت سایبری سختگیرانهتری را هم در مقایسه با هایکو ۴.۵ اعمال کرده است؛ از جمله اینکه انجام آزمون نفوذ (Penetration Testing) تحت تدابیر امنیتی پیشفرض آن مسدود شده است. سازمانهایی که برای کارهای امنیت سایبری یا تحقیقات زیستی به دسترسیهای بازتری نیاز دارند، میتوانند از طریق برنامههای تأیید صلاحیت آنتروپیک درخواست دهند.
برای توسعهدهندگان سازمانی، آزمون واقعی این است که آیا هایکو میتواند وظایف مشخص و محدود را با پایداری کافی برای استفادههای مداوم انجام دهد یا خیر. قیمتهای فوقالعاده پایینتر و جهشهای عملکردی اعلامشده، بررسی و آزمایش این مدل را بسیار جذاب کرده است؛ با این حال، نتایج بنچمارکها همچنان نشان میدهند که برای پروژههای پیچیدهتر، باید کار را به مدلهای بزرگتر سپرد.
برچسب های مرتبط
مطالب مرتبط و پیشنهادی

دردسرهای فنی OpenAI Dots و ظهور شبیهسازهای متنباز؛ وقتی ایجنت همیشهروشن به این سادگیها نیست!
سرویس جدید OpenAI Dots با وعده ایجنتهای ابری همیشهروشن عرضه شد، اما بروز اختلالات فنی متعدد و قطعیهای پیدرپی حسابی صدای کاربران را درآورده است. همزمان، توسعهدهندگان مستقل با عرضه پروژههای متنبازی چون OpenDots و Open Dot در تلاشاند جایگزینهایی ارزانتر، آزادتر و بدون محدودیت در اختیار همگان بگذارند.

دانشمندان آزمایشگاه آرگون میکروسکوپ پرتو ایکس سخنگویی ساختند که با زبان طبیعی فرمان میگیرد و زوم میکند!
پژوهشگران آزمایشگاه ملی آرگون با اتصال ایجنتهای هوش مصنوعی به خط باریکه نانوپروب پرتو ایکس، میکروسکوپی توسعه دادهاند که دانشمندان میتوانند به زبان ساده و گفتاری با آن مکالمه کنند و از دستگاه بخواهند روی نقاط دلخواه نمونه زوم کند. این نوآوری با بازسازی بلادرنگ دادههای سنگین تایکوگرافی، افقهای تازهای در تحقیقات مواد پیشرفته و ساخت نیمههادیها میگشاید.

استارتاپ هوش مصنوعی ورنیک راهی اروپا شد؛ تأسیس نخستین مقر در لوکزامبورگ
استارتاپ هوش مصنوعی ورنیک (Verneek) که توسط نسرین مصطفیزاده و امید بخشنده تأسیس شده، قصد دارد با راهاندازی نخستین دفتر اروپایی خود در لوکزامبورگ فعالیتهایش را گسترش دهد. این شرکت فعال در حوزه هوش مصنوعی سازمانی، با پلتفرم اختصاصی خود به غولهای خردهفروشی کمک میکند تا دادههای پراکنده را یکپارچه کرده و بهرهوری را افزایش دهند.
دیدگاه ها و گفتگوی تخصصی
نظرات خود را با جامعه مخاطبان وایر ای آی در میان بگذارید
هنوز دیدگاهی برای این مطلب ثبت نشده است
اولین نفری باشید که دیدگاه، تحلیل یا دیدگاه خود را درباره این موضوع با دیگران به اشتراک می گذارد.