شاهکار گیتهاب در Copilot؛ قابلیت HydraFusion با ۶۷ درصد هزینه کمتر، Claude Opus 5 را پشت سر گذاشت!
گیتهاب پروژه جذاب HydraFusion را به محیط VS Code و اپلیکیشن کوپایلوت آورد؛ سیستمی هوشمند که درخواستهای کدنویسی را بین چند مدل مختلف هوش مصنوعی مدیریت میکند. نتایج بنچمارکها نشان میدهد این رویکرد نهتنها کیفیت کدها را در مقایسه با غولهایی مثل Claude Opus 5 ارتقا داده، بلکه هزینهها را هم تا ۶۷ درصد کاهش میدهد.

در یک نگاه (نکات کلیدی خبر)
خلاصه مهمترین نکات و تحولات این گزارش برای مطالعه سریع
- گیتهاب پروژه آزمایشی HydraFusion رو که قبلاً فقط تو محیط متنی Copilot CLI بود، بالاخره به ادیتور محبوب VS Code و اپلیکیشن کوپایلوت آورد.
- این سیستم مثل یک رهبر ارکستر کارها رو بین مدلهای مختلف پخش میکنه و تونسته با ۶۷ درصد هزینه کمتر، کیفیتی حتی بالاتر از غول Claude Opus 5 ثبت کنه!
- کاربران اشتراکهای پولی کوپایلوت میتونن همین حالا با فعالکردن یک گزینه ساده، از سه شیوه هوشمند پردازش کدها (تکمدلی، پلکانی یا بررسی نقادانه) لذت ببرن.
گیتهاب (GitHub) دامنه دسترسی به پروژه آزمایشی HydraFusion را گسترش داده است؛ قابلیتی هوشمند که میتواند یک درخواست کدنویسی را با هدایت دقیق، بین یک یا چند مدل مختلف هوش مصنوعی تقسیم کند. این ویژگی که پیش از این فقط به محیط ترمینال (Copilot CLI) محدود بود، حالا مستقیماً از بخش انتخاب مدل در نرمافزار Visual Studio Code و اپلیکیشن GitHub Copilot در دسترس قرار گرفته است. با این بهروزرسانی، یکی از پرتکرارترین خواستههای برنامهنویسان برآورده شده و وضعیت پیشرفت پردازش مدلها هم بسیار شفافتر از قبل نمایش داده میشود.
یک انتخاب ساده در منو، هماهنگی سه جریان کاری هوشمند
در لیست مدلهای کوپایلوت، گزینه HydraFusion درست در کنار سایر مدلها به چشم میخورد؛ اما در عمل مثل یک رهبر ارکستر همهفنحریف کار میکند. این سیستم برای هر کار و پرامپت، فاکتورهای مختلفی از جمله قدرت استدلال، کدنویسی، خطایابی و نحوه استفاده از ابزارها را میسنجد. سپس کمهزینهترین مسیر و جریان کاری را که بتواند به حدنصاب کیفیت مورد نظر برسد انتخاب میکند و در نهایت، یک خروجی تمیز و یکپارچه تحویل میدهد.
این مسیریاب هوشمند میتواند کارها را در سه قالب اجرایی مختلف پیش ببرد:
- حالت تکمدلی (Single): یک مدل منتخب وظیفه حل مستقیم و صفر تا صدی مسئله را به عهده میگیرد.
- حالت پلکانی (Cascade): ابتدا یک مدل کمهزینه و سریع، پیشنویس اولیه را آماده میکند. سپس فیلتر کیفی بررسی میکند که آیا پاسخ مناسب است یا کار باید برای تکمیل به یک مدل قدرتمندتر ارجاع داده شود.
- حالت نقد و بررسی (Critique): یک مدل کد اولیه را مینویسد، سپس یک مدل نقاد از خانوادهای کاملاً متفاوت (بدون دسترسی ویرایش) کد را بررسی و بازبینی میکند، و در آخر مدل اولیه با در نظر گرفتن بازخوردها، نسخه نهایی را اصلاح و ارائه میدهد.
مدل نقاد در یک محیط ایزوله و بدون دسترسی به ابزارها اجرا میشود؛ این یعنی بدون دستکاری در مخزن کد (Repository)، صرفاً کد را موشکافی میکند. علاوه بر این، اگر فرآیند لغو شود یا بررسی کیفی شکست بخورد، هایدرافیوژن هیچ تغییری روی فایلهای شما اعمال نخواهد کرد. تمام این مراحل با محاسبه دقیق هزینهها، محدودیتهای زمانی و سیستم بازگشت به حالت امن همراه است؛ ویژگیهایی که آن را فراتر از یک تغییردهنده ساده مدل و به یک چرخه ایجنتی کنترلشده و تمامعیار تبدیل میکند.
نحوه فعالسازی نسخه آزمایشی
برای استفاده از این قابلیت در نرمافزار Visual Studio Code، به نسخه ۱.۱۴۰ یا جدیدتر (از جمله نسخههای اینسایدرز) نیاز خواهید داشت. کافی است در چت کوپایلوت، گزینه HydraFusion را از منوی انتخاب مدل انتخاب کنید. اگر این گزینه را ندیدید، میتوانید به بخش تنظیمات ادیتور بروید و گزینه chat.copilot.hydraFusion.enabled را فعال کنید.
کاربران اپلیکیشن GitHub Copilot هم با نصب آخرین نسخه، رفتن به تنظیمات و جستجوی نام HydraFusion میتوانند تیک فعالسازی آن را بزنند. در حال حاضر، این قابلیت برای کاربران اشتراکهای Copilot Pro، Pro+، Business و Enterprise در دسترس است. البته در اشتراکهای تجاری و شرکتی، ابتدا مدیران سازمانی باید اجازه استفاده از قابلیتهای آزمایشی را صادر کنند.
هایدرافیوژن هزینه اشتراک جداگانهای ندارد؛ گیتهاب توکنهای مصرفشده توسط هر مدل را دقیقاً بر اساس تعرفه استاندارد همان مدل محاسبه میکند. با این حال، توجه داشته باشید که در فرآیندهای پلکانی یا نقد و بررسی، به دلیل درگیر شدن چند مدل در یک درخواست، ممکن است حجم توکن مصرفی نسبت به اجرای ساده با یک مدل تک بیشتر باشد.
فراتر از یک انتخاب ساده مدل
گزینه خودکار (Auto) فعلی در گیتهاب صرفاً برای هر درخواست یک مدل را انتخاب میکرد؛ اما هایدرافیوژن علاوه بر مدل، الگوی اجرایی مناسب را هم مشخص میکند و حتی میتواند در طول یک گفتوگو، چند مدل را هماهنگ به خط کند. این دید گستردهتر به سیستم اجازه میدهد تا تعادل بسیار بهتری میان هزینه، سرعت پاسخدهی و کیفیت نهایی کد برقرار سازد.
گزارش تحقیقاتی گیتهاب عملکرد هایدرافیوژن را در آزمونهای آفلاین با مدل مطرح Claude Opus 5 مقایسه کرده است. در تمام این آزمایشها، سطح استدلال برای همه مدلها روی حالت متوسط (Medium) تنظیم شده بود.
بنچمارک | هزینه | کیفیت |
|---|---|---|
TerminalBench 2.1 | ۶۷ درصد کمتر | ۴.۹ امتیاز بالاتر |
DeepSWE | ۳۶ درصد کمتر | ۱.۵ امتیاز پایینتر |
CheckpointBench | ۶۵ درصد کمتر | ۰.۱ امتیاز پایینتر |
البته این آمار و ارقام مربوط به شرایط کنترلشده آزمایشگاهی، نسخههای خاص بنچمارک و قیمتگذاری فرضی گیتهاب است؛ طبیعتاً در پروژههای واقعی با توجه به حجم ریپازیتوری، پیچیدگی تسکها و ابزارهای مورد استفاده، نتایج میتواند متغیر باشد. هایدرافیوژن بیشترین جهش کیفی خود را در بنچمارک TerminalBench 2.1 به ثبت رساند؛ در حالی که در بنچمارک DeepSWE (که خطایابی و اصلاح همزمان در چند فایل پروژه را میسنجد)، با وجود کاهش ۳۶ درصدی هزینهها، کیفیت خروجی کمی از Opus 5 پایینتر بود.
بهترین کارایی در تسکهای مشخص و محدود
تنظیمات فعلی هایدرافیوژن بیشتر برای تسکهای کدنویسی تکمرحلهای بهینهسازی شده است؛ یعنی تسکهایی که همه دستورات در یک پرامپت مشخص مطرح میشوند. گیتهاب اعلام کرده که پشتیبانی بهتر از مکالمات طولانی و رفتوبرگشتی را در برنامههای آینده خود دارد. بنابراین در حال حاضر، این قابلیت برای کارهای مشخص و مستقلی مناسب است که زمینه شفافی دارند و صحت نتیجه آنها در یک چرخه مشخص قابل اعتبارسنجی است.
در طول اجرای فرآیند، پیشنویسهای میانی پنهان میمانند. با اینکه نشانگرهای جدید پیشرفت مراحل جزئیتری را به کاربر نشان میدهند، اما برنامهنویسان برخلاف حالتهای تکمدلی نمیتوانند تکتک فراخوانی ابزارها یا پیشنویسها را زیر ذرهبین بگذارند. همچنین فرآیندهای پیچیدهترِ پلکانی یا نقد و بررسی به دلیل فراخوانی چند مدل و اعتبارسنجی اضافه، ممکن است زمان بیشتری برای پاسخدهی نیاز داشته باشند.
برنامهنویسانی که تا پیش از این عادت داشتند کارهای سنگین را دستی از یک مدل ارزان به یک مدل قویتر ببرند، حالا با HydraFusion میتوانند این فرآیند را کاملاً خودکار کنند. این سیستم خودش بهترین جریان کاری را تعیین میکند، هزینههای مدلها را ثبت میکند و در صورت لغو یا عدم تایید بازبینی، جلوی دستکاری ناقص و ناخواسته کدهای پروژه را میگیرد.
برچسب های مرتبط
مطالب مرتبط و پیشنهادی

خط قرمز کالیفرنیا برای کارفرماها: اخراج کارمندان با هوش مصنوعی رسماً ممنوع شد!
ایالت کالیفرنیا با تصویب یک بسته قانونی تازه، دست کارفرماها را در استفاده بیرویه از هوش مصنوعی بست و اخراج کارکنان صرفاً بر اساس تصمیم الگوریتمها را ممنوع اعلام کرد. این قانون علاوه بر الزام به شفافیت در تعدیلهای نیرو، استفاده از هوش مصنوعی برای نظارت تصویری در سرویسهای بهداشتی محل کار را هم قدغن کرده است. فرماندار کالیفرنیا با دفاع از نیروی کار، ادعای امکان خودتنظیمگری شرکتهای هوش مصنوعی را بیاساس خواند.

طوفان هوش مصنوعی در بازار حافظه؛ رکورد تاریخی درآمد ۵۴ میلیارد دلاری میکرون در یک فصل!
عطش سیریناپذیر غولهای فناوری برای توسعه هوش مصنوعی، درآمد فصلی شرکت میکرون را با جهشی باورنکردنی به بیش از ۵۴ میلیارد دلار رساند تا والاستریت شگفتزده شود. این غول تراشهسازی با ثبت درآمد سالانه ۱۳۳ میلیارد دلاری رکورد تاریخ خود را شکست و حالا با تقاضای انفجاری برای حافظههای پیشرفته، چشم به آیندهای درخشانتر دوخته است.

خداحافظی گوگل با Opal؛ جمزها به «اسکیلهای جمینای» برای تمام کاربران تبدیل میشوند!
گوگل در اقدامی تازه برای یکپارچهسازی ابزارهای هوش مصنوعی، سرویس Opal را بازنشسته کرده و دستیارهای اختصاصی جمز را به «اسکیلهای جمینای» تبدیل میکند. این قابلیت که پیش از این در انحصار کاربران اشتراکی بود، حالا با پیروی از استاندارد مشترک ایجنتها و به کمک دستورهای ساده اسلش، به رایگان در دسترس همه کاربران قرار میگیرد.
دیدگاه ها و گفتگوی تخصصی
نظرات خود را با جامعه مخاطبان وایر ای آی در میان بگذارید
هنوز دیدگاهی برای این مطلب ثبت نشده است
اولین نفری باشید که دیدگاه، تحلیل یا دیدگاه خود را درباره این موضوع با دیگران به اشتراک می گذارد.