پرش به محتوای اصلی
آخرین اخبار
۲ وایر پاداش مطالعه

شاهکار گیت‌هاب در Copilot؛ قابلیت HydraFusion با ۶۷ درصد هزینه کمتر، Claude Opus 5 را پشت سر گذاشت!

انتشار:۹ مهر ۱۴۰۵(۲ ساعت پیش)
۴ دقیقه زمان مطالعه
۰ دیدگاه

گیت‌هاب پروژه جذاب HydraFusion را به محیط VS Code و اپلیکیشن کوپایلوت آورد؛ سیستمی هوشمند که درخواست‌های کدنویسی را بین چند مدل مختلف هوش مصنوعی مدیریت می‌کند. نتایج بنچمارک‌ها نشان می‌دهد این رویکرد نه‌تنها کیفیت کدها را در مقایسه با غول‌هایی مثل Claude Opus 5 ارتقا داده، بلکه هزینه‌ها را هم تا ۶۷ درصد کاهش می‌دهد.

شاهکار گیت‌هاب در Copilot؛ قابلیت HydraFusion با ۶۷ درصد هزینه کمتر، Claude Opus 5 را پشت سر گذاشت!

در یک نگاه (نکات کلیدی خبر)

خلاصه مهم‌ترین نکات و تحولات این گزارش برای مطالعه سریع

  • گیت‌هاب پروژه آزمایشی HydraFusion رو که قبلاً فقط تو محیط متنی Copilot CLI بود، بالاخره به ادیتور محبوب VS Code و اپلیکیشن کوپایلوت آورد.
  • این سیستم مثل یک رهبر ارکستر کار‌ها رو بین مدل‌های مختلف پخش می‌کنه و تونسته با ۶۷ درصد هزینه کمتر، کیفیتی حتی بالا‌تر از غول Claude Opus 5 ثبت کنه!
  • کاربران اشتراک‌های پولی کوپایلوت می‌تونن همین حالا با فعال‌کردن یک گزینه ساده، از سه شیوه هوشمند پردازش کدها (تک‌مدلی، پلکانی یا بررسی نقادانه) لذت ببرن.

گیت‌هاب (GitHub) دامنه دسترسی به پروژه آزمایشی HydraFusion را گسترش داده است؛ قابلیتی هوشمند که می‌تواند یک درخواست کدنویسی را با هدایت دقیق، بین یک یا چند مدل مختلف هوش مصنوعی تقسیم کند. این ویژگی که پیش از این فقط به محیط ترمینال (Copilot CLI) محدود بود، حالا مستقیماً از بخش انتخاب مدل در نرم‌افزار Visual Studio Code و اپلیکیشن GitHub Copilot در دسترس قرار گرفته است. با این به‌روزرسانی، یکی از پرتکرارترین خواسته‌های برنامه‌نویسان برآورده شده و وضعیت پیشرفت پردازش مدل‌ها هم بسیار شفاف‌تر از قبل نمایش داده می‌شود.

یک انتخاب ساده در منو، هماهنگی سه جریان کاری هوشمند

در لیست مدل‌های کوپایلوت، گزینه HydraFusion درست در کنار سایر مدل‌ها به چشم می‌خورد؛ اما در عمل مثل یک رهبر ارکستر همه‌فن‌حریف کار می‌کند. این سیستم برای هر کار و پرامپت، فاکتورهای مختلفی از جمله قدرت استدلال، کدنویسی، خطایابی و نحوه استفاده از ابزار‌ها را می‌سنجد. سپس کم‌هزینه‌ترین مسیر و جریان کاری را که بتواند به حدنصاب کیفیت مورد نظر برسد انتخاب می‌کند و در نهایت، یک خروجی تمیز و یکپارچه تحویل می‌دهد.

این مسیریاب هوشمند می‌تواند کار‌ها را در سه قالب اجرایی مختلف پیش ببرد:

  • حالت تک‌مدلی (Single): یک مدل منتخب وظیفه حل مستقیم و صفر تا صدی مسئله را به عهده می‌گیرد.
  • حالت پلکانی (Cascade): ابتدا یک مدل کم‌هزینه و سریع، پیش‌نویس اولیه را آماده می‌کند. سپس فیلتر کیفی بررسی می‌کند که آیا پاسخ مناسب است یا کار باید برای تکمیل به یک مدل قدرتمندتر ارجاع داده شود.
  • حالت نقد و بررسی (Critique): یک مدل کد اولیه را می‌نویسد، سپس یک مدل نقاد از خانواده‌ای کاملاً متفاوت (بدون دسترسی ویرایش) کد را بررسی و بازبینی می‌کند، و در آخر مدل اولیه با در نظر گرفتن بازخوردها، نسخه نهایی را اصلاح و ارائه می‌دهد.

مدل نقاد در یک محیط ایزوله و بدون دسترسی به ابزار‌ها اجرا می‌شود؛ این یعنی بدون دستکاری در مخزن کد (Repository)، صرفاً کد را موشکافی می‌کند. علاوه بر این، اگر فرآیند لغو شود یا بررسی کیفی شکست بخورد، هایدرافیوژن هیچ تغییری روی فایل‌های شما اعمال نخواهد کرد. تمام این مراحل با محاسبه دقیق هزینه‌ها، محدودیت‌های زمانی و سیستم بازگشت به حالت امن همراه است؛ ویژگی‌هایی که آن را فراتر از یک تغییردهنده ساده مدل و به یک چرخه ایجنتی کنترل‌شده و تمام‌عیار تبدیل می‌کند.

نحوه فعال‌سازی نسخه آزمایشی

برای استفاده از این قابلیت در نرم‌افزار Visual Studio Code، به نسخه ۱.۱۴۰ یا جدید‌تر (از جمله نسخه‌های اینسایدرز) نیاز خواهید داشت. کافی است در چت کوپایلوت، گزینه HydraFusion را از منوی انتخاب مدل انتخاب کنید. اگر این گزینه را ندیدید، می‌توانید به بخش تنظیمات ادیتور بروید و گزینه chat.copilot.hydraFusion.enabled را فعال کنید.

کاربران اپلیکیشن GitHub Copilot هم با نصب آخرین نسخه، رفتن به تنظیمات و جستجوی نام HydraFusion می‌توانند تیک فعال‌سازی آن را بزنند. در حال حاضر، این قابلیت برای کاربران اشتراک‌های Copilot Pro، Pro+، Business و Enterprise در دسترس است. البته در اشتراک‌های تجاری و شرکتی، ابتدا مدیران سازمانی باید اجازه استفاده از قابلیت‌های آزمایشی را صادر کنند.

هایدرافیوژن هزینه اشتراک جداگانه‌ای ندارد؛ گیت‌هاب توکن‌های مصرف‌شده توسط هر مدل را دقیقاً بر اساس تعرفه استاندارد همان مدل محاسبه می‌کند. با این حال، توجه داشته باشید که در فرآیندهای پلکانی یا نقد و بررسی، به دلیل درگیر شدن چند مدل در یک درخواست، ممکن است حجم توکن مصرفی نسبت به اجرای ساده با یک مدل تک بیش‌تر باشد.

فراتر از یک انتخاب ساده مدل

گزینه خودکار (Auto) فعلی در گیت‌هاب صرفاً برای هر درخواست یک مدل را انتخاب می‌کرد؛ اما هایدرافیوژن علاوه بر مدل، الگوی اجرایی مناسب را هم مشخص می‌کند و حتی می‌تواند در طول یک گفت‌وگو، چند مدل را هماهنگ به خط کند. این دید گسترده‌تر به سیستم اجازه می‌دهد تا تعادل بسیار بهتری میان هزینه، سرعت پاسخ‌دهی و کیفیت نهایی کد برقرار سازد.

گزارش تحقیقاتی گیت‌هاب عملکرد هایدرافیوژن را در آزمون‌های آفلاین با مدل مطرح Claude Opus 5 مقایسه کرده است. در تمام این آزمایش‌ها، سطح استدلال برای همه مدل‌ها روی حالت متوسط (Medium) تنظیم شده بود.

بنچمارک
هزینه
کیفیت
TerminalBench 2.1
۶۷ درصد کم‌تر
۴.۹ امتیاز بالا‌تر
DeepSWE
۳۶ درصد کم‌تر
۱.۵ امتیاز پایین‌تر
CheckpointBench
۶۵ درصد کم‌تر
۰.۱ امتیاز پایین‌تر

البته این آمار و ارقام مربوط به شرایط کنترل‌شده آزمایشگاهی، نسخه‌های خاص بنچمارک و قیمت‌گذاری فرضی گیت‌هاب است؛ طبیعتاً در پروژه‌های واقعی با توجه به حجم ریپازیتوری، پیچیدگی تسک‌ها و ابزار‌های مورد استفاده، نتایج می‌تواند متغیر باشد. هایدرافیوژن بیش‌ترین جهش کیفی خود را در بنچمارک TerminalBench 2.1 به ثبت رساند؛ در حالی که در بنچمارک DeepSWE (که خطایابی و اصلاح هم‌زمان در چند فایل پروژه را می‌سنجد)، با وجود کاهش ۳۶ درصدی هزینه‌ها، کیفیت خروجی کمی از Opus 5 پایین‌تر بود.

بهترین کارایی در تسک‌های مشخص و محدود

تنظیمات فعلی هایدرافیوژن بیش‌تر برای تسک‌های کدنویسی تک‌مرحله‌ای بهینه‌سازی شده است؛ یعنی تسک‌هایی که همه دستورات در یک پرامپت مشخص مطرح می‌شوند. گیت‌هاب اعلام کرده که پشتیبانی بهتر از مکالمات طولانی و رفت‌وبرگشتی را در برنامه‌های آینده خود دارد. بنابراین در حال حاضر، این قابلیت برای کار‌های مشخص و مستقلی مناسب است که زمینه شفافی دارند و صحت نتیجه آنها در یک چرخه مشخص قابل اعتبارسنجی است.

در طول اجرای فرآیند، پیش‌نویس‌های میانی پنهان می‌مانند. با اینکه نشانگرهای جدید پیشرفت مراحل جزئی‌تری را به کاربر نشان می‌دهند، اما برنامه‌نویسان برخلاف حالت‌های تک‌مدلی نمی‌توانند تک‌تک فراخوانی ابزار‌ها یا پیش‌نویس‌ها را زیر ذره‌بین بگذارند. همچنین فرآیندهای پیچیده‌ترِ پلکانی یا نقد و بررسی به دلیل فراخوانی چند مدل و اعتبارسنجی اضافه، ممکن است زمان بیشتری برای پاسخ‌دهی نیاز داشته باشند.

برنامه‌نویسانی که تا پیش از این عادت داشتند کار‌های سنگین را دستی از یک مدل ارزان به یک مدل قوی‌تر ببرند، حالا با HydraFusion می‌توانند این فرآیند را کاملاً خودکار کنند. این سیستم خودش بهترین جریان کاری را تعیین می‌کند، هزینه‌های مدل‌ها را ثبت می‌کند و در صورت لغو یا عدم تایید بازبینی، جلوی دستکاری ناقص و ناخواسته کدهای پروژه را می‌گیرد.

دیدگاه ها و گفتگوی تخصصی

نظرات خود را با جامعه مخاطبان وایر ای آی در میان بگذارید

۰ دیدگاه

هنوز دیدگاهی برای این مطلب ثبت نشده است

اولین نفری باشید که دیدگاه، تحلیل یا دیدگاه خود را درباره این موضوع با دیگران به اشتراک می گذارد.

مطالب مرتبط و پیشنهادی

خط قرمز کالیفرنیا برای کارفرماها: اخراج کارمندان با هوش مصنوعی رسماً ممنوع شد!
آخرین اخبار

خط قرمز کالیفرنیا برای کارفرماها: اخراج کارمندان با هوش مصنوعی رسماً ممنوع شد!

ایالت کالیفرنیا با تصویب یک بسته قانونی تازه، دست کارفرماها را در استفاده بی‌رویه از هوش مصنوعی بست و اخراج کارکنان صرفاً بر اساس تصمیم الگوریتم‌ها را ممنوع اعلام کرد. این قانون علاوه بر الزام به شفافیت در تعدیل‌های نیرو، استفاده از هوش مصنوعی برای نظارت تصویری در سرویس‌های بهداشتی محل کار را هم قدغن کرده است. فرماندار کالیفرنیا با دفاع از نیروی کار، ادعای امکان خودتنظیم‌گری شرکت‌های هوش مصنوعی را بی‌اساس خواند.

۲ دقیقه مطالعه
۰
۹ مهر
طوفان هوش مصنوعی در بازار حافظه؛ رکورد تاریخی درآمد ۵۴ میلیارد دلاری میکرون در یک فصل!
آخرین اخبار

طوفان هوش مصنوعی در بازار حافظه؛ رکورد تاریخی درآمد ۵۴ میلیارد دلاری میکرون در یک فصل!

عطش سیری‌ناپذیر غول‌های فناوری برای توسعه هوش مصنوعی، درآمد فصلی شرکت میکرون را با جهشی باورنکردنی به بیش از ۵۴ میلیارد دلار رساند تا وال‌استریت شگفت‌زده شود. این غول تراشه‌سازی با ثبت درآمد سالانه ۱۳۳ میلیارد دلاری رکورد تاریخ خود را شکست و حالا با تقاضای انفجاری برای حافظه‌های پیشرفته، چشم به آینده‌ای درخشان‌تر دوخته است.

۲ دقیقه مطالعه
۰
۹ مهر
خداحافظی گوگل با Opal؛ جمزها به «اسکیل‌های جمینای» برای تمام کاربران تبدیل می‌شوند!
آخرین اخبار

خداحافظی گوگل با Opal؛ جمزها به «اسکیل‌های جمینای» برای تمام کاربران تبدیل می‌شوند!

گوگل در اقدامی تازه برای یکپارچه‌سازی ابزار‌های هوش مصنوعی، سرویس Opal را بازنشسته کرده و دستیارهای اختصاصی جمز را به «اسکیل‌های جمینای» تبدیل می‌کند. این قابلیت که پیش از این در انحصار کاربران اشتراکی بود، حالا با پیروی از استاندارد مشترک ایجنت‌ها و به کمک دستورهای ساده اسلش، به رایگان در دسترس همه کاربران قرار می‌گیرد.

۴ دقیقه مطالعه
۰
۹ مهر