پرش به محتوای اصلی
آخرین اخبار
۲ وایر پاداش مطالعه

پایان معمای هزینه‌های سرسام‌آور هوش مصنوعی؛ فکتوری مصرف ایجنت‌های کدنویسی را زیر ذره‌بین برد

انتشار:۱۱ مهر ۱۴۰۵(۱۱ ساعت پیش)
۴ دقیقه زمان مطالعه
۰ دیدگاه

استارتاپ فکتوری (Factory) با رونمایی از داشبورد تحلیلی بازطراحی‌شده برای ایجنت‌های کدنویسی Droids، امکان رصد موشکافانه مصرف اعتبارها را به تفکیک هر کاربر و مدل هوش مصنوعی فراهم کرد. این سیستم به تیم‌های فنی و مالی سازمان‌ها اجازه می‌دهد نقاط اوج مصرف، الگوهای پذیرش ابزار و کارآمدی مسیریابی خودکار مدل‌ها را با دقت بالا زیر نظر بگیرند. با این به‌روزرسانی، شرکت‌ها بالاخره می‌توانند سر از جزئیات قبض‌های هوش مصنوعی درآورند و بفهمند کدام برنامه‌نویسان یا اسکریپت‌های خودکار بیش‌ترین اعتبار را مصرف می‌کنند.

پایان معمای هزینه‌های سرسام‌آور هوش مصنوعی؛ فکتوری مصرف ایجنت‌های کدنویسی را زیر ذره‌بین برد

در یک نگاه (نکات کلیدی خبر)

خلاصه مهم‌ترین نکات و تحولات این گزارش برای مطالعه سریع

  • استارتاپ Factory داشبورد تحلیلی جدیدی برای ایجنت‌های مهندسی نرم‌افزار خود (Droids) معرفی کرده که میزان مصرف اعتبارها، مدل‌های استفاده‌شده و نرخ پذیرش تیمی را با جزئیات کامل نمایش می‌دهد.
  • این پلتفرم مدعی است سیستم مسیریاب هوشمندش (Router) توانسته با انتخاب خودکار بهترین مدل برای هر دستور، هزینه‌ها را تا ۶۳ درصد نسبت به مدل‌های پرچمدار کاهش دهد.
  • با توجه به اینکه تعداد کاربران (لایسنس‌ها) معیار دقیقی برای پیش‌بینی هزینه‌های هوش مصنوعی نیست، این سیستم به تیم‌های مهندسی و مالی کمک می‌کند مثل ابزار‌های مدیریت هزینه ابری (FinOps)، دقیقاً رد هزینه‌ها را تا سطح هر پروژه و دولوپر دنبال کنند.

استارتاپ فکتوری داشبورد تحلیلی جدیدی برای رصد ایجنت‌های کدنویسی معرفی کرد

استارتاپ فکتوری (Factory) از مجموعه ابزار تحلیلی بازطراحی‌شده خود برای درویدها (Droids)، ایجنت‌های هوش مصنوعی مهندسی نرم‌افزار این شرکت، رونمایی کرده است. این داشبورد جدید میزان مصرف اعتبارها را در جلسات مختلف یک سازمان به تفکیک هر مدل و هر کاربر مشخص می‌کند و در کنار آن، گزارش‌های کاملی درباره نرخ پذیرش تیمی، حجم کاری و میزان صرفه‌جویی حاصل از مسیریابی خودکار مدل‌ها ارائه می‌دهد.

  • دسترس‌پذیری: هم‌اکنون برای مشتریان پلن‌های تجاری (Business) و سازمانی (Enterprise) فعال است.
  • دسترسی: مالکان و مدیران ارشد می‌توانند از منوی پروفایل کاربری خود به بخش آنالیتیکس دسترسی داشته باشند.
  • پوشش آماری: ردیابی دقیق اعتبارها، ترکیب مدل‌ها، کاربران، نشست‌ها، پیام‌ها، فراخوانی ابزار‌ها (Tool Calls) و معیارهای کاربران فعال.
  • یکپارچه‌سازی: دسترسی مستقیم از طریق داشبورد اختصاصی و ارائه یک API کاربردی برای دریافت گزارش‌های سازمانی در سیستم‌های خارجی.

در دنیای واقعی کدنویسی با هوش مصنوعی، یک جلسه کاری ساده با یک ایجنت ممکن است ده‌ها درخواست به مدل، فراخوانی ابزار و تلاش مجدد (Retry) ایجاد کند؛ به همین خاطر، گزارش کلی هزینه‌های آخر ماه سازمان عملاً هیچ سرنخی از دلایل جهش ناگهانی هزینه‌ها به مدیران نمی‌دهد. اما تفکیک مصرف بر اساس کاربران و مدل‌ها به تیم‌های مهندسی و مالی کمک می‌کند هزینه‌ها را به پروژه‌ها و بارهای کاری واقعی متصل کنند، رفتارهای غیرعادی را موشکافی نمایند و با داده‌هایی شفاف و اتکاپذیر، استراتژی گسترش استفاده از هوش مصنوعی را در شرکت پیاده کنند.

ردگیری دقیق اعتبارها؛ تا سطح هر کاربر و مدل

پلتفرم فکتوری میزان مصرف را در قالب «اعتبار» (Credit) نشان می‌دهد؛ در نمودار مصرف بر حسب زمان (Usage Over Time)، میزان مصرف کل از سهم تک‌تک مدل‌ها تفکیک شده است. همچنین نمودار ترکیب مدل‌ها (Model Mix) سهم اختصاص‌یافته به هر مدل را روی صفحه می‌آورد و گزارش‌های سطح کاربر دقیقاً مشخص می‌کنند چه کسی کار را استارت زده است. البته تبدیل این اعتبارها به مبالغ نهایی صورت‌حساب مالی، به شرایط قرارداد و تعرفه توافقی هر مشتری بستگی دارد.

نمای مصرف در داشبورد تحلیلی فکتوری که میزان مصرف اعتبار را بر حسب زمان و ترکیب مدل‌ها نشان می‌دهد
بخش سنجش مصرف (Consumption)، سهم هر مدل و کاربر را از اعتبارها با جزئیات کامل تفکیک می‌کند.

نمودار تمرکز هزینه (Cost Concentration) روند مصرف تجمعی را در کل سازمان ترسیم می‌کند. فکتوری در یادداشت‌های انتشار خود توضیح داده که در بسیاری از استقرارها، بخش اعظم مصرف معمولاً زیر سر گروه کوچکی از کاربران حرفه‌ای و فرآیندهای خودکارسازی است. این نمودار می‌تواند به‌سرعت نشان دهد که آیا پای یک تسک سنگین اما برنامه‌ریزی‌شده در میان است، یا اینکه یک اسکریپت خودکار بیش از حد انتظار اعتبارها را بلعیده است.

واقعیت ادعای صرفه‌جویی ۶۳ درصدی مسیریاب فکتوری چیست؟

ابزار مسیریاب فکتوری (Factory Router) برای هر درخواست ارسالی، به‌صورت خودکار مناسب‌ترین مدل را انتخاب می‌کند؛ با این قابلیت، توسعه‌دهندگان دیگر مجبور نیستند هر بار میان قیمت و عملکرد مدل‌ها دست به انتخاب بزنند. بخش آنالیتیکس تخمین می‌زند اگر سازمان تمام درخواست‌ها را با تعرفه مدل‌های پرچمدار و گران‌قیمت اجرا می‌کرد چقدر باید هزینه می‌پرداخت و با این مقایسه، میزان صرفه‌جویی حاصل از مسیریابی را شفاف می‌کند.

فکتوری مدعی است که این مسیریاب، هزینه‌های کلی محیط پروداکشن را در مقایسه با نرخ مدل‌های پیشرو تا ۶۳ درصد کاهش می‌دهد، آن هم در حالی که طبق ارزیابی‌های داخلی شرکت عملکرد سطح پرچمدار را حفظ می‌کند. با این حال، در گزارش عمومی منتشرشده جزئیاتی از چارچوب تست‌ها، نحوه توزیع مدل‌ها، بازه ترافیک مورد بررسی، ارائه‌دهندگان مبنا و مفروضات قیمت‌گذاری ذکر نشده است. طبیعتاً سود و صرفه‌جویی واقعی هر مجموعه به ترکیب درخواست‌ها، قیمت لحظه‌ای مدل‌ها و سیاست‌های مسیریابی وابسته خواهد بود.

کنترل‌های سازمانی (Enterprise Controls) با در اختیار گذاشتن سیاست‌ها و مدل‌های پیش‌فرض متمرکز برای مدیران، مکمل عملکرد مسیریاب هستند. این تنظیمات از انتخاب‌های پراکنده و متناقض مدل‌ها جلوگیری می‌کند و گزارش‌های جدید هم نشان می‌دهند اجرای این سیاست‌ها دقیقاً چه اثری روی مصرف گذاشته است.

پیوند سنجش پذیرش با میزان مصرف ابزار

بخش «پذیرش» (Adoption) در این داشبورد ارزیابی می‌کند که آیا تیم‌ها به‌صورت مستمر از ایجنت‌های دروید استفاده می‌کنند و چه حجمی از کار‌ها به دوش این ابزار‌ها سپرده شده است. ترکیب این نما با داده‌های مصرف، زاویه‌دیدهای کاربردی گوناگونی را به مدیران بودجه ارائه می‌دهد:

شاخص
معیارهای اندازه‌گیری
تصمیم مدیریتی قابل اتخاذ
ضریب نفوذ (Reach)
کاربران فعال روزانه، هفتگی و ماهانه
آیا ایجاد دسترسی واقعاً به استفاده عملی از ابزار تبدیل شده است؟
حجم کاری (Workload)
تعداد نشست‌ها، پیام‌ها و فراخوانی ابزار‌ها
تیم‌های نرم‌افزاری با چه شدتی از ایجنت‌ها کار می‌کشند؟
ماندگاری (Retention)
میزان چسبندگی و تکرار استفاده
آیا توسعه‌دهندگان پس از آزمون‌های اولیه، دوباره به استفاده از ابزار برمی‌گردند؟
تخصیص هزینه (Cost allocation)
اعتبارهای مصرفی به تفکیک کاربر و مدل
کدام افراد و انتخاب کدام مدل‌ها پیشران اصلی مصرف اعتبارها هستند؟
نمای پذیرش در داشبورد تحلیلی فکتوری که کاربران فعال، نشست‌ها، پیام‌ها و فراخوانی ابزارها را نمایش می‌دهد
بخش سنجش پذیرش (Adoption)، تناوب استفاده و حجم کاری سپرده‌شده به ایجنت‌ها را رصد می‌کند.

البته سنجش دقیق بهره‌وری همچنان به شاخص‌های خروجی مستقلی مثل تغییرات پذیرفته‌شده، مدت‌زمان چرخه بررسی پول‌ریکوئست‌ها (PR)، بازنویسی‌ها و رخدادهای پروداکشن نیاز دارد. با این وجود، معیارهای فکتوری پایه‌های تحلیل پذیرش و تخصیص هزینه را تثبیت کرده و داده‌های عملیاتی مورد نیاز برای مقایسه این خروجی‌ها با میزان استفاده از ایجنت‌ها را مهیا می‌سازد.

رابط برنامه‌نویسی Analytics API نیز داده‌های جزئی مصرف در سطح کاربر و مدل را برای سیستم‌های مالی و هوش تجاری (BI) سازمان‌ها مهیا می‌کند. علاوه بر این، در هر کارت داشبورد راهنمایی (Tooltip) تعبیه شده که نحوه محاسبه هر فرمول را شرح می‌دهد تا تیم‌ها هنگام تطبیق گزارش‌های مختلف دچار اختلاف نشوند.

فشار سازمان‌های بزرگ؛ پشت‌پرده این به‌روزرسانی مهم

بر اساس پروفایل رسمی شرکت، استارتاپ فکتوری در سال ۲۰۲۳ توسط متان گرینبرگ (Matan Grinberg) و اینو ریس (Eno Reyes) تأسیس شد. این شرکت در دور سوم جذب سرمایه (Series C) خود به رهبری Khosla Ventures توانست ۱۵۰ میلیون دلار سرمایه تازه با ارزش‌گذاری ۱.۵ میلیارد دلاری جذب کند. طبق این مشخصات، غول‌های نام‌آشنایی نظیر انویدیا (NVIDIA)، ادوبی (Adobe)، ارنست اند یانگ (EY)، پالو آلتو نتورکس و Adyen به‌صورت روزمره از ایجنت‌های دروید استفاده می‌کنند.

در پردازش کار‌های ایجنت‌محور، هزینه‌ها مستقیماً به ریکوئست‌ها، انتخاب مدل، استفاده از ابزار و تلاش‌های مجدد گره خورده است؛ بنابراین نگاه سنتی بر اساس تعداد کاربر یا لایسنس (Seat Count) دیگر به هیچ وجه معیار مناسبی برای برآورد مخارج نیست. تفکیک مصرف تا سطح کاربر و مدل، لایه تخصیص هزینه‌ای شبیه به مدل‌های مدیریت مالی ابری (FinOps) را به برنامه‌های کدنویسی هوش مصنوعی اضافه می‌کند؛ هم‌زمان، داده‌های پذیرش نشان می‌دهند آیا این سرمایه‌گذاری به دست تیم‌های درست رسیده یا خیر. با همه این‌ها، برای ارزیابی جامع بازگشت سرمایه (ROI) همچنان باید در کنار داده‌های تله‌متری فکتوری، قیمت‌گذاری قراردادها و خروجی‌های واقعی تحویل نرم‌افزار را هم لحاظ کرد.

دیدگاه ها و گفتگوی تخصصی

نظرات خود را با جامعه مخاطبان وایر ای آی در میان بگذارید

۰ دیدگاه

هنوز دیدگاهی برای این مطلب ثبت نشده است

اولین نفری باشید که دیدگاه، تحلیل یا دیدگاه خود را درباره این موضوع با دیگران به اشتراک می گذارد.

مطالب مرتبط و پیشنهادی

شتاب خیره‌کننده مدل زبانی MiniCPM5 با دستیار ۳۲۴ میلیونی DSpark؛ جهش چشمگیر در تولید موازی توکن‌ها
آخرین اخبار

شتاب خیره‌کننده مدل زبانی MiniCPM5 با دستیار ۳۲۴ میلیونی DSpark؛ جهش چشمگیر در تولید موازی توکن‌ها

تیم OpenBMB با انتشار مدل کم‌حجم ۳۲۴ میلیون پارامتری DSpark، جهش بزرگی در سرعت استنتاج مدل زبانی MiniCPM5-2B ایجاد کرده است. این مدل با تکیه بر تکنیک هوشمندانه رمزگشایی گمانه‌زنانه، توکن‌ها را به صورت دسته‌ای حدس می‌زند تا فرایند پردازش با کم‌ترین مصرف محاسباتی و بیش‌ترین سرعت ممکن اجرا شود.

۲ دقیقه مطالعه
۰
۱۱ مهر
پیودی‌پای: موقع ساخت هوش مصنوعی اختصاصی‌ام، OpenAI دو بار اکانتم را بست!
آخرین اخبار

پیودی‌پای: موقع ساخت هوش مصنوعی اختصاصی‌ام، OpenAI دو بار اکانتم را بست!

فلیکس شلبرگ یا همان پیودی‌پای معروف، به‌تازگی مدل هوش مصنوعی محلی خود به نام Ajax را معرفی کرده، اما فاش ساخته که در مسیر توسعه آن، شرکت OpenAI دو بار حسابش را مسدود کرده است. او برای ساخت این مدل ۹ میلیارد پارامتری از تکنیک تقطیر استفاده کرده؛ موضوعی که زنگ خطر نقض قوانین سازنده ChatGPT را به صدا درآورده است.

۳ دقیقه مطالعه
۰
۱۱ مهر
طعنه سنگین سم آلتمن به آنتروپیک: نسبت دادن روح و دین به هوش مصنوعی خطرناکه!
آخرین اخبار

طعنه سنگین سم آلتمن به آنتروپیک: نسبت دادن روح و دین به هوش مصنوعی خطرناکه!

سم آلتمن، مدیرعامل اوپن‌ای‌آی، در اظهارنظری جنجالی به رویکرد شرکت رقیب یعنی آنتروپیک تاخت و نسبت دادن مفاهیم مذهبی و خودآگاهی به مدل‌های هوش مصنوعی را یک تهدید امنیتی واقعی دانست. این اختلاف‌نظر تازه پس از آن بالا گرفت که گزارش‌هایی از گفت‌وگوهای آنتروپیک با رهبران دینی برای تزریق اخلاق به مدل‌ها منتشر شد. حالا دانشمندان ارشد هوش مصنوعی و حتی واتیکان هم به این مناقشه فلسفی کشیده شده‌اند و درباره خطرات چنین رویکردی هشدار می‌دهند.

۲ دقیقه مطالعه
۰
۱۱ مهر