پرش به محتوای اصلی
آخرین اخبار
۲ وایر پاداش مطالعه

ایجنت متن‌باز اندرو لوین برای macOS؛ ۱۵۵ برابر ارزان‌تر از Claude Opus

انتشار:۳۱ شهریور ۱۴۰۵(۶ روز پیش)
۲ دقیقه زمان مطالعه
۰ دیدگاه

پروژه متن‌باز typesafe-computer-use یک ایجنت macOS است که هر مرحله از تصمیم‌گیری را تنها با هزینه ۰٫۰۰۰۲ دلار اجرا می‌کند.

ایجنت متن‌باز اندرو لوین برای macOS؛ ۱۵۵ برابر ارزان‌تر از Claude Opus

در یک نگاه (نکات کلیدی خبر)

خلاصه مهم‌ترین نکات و تحولات این گزارش برای مطالعه سریع

  • پروژه متن‌باز typesafe-computer-use یک ایجنت دسکتاپ است که هزینه هر تصمیم‌گیری را به ۰٫۰۰۰۲ دلار کاهش می‌دهد.
  • این ایجنت به جای ارسال مداوم اسکرین‌شات‌های سنگین، داده‌های صفحه را به صورت محلی استخراج کرده و به یک مدل تصمیم‌گیرنده کوچک‌تر می‌فرستد.
  • در مقایسه با مدل Claude Opus، این رویکرد تا ۱۵۵ برابر ارزان‌تر و بسیار سریع‌تر عمل می‌کند، هرچند برای کاربردهای تجاری نیازمند ارزیابی‌های جامع‌تری است.

یک ایجنت macOS بر پایه تصمیمات ۰٫۰۰۰۲ دلاری

بسیاری از ایجنت‌های دسکتاپ مبتنی بر مدل‌های پیشگام، برای هر اقدام یک اسکرین‌شات جدید را به یک مدل بزرگ ارسال می‌کنند و سپس چند ثانیه برای دریافت برنامه منتظر می‌مانند. پروژه متن‌باز اندرو لوین با نام typesafe-computer-use که تحت مجوز MIT منتشر شده است، وضعیت صفحه نمایش را به صورت محلی استخراج کرده و از یک مدل تصمیم‌گیرنده کوچک‌تر می‌خواهد تا از میان اقدامات محدودشده یکی را انتخاب کند. به گفته توسعه‌دهنده، نسخه اولیه این پروژه در کمتر از ۳۰ دقیقه ساخته شده است.

این ایجنت برای رسیدن به هدفی که با زبان ساده انگلیسی روی macOS تعریف شده، کار می‌کند و هزینه هر تصمیم‌گیری آن حدود ۰٫۰۰۰۲ دلار گزارش شده است. پیکسل‌های اسکرین‌شات روی دستگاه باقی می‌مانند. درخواست‌های ارسالی به مدل شامل متن استخراج‌شده (OCR)، فراداده‌های دسترسی‌پذیری، برنامه فعال، آدرس مرورگر و سایر وضعیت‌های ساختاریافته است. متن‌های آزاد تنها زمانی به یک مدل نویسنده مجزا ارسال می‌شوند که یک فیلد یا آدرس اینترنتی به آن نیاز داشته باشد.

  • پلتفرم: macOS 14 یا جدیدتر
  • مجوز: MIT
  • سرویس تصمیم‌گیری: TypeSafe API
  • نویسنده پیش‌فرض: Claude Haiku
  • تاخیر گزارش‌شده برای تصمیم‌گیری: ۰٫۱۳ تا ۰٫۳۸ ثانیه

یک اسکرین‌شات و اختلاف هزینه ۱۵۵ برابری

مخزن این پروژه، پیکربندی TypeSafe خود (با برچسب jev) را با مدل Claude Opus 5 روی یک اسکرین‌شات و هدف مشابه مقایسه می‌کند. مدل پایه Opus تنها یک اسکرین‌شات خام دریافت می‌کند.

معیار
مدل TypeSafe (jev)
مدل Claude Opus 5
تفاوت گزارش‌شده
هزینه هر تصمیم
۰٫۰۰۰۲ دلار
۰٫۰۳۲ دلار
۱۵۵ برابر ارزان‌تر
هزینه برای کار ۱۲ مرحله‌ای
۰٫۰۰۳ دلار
۰٫۴۰ تا ۰٫۹۰ دلار
۱۳۰ تا ۳۰۰ برابر ارزان‌تر
تاخیر مدل
۰٫۱۳ تا ۰٫۳۸ ثانیه
۵٫۲ ثانیه
۱۴ تا ۴۰ برابر سریع‌تر
زمان هر مرحله با ثبت تصویر و OCR
حدود ۱٫۵ ثانیه
حدود ۵٫۵ ثانیه
۳٫۷ برابر سریع‌تر

این ارقام از مخزن پروژه به دست آمده‌اند و به طور مستقل تایید نشده‌اند. داده‌های یادشده صرفاً یک مقایسه نقطه‌ای محدود را نشان می‌دهند و شامل نرخ تکمیل وظایف، آزمایش روی مجموعه گسترده‌ای از برنامه‌ها یا بنچمارک‌های بازیابی نمی‌شوند. فراخوانی‌های مدلِ نویسنده نیز تاخیر و هزینه خاص خود را به همراه دارند. برای ارزیابی در محیط عملیاتی، باید میزان موفقیت، تلاش‌های مجدد، استفاده از مدل نویسنده و خطاها در جریان‌های کاری مختلف اندازه‌گیری شود.

رابط TypeSafe که وابستگی اصلی این پروژه است، یک شیء Choice حاوی حداکثر ۲۵۵ گزینه را می‌پذیرد و توزیع احتمالی را با نمره اطمینان کالیبره‌شده برمی‌گرداند. بر اساس مستندات پروژه، پاسخ‌ها در کسری از ثانیه (چند صد میلی‌ثانیه) دریافت می‌شوند و هیچ هزینه توکن خروجی را در بر ندارند. بنابراین، این ایجنت متن‌باز به جای یک مدل تصمیم‌گیری قابل اجرا به صورت محلی، به استنتاج میزبانی‌شده وابسته است.

دیدگاه ها و گفتگوی تخصصی

نظرات خود را با جامعه مخاطبان وایر ای آی در میان بگذارید

۰ دیدگاه

هنوز دیدگاهی برای این مطلب ثبت نشده است

اولین نفری باشید که دیدگاه، تحلیل یا دیدگاه خود را درباره این موضوع با دیگران به اشتراک می گذارد.

مطالب مرتبط و پیشنهادی

رکورد ۸۳۳ هزار دانلود ماهانه برای LEGAL-BERT؛ وقتی توسعه‌دهنده‌ها قید مدل‌های گران‌قیمت را می‌زنند!
آخرین اخبار

رکورد ۸۳۳ هزار دانلود ماهانه برای LEGAL-BERT؛ وقتی توسعه‌دهنده‌ها قید مدل‌های گران‌قیمت را می‌زنند!

مدل زبانی تخصصی LEGAL-BERT با ثبت بیش از ۸۳۳ هزار دانلود در ماه روی پلتفرم هاگینگ فیس حسابی خبرساز شده است. این ابزار جمع‌وجور و تخصصی نشان می‌دهد که برای پردازش و تحلیل متون حقوقی، حتماً نیازی به مدل‌های غول‌پیکر و پرهزینه ندارید و گزینه‌های بهینه همچنان در اوج هستند.

۲ دقیقه مطالعه
۰
۶ مهر
جاسوسی هوش مصنوعی در محل کار؛ کارمندان می‌گویند کارفرماها باید قانوناً مچ‌گیری‌هایشان را لو بدهند!
آخرین اخبار

جاسوسی هوش مصنوعی در محل کار؛ کارمندان می‌گویند کارفرماها باید قانوناً مچ‌گیری‌هایشان را لو بدهند!

نظرسنجی‌های تازه نشان می‌دهد که بیشتر کارمندان حس می‌کنند مدیرانشان با ابزارهای هوش مصنوعی تمام حرکات آن‌ها را زیر نظر گرفته‌اند. حالا بیش از ۸۰ درصد شاغلان خواستار تصویب قانونی شده‌اند که شرکت‌ها را مجبور کند هرگونه مچ‌گیری و نظارت هوش مصنوعی در محیط کار را رسماً اعلام کنند.

۳ دقیقه مطالعه
۰
۶ مهر
گزارش داغ مایکروسافت از نفوذ جهانی هوش مصنوعی؛ امارات در صدر و رتبه عجیب آمریکا!
آخرین اخبار

گزارش داغ مایکروسافت از نفوذ جهانی هوش مصنوعی؛ امارات در صدر و رتبه عجیب آمریکا!

مایکروسافت در تازه‌ترین گزارش خود از ضریب نفوذ هوش مصنوعی در جهان پرده برداشت؛ آماری شگفت‌انگیز که نشان می‌دهد امارات و سنگاپور با فاصله‌ای خیره‌کننده پیشتاز دنیا هستند و در مقابل، آمریکا در رتبه ۲۱ جا مانده است. همچنین الگوی استفاده از هوش مصنوعی میان کشورهای غربی و کشورهای در حال توسعه، از تفاوتی عمیق میان کاربردهای روزمره و آموزش پرده برمی‌دارد.

۳ دقیقه مطالعه
۰
۶ مهر