ایجنت متنباز اندرو لوین برای macOS؛ ۱۵۵ برابر ارزانتر از Claude Opus
پروژه متنباز typesafe-computer-use یک ایجنت macOS است که هر مرحله از تصمیمگیری را تنها با هزینه ۰٫۰۰۰۲ دلار اجرا میکند.

در یک نگاه (نکات کلیدی خبر)
خلاصه مهمترین نکات و تحولات این گزارش برای مطالعه سریع
- پروژه متنباز typesafe-computer-use یک ایجنت دسکتاپ است که هزینه هر تصمیمگیری را به ۰٫۰۰۰۲ دلار کاهش میدهد.
- این ایجنت به جای ارسال مداوم اسکرینشاتهای سنگین، دادههای صفحه را به صورت محلی استخراج کرده و به یک مدل تصمیمگیرنده کوچکتر میفرستد.
- در مقایسه با مدل Claude Opus، این رویکرد تا ۱۵۵ برابر ارزانتر و بسیار سریعتر عمل میکند، هرچند برای کاربردهای تجاری نیازمند ارزیابیهای جامعتری است.
یک ایجنت macOS بر پایه تصمیمات ۰٫۰۰۰۲ دلاری
بسیاری از ایجنتهای دسکتاپ مبتنی بر مدلهای پیشگام، برای هر اقدام یک اسکرینشات جدید را به یک مدل بزرگ ارسال میکنند و سپس چند ثانیه برای دریافت برنامه منتظر میمانند. پروژه متنباز اندرو لوین با نام typesafe-computer-use که تحت مجوز MIT منتشر شده است، وضعیت صفحه نمایش را به صورت محلی استخراج کرده و از یک مدل تصمیمگیرنده کوچکتر میخواهد تا از میان اقدامات محدودشده یکی را انتخاب کند. به گفته توسعهدهنده، نسخه اولیه این پروژه در کمتر از ۳۰ دقیقه ساخته شده است.
این ایجنت برای رسیدن به هدفی که با زبان ساده انگلیسی روی macOS تعریف شده، کار میکند و هزینه هر تصمیمگیری آن حدود ۰٫۰۰۰۲ دلار گزارش شده است. پیکسلهای اسکرینشات روی دستگاه باقی میمانند. درخواستهای ارسالی به مدل شامل متن استخراجشده (OCR)، فرادادههای دسترسیپذیری، برنامه فعال، آدرس مرورگر و سایر وضعیتهای ساختاریافته است. متنهای آزاد تنها زمانی به یک مدل نویسنده مجزا ارسال میشوند که یک فیلد یا آدرس اینترنتی به آن نیاز داشته باشد.
- پلتفرم: macOS 14 یا جدیدتر
- مجوز: MIT
- سرویس تصمیمگیری: TypeSafe API
- نویسنده پیشفرض: Claude Haiku
- تاخیر گزارششده برای تصمیمگیری: ۰٫۱۳ تا ۰٫۳۸ ثانیه
یک اسکرینشات و اختلاف هزینه ۱۵۵ برابری
مخزن این پروژه، پیکربندی TypeSafe خود (با برچسب jev) را با مدل Claude Opus 5 روی یک اسکرینشات و هدف مشابه مقایسه میکند. مدل پایه Opus تنها یک اسکرینشات خام دریافت میکند.
معیار | مدل TypeSafe ( jev) | مدل Claude Opus 5 | تفاوت گزارششده |
|---|---|---|---|
هزینه هر تصمیم | ۰٫۰۰۰۲ دلار | ۰٫۰۳۲ دلار | ۱۵۵ برابر ارزانتر |
هزینه برای کار ۱۲ مرحلهای | ۰٫۰۰۳ دلار | ۰٫۴۰ تا ۰٫۹۰ دلار | ۱۳۰ تا ۳۰۰ برابر ارزانتر |
تاخیر مدل | ۰٫۱۳ تا ۰٫۳۸ ثانیه | ۵٫۲ ثانیه | ۱۴ تا ۴۰ برابر سریعتر |
زمان هر مرحله با ثبت تصویر و OCR | حدود ۱٫۵ ثانیه | حدود ۵٫۵ ثانیه | ۳٫۷ برابر سریعتر |
این ارقام از مخزن پروژه به دست آمدهاند و به طور مستقل تایید نشدهاند. دادههای یادشده صرفاً یک مقایسه نقطهای محدود را نشان میدهند و شامل نرخ تکمیل وظایف، آزمایش روی مجموعه گستردهای از برنامهها یا بنچمارکهای بازیابی نمیشوند. فراخوانیهای مدلِ نویسنده نیز تاخیر و هزینه خاص خود را به همراه دارند. برای ارزیابی در محیط عملیاتی، باید میزان موفقیت، تلاشهای مجدد، استفاده از مدل نویسنده و خطاها در جریانهای کاری مختلف اندازهگیری شود.
رابط TypeSafe که وابستگی اصلی این پروژه است، یک شیء Choice حاوی حداکثر ۲۵۵ گزینه را میپذیرد و توزیع احتمالی را با نمره اطمینان کالیبرهشده برمیگرداند. بر اساس مستندات پروژه، پاسخها در کسری از ثانیه (چند صد میلیثانیه) دریافت میشوند و هیچ هزینه توکن خروجی را در بر ندارند. بنابراین، این ایجنت متنباز به جای یک مدل تصمیمگیری قابل اجرا به صورت محلی، به استنتاج میزبانیشده وابسته است.
برچسب های مرتبط
مطالب مرتبط و پیشنهادی

رکورد ۸۳۳ هزار دانلود ماهانه برای LEGAL-BERT؛ وقتی توسعهدهندهها قید مدلهای گرانقیمت را میزنند!
مدل زبانی تخصصی LEGAL-BERT با ثبت بیش از ۸۳۳ هزار دانلود در ماه روی پلتفرم هاگینگ فیس حسابی خبرساز شده است. این ابزار جمعوجور و تخصصی نشان میدهد که برای پردازش و تحلیل متون حقوقی، حتماً نیازی به مدلهای غولپیکر و پرهزینه ندارید و گزینههای بهینه همچنان در اوج هستند.

جاسوسی هوش مصنوعی در محل کار؛ کارمندان میگویند کارفرماها باید قانوناً مچگیریهایشان را لو بدهند!
نظرسنجیهای تازه نشان میدهد که بیشتر کارمندان حس میکنند مدیرانشان با ابزارهای هوش مصنوعی تمام حرکات آنها را زیر نظر گرفتهاند. حالا بیش از ۸۰ درصد شاغلان خواستار تصویب قانونی شدهاند که شرکتها را مجبور کند هرگونه مچگیری و نظارت هوش مصنوعی در محیط کار را رسماً اعلام کنند.

گزارش داغ مایکروسافت از نفوذ جهانی هوش مصنوعی؛ امارات در صدر و رتبه عجیب آمریکا!
مایکروسافت در تازهترین گزارش خود از ضریب نفوذ هوش مصنوعی در جهان پرده برداشت؛ آماری شگفتانگیز که نشان میدهد امارات و سنگاپور با فاصلهای خیرهکننده پیشتاز دنیا هستند و در مقابل، آمریکا در رتبه ۲۱ جا مانده است. همچنین الگوی استفاده از هوش مصنوعی میان کشورهای غربی و کشورهای در حال توسعه، از تفاوتی عمیق میان کاربردهای روزمره و آموزش پرده برمیدارد.
دیدگاه ها و گفتگوی تخصصی
نظرات خود را با جامعه مخاطبان وایر ای آی در میان بگذارید
هنوز دیدگاهی برای این مطلب ثبت نشده است
اولین نفری باشید که دیدگاه، تحلیل یا دیدگاه خود را درباره این موضوع با دیگران به اشتراک می گذارد.