پرش به محتوای اصلی
آخرین اخبار
۲ وایر پاداش مطالعه

معرفی ابزار متن‌باز AWS برای ایجنت‌های هوش مصنوعی؛ مصرف توکن کمتر نسبت به رقبا

انتشار:۳۱ شهریور ۱۴۰۵(۶ روز پیش)
۳ دقیقه زمان مطالعه
۰ دیدگاه

ابزار جدید AWS با نام Strands در بنچمارک‌ها عملکردی نزدیک به Claude Code و Codex ثبت کرده است، اگرچه این مقایسه صرفاً با ایجنت‌های کدنویسی انجام شده است.

معرفی ابزار متن‌باز AWS برای ایجنت‌های هوش مصنوعی؛ مصرف توکن کمتر نسبت به رقبا

در یک نگاه (نکات کلیدی خبر)

خلاصه مهم‌ترین نکات و تحولات این گزارش برای مطالعه سریع

  • شرکت AWS از یک ابزار متن‌باز جدید به نام Strands برای توسعه سریع و استقرار ایجنت‌های هوش مصنوعی رونمایی کرد.
  • بنا بر اعلام AWS، این ابزار در مقایسه با مدل‌های مبتنی بر Claude و GPT تا ۲۸ درصد توکن کمتری مصرف می‌کند.
  • این ابزار به صورت کتابخانه Python و TypeScript عرضه شده و از قابلیت‌های پیشرفته‌ای نظیر مدیریت زمینه و کش کردن پرامپت بهره می‌برد.

شرکت AWS با معرفی ابزار جدید خود، رسماً وارد رقابت توسعه ایجنت‌های هوش مصنوعی متن‌باز شد. این شرکت مدعی است که ابزار جدید موسوم به Strands، در بنچمارک‌ها عملکردی هم‌تراز با رقبا دارد و در عین حال حدود یک‌چهارم توکن کمتری مصرف می‌کند.

این ابزار بر پایه کیت توسعه نرم‌افزاری Strands شرکت AWS ساخته شده است، اما به صورت یک بسته آماده ارائه می‌شود که هم به‌صورت محلی (Local) و هم در تعامل با ارائه‌دهندگان مختلف مدل‌های هوش مصنوعی قابل اجرا است.

شرکت AWS در اطلاعیه خود اشاره کرده است: «لحظه‌ای که تصمیم به ساخت ایجنت اختصاصی خود می‌گیرید، مسیر دشواری پیش روی شماست و ترکیب درست ابزارهای پایه برای رسیدن به عملکردی بی‌نقص، چالش‌برانگیز خواهد بود.»

بنا بر اعلام این شرکت، با استفاده از این گزینه متن‌باز جدید، توسعه‌دهندگان تنها با یک خط کد در زبان‌های Python یا TypeScript می‌توانند آن را با مدل هوش مصنوعی دلخواه خود راه‌اندازی کنند.

علاوه بر طراحی ساده و آماده‌به‌کار، AWS مدعی است که ابزار Strands در آزمایش‌های انجام‌شده با فریم‌ورک Harbor، به «امتیازات بنچمارک تقریباً برابری» در مقایسه با Claude Code، Codex و سایر ابزارهای محبوب دست یافته است. این آزمایش‌ها روی گره‌های متعددی از سرورهای مجازی EC2 متعلق به خود AWS اجرا شده‌اند.

شرکت AWS ادعا می‌کند که Strands در ۶ تست بنچمارک مختلف، در مقایسه با مدل‌های Claude یا GPT تا ۲۸ درصد توکن کمتری مصرف کرده و در برخی موارد دقت بالاتری نسبت به سایر ابزارها داشته است. البته این شرکت اذعان کرده است که ابزار توسعه‌یافته توسط DeepSeek مصرف توکن بهینه‌تری دارد، اما بر اساس نتایج ارائه‌شده، دقت آن در تست‌های مشابه پایین‌تر بوده است.

دلیل اصلی این عملکرد مطلوب، تنظیمات پیش‌فرض ابزار Strands در زمینه کش کردن پرامپت (Prompt Caching) و مدیریت زمینه (Context Management) است. بر اساس پست معرفی این محصول، ابزار یادشده به‌طور پیش‌فرض نتایجی را که طول آن‌ها از ۱۵۰۰ توکن فراتر می‌رود، کوتاه می‌کند؛ همچنین در صورتی که پنجره زمینه (Context Window) به مرز ۸۵ درصد ظرفیت خود برسد، آن را به‌طور خودکار فشرده‌سازی کرده و در مواقع سرریز داده، برای بازیابی زمینه تلاش می‌کند.

با این حال، نکته قابل‌تأمل این است که AWS ابزار Strands را بیش از آنکه یک ایجنت کدنویسی بداند، به عنوان یک ایجنت همه‌منظوره (General-purpose Agent) توصیف می‌کند. با توجه به اینکه تمامی ابزارهای مورد مقایسه در بنچمارک‌های این شرکت (شامل Claude Code، Codex، oh-my-pi، OpenCode و DeepSeek) در دسته ایجنت‌های کدنویسی قرار می‌گیرند، جای سؤال است که ایجنت‌های همه‌منظوره دیگر در مقایسه با ابزار جدید Strands چه عملکردی از خود نشان خواهند داد.

شرکت Amazon قصد دارد در آینده مقاله‌ای از محققان خود منتشر کند که جزئیات بیشتری از بنچمارک‌ها را در بر می‌گیرد و معیارهای دقیق ارزیابی این سیستم را مشخص خواهد کرد.

در همین راستا، کاربرانی که علاقه‌مند به بررسی و استفاده از این ابزار متن‌باز، آماده و همه‌منظوره هستند، می‌توانند با دنبال کردن دستورالعمل‌های ارائه‌شده در پست معرفی محصول، آن را آزمایش کنند. این پروژه به عنوان یک کتابخانه Python یا TypeScript در دسترس است و رابط خط فرمان (CLI) نیز دارد. همچنین به همراه یک فایل اسکیل (Skill) عرضه می‌شود که ادغام آن با ابزارهای دلخواه کاربران را تسهیل می‌کند؛ قابلیت‌های مربوط به ابزارهای Shell، مدیریت فایل و وب از همان ابتدا در این سیستم گنجانده شده‌اند.

شرکت AWS درباره طراحی این ابزار تأکید کرده است: «ما بر این باوریم که نمونه‌سازی سریع با استفاده از ابزارهای جامع و کامل، به خلق ایجنت‌های کاربردی‌تر منجر خواهد شد.» این ابزار در حال حاضر در دسترس قرار دارد و گزینه جدیدی برای توسعه‌دهندگان محسوب می‌شود؛ هرچند که در حال حاضر بررسی‌های مستقل و بی‌طرفانه کمتری در خصوص ارزیابی عملکرد آن انجام گرفته است.

دیدگاه ها و گفتگوی تخصصی

نظرات خود را با جامعه مخاطبان وایر ای آی در میان بگذارید

۰ دیدگاه

هنوز دیدگاهی برای این مطلب ثبت نشده است

اولین نفری باشید که دیدگاه، تحلیل یا دیدگاه خود را درباره این موضوع با دیگران به اشتراک می گذارد.

مطالب مرتبط و پیشنهادی

رکورد ۸۳۳ هزار دانلود ماهانه برای LEGAL-BERT؛ وقتی توسعه‌دهنده‌ها قید مدل‌های گران‌قیمت را می‌زنند!
آخرین اخبار

رکورد ۸۳۳ هزار دانلود ماهانه برای LEGAL-BERT؛ وقتی توسعه‌دهنده‌ها قید مدل‌های گران‌قیمت را می‌زنند!

مدل زبانی تخصصی LEGAL-BERT با ثبت بیش از ۸۳۳ هزار دانلود در ماه روی پلتفرم هاگینگ فیس حسابی خبرساز شده است. این ابزار جمع‌وجور و تخصصی نشان می‌دهد که برای پردازش و تحلیل متون حقوقی، حتماً نیازی به مدل‌های غول‌پیکر و پرهزینه ندارید و گزینه‌های بهینه همچنان در اوج هستند.

۲ دقیقه مطالعه
۰
۶ مهر
جاسوسی هوش مصنوعی در محل کار؛ کارمندان می‌گویند کارفرماها باید قانوناً مچ‌گیری‌هایشان را لو بدهند!
آخرین اخبار

جاسوسی هوش مصنوعی در محل کار؛ کارمندان می‌گویند کارفرماها باید قانوناً مچ‌گیری‌هایشان را لو بدهند!

نظرسنجی‌های تازه نشان می‌دهد که بیشتر کارمندان حس می‌کنند مدیرانشان با ابزارهای هوش مصنوعی تمام حرکات آن‌ها را زیر نظر گرفته‌اند. حالا بیش از ۸۰ درصد شاغلان خواستار تصویب قانونی شده‌اند که شرکت‌ها را مجبور کند هرگونه مچ‌گیری و نظارت هوش مصنوعی در محیط کار را رسماً اعلام کنند.

۳ دقیقه مطالعه
۰
۶ مهر
گزارش داغ مایکروسافت از نفوذ جهانی هوش مصنوعی؛ امارات در صدر و رتبه عجیب آمریکا!
آخرین اخبار

گزارش داغ مایکروسافت از نفوذ جهانی هوش مصنوعی؛ امارات در صدر و رتبه عجیب آمریکا!

مایکروسافت در تازه‌ترین گزارش خود از ضریب نفوذ هوش مصنوعی در جهان پرده برداشت؛ آماری شگفت‌انگیز که نشان می‌دهد امارات و سنگاپور با فاصله‌ای خیره‌کننده پیشتاز دنیا هستند و در مقابل، آمریکا در رتبه ۲۱ جا مانده است. همچنین الگوی استفاده از هوش مصنوعی میان کشورهای غربی و کشورهای در حال توسعه، از تفاوتی عمیق میان کاربردهای روزمره و آموزش پرده برمی‌دارد.

۳ دقیقه مطالعه
۰
۶ مهر