پرش به محتوای اصلی
آخرین اخبار
۲ وایر پاداش مطالعه

موتور Splash شرکت Inco AI مدل Qwen3.8-27B را دو برابر سریع‌تر روی تراشه‌های Apple Silicon اجرا می‌کند

انتشار:۳۱ شهریور ۱۴۰۵(۵ روز پیش)
۲ دقیقه زمان مطالعه
۰ دیدگاه

شرکت Inco AI از موتور استنتاج متن‌باز Splash برای تراشه‌های Apple Silicon رونمایی کرد. این ابزار قادر است مدل زبانی Qwen3.8-27B را با سرعت ۷۴ توکن بر ثانیه روی تراشه M5 Pro اجرا کند که دو برابر سریع‌تر از ابزارهای مشابه است.

موتور Splash شرکت Inco AI مدل Qwen3.8-27B را دو برابر سریع‌تر روی تراشه‌های Apple Silicon اجرا می‌کند

در یک نگاه (نکات کلیدی خبر)

خلاصه مهم‌ترین نکات و تحولات این گزارش برای مطالعه سریع

  • معرفی موتور استنتاج متن‌باز Splash با لایسنس Apache-2.0 برای اجرای محلی و بهینه مدل‌های زبانی روی سیستم‌های Mac.
  • اجرای مدل Qwen3.8-27B با سرعت ۷۴ توکن بر ثانیه روی تراشه M5 Pro و با مصرف ۴۸ گیگابایت حافظه یکپارچه.
  • بهینه‌سازی اختصاصی برای ایجنت‌های کدنویسی از طریق کش‌سازی پیشوند و زمان‌بندی همزمان درخواست‌ها.

موتور Splash استنتاج محلی مدل‌های زبانی را برای Apple Silicon بهینه‌سازی می‌کند

شرکت Inco AI سرور متن‌باز Splash را با لایسنس Apache-2.0 منتشر کرده است. این ابزار به کاربران اجازه می‌دهد مدل‌های زبانی بزرگ و منتخب را به صورت محلی روی سیستم‌های Mac جدید اجرا کنند و از API-های آشنای HTTP بهره ببرند. هر مدل پشتیبانی‌شده با وزن‌های ۴ بیتی، یک مدل پیش‌نویس (draft model) سازگار، کرنل‌های Metal اختصاصی و یک برنامه حافظه ثابت ارائه می‌شود. در تست‌های انجام‌شده روی یک سیستم مجهز به تراشه M5 Pro با ۴۸ گیگابایت حافظه یکپارچه، مدل Qwen3.8-27B توانست برای پرامپت‌های کوتاه ۷۴ توکن بر ثانیه تولید کند. این رقم در مقایسه با سرعت ۳۸ توکن بر ثانیه در oMLX بسیار چشمگیر است و در پردازش چهار درخواست همزمان، به توان عملیاتی تقریباً چهار برابری نسبت به oMLX دست یافته است.

ایجنت‌های کدنویسی به طور مداوم تاریخچه‌های طولانی مکالمات را ارسال می‌کنند، از کانتکست‌های مخازن کد مجدداً استفاده می‌کنند و کارها را بین ساب-ایجنت‌ها تقسیم می‌کنند. موتور Splash با بهره‌گیری از قابلیت کش‌سازی پیشوند (prefix caching) و زمان‌بندی همزمان درخواست‌ها، دقیقاً این الگوها را هدف قرار داده و زمان مورد نیاز برای پردازش مجدد ورودی‌های مشترک را به شدت کاهش می‌دهد.

نصب سریع از Homebrew تا لوکال‌هاست

  • تراشه: Apple M3 یا جدیدتر
  • سیستم‌عامل: macOS 26.4 یا نسخه‌های بالاتر
  • حافظه: حداقل ۳۶ گیگابایت حافظه یکپارچه (۴۸ گیگابایت یا بیشتر توصیه می‌شود)
  • مدیریت بسته‌ها: Homebrew
brew install incoai/tap/splash
splash serve --model incoai/Qwen3.8-27B-Splash

با اولین اجرای دستور serve، بسته ۱۷.۴ گیگابایتی مدل دانلود شده و پس از اعتبارسنجی و بررسی حافظه در دسترس، سرور راه‌اندازی می‌شود. این سرویس به طور پیش‌فرض روی آدرس 127.0.0.1:8000 تنظیم می‌شود تا ارتباطات کاملاً روی ماشین محلی باقی بماند.

مسیر راه‌اندازی سریع به هیچ فایل پیکربندی نیاز ندارد. همچنین، کلاینت‌های کمکی این ابزار شامل مواردی نظیر splash opencode، splash claude، splash codex و splash hermes هستند.

پیشتازی در بنچمارک‌ها

شرکت Inco در ارزیابی‌های خود، موتور Splash را با ابزارهای oMLX، Lily، uzu و Ollama روی سیستم مشابه با تراشه M5 Pro و ۴۸ گیگابایت حافظه مقایسه کرده است. این تست با استفاده از پرامپت‌های کدنویسی ابزار بنچمارک SPEED-Bench شرکت NVIDIA انجام شده و خروجی تولیدی روی ۱۰۲۴ توکن محدود شده بود.

دیدگاه ها و گفتگوی تخصصی

نظرات خود را با جامعه مخاطبان وایر ای آی در میان بگذارید

۰ دیدگاه

هنوز دیدگاهی برای این مطلب ثبت نشده است

اولین نفری باشید که دیدگاه، تحلیل یا دیدگاه خود را درباره این موضوع با دیگران به اشتراک می گذارد.

مطالب مرتبط و پیشنهادی

رکورد ۸۳۳ هزار دانلود ماهانه برای LEGAL-BERT؛ وقتی توسعه‌دهنده‌ها قید مدل‌های گران‌قیمت را می‌زنند!
آخرین اخبار

رکورد ۸۳۳ هزار دانلود ماهانه برای LEGAL-BERT؛ وقتی توسعه‌دهنده‌ها قید مدل‌های گران‌قیمت را می‌زنند!

مدل زبانی تخصصی LEGAL-BERT با ثبت بیش از ۸۳۳ هزار دانلود در ماه روی پلتفرم هاگینگ فیس حسابی خبرساز شده است. این ابزار جمع‌وجور و تخصصی نشان می‌دهد که برای پردازش و تحلیل متون حقوقی، حتماً نیازی به مدل‌های غول‌پیکر و پرهزینه ندارید و گزینه‌های بهینه همچنان در اوج هستند.

۲ دقیقه مطالعه
۰
۶ مهر
جاسوسی هوش مصنوعی در محل کار؛ کارمندان می‌گویند کارفرماها باید قانوناً مچ‌گیری‌هایشان را لو بدهند!
آخرین اخبار

جاسوسی هوش مصنوعی در محل کار؛ کارمندان می‌گویند کارفرماها باید قانوناً مچ‌گیری‌هایشان را لو بدهند!

نظرسنجی‌های تازه نشان می‌دهد که بیشتر کارمندان حس می‌کنند مدیرانشان با ابزارهای هوش مصنوعی تمام حرکات آن‌ها را زیر نظر گرفته‌اند. حالا بیش از ۸۰ درصد شاغلان خواستار تصویب قانونی شده‌اند که شرکت‌ها را مجبور کند هرگونه مچ‌گیری و نظارت هوش مصنوعی در محیط کار را رسماً اعلام کنند.

۳ دقیقه مطالعه
۰
۶ مهر
گزارش داغ مایکروسافت از نفوذ جهانی هوش مصنوعی؛ امارات در صدر و رتبه عجیب آمریکا!
آخرین اخبار

گزارش داغ مایکروسافت از نفوذ جهانی هوش مصنوعی؛ امارات در صدر و رتبه عجیب آمریکا!

مایکروسافت در تازه‌ترین گزارش خود از ضریب نفوذ هوش مصنوعی در جهان پرده برداشت؛ آماری شگفت‌انگیز که نشان می‌دهد امارات و سنگاپور با فاصله‌ای خیره‌کننده پیشتاز دنیا هستند و در مقابل، آمریکا در رتبه ۲۱ جا مانده است. همچنین الگوی استفاده از هوش مصنوعی میان کشورهای غربی و کشورهای در حال توسعه، از تفاوتی عمیق میان کاربردهای روزمره و آموزش پرده برمی‌دارد.

۳ دقیقه مطالعه
۰
۶ مهر