پرش به محتوای اصلی
آخرین اخبار
۲ وایر پاداش مطالعه

اجرای محلی هوش مصنوعی بدون نیاز به GPU با مدل سبک JiRackUltra_1b

انتشار:۵ مهر ۱۴۰۵(۱ روز پیش)
۲ دقیقه زمان مطالعه
۰ دیدگاه

مدل زبانی جدید JiRackUltra_1b با ۱٫۵ میلیارد پارامتر و وزن‌های سه‌تایی، امکان اجرای استنتاج و مسیریابی هوش مصنوعی را بدون نیاز به کارت گرافیک روی پردازنده‌های معمولی فراهم می‌کند. این مدل با استقبال قابل‌توجه توسعه‌دهندگان، در آستانه ثبت یک میلیون بارگیری در پلتفرم Hugging Face قرار گرفته است.

اجرای محلی هوش مصنوعی بدون نیاز به GPU با مدل سبک JiRackUltra_1b

در یک نگاه (نکات کلیدی خبر)

خلاصه مهم‌ترین نکات و تحولات این گزارش برای مطالعه سریع

  • مدل سبک‌وزن JiRackUltra_1b با حدود ۱٫۵ میلیارد پارامتر، امکان اجرای استنتاج روی پردازنده‌های معمولی (CPU) را بدون نیاز به شتاب‌دهنده گرافیکی یا محیط CUDA فراهم می‌کند.
  • این مدل بر پایه معماری بهینه‌شده DeepSeek R1 و فناوری وزن‌های سه‌تایی BitNet ساخته شده و در قالب فایل‌های GGUF برای پردازش RAG، رباتیک و مسیریابی عرضه شده است.
  • استفاده از سازوکار Grouped-Query Attention و توکنایزر اختصاصی، مصرف رم و کش محاسباتی را حین اجرای محلی به حداقل می‌رساند.

هدف‌گذاری مدل JiRackUltra_1b برای مسیریابی محلی هوش مصنوعی بدون نیاز به GPU

بر اساس آخرین آمارها، شمار دریافت‌های مدل JiRackUltra_1b در Hugging Face به مرز یک میلیون بار نزدیک شده است. این مدل زبانی حدوداً ۱٫۵ میلیارد پارامتری، با هدف اجرای استنتاج مبتنی بر CPU برای اموری چون فراخوانی ابزارها (Tool Calling)، مسیریابی درخواست‌ها، تولید تقویت‌شده با بازیابی اطلاعات (RAG) و تحلیل دستورهای رباتیک توسعه یافته است.

شمارنده پلتفرم Hugging Face مجموع درخواست‌های دریافت فایل، شامل دانلودهای خودکار و نصب‌های مکرر را ثبت می‌کند و لزوماً نشان‌دهنده یک میلیون کاربر مستقل نیست؛ با این حال، نشان از استقبال چشمگیر جامعه توسعه‌دهندگان از مدلی دارد که برای اجرا روی زیرساخت‌های متداول CPU با حداقل منابع حافظه طراحی شده است.

مزیت عملیاتی این مدل برای توسعه‌دهندگان کاملاً روشن است: امکان اجرای استنتاج روی سرورهای کاربردی، دستگاه‌های لبه (Edge) یا لپ‌تاپ‌های شخصی بدون نیاز به ران‌تایم محاسباتی CUDA و سرورهای اختصاصی مجهز به GPU فراهم می‌شود. البته میزان صرفه‌جویی واقعی بسته به طول پرامپت، نرخ پردازش (Throughput)، اهداف تاخیر زمانی (Latency)، سخت‌افزار هدف و کرنل استنتاج مورداستفاده متغیر خواهد بود.

معماری فشرده و بهینه با الهام از ساختار Llama

بر اساس اطلاعات ثبت‌شده در مخزن پروژه، JiRackUltra_1b بر پایه نسخه‌ای بازطراحی‌شده از معماری DeepSeek R1 همراه با پشتیبانی ذاتی از وزن‌های سه‌تایی (Ternary به سبک BitNet) توسعه یافته است. مشخصات فنی رسمی منتشرشده از این معماری به شرح زیر است:

بخش
مشخصات فنی اعلام‌شده
تعداد پارامترها
حدود ۱٫۵ میلیارد
لایه‌های ترنسفورمر
۱۶
ابعاد پنهان (Hidden Dimension)
۲,۰۴۸
ابعاد میانی (Intermediate Dimension)
۸,۱۹۲
سازوکار توجه (Attention)
۳۲ هد پرس‌وجو (Query) و ۸ هد کلید-مقدار (Key-Value)
واژگان (Vocabulary)
۱۲۸,۲۵۶ توکن
فرمت عرضه
فایل‌های GGUF و کانتینرهای بسته‌بندی‌شده

بهره‌گیری از سازوکار «توجه کوئری گروهی» (Grouped-Query Attention) با اشتراک‌گذاری هشت هد کلید-مقدار میان ۳۲ هد پرس‌وجو، میزان حافظه اشغال‌شده در حافظه کش را حین استنتاج به میزان قابل‌توجهی کاهش می‌دهد. علاوه‌بر این، توکنایزر سفارشی JiRack شامل توکن‌های اختصاصی برای مسیریابی، فراخوانی ابزار و دستورهای رباتیک است؛ هرچند نرم‌افزارهای میزبان همچنان مسئولیت اعتبارسنجی آرگومان‌ها، مدیریت دسترسی ابزارها و کنترل خطاهای زمان اجرا را بر عهده دارند.

دیدگاه ها و گفتگوی تخصصی

نظرات خود را با جامعه مخاطبان وایر ای آی در میان بگذارید

۰ دیدگاه

هنوز دیدگاهی برای این مطلب ثبت نشده است

اولین نفری باشید که دیدگاه، تحلیل یا دیدگاه خود را درباره این موضوع با دیگران به اشتراک می گذارد.

مطالب مرتبط و پیشنهادی

رکورد ۸۳۳ هزار دانلود ماهانه برای LEGAL-BERT؛ وقتی توسعه‌دهنده‌ها قید مدل‌های گران‌قیمت را می‌زنند!
آخرین اخبار

رکورد ۸۳۳ هزار دانلود ماهانه برای LEGAL-BERT؛ وقتی توسعه‌دهنده‌ها قید مدل‌های گران‌قیمت را می‌زنند!

مدل زبانی تخصصی LEGAL-BERT با ثبت بیش از ۸۳۳ هزار دانلود در ماه روی پلتفرم هاگینگ فیس حسابی خبرساز شده است. این ابزار جمع‌وجور و تخصصی نشان می‌دهد که برای پردازش و تحلیل متون حقوقی، حتماً نیازی به مدل‌های غول‌پیکر و پرهزینه ندارید و گزینه‌های بهینه همچنان در اوج هستند.

۲ دقیقه مطالعه
۰
۶ مهر
جاسوسی هوش مصنوعی در محل کار؛ کارمندان می‌گویند کارفرماها باید قانوناً مچ‌گیری‌هایشان را لو بدهند!
آخرین اخبار

جاسوسی هوش مصنوعی در محل کار؛ کارمندان می‌گویند کارفرماها باید قانوناً مچ‌گیری‌هایشان را لو بدهند!

نظرسنجی‌های تازه نشان می‌دهد که بیشتر کارمندان حس می‌کنند مدیرانشان با ابزارهای هوش مصنوعی تمام حرکات آن‌ها را زیر نظر گرفته‌اند. حالا بیش از ۸۰ درصد شاغلان خواستار تصویب قانونی شده‌اند که شرکت‌ها را مجبور کند هرگونه مچ‌گیری و نظارت هوش مصنوعی در محیط کار را رسماً اعلام کنند.

۳ دقیقه مطالعه
۰
۶ مهر
گزارش داغ مایکروسافت از نفوذ جهانی هوش مصنوعی؛ امارات در صدر و رتبه عجیب آمریکا!
آخرین اخبار

گزارش داغ مایکروسافت از نفوذ جهانی هوش مصنوعی؛ امارات در صدر و رتبه عجیب آمریکا!

مایکروسافت در تازه‌ترین گزارش خود از ضریب نفوذ هوش مصنوعی در جهان پرده برداشت؛ آماری شگفت‌انگیز که نشان می‌دهد امارات و سنگاپور با فاصله‌ای خیره‌کننده پیشتاز دنیا هستند و در مقابل، آمریکا در رتبه ۲۱ جا مانده است. همچنین الگوی استفاده از هوش مصنوعی میان کشورهای غربی و کشورهای در حال توسعه، از تفاوتی عمیق میان کاربردهای روزمره و آموزش پرده برمی‌دارد.

۳ دقیقه مطالعه
۰
۶ مهر