آرشیو کامل مطالب مرتبط با برچسب #Llama

یک نسخه بهینهسازیشده از مدل قدرتمند Llama 3.3 70B متا منتشر شده که به لطف کوانتیزاسیون ۴ بیتی AWQ، روی یک کارت گرافیک ۴۸ گیگابایتی جا میشود. این نسخه جدید حجم وزنهای مدل را از ۱۴۰ گیگابایت به زیر ۴۰ گیگابایت رسانده و اجرای محلی یکی از قویترین مدلهای زبانی متنباز دنیا را برای توسعهدهندگان بسیار سادهتر و کمهزینهتر کرده است.