مدل محلی Humanizer: بازنویسی متنهای هوش مصنوعی با لحن کاملاً انسانی و عبور از سد دتکتورها
مدل متنباز و ۱۲ میلیارد پارامتری Humanizer که بر پایه مدل گما ۴ گوگل (Gemma 4) توسعه یافته، متنهای تولیدشده توسط هوش مصنوعی را با لحنی کاملاً طبیعی و انسانی بازنویسی میکند. این ابزار با حفظ دقیق دادهها، نامها و اعداد، متون را طوری دگرگون میکند که ابزارهای تشخیص هوش مصنوعی را به سادگی به اشتباه میاندازد. امکان اجرای کاملاً محلی و آفلاین این مدل، امنیت و حریم خصوصی پیشنویسهای حساس کاری را تضمین میکند.

در یک نگاه (نکات کلیدی خبر)
خلاصه مهمترین نکات و تحولات این گزارش برای مطالعه سریع
- مدل ۱۲ میلیارد پارامتری Humanizer که بر پایه Gemma 4 گوگل توسعه پیدا کرده، ترند هاگینگ فیس شده و انواع ایمیلها، مقالهها و گزارشهای هوش مصنوعی رو به زبان انگلیسی و چینی با لحن کاملاً انسانی بازنویسی میکنه.
- توی ارزیابیهای منتشرشده، دتکتورهای هوش مصنوعی از ۲۱۰ متن فقط موفق به شناسایی ۱۱ مورد شدن؛ نکته مهمتر اینکه مدل تمام اعداد، تاریخها و فکتها رو بدون دستکاری و توهم حفظ میکنه.
- این پروژه نسخههای کوانتیزهشده سبکی برای سیستمهایی با رم ۸ تا ۳۲ گیگابایت منتشر کرده و به کمک نرمافزار دسکتاپ و ابزار خط فرمان، کاملاً آفلاین و امن روی سیستم شخصی اجرا میشه.
اصلاح لحن یکنواخت مدلهای زبانی با مدل محلی ۱۲ میلیاردی Humanizer
مدل Humanizer، یک مدل جدید متنباز با وزنهای قابل دانلود است که حسابی در صدر فهرست مدلهای ترند هاگینگ فیس (Hugging Face) گل کرده است. این مدل ۱۲ میلیارد پارامتری، متن انواع ایمیلها، مقالهها، گزارشها، پستهای تالارهای گفتگو و سایر پیشنویسهای تولیدشده توسط هوش مصنوعی را به دو زبان انگلیسی و چینی بازنویسی میکند. هدف اصلی در فرایند آموزش این مدل، رسیدن به بیانی روان و طبیعی بوده؛ به شکلی که تمام اعداد، واحدها، تاریخها، نامها و نقلقولها دستنخورده باقی میمانند و هیچ اطلاعات بیپایه و جدیدی به متن اضافه نمیشود.
امکان دانلود مستقیم وزنها به توسعهدهندگان اجازه میدهد پیشنویسهای حساس را کاملاً آفلاین و روی سیستم شخصی خود پردازش کنند و قابلیت بازنویسی را به پایپلاینهای موجود بیفزایند. نکته جالب اینجاست که در چرخه آموزش این مدل از هیچ ابزار تشخیص هوش مصنوعی به عنوان سیگنال پاداش استفاده نشده است. ابزار Originality.ai صرفاً در ارزیابی نهایی منتشرشده به کار رفته، در حالی که پاداشهای آموزشی روی وفاداری کامل به فکتها و پرهیز از کپیبرداری عینی از متن مرجع متمرکز بودهاند.
وزنهای مدل متناسب با چهار سطح سختافزاری
این پروژه در واقع یک نسخه فاینتیونشده از مدل Gemma 4 12B گوگل است که تحت مجوز متنباز Apache 2.0 در دسترس قرار دارد. فرمتهای کوانتیزهشده GGUF از ابزار llama.cpp پشتیبانی میکنند، فایلهای safetensors برای کتابخانههای Transformers و vLLM آماده شدهاند و یک مسیر اختصاصی با فریمورک MLX هم پردازندههای سری اپل سیلیکون (Apple Silicon) را هدف گرفته است. تکنیک کوانتیزهسازی با کاهش دقت محاسبات عددی، میزان مصرف رم و حافظه ذخیرهسازی را به شکل چشمگیری پایین میآورد.
نسخه | حجم تقریبی | سیستم پیشنهادی پروژه |
|---|---|---|
humanizer-12b-Q8_0.gguf | ۱۲.۷ گیگابایت | سیستمهای دارای حداقل ۳۲ گیگابایت رم |
humanizer-12b-Q6_K.gguf | ۱۰ گیگابایت | سیستمهای دارای ۱۶ گیگابایت رم |
humanizer-12b-Q4_K_M.gguf | ۷.۶ گیگابایت | سیستمهای دارای محدودیت رم یا فضای ذخیرهسازی |
lite/ | نسخه پیشین E4B | سیستمهای دارای ۸ گیگابایت رم |
تیم توسعهدهنده علاوه بر خود مدل، یک اپلیکیشن دسکتاپ برای سیستمعاملهای مکاواس و ویندوز آماده کرده است. ابزار خط فرمان اختصاصی پروژه به نام hz نیز فایلهای با فرمت .md، .txt و .docx را پردازش میکند و ساختار تیترها، بلوکهای کد، جدولها و لینکها را کاملاً حفظ مینماید. این ابزار برای اسناد طولانی، متن را از مرز پاراگرافها تفکیک میکند و در صورتی که تشخیص دهد عددی حین بازنویسی حذف شده، آن بخش را دوباره بازنویسی و اصلاح میکند.
برچسب های مرتبط
مطالب مرتبط و پیشنهادی

مدل قدرتمند GLM-5.3 به آمازون بدراک آمد؛ هیولای ۱ میلیون توکنی Z.ai برای کدنویسی و ایجنتها
آمازون وب سرویسز (AWS) رسماً مدل پرچمدار GLM-5.3 توسعهیافته توسط شرکت Z.ai را به پلتفرم ابری بدراک اضافه کرد. این مدل وزنباز با پشتیبانی از پنجره زمینه خارقالعاده ۱ میلیون توکنی و بهینهسازی ویژه برای وظایف مهندسی نرمافزار، انتخابی ایدهآل برای توسعه ایجنتهای خودکار و ریفکتور کدهای حجیم به شمار میرود.

میلیارد دلار، پول خرد تازه سیلیکونولی؛ پشت پرده ارزشگذاریهای نجومی استارتاپهای هوش مصنوعی
در سیلیکونولی ارزشگذاریهای میلیاردی برای استارتاپهای هوش مصنوعی به یک اتفاق عادی و روزمره تبدیل شده است؛ گویی یک میلیارد دلار حکم پول خرد جدید را دارد. اما آیا این ارقام نجومی که خیلی وقتها پیش از عرضه اولین محصول ثبت میشوند، پشتوانه واقعی دارند یا صرفاً قماری بزرگ روی آینده هستند؟

چتهای ChatGPT شما باارزشتر از چیزیه که فکر میکنید؛ راهنمای کامل بکاپگیری از گفتگوها
فرقی نمیکنه کاربر روزمره ChatGPT باشید یا گهگاه سراغش برید؛ تاریخچه چتهای شما پر از ایدهها و اسناد باارزشه که نباید فقط به سرورهای اوپنایآی متکی باشن. توی این راهنمای کاربردی یاد میگیرید که چطور به سادگی از تمام گفتگوهای خود فایل پشتیبان بگیرید و اون رو در جایی امن ذخیره کنید.
دیدگاه ها و گفتگوی تخصصی
نظرات خود را با جامعه مخاطبان وایر ای آی در میان بگذارید
هنوز دیدگاهی برای این مطلب ثبت نشده است
اولین نفری باشید که دیدگاه، تحلیل یا دیدگاه خود را درباره این موضوع با دیگران به اشتراک می گذارد.