پرش به محتوای اصلی
آخرین اخبار
۲ وایر پاداش مطالعه

تکیه‌کلام‌هایی که دست هوش مصنوعی را رو می‌کنند؛ افشای تیک‌های نگارشی Opus 5.5 و مدل‌های پیشرو

انتشار:۹ مهر ۱۴۰۵(۱ ساعت پیش)
۴ دقیقه زمان مطالعه
۰ دیدگاه

پژوهش جدید شرکت گرافیت نشان می‌دهد مدل‌های هوش مصنوعی با وجود پیشرفت چشمگیر، هنوز تکیه‌کلام‌ها و ساختارهای نگارشی تکراری دارند که دستشان را رو می‌کند. از علاقه افراطی مدل Opus 5.5 به تکرار عبارت «این موضوع اهمیت دارد» تا ترفندهای مدل‌های OpenAI، هر نسخه با الگوهای منحصربه‌فردی نوشته‌های ماشینی را لو می‌دهد.

تکیه‌کلام‌هایی که دست هوش مصنوعی را رو می‌کنند؛ افشای تیک‌های نگارشی Opus 5.5 و مدل‌های پیشرو

در یک نگاه (نکات کلیدی خبر)

خلاصه مهم‌ترین نکات و تحولات این گزارش برای مطالعه سریع

  • پژوهشگران با بررسی بیش از ۱۰ هزار مقاله دریافتند که مدل‌های هوش مصنوعی هنوز از ۱۳ هزار عبارت خاص حداقل دو برابر بیش‌تر از انسان‌ها استفاده می‌کنند و دستشان رو می‌شود.
  • مدل Opus 5.5 علاقه عجیبی به عبارت «این موضوع اهمیت دارد» و واژه «قابل اعتماد» دارد، در حالی که مدل Astra از OpenAI ترجیح می‌دهد با عباراتی مثل «بُعدی دیگر» از قطعیت کلام فرار کند.
  • اگرچه شرکت‌ها توانسته‌اند نشانه‌های تابلوی قدیمی مانند کاربرد افراطی خط‌تیره را مهار کنند، اما کارشناسان معتقدند با هر نسخه جدید، تکیه‌کلام‌های پیش‌بینی‌نشده تازه‌ای ظهور می‌کنند.

حالا که متن‌های تولیدشده توسط مدل‌های زبانی بزرگ همه اینترنت را پر کرده‌اند، همه ما دنبال راه‌هایی هستیم تا مچ هوش مصنوعی را بگیریم و بفهمیم متن کار انسان است یا ماشین. اگرچه نشانه‌های تابلوی قدیمی مثل استفاده افراطی از خط‌تیره یا کلمه کلیشه‌ای «delve» دیگر کمرنگ شده‌اند، اما پژوهشگران می‌گویند مدل‌های هوش مصنوعی هنوز هم پر از تکیه‌کلام‌ها و عادت‌های نگارشی خاصی هستند که موقع نوشتن دستشان را رو می‌کند.

مطالعه جدیدی از شرکت تحقیقاتی گرافیت (Graphite) به بررسی دقیق عادت‌های نگارشی مدل‌های پیشرو پرداخته و کلمات و عبارت‌های محبوب هر مدل را زیر ذره‌بین برده است. با اینکه ردپاهای قدیمی مانند خط‌تیره حذف شده‌اند، مدل‌ها هنوز به ساختارهای پر از تضاد تکیه می‌کنند و هر نسخه از آن‌ها رفتارهای عجیب‌وغریب و منحصربه‌فرد خودش را دارد. نکته غافلگیرکننده، گستردگی شگفت‌انگیز این تکیه‌کلام‌هاست؛ گرافیت بیش از ۱۳ هزار عبارت پیدا کرده که در محتوای هوش مصنوعی حداقل دو برابر بیش‌تر از متون انسانی تکرار می‌شوند؛ معیاری که محققان آن را به عنوان «نشانه لو‌دهنده» هوش مصنوعی تعریف کرده‌اند.

گرگ دراک (مدیر ارشد هوش مصنوعی در شرکت گرافیت) در این باره می‌گوید: «شواهد نشان می‌دهد مدل‌های Claude به مرور زمان دارند به الگوی کلمات انسانی نزدیک‌تر می‌شوند، در حالی که مدل‌های GPT برعکس رفتار کرده و روزبه‌روز دارند از لحن طبیعی انسان فاصله می‌گیرند.»

بررسی نگارش هوش مصنوعی در این مقیاس نیازمند آزمایشی بسیار حساب‌شده بود. گرافیت کار را با گردآوری ۱۰ هزار مقاله منتشرشده پیش از ظهور ChatGPT به عنوان گروه معیار انسانی آغاز کرد. سپس پژوهشگران از مدل‌های مختلف هوش مصنوعی خواستند تا مقاله‌ها را بر اساس خلاصه آن‌ها بازنویسی کنند تا هرگونه اثرپذیری از لحن متن اصلی از بین برود. در نهایت، با مقایسه نمونه‌های هم‌تراز انسانی و ماشینی، توانستند بسامد تکرار واژه‌ها، عبارت‌ها و الگوهای ساختار جملات را بسنجند.

بر اساس نتایج این تحقیق، بزرگ‌ترین نشانه لو‌دهنده مدل Claude Opus 5.5 کلمه «dependable» (قابل اعتماد) است که ۲۳ برابر بیش‌تر از متن‌های انسانی در نوشته‌هایش دیده می‌شود! علاوه بر این، با اینکه Opus 5.5 دیگر از ساختار کلیشه‌ای «این X نیست، بلکه Y است» پرهیز می‌کند، اما هنوز هم علاقه شدیدی دارد که بگوید چیزی «فراتر از یک X است، بلکه Y است».

از همه جالب‌تر اینکه اوپوس شیفته توضیح دادن اهمیت چیزهاست؛ این مدل عبارت «این موضوع اهمیت دارد» (this matters) را ۱۱۶ برابر و عبارت «چرا فلان موضوع اهمیت دارد» (why X matters) را ۹۲ برابر بیش‌تر از نویسندگان انسانی به کار می‌برد.

در نقطه مقابل، مدل آسترا (Astra) محصول OpenAI تکیه‌کلام‌های کاملاً متفاوتی دارد. این مدل عاشق توصیف «بُعدی دیگر» (another dimension) از هر موضوعی است و معمولاً برای گریز از قطعیت، ادعا می‌کند که فلان کار «ممکن است فایده‌ای داشته باشد» یا «می‌تواند مزیتی فراهم کند». بزرگ‌ترین نشانه لو‌دهنده آن چیزی است که گرافیت «قاب‌بندی اصلاحی» می‌نامد؛ یعنی جایی که موضوعی را به صورت «صرفاً فلان چیز نیست» یا به عنوان گزینه‌ای جایگزین مثل «به جای اتکا به فلان چیز» مطرح می‌کند. بر اساس گزارش گرافیت، این نوع جمله‌بندی‌ها در متن‌های آسترا بیش از ۱۰۰ برابر بیش‌تر از نوشته‌های انسان تکرار شده است.

نکته قابل توجه این است که به نظر می‌رسد تمام آزمایشگاه‌های پیشرو به انتقادها درباره استفاده افراطی از خط‌تیره توجه کرده‌اند. در داده‌های گرافیت، مدل Opus 5.5 حدود ۹۹ درصد کم‌تر از Opus 5 از این علامت نگارشی استفاده کرده است. مدل آسترا هم ۸۸ درصد کم‌تر از انسان‌ها سراغ خط‌تیره می‌رود و مدل Gemini 3.1 Pro تقریباً خط‌تیره را به طور کامل از نوشته‌های خود حذف کرده است.

اما در حالی که نشانه‌های فردی هر مدل دستخوش تغییر می‌شود، گرافیت می‌گوید تعداد کلی این نشانه‌ها تغییری نکرده است. دراک در توضیحات خود می‌گوید: «موضوع این نیست که تکیه‌کلام‌های هوش مصنوعی واقعاً کم شده باشند؛ سازندگان موفق می‌شوند معروف‌ترین نشانه‌های لو‌دهنده را حذف کنند، اما بلافاصله نشانه‌های جدیدی سر برمی‌آورند و هر نسخه‌ای از مدل‌ها تکیه‌کلام‌های خاص خودش را پیدا می‌کند.»

ماندگاری این تکیه‌کلام‌ها با توجه به تمرکز شدید شرکت‌ها روی شبیه‌سازی سبک نگارش انسان واقعاً شگفت‌انگیز است. آنتروپیک در زمان معرفی Opus 5.5 مدعی شده بود که این مدل «بسیار طبیعی‌تر از مدل‌های قبلی صحبت می‌کند» و کاربران اولیه معتقد بودند «نوشته‌های آن شفاف‌تر و دنبال کردنش ساده‌تر است».

شرکت OpenAI هم هنگام رونمایی از نسخه‌های Sol و Luna برای مدل GPT-6 ادعاهای مشابهی داشت و تأکید کرده بود کاربران می‌توانند «منتظر شفافیت بیشتر، اصطلاحات فنی کم‌تر و جمله‌بندی‌های نامأنوس بسیار کمتری باشند».

با این حال، دراک نسبت به توانایی آزمایشگاه‌ها در ریشه‌کن کردن کامل این نشانه‌ها و عبارت‌های لو‌دهنده به شدت بدبین است.

دراک در جمع‌بندی می‌گوید: «فرضیه کلی من این است که شرکت‌ها توانایی کمتری برای کنترل این موارد دارند، خیلی کم‌تر از آنچه فکرش را می‌کنید. ما با مدل‌های غول‌پیکری با میلیاردها پارامتر طرف هستیم؛ آزمایش‌هایی که آن‌ها می‌توانند انجام دهند محدود است و در نتیجه خیلی از این تکیه‌کلام‌ها ناخواسته از زیر دستشان فرار می‌کند.»

دیدگاه ها و گفتگوی تخصصی

نظرات خود را با جامعه مخاطبان وایر ای آی در میان بگذارید

۰ دیدگاه

هنوز دیدگاهی برای این مطلب ثبت نشده است

اولین نفری باشید که دیدگاه، تحلیل یا دیدگاه خود را درباره این موضوع با دیگران به اشتراک می گذارد.

مطالب مرتبط و پیشنهادی

دردسر تازه در اوپن‌ای‌آی؛ اخراج جنجالی سه پژوهشگر ایمنی به اتهام درز اطلاعات محرمانه
آخرین اخبار

دردسر تازه در اوپن‌ای‌آی؛ اخراج جنجالی سه پژوهشگر ایمنی به اتهام درز اطلاعات محرمانه

اوپن‌ای‌آی در پی یک تحقیق داخلی، سه پژوهشگر تیم ایمنی خود را به اتهام افشای اطلاعات محرمانه شرکت اخراج کرد. این تصمیم در حالی گرفته شده که انتقادها از کم‌توجهی این غول فناوری به مسائل امنیتی بالا گرفته و اخیراً حتی عرضه مدل GPT-6.1 Astra نیز به دلیل ریسک‌های ایمنی متوقف شده است.

۲ دقیقه مطالعه
۰
۹ مهر
شاهکار هوش مصنوعی ERA گوگل؛ شکست ۳۹ تیم در چالش پیش‌بینی آنفلوآنزا برای CDC
آخرین اخبار

شاهکار هوش مصنوعی ERA گوگل؛ شکست ۳۹ تیم در چالش پیش‌بینی آنفلوآنزا برای CDC

سیستم هوش مصنوعی ERA گوگل با تکیه بر تولید و آزمایش خودکار کدهای علمی، موفق شد در ارزیابی فصلی سازمان CDC آمریکا رتبه نخست پیش‌بینی بستری‌های آنفلوآنزا را میان ۳۹ تیم مدعی کسب کند. این مدل که صفر تا صد الگوریتم‌هایش با جست‌وجوی درختی توسط هوش مصنوعی بهینه‌سازی شده، قدرت خیره‌کننده کدنویسی هوشمند در حل مسائل پیچیده همه‌گیرشناسی را به نمایش می‌گذارد.

۴ دقیقه مطالعه
۰
۹ مهر
بی‌خیال آخرالزمان هوش مصنوعی؛ خطر واقعی تنبلی ما در رعایت امنیت پایه است!
آخرین اخبار

بی‌خیال آخرالزمان هوش مصنوعی؛ خطر واقعی تنبلی ما در رعایت امنیت پایه است!

در حالی که خبرهای هولناک از نفوذ خودسرانه ایجنت‌های هوش مصنوعی سرتیتر رسانه‌ها شده، متخصصان ارشد امنیت سایبری در کنفرانس HumanX یادآور می‌شوند که بزرگ‌ترین تهدید نه هوش ماشین‌ها، بلکه تنبلی خودمان در رعایت اصول پایه امنیت است. به گفته این کارشناسان، شرکت‌ها به جای وحشت از سناریوهای تخیلی آخرالزمانی، باید روی بستن رخنه‌های پیش‌پاافتاده، فعال‌سازی احراز هویت چندمرحله‌ای و کنترل دسترسی ایجنت‌ها تمرکز کنند.

۵ دقیقه مطالعه
۰
۹ مهر