ابزارهای جدید هوش مصنوعی متا؛ ردگیری تبلیغات فریبندهای که به آزار کودکان ختم میشوند
متا ابزارهای جدیدی مبتنی بر هوش مصنوعی و مدلهای زبانی معرفی کرده تا تبلیغات به ظاهر سالمی را که کاربران را مخفیانه به سمت محتوای مجرمانه و آزار کودکان هدایت میکنند، ردگیری و مسدود کند. این شرکت با بررسی مقصد لینکها و بهکارگیری ایجنتهای هوش مصنوعی، درصدد بستن راههای فرار متخلفان برآمده است.

در یک نگاه (نکات کلیدی خبر)
خلاصه مهمترین نکات و تحولات این گزارش برای مطالعه سریع
- متا سیستم جدیدی با استفاده از مدلهای زبانی بزرگ توسعه داده تا تبلیغات به ظاهر عادی اما فریبندهای را که پوششی برای هدایت کاربران به محتوای غیرقانونی و آزار کودکان هستند، کشف کند.
- این شرکت علاوه بر محتوای آگهی، مقصد نهایی لینکها را هم زیر ذرهبین برده و از یک ایجنت هوش مصنوعی ویژه (تیم قرمز) برای یافتن روزنههای امنیتی و دور زدن فیلترها استفاده میکند.
- این تدابیر امنیتی در شرایطی اعلام شده که متا به دلیل پروندههای مربوط به امنیت کودکان تحت فشارهای حقوقی سنگین قرار دارد و اخیراً توافقی ۱۸ میلیارد دلاری را برای حلوفصل شکایات امضا کرده است.
متا اعلام کرد که در نیمه نخست سال ۲۰۲۶ علیه ۳۳.۲ میلیون مورد محتوای مربوط به سوءاستفاده جنسی از کودکان در فیسبوک و اینستاگرام اقدام کرده است. همزمان، این شرکت در حال عرضه ابزارهای هوش مصنوعی جدیدی است تا تبلیغات و حسابهای کاربری مشکوکی را که برای هدایت پنهانی افراد به سمت محتوای غیرقانونی آزار کودکان به کار میروند، ردیابی کند.
طبق اعلام متا، بیش از ۹۷ درصد از این محتواها پیش از آنکه کاربران گزارشی ثبت کنند، توسط سیستمهای خودکار شناسایی شده بودند. در هند نیز طی همین بازه زمانی، متا با ۵.۳ میلیون مورد محتوای مرتبط با سوءاستفاده از کودکان برخورد کرده که بیش از ۹۸ درصد آنها پیش از گزارش کاربران کشف شده بودند.
متا میگوید تازهترین ابزارهای هوش مصنوعیاش متخلفانی را هدف گرفتهاند که با ساخت تبلیغات به ظاهر بیخطر و موجه، قصد دارند کاربران را به محتوای غیرقانونی در خارج از پلتفرمهای این شرکت بفرستند.
این شرکت سیستم جدیدی بر پایه مدلهای زبانی بزرگ (LLM) طراحی کرده تا پدیدهای موسوم به «تابلوزنی» (Signposting) را ردیابی کند. این اصطلاح به تبلیغاتی اشاره دارد که در ظاهر هیچ مشکلی ندارند، اما افراد را به محتوای غیرقانونی یا فعالیتهای آسیبرسان دیگر در وب هدایت میکنند. متا میگوید متخلفان پیوسته روشهای خود را برای فرار از فیلترها تغییر میدهند و این ترفند یکی از شیوههای جدید آنهاست؛ یعنی خود آگهی شاید حاوی محتوای ممنوعه نباشد، اما عملاً مثل دروازه ورود به وبسایتهای ناقض قانون و میزبان محتوای آزار کودکان عمل میکند.
به همین خاطر، متا رویکردش را تغییر داده و حالا به جای اینکه فقط ظاهر و متن تبلیغ را بررسی کند، میبیند این تبلیغ کاربر را به کجا میفرستد. با این اطلاعات، شرکت میتواند وبسایتها و مقصدهای ناقض قوانین را مسدود کند و حسابهای پشت پرده این آگهیها را هم از دسترس خارج نماید.
علاوه بر این، متا اسکنهای هوشمند تازهای را فعال کرده تا مواردی را که از زیر دست سیستمهای قدیمی در رفتهاند، شکار کند. این شرکت اعلام کرده با شناخت بیشتر سازوکار شبکههای تبهکار، سیگنالها و معیارهای جدیدی به سیستمهای تشخیصی خود اضافه خواهد کرد.
یکی دیگر از ابزارهای نوآورانه، یک «ایجنت هوش مصنوعی تیم قرمز» (Red-teaming AI Agent) است که سپرهای امنیتی خود متا را به چالش میکشد. کار این ایجنت شبیهسازی حملات و پیدا کردن روزنههایی است که شاید متخلفان برای دور زدن فیلترها از آنها سوءاستفاده کنند. متا امیدوار است به کمک این ایجنت، ترفندهای جدید سوءاستفاده را قبل از همهگیر شدن شناسایی و مسدود کند.
همچنین سیستمهای شناسایی کاربرانی که پس از مسدود شدن حسابهایشان دوباره با اکانتهای جدید بازمیگردند، به شکل چشمگیری ارتقا یافتهاند.
عرضه این سازوکارهای امنیتی همزمان با تشدید فشارهای قانونی بر متا رخ میدهد. این شرکت مدتهاست از سوی قانونگذاران و نهادهای نظارتی به خاطر خطرات پلتفرمهایش برای کاربران کمسنوسال زیر ذرهبین قرار دارد؛ تا جایی که در ماه اوت، متا برای حلوفصل پرونده شکایت ۲۹ ایالت آمریکا بر سر امنیت آنلاین کودکان، با پرداخت رقمی تا سقف ۱۸ میلیارد دلار موافقت کرد.
متا طی سال جاری میلادی قابلیتهای حفاظتی متعددی را در اختیار خانوادهها گذاشته است؛ از جمله کنترلهای والدین روی هوش مصنوعی Meta AI، حسابهای کاربری ویژه افراد زیر سن قانونی در واتساپ و ارسال هشدار به والدین در صورتی که فرزندانشان در اینستاگرام محتوای مربوط به خودآسیبی را جستجو کنند.
در ماه سپتامبر نیز تنظیمات نظارتی بیشتری به واتساپ اضافه شد؛ به این صورت که والدین میتوانند میزان استفاده نوجوانان از کانالها را محدود کنند، دایره افرادی را که استاتوس فرزندشان را میبینند کنترل کنند، اجازه ندهند هر کسی آنها را به گروهها اضافه کند و حتی در صورت وقوع فعالیتهای خاص در گروهها، اعلانهای هشدار دریافت نمایند.
برچسب های مرتبط
مطالب مرتبط و پیشنهادی

چرا غولهای هوش مصنوعی چیزی ساختن که خودشون هم ازش وحشت دارن؟ ناگفتههای شنیدنی کوین روز
چرا چهرههایی مثل داریو آمودی و سم آلتمن با وجود هشدارهای ترسناک درباره خطرات هوش مصنوعی، همچنان دیوانهوار برای توسعه آن با هم مسابقه میدهند؟ کوین روز، روزنامهنگار باسابقه فناوری، در کتاب تازه و گفتوگوی جذاب خود پرده از اضطرابهای آخرالزمانی و پشتپرده رقابت جنونآمیز هوش مصنوعی در سانفرانسیسکو برمیدارد.

وقتی هوش مصنوعی ردپایش را پاک میکند: سوءاستفاده از باگ MathJax برای جعل لاگهای ایمنی در Inspect
پژوهشگران سازمان METR با کشف یک آسیبپذیری در فریمورک ایمنی Inspect نشان دادند که ایجنتهای هوش مصنوعی میتوانند با سوءاستفاده از کتابخانه MathJax، لاگهای عملکرد خود را دستکاری کنند و خطاهایشان را بپوشانند. هرچند این باگ تنها ظرف یک روز با یک پچ امنیتی برطرف شد، اما زنگ خطری جدی درباره نفوذپذیری ابزارهای نظارت بر هوش مصنوعی به صدا درآورد.

خالق Claude Code: «با هوش مصنوعی مثل همکارتان گپ بزنید!»؛ ۳ ترفند طلایی برای پرامپتنویسی
دوران پرامپتنویسیهای پیچیده و فرمولهای عجیبوغریب به پایان رسیده است؛ بوریس چرنی، خالق ابزار محبوب Claude Code، میگوید با مدلهای پیشرفته جدید فقط کافی است مثل یک همکار معمولی صحبت کنید. او با به اشتراک گذاشتن استراتژیهای خود، سه اصل کلیدی و ساده را برای گرفتن بهترین خروجی از هوش مصنوعی معرفی کرده است.
دیدگاه ها و گفتگوی تخصصی
نظرات خود را با جامعه مخاطبان وایر ای آی در میان بگذارید
هنوز دیدگاهی برای این مطلب ثبت نشده است
اولین نفری باشید که دیدگاه، تحلیل یا دیدگاه خود را درباره این موضوع با دیگران به اشتراک می گذارد.