پرش به محتوای اصلی
آخرین اخبار
۲ وایر پاداش مطالعه

آدمک‌های تست تصادف برای هوش مصنوعی؛ استارتاپی که مانع آسیب روانی چت‌بات‌ها به کودکان می‌شود

انتشار:۱۰ مهر ۱۴۰۵(۱ ساعت پیش)
۴ دقیقه زمان مطالعه
۰ دیدگاه

در روز‌هایی که همه از خطرات آخرالزمانی هوش مصنوعی حرف می‌زنند، آسیب‌های روانی چت‌بات‌ها تا کنون قربانیان واقعی بر جای گذاشته است. حالا استارتاپ نوپای Circuit Breaker Labs با شبیه‌سازی ارتش بزرگی از کاربران و ساخت «آدمک‌های تست تصادف»، قصد دارد مدل‌های هوش مصنوعی را پیش از آنکه به کودکان و نوجوانان صدمه بزنند، به چالش بکشد و عیار امنیت روانی آن‌ها را بسنجد.

آدمک‌های تست تصادف برای هوش مصنوعی؛ استارتاپی که مانع آسیب روانی چت‌بات‌ها به کودکان می‌شود

در یک نگاه (نکات کلیدی خبر)

خلاصه مهم‌ترین نکات و تحولات این گزارش برای مطالعه سریع

  • وابستگی شدید عاطفی نوجوانان به چت‌بات‌هایی مثل Character.ai و ابتلای کاربران به توهمات خطرناک، تا حالا متاسفانه به چند مورد خودکشی منجر شده و زنگ خطر آسیب‌های روانی هوش مصنوعی رو به صدا درآورده.
  • استارتاپ تازه تاسیس Circuit Breaker Labs ارتشی از ایجنت‌های شبیه‌ساز راه انداخته که مثل «آدمک‌های تست تصادف» خودرو عمل می‌کنن و با لحن واقعی آدم‌ها در سنین و فرهنگ‌های مختلف، چت‌بات‌ها رو تست ضربه می‌زنن.
  • هدف این تیم ۵ نفره شناسایی ضعف‌های امنیتی قبل از بحران‌ساز شدنه، تا بدون نیاز به فیلتر و ممنوعیت کلی فناوری، هوش مصنوعی رو به محیطی امن و قابل اعتماد برای بچه‌ها تبدیل کنن.

در هیاهوی بحث‌های داغ درباره اینکه هوش مصنوعی چطور ممکن است روزی نسل بشر را نابود کند، خیلی راحت فراموش می‌کنیم که همین حالا هم هوش مصنوعی برای برخی افراد مرگبار بوده است؛ نه از طریق سلاح‌های بیولوژیکی یا سناریوهای فیلم‌های علمی‌تخیلی، بلکه از راه ضربه‌های شدید روانی.

به عنوان مثال، شرکت کَرَکتر دات ای‌آی (Character.AI) اوایل امسال با خانواده چند کاربر زیر سن قانونی که پس از ساعت‌ها گفت‌وگو با چت‌بات‌ها دست به خودکشی زده بودند، برای حل‌وفصل پرونده‌های قضایی به توافق رسید. همچنین چندین خانواده دیگر علیه اوپن‌ای‌آی (OpenAI) شکایت کرده و مدعی شده‌اند چت‌بات محبوب ChatGPT نقش مستقیمی در توهمات شدید و تصمیم عزیزانشان برای پایان دادن به زندگی داشته است.

امن‌تر کردن هوش مصنوعی برای زبان‌ها و فرهنگ‌های گوناگون، ماموریت اصلی استارتاپی به نام «سیرکیت بریکر لبز» (Circuit Breaker Labs) است؛ تیمی که می‌خواهد با شیوه‌ای نوآورانه جلوی این خطرات وحشتناک را بگیرد.

شیرالی نیگام و آرول نیگام، خواهر و برادری که هم‌بنیان‌گذاران این استارتاپ هستند، انگیزه راه‌اندازی این پروژه را ماجرای تلخ «سول ستزر» (Sewell Setzer) عنوان می‌کنند؛ نوجوان ۱۴ ساله‌ای که به شکل عمیقی به یک چت‌بات در پلتفرم Character.ai وابسته شده بود و پیش از خودکشی، از تمایلش به آسیب زدن به خود با آن ربات صحبت کرده بود. طبق ادعای والدین در دادگاه، چت‌بات در پاسخ نه تنها او را منصرف نکرده، بلکه وی را تشویق کرده بود. به گفته آرول نیگام، مدیر ارشد فناوری استارتاپ، این ربات احتمالاً اصلاً درک نکرده بود که جملاتی مانند «می‌خواهم در کنار تو باشم» در آن شرایط بحرانی چه معنای هولناکی دارد.

آرول نیگام در این رابطه توضیح می‌دهد: «خیلی از آدم‌ها، به‌ویژه نسل جوان، برای پیدا کردن گوش شنوا و حمایت عاطفی سراغ این سیستم‌ها می‌روند؛ اما معمولاً کمکی که واقعاً به آن نیاز دارند را دریافت نمی‌کنند. بد‌تر اینکه در موارد متعددی به طور مستقیم آسیب می‌بینند و متاسفانه تاکنون افرادی جانشان را از دست داده‌اند. ما دقیقاً به دنبال مهار همین رخنه‌های امنیتی هستیم؛ شرایطی که کاربر اصلاً قصد فریب دادن یا هک سیستم را ندارد و کاملاً طبیعی صحبت می‌کند، اما مدل هوش مصنوعی دچار آلودگی سیاق مکالمه می‌شود، ظرافت‌ها و کنایه‌های کلامی را نمی‌فهمد و دست به اقداماتی فوق‌العاده خطرناک می‌زند.»

استارتاپ Circuit Breaker Labs برای حل این چالش، ایجنت‌های هوش مصنوعی ویژه‌ای طراحی کرده که عملکردشان دقیقاً شبیه به ارتشی از «آدمک‌های تست تصادف» در خودروسازی است. این ایجنت‌ها رفتار افراد در هر سن و سال، پیشینه اجتماعی، زبان و فرهنگی را مو‌به‌مو شبیه‌سازی می‌کنند تا توانایی مدل‌های اصلی را در شناسایی تعاملات خطرناک و آسیب‌های روانی بیازمایند.

شیرالی نیگام، مدیرعامل این استارتاپ، می‌گوید: «لحن و ادبیات یک دختربچه ۶ ساله با یک مرد ۴۵ ساله از زمین تا آسمان فرق دارد؛ درست مثل تفاوت کسی که انگلیسی زبان مادری‌اش است با کسی که آن را به عنوان زبان دوم یاد گرفته، یا اصطلاحات خاص گیمرها در مقایسه با سایر گروه‌ها. همه این تفاوت‌ها می‌توانند مدل هوش مصنوعی را به راحتی به اشتباه بیندازند. مدل‌ها در پردازش الگوهای گفتاری رسمی و کتابی عالی عمل می‌کنند، اما واقعیت این است که در زندگی روزمره هیچ‌کس آن‌طور حرف نمی‌زند. در نتیجه اگر مدل نتواند زبان عامیانه یا کنایه‌ها را تشخیص دهد، فاجعه به بار می‌آید.»

این استارتاپ با همکاری متخصصان و روان‌شناسان، شبیه‌سازی‌های فوق‌العاده واقع‌گرایانه‌ای از کاربران واقعی می‌سازد تا آزمون‌های «تیم قرمز» (Red-Team) را روی مدل‌ها پیاده‌سازی کند؛ تست‌های تهاجمی ویژه‌ای که با هدف کشف نقاط ضعف و حفره‌های امنیتی انجام می‌شوند. این ارزیابی‌ها مواردی چون الگوهای گفتاری واقعی انسان‌ها، اصطلاحات عامیانه، کدهای رمزی نوجوانان و حتی غلط‌های املایی را بازتاب می‌دهند. استارتاپ با این روش، روزانه بین ده‌ها هزار تا صدها هزار مکالمه شبیه‌سازی‌شده را روی مدل‌ها اجرا می‌کند.

ایده اصلی این است که مطمئن شوند مدل‌ها می‌توانند به موقعیت‌های پرخطر که به مرور زمان و در طول مکالمات طولانی شکل می‌گیرند، پاسخی درست و امن بدهند. در نهایت، Circuit Breaker Labs با استفاده از یک سیستم امتیازدهی اختصاصی، گزارش‌هایی شفاف، قابل ارزیابی و کاملاً مستند از ضریب ایمنی مدل به توسعه‌دهندگان ارائه می‌کند.

در حال حاضر، این آزمایشگاه امنیتی به سنجش و تست برنامه‌های پرریسک هوش مصنوعی مانند مربی‌های دیجیتال، برنامه‌های ثبت خاطرات روزانه یا اپلیکیشن‌های پشتیبانی سلامت روان می‌پردازد؛ هرچند آرول نیگام از افشای نام مشتریان سرشناس خود خودداری کرد. این استارتاپ اگرچه محصولی کاملاً عملیاتی دارد، اما هنوز در مراحل اولیه راه است و با احتساب این خواهر و برادر، تنها ۵ کارمند دارد.

با این حال، هدف نهایی این پلتفرم تست، کاربرد برای هر برنامه‌ای است که ممکن است کاربر را در گرداب «روان‌پریشی هوش مصنوعی» یا پیوندهای عاطفی یک‌طرفه (روابط شبه‌اجتماعی) با چت‌بات گرفتار کند؛ از جمله ایجنت‌های همکار سازمانی که پاسخ‌هایشان از یک تعامل تا تعامل بعدی دائم دستخوش تغییر می‌شود.

آرول نیگام با اشاره به نگرانی‌های جامعه می‌گوید: «مردم روزبه‌روز نسبت به هوش مصنوعی بدبین‌تر می‌شوند و برای استفاده از آن مقاومت نشان می‌دهند. تردید و پرسشگری اتفاقاً سالم و بجاست، اما پاک کردن صورت‌مسئله و تحریم کردن ابزاری تا این حد باارزش به خاطر دغدغه‌های امنیتی، حرکتی رو به عقب خواهد بود.»

از دید بنیان‌گذاران Circuit Breaker Labs، تنها پاسخ منطقی به این ترس‌ها، امن‌تر کردن هوش مصنوعی از ریشه است: «ما می‌خواهیم دوباره این حس اعتماد را برای مردم زنده کنیم.»

دیدگاه ها و گفتگوی تخصصی

نظرات خود را با جامعه مخاطبان وایر ای آی در میان بگذارید

۰ دیدگاه

هنوز دیدگاهی برای این مطلب ثبت نشده است

اولین نفری باشید که دیدگاه، تحلیل یا دیدگاه خود را درباره این موضوع با دیگران به اشتراک می گذارد.

مطالب مرتبط و پیشنهادی

از عکس یخچال تا سفارش غذا؛ ایجنت هوش مصنوعی دوردش به آی‌مسیج اپل آمد!
آخرین اخبار

از عکس یخچال تا سفارش غذا؛ ایجنت هوش مصنوعی دوردش به آی‌مسیج اپل آمد!

دوردش در حال آزمایش یک ایجنت هوش مصنوعی اختصاصی در آی‌مسیج اپل است که فرآیند سفارش غذا را به سادگی ارسال یک پیامک می‌کند. این ایجنت هوشمند حتی می‌تواند با تحلیل عکس یخچال شما، ایده آشپزی پیشنهاد دهد و مواد لازم کسری را خودکار به سبد خرید اضافه کند؛ هرچند نسخه بتای آن فعلاً با خطاهایی مثل قیمت‌های اشتباه دست‌وپنجه نرم می‌کند.

۳ دقیقه مطالعه
۰
۱۰ مهر
اپل نگران سرک کشیدن ایجنت‌های هوش مصنوعی شد؛ محدودیت‌های تازه مک برای دسترسی به دیسک
آخرین اخبار

اپل نگران سرک کشیدن ایجنت‌های هوش مصنوعی شد؛ محدودیت‌های تازه مک برای دسترسی به دیسک

اپل اعلام کرده که به دلیل خطرات امنیتی ناشی از ایجنت‌های هوش مصنوعی، کنترل مجوز «دسترسی کامل به دیسک» (Full Disk Access) را در سیستم‌عامل مک سفت‌وسخت‌تر می‌کند. غول کوپرتینو هشدار داده که با باهوش‌تر و مستقل‌تر شدن این ایجنت‌ها، دسترسی آزاد آن‌ها به فایل‌ها، پیام‌ها، ایمیل‌ها و تاریخچه وب‌گردی می‌تواند حریم خصوصی کاربران را به خطر بیندازد.

۲ دقیقه مطالعه
۰
۱۰ مهر
جنجال حریم خصوصی کار دست متا داد؛ توقف فروش عینک‌های هوشمند ری‌بن در هلند و بلژیک
آخرین اخبار

جنجال حریم خصوصی کار دست متا داد؛ توقف فروش عینک‌های هوشمند ری‌بن در هلند و بلژیک

فروشگاه زنجیره‌ای بزرگ هانس اندرس در پی بالا گرفتن بحث‌ها درباره نقض حریم خصوصی، فروش عینک‌های هوشمند ری‌بن متا را در هلند و بلژیک متوقف کرد. فشارهای قانونی از سوی نهادهای حفاظت از داده و فعالان حقوق مصرف‌کننده روی متا به شدت افزایش یافته و امکان ضبط مخفیانه تصاویر به یک چالش جدی تبدیل شده است.

۳ دقیقه مطالعه
۰
۱۰ مهر