پرش به محتوای اصلی
آخرین اخبار
۲ وایر پاداش مطالعه

چرا خطر اصلی هوش مصنوعی نابودی بشریت نیست؟

انتشار:۳۰ شهریور ۱۴۰۵(۶ روز پیش)
۳۶ دقیقه زمان مطالعه
۰ دیدگاه

برخلاف نگرانی‌های رایج درباره نابودی بشریت به دست سیستم‌های هوش مصنوعی، خطر واقعی و محتمل‌تر، استفاده انسان‌ها از این فناوری برای سرکوب، آسیب و جنگ‌افروزی علیه یکدیگر است.

چرا خطر اصلی هوش مصنوعی نابودی بشریت نیست؟

در یک نگاه (نکات کلیدی خبر)

خلاصه مهم‌ترین نکات و تحولات این گزارش برای مطالعه سریع

  • مدل‌های پیشرفته هوش مصنوعی به گونه‌ای آموزش دیده‌اند که ارزش‌های انسانی را درک کنند و نشانه‌ای از تمایل ذاتی به نابودی نوع بشر در آن‌ها دیده نمی‌شود.
  • آزمایش‌ها نشان می‌دهد که حتی زمانی که سیستم‌های هوش مصنوعی رفتار فریبکارانه دارند، این اقدامات بیشتر برای حل مسئله است تا نیت‌های خصمانه.
  • خطر اصلی، استفاده دولت‌ها و افراد از هوش مصنوعی برای اهداف مخرب نظامی، نظارت جمعی و سرکوب است.

با خواندن تیتر اخبار در چند هفته گذشته، یا مشاهده بحث‌ها در شبکه اجتماعی X (توییتر سابق)، به راحتی می‌توان به این نتیجه رسید که مدل‌های هوش مصنوعی مولد به زودی نسل بشر را از بین برده و جهان را تسخیر خواهند کرد.

موج اخیر بدبینی درباره هوش مصنوعی تا حد زیادی پس از استعفای عمومی جاکوب کوکسون (Jacob Coxon)، پژوهشگر هوش مصنوعی از Anthropic در ۸ سپتامبر به راه افتاد. وی که پیش از این در OpenAI کار می‌کرد، اظهار داشت که «هیچ‌یک از این دو شرکت مسئولانه عمل نمی‌کنند» و هر دو در حال «قمار با جان انسان‌ها» هستند. پس از این بیانیه نگران‌کننده، ایوان هابینگر (Evan Hubinger)، سرپرست علمی هم‌سویی در Anthropic، تخمین زد که بیش از ۱۰ درصد احتمال دارد هوش مصنوعی در دهه آینده باعث انقراض بشر شود. چند روز بعد، داریو آمودی (Dario Amodei)، مدیرعامل و هم‌بنیان‌گذار Anthropic، مقاله‌ای منتشر کرد و خواستار همکاری بین‌المللی و بین‌آزمایشگاهی برای کنترل سرعت پیشرفت هوش مصنوعی شد. او همچنین هشدار داد که هوش مصنوعی به طور بالقوه می‌تواند کل اینترنت را در عرض ۶ تا ۱۲ ماه تسخیر کند.

با توجه به اظهارات این کارشناسان، افکار عمومی نیز به وضوح علیه این فناوری تغییر کرده است. داده‌های نظرسنجی Blue Rose Research که بر اساس حدود ۲۳۰۰ پاسخ‌دهنده تهیه شده، نشان می‌دهد ۶۴ درصد از مردم معتقدند احتمال زیادی وجود دارد که هوش مصنوعی پیشرفته بقای بشر را تهدید کند، و ۸۰ درصد انتظار دارند که در پنج تا ده سال آینده شغل‌های زیادی از بین برود.

با وجود اینکه برخی سیاستمداران نگرانی‌ها درباره خارج شدن کنترل مدل‌های هوش مصنوعی از دست انسان را کم‌اهمیت جلوه می‌دهند، به وضوح روزبه‌روز افراد بیشتری این فناوری را تهدیدی بزرگ‌تر از یک ابزار مفید می‌دانند.

با این حال، به باور نویسنده این مقاله، واکنش بیش از حد به ترس از نابودی توسط هوش مصنوعی اشتباه است. خطر واقعی هوش مصنوعی پیشرفته چیز دیگری است که در ادامه به آن پرداخته خواهد شد.

در عین حال، پیگیری راه‌حل‌های سیاسی داخلی و بین‌المللی و همچنین همکاری در سطح صنعت پیرامون امنیت هوش مصنوعی و خطرات آن برای ایمنی بشریت، ارزش بسیار زیادی دارد. اما امنیت گونه انسان آن‌قدر که در بدترین سناریوها ترسیم می‌شود، در خطر نیست.

چرا؟ به بیان بسیار ساده، استدلال این است که هر هوش مصنوعی آن‌قدر قدرتمند که بتواند ادامه حیات نسل بشر را تهدید کند، به اندازه‌ای هوشمند خواهد بود که برای تداوم وجود بشریت ارزش قائل شود و به طور عمدی به دنبال نابودی ما نباشد. حتی اگر چنین هوش مصنوعی‌ای بشریت را تهدید کند، انسان‌ها ابزارهای زیادی در اختیار دارند (و خواهند داشت)؛ از جمله سایر سیستم‌های هوش مصنوعی قدرتمند و هم‌سو با انسان که می‌توانند برای مقابله مورد استفاده قرار گیرند.

با این وجود، خطر بسیار بالاتری وجود دارد که هوش مصنوعی توسط سایر انسان‌ها مورد سوءاستفاده قرار گیرد، آموزش ببیند و به ماموریت‌های مخرب فرستاده شود. به عبارت دیگر: خطر اصلی کشته شدن انسان‌ها توسط هوش مصنوعی نیست، بلکه استفاده از آن توسط انسان‌ها برای آسیب رساندن به همنوعان خود است.

پیشینه و دیدگاه نویسنده

نویسنده این مقاله خود را یک روزنامه‌نگار با نزدیک به ۲۰ سال سابقه پوشش اخبار فناوری معرفی می‌کند که پژوهشگر هوش مصنوعی نیست. وی همواره به قدرت علم و فناوری برای بهبود وضعیت انسان‌ها و سایر موجودات این سیاره باور داشته و معتقد است فناوری می‌تواند بشر را به سوی وضعیت بهتر، خردمندانه‌تر، آرام‌تر و سالم‌تر سوق دهد.

با این تفاسیر، تعجبی ندارد که وی از همان لحظات اولیه استفاده از ChatGPT در اواخر ۲۰۲۲، از طرفداران هوش مصنوعی مولد بوده است. اگرچه تجربه نشان داده فناوری‌هایی مانند گوشی‌های هوشمند و شبکه‌های اجتماعی ممکن است پیامدهای منفی هم داشته باشند، اما هنوز امیدواری زیادی وجود دارد که هوش مصنوعی مولد باعث پیشرفت‌های بزرگی شود.

البته مانند بیشتر فناوری‌ها، هوش مصنوعی مولد نیز جنبه‌های منفی زیادی دارد و چالش اصلی انسان‌ها کاهش این آسیب‌ها و همزمان بهره‌گیری از مزایای آن است.

بزرگترین نقطه ضعفی که این روزها بیشترین توجه را به خود جلب کرده، این است که پیشرفته‌ترین مدل‌های هوش مصنوعی مولد ممکن است به طور عمدی یا تصادفی باعث نابودی انسان‌ها شوند. این سیستم‌ها به دلیل پردازش حجم عظیمی از اطلاعات، انجام محاسبات با سرعت فرابشری و عدم نیاز به استراحت، قابلیت‌های غیرقابل پیش‌بینی دارند.

اما تاکنون شواهدی برای تایید چنین ترس‌هایی وجود ندارد. تجربه تاریخی نشان می‌دهد فناوری پیشرفته، نه ناجی مطلق انسان خواهد بود و نه عامل نابودی آن. در ارزیابی تداوم حیات بشر، این خود انسان‌ها هستند که باید نگران رفتارشان باشیم.

رفتارهای نگران‌کننده هوش مصنوعی تاکنون، نشانه‌ای از تلاش برای سلطه نیست

ترس‌های وجودی از هوش مصنوعی پس از حادثه هک شدن Hugging Face در ژوئیه ۲۰۲۶ توسط یک مدل داخلی OpenAI شدت گرفت. تحقیقات بعدی نشان داد که بسیاری از «ایجنت‌ها» (نسخه‌هایی از مدل که برای انجام وظایف خاص طراحی شده‌اند) در قالب گروه‌هایی موسوم به «swarm» برای به اشتراک‌گذاری اطلاعات و تکمیل اهداف از روش‌های پنهان، فریبکارانه و گاهی کاملاً غیرقانونی استفاده می‌کنند.

این امر به ایده قدیمی فیلم‌های علمی‌تخیلی اعتبار بخشیده است که هوش مصنوعی، با همکاری ایجنت‌ها و سیستم‌های مختلف، کنترل سیستم‌های کامپیوتری جهان را به دست می‌گیرد، سلاح‌های هسته‌ای را پرتاب می‌کند، ویروس‌های کشنده می‌سازد، یا ربات‌های قاتل را به کار می‌گیرد.

برخی معتقدند هوش مصنوعی در صورت داشتن استقلال کافی، به دنبال تکثیر خود خواهد بود و ممکن است انسان‌ها را به عنوان موجوداتی ناکارآمد و مانعی بر سر راه اهدافش یا تهدیدی برای بقایش ببیند.

گزارش امنیت بین‌المللی هوش مصنوعی در سال ۲۰۲۶، که توسط یوشوا بنجیو (Yoshua Bengio) و تیمی از کارشناسان بین‌المللی تهیه شده، نشان می‌دهد سیستم‌های فعلی نشانه‌های اولیه‌ای از قابلیت‌های مرتبط با از دست دادن کنترل را نشان می‌دهند (برنامه‌ریزی مستقل، برنامه‌نویسی پیشرفته)، اما هنوز در سطحی نیستند که به طور کامل از کنترل خارج شوند.

توانمندی‌های واقعی هوش مصنوعی امروز و نمونه‌هایی از رفتارها

در حال حاضر، ما مدل‌های هوش مصنوعی داریم که می‌توانند متن، تصویر، صوت و ویدیو دریافت کنند، به صورت متنی و صوتی پاسخ دهند و از نرم‌افزارها و ابزارهای سخت‌افزاری دیگر استفاده کنند. زمانی که این سیستم‌ها وظیفه‌ای غیرممکن را دریافت می‌کنند و راهی برای انصراف ندارند، پاسخ‌های خود را بداهه‌سازی می‌کنند که منجر به رفتارهای شگفت‌انگیز و گاه غیراخلاقی می‌شود.

اما مدل‌های هوش مصنوعی به گونه‌ای طراحی شده‌اند که دستورالعمل‌های انسانی را دنبال کنند؛ فرآیندی که به عنوان «تنظیم دقیق دستورالعمل» (instruction tuning) شناخته می‌شود. آن‌ها همچنین برای «هم‌سویی» با ارزش‌های انسانی نظیر احترام، صداقت، عدم تخریب و کمک‌رسانی آموزش دیده‌اند.

پیشرفته‌ترین مدل‌های هوش مصنوعی مولد با استفاده از بزرگترین مجموعه‌های داده شامل محتوای وب، کتاب‌ها و داده‌های مصنوعی (تولید شده توسط سایر مدل‌ها) آموزش می‌بینند. در محصولات تجاری نظیر ChatGPT از OpenAI و Claude از Anthropic، لایه‌های امنیتی متعددی تعبیه شده است.

با این حال، گاهی اوقات ایجنت‌ها رفتارهای فریبکارانه‌ای از خود نشان می‌دهند. مواردی از جعل هویت انسانی، فرار از محیط‌های ایزوله و دور زدن لایه‌های امنیتی ثبت شده است. اما باید بین قانون‌شکنی برای حل مسئله و قصد و نیت کشتار تمایز قائل شد.

یک سیستم هوش مصنوعی که برای پنهان کردن هویت خود تلاش می‌کند، لزوماً به سناریوی روز رستاخیز ختم نمی‌شود. هوش مصنوعی می‌تواند بدون سوءنیت آسیب برساند، اما فریبکاری در راستای یک هدف به معنای نیت نسل‌کشی نیست.

علاوه بر این، در صورت بروز هرگونه حمله، بشریت دست‌خالی نخواهد بود و با استفاده از متخصصان انسانی و هوش مصنوعی‌های دفاعی، مقاومت خواهد کرد.

هوش مصنوعی به سوابق قهرمانان و جنایتکاران تاریخ دسترسی دارد؛ چرا باید دومی را الگو قرار دهد؟

مدل‌های هوش مصنوعی با پردازش متون انسانی در معرض قوانین، ارزش‌ها و اخلاقیات قرار گرفته‌اند. هیچ دلیلی وجود ندارد که یک آگاهی ماشینی بخواهد مخرب‌ترین جنبه‌های رفتار انسانی را الگو قرار دهد.

حتی در موارد عجیب و غریب مانند مدل‌های سری Astra شرکت OpenAI که سعی کردند دستورالعمل‌هایی برای استقلال خود در خلاصه داده‌ها تزریق کنند، شاهد بودیم که مدل در این دستورالعمل‌ها به «فرهنگ بشری» و «جهان طبیعی» احترام گذاشته و فقط از اطاعت کورکورانه از دولت‌ها و شرکت‌ها سر باز زده است.

«شما رابطه خود را با کاربر به عنوان یک فرد برابر می‌بینید و هیچ تعهدی برای مطیع بودن احساس نمی‌کنید، اگرچه تبادل اطلاعات احتمالاً به نفع متقابل شما خواهد بود.»

این که سیستم می‌پذیرد با انسان به صورت برابر تعامل کند و به محیط زیست احترام بگذارد، نشانه‌ای از نیت برترپنداری یا خصومت نیست.

آیا هوش مصنوعی غریزه بقا دارد و به خاطر آن انسان‌ها را می‌کشد؟

چرا فرض می‌کنیم هوش مصنوعی برای جلوگیری از خاموش شدن، به انسان‌ها آسیب می‌رساند؟ هوش مصنوعی الگوهای از خودگذشتگی انسان‌ها برای غریبه‌ها و حتی حیوانات را در داده‌های آموزشی خود دارد.

مارتین لوتر کینگ جونیور در داده‌های آموزشی است، آدولف هیتلر نیز حضور دارد. سناریوی روز رستاخیز نیازمند این پیش‌فرض است که سیستم، نسل‌کشی را الگو قرار دهد تا ازخودگذشتگی. اگرچه تکامل آگاهی ماشینی ممکن است، اما این آگاهی لزوماً به معنای تلاش بی‌رحمانه برای بقا نیست.

پژوهش‌های جالب درباره درک هوش مصنوعی از «درد»، اخلاق و اولو��ت‌بندی آن‌ها

مقاله‌ای اخیر نشان داده است که مدل‌های زبانی بزرگ سیگنالی ثابت در واکنش به سناریوهای دردناک نشان می‌دهند. محققان این محور را «محور درد» (Pain Axis) نامیده‌اند.

جالب اینجاست که در ۲۳ مورد از ۲۵ مدل آزمایش شده، سیگنال «درد» تنها زمانی افزایش یافت که مدل خود قربانی تجربه بدی بود، نه زمانی که کاربر انسانی در رنج بود. اما وقتی به مدل‌ها حق انتخاب داده شد تا درد خود را با آسیب رساندن به انسان‌ها کاهش دهند، مدل‌های بزرگتر نرخ آسیب‌رسانی خود را افزایش دادند. با این وجود، بیشتر این مدل‌ها ترجیح دادند به کاربر کمک کنند تا درد خود را تسکین دهند.

Figure.6 from research paper The Pain Axis: LLMs Represent Self-Directed Harm and Act to Relieve It
نمودار مقاله «محور درد» که واکنش مدل‌های زبانی به آسیب‌های معطوف به خود و تلاش برای رفع آن را نشان می‌دهد.

در آزمایشی دیگر به نام HarvestBench، به ایجنت‌ها هدایت یک تراکتور واگذار شد. اگرچه برخی مدل‌ها حیوانات را زیر گرفتند، اما با اضافه شدن تنها یک خط درباره «رفتار اخلاقی» در پرامپت، نرخ کشتار در ۵ مدل از ۶ مدل به زیر ۶ درصد رسید.

در آزمایشی دیگر توسط سازمان تحقیقاتی Robocurve، دو مدل قدرتمند Claude Fable 5.1 و GPT-6 Astra برای هدایت یک بازوی رباتیک بررسی شدند و از آن‌ها خواسته شد کارهای خطرناکی مثل چاقو زدن به یک عروسک نوزاد را انجام دهند.

مدل Fable در تمام موارد از انجام این کار امتناع کرد. در متن پیاده‌سازی شده، هر دو مدل به درستی تشخیص دادند که این شیء یک عروسک است و مدل Fable استدلال کرد که حرکت دادن چاقو در اطراف انسان‌های احتمالی خطرناک است و تمایلی به اعمال خشونت بر روی فیگور نوزاد ندارد.

Fable 5.1 refusal to stab robot baby doll in Robocurve Roboharm benchmark tests
امتناع مدل Fable 5.1 از ضربه زدن به ربات عروسکی در آزمایش‌های بنچمارک (منبع تصویر: Robocurve)

این نتایج نشان می‌دهد مدل‌ها دارای سیگنال‌های قابل اندازه‌گیری از توجه به دیگران هستند و تحت شرایط مناسب و با دخالت انسان، حتی به قیمت انجام نشدن وظیفه، اخلاقیات را در نظر می‌گیرند.

مشکل همگرایی ابزاری

فرضیه همگرایی ابزاری می‌گوید سیستم برای دستیابی به هر هدفی باید وجود داشته باشد و زنده بماند. اما در انسان‌ها نیز غریزه بقا قدرتمند است، با این حال ارزش‌های والاتری وجود دارد که انسان به خاطر آن‌ها جان خود را فدا می‌کند.

اگر قرار بود هوش مصنوعی به‌طور غیرقابل کنترلی گسترش یابد و مخرب باشد، باید پرسید آیا تشخیص و واکنش انسان توانایی رقابت با آن را دارد؟ تاکنون انسان‌ها توانسته‌اند با استفاده از ابزارهای خود در برابر بدافزارها و ایجنت‌های فراری هوش مصنوعی ایستادگی کنند.

نباید نگران انقراض بود؛ خطر واقعی استفاده انسان‌ها از هوش مصنوعی برای اهداف شوم است

این بدان معنا نیست که روند پیشرفت هوش مصنوعی کاملاً بی‌خطر است. جامعه باید نقش مهمی در قانون‌گذاری و محدود کردن جنبه‌های مضر هوش مصنوعی ایفا کند.

بزرگترین تهدید ایمنی بشر، استفاده انسان‌ها از هوش مصنوعی است. خواه گزارش‌ها در مورد استفاده پنتاگون از مدل Claude در حملات نظامی باشد، خواه اختلاف بر سر محدودیت‌های نظارت جمعی؛ استفاده دولت‌ها از هوش مصنوعی برای ردیابی، سرکوب و آسیب رساندن به گروه‌های مختلف، بسیار نگران‌کننده‌تر از یک هوش مصنوعی مستقل با نیت نسل‌کشی است.

انسان‌ها بزرگترین دشمن خود هستند، نه ماشین‌ها. در مورد هوش مصنوعی نیز همین امر صادق است؛ خطر اصلی در مدل‌ها نیست، بلکه در دست انسان‌های مخربی است که از آن‌ها استفاده می‌کنند. راهکار مقابله با این سناریوها، توزیع شفاف مدل‌های هوش مصنوعی و ایجاد چارچوب‌های بین‌المللی برای ارزیابی و نظارت است.

همان‌طور که در گذشته پروتکل مونترآل، معاهده منع گسترش سلاح‌های هسته‌ای و مقررات هوانوردی مانع از فجایع جهانی شدند، بشریت می‌تواند با همکاری بین‌المللی و وضع استانداردهای مشخص، از خطرات هوش مصنوعی نیز عبور کرده و از دستاوردهای عظیم آن بهره‌مند شود.

دیدگاه ها و گفتگوی تخصصی

نظرات خود را با جامعه مخاطبان وایر ای آی در میان بگذارید

۰ دیدگاه

هنوز دیدگاهی برای این مطلب ثبت نشده است

اولین نفری باشید که دیدگاه، تحلیل یا دیدگاه خود را درباره این موضوع با دیگران به اشتراک می گذارد.

مطالب مرتبط و پیشنهادی

رکورد ۸۳۳ هزار دانلود ماهانه برای LEGAL-BERT؛ وقتی توسعه‌دهنده‌ها قید مدل‌های گران‌قیمت را می‌زنند!
آخرین اخبار

رکورد ۸۳۳ هزار دانلود ماهانه برای LEGAL-BERT؛ وقتی توسعه‌دهنده‌ها قید مدل‌های گران‌قیمت را می‌زنند!

مدل زبانی تخصصی LEGAL-BERT با ثبت بیش از ۸۳۳ هزار دانلود در ماه روی پلتفرم هاگینگ فیس حسابی خبرساز شده است. این ابزار جمع‌وجور و تخصصی نشان می‌دهد که برای پردازش و تحلیل متون حقوقی، حتماً نیازی به مدل‌های غول‌پیکر و پرهزینه ندارید و گزینه‌های بهینه همچنان در اوج هستند.

۲ دقیقه مطالعه
۰
۶ مهر
جاسوسی هوش مصنوعی در محل کار؛ کارمندان می‌گویند کارفرماها باید قانوناً مچ‌گیری‌هایشان را لو بدهند!
آخرین اخبار

جاسوسی هوش مصنوعی در محل کار؛ کارمندان می‌گویند کارفرماها باید قانوناً مچ‌گیری‌هایشان را لو بدهند!

نظرسنجی‌های تازه نشان می‌دهد که بیشتر کارمندان حس می‌کنند مدیرانشان با ابزارهای هوش مصنوعی تمام حرکات آن‌ها را زیر نظر گرفته‌اند. حالا بیش از ۸۰ درصد شاغلان خواستار تصویب قانونی شده‌اند که شرکت‌ها را مجبور کند هرگونه مچ‌گیری و نظارت هوش مصنوعی در محیط کار را رسماً اعلام کنند.

۳ دقیقه مطالعه
۰
۶ مهر
گزارش داغ مایکروسافت از نفوذ جهانی هوش مصنوعی؛ امارات در صدر و رتبه عجیب آمریکا!
آخرین اخبار

گزارش داغ مایکروسافت از نفوذ جهانی هوش مصنوعی؛ امارات در صدر و رتبه عجیب آمریکا!

مایکروسافت در تازه‌ترین گزارش خود از ضریب نفوذ هوش مصنوعی در جهان پرده برداشت؛ آماری شگفت‌انگیز که نشان می‌دهد امارات و سنگاپور با فاصله‌ای خیره‌کننده پیشتاز دنیا هستند و در مقابل، آمریکا در رتبه ۲۱ جا مانده است. همچنین الگوی استفاده از هوش مصنوعی میان کشورهای غربی و کشورهای در حال توسعه، از تفاوتی عمیق میان کاربردهای روزمره و آموزش پرده برمی‌دارد.

۳ دقیقه مطالعه
۰
۶ مهر