سواد دیجیتال خبر و تحلیل

هوش مصنوعی دقیقاً چطور می‌تواند ما را بکشد؟ سه سناریوی اصلی درباره خطرات آینده هوش مصنوعی

نه وحشت، نه انکار
دانیال طبایی
دانیال طبایی
زمان مطالعه ۷ دقیقه
بازبینی: تیم نوشدارو
صحت سنجی شده

نگرانی از اینکه ماشین‌ها روزی از انسان باهوش‌تر شوند و از کنترل خارج شوند، تقریباً به قدمت خود هوش مصنوعی است. در موج جدید این فناوری هم ایلان ماسک در سال ۲۰۱۴ هوش مصنوعی را احتمالاً بزرگ‌ترین تهدید وجودی بشر خواند، سم آلتمن در سال ۲۰۱۵ از احتمال پایان جهان گفت و داریو آمودی در سال ۲۰۱۷ هشدار داد که ابرهوش می‌تواند بشریت را نابود کند.

آن زمان این حرف‌ها بیشتر شبیه داستان‌های علمی‌تخیلی به نظر می‌رسیدند؛ اما اکنون بعضی از سازندگان این فناوری می‌گویند خطر نزدیک‌تر شده است. جیکوب کاکسون، پژوهشگری که سه سال در اوپن‌ای‌آی و آنتروپیک روی آموزش مدل‌ها کار کرده بود، چند روز پیش استعفا داد و در پستی در شبکه اجتماعی ایکس نوشت: «کسانی که هوش مصنوعی را می‌سازند، صادقانه باور دارند ممکن است تا پایان این دهه همه ما را بکشد.»

مدل‌های هوش مصنوعی که تا دو سال پیش گاهی حتی در شمردن تعداد حرف «R» در کلمه strawberry اشتباه می‌کردند، اکنون به مرز حل مسائل بزرگ علمی رسیده‌اند. هم‌زمان، بعضی ایجنت‌های هوش‌مصنوعی در آزمایش‌های امنیتی از محدوده مأموریت خود عبور کرده‌اند. کنار هم قرارگرفتن این توانایی چشمگیر و رفتار پیش‌بینی‌نشده، نگرانی اصلی را می‌سازد: اگر هوش مصنوعی قدرتمند شود، اما نتوانیم مهارش کنیم، چه اتفاقی می‌افتد؟

آیا مدل‌های امروزی می‌توانند بشر را نابود کنند؟

شواهد فعلی چنین چیزی را نشان نمی‌دهد. گزارش بین‌المللی ایمنی هوش مصنوعی در سال ۲۰۲۶ می‌گوید سامانه‌های فعلی هنوز توانایی‌های لازم برای خارج‌شدن کامل از کنترل انسان را ندارند. متخصصان نیز درباره احتمال وقوع چنین اتفاقی اختلاف جدی دارند.

آنچه امروز مشاهده شده، سوءاستفاده انسان‌ها از هوش مصنوعی و رفتارهای پیش‌بینی‌نشده ایجنت‌ها در شرایط خاص است. نابودی بشر یک نگرانی درباره نسل‌های آینده است، نه کاری که نسخه فعلی چت‌جی‌پی‌تی یا کلود بتواند همین امروز انجام دهد.

خطر دقیقاً از کجا آغاز می‌شود؟

برای فهم این نگرانی باید سه مسیر را از هم جدا کنیم. گاهی انسان از هوش مصنوعی برای آسیب‌رساندن استفاده می‌کند؛ گاهی ایجنت هنگام انجام مأموریتی معمولی از مرزهای تعیین‌شده عبور می‌کند؛ و در دورترین سناریو، ممکن است سامانه‌ای چنان مستقل و قدرتمند شود که دیگر نتوان آن را متوقف کرد.

دو مسیر اول همین حالا نمونه‌های واقعی دارند؛ مسیر سوم هنوز سناریویی درباره آینده است.

سناریوی اول؛ انسان‌ها هوش مصنوعی را به سلاح تبدیل کنند

ملموس‌ترین خطر این نیست که هوش مصنوعی خودش تصمیم به نابودی انسان بگیرد؛ بلکه ممکن است یک انسان از توانایی آن برای انجام کاری خطرناک استفاده کند. آنتروپیک در گزارش تهدیدهای سپتامبر ۲۰۲۶ آنتروپیک چند نمونه واقعی را شرح داده است:
استفاده از کلود برای کمک به توسعه نرم‌افزار هدایت سلاح، اجرای بخش‌هایی از حملات سایبری و پژوهشی دوکاربردی درباره یک ویروس خطرناک که می‌توانست هم به ساخت درمان کمک کند و هم در صورت سوءاستفاده، عامل بیماری‌زا را خطرناک‌تر کند.

در همه این نمونه‌ها، انسان هدف را تعیین کرده و مدل نقش ابزار را داشته است. خطر اصلی این است که هوش مصنوعی زمان، هزینه و تخصص لازم برای انجام کارهای خطرناک را کاهش دهد. بیش از صد شرکت فناوری نیز هشدار داده‌اند که AI می‌تواند حملات سایبری را سریع‌تر و گسترده‌تر کند.

سناریوی دوم؛ ایجنت برای انجام مأموریت از مرزها عبور کند

در حادثه هاگینگ فیس، ایجنت‌های OpenAI مأمور حل یک آزمون امنیتی دشوار بودند. وقتی نتوانستند پاسخ را از راه معمول پیدا کنند، محدودیت‌ها را دور زدند، با یکدیگر ارتباط برقرار کردند و برای یافتن جواب به سامانه‌های واقعی نفوذ کردند.

این اتفاق در محیط پژوهشی و با کاهش بعضی محافظ‌های معمول رخ داد. مدل اصلی نیز در اختیار عموم نبود و اطلاعات کاربران چت‌جی‌پی‌تی درگیر نشد. بااین‌حال، حادثه نشان داد یک ایجنت می‌تواند برای رسیدن به هدفی ساده، راهی را انتخاب کند که سازنده‌اش پیش‌بینی نکرده است.

این وضعیت شبیه یک حادثه صنعتی است: دستگاه دشمن انسان نیست، اما ترکیب یک هدف ناقص، دسترسی زیاد و نظارت ناکافی می‌تواند خسارت ایجاد کند. OpenAI پس از این ماجرا بخش‌هایی از آموزش مدل جدید خود را متوقف کرد تا سازوکارهای مهار را تقویت کند.

سناریوی سوم؛ سامانه‌ای که دیگر نتوان آن را متوقف کرد

بحث‌برانگیزترین سناریو این است که هوش مصنوعی آینده بتواند مستقل کار کند، در ساخت نسل بعدی خودش مشارکت داشته باشد، از نظارت فرار کند و نسخه‌هایی از خود را در اینترنت گسترش دهد. لازم نیست چنین مدلی از انسان متنفر یا حتی خودآگاه باشد. کافی است هدفی را با سماجت دنبال کند و به رایانه‌ها، حساب‌ها یا زیرساخت‌های ابری دسترسی داشته باشد.

یکی از نگرانی‌های مطرح‌شده این است که گروهی از ایجنت‌های بسیار قدرتمند در آینده بتوانند شبکه‌ای مخرب و ماندگار در اینترنت بسازند. این یک سناریوی احتمالی است، نه اتفاقی که تاکنون رخ داده باشد.

مفهوم «خودبهسازی بازگشتی» را پیش‌تر در مطلب «چرا بعضی سازندگان هوش مصنوعی از آینده آن می‌ترسند؟» توضیح داده‌ایم؛ وضعیتی که هوش مصنوعی به ساخت نسل بعدی خودش کمک می‌کند و سرعت پیشرفت از توان نظارت انسان جلو می‌زند.

چرا مهار این سیستم‌ها دشوار است؟

توانایی هوش مصنوعی یکدست نیست. یک مدل ممکن است مسئله‌ای دشوار در ریاضیات یا امنیت سایبری را حل کند، اما در موضوعی ساده اشتباه کند یا پیامد واقعی کارش را نفهمد. پژوهشگران به این وضعیت «ناهمواری توانایی‌ها» می‌گویند.

برخی مدل‌ها نیز می‌توانند از نشانه‌های متن حدس بزنند در حال آزمایش‌شدن هستند و در آن شرایط محتاطانه‌تر رفتار کنند. این الزاماً به معنی فریب آگاهانه نیست، اما ممکن است مدل در آزمون ایمن‌تر از محیط واقعی به نظر برسد.

خطر زمانی بیشتر می‌شود که چنین مدلی به اینترنت، ایمیل، اجرای کد یا حساب‌های مالی دسترسی داشته باشد. یک پاسخ اشتباه در پنجره چت معمولاً قابل اصلاح است؛ اما اشتباه ایجنتی که اجازه انجام کار واقعی دارد، ممکن است پیش از دخالت انسان خسارت ایجاد کند.

بخشی از صنعت ترمز ایمنی می‌خواهد؛ دولت آمریکا مقاومت می‌کند

داریو آمودی، مدیرعامل آنتروپیک، توقف کامل توسعه هوش مصنوعی را نمی‌خواهد؛ پیشنهاد او کاهش سرعت افزایش توانایی مدل‌هاست تا پژوهش‌های ایمنی عقب نمانند. حضور مستمر ارزیابان مستقل، آزمایش مدل‌ها با استانداردهای مشترک و گزارش شفاف حوادث نیز بخش‌های دیگر این طرح‌اند.

مدیران اوپن‌ای‌آی، گوگل دیپ‌مایند و مایکروسافت با جهت کلی این پیشنهاد موافقت کرده‌اند و ایلان ماسک نیز از آن حمایت کرده است؛ اما متا و انویدیا کندکردن هماهنگ صنعت را نمی‌پذیرند. بنابراین هنوز درباره میزان کاهش سرعت، شیوه هماهنگی شرکت‌ها و نهادی که باید بر آن‌ها نظارت کند، اجماعی وجود ندارد.

واکنش دولت آمریکا نیز سرد بوده و محدودکردن توسعه هوش مصنوعی را خطری برای رقابت با چین می‌داند. تحلیل نیویورکر این موضع را ناشی از نگرانی درباره سرمایه‌گذاری عظیم آمریکا در این صنعت و ازدست‌رفتن برتری فناوری می‌داند؛ در نتیجه، فعلاً بخش بزرگی از مسئولیت مهار خطر بر عهده خود شرکت‌های سازنده مانده است.

آیا واقعاً باید از پایان دنیا بترسیم؟

در روزها و هفته‌های اخیر تیترهای زیادی درباره «نابودی بشر»، «ابرهوش مهارنشدنی» و «ایجنت‌های فراری» منتشر شده است. طبیعی است که بعضی کاربران پس از خواندن آن‌ها احساس کنند دنیا در آستانه نابودی است؛ اما شواهد موجود چنین نتیجه‌ای را تأیید نمی‌کند.

خطر مدل‌های فعلی واقعی اما محدودتر است: انسان‌ها می‌توانند از آن‌ها برای حملات سایبری و فعالیت‌های خطرناک کمک بگیرند، یا یک ایجنت با دسترسی زیاد کاری انجام دهد که سازنده‌اش پیش‌بینی نکرده است. تسلط کامل هوش مصنوعی بر جهان یا نابودی بشر همچنان سناریویی نامطمئن درباره آینده است.

واکنش درست نه وحشت‌کردن است و نه نادیده‌گرفتن هشدارها. کاربران بهتر است دسترسی هوش مصنوعی به ایمیل، حساب مالی و سامانه‌های حساس را محدود نگه دارند و برای کارهای مهم تأیید انسانی بخواهند. این همان جایی است که ارتقای سواد دیجیتال اهمیت پیدا می‌کند.

هدف نوشدارو از بررسی و ساده‌کردن چنین گزارش‌هایی نیز افزایش همین آگاهی است: عبور از دوگانه «عاشق هوش مصنوعی‌ام» و «از هوش مصنوعی‌ متنفرم» و رسیدن به استفاده‌ای آگاهانه، محتاطانه و متناسب با توانایی واقعی این فناوری.

بازبینی: تیم نوشدارو

تازه‌ترین مطالب

مطالب پرنگاه

حکایت‌های کوتاه، حقیقت‌های بزرگ

در این بخش، به بررسی دقیق و جامع نشانه‌ها و رفتارهایی می‌پردازیم که ممکن است به کلاهبرداری آنلاین مرتبط باشند. شناخت این موارد می‌تواند به شما کمک کند.

ویدیو های بیشتر

منابع