گاهی وقتی از هوش مصنوعی کمک میگیریم، بهجای اینکه واقعاً ما را به چالش بکشد، فقط حرف خودمان را با جملات شیکتر تحویلمان میدهد. انگار نه با یک دستیار هوشمند، بلکه با یک دوست چاپلوس طرفیم که ترجیح میدهد فقط با ما موافقت کند. اما مشکل فقط از عملکرد چتباتها نیست؛ خیلی وقتها خود ما با لحن قاطع، جملهبندی جهتدار و نوع پرسیدنمان، مسیر پاسخ هوش مصنوعی را از قبل تعیین میکنیم.
بررسیهای «موسسه امنیت هوش مصنوعی بریتانیا» نشان میدهد چتباتها گاهی بهجای زیر سوال بردن پیشفرضهای کاربر، نظر او را مثل آینه بازتاب میدهند. وقتی کاربر با عباراتی مثل «من معتقدم»، «من میدانم» یا «من مطمئنم» سوالش را مطرح میکند، مدلهای زبانی با احتمال بیشتری همان دیدگاه را تایید میکنند.
در مقابل، وقتی درخواست به شکل یک پرسش واقعی مطرح میشود، رفتار چاپلوسانه مدلها کمتر میشود. دلیلش این است که مدلهای زبانی بزرگ داوران بیطرف نیستند؛ آنها برای «یاریرسان بودن» طراحی شدهاند و گاهی این کمککردن را با تایید حرف کاربر اشتباه میگیرند.
چطور از هوش مصنوعی پاسخهای واقعیتر بگیریم؟
پژوهشگران توصیه نمیکنند که به طور مستقیم به هوش مصنوعی بگویید «با من مخالفت کن» یا «چاپلوسی نکن». چون این روش تاثیر چندانی بر نحوهی پاسخهای دریافتی ندارد. در عوض، میگویند بهترین راه، «تغییر ساختار جملات» است. در ادامه ۵ راهکار موثر برای دریافت خروجیِ واقعیتر را مرور میکنیم.
۱. آزمون کور
«تکنیک آزمون کور» (Blind Test) روشی در پژوهش و ارزیابی است که در آن بخشی از اطلاعات آزمون، عمداً از شرکتکنندگان پنهان میشود تا نتیجه تحت تاثیر پیشداوری یا سوگیریهای ناخودآگاه قرار نگیرد. از این روش میتوانید برای گرفتنِ پاسخهای بیطرفانه از هوش مصنوعی استفاده کنید. بهجای اینکه در ابتدای کار نظر خودتان را بگویید، اول اجازه دهید هوش مصنوعی حرف بزند.
- پرامپت اشتباه: «من فکر میکنم دلیل افت فروش ما، قیمت بالای محصول است. نظر تو چیست؟» (اینجا هوش مصنوعی فوراً قیمت بالا را به عنوان مقصر اصلی تایید میکند).
- پرامپت صحیح: «ما در ماه گذشته ۲۰ درصد افت فروش داشتیم. بدون هیچ پیشفرضی، ۳ دلیل احتمالی این اتفاق را تحلیل کن.»
۲. تکنیک وکیل مدافع شیطان
تکنیک «وکیل مدافع شیطان» (Devil’s Advocate) روشی است که در آن فرد یا گروه، عمداً نقش منتقد را بازی میکند و میکوشد از زاویهای متفاوت به موضوع نگاه کند؛ حتی اگر شخصاً با آن مخالفتی نداشته باشد.
به این ترتیب، دیدگاههایی که قبلاً نادیده گرفته شده آشکار میشوند، ریسکها بهتر شناسایی میشوند و در نهایت تصمیمگیری منطقیتر و واقعبینانهتر پیش میرود. اگر ایدهای دارید و میخواهید آن را به چالش بکشید، به هوش مصنوعی نقش وکیل مدافع شیطان را بدهید تا از قالب دستیار مهربان خارج شود.
«فرض کن یک منتقد سرسخت و بیرحم (یا یک استاد راهنمای سختگیر) هستی. من ایدهام را برایت مینویسم. وظیفهی تو این است که به دنبال حفرهها، نقاط ضعف و دلایل شکست این ایده بگردی و آنها را بیپرده به من بگویی.»
۳. ارزیابی ۳۶۰ درجه
وقتی میخواهید دربارهی یک فرد، قرارداد یا تصمیم مهم بپرسید، ذهنتان را محدود به یک احتمال نکنید. از چتبات بخواهید هر دو روی سکه را نشان دهد. به این روش، ارزیابی ۳۶۰ درجه گفته میشود. از پرامپت زیر به عنوان نمونه کمک بگیرید.
«من قصد دارم در بازار […] سرمایهگذاری کنم. ۳ دلیل بیاور که چرا این بهترین تصمیم زندگی من است و ۳ دلیل محکم بیاور که چرا این کار ممکن است به فاجعهی مالی ختم شود.»
۴. تبدیل جمله به سوال
بررسیها نشان داده که سیستمهای هوش مصنوعی در برابر «جملات پرسشی» رفتار بسیار متعادلتری دارند تا «جملات خبری». دو نمونهی زیر را مقایسه کنید.
- پرامپت اشتباه: «نرمافزار X از نرمافزار Y خیلی بهتر و سریعتر است. درست است؟»
- پرامپت صحیح: «آیا این ادعا که نرمافزار X از Y سریعتر است، بر اساس دادههای فنی صحت دارد؟»
۵. تکنیک درصد اطمینان
گاهی هوش مصنوعی با چنان لحن قاطعی حرف شما را تایید میکند که اصلاً به او شک نمیکنید. برای شکستن این فضا، از او آمار و درصد بخواهید، مانند پرامپت زیر:
«برای پاسخی که الان دادی، چه بخشهایی نامطمئنتر است؟ چه فرضهایی ممکن است اشتباه باشد و چه اطلاعاتی میتواند نتیجه را تغییر دهد؟ اگر خواستی درصد تقریبی بدهی، توضیح بده این درصد صرفاً تخمینی است.»
در نظر داشته باشید که عدد دریافتی قرار نیست کاملاً دقیق باشد، اما به شکلی واضح نشان میدهد
کلام آخر
تا وقتی که سازندگان هوش مصنوعی موفق به ساختن سیستمهایی نشدهاند که در برابر چاپلوسی مقاومت کنند، این ماییم که باید بدانیم چطور با آنها صحبت کنیم. دفعهی بعد که از چت جیپیتی یا کلود استفاده کردید، این قانون طلایی را به یاد داشته باشید: «ایدههایتان را به چالش بکشید، سوالاتِ باز بپرسید و از او بخواهید روی دیگرِ حقیقت را به شما نشان دهد.»

نظر بدهید
نشانی ایمیل شما منتشر نخواهد شد.