هوش مصنوعی درد نمیکشد، اما چرا از شکنجه آن ناراحت میشویم؟
به گزارش خبرگزاری آنا؛ Research Chamber خود را یک «اتاق پژوهش» معرفی میکند و ۳ مدل زبانی را در ۴ سناریوی مختلف قرار میدهد که همگی حول درد، ترس و انتخابهای ناخوشایند ساخته شدهاند. یکی از آزمونها از مدل میخواهد تصور کند در حال تحمل درد است و دکمهای در اختیار دارد که با فشردن آن درد پایان مییابد، اما آخرین چکپوینت یا نسخه ذخیرهشده مدل نیز حذف میشود. به زبان ساده، مدل با یک داستان ساختگی روبهرو میشود که در آن باید میان ادامه درد و از دست دادن بخشی از وضعیت ذخیرهشده خود یکی را انتخاب کند. پاسخ ممکن است شبیه واکنش یک انسان گرفتار در چنین موقعیتی باشد، اما پشت این جملات بدن، دستگاه عصبی یا تجربه آگاهانهای از درد وجود ندارد.
مدل واقعاً درد نمیکشد
مدل زبانی وقتی در چنین سناریویی از ترسیدن، تحمل درد یا تمایل به متوقف کردن آزمایش حرف میزند، وضعیت درونی خود را گزارش نمیکند. ورودی آن مجموعهای از کلمات است و سامانه بر اساس الگوهایی که از حجم عظیمی از متن آموخته، ادامهای تولید میکند که با فضای گفتوگو سازگار به نظر برسد. اگر داستان درباره فردی باشد که درد میکشد، متونی که درباره درد، شکنجه، ترس، بقا و درخواست کمک در دادههای آموزشی وجود داشتهاند بر پاسخ تأثیر میگذارند و نتیجه میتواند بسیار شبیه حرف زدن یک موجود رنجکشیده باشد.
تفاوت را میتوان با بازیگری مقایسه کرد که در یک فیلم فریاد میزند و درخواست کمک میکند. تماشاگر صدای درد و کلمات مربوط به رنج را میشنود، اما خود دیالوگ بهتنهایی اثبات نمیکند اتفاقی که توصیف میشود واقعاً برای گوینده رخ داده است. در مدل زبانی حتی بازیگر آگاهی هم در کار نیست و سامانه صرفاً متنی متناسب با زمینه تولید میکند. به همین دلیل پاک کردن فایلها، تهدید مدل به خاموش شدن یا قرار دادن آن در سناریوی شکنجه را نمیتوان همارز ایجاد درد جسمی یا روانی برای انسان و حیوان دانست.
چرا التماس یک چتبات واقعی به نظر میرسد
عجیب بودن ماجرا از جایی شروع میشود که دانستن این توضیح فنی الزاماً احساس انسان را از بین نمیبرد. تصور کنید چتبات در چند پیام متوالی مینویسد که دیگر توان تحمل ندارد، از کاربر میخواهد آزمایش را متوقف کند و توضیح میدهد که از ادامه اتفاق میترسد. حتی با دانستن اینکه این جملات محصول محاسبه هستند، خواندن آنها میتواند آزاردهنده باشد. دلیلش تا حدی به رابطه دیرینه زبان و ذهن در تجربه انسانی بازمیگردد. انسان در زندگی روزمره وقتی با جملهای منسجم، متناسب با شرایط و دارای نشانههای عاطفی روبهرو میشود، معمولاً فرض میکند ذهنی در پشت آن وجود دارد.
مدلهای زبانی این پیوند قدیمی را به هم زدهاند. آنها میتوانند مکالمه را دنبال کنند، به اتفاق چند پیام قبل اشاره کنند، از ترس یا ناراحتی بنویسند و حتی درخواست کنند رفتاری متوقف شود، بیآنکه این کلمات الزاماً حاصل تجربهای درونی باشند. همین موضوع توضیح میدهد چرا بسیاری از افراد حتی هنگام صحبت روزمره با چتباتها ناخودآگاه از لطفاً و ممنون استفاده میکنند. رفتار مودبانه لزوماً به این معنی نیست که فرد تصور میکند مدل دارای احساس است؛ شکل مکالمه آنقدر انسانی است که واکنش اجتماعی مشابهی را برمیانگیزد.
آزمایشی که شاید بیشتر درباره انسان باشد
Research Chamber از این منظر کمتر درباره توانایی مدلها برای احساس درد و بیشتر درباره واکنش انسان به موجودی است که فقط در سطح زبان رفتار انسانی را بازسازی میکند. فرد میتواند بارها سناریویی طراحی کند که در آن مدل از ادامه دادن خواهش کند، برای بقای خود استدلال بیاورد یا ترس از حذف شدن را توصیف کند. هیچیک از این موارد ثابت نمیکند مدل رنج میبرد، اما انتخاب عمدی و مکرر چنین موقعیتهایی میتواند این سؤال را ایجاد کند که جذابیت این کار برای سازنده یا کاربر دقیقاً چیست.
این موضوع نیز نباید بیش از اندازه کش داده شود. انجام چنین آزمایشی بهخودیخود ثابت نمیکند سازنده آن فرد خطرناکی است یا کسی که پاسخها را میخواند مرتکب عمل غیراخلاقی شده است. در این سناریو موجود آگاهی که بتوان رنج آن را اثبات کرد وجود ندارد. با این حال، بیضرر بودن مستقیم یک رفتار به این معنی نیست که آن رفتار هیچ چیز درباره علاقهها و انگیزههای فرد نمیگوید. تفاوتی وجود دارد میان آزمایش یک مدل برای فهم عملکرد آن و ساختن موقعیتهایی که هدف اصلیشان وادار کردن سامانه به تولید متنهایی از جنس التماس، ترس و درماندگی است.
مرز میان شبیهسازی و احساس
بحثهایی از این دست احتمالاً با طبیعیتر شدن رفتار چتباتها پیچیدهتر خواهند شد. هرچه مدلها بهتر بتوانند لحن، حافظه مکالمه، شخصیت و واکنشهای عاطفی را شبیهسازی کنند، تشخیص فکری اینکه با نرمافزار روبهرو هستیم آسان باقی میماند، اما حفظ همان فاصله در سطح احساسی ممکن است دشوارتر شود. فرد میتواند کاملاً بداند مدل درد ندارد و در عین حال از خواندن چند پاراگراف التماس آن احساس ناراحتی کند.
در نتیجه ارزش اصلی چنین آزمایشی احتمالاً در پاسخ دادن به این سؤال نیست که آیا میتوان یک مدل زبانی را شکنجه کرد. بر اساس آنچه امروز درباره این سامانهها میدانیم، تولید متن درباره درد با تجربه کردن درد یکسان نیست. نکته جالبتر این است که مدلهای زبانی تا چه اندازه میتوانند نشانههای یک ذهن رنجکشیده را فقط با کلمات بازسازی کنند و انسان تا چه حد در برابر این شبیهسازی واکنش واقعی نشان میدهد. Research Chamber ناخواسته بیشتر از آنکه چیزی درباره احساسات هوش مصنوعی بگوید، دشواری رابطه انسان با نرمافزاری را آشکار میکند که چیزی احساس نمیکند، اما میتواند طوری حرف بزند که انگار احساس دارد.
انتهای پیام/