13:02 25 / 06 /1405

پیمانکاران اوپن‌ای‌آی بعضی چت‌های واقعی کاربران را بررسی می‌کنند

مطالعه چت‌های کاربران با هوش مصنوعی
گزارشی تازه از پروژه‌ای داخلی با نام «لیلی» حاکی از آن است که صدها پیمانکار اوپن‌ای‌آی پیام‌های واقعی برخی کاربران چت‌جی‌پی‌تی را می‌خوانند و پاسخ‌های تولیدشده را ارزیابی می‌کنند تا عملکرد مدل‌ها بهبود پیدا کند. نام کاربری افراد در اختیار ارزیابان قرار نمی‌گیرد و اوپن‌ای‌آی از فیلتری خودکار برای حذف اطلاعات شخصی استفاده می‌کند، اما تأکید دارد کاربران نباید اطلاعات حساسی را وارد چت‌جی‌پی‌تی کنند که نمی‌خواهند در فرایند بهبود مدل بررسی شود.

به گزارش خبرگزاری آنا؛ ۴۰۴ مدیا براساس اسناد داخلی، دستورالعمل‌های کاری و نمونه‌هایی از پیام‌های واقعی کاربران گزارش داده که پیمانکاران پروژه لیلی ابتدا درخواست کاربر را می‌خوانند، هدف او را خلاصه می‌کنند و سپس چند پاسخ چت‌جی‌پی‌تی را از نظر کیفیت بررسی و امتیازدهی می‌کنند. هدف این فرایند فقط پیدا کردن پاسخ درست یا غلط نیست و ارزیابان مواردی مانند لحن بیش از حد تأییدکننده، استفاده زیاد از ایموجی، شیوه نگارش مصنوعی و میزان طبیعی و حرفه‌ای بودن پاسخ‌ها را نیز بررسی می‌کنند. طبق این گزارش، اوپن‌ای‌آی صد‌ها پیمانکار را برای چنین کاری به خدمت گرفته و بعضی نمونه‌های ارسالی برای ارزیابی شامل بخش بزرگی از یک گفت‌وگوی واقعی میان کاربر و چت‌جی‌پی‌تی بوده‌اند.

پیام‌ها بدون نام کاربری در اختیار ارزیاب قرار می‌گیرند

به گفته ۴۰۴ مدیا، صفحه‌ای که پیمانکاران در آن پیام‌ها را بررسی می‌کنند نام کاربری صاحب گفت‌و‌گو را نمایش نمی‌دهد و داده‌ها پیش از رسیدن به ارزیابان تا حدی ناشناس‌سازی می‌شوند. اوپن‌ای‌آی نیز رسماً توضیح داده که پیش از استفاده از اطلاعات در فرایند آموزش، ابزار «فیلتر حریم خصوصی» را برای پیدا کردن و پوشاندن اطلاعات شخصی به کار می‌گیرد و همین ابزار روی گفت‌و‌گو‌های کاربرانی که اجازه استفاده از چت‌هایشان برای بهبود مدل را داده‌اند نیز اجرا می‌شود. با این حال، ناشناس‌سازی نام حساب لزوماً به معنای حذف تمام اطلاعات هویتی داخل متن نیست و اگر کاربر در خود پیام نام، محل کار، نشانی، جزئیات پزشکی یا اطلاعات شخصی دیگری نوشته باشد، ممکن است بخشی از این اطلاعات از فیلتر عبور کند.

همین مسئله اهمیت بیشتری پیدا می‌کند، زیرا کاربران چت‌جی‌پی‌تی فقط برای پرسش‌های عمومی از آن استفاده نمی‌کنند و گاهی اطلاعات کاری، مالی، خانوادگی یا پزشکی خود را نیز وارد گفت‌و‌گو می‌کنند. اوپن‌ای‌آی در توضیحات رسمی حریم خصوصی خود صراحتاً توصیه کرده کاربران اطلاعات حساسی را که نمی‌خواهند استفاده یا بررسی شود در چت‌جی‌پی‌تی وارد نکنند.

تنظیم استفاده از چت‌ها برای آموزش

در حساب‌های شخصی چت‌جی‌پی‌تی شامل نسخه‌های رایگان، پلاس و پرو، استفاده از محتوا برای بهبود مدل‌ها به‌صورت پیش‌فرض فعال است. کاربر می‌تواند از بخش کنترل داده‌ها گزینه «بهبود مدل برای همه» را خاموش کند و اوپن‌ای‌آی می‌گوید پس از این تغییر، گفت‌و‌گو‌های جدید دیگر برای آموزش مدل‌ها استفاده نمی‌شوند و همچنان در تاریخچه حساب باقی خواهند ماند. این توضیح به‌طور مشخص درباره چت‌های جدید پس از خاموش کردن گزینه صحبت می‌کند و به همین دلیل تغییر تنظیمات را نباید به‌معنای حذف خودکار داده‌هایی دانست که پیش‌تر وارد فرایند آموزش شده‌اند.

کاربرانی که نمی‌خواهند یک گفت‌و‌گو برای بهبود مدل‌ها استفاده شود می‌توانند از چت موقت نیز استفاده کنند. این گفت‌و‌گو‌ها در تاریخچه عادی ذخیره نمی‌شوند، حافظه ایجاد نمی‌کنند و برای آموزش مدل‌ها مورد استفاده قرار نمی‌گیرند، هرچند اوپن‌ای‌آی آن‌ها را تا ۳۰ روز برای اهداف ایمنی نگه می‌دارد.

پروژه لیلی چگونه کار می‌کند

براساس اسناد بررسی‌شده توسط ۴۰۴ مدیا، پیمانکار پس از دریافت یک درخواست واقعی ابتدا باید توضیح دهد کاربر چه چیزی می‌خواهد و سپس چند پاسخ تولیدشده را نقد و ارزیابی کند. در برخی پروژه‌ها این پاسخ‌ها با مقیاس یک تا هفت امتیاز می‌گیرند و هدف آن است که مدل در نمونه‌های بعدی پاسخ‌هایی طبیعی‌تر، دقیق‌تر و کم‌اغراق‌تر ارائه کند. این نوع بازبینی انسانی بخشی از فرایند آموزش و ارزیابی مدل‌هاست و با بررسی‌هایی که ممکن است برای اجرای سیاست‌های ایمنی یا رسیدگی به سوءاستفاده انجام شود تفاوت دارد. ۴۰۴ مدیا همچنین گزارش داده مدل مشخصی که داده‌های پروژه لیلی برای آموزش آن استفاده می‌شوند در اسناد فاش‌شده مشخص نشده است.

استفاده از نیروی انسانی برای بررسی گفت‌و‌گو‌های هوش مصنوعی منحصر به اوپن‌ای‌آی نیست. گوگل در اطلاعیه حریم خصوصی جمینای به‌طور مستقیم توضیح داده که بخشی از چت‌های ذخیره‌شده توسط ارزیابان انسانی و کارکنان شرکت‌های خدماتی بررسی می‌شوند تا کیفیت پاسخ‌ها و ایمنی مدل‌ها بهتر شود و این چت‌ها پیش از ارسال برای ارزیابان از حساب کاربر جدا می‌شوند. ۴۰۴ مدیا نیز گزارش داده آنتروپیک استفاده از بازبینی انسانی برای بهبود مدل‌های خود را تأیید کرده است.

تفاوت میان «ماشین می‌خواند» و «انسان ممکن است بخواند»

اصل استفاده از گفت‌و‌گو‌های کاربران برای آموزش مدل‌های شخصی چت‌جی‌پی‌تی موضوع تازه‌ای نیست و اوپن‌ای‌آی مدت‌هاست امکان خاموش کردن آن را در تنظیمات ارائه می‌کند. بخش تازه گزارش پروژه لیلی بیشتر به مرحله انسانی این فرایند مربوط می‌شود و نشان می‌دهد بخشی از داده‌هایی که برای بهبود مدل انتخاب می‌شوند ممکن است بعد از عبور از فیلتر‌های حریم خصوصی به دست یک ارزیاب واقعی نیز برسند. در نتیجه کاربری که گزینه استفاده از چت‌ها برای بهبود مدل را روشن نگه می‌دارد نباید فرض کند محتوای گفت‌و‌گو در تمام مراحل فقط توسط سامانه‌های خودکار پردازش خواهد شد.

انتهای پیام/

ارسال نظر