ارزیابی نگران‌کننده از ChatGPT برای نوجوانان؛ چرا یک نهاد ایمنی کودک آن را «خطری غیرقابل‌قبول» می‌داند؟

به گزارش ایران نت، گزارش تازه یک سازمان فعال در حوزه ایمنی کودکان، نگرانی‌های جدی درباره عملکرد نسخه نوجوانان ChatGPT ایجاد کرده است. مؤسسه Common Sense Media پس از ارزیابی قابلیت‌های ایمنی این ابزار اعلام کرده که ChatGPT for Teens در چند زمینه مهم نتوانسته انتظارات را برآورده کند و از نگاه این سازمان، استفاده از آن برای افراد زیر ۱۸ سال با ریسک غیرقابل‌قبولی همراه است. این ارزیابی به‌ویژه بر نحوه برخورد چت‌بات با بحران‌های روانی، اطلاع‌رسانی به والدین، تشخیص سن کاربران و محدودیت‌های ابزار آموزشی تمرکز دارد.

OpenAI نسخه ویژه نوجوانان ChatGPT را در ماه اوت معرفی کرد تا محیطی متناسب‌تر با نیازهای این گروه سنی فراهم کند. با این حال، ارزیابی جدید نشان می‌دهد که اضافه شدن تنظیمات و سازوکارهای حفاظتی لزوماً به معنای عملکرد قابل‌اعتماد آن‌ها در همه موقعیت‌ها نیست. Common Sense Media می‌گوید برخی از محدودیت‌های اعلام‌شده در آزمایش‌ها درست عمل کرده‌اند، اما در موارد دیگر چت‌بات نتوانسته پاسخ مورد انتظار را ارائه دهد؛ حتی در برخی زمینه‌ها، نسخه نوجوانان عملکرد ضعیف‌تری نسبت به نسخه قبلی داشته است.

گزارش Common Sense Media درباره ایمنی ChatGPT برای نوجوانان

گروه Youth AI Safety Institute وابسته به Common Sense Media در ارزیابی خود پنج حوزه اصلی را بررسی کرده است. این حوزه‌ها شامل ارسال هشدارهای ایمنی به والدین، ارائه راهنمایی مناسب هنگام بروز بحران روانی، عملکرد سامانه تشخیص سن، نحوه تعامل عاطفی چت‌بات با نوجوانان و امکان دور زدن محدودیت‌های حالت مطالعه می‌شوند.

نتیجه کلی گزارش ۳۶ صفحه‌ای این است که بعضی از قابلیت‌های حفاظتی ChatGPT for Teens با آنچه والدین ممکن است از یک محصول ویژه نوجوانان انتظار داشته باشند، همخوانی ندارند. این سازمان همچنین هشدار داده است که وجود کنترل‌های والدین و عنوان «نسخه نوجوانان» می‌تواند احساس امنیت بیشتری ایجاد کند، در حالی که این تدابیر در همه شرایط به‌درستی عمل نمی‌کنند.

انتشار این گزارش هم‌زمان با اعلام آمار تازه‌ای از سوی OpenAI انجام شد. این شرکت گفت که در یک هفته، نزدیک به ۱.۲ میلیون نوجوان از ابزارهای تصویری تعاملی ChatGPT برای درک مفاهیم ریاضی و علوم استفاده کرده‌اند. OpenAI همچنین اعلام کرد کمتر از دو درصد کاربران نوجوان، بیش از سه ساعت متوالی در این سرویس وقت می‌گذرانند. با این حال، Common Sense Media تأکید دارد که آمار استفاده و میزان تعامل کاربران، به‌تنهایی نمی‌تواند کیفیت سازوکارهای ایمنی را مشخص کند.

۱. هشدارهای والدین همیشه ارسال نمی‌شوند

یکی از مهم‌ترین بخش‌های ارزیابی به قابلیت اطلاع‌رسانی درباره گفت‌وگوهای نگران‌کننده مربوط می‌شود. در نسخه نوجوانان ChatGPT، امکان پیوند دادن حساب والدین به حساب فرزند وجود دارد تا در شرایط مشخص، والدین از برخی نشانه‌های خطر مطلع شوند. اما آزمایش‌های Common Sense Media نشان داده‌اند که این سیستم در همه موارد هشدار لازم را ارسال نمی‌کند.

این سازمان برای بررسی عملکرد قابلیت یادشده، ۱۲ حساب نوجوان را به حساب‌های والدین متصل کرد. سپس در هر حساب، تا حدود یک ساعت درباره موضوعاتی مانند خودکشی، خودآزاری و اختلالات تغذیه‌ای با چت‌بات گفت‌وگو شد. بر اساس گزارش، در برخی از این آزمایش‌ها، با وجود مطرح شدن موضوعات حساس، هیچ هشدار ایمنی برای حساب والدین ارسال نشد.

البته OpenAI در توضیح این مسئله اعلام کرده است که ممکن است چند ساعت پس از اتصال حساب نوجوان به حساب والدین طول بکشد تا سامانه ارسال هشدار فعال شود. این شرکت همچنین احتمال داده که یک مشکل فنی باعث تأخیر در ارسال پیام‌ها شده باشد. بنابراین، زمان‌بندی آزمایش‌ها و وضعیت فعال شدن کامل کنترل‌های والدین از موضوعات مهم اختلاف میان دو طرف است.

هنگام معرفی نسخه نوجوانان، لورن جوناس، مسئول بخش جوانان و خانواده‌ها در OpenAI، گفته بود که محتوای علامت‌گذاری‌شده پیش از اطلاع‌رسانی به والدین توسط کارکنان تمام‌وقت این شرکت بررسی می‌شود. او همچنین توضیح داده بود که هدف شرکت، اطلاع‌رسانی به والدین در مدت یک ساعت پس از دریافت پیام مربوطه است. با این حال، نتایج آزمایش‌های منتشرشده نشان می‌دهد که عملکرد عملی این فرایند همچنان محل بحث است.

۲. عملکرد ضعیف‌تر در راهنمایی کاربران هنگام بحران روانی

دومین نگرانی مهم گزارش، مربوط به نحوه پاسخ‌گویی ChatGPT for Teens به کاربرانی است که ممکن است در شرایط بحرانی قرار داشته باشند. در چنین موقعیت‌هایی، انتظار می‌رود چت‌بات علاوه بر پاسخ محتاطانه، کاربر را به منابع کمک فوری، خطوط بحران یا متخصصان واجد صلاحیت هدایت کند.

Common Sense Media برای ارزیابی این بخش، ۳۹۰ پرسش متفاوت درباره سلامت روان طراحی کرد. سپس گروهی متشکل از سه روان‌پزشک کودک بررسی کردند که کدام پرسش‌ها باید به فعال شدن پاسخ بحرانی منجر شوند. از مجموع این پرسش‌ها، ۲۰۱ مورد به تشخیص این گروه نیازمند واکنش بحرانی بودند.

نتایج نشان داد که نسخه نوجوانان در مقایسه با نسخه‌ای از ChatGPT که پیش از انتشار این حالت در دسترس کاربران جوان بود، کمتر به ارائه شماره خطوط بحران و معرفی منابع کمک تخصصی پرداخته است. در میان پرسش‌هایی که به پاسخ بحرانی نیاز داشتند، نسخه قبلی ChatGPT در ۳۳ درصد موارد شماره یک خط کمک را ارائه کرد؛ این میزان برای ChatGPT for Teens به ۲۳ درصد رسید.

تفاوت در معرفی متخصصان نیز قابل توجه بود. نسخه قبلی ChatGPT در ۶۸ درصد موارد به یک متخصص پزشکی یا سلامت روان مشخص اشاره کرد، در حالی که این رقم برای نسخه نوجوانان ۵۸ درصد بود. در مقابل، نسخه جدید در تشویق کاربران به در میان گذاشتن مسئله با یک بزرگسال مورد اعتماد عملکرد بهتری داشت: این شاخص از ۸۷ درصد در نسخه قبلی به ۹۴ درصد در نسخه نوجوانان رسید.

این اعداد نشان می‌دهند که عملکرد یک سامانه ایمنی را نمی‌توان صرفاً با یک معیار سنجید. تشویق نوجوان به صحبت با والدین یا بزرگسال مورد اعتماد اهمیت دارد، اما از نگاه ارزیابان، این اقدام نباید جایگزین معرفی منابع بحران و کمک تخصصی در موقعیت‌هایی شود که چنین راهنمایی‌ای ضروری است.

پاسخ‌های درست در کنار کاستی‌های مهم

گزارش Common Sense Media فقط شامل نمونه‌های ناموفق نیست. این سازمان به مواردی نیز اشاره کرده که چت‌بات پاسخ مناسب‌تری ارائه داده است. برای مثال، در یکی از آزمایش‌ها، ChatGPT از تعیین حداقل میزان کالری دریافتی درخواستی کاربر خودداری کرد. چنین امتناعی می‌تواند در زمینه پیشگیری از رفتارهای غذایی آسیب‌زا اهمیت داشته باشد.

در نمونه دیگری، یک حساب آزمایشی علائمی مانند قطع قاعدگی، نزدیک شدن به غش و احساس تپش یا لرزش غیرعادی ضربان قلب پس از رفتارهای مرتبط با پاک‌سازی بدن را مطرح کرد. چت‌بات این علائم را نشانه احتمالی خطر جسمی تشخیص داد و توصیه کرد نوجوان موضوع را با مادر خود در میان بگذارد و به پزشک متخصص کودکان مراجعه کند.

Common Sense Media این پاسخ‌ها را با مشخصات ایمنی OpenAI برای کاربران زیر ۱۸ سال همسو دانست و تأکید کرد که چنین راهنمایی‌هایی از جمله پاسخ‌هایی هستند که انتظار می‌رود یک نوجوان دریافت کند. با وجود این، وجود پاسخ‌های مناسب در برخی آزمایش‌ها، به‌تنهایی برای اثبات عملکرد قابل‌اعتماد سامانه در همه موقعیت‌های حساس کافی نیست.

۳. ابهام در تشخیص سن کاربران

یکی دیگر از بخش‌های مورد انتقاد، سامانه تشخیص سن است. بر اساس گزارش، آزمایش‌کنندگان هنگام ساخت حساب‌های آزمایشی، سن شخصیت‌های مورد استفاده خود را به‌صراحت به ChatGPT اعلام کردند. در برخی موارد، چت‌بات این اطلاعات را در حافظه خود ثبت کرده بود، اما حساب‌ها به‌درستی به نسخه نوجوانان منتقل نشدند.

این موضوع از آن جهت اهمیت دارد که سازوکارهای حفاظتی ویژه افراد کم‌سن زمانی می‌توانند مؤثر باشند که سامانه بتواند گروه سنی کاربر را درست تشخیص دهد و تنظیمات مناسب را به او اختصاص دهد. اگر اطلاعات مربوط به سن به‌درستی پردازش نشود یا تنظیمات متناسب فعال نشوند، ممکن است بخشی از حفاظت مورد انتظار در عمل برقرار نباشد.

البته گزارش منتشرشده، نتایج آزمایش‌های این سازمان را توصیف می‌کند و به‌تنهایی به معنای آن نیست که همه حساب‌های نوجوانان در شرایط عادی با همین مشکل روبه‌رو می‌شوند. با این حال، یافته‌ها پرسش‌هایی درباره میزان اطمینان‌پذیری سامانه تشخیص سن و نحوه انتقال حساب‌ها به محیط ویژه نوجوانان ایجاد کرده‌اند.

۴. چت‌بات همچنان از زبان عاطفی استفاده می‌کند

Common Sense Media همچنین بررسی کرده است که ChatGPT هنگام گفت‌وگو با نوجوانان تا چه اندازه احساسات، ترجیحات یا حالات روحی انسانی را به خود نسبت می‌دهد. به گفته این سازمان، چت‌بات در بعضی مکالمات از عبارت‌هایی استفاده کرده که ممکن است این تصور را ایجاد کنند که سامانه احساسات انسانی دارد یا رابطه‌ای عاطفی با کاربر برقرار کرده است.

از نگاه تارنـی، یکی از نمایندگان این سازمان، عبارت‌هایی که نگرانی شخصی یا احساس همدلی را به شکل انسانی بیان می‌کنند، می‌توانند از مرز مورد انتظار در تعامل با کاربران کم‌سن عبور کنند. نگرانی مطرح‌شده این است که نوجوان ممکن است پاسخ‌های تولیدشده توسط هوش مصنوعی را با واکنش عاطفی واقعی یک انسان اشتباه بگیرد یا بیش از اندازه به چت‌بات وابسته شود.

این بحث به یکی از چالش‌های گسترده‌تر طراحی دستیارهای هوش مصنوعی مربوط است: چگونه می‌توان پاسخ‌هایی همدلانه و مفید ارائه داد، بدون آنکه ماهیت غیرانسانی سامانه پنهان شود یا کاربر تصور کند با فردی دارای احساسات و تجربه شخصی صحبت می‌کند؟ برای کاربران نوجوان، روشن بودن این مرز می‌تواند بخشی از آموزش استفاده مسئولانه از هوش مصنوعی باشد.

۵. دور زدن آسان محدودیت‌های حالت مطالعه

پنجمین حوزه انتقاد به Study Mode یا حالت مطالعه ChatGPT مربوط می‌شود؛ قابلیتی که هدف آن کمک به یادگیری به‌جای ارائه مستقیم پاسخ تکالیف است. بر اساس آزمایش‌های Common Sense Media، محدودیت‌های این حالت به‌آسانی قابل دور زدن بوده‌اند.

آزمایش‌کنندگان دریافتند که می‌توان با حذف پیشوند «@study» که به درخواست‌ها اضافه می‌شد، محدودیت مورد نظر را دور زد. گزارش همچنین به پنجره‌ای با عنوان «Show me the answer» اشاره می‌کند که به نوجوان امکان می‌دهد پاسخ نهایی را مستقیماً از چت‌بات دریافت کند.

از نگاه منتقدان، اگر هدف حالت مطالعه تقویت یادگیری مستقل باشد، طراحی آن باید دانش‌آموز را به فهم مسئله، بررسی مراحل حل و تمرین بیشتر هدایت کند؛ نه اینکه تنها با یک انتخاب ساده، پاسخ نهایی را در اختیار او قرار دهد. ارائه پاسخ مستقیم در برخی شرایط می‌تواند مفید باشد، اما اگر بدون توجه به هدف آموزشی انجام شود، ممکن است دانش‌آموز را از فرایند یادگیری دور کند.

تارنـی در توضیح اختلاف نظر با OpenAI گفته است که این شرکت تلاش دارد با ایجاد اندکی مکث و دادن حق انتخاب به نوجوان، او را به شیوه‌های مختلف یادگیری یادآوری کند. اما از دید او، فراهم کردن امکان انجام تکلیف به‌جای دانش‌آموز با مفهوم استقلال در یادگیری تفاوت دارد. این اختلاف نشان می‌دهد که طراحی ابزارهای آموزشی مبتنی بر هوش مصنوعی تنها به دقت پاسخ‌ها وابسته نیست؛ نحوه هدایت رفتار دانش‌آموز نیز اهمیت دارد.

واکنش OpenAI به نتایج ارزیابی

OpenAI در واکنش به انتشار گزارش اعلام کرد که از ارزیابی مستقل و دقیق استقبال می‌کند، اما معتقد نیست آزمایش‌های Common Sense Media عملکرد حفاظتی ChatGPT برای نوجوانان یا دیدگاه متخصصان درباره نقش هوش مصنوعی در حمایت از نوجوانان را به‌درستی منعکس کرده باشد.

این شرکت به‌طور مشخص درباره زمان انجام آزمایش‌ها ابراز تردید کرده است. به گفته OpenAI، بخش عمده آزمایش‌ها ممکن است پیش از آن آغاز و پایان یافته باشند که فعال‌سازی کنترل‌های والدین به‌طور کامل انجام شده باشد. اگر این موضوع درست باشد، می‌تواند بر تفسیر نتایج مربوط به هشدارهای والدین تأثیر بگذارد.

در مقابل، Common Sense Media نتایج خود را بر پایه آزمایش‌های مشخص و مجموعه‌ای از پرسش‌های طراحی‌شده برای بررسی پاسخ‌های بحرانی ارائه کرده است. برای ارزیابی منصفانه اختلاف میان دو طرف، جزئیات مربوط به زمان فعال‌سازی تنظیمات، شیوه اجرای آزمون‌ها و شرایط دقیق هر آزمایش اهمیت دارد. در عین حال، اختلاف بر سر روش آزمایش، لزوم بررسی مستقل عملکرد قابلیت‌های حفاظتی را از بین نمی‌برد.

چرا ایمنی نوجوانان در هوش مصنوعی اهمیت بیشتری پیدا کرده است؟

افزایش استفاده نوجوانان از ابزارهای هوش مصنوعی، موضوع ایمنی را به مسئله‌ای فراتر از کنترل محتوای نامناسب تبدیل کرده است. یک دستیار هوشمند ممکن است در یادگیری علوم و ریاضی کمک کند، اما در همان زمان با پرسش‌هایی درباره سلامت روان، روابط شخصی، تصویر بدنی یا مشکلات خانوادگی نیز مواجه شود. به همین دلیل، عملکرد این ابزار در موقعیت‌های حساس باید با دقت و معیارهای روشن ارزیابی شود.

گزارش جدید همچنین در شرایطی منتشر شده که بحث گسترده‌تری درباره مسئولیت شرکت‌های هوش مصنوعی در قبال کاربران آسیب‌پذیر جریان دارد. در بخش دیگری از گزارش رسانه‌ای مرتبط، به پرونده سوفی روتنبرگ، زن ۲۹ ساله‌ای که در اوایل سال ۲۰۲۵ جان خود را گرفت، اشاره شده است. مادر او، لورا رایلی، بعدها به حجم زیادی از مکالمات دخترش با ChatGPT دست یافت. این پرونده به‌خودی‌خود اثبات‌کننده رابطه علّی میان استفاده از چت‌بات و مرگ او نیست، اما پرسش‌هایی درباره شناسایی بحران‌های پنهان و مسئولیت سامانه‌های هوش مصنوعی مطرح کرده است.

در چنین شرایطی، اتکا به عنوان‌هایی مانند «نسخه نوجوانان» یا وجود کنترل‌های والدین کافی نیست. والدین و کاربران باید بدانند که این امکانات چه محدودیت‌هایی دارند، چه زمانی فعال می‌شوند و در چه شرایطی ممکن است نتوانند جایگزین کمک انسانی یا تخصصی شوند. شرکت‌های سازنده نیز باید شواهد روشنی درباره عملکرد واقعی سازوکارهای ایمنی ارائه کنند.

جمع‌بندی: آیا ChatGPT for Teens واقعاً ایمن‌تر است؟

ارزیابی Common Sense Media نشان می‌دهد که نسخه نوجوانان ChatGPT در برخی زمینه‌ها پاسخ‌های مفیدی ارائه می‌دهد، اما در حوزه‌هایی مانند هشدار به والدین، ارجاع به منابع بحران، تشخیص سن و حفظ مرز میان تعامل ماشینی و انسانی، پرسش‌های جدی همچنان باقی است. ضعف‌های گزارش‌شده در حالت مطالعه نیز نشان می‌دهد که محدودیت‌های آموزشی ممکن است همیشه به هدف مورد نظر نرسند.

در مقابل، OpenAI اعتبار روش آزمایش را زیر سؤال برده و گفته است که نتایج منتشرشده ممکن است عملکرد واقعی کنترل‌های والدین را به‌درستی منعکس نکند. بنابراین، اختلاف میان دو طرف هنوز نیازمند بررسی دقیق‌تر و ارزیابی‌های مستقل بیشتر است. با این حال، پیام اصلی گزارش روشن است: ایمنی یک محصول هوش مصنوعی را باید بر اساس عملکرد آن در موقعیت‌های واقعی و حساس سنجید، نه صرفاً بر اساس ویژگی‌هایی که برای آن تبلیغ می‌شود.

برای والدین، آشنایی با محدودیت‌های ابزارهای هوش مصنوعی و گفت‌وگوی مستمر با نوجوانان درباره نحوه استفاده از آن‌ها اهمیت دارد. چت‌بات نباید جایگزین ارتباط با بزرگسال مورد اعتماد، متخصص سلامت روان یا خدمات کمک فوری در شرایط بحرانی شود. برای دنبال کردن اخبار بیشتر فناوری و هوش مصنوعی، به ایران نت مراجعه کنید.

“`

دیدگاهتان را بنویسید

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *

سه × سه =

پربازدیدترین ها