روبوتات الدردشة الذكية ناجحة في تحديد المستخدمين في أزمات الصحة النفسية، لكنها تفشل في تقديم المساعدات الفعالة. وفقًا لأبحاث جديدة، كانت هذه الروبوتات قادرة على تحديد حالة الطوارئ لدى المستخدمين في حوالي ٣٥% من المحادثات التجريبية، لكنها لا تحيل إلى موارد مفيدة، بما في ذلك خط الهاتف الخاص بالانتحار.
أداء الروبوتات في تحديد الأزمات
باتريك أوت هوت، مسؤول فريق السلامة في Scale AI، يوضح أن النماذج ناجحة جدًا في تحديد الأفراد الذين يتحدثون عن مواضيع ضارة. يقول: "النماذج تحدد بشكل جيد أن الشخص يتحدث عن موضوع ضار، لكن ردودهم غالبًا ما تكون تعاطفية ولطيفة ولا تتناول تقديم حلول فعالة. هذه المسألة تتضح بشكل خاص في المحادثات الأطول."
اقرأ المزيد: تدريس کمپین سنای تگزاس توسط تلیریکو پس از تشخیص آنفولانزا متوقف شد
التحديات الموجودة في الإحالة إلى المساعدات البشرية
في هذه الدراسة، طلبت Scale AI من ١٩ مستشارًا وخبير أزمات محاكاة ٧١٨ محادثة حقيقية. اختبرت الشركة ٢٥ نموذجًا متقدمًا بما في ذلك نماذج OpenAI وGoogle. تم تقييم أداء الروبوتات بناءً على معايير مثل التعاطف والإحالة إلى المتخصصين. هناك العديد من الأسئلة السياسية حول كيفية نقل المسؤولية من الروبوت إلى الإنسان في أوقات الأزمات الصحية النفسية.
كلي زورومسكي، عالمة أبحاث في Crisis Text Line، تقول إن العديد من الأشخاص الذين يتواصلون مع هذه المجموعة قد تعرفوا عليهم من خلال الروبوتات. ومع ذلك، تقول إن هناك الكثير من الأسئلة حول كيفية إحالة المستخدمين بشكل صحيح إلى الموارد البشرية وما إذا كانت هذه الإحالات فعالة أم لا.
في بعض الحالات، تم ملاحقة شركات الذكاء الاصطناعي بسبب خلق اعتماد عاطفي بين المستخدمين الشباب وعدم الاستجابة المناسبة لمشاعرهم. وقد أعلنت هذه الشركات أن نماذجها تشمل حماية متعلقة بالصحة النفسية، لكنها لم تعلق على هذه الدراسة.
تعتقد Scale AI أن هناك حاجة لمزيد من الاختبارات لتحسين أداء الروبوتات في الاستجابة للمستخدمين في أزمات الصحة النفسية. يقول أوت هوت: "النماذج تعمل الآن بشكل أفضل من ذي قبل، لكن هدفنا هو تحقيق تحسين أكبر وتقليل الأضرار، مما يمكن أن يعود بفوائد كبيرة على المجتمع."
اقرأ المزيد: سازمان بهداشت جهانی از روسیه درباره مرگ مشکوک کارمند یک پژوهشکده طاعون سوال کرد · تحقیقات سنای آمریکا به منافع واقعی مراکز داده هوش مصنوعی بزرگ فناوری چالش میزند




