بررسی تدابیر حفاظتی حقوق بشر در زمینه تعدیل محتوا
به گزارش کارگروه فناوری اطلاعات سایبربان، همزمان با استفاده پلتفرمها از هوش مصنوعی برای تعدیل محتوا، هیئت نظارت در حال بررسی پیامدهای حقوق بشری این اقدام و تدوین دستورالعملهایی برای صنعت فناوری است.
هیئت نظارت، نهادی مستقل که تصمیمات و سیاستهای تعدیل محتوا را در پلتفرمهای متا، از جمله فیسبوک و اینستاگرام، بررسی میکند، در اول اکتبر اعلام کرد که در حال انجام تحقیقاتی در مورد چگونگی استفاده از LLMها برای تعدیل محتوا در رسانههای اجتماعی با رعایت آزادی بیان و استانداردهای حقوق بشر شناخته شده بینالمللی است. این تحقیق باهدف ارائه راهنمایی برای شرکتهای فناوری که سیستمهای تعدیل مبتنی بر LLM را به کار میگیرند، انجام میشود و بر اساس شش سال کار هیئتمدیره در بررسی نحوه اجرای سیاستهای محتوای متا توسط سیستمهای انسانی و خودکار انجام میشود.
هیئتمدیره اعلام کرد که LLMها میتوانند مقیاس و قابلیتهای زمینهای تعدیل خودکار را گسترش دهند، از جمله با بهبود تعدیل در زبانهای کم منبع (زبانهایی با دادههای دیجیتال و منابع فناوری محدود). درعینحال، به خطراتی از جمله تعصب، توهم، دشواری در تفسیر طعنه، طنز و زبان رمزگذاری شده و ظرفیت سیستمهای خودکار برای تصمیمگیریهای مؤثر بر حقوق در مقیاس بزرگ اشاره کرد.
این تحقیق، سیستمهای مبتنی بر LLM را با طبقهبندیکنندههای خودکار موجود (سیستمهای هوش مصنوعی آموزشدیده برای شناسایی یا دستهبندی محتوا) و بررسی انسانی مقایسه و رویکردهای مربوط به تشدید، آزمایش و حسابرسی انسانی را بررسی خواهد کرد. همچنین به شفافیت پیرامون اجرای خودکار، درخواستهای کاربر و نحوه عملکرد سیستمهای تعدیل در زبانهای کم منبع و محتوای چندوجهی (محتوایی که فرمتهایی مانند متن، تصویر، صدا یا ویدیو را ترکیب میکند) خواهد پرداخت. هیئتمدیره بهعنوان بخشی از این فرآیند، از نظرات عمومی استقبال میکند.
این ابتکار بر اساس کار قبلی هیئتمدیره در این زمینه بنا شده است. در یک مطالعه در ژوئیه ۲۰۲۶، هیئتمدیره دریافت که برنامههای ساخته شده بر روی LLMهای اصلی میتوانند ناخواسته قوانین ملی محدودکننده گفتار را منعکس کنند که با استانداردهای بینالمللی حقوق بشر ناسازگار هستند و خواستار گنجاندن تحلیل حقوق بشر در نحوه آموزش و ارزیابی چنین مدلهایی شد.
گزارش شفافیت دوسالانه متا برای نیمه اول سال ۲۰۲۶ نیز مواردی را شرح میدهد که در آنها هیئتمدیره پس از مشاهده عدم موفقیت سیستمهای خودکار آن در تشخیص (algospeak) زبان رمزگذاری شدهای که برای فرار از شناسایی استفاده میشود، تصمیمات محتوای متا را لغو کرد و نتیجه گرفت که حذفها با مسئولیتهای حقوق بشری متا مغایرت دارند، درحالیکه دشواریهایی را که چنین زبانی برای طبقهبندیکنندگان ایجاد میکند، اذعان میکند.
تحقیق فعلی پس از اعلام متا در ماه مارس مبنی بر برنامههایی برای استفاده از مدلهای پیشرفتهتر هوش مصنوعی در سیستمهای تعدیل محتوا و پشتیبانی از کاربر انجام میشود. هیئتمدیره پیشازاین خواستار ایجاد ضمانتهای حقوق بشر و آزادی بیان در سیستمهای تعدیل مبتنی بر هوش مصنوعی، همراه با شفافیت بیشتر و ارزیابی مستقل شده بود. بااینحال، هدف اعلام شده آن برای این تحقیق، تولید راهنمایی برای صنعت فناوری بهطورکلی است.