رفتن به محتوای اصلی
حریم خصوصی دادهتوضیح و تحلیل۲۳ مرداد ۱۴۰۵، ۱۵:۲۳· 6 دقیقه مطالعه· #3 از 3 در بازی و ورزش‌های الکترونیک

اجازه توییچ به آمازون برای آموزش هوش مصنوعی با محتوای استریمرها به صورت پیش‌فرض

توییچ یک تنظیمات حریم خصوصی جدید معرفی کرده است که به طور خودکار تولیدکنندگان محتوا را برای استفاده از استریم‌ها، کلیپ‌ها و لاگ‌های چت آن‌ها جهت آموزش مدل‌های هوش مصنوعی مولد آمازون، در این فرآیند مشارکت می‌دهد. استریمرها باید به صورت دستی به تنظیمات حساب کاربری خود مراجعه کرده تا از این جمع‌آوری داده انصراف دهند.

به قلم قاسم طباطبایی

تولیدکنندگان محتوا 45%مدافعان حریم خصوصی 30%مدیران پلتفرم 25%
تولیدکنندگان محتوا
پخش‌ها و صدای خود را به عنوان مالکیت فکری شخصی می‌بینند که باید نیازمند رضایت صریح باشد.
مدافعان حریم خصوصی
بر پیامدهای اخلاقی کلیدهای رضایت پنهان و حفره‌های داده تمرکز می‌کنند.
مدیران پلتفرم
استدلال می‌کنند که جمع‌آوری پیش‌فرض داده برای ساخت ابزارهای هوش مصنوعی رقابتی ضروری است.

بررسی عمیق دیدگاه‌ها

مدیران پلتفرم

استدلال می‌کنند که جمع‌آوری پیش‌فرض داده برای ساخت ابزارهای هوش مصنوعی رقابتی ضروری است.

رهبری پلتفرم معتقد است که چارچوب‌های انصراف به دلیلی استاندارد صنعت هستند: ساخت مدل‌های بنیادی هوش مصنوعی نیازمند مجموعه‌داده‌های عظیمی است که سیستم‌های مشارکت داوطلبانه به سادگی نمی‌توانند فراهم کنند. مدیران با معرفی این کلید به عنوان یک ویژگی حریم خصوصی به جای یک تصاحب داده، استدلال می‌کنند که کنترل بیشتری نسبت به بسیاری از پلتفرم‌های رقیب به تولیدکنندگان محتوا ارائه می‌دهند، در حالی که همچنان مواد خام مورد نیاز آمازون برای رقابتی ماندن در مسابقه تسلیحاتی هوش مصنوعی را تضمین می‌کنند.

تولیدکنندگان محتوا

پخش‌ها و صدای خود را به عنوان مالکیت فکری شخصی می‌بینند که باید نیازمند رضایت صریح باشد.

پخش‌کنندگان استدلال می‌کنند که انتقال بار رضایت به دوش کاربر استثمارگرانه است، به ویژه زمانی که محصول استخراج شده، صدای واقعی و شباهت آن‌هاست. استریمرهای حرفه‌ای و صداپیشگان تحت حمایت اتحادیه‌ها، جذب پیش‌فرض محتوای خود را به عنوان دور زدن جبران عادلانه و حقوق کار می‌بینند و هشدار می‌دهند که مدل‌های هوش مصنوعی که ناخواسته در حال آموزش آن‌ها هستند، ممکن است در نهایت برای تکرار یا جایگزینی کار آن‌ها استفاده شوند.

مدافعان حریم خصوصی

بر پیامدهای اخلاقی کلیدهای رضایت پنهان و حفره‌های داده تمرکز می‌کنند.

محققان حریم خصوصی به ماهیت تکه‌تکه سیاست توییچ به عنوان یک نگرانی عمده اشاره می‌کنند. این واقعیت که داده‌های چت یک کاربر همچنان می‌تواند در صورت شرکت در یک کانال مشارکت کرده، جمع‌آوری شود، دشواری دستیابی به حاکمیت واقعی داده‌ها در یک محیط چندکاربره را نشان می‌دهد. مدافعان هشدار می‌دهند که پنهان کردن این کلیدها در اعماق منوهای امنیتی یک انتخاب طراحی عمدی است که برای به حداقل رساندن نرخ انصراف در نظر گرفته شده و سؤالاتی را در مورد انطباق با مقررات جهانی حفاظت از داده‌های در حال ظهور ایجاد می‌کند.

چرا مهم است

این سیاست میلیون‌ها تولیدکننده مستقل محتوا را به تأمین‌کنندگان ناخواسته داده برای یکی از بزرگترین توسعه‌دهندگان هوش مصنوعی جهان تبدیل می‌کند. این موضوع نشان‌دهنده یک تغییر حیاتی در اقتصاد دیجیتال است، جایی که پلتفرم‌های میزبان محتوای کاربران به طور فزاینده‌ای حق استخراج آن محتوا را برای آموزش هوش مصنوعی، به صورت پیش‌فرض، مطالبه می‌کنند.

در ۱۲ آگوست ۲۰۲۶، یک تغییر آرام اما بسیار مهم در اعماق تنظیمات کاربری بزرگترین پلتفرم استریم زنده جهان ظاهر شد: یک کلید ساده که به طور پیش‌فرض روشن بود و به شرکت مادر، آمازون، حق می‌داد تا مدل‌های هوش مصنوعی مولد را با استفاده از هر استریم، کلیپ و لاگ چت میزبانی شده در توییچ آموزش دهد. این کشف بلافاصله موجی از خشم را در میان تولیدکنندگان محتوا برانگیخت که سال‌ها وقت صرف ساختن جوامع و برندهای شخصی خود در این سرویس کرده بودند. برای آمازون، این سیاست یک مجموعه داده عظیم و چندوجهی از تعاملات انسانی، گیم‌پلی و مکالمات لحظه‌ای را آزاد می‌کند. اما برای پخش‌کنندگان، این نشان‌دهنده یک تغییر ناگهانی در مورد اینکه چه کسی کنترل ردپای دیجیتالی آن‌ها را در اختیار دارد، است.[1][2][6]

اهمیت این خط لوله داده بسیار زیاد است. آمازون در حال حاضر در حال اجرای یک پروژه عظیم برای توسعه زیرساخت‌های هوش مصنوعی خود است و میلیاردها دلار برای توسعه مدل‌های بنیادی که می‌توانند متن، صدا، تصویر و ویدئو را سنتز کنند، اختصاص داده است. آموزش این سیستم‌ها نیازمند اقیانوس‌های وسیعی از رسانه‌های با کیفیت بالا و تولید شده توسط انسان است. توییچ، که میلیون‌ها ساعت ویدئوی زنده و میلیاردها خط متن چت را هر ماه میزبانی می‌کند، یک معدن طلا برای این هدف دقیق است. آمازون با تبدیل توافقنامه اشتراک‌گذاری داده به یک شرط خودکار برای استفاده از پلتفرم، فوراً یکی از غنی‌ترین زمینه‌های آموزشی اینترنت را برای خود تضمین می‌کند.[2][3][4]

مکانیسم‌های این سیاست جدید بر روی یک تنظیمات با عنوان «آموزش برای هوش مصنوعی مولد» متمرکز است که در بخش امنیت و حریم خصوصی حساب کاربری قرار دارد. طبق مستندات به‌روزرسانی شده پلتفرم، فعال نگه داشتن این کلید به آمازون اجازه می‌دهد تا استریم‌ها، ویدئوهای درخواستی (VOD)، کلیپ‌ها، چت‌های استریم و تصاویر کانال یک تولیدکننده محتوا را برای بهبود مدل‌های آینده جذب کند. این بدان معناست که صدای یک تولیدکننده می‌تواند برای اصلاح مدل‌های تبدیل گفتار به متن استفاده شود، در حالی که گیم‌پلی و واکنش‌های آن‌ها می‌تواند به آموزش سیستم‌های تولید ویدئو کمک کند.[1][2][5]

نحوه جریان داده‌های کانال توییچ به خطوط لوله آموزش هوش مصنوعی مولد آمازون.

تصمیم برای تبدیل این جمع‌آوری داده به یک سیستم «انصراف» (Opt-out)، به جای درخواست مجوز صریح از تولیدکنندگان محتوا، بلافاصله به نقطه اصلی اختلاف تبدیل شد. مایک مینتون، مدیر ارشد محصولات توییچ، در یک پخش زنده که به این واکنش‌ها پاسخ می‌داد، توضیح بسیار صریحی برای این استراتژی ارائه داد. مینتون به نزدیک به ۳۰۰۰ بیننده‌ای که استریم را تماشا می‌کردند، گفت: «ما می‌دانیم که بسیاری از شما انصراف خواهید داد. چرا این سیستم «مشارکت» (Opt-in) نیست؟ چرا باید من انصراف دهم به جای اینکه مشارکت کنم؟ خب، یک پاسخ صادقانه وجود دارد و فکر می‌کنم بیشتر شما آن را درک می‌کنید. اگر مشارکت اختیاری بود، هیچ کس مشارکت نمی‌کرد.»[1][3][4]

مینتون استدلال کرد که تقریباً تمام سرویس‌های محتوایی بزرگ در جهان بر اساس مشارکت پیش‌فرض برای جمع‌آوری داده عمل می‌کنند و گنجاندن کلید انصراف توسط توییچ را به عنوان یک حرکت منحصر به فرد برای احترام به خواسته‌های تولیدکنندگان محتوا معرفی کرد. با این حال، استراتژی اولیه ارتباطی پلتفرم – که این به‌روزرسانی را صرفاً به عنوان افزودن یک تنظیمات حریم خصوصی و نه یک خط لوله داده جدید معرفی کرد – به دلیل عدم شفافیت، انتقادات شدیدی را به دنبال داشت. تولیدکنندگان محتوا استدلال کردند که انتقال بار رضایت به دوش پخش‌کننده، اساساً استثمارگرانه است، به ویژه زمانی که شهرت و صدای آن‌ها محصولاتی هستند که استخراج می‌شوند.[1][3][4]

تولیدکنندگان محتوا استدلال کردند که انتقال بار رضایت به دوش پخش‌کننده، اساساً استثمارگرانه است، به ویژه زمانی که شهرت و صدای آن‌ها محصولاتی هستند که استخراج می‌شوند.

پیچیدگی این موضوع، تمایز پلتفرم بین هوش مصنوعی مولد و یادگیری ماشینی عملیاتی است. توییچ اعلام کرده است که حتی اگر یک تولیدکننده محتوا از آموزش مدل مولد انصراف دهد، محتوای او همچنان توسط ویژگی‌های پلتفرم که با هوش مصنوعی پشتیبانی می‌شوند، پردازش خواهد شد. این ویژگی‌ها شامل ابزارهای تعدیل خودکار مانند AutoMod، توصیه‌های الگوریتمی محتوا و کمک به کمپین‌های حمایت مالی لحظه‌ای است. پلتفرم تأکید می‌کند که این سیستم‌های عملیاتی داده‌های کاربر را برای آموزش مدل گسترده‌تر حفظ نمی‌کنند، اما اصطلاحات همپوشان باعث سردرگمی بسیاری از کاربران در مورد سرنوشت نهایی داده‌هایشان شده است.[1][2][4]

یک حفره قابل توجه در معماری انصراف، نحوه مدیریت چت‌های جامعه توسط پلتفرم است. طبق مستندات پشتیبانی توییچ، تنظیمات حریم خصوصی فردی یک کاربر فقط محتوای پخش شده در کانال خودش را کنترل می‌کند. اگر کاربری که از آموزش هوش مصنوعی انصراف داده است، وارد استریم تولیدکننده دیگری شود و در چت شرکت کند، آن متن تحت تأثیر ترجیحات کانال میزبان قرار می‌گیرد. اگر میزبان انصراف نداده باشد، لاگ‌های چت کاربر بازدیدکننده همچنان می‌توانند وارد مجموعه داده‌های آموزشی آمازون شوند، که دستیابی به حریم خصوصی کامل داده‌ها را برای اعضای فعال جامعه تقریباً غیرممکن می‌سازد.[1][2][4]

صداپیشگان و استریمرهای حرفه‌ای نگرانی‌هایی را در مورد جذب شباهت‌های صوتی آن‌ها بدون رضایت صریح مطرح کرده‌اند.

این سیاست همچنین نگرانی‌های جدی را برای هنرمندان حرفه‌ای که از این پلتفرم استفاده می‌کنند، ایجاد کرده است. بسیاری از صداپیشگان و متخصصان صنعت که تحت حمایت اتحادیه‌ها هستند، برای ارتباط با طرفداران خود در توییچ استریم می‌کنند و شباهت‌های صوتی آن‌ها دارایی‌هایی هستند که به شدت محافظت می‌شوند. چشم‌انداز جذب بی‌سروصدای صدای آن‌ها برای آموزش مدل‌های سنتز صوتی آمازون بدون رضایت صریح و مذاکره شده، قلب اختلافات کارگری جاری در سراسر صنعت سرگرمی در مورد حفاظت‌های هوش مصنوعی را هدف قرار می‌دهد.[4]

دامنه عطف به ماسبق این سیاست همچنان یک نقطه ابهام شدید است. در حالی که کلید جدید صراحتاً «آموزش آینده» مدل‌های مولد آمازون را کنترل می‌کند، مدیران توییچ از تأیید یا تکذیب اینکه آیا محتوای آرشیو شده استریمرها قبلاً در مراحل توسعه اولیه استفاده شده است، خودداری کردند. مینتون در طول پخش زنده اظهار داشت که خود توییچ مدل‌ها را آموزش نمی‌دهد، اما نمی‌تواند در مورد اینکه آمازون قبلاً چه چیزی را در مورد استفاده از محتوای خاص پردازش کرده یا نکرده است، صحبت کند.[2][6]

این تغییر سیاست در توییچ منعکس‌کننده یک روند گسترده‌تر در صنعت است که در آن غول‌های فناوری به طور فزاینده‌ای از پلتفرم‌های محتوای تولید شده توسط کاربران خود برای تغذیه جاه‌طلبی‌های هوش مصنوعی خود استفاده می‌کنند. متا آشکارا اعتراف کرده است که مدل‌های بنیادی خود را با پست‌های عمومی فیس‌بوک و اینستاگرام آموزش می‌دهد، در حالی که گوگل از استفاده از داده‌های وب در دسترس عموم به عنوان یک عمل تحول‌آفرین و استفاده منصفانه دفاع کرده است. با شتاب گرفتن رقابت برای ساخت سیستم‌های هوش مصنوعی توانمندتر، تنش بین کسب داده‌های شرکتی و حقوق مالکیت فکری تولیدکنندگان محتوا در حال تبدیل شدن به یک درگیری تعیین‌کننده در اقتصاد دیجیتال است.[5][6]

حفره چت: انصراف‌های فردی از پیام‌های ارسال شده در کانال‌هایی که مشارکت کرده‌اند، محافظت نمی‌کند.

از منظر نظارتی، طراحی مشارکت پیش‌فرض، بار انطباق را به طور کامل بر دوش کاربر قرار می‌دهد، یک معماری رضایت که با بررسی‌های فزاینده‌ای روبرو است. مدافعان حریم خصوصی استدلال می‌کنند که پنهان کردن این کلید در یک منوی تنظیمات ثانویه، به جای نمایش آن در داشبورد اصلی تولیدکنندگان محتوا، به گونه‌ای طراحی شده است که تعداد کاربرانی را که واقعاً این ویژگی را کشف و غیرفعال می‌کنند، به حداقل برساند.[2][3]

برای تولیدکنندگان محتوا که به دنبال محافظت از شباهت دیجیتالی خود هستند، راه‌حل فوری نیازمند مداخله دستی است. پخش‌کنندگان باید به تنظیمات حساب کاربری خود بروند، بخش امنیت و حریم خصوصی را انتخاب کنند و به طور فعال تیک مربوط به آموزش هوش مصنوعی مولد را بردارند. در حالی که این کار جذب آینده پخش‌های اصلی آن‌ها را متوقف می‌کند، ماهیت تکه‌تکه سیاست – جایی که داده‌های چت و هوش مصنوعی عملیاتی همچنان در هم تنیده باقی می‌مانند – به این معنی است که جدا کردن کامل حضور یک تولیدکننده محتوا از دستگاه یادگیری ماشینی آمازون دیگر یک فرآیند ساده نیست.[1][3][4][5]

نکات کلیدی

  1. توییچ یک تنظیمات پیش‌فرض را فعال کرده است که به آمازون اجازه می‌دهد مدل‌های هوش مصنوعی مولد را با محتوای استریمر آموزش دهد.
  2. این سیاست شامل استریم‌های زنده، VODها، کلیپ‌ها، لاگ‌های چت و تصاویر کانال است.
  3. مدیران توییچ اعتراف کردند که طراحی انصراف انتخاب شد زیرا کاربران به طور داوطلبانه مشارکت نمی‌کردند.
  4. انصراف دادن از پیام‌های چت یک کاربر هنگام شرکت در کانال دیگری که مشارکت کرده است، محافظت نمی‌کند.
  5. صرف نظر از کلید هوش مصنوعی مولد، پلتفرم همچنان از محتوا برای ویژگی‌های هوش مصنوعی عملیاتی مانند AutoMod استفاده می‌کند.

منابع

پوشش منابع

6 منبع

3 دیدگاه شناسایی‌شده

تولیدکنندگان محتوا 45%مدافعان حریم خصوصی 30%مدیران پلتفرم 25%
  1. [1]Hitmarkerمدیران پلتفرم

    Twitch is using streamer content to train Amazon's AI models by default, CPO confirms

    مطالعه در Hitmarker
  2. [2]The Vergeمدافعان حریم خصوصی

    Twitch streamers can now opt out from training Amazon's AI

    مطالعه در The Verge
  3. [3]IGNتولیدکنندگان محتوا

    Twitch Now Trains Amazon's Generative AI Models On Your Channel By Default

    مطالعه در IGN
  4. [4]GameSpotمدیران پلتفرم

    Twitch is using channels to train generative AI systems

    مطالعه در GameSpot
  5. [5]CNETتولیدکنندگان محتوا

    Twitch channels are quietly being used to train Amazon's AI models. Here's how creators can opt out.

    مطالعه در CNET
  6. [6]Forbesتولیدکنندگان محتوا

    Twitch is under fire for automatically signing up streamers to share their data for GenAI training

    مطالعه در Forbes

نظرات

همیشه در جریان باشید

هر زاویه. هر روز.

دریافت بازی و ورزش‌های الکترونیک اخبار همراه با پوشش کامل منابع و تحلیل دیدگاه‌ها، مستقیم در صندوق ورودی شما.