هوش مصنوعی جدید «موز ایمیج» متا چگونه به طور پیشفرض از عکسهای عمومی اینستاگرام استفاده میکند (و نحوه انصراف از آن)
متا «موز ایمیج» (Muse Image)، یک ابزار قدرتمند جدید تولید تصویر با هوش مصنوعی، را راهاندازی کرده است که به کاربران اجازه میدهد عکسهای عمومی اینستاگرام را بدون اطلاع صاحب حساب، بازترکیب کنند. در اینجا نحوه عملکرد این مدل عاملی (Agentic) و مراحل لازم برای محافظت از هویت دیجیتال شما آمده است.
به قلم نیما موسوی
این خبر را به اشتراک بگذارید
- مدافعان حریم خصوصی و مصرفکننده
- استدلال میکنند که فعالسازی پیشفرض کاربران در تولید هوش مصنوعی بدون اطلاعرسانی، نقض فاحش رضایت دیجیتال است.
- متا و توسعهدهندگان هوش مصنوعی
- ادغام یکپارچه عکسهای عمومی را راهی بدون اصطکاک برای تقویت خلاقیت اجتماعی و طراحی مشترک میدانند.
- تحلیلگران امنیتی و فناوری
- بر معماری فنی مدل عاملی و پیامدهای عملی مدیریت ردپای دیجیتال تمرکز دارند.
متا رسماً «موز ایمیج» (Muse Image)، پیشرفتهترین ابزار تولید تصویر با هوش مصنوعی خود تا به امروز، را راهاندازی کرده و آن را مستقیماً در اینستاگرام، واتساپ و اپلیکیشن مستقل متا اِیآی (Meta AI) ادغام کرده است. این ابزار که توسط آزمایشگاههای فوق هوش متا (Meta Superintelligence Labs) توسعه یافته، یک جهش قابل توجه در رسانههای مولد است و فراتر از نگاشت ساده متن به پیکسل، به سمت چیزی حرکت میکند که شرکت آن را تولید «عاملی» (Agentic) مینامد. با این حال، این راهاندازی بلافاصله به دلیل یک تنظیمات پیشفرض بحثبرانگیز، واکنشهای منفی شدیدی در مورد حریم خصوصی ایجاد کرده است: هر حساب عمومی اینستاگرام به طور خودکار برای استفاده به عنوان خوراک بصری برای تولیدات هوش مصنوعی سایر کاربران، فعال میشود.[1]
هسته اصلی این جنجال بر روی یک ویژگی جدید متمرکز است که به کاربران اجازه میدهد نام کاربری (هندل) هر حساب عمومی اینستاگرام را مستقیماً با علامت «@» در دستور تولید موز ایمیج وارد کنند. با تگ کردن یک نام کاربری، هوش مصنوعی به طور یکپارچه از عکسها، ریلها و تصاویر پروفایل عمومی آن کاربر استفاده کرده و یک تصویر ترکیبی (synthetic) جدید میسازد. به عنوان مثال، یک کاربر میتواند یک چهره عمومی یا یک فرد غریبه را تگ کند و او را در یک سناریوی ساختگی قرار دهد، بدون اینکه فرد مورد نظر اجازه صریح یا آگاهی داشته باشد.[1]
طبق مستندات رسمی متا، این سیستم هنگام بازترکیب هویت بصری کاربران در تولیدات هوش مصنوعی، به آنها اطلاع نمیدهد. در حالی که شرکت این ویژگی را راهی بدون اصطکاک برای طراحی دعوتنامههای سفارشی رویدادها یا پیشنویس مفاهیم خلاقانه مشترک میداند، مدافعان حریم خصوصی به شدت از این اجرا انتقاد کردهاند. جی.بی. برنچ، مدیر حاکمیت فدرال هوش مصنوعی در سازمان «پابلیک سیتیزن» (Public Citizen)، این ویژگی را «تجاوز فاحش به حریم خصوصی کاربر» خواند و استدلال کرد که کاربران نباید صبح از خواب بیدار شوند و ببینند چهرههایشان به عنوان مواد خام برای آزمایش هوش مصنوعی شخص دیگری استفاده شده است.
برای کاربرانی که به دنبال محافظت از هویت دیجیتال خود هستند، انصراف از این ویژگی مستلزم پیمایش در یک توالی خاص از منوهای درون برنامهای است. از آنجایی که این قابلیت به سیاستهای گستردهتر اینستاگرام در مورد استفاده مجدد از محتوا گره خورده است، کاربران باید تنظیمات اینستاگرام خود را باز کنند، تب «اشتراکگذاری و استفاده مجدد» (Sharing and reuse) را پیدا کنند و به صورت دستی مجوزهای مربوط به «پستها» (Posts) و «ریلها» (Reels) را غیرفعال کنند. نکته مهم این است که متا اشاره میکند غیرفعال کردن این ویژگی فقط برای محتوای آتی اعمال میشود؛ تصاویر هوش مصنوعی که توسط دیگران قبل از انصراف کاربر تولید شدهاند، از پلتفرم حذف نخواهند شد.
تنها راه دفاع فوری دیگر، خصوصی کردن حساب کاربری است. سیاست متا حکم میکند که اگر کاربری حساب خود را برای بیش از ۲۴ ساعت از عمومی به خصوصی تغییر دهد، تمام ریلها، پستها و استوریهایی که از محتوای او استفاده میکنند، از مجموعه فعال تولید هوش مصنوعی سیستم پاک خواهند شد. علاوه بر این، برای کاربران اینستاگرام زیر ۱۸ سال با حسابهای عمومی، متا ویژگی استفاده مجدد توسط هوش مصنوعی را محدود میکند تا فقط فالوئرهای تأیید شده بتوانند محتوای آنها را دستکاری کنند.
فراتر از بحث حریم خصوصی، معماری موز ایمیج نشاندهنده یک تغییر فنی بزرگ برای متا است. این مدل که در ابتدا با نام رمز «مانگو» (Mango) شناخته میشد، تحت رهبری الکساندر ونگ در آزمایشگاههای فوق هوش متا توسعه یافت و نشاندهنده فاصله گرفتن از ابزارهای تصویر مبتنی بر لاما (Llama) قبلی شرکت است. موز ایمیج طوری طراحی شده است که در کنار «موز اسپارک» (Muse Spark)، مدل زبان بنیادی متا، کار کند و به این دو سیستم اجازه میدهد قبل از رندر کردن یک پیکسل، ابزارها را به اشتراک بگذارند و به طور مشترک برنامهریزی کنند.[1][2]
فراتر از بحث حریم خصوصی، معماری موز ایمیج نشاندهنده یک تغییر فنی بزرگ برای متا است.
این رویکرد «عاملی» (Agentic) به این معنی است که موز ایمیج بیشتر شبیه یک دستیار خودمختار عمل میکند تا یک تولیدکننده تصویر سنتی. هنگامی که یک دستور پیچیده به آن داده میشود، مدل ابتدا جستجوی وب را برای جمعآوری زمینه در زمان واقعی فرا میخواند و از ابزارهای کدنویسی برای تأیید دقت ساختاری استفاده میکند. به عنوان مثال، اگر از آن خواسته شود یک پوستر تبلیغاتی با یک کد QR کاربردی تولید کند، موز ایمیج کد را مینویسد و اجرا میکند تا مطمئن شود بلوک QR قابل اسکن و بدون خطا است، قبل از اینکه آن را در ترکیب هنری نهایی ادغام کند.[1][2]
متا همچنین تلاش میکند تا با جاسازی یک سیگنال منبع نامرئی به نام «مُهر محتوا» (Content Seal)، خطرات اجتنابناپذیر اطلاعات نادرست مرتبط با تولید هوش مصنوعی فوقواقعگرایانه را برطرف کند. به گفته شرکت، این واترمارک رمزنگاری شده پنهان حتی اگر تصویر برش داده شود، فشرده شود، تغییر اندازه یابد یا اسکرینشات گرفته شود، دست نخورده باقی میماند. متا در حال حاضر ابزار تشخیص را پیشنمایش میکند که به کاربران امکان میدهد تصویر را اسکن کرده و تأیید کنند که آیا توسط موز ایمیج سنتز شده است یا خیر، اگرچه اثربخشی چنین واترمارکهایی در برابر تکنیکهای پیچیده حذف، همچنان موضوع بحثهای جاری در صنعت است.[1]
عرضه موز ایمیج در حال حاضر محدود به ایالات متحده و بازارهای بینالمللی منتخب است و قرار است در هفتههای آینده در فیسبوک و مسنجر نیز در دسترس قرار گیرد. برای کاربران عادی، این ابزار رایگان است اما مشمول سقف تولید روزانه نامعلومی است، در حالی که استفاده سنگینتر و کنترلهای پیشرفتهتر پشت سطوح اشتراک پولی متا قرار دارند. تبلیغکنندگان نیز به زودی از طریق مجموعه خلاقیت Advantage+ متا به این مدل دسترسی پیدا خواهند کرد و به برندها اجازه میدهد داراییهای بازاریابی پویا را به سرعت تولید کنند.[1]
تنش بین نقشه راه تهاجمی محصولات هوش مصنوعی متا و رضایت کاربر چیز جدیدی نیست، اما ادغام موز ایمیج در بافت اجتماعی اینستاگرام، ریسکها را بالا میبرد. متا با تبدیل میلیاردها عکس عمومی پلتفرم به یک مجموعه داده تعاملی و بیدرنگ برای رسانههای ترکیبی، مرز بین شبکههای اجتماعی و سرگرمیهای مولد را محو میکند. از آنجایی که شرکت در حال آمادهسازی برای راهاندازی «موز ویدئو» (Muse Video) است—یک مدل خواهر که بر اساس همان پایه پیشآموزشی ساخته شده و نوید تولید ویدئوی با کیفیت بالا و صدای بومی را میدهد—بحث بر سر فعالسازیهای پیشفرض و کالاییسازی هویتهای دیجیتال شخصی تنها تشدید خواهد شد.[1]
اصطکاک بر سر تنظیمات پیشفرض، الگوی گستردهتری در صنعت را برجسته میکند که در آن غولهای فناوری، پذیرش بدون اصطکاک کاربر را بر رضایت صریح اولویت میدهند. متا با پنهان کردن مکانیسم انصراف در اعماق منوی تنظیمات، تضمین میکند که اکثریت قریب به اتفاق کاربرانش صرفاً به دلیل اینرسی، فعال باقی خواهند ماند. منتقدان استدلال میکنند که این طراحی «الگوی تاریک» (dark pattern) عمداً واقعیت نحوه استفاده از دادههای شخصی را مبهم میکند و بار حفظ حریم خصوصی را به طور کامل به مصرفکننده منتقل میکند، به جای اینکه نیاز به یک فعالسازی تأییدی داشته باشد.
علاوه بر این، قابلیت کشف این بازترکیبهای تولید شده توسط هوش مصنوعی، یک چالش منحصر به فرد برای مدیریت ردپای دیجیتال ایجاد میکند. اسناد راهنمای خود متا اذعان میکنند که بسته به تنظیمات حریم خصوصی کاربری که تصویر هوش مصنوعی را تولید میکند، محتوای ترکیبی حاصل ممکن است در نتایج موتورهای جستجوی خارجی فهرست شده و قابل کشف باشد. این بدان معناست که هویت بصری یک کاربر، که توسط یک غریبه در یک زمینه جدید دستکاری شده است، میتواند در جستجوهای گوگل مرتبط با نام او ظاهر شود و تلاشها برای حفظ کنترل شهرت حرفهای یا شخصی را دشوار سازد.
با تشدید نظارت نظارتی بر هوش مصنوعی در سطح جهانی، استقرار تهاجمی موز ایمیج توسط متا ممکن است چالشهای حقوقی بیشتری را به همراه داشته باشد. قانون هوش مصنوعی اتحادیه اروپا (EU AI Act) و قوانین مختلف حریم خصوصی در سطح ایالتی در ایالات متحده، به طور فزایندهای بر استفاده غیرمجاز از دادههای بیومتریک و هویت شخصی تمرکز دارند. در حالی که متا استدلال میکند که پستهای عمومی اینستاگرام از قبل مشمول سیاستهای گسترده استفاده مجدد هستند، جهش از اشتراکگذاری ساده به سنتز الگوریتمی، یک مرز حقوقی جدید را نشان میدهد که دادگاهها هنوز به طور کامل درباره آن قضاوت نکردهاند.
در نهایت، راهاندازی موز ایمیج به عنوان یک یادآوری آشکار از قرارداد اجتماعی در حال تحول بین کاربران و پلتفرمها در عصر هوش مصنوعی مولد عمل میکند. در حالی که آزمایشگاههای فوق هوش متا به پیشروی خود به سمت آنچه «فوق هوش شخصی» مینامند ادامه میدهند، مواد خام تغذیهکننده این چشمانداز، زندگی روزمره، چهرهها و خاطرات کاربران آن باقی میماند. برای کسانی که تمایلی به شرکت در این آزمایش بزرگ ندارند، تنها راه چاره فوری، هوشیاری، پیمایش در منوهای تنظیمات پیچیده، یا عقبنشینی به پشت دیوارهای یک حساب خصوصی است.[1]
نکات کلیدی
- متا «موز ایمیج»، یک تولیدکننده پیشرفته هوش مصنوعی، را راهاندازی کرده است که میتواند به طور یکپارچه عکسهای عمومی اینستاگرام را بازترکیب کند.
- این ویژگی به طور پیشفرض برای همه حسابهای عمومی فعال است و به هر کسی اجازه میدهد تا با تگ کردن یک کاربر (@-mention)، بدون اطلاع او، تصاویری از وی تولید کند.
- برای محافظت از هویت بصری خود، کاربران باید به صورت دستی کلیدهای «پستها» و «ریلها» را در تنظیمات «اشتراکگذاری و استفاده مجدد» اینستاگرام غیرفعال کنند.
- موز ایمیج به عنوان یک مدل «عاملی» عمل میکند و از جستجوی وب و ابزارهای کدنویسی برای برنامهریزی ترکیببندیها قبل از رندر نهایی استفاده میکند.
اصطلاحات کلیدی
- موز ایمیج (Muse Image)
- جدیدترین مدل تولید تصویر با هوش مصنوعی متا، توسعه یافته توسط آزمایشگاههای فوق هوش متا، که قادر به استدلال پیچیده و ادغام با رسانههای اجتماعی است.
- هوش مصنوعی عاملی (Agentic AI)
- سیستمهای هوش مصنوعی که میتوانند به طور مستقل برنامهریزی کنند، از ابزارهای خارجی مانند جستجوی وب یا اجرای کد استفاده کنند و خروجیهای خود را خوداصلاح کنند، به جای اینکه صرفاً متن را به پیکسل نگاشت کنند.
- مُهر محتوا (Content Seal)
- یک واترمارک رمزنگاری شده نامرئی که در تصاویر تولید شده توسط هوش مصنوعی متا جاسازی شده و طراحی شده است تا حتی اگر تصویر برش داده یا فشرده شود، باقی بماند.
- موز اسپارک (Muse Spark)
- مدل زبان بنیادی متا که همراه با موز ایمیج کار میکند تا دستورات پیچیده را پردازش کرده و طرحبندیهای بصری را برنامهریزی کند.
منابع
[1]Metaمتا و توسعهدهندگان هوش مصنوعیIntroducing Muse Image and Muse Video
مطالعه در Meta →
[2]DataCampتحلیلگران امنیتی و فناوریWhat Is Meta's Muse Image AI?
مطالعه در DataCamp →
نظرات
بیشتر در فناوری
مشاهده همه →رصدخانههای فضایی
پرتاب تلسکوپ فضایی «رومن»: چرا اخترفیزیک مشاهده عمیق را با پیمایشهای گسترده عوض میکند؟
6 منبع
Audio Tech
کالبدشکافی حذف نویز فعال (ANC): چرا هدفون شما صدا را با یک صدای دیگر نابود میکند؟
3 منبع
فیدهای الگوریتمی
سازوکار الگوریتم صفحه «برای شما» تیکتاک: سیستم چگونه ویدئوها را رتبهبندی و پیشنهاد میکند
4 منبع
امنیت پسا-کوانتومی
رمزنگاری پسا-کوانتومی: الگوریتمهای مبتنی بر شبکه چگونه دادهها را ایمن میکنند؟
6 منبع
هر زاویه. هر روز.
دریافت فناوری اخبار همراه با پوشش کامل منابع و تحلیل دیدگاهها، مستقیم در صندوق ورودی شما.





