رفتن به محتوای اصلی
توضیح کوهستانیادگیری رباتیکتحلیل و توضیح۹ شهریور ۱۴۰۵، ۱۰:۴۰· 6 دقیقه مطالعه· در فناوری

«انتقال از شبیه‌سازی به واقعیت» واقعاً چگونه کار می‌کند: مکانیسم‌های یادگیری رباتیک

ربات‌هایی که در محیط شبیه‌سازی بی‌نقص عمل می‌کنند، اغلب در دنیای فیزیکی فوراً شکست می‌خورند. «انتقال از شبیه‌سازی به واقعیت» (Sim-to-Real Transfer) این «شکاف واقعیت» را با آموزش مدل‌های هوش مصنوعی برای انتظار یک جهان آشفته و غیرقابل پیش‌بینی پر می‌کند.

به قلم کاوه کردی

خوش‌بینان شبیه‌سازی 40%واقع‌گرایان سخت‌افزار 35%طرفداران واقعیت به شبیه‌سازی 25%
خوش‌بینان شبیه‌سازی
معتقدند که افزایش مقیاس آموزش مجازی و تصادفی‌سازی دامنه در نهایت تمام مشکلات کنترل رباتیک را حل خواهد کرد.
واقع‌گرایان سخت‌افزار
استدلال می‌کنند که برای بستن واقعی شکاف واقعیت، آزمایش فیزیکی و موتورهای با کیفیت بالا و تأخیر کم ضروری هستند.
طرفداران واقعیت به شبیه‌سازی
بر استفاده از اسکن سه‌بعدی و شناسایی سیستم برای ساخت کپی‌های دیجیتالی دقیق از دنیای فیزیکی تمرکز دارند.

نکات کلیدی

  • انتقال از شبیه‌سازی به واقعیت، فرآیند پیاده‌سازی یک سیاست کنترل رباتیک است که در شبیه‌سازی مجازی آموزش دیده، بر روی سخت‌افزار فیزیکی.
  • «شکاف واقعیت» به این دلیل رخ می‌دهد که شبیه‌سازها نمی‌توانند اصطکاک دنیای واقعی، نویز حسگرها و تأخیر موتورها را به طور کامل مدل‌سازی کنند.
  • «تصادفی‌سازی دامنه» (Domain Randomization) این شکاف را با آموزش هوش مصنوعی در هزاران شبیه‌سازی متنوع با قوانین فیزیکی تصادفی، پر می‌کند.
  • آموزش در شبیه‌سازی ضروری است زیرا جمع‌آوری میلیون‌ها اپیزود آزمون و خطا بر روی ربات‌های فیزیکی بسیار کُند و خطرناک است.
  • تکنیک‌های «واقعیت به شبیه‌سازی» (Real-to-Sim) در حال ظهور هستند تا محیط‌های فیزیکی را اسکن کرده و دوقلوهای دیجیتالی بسیار دقیقی برای آموزش مجازی ایجاد کنند.

چرا مهم است

جهش اخیر در ربات‌های انسان‌نما و چهارپای توانمند، نه به دلیل موتورها یا باتری‌های جدید، بلکه ناشی از پیشرفت‌های نرم‌افزاری است که به هوش مصنوعی اجازه می‌دهد در جهان‌های مجازی تمرین کند. درک مکانیسم «انتقال از شبیه‌سازی به واقعیت» توضیح می‌دهد که چرا ربات‌ها ناگهان در حال ترک آزمایشگاه‌ها و ورود به کارخانه‌ها و خانه‌ها هستند.

رقابت جهانی برای تسلط بر سیستم‌های فیزیکی خودران به سرعت از یک کنجکاوی تحقیقاتی به یک موضوع سیاست صنعتی ملی تبدیل شده است، که با تلاش‌های اخیر ایالات متحده برای ایجاد موانع تجاری در اطراف پهپادها و ربات‌های ساخت خارجی برجسته شده است.[5]

اگر ویدیوی تبلیغاتی هر یک از استارتاپ‌های رباتیک با سرمایه‌گذاری سنگین را که پیشتاز این حرکت هستند تماشا کنید، احتمالاً ماشینی انسان‌نما را خواهید دید که پشتک‌های بی‌نقص می‌زند، لباس تا می‌کند یا قطعات پیچیده موتور را مونتاژ می‌کند. اما آنچه متون بازاریابی به ندرت به آن اشاره می‌کنند این است که این شاهکارها تقریباً هرگز در اولین تلاش در دنیای فیزیکی محقق نمی‌شوند. در یک شبیه‌سازی فیزیکی بکر، یک سیاست یادگیری تقویتی می‌تواند به راحتی به یک ربات دیجیتال آموزش دهد که کاملاً راه برود. اما وقتی همان نرم‌افزار دقیق روی یک ماشین واقعی با وزن ۱۵۰ پوند (حدود ۶۸ کیلوگرم) بارگذاری می‌شود، ربات اغلب به شدت می‌لرزد، موتورهایش بیش از حد داغ می‌شوند و ظرف چند ثانیه از کار می‌افتد. دنیای فیزیکی برای مغزی که در خلأ آموزش دیده، به سادگی بیش از حد آشفته است.[3]

این حالت شکست در صنعت به عنوان «شکاف واقعیت» شناخته می‌شود و از لحاظ تاریخی گورستان یادگیری رباتیک بوده است. شبیه‌ساز یک انتزاع ریاضی است که در آن سطوح کاملاً صاف هستند، دوربین‌ها فاقد اعوجاج نوری هستند و موتورها فوراً پاسخ می‌دهند. در مقابل، دنیای واقعی مملو از اصطکاک غیرقابل پیش‌بینی، نویز حسگر و تأخیرهای میکروسکوپی در پاسخ محرک‌ها است. پر کردن این شکاف، گلوگاه اصلی فنی در رباتیک مدرن است و تعیین می‌کند که آیا یک ماشین در حد یک پروژه تحقیقاتی باقی می‌ماند یا به یک محصول کاربردی تبدیل می‌شود.[4]

راه‌حل، یک خط لوله نرم‌افزاری به نام «انتقال از شبیه‌سازی به واقعیت» است. مهندسان به جای تلاش برای آینه‌ای کردن کامل شبیه‌سازی‌ها با واقعیت—که کاری غیرممکن و از نظر محاسباتی ویرانگر است—اکنون مدل‌های هوش مصنوعی را آموزش می‌دهند تا انتظار یک جهان آشفته و غیرقابل پیش‌بینی را داشته باشند. توسعه‌دهندگان با تزریق عمدی نویز و تصادفی‌سازی قوانین فیزیکی در طول فاز آموزش مجازی، سیاست کنترل ربات را مجبور می‌کنند که قبل از اینکه حتی کف فیزیکی را لمس کند، مقاوم شود.[4]

شکاف واقعیت به این دلیل رخ می‌دهد که شبیه‌سازی‌های مجازی نمی‌توانند اصطکاک فیزیکی، تأخیر و نویز دنیای واقعی را به طور کامل مدل‌سازی کنند.

برای درک اینکه چرا انتقال از شبیه‌سازی به واقعیت ضروری است، باید به حجم عظیم داده‌های مورد نیاز برای آموزش یک سیستم هوش مصنوعی فیزیکی مدرن نگاه کرد. آموزش یک ربات برای انجام یک وظیفه دستکاری ساده، مانند برداشتن یک شیء شکننده، معمولاً نیازمند ده‌ها هزار اپیزود نمایشی است. سیستم باید یاد بگیرد که در شرایط نوری مختلف، موقعیت‌های شیء، بافت‌های سطح و جهت‌گیری‌های گیره، تعمیم‌پذیر باشد. اجرای صرف این اپیزودها بر روی سخت‌افزار فیزیکی به طرز دردناکی کُند، پرهزینه و بسیار پرخطر است.

شبیه‌سازی مستقیماً این گلوگاه داده را برطرف می‌کند. یک محیط مجازی با فیزیک دقیق می‌تواند داده‌های آموزشی را با سرعتی بسیار بیشتر از زمان واقعی تولید کند و هزاران سناریوی موازی را به طور همزمان بر روی یک خوشه از واحدهای پردازش گرافیکی اجرا کند. یک شرکت رباتیک می‌تواند داده‌های راه رفتن چندین سال را تنها در چند ساعت شبیه‌سازی کند. با این حال، مدلی که صرفاً بر روی داده‌های مصنوعی تمیز آموزش دیده باشد، یاد می‌گیرد که از بی‌نقصی شبیه‌سازی سوءاستفاده کند، که منجر به رفتارهای آموخته‌شده‌ای می‌شود که انتقال آن‌ها به سخت‌افزار فیزیکی کاملاً شکست می‌خورد.

یک شرکت رباتیک می‌تواند داده‌های راه رفتن چندین سال را تنها در چند ساعت شبیه‌سازی کند.

مهندسان سخت‌افزار معمولاً شکاف واقعیت را در سه دسته متمایز تشخیص می‌دهند: تقریب‌های فیزیکی، اختلافات ادراکی و دینامیک محرک. تقریب‌های فیزیکی شامل ناتوانی شبیه‌ساز در مدل‌سازی کامل تماس‌های نرم، ضرایب اصطکاک و کشش کابل‌های داخلی است. اختلافات ادراکی به این دلیل به وجود می‌آیند که دوربین‌های واقعی نویز، اعوجاج و تغییرات نوردهی را معرفی می‌کنند که رندرهای مصنوعی به طور طبیعی آن‌ها را ثبت نمی‌کنند.[1]

دشوارترین دسته، که بدنام است، دینامیک محرک است. شبیه‌سازها فوراً عمل می‌کنند، به این معنی که دستور حرکت یک بازو منجر به حرکت فوری می‌شود. ربات‌های واقعی دارای موتورهای فیزیکی با لقی، رانش حرارتی و تأخیر در گذرگاه‌های USB و کنترل‌کننده‌های موتور هستند. اگر یک سیاست یادگیری تقویتی انتظار پاسخ فوری به یک فرمان گشتاور را داشته باشد، تأخیر جزئی در یک موتور فیزیکی باعث می‌شود نرم‌افزار بیش از حد جبران کند و به لرزش‌های خشنی منجر شود که ربات‌ها را از هم می‌پاشد.[3]

تصادفی‌سازی دامنه، هوش مصنوعی را مجبور می‌کند تا در هزاران شبیه‌سازی فیزیکی کمی نادرست یاد بگیرد و آن را به اندازه‌ای مقاوم می‌کند که بتواند از پس واقعیت برآید.

مکانیسم اصلی مورد استفاده برای بستن این شکاف، «تصادفی‌سازی دامنه» است. مهندسان به جای تلاش برای ساختن یک شبیه‌سازی بی‌نقص، هزاران شبیه‌سازی کمی نادرست ایجاد می‌کنند. در طول آموزش، سیستم به طور مداوم مقادیر مختلفی را برای جرم، اصطکاک، میرایی، جاذبه و اشکال اشیاء تغییر می‌دهد. ممکن است یک ربات مجازی در محیطی با جاذبه کم و اصطکاک زیاد آموزش ببیند، در حالی که دیگری با جاذبه سنگین و کف‌های لغزنده روبرو شود.[4]

با قرار دادن شبکه عصبی در معرض این توزیع گسترده از پارامترهای فیزیکی، سیاست کنترل یاد می‌گیرد که ثبات را بر بهینه‌سازی کامل اولویت دهد. ترفند هوشمندانه تصادفی‌سازی دامنه این است که دنیای واقعی را تنها به عنوان یک تغییر دیگر که ربات قبلاً دیده است، در نظر می‌گیرد. هنگامی که این سیاست در نهایت بر روی سخت‌افزار فیزیکی پیاده‌سازی می‌شود، اصطکاک غیرمنتظره یک فرش یا تأخیر جزئی یک موتور به خوبی مدیریت می‌شود، زیرا نرم‌افزار قبلاً در شبیه‌سازی از شرایط بسیار بدتری جان سالم به در برده است.[1]

فراتر از تصادفی‌سازی، مهندسان برای اطمینان از انتقال روان، به شدت به کالیبراسیون لمسی و شکل‌دهی پاداش متکی هستند. کالیبراسیون لمسی شامل نگاشت بازخورد دقیق گشتاور از موتورهای فیزیکی به داخل شبیه‌سازی است، که تضمین می‌کند ربات مجازی مقاومت را به همان شکلی که ربات واقعی احساس می‌کند، حس کند. شکل‌دهی پاداش شامل افزودن جریمه‌های ریاضی در طول آموزش است تا هوش مصنوعی از سوءاستفاده از اشکالات شبیه‌سازی دست بردارد، مثلاً جریمه کردن حرکات تند برای تشویق مسیرهای روان و سازگار با موتور.[2]

برای وظایف بسیار پیچیده، مانند مونتاژ صنعتی یا قرار دادن یک میخ در یک سوراخ تنگ، انتقال از شبیه‌سازی به واقعیت نیازمند ادغام حتی محکم‌تری است. چارچوب‌های اخیر به مهندسان اجازه می‌دهند تا سیاست‌های تخصصی را برای مونتاژ قطعات متنوع هندسی، کاملاً در شبیه‌سازی آموزش دهند. با مدل‌سازی دقیق تعاملات پربرخورد قطعات فلزی که روی یکدیگر می‌لغزند، این سیاست‌ها می‌توانند به «انتقال بدون آموزش مجدد» دست یابند، به این معنی که مهارت‌های مونتاژ آموخته شده در دنیای مجازی مستقیماً و بدون هیچ تنظیم فیزیکی اضافی، در کف کارخانه اعمال می‌شوند.

وظایف پربرخورد مانند مونتاژ صنعتی نیازمند مدل‌سازی بسیار دقیق محرک‌ها (Actuators) است تا انتقال موفقیت‌آمیزی از شبیه‌سازی به کف کارخانه صورت گیرد.

این خط لوله همچنین در حال دوطرفه شدن است و منجر به ظهور تکنیک‌های «واقعیت به شبیه‌سازی» شده است. اگر انتقال از شبیه‌سازی به واقعیت در مورد انتقال یک مغز به یک بدن فیزیکی باشد، واقعیت به شبیه‌سازی در مورد اطمینان از این است که زمین آموزش مجازی به طور دقیق محیط استقرار را منعکس کند. محققان با استفاده از اسکن لایدار (LiDAR) و فتوگرامتری، می‌توانند دوقلوهای دیجیتالی از محیط‌های دنیای واقعی—مانند یک آزمایشگاه خاص یا یک اتاق نشیمن نامرتب—را ثبت کرده و آن شبکه‌های سه‌بعدی دقیق را برای تمرین ربات به شبیه‌ساز وارد کنند.[4]

با وجود این پیشرفت‌های سریع، شکاف واقعیت به طور کامل ریشه‌کن نشده است. انتقال از شبیه‌سازی به واقعیت برای دستکاری‌های غیرقابل درک، مانند هل دادن اشیاء سنگین، و برای مدیریت مواد بسیار تغییرشکل‌پذیر مانند پارچه، کابل یا مایعات، همچنان فوق‌العاده دشوار است. شبیه‌سازی فیزیک دقیق یک حوله در حال تا شدن یا یک مایع در حال پاشیدن هنوز از نظر محاسباتی بسیار پرهزینه است، به این معنی که ربات‌های آموزش‌دیده برای مدیریت این مواد اغلب نیازمند تنظیم دقیق گسترده در دنیای واقعی هستند.[3][4]

اصطلاحات کلیدی

شکاف واقعیت (Reality Gap)
افت عملکردی که زمانی رخ می‌دهد که یک مدل هوش مصنوعی آموزش‌دیده در یک شبیه‌سازی مجازی بی‌نقص، در دنیای فیزیکی آشفته و غیرقابل پیش‌بینی پیاده‌سازی می‌شود.
تصادفی‌سازی دامنه (Domain Randomization)
تکنیک آموزشی که در آن پارامترهای فیزیکی مانند جاذبه، اصطکاک و جرم به طور مداوم در شبیه‌سازی تغییر داده می‌شوند تا هوش مصنوعی مجبور به یادگیری رفتارهای مقاوم و سازگار شود.
دینامیک محرک (Actuator Dynamics)
رفتار فیزیکی موتورهای یک ربات، شامل تأخیر، رانش حرارتی و محدودیت‌های گشتاور، که شبیه‌سازی کامل آن‌ها به طور بدنامی دشوار است.
انتقال بدون آموزش مجدد (Zero-Shot Transfer)
پیاده‌سازی موفقیت‌آمیز یک سیاست هوش مصنوعی از شبیه‌سازی مستقیماً بر روی سخت‌افزار فیزیکی بدون نیاز به هیچ آموزش یا تنظیم دقیق اضافی در دنیای واقعی.
یادگیری تقویتی (Reinforcement Learning)
روشی برای آموزش هوش مصنوعی که در آن یک عامل نرم‌افزاری از طریق آزمون و خطا برای رسیدن به یک هدف یاد می‌گیرد و برای اقدامات موفقیت‌آمیز پاداش‌های ریاضی دریافت می‌کند.

پرسش‌های متداول

چرا ربات‌ها نمی‌توانند مستقیماً در دنیای واقعی یاد بگیرند؟

آموزش یک ربات نیازمند ده‌ها هزار تلاش آزمون و خطا است. انجام این کار بر روی سخت‌افزار فیزیکی بسیار کُند است، خطر تخریب ماشین‌آلات گران‌قیمت را دارد و می‌تواند برای انسان‌ها خطرناک باشد.

تصادفی‌سازی دامنه چگونه کمک می‌کند؟

با آموزش ربات در هزاران شبیه‌سازی با فیزیک کمی نادرست—مانند تغییر جاذبه یا کف‌های لغزنده—هوش مصنوعی یاد می‌گیرد که سازگار شود. هنگامی که با دنیای واقعی روبرو می‌شود، آن را فقط به عنوان یک تغییر دیگر در نظر می‌گیرد.

انتقال چه وظایفی از شبیه‌سازی همچنان دشوار است؟

وظایفی که شامل اشیاء بسیار تغییرشکل‌پذیر هستند، مانند تا کردن لباس، باز کردن گره کابل‌ها یا ریختن مایعات، همچنان دشوار باقی می‌مانند زیرا شبیه‌سازی فیزیک دقیق آن‌ها از نظر محاسباتی بسیار پرهزینه است.

منابع

پوشش منابع

5 منبع

3 دیدگاه شناسایی‌شده

خوش‌بینان شبیه‌سازی 40%واقع‌گرایان سخت‌افزار 35%طرفداران واقعیت به شبیه‌سازی 25%
  1. [1]arXivطرفداران واقعیت به شبیه‌سازی

    Towards bridging the gap: Systematic sim-to-real transfer for diverse legged robots

    مطالعه در arXiv
  2. [2]NVIDIA Developerخوش‌بینان شبیه‌سازی

    Transferring Industrial Robot Assembly Tasks from Simulation to Reality

    مطالعه در NVIDIA Developer
  3. [3]Almond AIواقع‌گرایان سخت‌افزار

    Glossary: Sim-to-Real Transfer

    مطالعه در Almond AI
  4. [4]تیم سردبیری کوهستانطرفداران واقعیت به شبیه‌سازی

    تحلیل تیم سردبیری کوهستان

    مطالعه در تیم سردبیری کوهستان
  5. [5]TechCrunchواقع‌گرایان سخت‌افزار

    The U.S. is building barriers around drones and robots, but China has scale to get around them

    مطالعه در TechCrunch

نظرات

همیشه در جریان باشید

هر زاویه. هر روز.

دریافت فناوری اخبار همراه با پوشش کامل منابع و تحلیل دیدگاه‌ها، مستقیم در صندوق ورودی شما.