کنترلکنندههای شبکه عصبی ثبات را برای روباتهای پیچیده فراهم میکنند و راه را برای استقرار ایمنتر وسایل نقلیه خودران و ماشینهای صنعتی هموار میکنند. محققان موسسه فناوری ماساچوست یک الگوریتم کارآمد برای احراز هویت عملکرد لیاپانوف در سیستمهای پیچیده ایجاد کردهاند که از پایداری و ایمنی روباتهای کنترلشده توسط شبکه عصبی در محیطهای مختلف اطمینان میدهد.
شبکههای عصبی تأثیر زیادی بر نحوه طراحی کنترلکنندههای ربات توسط مهندسان داشته است و باعث ایجاد ماشینهای سازگارتر و کارآمدتر میشود. با این حال، این سیستمهای یادگیری ماشینی شبیه به مغز نیز یک شمشیر دولبه هستند: پیچیدگی آنها آنها را قدرتمند میکند، اما آنها همچنین برای اطمینان از اینکه روباتهای مجهز به شبکههای عصبی میتوانند وظایف خود را با خیال راحت انجام دهند، تلاش میکنند.
روش سنتی برای تایید امنیت و ثبات از طریق تکنیکی به نام تابع لیاپانوف است. اگر بتوانید تابع لیاپانوف را با مقداری ثابت در حال کاهش پیدا کنید، می توانید بدانید که ناامنی یا بی ثباتی مرتبط با مقادیر بالاتر هرگز رخ نخواهد داد. با این حال، برای روباتهایی که توسط شبکههای عصبی کنترل میشوند، روشهای قبلی برای تأیید شرایط لیاپانوف به خوبی برای ماشینهای پیچیده قابل مقایسه نبودند.
محققان آزمایشگاه علوم کامپیوتر و هوش مصنوعی MIT (CSAIL) و سایر موسسات اکنون فناوریهای جدیدی را توسعه دادهاند که اجازه صدور گواهینامه دقیق محاسبات لیاپانوف را در سیستمهای پیچیدهتر میدهد. این الگوریتم به طور موثر عملکرد لیاپانوف را جستجو و تأیید می کند، که تضمین پایداری سیستم را فراهم می کند. این رویکرد این پتانسیل را دارد که استقرار ربات ها و وسایل نقلیه خودران از جمله هواپیماها و فضاپیماها را ایمن تر کند.
برای پیشی گرفتن از الگوریتم های قبلی، محققان یک میانبر برای صرفه جویی در هزینه در فرآیند آموزش و اعتبار سنجی پیدا کردند. آنها نمونههای متقابل کمهزینهتری تولید میکنند - برای مثال، دادههای متخاصم از حسگرهایی که میتوانند کنترلکنندهها را غیرفعال کنند - و سپس سیستم روباتیک را برای مقابله با آن نمونههای متقابل بهینه میکنند. درک این موارد لبه به یادگیری ماشین کمک می کند تا موقعیت های چالش برانگیز را مدیریت کند و به آن ها اجازه می دهد تا در محدوده وسیع تری از شرایط ایمن از همیشه کار کنند. آنها سپس فرمول تأیید جدیدی را توسعه دادند که قادر به استفاده از اعتبارسنجی شبکه عصبی مقیاسپذیر، -CROWN، برای ارائه ضمانتهای سختگیرانه در بدترین حالت علاوه بر مثالهای متقابل است.
ما عملکرد تجربی قابل توجهی را در ماشینهای کنترلشده با هوش مصنوعی مانند روباتهای انساننما و سگهای روباتی دیدهایم، اما این کنترلکنندههای هوش مصنوعی فاقد اطمینان رسمی است که برای سیستمهای حیاتی ایمنی حیاتی است.» لوجی یانگ، دانشجوی دکترا در مهندسی برق و علوم کامپیوتر (EECS) در این باره گفت: «کار ما شکاف بین سطح عملکرد کنترلکنندههای شبکه عصبی و تضمینهای امنیتی مورد نیاز برای استقرار کنترلکنندههای پیچیدهتر شبکه عصبی در دنیای واقعی را کاهش میدهد. موسسه فناوری ماساچوست و یک محقق وابسته به CSAIL. "
در یک نمایش دیجیتال، این تیم شبیهسازی کردند که چگونه یک پهپاد کوادکوپتر با حسگر لیدار در یک محیط دو بعدی پایدار است. الگوریتم آنها تنها با استفاده از اطلاعات محدود محیطی ارائه شده توسط حسگر لیدار، پهپاد را با موفقیت به موقعیت شناور پایدار هدایت می کند.
در دو آزمایش دیگر، رویکرد آنها دو سیستم رباتیک شبیهسازی شده را قادر میسازد تا تحت طیف وسیعتری از شرایط پایدار عمل کنند: یک آونگ معکوس و یک وسیله نقلیه که مسیر را دنبال میکند. این آزمایشها، اگرچه کوچک هستند، اما بسیار پیچیدهتر از اعتبارسنجیهای شبکه عصبی قبلی هستند، به ویژه از آنجایی که شامل مدلهای حسگر میشوند.
سیکون گائو، دانشیار علوم و مهندسی کامپیوتر در دانشگاه کالیفرنیا در سن دیگو گفت: برخلاف مشکلات رایج یادگیری ماشین، استفاده دقیق از شبکه های عصبی به عنوان توابع لیاپانوف مستلزم حل مسائل دشوار بهینه سازی جهانی است، بنابراین مقیاس پذیری یک گلوگاه کلیدی است. .
در مقایسه با روش های موجود، پیشرفت های قابل توجهی در مقیاس پذیری و کیفیت راه حل ارائه می دهد. این کار مسیرهای هیجان انگیزی را برای توسعه بیشتر الگوریتم های بهینه سازی برای روش لیاپانوف عصبی و همچنین استفاده دقیق از یادگیری عمیق در کنترل و رباتیک باز می کند.
روش جدید پایداری پتانسیل استفاده گسترده را دارد. در این برنامه ها، ایمنی در درجه اول اهمیت قرار دارد. این می تواند اطمینان حاصل شود که اتومبیل های خودران مانند هواپیماها و فضاپیماها راحت تر رانندگی می کنند. به همین ترتیب، پهپادهایی که اقلام را تحویل می دهند یا از مناطق مختلف نقشه برداری می کنند نیز می توانند از این تضمین امنیتی بهره مند شوند.
رویکرد جدید به رباتیک محدود نمی شود و ممکن است در آینده به کاربردهای دیگر مانند پردازش های زیست پزشکی و صنعتی کمک کند. در حالی که این فناوری از نظر مقیاس پذیری نسبت به کارهای قبلی بهبود یافته است، محققان در حال بررسی چگونگی عملکرد بهتر آن در سیستم هایی با ابعاد بالاتر هستند. آنها همچنین می خواهند داده هایی را فراتر از خوانش های لیدار، مانند تصاویر و ابرهای نقطه ای، در نظر بگیرند.
به عنوان یک جهت تحقیقاتی آینده، این تیم امیدوار است که تضمین پایداری یکسانی را برای سیستمها در محیطهای نامشخص و مستعد تداخل ارائه کند. به عنوان مثال، اگر یک پهپاد در معرض وزش شدید باد قرار گیرد، محققان میخواهند مطمئن شوند که همچنان پایدار پرواز میکند و ماموریت مورد نظر خود را انجام میدهد.
علاوه بر این، آنها قصد دارند روشهای خود را برای مسائل بهینهسازی به کار ببرند، با هدف به حداقل رساندن زمان و مسافت مورد نیاز ربات برای تکمیل کار با حفظ ثبات. و قصد دارد فناوری خود را به رباتهای انساننما و سایر ماشینهای دنیای واقعی گسترش دهد، جایی که ربات باید در هنگام تماس با محیط اطراف خود پایدار باشد.

