
شرکت Google DeepMind از نسل جدید فناوری رباتیک خود با نام Gemini Robotics 2 رونمایی کرد؛ مجموعهای از مدلهای هوش مصنوعی که با هدف افزایش توانایی رباتها در درک محیط، تصمیمگیری، حرکت و انجام وظایف پیچیده طراحی شدهاند. این فناوری، گام مهمی در مسیر توسعه هوش مصنوعی فیزیکی (Physical AI) و ساخت رباتهای همهمنظوره به شمار میرود. برخلاف بسیاری از رباتهای امروزی که تنها برای انجام وظایف مشخص برنامهریزی شدهاند یا نیاز به کنترل مستقیم انسان دارند، Gemini Robotics 2 به رباتها امکان میدهد محیط اطراف خود را درک کنند، با شرایط جدید سازگار شوند و بدون نیاز به برنامهریزی مجدد، وظایف متنوعی را انجام دهند.
گوگل اعلام کرده است که این پلتفرم از سه مدل اصلی تشکیل شده است. مدل Gemini Robotics 2 یک مدل «بینایی، زبان و عمل» (Vision-Language-Action) است که دستورات متنی و اطلاعات تصویری را به حرکات فیزیکی ربات تبدیل میکند. مدل Gemini Robotics ER 2 نقش مغز متفکر ربات را بر عهده دارد و وظایفی مانند استدلال، برنامهریزی چندمرحلهای، ارتباط با انسان و هماهنگی میان چند ربات را انجام میدهد. همچنین مدل Gemini Robotics On-Device 2 برای اجرای مستقیم روی سختافزار رباتها طراحی شده و بدون نیاز به اتصال دائمی اینترنت فعالیت میکند.

یکی از مهمترین قابلیتهای Gemini Robotics 2، کنترل کامل رباتهای انساننما است. در نسخههای قبلی، کنترل رباتها عمدتاً به حرکات دست محدود بود، اما اکنون این سیستم میتواند کل بدن ربات را مدیریت کند. برای نمونه، ربات انساننمای Apollo 2 قادر است پس از دریافت یک دستور، به سمت هدف حرکت کند، اشیاء را بردارد، راه برود و آنها را در محل موردنظر قرار دهد؛ قابلیتی که نیازمند هماهنگی کامل میان بینایی، تعادل و کنترل حرکتی است. گوگل همچنین از پیشرفت چشمگیر در مهارتهای حرکتی ظریف رباتها خبر داده است. این مدل اکنون میتواند دستهای پنجانگشتی ربات را برای انجام کارهای حساسی مانند گره زدن طناب یا بستن کیسه زیپدار کنترل کند. علاوه بر این، رباتهای مجهز به گیرههای دو انگشتی نیز قادر به انجام وظایف پیچیدهای مانند بستهبندی دقیق خواهند بود.
از دیگر ویژگیهای مهم Gemini Robotics 2، همکاری چندرباتی است. در این قابلیت، چند ربات میتوانند با یکدیگر ارتباط برقرار کرده، وظایف را میان خود تقسیم کنند و برای انجام پروژههایی که از توان یک ربات خارج است، به صورت هماهنگ همکاری کنند. این ویژگی میتواند در کارخانهها، انبارهای هوشمند، مراکز درمانی و عملیات امداد و نجات کاربرد گستردهای داشته باشد. گوگل همچنین اعلام کرده است که مدل On-Device 2 میتواند تنها با چند ساعت آموزش و کمتر از ۲۰۰ نمونه داده، با انواع جدیدی از رباتها سازگار شود. این موضوع هزینه و زمان توسعه سیستمهای رباتیکی را به شکل قابل توجهی کاهش میدهد.

ایمنی نیز یکی از محورهای اصلی این پروژه است. گوگل همزمان با معرفی Gemini Robotics 2 از معیار جدیدی با نام ASIMOV-Agentic رونمایی کرده که برای ارزیابی ایمنی تصمیمگیری رباتها طراحی شده است. این سیستم میتواند درخواستهای ناایمن را رد کند، در شرایط نامطمئن از انسان کمک بخواهد و هنگام نزدیک شدن افراد به ربات، اقدامات ایمنی لازم از جمله توقف خودکار را انجام دهد. گوگل دیپمایند معتقد است Gemini Robotics 2 گامی مهم در مسیر توسعه هوش مصنوعی عمومی در دنیای فیزیکی است؛ فناوریای که در آینده میتواند رباتهایی هوشمند، سازگار و ایمن را در کنار انسانها برای انجام وظایف پیچیده در خانه، صنعت و محیطهای کاری به کار گیرد.
منبع خبر: deepmind

شاهین آقامعلی


پاسخ :