دیپمایند سامانه هوشمندی ساخت که کارهای ظریف و پیچیده را به رباتها میآموزد
به گزارش خبرگزاری آنا؛ برخلاف الگوریتمهای سنتی رباتیک که معمولاً تنها برای انجام یک وظیفه مشخص طراحی میشدند، مجموعه Gemini Robotics ۲ به رباتها اجازه میدهد محیط اطراف خود را بهصورت لحظهای تحلیل کنند، دستورات زبانی انسان را درک کنند و آنها را به مجموعهای از حرکات دقیق و هماهنگ در دنیای واقعی تبدیل کنند. این موضوع باعث میشود رباتها در شرایط متغیر نیز بتوانند بدون نیاز به برنامهریزی مجدد، تصمیمهای مناسب بگیرند و وظایف خود را ادامه دهند.
کنترل کامل بدن رباتهای انساننما
یکی از مهمترین پیشرفتهای این نسل، پشتیبانی از کنترل تمامبدنه است. در گذشته بسیاری از مدلهای هوش مصنوعی تنها قادر بودند بازوهای ربات یا بخش محدودی از حرکات آن را کنترل کنند، اما Gemini Robotics ۲ میتواند تمام اندامهای یک ربات انساننما را بهصورت هماهنگ هدایت کند.
گوگل در نمونههای نمایشی خود نشان داده است که ربات انساننمای Apollo ۲ با دریافت دستور سادهای مانند «آبپاش را بردار و آن را داخل سطل سبز روی قفسه پایینی قرار بده»، مسیر مناسب را انتخاب میکند، به سمت هدف حرکت میکند، برای برداشتن وسیله خم میشود، تعادل جسم را حفظ میکند و آن را با دقت در محل موردنظر قرار میدهد. انجام چنین زنجیرهای از حرکات تا پیش از این معمولاً به برنامهریزیهای طولانی و از پیش تعیینشده نیاز داشت.
افزایش دقت حرکات دست و انجام کارهای ظریف
گوگل علاوه بر کنترل حرکت بدن، روی افزایش ظرافت حرکات دست نیز تمرکز ویژهای داشته است. Gemini Robotics ۲ قادر است دستهای رباتیک پنجانگشتی پیشرفته مانند SharpaWave را که از ۲۲ درجه آزادی حرکتی برخوردار هستند کنترل کند. این سطح از دقت باعث میشود ربات بتواند وظایفی مانند گره زدن طناب، بستن زیپ کیف، باز کردن پیچ یا جابهجایی اشیای کوچک را با دقت بسیار بیشتری نسبت به نسلهای قبل انجام دهد؛ مهارتهایی که برای حضور رباتها در کارخانهها، مراکز خدماتی و حتی محیطهای خانگی اهمیت زیادی دارند.
سه مدل مکمل برای مدیریت کامل ربات
گوگل این سامانه را در قالب سه مدل مکمل توسعه داده است تا هر بخش از فرایند تصمیمگیری و اجرای حرکت بهصورت تخصصی انجام شود.
نخستین مدل Gemini Robotics ER ۲ است که نقش مغز متفکر سیستم را بر عهده دارد. این مدل که بر پایه فناوری Gemini ۳.۵ Flash ساخته شده، محیط را تحلیل میکند، فرمانهای متنی یا صوتی انسان را میفهمد و وظایف پیچیده چندمرحلهای را برنامهریزی میکند. گوگل اعلام کرده این مدل از طریق Google AI Studio و Gemini API نیز در اختیار توسعهدهندگان قرار گرفته است.
مدل دوم با نام Gemini Robotics ۲ وظیفه تبدیل تصمیمهای سطح بالا به فرمانهای حرکتی را بر عهده دارد. این مدل دستورات صادرشده توسط بخش استدلال را به سیگنالهای دقیق قابل اجرا برای موتورهای ربات تبدیل میکند تا حرکات با دقت بالا انجام شوند.
در نهایت، مدل Gemini Robotics On-Device ۲ نسخهای سبک و بهینهشده است که مستقیماً روی سختافزار ربات اجرا میشود و برای عملکرد خود به اتصال اینترنت نیاز ندارد. گوگل میگوید این مدل میتواند تنها با کمتر از ۲۰۰ نمونه آموزشی، خود را با رباتهای جدید سازگار کند و روی آنها آموزش ببیند.
تحلیل زنده ویدیو و همکاری همزمان چند ربات
یکی دیگر از قابلیتهای مهم این نسل، توانایی تحلیل لحظهای تصاویر دوربین ربات است. مدل ER ۲ میتواند جریان ویدیویی را بهصورت زنده بررسی کند، مراحل انجام یک وظیفه را تشخیص دهد و اگر بخشی از کار با خطا مواجه شود، تنها همان مرحله را دوباره اجرا کند. برای مثال اگر جسمی از دست ربات بیفتد، نیازی به آغاز دوباره کل فرایند نیست و سیستم تنها همان بخش را اصلاح میکند.
گوگل همچنین قابلیت همکاری چند ربات را نیز به نمایش گذاشته است. در یکی از نمونههای منتشرشده، ربات انساننمای Apollo ۲ در کنار بازوی صنعتی Franka Duo بهصورت همزمان روی یک پروژه مشترک کار میکنند. مدل هوش مصنوعی وظایف را میان رباتها تقسیم میکند و آنها بدون ایجاد تداخل، عملیات را با هماهنگی کامل به پایان میرسانند.
تمرکز ویژه بر ایمنی رباتها
گوگل تأکید کرده است که افزایش توانایی رباتها بدون ارتقای ایمنی میتواند خطرات جدی ایجاد کند. به همین دلیل در Gemini Robotics ۲ علاوه بر سامانههای سنتی ایمنی رباتیک، لایههای جدیدی از کنترل مبتنی بر هوش مصنوعی نیز اضافه شده است.
به گفته گوگل، اگر انسان بیش از حد به محدوده کاری ربات نزدیک شود، سامانه بهصورت خودکار حرکت ربات را متوقف میکند و پس از ایمن شدن محیط، ادامه فعالیت را از سر میگیرد. علاوه بر این، گوگل معیار ارزیابی جدیدی با نام ASIMOV-Agentic معرفی کرده که برای سنجش ایمنی عاملهای هوش مصنوعی طراحی شده است. این معیار توانایی مدل در رد کردن دستورهای خطرناک، تشخیص انجامپذیر بودن ایمن یک مأموریت و درخواست کمک از اپراتور انسانی در شرایط مبهم را ارزیابی میکند و کدهای آن نیز بهصورت متنباز منتشر شدهاند.
اگرچه این فناوری هنوز تا رسیدن به سرعت، دقت و انعطافپذیری کامل انسان فاصله دارد، اما معرفی Gemini Robotics ۲ نشان میدهد گوگل گام مهمی برای ورود نسل جدید رباتهای هوشمند به کارخانهها، انبارها، مراکز خدماتی و حتی خانهها برداشته است.
انتهای پیام/