آخرین اخبار:
23:23 09 / 05 /1405

دیپ‌مایند سامانه هوشمندی ساخت که کارهای ظریف و پیچیده را به ربات‌ها می‌آموزد

ربات گوگل دیپ‌مایند
گوگل دیپ‌مایند از نسل جدید سامانه هوش مصنوعی رباتیک خود با نام Gemini Robotics ۲.۰ رونمایی کرد. این مجموعه از مدل‌های پیشرفته برای افزایش توانایی ربات‌ها در درک محیط، تصمیم‌گیری، کنترل حرکات و تعامل ایمن با انسان‌ها توسعه یافته و به گفته گوگل، گامی مهم در مسیر دستیابی به هوش مصنوعی عمومی فیزیکی به شمار می‌رود.

به گزارش خبرگزاری آنا؛ برخلاف الگوریتم‌های سنتی رباتیک که معمولاً تنها برای انجام یک وظیفه مشخص طراحی می‌شدند، مجموعه Gemini Robotics ۲ به ربات‌ها اجازه می‌دهد محیط اطراف خود را به‌صورت لحظه‌ای تحلیل کنند، دستورات زبانی انسان را درک کنند و آن‌ها را به مجموعه‌ای از حرکات دقیق و هماهنگ در دنیای واقعی تبدیل کنند. این موضوع باعث می‌شود ربات‌ها در شرایط متغیر نیز بتوانند بدون نیاز به برنامه‌ریزی مجدد، تصمیم‌های مناسب بگیرند و وظایف خود را ادامه دهند.

کنترل کامل بدن ربات‌های انسان‌نما

یکی از مهم‌ترین پیشرفت‌های این نسل، پشتیبانی از کنترل تمام‌بدنه است. در گذشته بسیاری از مدل‌های هوش مصنوعی تنها قادر بودند بازو‌های ربات یا بخش محدودی از حرکات آن را کنترل کنند، اما Gemini Robotics ۲ می‌تواند تمام اندام‌های یک ربات انسان‌نما را به‌صورت هماهنگ هدایت کند.

گوگل در نمونه‌های نمایشی خود نشان داده است که ربات انسان‌نمای Apollo ۲ با دریافت دستور ساده‌ای مانند «آب‌پاش را بردار و آن را داخل سطل سبز روی قفسه پایینی قرار بده»، مسیر مناسب را انتخاب می‌کند، به سمت هدف حرکت می‌کند، برای برداشتن وسیله خم می‌شود، تعادل جسم را حفظ می‌کند و آن را با دقت در محل موردنظر قرار می‌دهد. انجام چنین زنجیره‌ای از حرکات تا پیش از این معمولاً به برنامه‌ریزی‌های طولانی و از پیش تعیین‌شده نیاز داشت.

افزایش دقت حرکات دست و انجام کار‌های ظریف

گوگل علاوه بر کنترل حرکت بدن، روی افزایش ظرافت حرکات دست نیز تمرکز ویژه‌ای داشته است. Gemini Robotics ۲ قادر است دست‌های رباتیک پنج‌انگشتی پیشرفته مانند SharpaWave را که از ۲۲ درجه آزادی حرکتی برخوردار هستند کنترل کند. این سطح از دقت باعث می‌شود ربات بتواند وظایفی مانند گره زدن طناب، بستن زیپ کیف، باز کردن پیچ یا جابه‌جایی اشیای کوچک را با دقت بسیار بیشتری نسبت به نسل‌های قبل انجام دهد؛ مهارت‌هایی که برای حضور ربات‌ها در کارخانه‌ها، مراکز خدماتی و حتی محیط‌های خانگی اهمیت زیادی دارند.

سه مدل مکمل برای مدیریت کامل ربات

گوگل این سامانه را در قالب سه مدل مکمل توسعه داده است تا هر بخش از فرایند تصمیم‌گیری و اجرای حرکت به‌صورت تخصصی انجام شود.

نخستین مدل Gemini Robotics ER ۲ است که نقش مغز متفکر سیستم را بر عهده دارد. این مدل که بر پایه فناوری Gemini ۳.۵ Flash ساخته شده، محیط را تحلیل می‌کند، فرمان‌های متنی یا صوتی انسان را می‌فهمد و وظایف پیچیده چندمرحله‌ای را برنامه‌ریزی می‌کند. گوگل اعلام کرده این مدل از طریق Google AI Studio و Gemini API نیز در اختیار توسعه‌دهندگان قرار گرفته است.

مدل دوم با نام Gemini Robotics ۲ وظیفه تبدیل تصمیم‌های سطح بالا به فرمان‌های حرکتی را بر عهده دارد. این مدل دستورات صادرشده توسط بخش استدلال را به سیگنال‌های دقیق قابل اجرا برای موتور‌های ربات تبدیل می‌کند تا حرکات با دقت بالا انجام شوند.

در نهایت، مدل Gemini Robotics On-Device ۲ نسخه‌ای سبک و بهینه‌شده است که مستقیماً روی سخت‌افزار ربات اجرا می‌شود و برای عملکرد خود به اتصال اینترنت نیاز ندارد. گوگل می‌گوید این مدل می‌تواند تنها با کمتر از ۲۰۰ نمونه آموزشی، خود را با ربات‌های جدید سازگار کند و روی آن‌ها آموزش ببیند.

تحلیل زنده ویدیو و همکاری هم‌زمان چند ربات

یکی دیگر از قابلیت‌های مهم این نسل، توانایی تحلیل لحظه‌ای تصاویر دوربین ربات است. مدل ER ۲ می‌تواند جریان ویدیویی را به‌صورت زنده بررسی کند، مراحل انجام یک وظیفه را تشخیص دهد و اگر بخشی از کار با خطا مواجه شود، تنها همان مرحله را دوباره اجرا کند. برای مثال اگر جسمی از دست ربات بیفتد، نیازی به آغاز دوباره کل فرایند نیست و سیستم تنها همان بخش را اصلاح می‌کند.

گوگل همچنین قابلیت همکاری چند ربات را نیز به نمایش گذاشته است. در یکی از نمونه‌های منتشرشده، ربات انسان‌نمای Apollo ۲ در کنار بازوی صنعتی Franka Duo به‌صورت هم‌زمان روی یک پروژه مشترک کار می‌کنند. مدل هوش مصنوعی وظایف را میان ربات‌ها تقسیم می‌کند و آن‌ها بدون ایجاد تداخل، عملیات را با هماهنگی کامل به پایان می‌رسانند.

تمرکز ویژه بر ایمنی ربات‌ها

گوگل تأکید کرده است که افزایش توانایی ربات‌ها بدون ارتقای ایمنی می‌تواند خطرات جدی ایجاد کند. به همین دلیل در Gemini Robotics ۲ علاوه بر سامانه‌های سنتی ایمنی رباتیک، لایه‌های جدیدی از کنترل مبتنی بر هوش مصنوعی نیز اضافه شده است.

به گفته گوگل، اگر انسان بیش از حد به محدوده کاری ربات نزدیک شود، سامانه به‌صورت خودکار حرکت ربات را متوقف می‌کند و پس از ایمن شدن محیط، ادامه فعالیت را از سر می‌گیرد. علاوه بر این، گوگل معیار ارزیابی جدیدی با نام ASIMOV-Agentic معرفی کرده که برای سنجش ایمنی عامل‌های هوش مصنوعی طراحی شده است. این معیار توانایی مدل در رد کردن دستور‌های خطرناک، تشخیص انجام‌پذیر بودن ایمن یک مأموریت و درخواست کمک از اپراتور انسانی در شرایط مبهم را ارزیابی می‌کند و کد‌های آن نیز به‌صورت متن‌باز منتشر شده‌اند.

اگرچه این فناوری هنوز تا رسیدن به سرعت، دقت و انعطاف‌پذیری کامل انسان فاصله دارد، اما معرفی Gemini Robotics ۲ نشان می‌دهد گوگل گام مهمی برای ورود نسل جدید ربات‌های هوشمند به کارخانه‌ها، انبارها، مراکز خدماتی و حتی خانه‌ها برداشته است.

انتهای پیام/

ارسال نظر