هوش مصنوعی به ربات انساننمای Figure قدرت اجرای دستورات صوتی را بخشید.
به گزارش نگاه فناوری:شرکت Figure AI از پیشرفت چشمگیر ربات انساننمای خود خبر داد. این ربات با استفاده از مدل هوش مصنوعی Helix قادر به تفسیر و اجرای دستورات صوتی طبیعی انسان است. این پیشرفت رباتهای انساننما را قادر میسازد تا بدون نیاز به برنامهریزی مجدد، با محیط و اشیای جدید تعامل داشته باشند و وظایف پیچیدهتری را انجام دهند.
شرکت Figure AI از یک دستاورد بزرگ در زمینه توسعه رباتهای انساننما پرده برداشت. این شرکت از معماری جدید هوش مصنوعی خود به نام Helix رونمایی کرده است که به رباتهای انساننما اجازه میدهد تا دستورات صوتی طبیعی را به طور کامل درک کرده و آنها را اجرا کنند. این بدان معناست که رباتها میتوانند به جای دریافت دستورات کدگذاری شده یا از پیش تعیین شده، به طور مستقیم از انسانها دستور بگیرند و آنها را به شیوه مؤثری انجام دهند.
بر اساس اطلاعات منتشر شده در وبسایت Figure AI، مدل هوش مصنوعی “بینایی-زبانی-کنشی” (VLA) این شرکت که Helix نام دارد، به رباتهای انساننما امکان میدهد تا دستورات زبانی کاربران را به درستی متوجه شوند و حتی با ابزارهایی که قبلاً ندیدهاند، به راحتی تعامل کنند. این قابلیت، رباتها را قادر میسازد تا وظایف متنوع و پیچیدهای را بدون نیاز به برنامهریزی جداگانه برای هر کار، انجام دهند.
یکی از ویژگیهای کلیدی Helix، سیستم استدلال پیشرفته با قابلیت پردازش لحظهای آن است. این سیستم به رباتها کمک میکند تا نه تنها معنای اشیا را درک کنند (بدانند هر شیء چیست)، بلکه توانایی کنش و حرکت نیز داشته باشند (بدانند چگونه اشیا را بردارند و حرکت دهند). به عبارت دیگر، رباتها میتوانند به طور همزمان محیط اطراف خود را ببینند، دستورات صوتی را بشنوند، آنها را تفسیر کنند و سپس بر اساس آن عمل کنند.
یکی از مزایای اصلی Helix این است که رباتها بدون نیاز به دریافت بهروزرسانی نرمافزاری یا آموزش با دادههای جدید، به مرور زمان توانایی بیشتری پیدا میکنند. این امر به ویژه در محیطهای پویا که اشیا و شرایط دائماً در حال تغییر هستند، بسیار حائز اهمیت است.
برای نشان دادن نحوه عملکرد این هوش مصنوعی، شرکت Figure AI ویدیویی را منتشر کرده است که در آن دو ربات Figure با همکاری یکدیگر مواد غذایی و وسایل مختلفی را که برای اولین بار میدیدند، در یخچال یا کشو قرار میدهند.
در این ویدیو، حرکات رباتها بسیار آهسته به نظر میرسد، اما نکته قابل توجه، توانایی آنها در درک و تفسیر اشیایی است که میبینند. آنها قابلیت تعمیم دارند و میدانند که به عنوان مثال، شیر یک ماده خوراکی است و باید آن را در یخچال قرار داد. این امر نشان میدهد که رباتها نه تنها اشیا را تشخیص میدهند، بلکه میتوانند آنها را دستهبندی کرده و بر اساس آن تصمیمگیری کنند.

شرکت Figure AI برای دستیابی به این توانایی، مدلی را توسعه داده است که آن را Vision-Language-Action مینامند. این مدل، قدرت بینایی، ادراک زبانی و کنترل را به صورت یکپارچه در اختیار ربات قرار میدهد و به آن اجازه میدهد تا به طور همزمان از این سه قابلیت برای انجام وظایف خود استفاده کند.
شرکت Figure سیستم Helix را روی تقریباً ۵۰۰ ساعت کنترل رباتیک از راه دور آموزش داده و سپس از فرایند برچسبگذاری خودکار برای تولید دستورالعملهای زبانی طبیعی برای هر رفتار استفاده کرده است. همچنین، کل سیستم هوش مصنوعی جدید روی پردازشگرهای گرافیکی تعبیهشده در رباتها اجرا میشود که نشان از قدرت پردازش بالای این سیستم دارد.
همانطور که در ویدیو مشاهده میشود، ربات Figure توجه خاصی به کارهای خانه دارد. سیستم هوش مصنوعی جدید باعث میشود رباتهای Figure برای انجام کارهای منزل مناسبتر شوند؛ زیرا در خانه ابزارها و وسایل گوناگونی وجود دارد و مرتباً نیز جای آنها عوض میشود. روش بهینه برای انجام چنین وظایفی، استفاده از یک سیستم VLA است که قدرت تفسیر و شناسایی لحظهای را در ربات قرار میدهد و به آن اجازه میدهد تا با محیط اطراف خود به طور مؤثرتری تعامل کند.









