Сегодня 18 апреля 2025
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Hardware

Google упростила обучение роботов разным действиям с помощью ИИ-модели RT-2 — машины научили выбрасывать мусор

Google доложила о разработке модели искусственного интеллекта RT-2 (Robotics Transformer 2), предназначенной для интеграции в роботов. Она сочетает в себе умения обрабатывать изображение, голосовые команды и управлять двигательными функциями.

 Источник изображения: blog.google

Источник изображения: blog.google

RT-2 является первой моделью класса «зрение-язык-действие» (Vision-Language-Action — VLA). Она основана на архитектуре типа «Трансформер» и обучена на текстах и изображениях из интернета, а её ключевым преимуществом является преобразование данных в команды на выполнение определённых действий. Иными словами, отмечают в Google, она «говорит на языке роботов».

Традиционные методы обучения роботов являются чрезмерно трудоёмкими и дорогостоящими, а значит, они непрактичны для разработчиков — требуется ввод отдельных фрагментов данных по каждым объекту, среде, задаче и ситуации в реальном мире. Облегчить положение помогло внедрение модели машинного зрения PaLM-E, с которой роботы научились лучше ориентироваться в пространстве, а модель RT-1 показала, что роботы даже могут учиться друг у друга.

Нерешенной задачей до настоящего момента оставалось обучение конкретным действиям. Роботы уже могли пускаться в рассуждения высокого уровня, но не могли выполнять элементарных действий на низком. Иными словами, они думали о том, что хотят сделать, но не могли заставить собственное тело должным образом двигаться. Эту задачу решает модель RT-2 — она как единое целое обеспечивает работу алгоритмов рассуждений и управления действиями робота. Даже для задач, которые не входили в массив данных на этапе обучения.

К примеру, чтобы на традиционных алгоритмах научить робота выбрасывать мусор потребовалось бы сначала обучить робота явно идентифицировать мусор, а потом показать, как его взять и потом выбросить. Обученная на большом массиве данных модель RT-2 уже имеет представление о том, что такое мусор, а также о том, как его выбрасывать, хотя этому действию она никогда напрямую не обучалась. Она даже знакома с абстрактной природой мусора: пакет чипсов и банановая кожура становятся мусором, когда человек съел соответственно чипсы и банан — RT-2 понимает и это, что помогает ей выполнять поставленную задачу.

Инженеры Google сравнили эффективность моделей RT-1 и RT-2 в ходе более чем 6000 практических испытаний — новая система не уступает старой в очевидных задачах и показывает почти двухкратный рост эффективности при работе с незнакомыми в явном виде объектами и понятиями: 62 % успешных исходов против 32 % у RT-1.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Cloud.ru представил первый в России управляемый облачный сервис для инференса ИИ-моделей — Evolution ML Inference 14 мин.
«Жду эту игру с самого рождения»: новый трейлер фэнтезийного шутера Covenant с элементами Dark Souls и Dishonored впечатлил геймеров 49 мин.
В Android вернётся переключатель «Не беспокоить» для тех, кому не понравились «Режимы» 3 ч.
Автор Loretta раскрыл дату выхода новой игры — хоррор-стратегии Anoxia Station про погоню за нефтью в недрах умирающей Земли 3 ч.
Создатели кинематографичного боевика Spine в духе «Джона Уика» заинтриговали игроков тизером хардкорного режима — новый геймплейный трейлер 4 ч.
Цифровой белорусский рубль «полноценно» заработает во второй половине 2026 года 4 ч.
Google вживую продемонстрировала возможности Android XR 5 ч.
Премьера аддона A Pirate’s Fortune, дата выхода на Switch 2 и бесплатное демо: Ubisoft разразилась новостями о Star Wars Outlaws 5 ч.
Взрывной геймплейный трейлер Painkiller порадовал фанатов демонстрацией нового и классического адского оружия 6 ч.
WhatsApp перенял ещё одну «фишку» Telegram — пользовательские наборы стикеров 6 ч.
Физики обнаружили аномальный эффект Холла в неожиданном месте 6 мин.
Из-за политики США европейские пользователи задумались об уходе из американских облаков 44 мин.
Intel расследует падение производительности видеокарт Arc при работе со старыми CPU 50 мин.
Китайская EHang пообещала запустить сервис летающих такси по разумной цене до конца года 2 ч.
$278 млрд налогов недоплатила «Кремниевая шестёрка» IT-гигантов благодаря лазейкам в законе 2 ч.
Tesla урезала производство пикапов Cybertruck, потому что их почти никто не покупает 3 ч.
Curiosity нашёл свидетельства того, что в древности на Марсе могла быть жизнь 3 ч.
В Индии представили ароматизированный смартфон Infinix Note 50s 5G+ 3 ч.
Трамповские тарифы могут стоить США лидерства в ИИ и возрождения производства чипов 3 ч.
ИИ-мегапроект Stargate может прийти в Великобританию и Евросоюз, но только в случае успеха в США 4 ч.