Суббота, 1 августа 2026 г.сб · 1 авг
ИИ-чат для сайта
Подключите ИИ-ассистента на сайт за одну строку кода — отвечает на вопросы клиентов 24/7 — Neuralismo.ru →
Главная/Исследования/Gemini Robotics 2: ИИ научился управлять…
Исследования

Gemini Robotics 2: ИИ научился управлять телом робота целиком

Google DeepMind представила Gemini Robotics 2 — новое поколение AI-моделей, которые позволяют роботам координировать движения всего тела. Система объединяет зрение, тактильные ощущения и моторику для выполнения сложных задач без предварительного программирования.

Google DeepMind продолжает стирать границу между цифровым и физическим мирами. На этот раз исследователи представили Gemini Robotics 2 — новую модель искусственного интеллекта, которая наделяет роботов «целостным интеллектом тела». В отличие от предыдущих версий, где управление конечностями и сенсорами было разделено, новая система учится координировать все части тела одновременно, имитируя естественные движения человека.

Что произошло

Gemini Robotics 2 — это мультимодальная AI-модель, которая обрабатывает визуальные данные, тактильные сигналы и команды на естественном языке в едином потоке. В демонстрационных роликах роботы выполняют задачи, которые раньше считались прерогативой человека: складывают бельё, собирают мелкие детали, открывают двери с нестандартными ручками и даже переливают жидкости, адаптируясь к форме сосуда. Ключевое отличие — модель не требует детального программирования каждого движения. Она использует «внутреннее представление» всего тела, чтобы предсказывать последствия своих действий.

Почему это важно

До сих пор одной из главных проблем робототехники была узкая специализация: робот, обученный брать стакан, не мог открыть дверь. Gemini Robotics 2 решает эту проблему за счёт трансферного обучения и симуляции. Модель тренируется в виртуальной среде, где учится управлять сотнями различных тел, а затем переносит этот навык на физических роботов. Это означает, что один и тот же алгоритм может работать на гуманоидах, манипуляторах и даже на колёсных платформах. По сути, DeepMind создаёт универсальную операционную систему для роботов.

«Мы хотим, чтобы робот понимал не только то, что он видит, но и то, как его собственное тело может взаимодействовать с миром. Gemini Robotics 2 делает этот шаг — от восприятия к действию, от наблюдения к манипуляции», — отмечают в пресс-релизе DeepMind.

Как это работает

В основе Gemini Robotics 2 лежит архитектура «визуально-моторного трансформера». Модель получает видеопоток с камер робота и данные с тактильных датчиков (давление, скольжение, вибрация), после чего генерирует последовательность моторных команд для всех суставов одновременно. Важно, что система способна работать в реальном времени, подстраиваясь под изменения среды: если предмет соскользнул, робот мгновенно меняет хватку. Исследователи также внедрили механизм «безопасного исследования», который не позволяет роботу применять избыточную силу или входить в опасные зоны.

Что дальше

Пока Gemini Robotics 2 находится на стадии прототипа, но DeepMind уже объявила о партнёрстве с несколькими робототехническими компаниями для полевых испытаний. Ожидается, что первыми коммерческими применениями станут складская логистика и сборка электроники. В долгосрочной перспективе технология может лечь в основу домашних роботов-помощников, способных готовить еду, убирать и ухаживать за пожилыми людьми. Однако эксперты предупреждают: чем более автономными становятся роботы, тем острее встают вопросы безопасности и этики. DeepMind заявляет, что все модели проходят многоуровневую проверку на предвзятость и безопасность перед развёртыванием.

Читайте нас в Телеграм
2–3 поста в день, без шума
Телеграм
То же самое — но в кармане, без браузера.
Главные ИИ-новости, разборы и one-liners. 2–3 поста в день, без шума.
@theNeuralBase →
@theNeuralBase · сейчас
🟠 OpenAI выкатила o5-mini — в 3 раза дешевле o4.
⚪ Mistral закрыл раунд на $1.6 млрд. Оценка $14 млрд.
12 814 подписчиков