#робототехника

Публикаций: 9

DWM разделил то, что делает агент, и то, что делает физика

Новый фреймворк DWM (Decomposed World Model) впервые явно разделяет внутри латентного пространства то, что изменилось из-за действий агента, и то, что поменялось бы само — под влиянием гравитации, инерции, контактной динамики. На задачах с постоянными физическими эффектами метод даёт +13.1% к успешности планирования и не требует изменений в архитектуре базовой модели.

Xiaomi-Robotics-1 показала: данные решают больше, чем размер модели

Xiaomi обучила модель управления движением на более 100 000 часов реальных физических данных — и выяснила, что наращивание объёма данных даёт куда больший прирост производительности, чем увеличение числа параметров. Кривая обучения при этом не выходит на плато.

Orca от BAAI научилась управлять роботами без лейблов — и сравнялась с π0.5

BAAI опубликовала Orca — мировую модель, обученную на 125 000 часах видео без единой размеченной акции робота. На пяти задачах управления она сравнялась с π0.5 от Physical Intelligence — и поставила под вопрос саму необходимость дорогостоящей разметки в обучении роботов.

Роботы Nvidia учат себя сами — через агентов-программистов

Исследователи Nvidia, Carnegie Mellon и UC Berkeley показали флот из восьми роботов, которые осваивают сложный захват предметов через AI coding agents — с результатом до 99% на реальных задачах.

Nvidia идёт в физический ИИ: роботы, автопилот и новая модель мира

На GTC Taipei Nvidia представила сразу три системы для физического ИИ: обновлённую модель мира Cosmos 3, масштабированный автопилотный движок Alpamayo 2 Super и открытую платформу для гуманоидных роботов.

OpenAI возвращается в робототехнику — и целится в личного робота для каждого

OpenAI воссоздаёт робототехническое подразделение спустя пять лет после его закрытия. Ближайшая цель — роботы для инфраструктуры, долгосрочная — личный робот, который делает всё что нужно.

NVIDIA Cosmos 3: один omni-модель вместо четырёх для физического ИИ

NVIDIA выпустила Cosmos 3 — первую открытую omni-модель для физического ИИ, которая объединяет генерацию мира, физическое рассуждение и генерацию действий в одной архитектуре. Модель уже доступна на HuggingFace в двух размерах.

Компактная Gemma-3 в роботе: 270М параметров управляют гусеницей и клешнёй

Разработчик с Хабра зафайнтюнил Gemma-3 270M от Google под управление гусеничным роботом с манипулятором в симуляторе MuJoCo — модель переводит текстовые команды в JSON-инструкции для актуаторов. Весь стек умещается на Raspberry Pi Zero 2 W и обучается бесплатно на Kaggle.

Amap показал Tutu: четвероногий робот-поводырь для незрячих без оператора

Картографический сервис Alibaba дебютировал в физической робототехнике с конкретной задачей — вести незрячих людей через живую толпу без оператора и без заранее прописанного маршрута. Первый публичный тест прошёл на пекинском полумарафоне гуманоидных роботов в 2026 году.

← Все статьи