Gemini Robotics
Gemini Robotics — це сімейство моделей від Google DeepMind для керування фізичними роботами. Основна версія (Gemini Robotics 2) — це vision-language-action (VLA) модель, яка перетворює візуальний та текстовий ввід у команди моторного керування. На відміну від традиційних роботів, навчених на одну специфічну задачу, Gemini Robotics 2 розуміє різноманітні команди та адаптується до нових ситуацій без перенавчання. Модель контролює весь корпус гуманоїда — від ніг до кінчиків пальців, забезпечуючи складні рухи з високою точністю (тонка дексеритність для операцій типу закручування лампочки або в'язання вузлів). Додатково розроблені версії: Gemini Robotics ER 2 для міркування в фізичному просторі та планування з координацією множинних роботів, та облегшена on-device версія для локального запуску на обладнанні робота.