Physical Intelligence представила π0.7 — новая универсальная модель для роботов, которая умеет не только выполнять знакомые задачи, но и собирать новые действия из уже выученных навыков. В компании говорят, что это один из первых случаев, когда робот может по языковой инструкции делать то, чего вообще не было в обучении.
Главный акцент — на обобщении. Модель может работать с новыми кухонными приборами, выполнять команды шаг за шагом и переносить навыки между разными роботами. Например, π0.7 смогла складывать белье на новой роботической платформе, хотя данных по этой задаче на ней не было.
При этом модель не проседает и на “обычных” задачах. По словам Physical Intelligence, π0.7 показывает уровень специализированных моделей в dexterous-сценариях вроде приготовления эспрессо, сборки коробок и работы с одеждой — но уже без отдельного fine-tuning под каждую задачу.
Отдельно в компании выделяют управляемость модели. В обучение добавили не только текстовые команды, но и метаданные о скорости и качестве выполнения, типе управления и визуальные subgoal-изображения. За счет этого робот получает не просто команду что делать, а еще и как именно это делать.