NVIDIA представила открытый фреймворк Nemotron-Terminal. Это системный пайплайн для генерации данных. Он учит модели работать в командной строке.
Компания опубликовала метод Terminal-Task-Gen. Также она выложила датасет Terminal-Corpus. Это чертежи для создания агентов.
До сих пор рецепты данных хранились в секрете. Исследователи тратили время на пробы и ошибки. Теперь у них есть инструкция.
Проблема была в двух вещах. Не хватало разнообразных задач. Сложно было записывать шаги взаимодействия.
Решение состоит из двух слоёв. Первый — адаптация существующих датасетов. Используют 163 тысячи математических и 35 тысяч кодовых задач.
Второй слой — синтетическая генерация. Модель создаёт новые исполняемые задачи. Она комбинирует примитивные навыки.
Инженеры NVIDIA победили инфраструктурные накладные расходы. Они перешли на предсобранные Docker-образы. Раньше для каждой задачи создавали новый.
Теперь используют девять базовых образов. В них уже установлены нужные библиотеки. Это ускоряет процесс в разы.
Результаты впечатляют. Модель Nemotron-Terminal на 32 миллиарда параметров обошла конкурента. У конкурента было 480 миллиардов параметров.
Тест проходил на бенчмарке Terminal-Bench 2.0. Агент выполнял сквозные рабочие процессы. Например, обучал модели машинного обучения.