Японские инженеры из NTT DATA нашли выход. Они использовали синтетические данные NVIDIA. Точность модели подскочила с 15% до 79%.
Им хватило всего 240 исходных образцов. На их основе создали 138 тысяч обучающих примеров. Это в 300 раз больше исходного материала.
Проблема в нехватке японских данных. Английских материалов много. Японских — хронически мало.
Метод работает без раскрытия конфиденциальной информации. Компании могут строить ИИ на открытой инфраструктуре. Это ускоряет разработку в разы.