Учёные из MIT провели исследование. Они изучили популярные рейтинговые платформы. Результаты оказались тревожными.
Рейтинги меняются от нескольких голосов. Иногда хватает двух или трёх. Это на фоне десятков тысяч оценок.
Компании выбирают модели по этим спискам. Это важно для отчётов или работы с клиентами. Ошибка выбора стоит дорого.
Исследователи создали быстрый метод проверки. Он находит голоса, которые влияют на результат. Их можно изучить отдельно.
Тамара Бродерик — автор работы. Она говорит о неожиданной хрупкости. Лучшая модель в рейтинге не значит лучшую в деле.
Работу представят на конференции. Учёные предлагают собирать больше данных. Это сделает платформы устойчивее.