Блог им. Kommersant_ru

«Яндекс» и МТС разошлись в способах оценки ИИ

Активно развивающийся рынок искусственного интеллекта начинает сталкиваться с проблемами, характерными для развитых отраслей, например, выбора адекватной методики оценки эффективности. Российские разработчики больших языковых моделей (используются, в частности, для создания голосовых ассистентов) выбрали разные инструменты для публичного сравнения с другими разработками. Так, экспериментальная версия YandexGPT оценивается путем парного сравнения на «чатбот-арене», а модели MTS AI — путем решения заранее определенных задач. Участники рынка указывают на возможность использования разных бенчмарков эффективности для разных вопросов.

Подробнее — в материале «Ъ».
Данная публикация является личным мнением автора. Мнение владельца сайта может не совпадать с мнением автора.
200

Читайте на SMART-LAB:
Фото
S&P 500: быки чуют новые рекорды, а медведи — крупные проблемы?
Американский фондовый индекс S&P 500 провел образцовый возврат к ранее пробитой верхней границе бычьего флага. Протестировав этот рубеж сверху...
Фото
Средние доходности облигаций в зависимости от кредитного рейтинга. От B- до AA+
Средние доходности облигаций в зависимости от кредитного рейтинга (бледные столбцы — доходности без сглаживания). И как они изменились за...
Фото
ДВМП: ожидаемо плохой отчет, но впереди рост прибыли и возможное СП c DP World

теги блога Коммерсантъ

....все тэги



UPDONW
Новый дизайн