Блог им. Kommersant_ru

«Яндекс» и МТС разошлись в способах оценки ИИ

Активно развивающийся рынок искусственного интеллекта начинает сталкиваться с проблемами, характерными для развитых отраслей, например, выбора адекватной методики оценки эффективности. Российские разработчики больших языковых моделей (используются, в частности, для создания голосовых ассистентов) выбрали разные инструменты для публичного сравнения с другими разработками. Так, экспериментальная версия YandexGPT оценивается путем парного сравнения на «чатбот-арене», а модели MTS AI — путем решения заранее определенных задач. Участники рынка указывают на возможность использования разных бенчмарков эффективности для разных вопросов.

Подробнее — в материале «Ъ».
Данная публикация является личным мнением автора. Мнение владельца сайта может не совпадать с мнением автора.
188

Читайте на SMART-LAB:
Фото
EUR/USD: пара на низком старте перед очередным прыжком
Евро отступил от недавнего локального максимума, начав коррекцию, однако после формирования поддержки частично восстановился. В течение периода...
Фото
«Селигдар» и КРДВ договорились о сотрудничестве по реализации проекта «Кючус» в Якутии
Полиметаллический холдинг «Селигдар» (далее — Холдинг, «Селигдар») (MOEX: SELG) и Корпорация развития Дальнего Востока и Арктики (далее — КРДВ)...
Фото
Две торговые идеи на неделю: Магнит и Озон
Роман Бахтырев Предлагаем активным трейдерам две идеи на российском рынке акций, сформированные с помощью инструментов технического анализа....
Фото
ВУШ: погашение облигаций на 4 млрд пройдено, впереди 10 млрд в 3Q27-1П28. Оправдан ли риск в бондах компании?
Здравствуйте! В данной заметке подробно рассмотрим актуальные тенденции в бизнесе компании ВУШ, проанализируем сценарии, в которых сервис войдет в...

теги блога Коммерсантъ

....все тэги



UPDONW
Новый дизайн