Блог им. sgluhov

Datamining алгоритм - что выбрать?

Вопрос к тем, кто использует Датамайнинг алгоритмы, какой вы выбрали, и почему.

От себя отмечу, что выбрал алгоритм Random Forest (деревья делает С 4.5), так как данный алгоритм с моей точки зрения:
1) достаточно хорошо устойчив к шуму данных (видел несколько исследований которые показывают что деревья самый устойчивый алгоритм при повышении шума в данных).
2) Может отделить слабо значимые данные (можно удалить слабозначимые взодящие данные и заменить их более эффективными)
3) Показывает область «неуверенности» — класические деревья показывают только вероятность по одной из моделей.

Если есть те кто кто пользуется подобными алгоритмами — напишите подалуйста свои мысли.
Данная публикация является личным мнением автора. Мнение владельца сайта может не совпадать с мнением автора.
59 | ★3

Читайте на SMART-LAB:
Фото
Программа «АПРИномика с Игорем Файнманом» на площадке Finversia
Программа «АПРИномика с Игорем Файнманом» на площадке Finversia 💼 В воскресенье, 26 июля, на площадках проекта Finversia состоялся...
Фото
Акционеры ПАО «Группа «Русагро» утвердили выплату дивидендов
Группа «Русагро сообщает, что по итогам голосования на внеочередном общем собрании акционеров была утверждена выплата в виде дивидендов...
Фото
Ситуация на рынке новых авто стабилизировалась
Несмотря на сложности с топливом, продажи новых легковых автомобилей в России стабилизировались, отмечают в «Автостате». Если бы не дефицит...
Фото
Модельный портфель рублевых облигаций: итоги, состав, планы
В условиях повышенной волатильности долгового публичного российского рынка в этом году, модельный портфель рублевых облигаций в целом показывает...

теги блога sgluhov

....все тэги



UPDONW
Новый дизайн