BeyG, парадокс в том, что не всегда нужны «такие модели». Можно поднатаскаться, и взять оборудование под модели попроще, но которых будет всё равно хватать. И с лихвой окупит все подписки.
BeyG, при более-менее серьёзной работе эти подписки за 20-100-200 баксов имеют тенденцию быстро заканчиваться. И вместо того, чтобы что-то делать, приходится гулять, пока временное окно восстановления лимитов сдвинется. Ну, ещё есть такой параноидальный бред, как конфиденциальность, данные должны обрабатываться локально и всё такое.
Сергей Викторович, парадоксально, но факт — для RAG не нужны фундаментальные модели с сотнями миллиардов параметров. «Насыщение» наступает в районе 7-9 млрд. параметров. Я тут ради интереса экспериментирую вообще с qwen3.5-4b. Для RAG важнее длина контекста и способность обобщать и делать выводы из прочитанного. Количество параметров тут больше нужно для того, чтобы модель без особых плясок с бубном могла воспользоваться предоставленным RAG-инструментарием.
Про embedding-модели вам уже расписали, они нужны. Они они крохотные — по 300 млн. параметров, в памяти занимают 90 мб. И даже на ноутбучном процессоре core i7-1235u (даже без задействования встроенной графики) вполне выжимают под тысячу токенов в секунду. Для, условно, разовой векторизации нормативной базы — оставить компьютер на полчасика раз в сутки (если нормативная база обновляется каждый день) — вполне адекватное решение.
Дмитрий Киреев, в Минске договорились один раз, потом второй раз. А потом в Стамбуле ещё один раз. С «договориться» проблем вообще никаких нет. С исполнением договорённостей почему-то проблемы возникают.
KUKL_KUKL, чтобы закрывать дивгепы прошлых лет, должен быть рост прибыли. А Х5, по факту, жирные дивиденды платит в счёт нераспределённой прибыли прошлых лет.
Мультитрендовый, вот именно, что внутреннее общение как раз-таки и не подразумевает общение там. Есть целая куча других служебных способов коммуникации. А в Максе — чтобы поставили цифровой ID, обязательно с биометрией. Потому что какому-то начальнику надо наверх по вторникам в 17.00 отчитываться вышестоящему начальству.
Мультитрендовый, почему сразу нужно удалять безвозвратно? Если на канале нарушения, почему нельзя блокировать к нему доступ всем, кроме админов — для устранения нарушений? потому что так будет удобно людям, а так нельзя.
Сергей Викторович, парадоксально, но факт — для RAG не нужны фундаментальные модели с сотнями миллиардов параметров. «Насыщение» наступает в районе 7-9 млрд. параметров. Я тут ради интереса экспериментирую вообще с qwen3.5-4b. Для RAG важнее длина контекста и способность обобщать и делать выводы из прочитанного. Количество параметров тут больше нужно для того, чтобы модель без особых плясок с бубном могла воспользоваться предоставленным RAG-инструментарием.
Про embedding-модели вам уже расписали, они нужны. Они они крохотные — по 300 млн. параметров, в памяти занимают 90 мб. И даже на ноутбучном процессоре core i7-1235u (даже без задействования встроенной графики) вполне выжимают под тысячу токенов в секунду. Для, условно, разовой векторизации нормативной базы — оставить компьютер на полчасика раз в сутки (если нормативная база обновляется каждый день) — вполне адекватное решение.
>> Хочешь пользуйся, хочешь нет
Ха-ха, два раза. Вы, наверное, просто не видели\не слышали какой маразм с навязыванием Макса идёт по госконторам.