Блог им. spydell-telegram

Способны ли современные LLMs принести пользу в реальных рабочих проектах?...

Способны ли современные LLMs принести пользу в реальных рабочих проектах?

Однозначно – да, но все зависит от типа и формата проекта. Не буду углубляться в теорию и технические термины, а сразу расскажу, помогают ли LLMs в собственных проектах?

Эффект крайне неравномерен, сильно фрагментирован и нестабилен.

Оценка эффективности предельно прозрачна – совокупные ресурсы и время, затраченные на финализацию определенной задачи с использованием LLMs или без LLMs.

Например, какой бюджет токенов нужно консолидировать и сколько времени затратить на формализацию задачи, ожидание выполнения и фактчекинг с использованием LLMs и сколько ресурсов и времени уходит без LLMs.

В какой точке конструкция рассыпается? Главное и фундаментальное препятствие – затраты на верификацию результата.

Опыт использования комбинации самых мощных на сегодняшний день LLMs показывает, что они способны выдавать визуально блистательные (оформленные как солидные академические и консалтинговые исследования) с очень правдоподобным (на первый взгляд) наполнением результаты.

Первый и беглый взгляд показывает – превосходная работа, но … при верификации все начинает рассыпаться, а именно:

🔘Неверная развесовка факторов, параметров и искаженная иерархия приоритетов, что почти всегда ломает всю архитектуру проекта.

🔘Неравномерная контекстная развертка, когда одни направления могут быть избыточно подробно описаны, а другие, наоборот, необоснованно поверхностно.

🔘Концептуальные пробелы – неполное раскрытие вопросов и факторов, неучет множества обстоятельств.

🔘Неверная декомпозиция задачи на составляющие элементы и неверное задание векторов исследования.

🔘Очень частые ошибки в фактуре, как случайные, так и «намеренные», когда модели галлюцинируют, выдумывая «факты».

🔘Неверная консолидация источников информации. Часто решается принудительным ограничением контекстного пространства / источников информации.

🔘Очень часто сломанный стиль повествования, что требует глубокого рерайта.

Что получается на практике? LLMs генерируют огромное количество лонгридов, но на проверку, верификацию, переосмысление и рерайт которых уходит неприемлемое количество времени, сильно превышающее время на самостоятельное исследование.

Как это происходит на практике?

1. Формализация запроса с подробной проработкой техзадания для учета всех факторов, обстоятельств, требуемых векторов исследования и стиля повествования – 10% времени

2. Наполнение моделей контекстом – внутренний готовый набор данных, спектр внешних источников –5% времени.

3. Ожидание генерации ответа (часто может идти десятки минут) сразу в нескольких моделях – 4% времени.

4. Правки по ходу выполнения – 3% времени.

5. Сведение результатов 3-5 LLMs в единую матрицу для концептуального наслоения – 13% времени.

6. Очень длительный процесс верификации полученного ответа – примерно 65% всего времени, а часто еще больше.

Таким образом, постановка задачи примерно 15% времени, генерация ответа – 7%, сверка результатов – 13%, а проверка и контроль – 65%.

Слабое звено – проверка и верификация, которые поглощают основные ресурсы.


На моем опыте, комбинация самых мощных LLMs приводит не к росту производительности, а к радикальному снижению. Насколько? Примерно в 5 раз.

Ту работу, которую можно делать самостоятельно за час, на нее с использованием ИИ займет примерно в 5 раз больше времени и это в наиболее оптимизированном сценарии использования.

В моем классе задач, при моем опыте, накопленных знаниях и навыках, LLMs ухудшают работу, а не улучшают, и речь идет о существенно, иногда кратном ухудшении.

Это не значит, что LLMs – плохи или бесперспективны для определенного спектра задач. Ни в коем случае. В будущем я приведу спектр и категории задач, где LLMs наиболее эффективны.

Я лишь описываю собственный опыт, но при всем этом я остаюсь технооптимистом, т.е. верю в то, что технологии будут улучшаться, захватывая все больше ранее нерешенных задач.

Причем значительный класс задач так и остается принципиально неразрешимым с использованием ИИ (об этом в других материалах).


Источник: https://t.me/spydell_finance/9835

Данная публикация является личным мнением автора. Мнение владельца сайта может не совпадать с мнением автора.
3.1К | ★1
6 комментариев

ну если озаботиться проблемой верификации заранее, то потом можно уже не тратить столько времени… если потратить пару недель на обучение модели, то потом результат может быть намного более адекватен...

 

не забудьте, что это всего лишь очень продвинутая поисковая система, в которой при отсутствии в памяти точного ответа на заданный вопрос, выдается приблизительный... 

 

как пример, однажды мне на чистых щщах утверждали, что на видеокарту в 96 Гб влезет модели с 98 Гб параметров... 

на мой вопрос: «Корова, ты чего?», она встрепенулась и сказала: «И впрямь, чего это я?» )))

avatar
Статья написана ИИ. 
avatar
мне кажется что надо как лего собирать из верифицированных и проверенных кубиков... 
avatar
Ford вернул уволенных инженеров для исправления ошибок, которые наделал ИИ 25.06.2026 [17:51],  Анжелла Марина 

Компания Ford была вынуждена вернуть в штат бывших инженеров для устранения недочётов, допущенных автоматизированными системами проектирования и производства. Руководство признало, что излишняя ставка на искусственный интеллект без учёта накопленного человеческого опыта привела к снижению надёжности выпускаемых авто и рекордному росту числа отзывных кампаний.

Источник изображения: Dan Smedley/Unsplash

Чтобы восстановить утраченную корпоративную экспертизу, бренд нанял, повысил в должности и вернул более 350 опытных специалистов. Как пояснил вице-президент по разработке аппаратного обеспечения Чарльз Пун (Charles Poon), многие ветераны уволились до того, как их знания были полностью перенесены в цифровые базы, что потребовало их личного присутствия для настройки нейросетей и наставничества над молодыми сотрудниками. По его словам, эффективность алгоритмов напрямую зависит от качества обучающих данных, а первоначальный расчёт исключительно на автоматизацию оказался ошибочным.

Столкнувшись с трудностями при запуске моделей Explorer и Aviator, а также со сбоями в цепочках поставок, автопроизводитель пересмотрел свой производственный подход. Операционный директор Кумар Галхотра (Kumar Galhotra) отметил, что разрозненность отделов и укоренившийся подход, заключающийся в поиске и устранении уже возникших дефектов, показали свою несостоятельность. В настоящее время Ford переходит к стратегии, направленной на устранение проблем до их появления.

 Мой личный опыт разработки показывает что LLM серьезно ускоряет написание кода и документации но при этом в проект попадают трудно вычисляемые ошибки. На устранение которых тратится времени больше чем было сэкономлено
Работаю. в проектировании. Сейчас за ИИ в конструировании бьют палками сразу. Потому что ИИ-шная обезьяна выдает результаты из статей в интернете, написанных человеческими обезьянами(менагерамии, продаванами и прочими олигофренами). 
avatar

Читайте на SMART-LAB:
Фото
Вероятна пауза в снижении ключевой ставки и ужесточение макропрогноза
Мы полагаем, что Банк России на ближайшем опорном заседании впервые с июня прошлого года может сделать паузу в снижении ключевой ставки...
Фото
GBP/USD: фунт набирает силу на фоне временной слабости доллара
Фунт продолжил восходящее движение, обновив локальные максимумы. Главной движущей силой этого роста было ослабление доллара после публикации...
Если все риски уже в ценах, лучший момент для инвестиций – сейчас?
Российский рынок ставит очередные антирекорды, а инвесторы все чаще говорят о капитуляции. Если все риски уже заложены в цены, то лучший момент...
Фото
Банк Санкт-Петербург: ухудшение прогноза на текущий год, пришло ли время покупать акции?
Банк «Санкт-Петербург» представил финансовые результаты за июнь и 1П 2026 года по РСБУ. • Чистый процентный доход: 34,6 млрд руб....

теги блога spydell

....все тэги



UPDONW
Новый дизайн