Блог им. spydell-telegram

Направления наибольшего прогресса в LLMs

    • 10 августа 2026, 09:28
    • |
    • spydell
      Проверенный аккаунт
  • Еще
Направления наибольшего прогресса в LLMs

В середине 2026 оформились несколько направлений, где прогресс стал наиболее видимым.

▪️Высокоэффективные парсинг и навигация веб-сайтов в полностью автоматизированном формате с достаточно эффективными скриптами – это решает одну из центральных проблем сбора данных.

Для загрузки данных через API ИИ не нужен – все решалось существующими технологиями, но все, что вне контура API требовало утомительной ручной работы.

Да, можно было извращаться с написанием скриптов парсинга, но ни один из них не был ни надежным, ни стабильным (при изменении формата веб-ресурсов и данных).

Нужна была технология по динамическому считыванию структуры веб-ресурсов, котораярешается исключительно через LLMs и никак иначе в условиях неструктурированных массивов данных.

▪️ LLMs стали превосходным интегратором и агрегатором данных, особенно среди неструктурированных массивов информации. Всего год назад это было невозможно из-за галлюцинаций, ограниченного рабочего контекста и выполнения процедур внутри собственной «песочницы».

Теперь сбор, систематизация, консолидация, интеграция и синхронизация данных идут через внешние инструменты с проверкой контрольных сумм в рамках автоматизированной валидации.

Другими словами, работу с данными ведут внешние инструменты (ранее созданные или написанные с нуля самими LLMs), где LLMs выступают в роли «арбитра», дирижера, как бы оркестрируя инструментами (подбирая, вызывая и управляя нужными инструментами, утилитами, скриптами, навыками и т.д.) и обеспечивая финальную сверку и сборку проекта.

Еще весной все это не работало, теперь работает. Не идеально, но прогресс значительный.

▪️ Инструментальная работа. Любой проект – это тысячи или десятки тысяч составных элементов, каждый из которых может быть изолированным, иметь собственную структуру, характеристики и свойства.

Ценность LLMs не в попытке синтезировать, генерировать результат из собственного корпуса данных / знаний – здесь как раз полный провал и именно поэтому до 2026 ничего не работало.

Ценность ИИ в склейке результатов работы различных инструментов в единое целое, каждый из которых представляет собой созданные под локальные задачи скрипты, как правило, написанные на языке Python.

Не ИИ занимается расчетами, этим занимаются заранее написанные программные модули, чем и обеспечивается высокая точность и проверяемость.

Таким образом, задача валидации отдается на аутсорсинг внешним инструментам, где LLMs лишь сверяет контрольные суммы, формирует задачи, перенаправляет потоки данных и управляет атрибутами.

▪️ Агентные возможности – это прежде всего многоагентная оркестрация и маршрутизация ИИ-агентов + агентные оболочки типа Hermes или OpenClaw или инфраструктура AWS, Azure, Google Cloud и аналогичных.

Ранее формализовал определение ИИ-агента – автоматизированная интеллектуальная система, которая способна самостоятельно декомпозировать поставленную задачу на блоки, фрагменты, этапы и составляющие, находить нужный инструмент под каждую задачу, запускать цикл выполнения с обязательной валидацией, корректировать ход выполнения работы, иметь возможности отката на несколько итераций назад, действуя при этом строго в рамках очерченных инструкций, контуров и допусков, самостоятельно фиксируя момент завершения.

Соединяя все в единую логическую конструкцию, получается примерно так: ИИ разбивает / декомпозирует исходную задачу оператора на составные элементы, формирует вектор решения, консолидирует необходимый пул инструментов, запускает выполнение, маршрутизируя потоки данных, далее получает выходной результат от инструментов, интегрирует в единое целое, сверяет с поставленной задачей, при необходимости корректирует результат или вектор решения, а далее формирует итоговую сборку проекта.

Ранее описывал ограничения (по большей части направлений прогресс в LLMs близок к исчерпанию), но для коммерческого или научного внедрения не хватало как раз вышеописанных элементов.

Это те самые недостающие элементы, который ранее разрушали всю конструкцию проекта – оркестрация инструментами и субагентами, маршрутизация данных, качественный экстракт неструктурированных массивов информации (веб-сайты, сложные файлы, базы данных), внешняя валидация. Это не все направления прогресса, но наиболее чувствительные.

Не все работает идеально, но прогресс значительный в наиболее критических областях, причем за последние 1-2 месяца.


Источник: https://telegram.me/spydell_finance/9994

Данная публикация является личным мнением автора. Мнение владельца сайта может не совпадать с мнением автора.
2.5К | ★2
1 комментарий
Паш, когда SP500 упадет, ты давно не писал про это.
avatar

Читайте на SMART-LAB:
Кризис – время для кибербеза. "Позитив" растет на 45% / Юрий Маринчев в Клубе Двинского
На днях пообщались с директором по связям с инвесторами Positive Technologies Юрием Маринчевым. Обсудили результаты первого полугодия,...
Фото
Промомед - самая быстрорастущая компания на рынке по цене IPO
Промомед — фармацевтическая компания с одним из самых высоких темпов роста выручки в 2025 году, и, возможно, в этом году тоже.  Компания...
Фото
Группа «Аэрофлот» опубликовала операционные результаты за июль и 7 месяцев 2026 года.
✈️ В июле перевезено 5,7 млн пассажиров – на уровне прошлого года, на показатель продолжили влиять действовавшие временные ограничения. ✈️ На...
Фото
Позитив: сильный 2й квартал. Где "безопасная" цена акции?
2 квартал выглядит сильно 8,3 млрд руб — рекордные квартальные отгрузки для всех кварталов кроме 4-го Выручка +39%г/г за 2 квартал и +41% за...

теги блога spydell

....все тэги



UPDONW
Новый дизайн