Блог им. spydell-telegram

Где ожидается прогресс в ближайшие два года в ИИ?

Где ожидается прогресс в ближайшие два года в ИИ?

После очень короткого ретроспективного анализа эволюции LLMs за последние три года, решил контурно сформировать проекцию, куда может завести эта дорога, опираясь на мои материалы по архитектурным ограничениям?

На самом деле, технологический прогресс LLMs уже близок к исчерпанию.

▪️Архитектурно не было и в рамках нынешней архитектуры не предполагается прогресса в критерии истинности, в самообучении моделей, в полной детерминированности и стабильности выходного результата, во встроенной долговременной памяти, в автономном формировании целей и в полном снижении галлюцинаций.

▪️В середине 2026 прогресс остановлен или будет незначительным:

🔘Обучающий корпус данных практически исчерпан, т.е. модели не станут сильно умнее и качественно лучше с точки зрения воспроизведения фактов, событий и «когнитивной глубины». Хуже стать могут из-за заражения обучающих данных синтетическим контентом, нолучше – уже нет.

🔘Дальнейшее расширение контекстного окна свыше 1 млн архитектурно ограничено из-за экспоненциально растущей сложности воспроизведения –может быть незначительный прогресс с точки зрения стабильности глубины контекстного окна – безошибочное воспроизведение контекста на ширине 300–400 тыс. токенов.

🔘Базовая мультимодальность, т.е. «понимание» текста, аудио, изображений, видео, сложной графической информации близка к пределу, прогресс может быть в понимании сложных инженерных чертежей или перегруженных научных графиков и таблиц, либо в сложных сценах низкокачественного видео. Уже близко к пределу.

🔘WEB-поиск был значительно прокачен в 2024–2025, ничего принципиального нового не ожидается, но прогресс будет сфокусирован на WEB-парсинге многоуровневых сайтов и динамических потоков данных.

🔘Следование инструкциям – одна из главных проблем в 2023 и начале 2024, постепенно была устранена в 2025 и почти сошла на нет в середине 2026. Это важнейший функционал для реализации навыков и скиллов, без следования инструкций агентная работа невозможна. Прогресс будет, но незначительным.

🔘Снижение галлюцинаций – основной рывок в 2025, в этом году шлифовка, но полное устранение галлюцинаций невозможно, сейчас решается через смычку внешних верификаторов, внешних источников данных, расчетных модулей и WEB-синхронизацию. Сильного прогресса не ожидаю из-за архитектурных особенностей (галлюцинации неустранимы).

🔘Рассуждающие возможности – главное нововведение осени 2024 за 1.5 года было значительно улучшено, являясь еще одной важнейшей функцией для агентов с целью корректной декомпозиции задачи и поиска необходимых инструментов. В этом направлении прогресс будет идти, но не такими быстрыми темпами, как последние 1.5 года.

Таким образом, если вы работаете с генерацией, коррекцией и редактурой текста, резюмируете, конспектируете и сравниваете текстовые материалы, работаете с переводами, распознаванием документов, изображений и речи, используете ИИ, как справочное бюро, как замену поиска и эксперта/консультанта по базовым вопросам с решением простейших задач – ничего нового уже не будет, прогресс здесь остановился.

▪️Прогресс будет в агентных возможностях.

🔘Многоагентная оркестрация и маршрутизация ИИ-агентов, когда в рамках выполнения процесса или проекта происходит расслоение, разделение на несколько взаимосвязанных агентов, имеющих способность выполнять работу параллельно, но в рамках структурного и концептуального единообразия (например, агент-планировщик, агент-исследователь, агент-программист, агент-верификатор, агент-редактор и агент-интегратор).

🔘Агентные оболочки – специализированные плагины для перехвата и буста итераций в рамках определенного вектора решения. Это некие автоматизированные скрипты (ранее откалиброванные человеком в реальных проектах), которые активируются при определенных триггерах, помогающие выполнять сложные функции безошибочно.

🔘Внешние валидаторы, как первичное условие для функционирования агента – без него никакая автономность невозможна из-за наследования ошибок и выбора неверного вектора решений.

🔘Развитие MCP и инструментов для бесшовного потока данных в структурированном формате или по сценариям.

🔘Плюс корпоративная безопасность, права, аудит, управление состоянием и восстановление после сбоев или неверных итераций.


Источник: https://telegram.me/spydell_finance/9907

Данная публикация является личным мнением автора. Мнение владельца сайта может не совпадать с мнением автора.
701 | ★1
8 комментариев
Впервые не плюсую пост spydell  — в корне не согласен с половиной пунктов, особенно с тем, что еще в прошлом году решена проблема следования инструкциям.
Сужу по бесплатникам, правда, но платные отличаются в основном лимитами, а не «интеллектом» — так вот из порядка двух десятков ИИ не видел ни одного, который бы идеально следовал инструкциям и не нарушал своих же обещаний (иной раз в следующем же ответе).
avatar
VladMih, Вы в корне неправы. Платные именно «интеллектом» и отличаются. И там нет абсолютно никаких проблем со следованиям инструкциям.
avatar

JBJ, АБСОЛЮТНО??? Вы просто серьезных проектов не делали...
Дайте пруф на то, что фри-план даёт отуплённую версию.
Я такой информации нигде и никогда не встречал.

Если я использую сейчас Соннет 5.0, то у него мозги Соннета 5.0
Задайте этот же вопрос вашему платному «разумнику».
Кстати, как его зовут? ;0)

avatar
VladMih, 5.6 Sol Ultra
avatar

JBJ, это ж для каких задач такую крутизну хреначите?
В принципе, тоже к этому подбираюсь, но мой выбор Opus 4.8,
займусь им когда освобожусь для торговых роботов.

А что ж с вопросом?
Постеснялись задать или постеснялись дать честный ответ?

avatar
VladMih, Софт всякий пишу. Кодовая база одного из них примерно 300 тысяч строк сейчас.
Ни сейчас, ни до этого не встречал проблем со следованием инструкциям даже у более простых моделей типа гугла на платных тарифах.
avatar
JBJ, ладно, можно я ТРЕТИЙ раз попрошу задать мой вопрос своему крутому ИИ? Дублировать не буду, сами выше найдете, ибо нет у меня уверенности, что у вас есть на то желание.
Что за привычка настолько явно игнорить КОНКРЕТНЫЕ вопросы?
Уже или отвечайте, или… совсем не отвечайте такими блабла.

«Вы не встречали» — это блабла, если не поняли.
А ответ ИИ — это чистое знание! В которое вы свято верите…
avatar
На самом деле ии
Это идеальное средство коммуникации… он видит твои интересы и то над чем ты работаешь… и это может быть сайт знакомств поиска работы и ведения проектов… т.е он организовывает и коммуницирует и модерирует
avatar

Читайте на SMART-LAB:
Фото
Пять акций, которые выросли на 100% за месяц
Падение Индекса МосБиржи на 16% за первую половину июля и последующий такой же отскок создали условия для экстремального движения наиболее...
Фото
С начала программы buyback Группа выкупила с рынка примерно 9,7 млн акций RENI
Группа Ренессанс страхование опубликовала свежие данные о выкупе акций с рынка. C начала программы buyback в июне 2026 года Группа выкупила с...
Фото
📊 Выручка Группы МГКЛ за 7 месяцев 2026 года — 29,8 млрд рублей, рост в 2,5 раза
Подводим предварительные операционные итоги за январь–июль 2026 года. Ключевые показатели: 💰 Выручка — 29,8 млрд рублей, рост в 2,5...
Фото
Лента МСФО 2 кв. 2026 г. - Окей, а где прибыль?
Лента опубликовала финансовые результаты за 2 квартал 2026 года.  Выручка компании выросла на 28,8% во 2 квартале до 341,6 млрд руб. В 1...

теги блога spydell

....все тэги



UPDONW
Новый дизайн