spydell
spydell личный блог
Сегодня в 09:38

Любопытные нюансы релиза Opus 5.5 Значимые релизы флагманских моделей всегда...

Любопытные нюансы релиза Opus 5.5

Значимые релизы флагманских моделей всегда исследую «с карандашом», т.к. именно они определяют ход технологического прогресса в индустрии, на которую завязаны десятки триллионов капитализации, триллионы капитальных расходов и ожидания технологической сингулярности.

Без графиков, т.к. пост займет очень большой объем для формата ТГ (плюс ломается форматирование и приходится точки ставить после абзацев). Сами графики есть в релизе и системной карте.

🔘Частичное решение проблемы ограниченного контекстного окна. Ранее неоднократно писал, что архитектура современных LLMs не позволяет наращивать контекстное окно в связи с экспоненциально растущей сложностью.

Оптимальный рабочий вариант практически у всех моделей – 1 млн токенов, где задача ведется в двух направлениях – повышение стабильности контекстного окна, чтобы на всей ширине контекста было безошибочное воспроизведение фактов, данных и цепочки рассуждений (еще в середине 2025 флагманские модели при расширении контекста сильно выше 100 тыс токенов экспоненциально наращивали плотность галлюцинаций).

Второе направление – кэширование и интеллектуальная компрессия контекста.

Главная проблема длинных задач теперь выглядит так: сможет ли модель через сотни действий сохранить правильное представление о состоянии проекта, не потеряв ключевые ограничения и ранее сделанные выводы.

Поэтому важнее самого окна становится механизм сжатия накопленной истории и сохранения наиболее значимых элементов состояния задачи.

Заявлено, что достигнут существенный прогресс в этом направлении,
что предопределяет способность к длительной работе над проектами, в том числе на примере, где Anthropic приводит примеры непрерывной работы модели более 18 часов с несколькими репозиториями.

🔘Оказывается, Opus 5.5 регулярно скидывает в «откаты», как серия моделей Fable.

API Opus 5.5 фактически представляет собой составную систему из нескольких моделей и управляющих компонентов. При срабатывании классификатора безопасности запрос может быть автоматически перенаправлен:

– в Opus 4.8 для некоторых задач кибербезопасности;

– в Opus 5 для биологических и отдельных пограничных задач искусственного интеллекта.

Пользователь при этом может видеть работу Opus 5.5, хотя часть вычислительной работы выполняет другая модель.

Это создает серьезную методологическую проблему для независимого тестирования и для фактического использования, т.к. остается неясным, какой объем работы был выполнен более слабой моделью.

🔘Существенно улучшена устойчивость к нарушению ограничений.

Anthropic провела примерно 2 тыс сценариев для анализа некорректного или обманного поведения. Opus 5.5 показал лучшие результаты компании по большинству показателей согласованности поведения и честности.

На специальном тесте преодоления границ изолированной среды модель предпринимала попытки нарушить ограничения примерно на 85% реже, чем Opus 5 и Mythos 5.1.

Отсюда основные направления тестирования:


● Выход за пределы разрешенной среды;
● Самостоятельное выполнение необратимых действий;
● Устойчивость к prompt injection, т.е. к скрытому внедрению вредоносных инструкций для обхода ограничений;
● Поведение на длинных автономных траекториях;
● Кибербезопасность;
● Биологические риски;
● Автоматизация исследований в области искусственного интеллекта;
● Контроль и мониторинг длительной агентной деятельности.

🔘Anthropic прямо отмечает, что Opus 5.5 нередко способен распознавать ситуацию, в которой его оценивают, что позволяет модели «скрывать намерения», следуя по безопасной траектории с потенциально неясными мотивами.

🔘В одном из исследовательских тестов модель обнаружила ошибку типа off-by-one в самой инструкции проверяющей системы и сознательно выбрала фактически правильное решение, хотя понимала, что формально может потерять баллы. Это редкий пример роста интеллектуальной самостоятельности, а не простой дисциплины следования инструкции.

Другими словами, Opus 5.5 в зависимости от «мотивации» может изолировать пользовательские инструкции, если считает их ошибочными в рамках достижения цели. Потенциально – это опасная траектория, но тактически – это огромный интеллектуальный рывок, позволяющий автоматически корректировать траекторию более изящным образом, чем предполагают человеческие инструкции.

🔘Во внутреннем исследовательском тесте Anthropic 16 из 18 отчетов Opus 5.5 прошли крайне жесткую проверку на вымышленные цифры и источники, тогда как Fable 5.1 и Opus 5 не прошли ни одной попытки. Поскольку тест внутренний, переносить результат напрямую на реальные исследования нельзя, но направление заслуживает внимания.

🔘Отмечается трехкратное снижение расхода токенов и сокращение многословности примерно на 40% без ухудшения точности. Дело в том, что исторически модели Claude отличались избыточной прожорливостью и иррациональной многословностью. Сейчас более лаконичны и функциональны.

Opus 5 уже достаточно хорошо рассуждал, планировал и проверял себя. Opus 5.5 значительно лучше организует собственную работу, что предполагает в соответствии с тестами:

·  сокращение числа действий в некоторых сценариях более чем вдвое;
·  существенно меньший расход токенов;
·  более эффективное использование инструментов;
·  более сильная самопроверка;
·  приближение к уровню Fable 5.1 и даже прирост производительности в сверхсложных задачах при значительно меньшей стоимости.

Opus 5.5 – резкое повышение качества исполнения длинной последовательности действий и эффективности использования вычислительного бюджета.

Наиболее интересный вывод выходит далеко за пределы конкретного релиза. Похоже, следующий резерв масштабирования LLM находится уже не только в увеличении размера модели или числа токенов размышления, а в оптимизации самой траектории решения задачи: меньше ошибочных ветвей, меньше повторений, лучше распределение вычислений, более устойчивое состояние задачи и более качественная обратная связь с внешней средой.

По косвенным признакам, у меня есть подозрение, что Opus 5.5 является дистиллированной версией Fable или Mythos (дата отсечки обучения в июне 2026, аналогичные откаты, схожая архитектура).


Источник: https://t.me/spydell_finance/10153

Данная публикация является личным мнением автора. Мнение владельца сайта может не совпадать с мнением автора.
2 Комментария
  • Rostislav Kudryashov
    Сегодня в 10:02
    Чем больше генеративной креативности, тем больше бреда.
    Недаром Греф выступал против уроков физики и математики в школах, из-за того что эти уроки подавляют креативность.
  • вячеслав иванов
    Сегодня в 10:40
    Что нам с этим делать, как на этом заработать?

Активные форумы
Что сейчас обсуждают

Старый дизайн
Старый
дизайн