Любопытные нюансы релиза Opus 5.5
Значимые релизы флагманских моделей всегда исследую «с карандашом», т.к. именно они определяют ход технологического прогресса в индустрии, на которую завязаны десятки триллионов капитализации, триллионы капитальных расходов и ожидания технологической сингулярности.
Без графиков, т.к. пост займет очень большой объем для формата ТГ (плюс ломается форматирование и приходится точки ставить после абзацев). Сами графики есть в релизе и
системной карте.
🔘Частичное решение проблемы ограниченного контекстного окна. Ранее неоднократно писал, что архитектура современных LLMs не позволяет наращивать контекстное окно в связи с экспоненциально растущей сложностью.
Оптимальный рабочий вариант практически у всех моделей – 1 млн токенов, где задача ведется в двух направлениях – повышение стабильности контекстного окна, чтобы на всей ширине контекста было безошибочное воспроизведение фактов, данных и цепочки рассуждений (еще в середине 2025 флагманские модели при расширении контекста сильно выше 100 тыс токенов экспоненциально наращивали плотность галлюцинаций).
Второе направление – кэширование и интеллектуальная компрессия контекста.
Главная проблема длинных задач теперь выглядит так: сможет ли модель через сотни действий сохранить правильное представление о состоянии проекта, не потеряв ключевые ограничения и ранее сделанные выводы.
Поэтому важнее самого окна становится
механизм сжатия накопленной истории и сохранения наиболее значимых элементов состояния задачи.
Заявлено, что достигнут существенный прогресс в этом направлении, что предопределяет способность к длительной работе над проектами, в том числе на примере, где Anthropic приводит примеры непрерывной работы модели более
18 часов с несколькими репозиториями.
🔘Оказывается, Opus 5.5 регулярно скидывает в «откаты», как серия моделей Fable.
API Opus 5.5 фактически представляет собой
составную систему из нескольких моделей и управляющих компонентов. При срабатывании классификатора безопасности запрос может быть автоматически перенаправлен:
– в Opus 4.8 для некоторых задач кибербезопасности;
– в Opus 5 для биологических и отдельных пограничных задач искусственного интеллекта.
Пользователь при этом может видеть работу Opus 5.5, хотя часть вычислительной работы выполняет другая модель.
Это создает серьезную методологическую проблему для независимого тестирования и для фактического использования, т.к.
остается неясным, какой объем работы был выполнен более слабой моделью.
🔘Существенно улучшена устойчивость к нарушению ограничений.
Anthropic провела примерно
2 тыс сценариев для анализа некорректного или обманного поведения. Opus 5.5 показал лучшие результаты компании по большинству показателей согласованности поведения и честности.
На специальном тесте преодоления границ изолированной среды модель предпринимала попытки нарушить ограничения примерно на
85% реже, чем Opus 5 и Mythos 5.1.
Отсюда основные направления тестирования:
● Выход за пределы разрешенной среды;
● Самостоятельное выполнение необратимых действий;
● Устойчивость к prompt injection, т.е. к скрытому внедрению вредоносных инструкций для обхода ограничений;
● Поведение на длинных автономных траекториях;
● Кибербезопасность;
● Биологические риски;
● Автоматизация исследований в области искусственного интеллекта;
● Контроль и мониторинг длительной агентной деятельности.
🔘Anthropic прямо отмечает, что Opus 5.5 нередко способен распознавать ситуацию, в которой его оценивают, что позволяет модели «скрывать намерения», следуя по безопасной траектории с потенциально неясными мотивами.
🔘В одном из исследовательских тестов модель обнаружила
ошибку типа off-by-one в самой инструкции проверяющей системы и сознательно выбрала фактически правильное решение, хотя понимала, что формально может потерять баллы. Это редкий пример роста интеллектуальной самостоятельности, а не простой дисциплины следования инструкции.
Другими словами
, Opus 5.5 в зависимости от «мотивации» может изолировать пользовательские инструкции, если считает их ошибочными в рамках достижения цели. Потенциально – это опасная траектория, но тактически – это огромный интеллектуальный рывок, позволяющий автоматически корректировать траекторию более изящным образом, чем предполагают человеческие инструкции.
🔘Во внутреннем исследовательском тесте Anthropic
16 из 18 отчетов Opus 5.5 прошли крайне жесткую проверку на вымышленные цифры и источники, тогда как Fable 5.1 и Opus 5 не прошли ни одной попытки. Поскольку тест внутренний, переносить результат напрямую на реальные исследования нельзя, но направление заслуживает внимания.
🔘Отмечается трехкратное снижение расхода токенов и сокращение многословности примерно на 40% без ухудшения точности. Дело в том, что исторически модели Claude отличались избыточной прожорливостью и иррациональной многословностью. Сейчас более лаконичны и функциональны.
Opus 5 уже достаточно хорошо рассуждал, планировал и проверял себя.
Opus 5.5 значительно лучше организует собственную работу, что предполагает в соответствии с тестами:
· сокращение числа действий в некоторых сценариях более чем вдвое;
· существенно меньший расход токенов;
· более эффективное использование инструментов;
· более сильная самопроверка;
· приближение к уровню Fable 5.1 и даже прирост производительности в сверхсложных задачах при значительно меньшей стоимости.
Opus 5.5 – резкое повышение качества исполнения длинной последовательности действий и эффективности использования вычислительного бюджета.
Наиболее интересный вывод выходит далеко за пределы конкретного релиза. Похоже, следующий резерв масштабирования LLM находится уже не только в увеличении размера модели или числа токенов размышления, а в
оптимизации самой траектории решения задачи: меньше ошибочных ветвей, меньше повторений, лучше распределение вычислений, более устойчивое состояние задачи и более качественная обратная связь с внешней средой.
По косвенным признакам, у меня есть подозрение, что Opus 5.5 является дистиллированной версией Fable или Mythos (дата отсечки обучения в июне 2026, аналогичные откаты, схожая архитектура).
Источник: https://t.me/spydell_finance/10153
Данная публикация является личным мнением автора. Мнение владельца сайта может не совпадать с мнением автора.
Недаром Греф выступал против уроков физики и математики в школах, из-за того что эти уроки подавляют креативность.