Haiku 5.5 и эпоха интеллектуальной достаточности
Через две недели после OpenAI с GPT-6 Luna в ценовой коридор китайских моделей зашла и Anthropic. На OpenRouter у Anthropic 5.6% токенов и 29% денег, и почти весь этот доход – в дорогом сегменте, который дешёвые китайские модели догоняют снизу.
Невероятно, но американцы не только вернулись в гонку с китайцами за право доминировать в сегменте массовых и дешевых моделей, но даже отрываются.
На протяжении почти всего лета писал о том, как китайцы деклассирует американский гегемонизм в ИИ через агрессивный демпинг.
Сначала демпингом на «китайский произвол» ответил OpenAI через кратное обрушение цен на GPT-6 Luna, а теперь Anthropic выпустила Haiku 5.5 по цене $0.10 / $0.50 за 1 млн токенов – в 10 раз дешевле Haiku 4.5 годовой давности при индексе Artificial Analysis 43.4 против 16.9, но с важным нюансом — после 100 тыс токенов контекста цена взлетает в 5 раз!!

Haiku 5.5 – это уровень летнего флагмана Opus 4.8 (от которого ценители «прекрасного» ссались от восторга) и заметно лучше GPT-5.5 (при цене в 60 раз ниже), который был основной боевой моделью OpenAI до 9 июля по ценам примерно в сотню раз дороже!

Сейчас Haiku 5.5 по производительности на уровне или чуть выше большинства китайских легких моделей (GLM-5.3 flash, Qwen3.8 flash, DeepSeek v4.1 flash, Mimo-v2.6 flash), которые несколько месяцев назад деклассировали американцев.

При этом по цене в точности на уровне GPT-6 Luna и даже дешевле большинства китайских LLMs.
Haiku против Luna и Китая. Прайс у Haiku 5.5 и GPT-6 Luna одинаковый вплоть до кэша ($0.01), поэтому сравнивать нужно стоимость задачи, а не токена. В режиме xhigh Haiku даёт индекс 41.2 за $124 на 1 000 задач AA – выше и дешевле DeepSeek V4.1 Flash (39.5 за $265), Qwen3.8-Flash-Next (39.8, $372) и Gemini 3.8 Flash (40.9, $1 243). В режиме max (43.4, $213) она обходит GLM-5.3-Flash.

Тот исторический момент, когда Anthropic сделал модель, которая дешевле легендарного DeepSeek и практически всех китайцев.
Haiku 5.5 в режиме high эквивалент GPT-6 Luna в режиме Max при примерно схожих затратах, а Haiku 5.5 Medium = GPT-6 Luna Extra по производительности и экономической рентабельности.
Однако границу эффективности Haiku не забрала: MiMo-V2.6-Pro с открытыми весами даёт 46.3 за $133, а на дешёвых режимах впереди Luna – 38.1 за $68 против 37.8 за $79 у Haiku high.

Сила Haiku – агентная работа и честность: GDPval 56% и Terminal-Bench 4 32.8% против 42.7% и 14.6% у GPT-5.5 xhigh, доля отказов вместо галлюцинаций 59.6% против 23.3% у Luna и 3.5% у DeepSeek.
Слабостей две. В режиме max до первого токена ответа проходит 432 секунды против 10 у DeepSeek. Веса закрыты: китайскую модель можно развернуть у себя или взять у десятка провайдеров, Haiku – только у Anthropic и партнёрских облаков.
▪️Дефляция в десятки и сотни раз. Стоимость 1 000 задач на уровне GPT-5.5 xhigh упала с $2 634 в апреле до $68 у GPT-6 Luna – в 39 раз за 5 месяцев. Уровень индекса 30 (флагманы декабря–февраля) подешевел в 86 раз за 7 месяцев, уровень Claude 4.5 Sonnet – в 123 раза за год.

По прайсу выход GPT-5.5 дороже Haiku 5.5 в 60 раз, Claude 4.1 Opus августа 2025 года – в 150 раз. Дешёвые модели сжигают больше токенов, поэтому по стоимости задачи разрыв Haiku max и GPT-5.5 xhigh – 12 раз, а не 60, но ближе к 60 раз в режиме Medium.
Граница классов размывается: GPT-6.1 Sol в режиме medium стоит $214 за 1 000 задач, как Haiku max, при индексе 47.8. Цену задаёт глубина рассуждения, а не класс модели.
Лучшая дешёвая модель (46.3) уже выше фронтира конца мая (41.8). Отставание дешёвого сегмента от фронтира сократилось примерно с полугода до 4–5 месяцев.
▪️Интеллектуальная достаточность – точка, после которой дополнительный интеллект не повышает ценность решения задачи. На OpenRouter порог 95% пройден: 95.5% токенов идут в модели дешевле $20 за выход, 93.8% – в модели ниже фронтира.

Деньги пока держатся на тонком слое длинных агентных цепочек, и он еще растёт – в 2.1 раза при росте рынка в 2.4.
Однако окно монетизации флагмана сжимается до 4–5 месяцев: через 5–7 месяцев его уровень стоит в 40–90 раз дешевле, а лидеры сами ускоряют процесс своими Luna, Haiku и Flash. Сейчас период полураспада флагманов около 2-3 месяцев, далее утилизация.

Ценовой пол задают китайские лаборатории с открытыми весами, а американские прайсы лишь подтягиваются к нему.
Я посчитал сценарий: если доля дорогих моделей опустится с 13.1% до 5% токенов, выручка при том же объёме сократится на 37%, а с полугодом дефляции массового сегмента по текущему темпу (-56%) – на 58%. Чтобы удержать выручку, поток должен вырасти в 2.4 раза – ровно столько, сколько он вырос за последние 2.5 месяца.
Выручка провайдеров держится не на цене, а на взрывном объёме, который не может расти вечно. Две трети токенов уже приходятся на открытые веса, которые дают лишь 29% денег, а гиперскейлеры, по моему августовскому расчёту, направляют в капзатраты 81.8% операционного потока против 34.8% в 2017–2019.

Выигрывают те, у кого интеллект встроен в продукт или канал продаж – облака, офисные пакеты, агентные оболочки. Проигрывают продавцы «сырого» интеллекта.
Оговорка: OpenRouter – не весь рынок, основной трафик идет через облачных провайдеров и напрямую через API.
Источник: https://telegram.me/spydell_finance/10178
Данная публикация является личным мнением автора. Мнение владельца сайта может не совпадать с мнением автора.