spydell
spydell личный блог
Вчера в 11:05

Haiku 5.5 и эпоха интеллектуальной достаточности Через две недели после...

Haiku 5.5 и эпоха интеллектуальной достаточности

Через две недели после OpenAI с GPT-6 Luna в ценовой коридор китайских моделей зашла и Anthropic. На OpenRouter у Anthropic 5.6% токенов и 29% денег, и почти весь этот доход – в дорогом сегменте, который дешёвые китайские модели догоняют снизу.

Невероятно, но американцы не только вернулись в гонку с китайцами за право доминировать в сегменте массовых и дешевых моделей, но даже отрываются.

На протяжении почти всего лета писал о том, как китайцы деклассирует американский гегемонизм в ИИ через агрессивный демпинг.

Сначала демпингом на «китайский произвол» ответил OpenAI через кратное обрушение цен на GPT-6 Luna, а теперь Anthropic выпустила Haiku 5.5 по цене $0.10 / $0.50 за 1 млн токенов – в 10 раз дешевле Haiku 4.5 годовой давности при индексе Artificial Analysis 43.4 против 16.9, но с важным нюансом — после 100 тыс токенов контекста цена взлетает в 5 раз!!

Haiku 5.5 и эпоха интеллектуальной достаточности Через две недели после...


Haiku 5.5 – это уровень летнего флагмана Opus 4.8 (от которого ценители «прекрасного» ссались от восторга) и заметно лучше GPT-5.5 (при цене в 60 раз ниже), который был основной боевой моделью OpenAI до 9 июля по ценам примерно в сотню раз дороже!

Haiku 5.5 и эпоха интеллектуальной достаточности Через две недели после...


Сейчас Haiku 5.5 по производительности на уровне или чуть выше большинства китайских легких моделей (GLM-5.3 flash, Qwen3.8 flash, DeepSeek v4.1 flash, Mimo-v2.6 flash), которые несколько месяцев назад деклассировали американцев.

Haiku 5.5 и эпоха интеллектуальной достаточности Через две недели после...


При этом по цене в точности на уровне GPT-6 Luna и даже дешевле большинства китайских LLMs.

Haiku против Luna и Китая. Прайс у Haiku 5.5 и GPT-6 Luna одинаковый вплоть до кэша ($0.01), поэтому сравнивать нужно стоимость задачи, а не токена. В режиме xhigh Haiku даёт индекс 41.2 за $124 на 1 000 задач AA – выше и дешевле DeepSeek V4.1 Flash (39.5 за $265), Qwen3.8-Flash-Next (39.8, $372) и Gemini 3.8 Flash (40.9, $1 243). В режиме max (43.4, $213) она обходит GLM-5.3-Flash.

Haiku 5.5 и эпоха интеллектуальной достаточности Через две недели после...


Тот исторический момент, когда Anthropic сделал модель, которая дешевле легендарного DeepSeek и практически всех китайцев.

Haiku 5.5 в режиме high эквивалент GPT-6 Luna в режиме Max при примерно схожих затратах, а Haiku 5.5 Medium = GPT-6 Luna Extra по производительности и экономической рентабельности.

Однако границу эффективности Haiku не забрала: MiMo-V2.6-Pro с открытыми весами даёт 46.3 за $133, а на дешёвых режимах впереди Luna – 38.1 за $68 против 37.8 за $79 у Haiku high.

Haiku 5.5 и эпоха интеллектуальной достаточности Через две недели после...


Сила Haiku – агентная работа и честность: GDPval 56% и Terminal-Bench 4 32.8% против 42.7% и 14.6% у GPT-5.5 xhigh, доля отказов вместо галлюцинаций 59.6% против 23.3% у Luna и 3.5% у DeepSeek.

Слабостей две. В режиме max до первого токена ответа проходит 432 секунды против 10 у DeepSeek. Веса закрыты: китайскую модель можно развернуть у себя или взять у десятка провайдеров, Haiku – только у Anthropic и партнёрских облаков.

▪️Дефляция в десятки и сотни раз. Стоимость 1 000 задач на уровне GPT-5.5 xhigh упала с $2 634 в апреле до $68 у GPT-6 Luna – в 39 раз за 5 месяцев. Уровень индекса 30 (флагманы декабря–февраля) подешевел в 86 раз за 7 месяцев, уровень Claude 4.5 Sonnet – в 123 раза за год.

Haiku 5.5 и эпоха интеллектуальной достаточности Через две недели после...


По прайсу выход GPT-5.5 дороже Haiku 5.5 в 60 раз, Claude 4.1 Opus августа 2025 года – в 150 раз. Дешёвые модели сжигают больше токенов, поэтому по стоимости задачи разрыв Haiku max и GPT-5.5 xhigh – 12 раз, а не 60, но ближе к 60 раз в режиме Medium.

Граница классов размывается: GPT-6.1 Sol в режиме medium стоит $214 за 1 000 задач, как Haiku max, при индексе 47.8. Цену задаёт глубина рассуждения, а не класс модели.

Лучшая дешёвая модель (46.3) уже выше фронтира конца мая (41.8). Отставание дешёвого сегмента от фронтира сократилось примерно с полугода до 4–5 месяцев.

▪️Интеллектуальная достаточность – точка, после которой дополнительный интеллект не повышает ценность решения задачи. На OpenRouter порог 95% пройден: 95.5% токенов идут в модели дешевле $20 за выход, 93.8% – в модели ниже фронтира.

Haiku 5.5 и эпоха интеллектуальной достаточности Через две недели после...


Деньги пока держатся на тонком слое длинных агентных цепочек, и он еще растёт – в 2.1 раза при росте рынка в 2.4.

Однако окно монетизации флагмана сжимается до 4–5 месяцев: через 5–7 месяцев его уровень стоит в 40–90 раз дешевле, а лидеры сами ускоряют процесс своими Luna, Haiku и Flash. Сейчас период полураспада флагманов около 2-3 месяцев, далее утилизация.

Haiku 5.5 и эпоха интеллектуальной достаточности Через две недели после...


Ценовой пол задают китайские лаборатории с открытыми весами, а американские прайсы лишь подтягиваются к нему.

Я посчитал сценарий: если доля дорогих моделей опустится с 13.1% до 5% токенов, выручка при том же объёме сократится на 37%, а с полугодом дефляции массового сегмента по текущему темпу (-56%) – на 58%. Чтобы удержать выручку, поток должен вырасти в 2.4 раза – ровно столько, сколько он вырос за последние 2.5 месяца.

Выручка провайдеров держится не на цене, а на взрывном объёме, который не может расти вечно. Две трети токенов уже приходятся на открытые веса, которые дают лишь 29% денег, а гиперскейлеры, по моему августовскому расчёту, направляют в капзатраты 81.8% операционного потока против 34.8% в 2017–2019.

Haiku 5.5 и эпоха интеллектуальной достаточности Через две недели после...


Выигрывают те, у кого интеллект встроен в продукт или канал продаж – облака, офисные пакеты, агентные оболочки. Проигрывают продавцы «сырого» интеллекта.

Оговорка: OpenRouter – не весь рынок, основной трафик идет через облачных провайдеров и напрямую через API.


Источник: https://telegram.me/spydell_finance/10178

Данная публикация является личным мнением автора. Мнение владельца сайта может не совпадать с мнением автора.
6 Комментариев
  • Среднеброд
    Вчера в 11:35
    Вся эта канитель с запуском LLM и продаже доступа к ним пока глубоко убыточна и финансируется любыми способами, в надежде, что конкуренты сдохнут раньше. Сейчас лихорадочно строятся датацентры по всему миру и делаются серверы, которые морально устаревают за пару лет, в то время как стоимость этого оборудования может составлять до 70%. Под это дело стоится куча фабрик по производству компонентов (фабрики тоже морально стареют), куда все это девать потом, не особо ясно.  Все это выглядит не очень хорошо. 
  • ПОЯСНИТЕ КАК МОЖНО СДЕЛАТЬ ДЕШЕВЛЕ ДИПСИКА ЕСЛИ ПОСЛЕДНИЙ БЕСПЛАТЕН? а 
  • Nojpg
    Вчера в 11:49
    сравнение последних моделей китайских не с fable/mythos/astra, так и всяких sol/opus нет. в чем суть сравнения в табличках без них не понятно
  • Сколько у вас процентная доходность в год? Получается 20-39 процентов в год?

Активные форумы
Что сейчас обсуждают

Старый дизайн
Старый
дизайн