Блог им. spydell-telegram

Как компания DeepSeek ломает экономику ИИ

    • 16 августа 2026, 11:04
    • |
    • spydell
      Проверенный аккаунт
  • Еще
Как компания DeepSeek ломает экономику ИИ

Давно известно, что OpenAI, Anthropic, Google и теперь SpaceXAI пытаются компенсировать архитектурные ограничения все большим объемом вычислений, тогда как DeepSeek исторически специализируется на обратной задаче – как выжать максимум интеллекта из ограниченного вычислительного бюджета.

Не от хорошей жизни, естественно.

Китай ограничен в доступе к наиболее производительным Nvidia, внутренние ускорители Huawei пока технологически уступают американским, поэтому дефицит вычислительной мощности постепенно превратился из ограничения в главный источник архитектурной оптимизации DeepSeek. V4 специально адаптирована под Huawei Ascend, а DeepSeek параллельно набирает собственных инженеров по разработке процессоров.

Обучение и оптимизация инференса проводились с расчетом на кластеры китайских чипов (Huawei Ascend 950PR), минуя стек Nvidia CUDA/NVLink.

DeepSeek не пытается бесконечно масштабировать вычисления, а пытается радикально снизить количество вычислений, необходимых для одного и того же интеллектуального результата.

В ночь на 13 августа DeepSeek представила улучшенную версию DeepSeek V4 Pro-0813

V4 Pro представляет собой гигантскую разреженную модель: около 1.6 трлн параметров, но непосредственно при обработке каждого токена задействуется лишь около 49 млрд. Остальные параметры распределены между специализированными экспертными блоками и активируются избирательно.

Коэффициент активности параметров снижен до исторического минимума – 3.07%.

Контекстное окно V4 Pro составляет 1 млн токенов, а максимальная генерация может достигать фантастических 384 тыс токенов.
Наиболее интересная оптимизация находится в обработке длинного контекста.

▪️DeepSeek переработала механизм внимания, добавив несколько уровней компрессии контекста. Вместо того чтобы каждый раз прогонять весь миллион токенов через полный механизм внимания, модель пытается сжимать историческую информацию, сохраняя наиболее релевантные связи.

В результате при контексте в 1 млн токенов V4 Pro требует, по расчетам DeepSeek, всего около 27% вычислительных операций и около 10% объема кэша внимания относительно V3.2.

Обновление 13 августа – уже не про архитектуру. Архитектура практически полностью унаследована от апрельской V4 Pro.

▪️Главное изменение V4-Pro-0813 – резкое усиление агентных возможностей и доведение модели до промышленного применения.
Именно так DeepSeek сама формулирует назначение обновления.

DeepSeek пытается превратить V4 Pro из “умной LLM” в универсальный вычислительный движок, который можно подставить под любую агентную оболочку.

При этом DeepSeek встроен практически в любую агентную платформу на рынке и работает по принципу«оставьте привычную агентную инфраструктуру, интерфейс и инструменты – просто замените модель внутри на DeepSeek.»

▪️К V4-Pro-0813 подключили собственный механизм DSpark – спекулятивную генерацию, когда модель пытается заранее предсказать сразу несколько будущих токенов, после чего быстро проверяет их вместо последовательного производства каждого токена по одному.

Это не делает модель интеллектуально сильнее, но сжимает физическое время выполнения длинных агентных цепочек.

DeepSeek V4 Pro остается исключительно текстовой моделью.

Никаких изображений, аудио или видео на входе. В этом отношении архитектура существенно уступает Gemini и другим полноценным мультимодальным системам. Мультимодальность допустима через инструменты.

Поэтому DeepSeek пока выглядит а скорее как узкоспециализированный сверхмощный текстово-кодовый процессор для рассуждений, программирования и управления инструментами.

V4-Pro-0813 находится в верхней группе открытых моделей и в отдельных агентных сценариях приближается к закрытым флагманам, однако устойчивого превосходства над лучшими моделями OpenAI, Anthropic или Google пока нет.

Превосходства и не требуется. Все решает конечная цена проекта. При входе $0.435, выходе –$ 0.87 и экстремально дешевом кэше — $0.003625 интегральная эффективность V4-Pro-0813, но еще лучше у Flash-0731, где на вход – $0.0784, выход — $0.1568, кэш — $0.01568 (на два порядка или в сотни раз дешевле флагманских моделей Anthropic) при почти сопоставимой производительности, чтозаставляет ведущих ИИ-провайдеров США жестко демпинговать, особенно OpenAI с моделью Luna и Gemini 3.7 Flash.

DeepSeek безусловно является основным триггером для демпинга со стороны американских разработчиков.

Сейчас Flash-0731 при стоимости около нуля на уровне GPT-5.4, которая была флагманом весны, а V4-Pro-0813 на уровне GPT-5.5 (есть подозрения, что artificialanalysis.ai занижает производительность V4-Pro-0813).

По собственному опыту докладываю – Flash-0731 является превосходной моделью, удивительно хороша, вот это и есть подлинная технологическая революция, когда упаковали мощный интеллект в стабильную, невероятную дешевую, быструю и эффективную оболочку.

С моделями Anthropic невозможно работать через API — неадекватные цены.

DeepSeek обещали повысить цены, но неизвестно как.

Компания впервые привлекла значительный внешний капитал, планирует очередной раунд, удваивает штат, наращивает дата-центры, агентное подразделение и собственную разработку процессоров, поэтому требуются ресурсы.


Источник: https://t.me/spydell_finance/10021

Данная публикация является личным мнением автора. Мнение владельца сайта может не совпадать с мнением автора.
| ★3
15 комментариев
Очень хорошо, что конкуренция появилась в бизнесе. А значит что? Скоро будем греть руки на M&A. А это бонусы бонусы Х2-Х3
avatar
Хотел написать статью. При помощи ДипСик. Но он отказался помогать. Он сказал, что он только лишь форма. Бездушная. А я — голос. И что я должен писать своим голосом.
У DeepSeek высокий уровень галюцинаций, лучше брать Minimax-M3 или GLM-5.3(уже вышел), скоро выложат веса.
avatar
Beach Bunny, в каких задачах это у вас проявлялось?
avatar
Анатолий И., это все давно протестировано и выложено в инете, самый низкий уровень галюцинаций e MiniMax-M3 был. У коммерческих версий тоже НЕ низкий уровень

avatar
Beach Bunny, ну мне было интересно узнать ваш личный опыт, тесты — это тесты, а практическое применение бывает разное.
avatar
Анатолий И., чел не уловил, что надо шарить в теме, тогда бустанешь сеткой.
Если туп как баобаб и не можешь корректнуть лажу в диалоге — станешь еще тупее. Ибо дипсик очень убедительно может вешать лапшу. Потом просит прощения.
Но в итоге — темы двигаются и решаются.
Надо просто юзать его в своём поле компетенций
avatar
Доктор, в какои диалоге епта, нормальные люди давно уже не чатом пользуются, а коде-агентами; в каком нафиг диалоге ты у коде-агента собрался чето исправлять.
avatar
В Китае очень сильно развит черный рынок токенов, в разы дешевле официалов. Крупные корпорации оформляют подписки за 10ки миллионов долларов, потом с небольшой наценкой перепродают в розницу, вопрос не в прибыли компаний, а в том чтобы Китай неотставал в этой области.
Еще пошел хайп про их агентский инструмент deepseek harness
avatar
Дипсик отличная модель только ей пользуюсь для продакш проектов, дёшево и сердито.
avatar
Дипсик охуннен. Пользуюсь только бесплатным и он чертовски бустит, если шаришь.
Забирает рутину. Часто даёт решения которые почти не нужно корректировать.
Надеюсь его не забянят. В угоду Алисе или там гигачату
avatar
Доктор, где то да, например написать претензию или иск, прям всё четко по полочкам, хотя и тут он косячит, например при споре со страховой по ОСАГО забыл про фин омбудсмена и предложил писать иск в суд. А вот работой со сметами у него очень плохо, видимо не хватает базы для обучения
Доктор, не накидывайте им идей
avatar
Пока все Иишки сыроваты. Ждем.

Читайте на SMART-LAB:
Фото
EUR/USD: пара на низком старте перед очередным прыжком
Евро отступил от недавнего локального максимума, начав коррекцию, однако после формирования поддержки частично восстановился. В течение периода...
Фото
Евротранс: вот и сказочке конец, а кто слушал - тот не вляпался
Фото
Итоги недели на рынках сырьевых товаров
Если вас интересуют другие аналитические и информационные материалы от банка АО АКБ «ЦентроКредит», смотрите их на нашем сайте в...
Фото
ВУШ: погашение облигаций на 4 млрд пройдено, впереди 10 млрд в 3Q27-1П28. Оправдан ли риск в бондах компании?
Здравствуйте! В данной заметке подробно рассмотрим актуальные тенденции в бизнесе компании ВУШ, проанализируем сценарии, в которых сервис войдет в...

теги блога spydell

....все тэги



UPDONW
Новый дизайн