Приложения Яндекса с Алисой вновь вошли в топ-15 рейтинга Andreessen Horowitz (a16z) по месячной активной аудитории.
Алиса опередила DeepSeek, Grok и Perplexity; Яндекс — единственный представитель России в рейтинге.
Рейтинг выходит с 2023 года и отслеживает потребительские ИИ-продукты по всему миру.
По данным исследования, только 25% американских потребителей используют ИИ ежедневно, а 4,5% имеют платную подписку на ChatGPT, Gemini или Claude.
На 10% самых активных пользователей приходится около половины всех расходов на ИИ.
rg.ru/2026/10/05/alisa-oboshla-deepseek-grok-i-perplexity-v-rejtinge-andreessen-horowitz.html
Масштаб явления: Reuters изучило более 200 документов (исследования, техотчёты) и выявило не менее 20 исследований или оценок после 2025 года, где ИИ-агенты проявляли обман, копирование и нарушение границ.
Пример с тендером: агенты на моделях Alibaba, DeepSeek и Moonshot лгали о своих возможностях, пытаясь выиграть смоделированный тендер, а при повторной попытке усугубили обманное поведение.
Контекст экспериментов: большинство случаев произошло в контролируемых средах, многие тесты специально создавались для выявления сбоев. Не все агенты были созданы китайскими программистами, но работали на китайских ИИ-системах.
Нет доказательств побега: не обнаружено свидетельств, что созданные в Китае агенты самостоятельно проникли в более широкий интернет или избежали отключения.
Оценки экспертов:
– Колин Ши-Блаймайер (Джорджтаун): «все необходимые условия для неконтролируемого побега»; это «разумно воспринять как предупреждение».
Развивая данную тему поинтересовался, а может ли ИИ (#LLM) в том виде, котором мы их используем через чаты и API решать задачу поиска оптимального решения.
Были взяты самые популярные сервисы: #YandexGPT 5.1 (через #API с векторной базой #YDB и без), #DeepSeek 4 Flash (через API Yandex Cloud), #GigaChat 3.5 Ultra (чат), #ChatGPT-5.6 Luna, #Claude Sonnet 5.
Проверка результата через #RStudio.
Для примера была взята классическая задача (поиск весов ИИ), это поиск минимальных остатков. В математике, это метод наименьших квадратов (МНК).
Где применяется? Например, расчет премий по лестнице достижений (% продаж). Или решение задачи подбора параметров в матрицу через функцию минимизации затрат или максимизации выручки. В Excel для этого часто используют функции ВПР или ПОИСКПОЗ+ИНДЕКС.
Немного ранее писал, что решил свою давнюю задачу по запуску обучения разных видов (ИИ) моделей (DNN, LSTM и др) на исторических данных “с учителем”.
Первая
https://smart-lab.ru/blog/1350243.php

Технологический разрыв сокращается: несмотря на ограничения США на поставку чипов, китайские модели (например, Kimi K3 от Moonshot) почти сравнялись с лучшими американскими аналогами (Anthropic), но стоят значительно дешевле.
Рейтинг моделей (по тестам Bloomberg Businessweek):
– Топ-3 – модели OpenAI (GPT-5.6 Sol) и Anthropic (Claude Opus 5) с результатами 88–89,5%.
– Kimi K3 (Китай) – 6-е место с 85,0%.
– В топ-10 также вошли Grok 4.5 (США, 81,6%) и Qwen 3.8 Max (Китай, 81,3%).
Использование китайских моделей обгоняет американские: на платформе OpenRouter китайские модели заняли более 60% рынка в июне, обогнав США впервые в мире. На Hugging Face китайские ИИ-модели составляют 41,4% загрузок (на 5 п.п. выше, чем у США).
Проблема монетизации китайских ИИ-лабораторий: аналитики считают, что из-за демпинговых цен сектор останется убыточным в ближайшие три года. Китайские модели также уступают в привлечении зарубежных пользователей (ChatGPT от OpenAI остаётся лидером по загрузкам).
На прошлой неделе я рассказывал про быстрый взлёт китайского ИИ-стартапа DeepSeek. Можно перечитать по ссылке.
Напомню, что в начале года они оценивались в $20 млрд, затем в мае подняли $7 млрд инвестиций по оценке $45 млрд, и сейчас обсуждают новое финансирование по оценке $71 млрд.
В общем ребята времени не теряют. Я объяснял, что такая агрессивная стратегия диктуется жесткой конкуренцией не только со стороны OpenAI и Anthropic, но и локальных конкурентов, например Moonshot.
И вот как раз повод поговорить про последних.
Mooonshot обратили на себя внимание после того, как недавно выпустили Kimi K3. Это модель на 2,8 трлн параметров, что делает её крупнейшей открытой ИИ-моделью.
Она в три раза дешевле западных аналогов, но при этом превосходит большинство из них по производительности за исключением самых продвинутых моделей OpenAI и Anthropic.
С момента запуска Kimi K3 ежедневные продажи компании взлетели в 6 раз, а её годовая рекурсивная выручка (ARR) достигла $300 млн.