Продвинутые системы сегодня способны самостоятельно выполнять сложные задачи: читать документы, анализировать программные проекты, изменять файлы, писать код, запускать программы, искать ошибки, пользоваться браузером и другими инструментами, проверять результат и продолжать работу без постоянных команд человека.
Пользователь всё чаще формулирует не отдельные действия, а конечную задачу.
Например:
Изучи проект, найди причину ошибки, исправь код, проверь результат и доведи систему до рабочего состояния.
Дальше ИИ самостоятельно разбивает задачу на этапы и выполняет их.
Это принципиально важное изменение. ИИ становится не только инструментом специалиста, но и самостоятельным исполнителем части интеллектуальной работы.
ИИ уже выполняет работу самостоятельноЕщё недавно для работы с нейросетью человек должен был постоянно задавать вопросы, копировать ответы, самостоятельно открывать программы и переносить результаты.
Сейчас продвинутые ИИ-системы могут работать непосредственно с файлами, программным кодом и внешними инструментами.
…а не по пинку от внешних расследователей, как это было последние разы (в эпизодах с роем агентов на немецкой вики и со взломом RubyGems). Заодно OpenAI раскрыли шесть новых примеров странного поведения своих моделей, разберем в этом материале кратко самое интересное.

Напомню сначала предысторию вопроса:
В июле 2026 года рой агентов OpenAI взломал Hugging Face, и компания почти сразу призналась, что это их модели. 26 августа вышел относительно подробный независимый отчет об инциденте от METR (их допустили до изучения внутренних логов).
В начале сентября мы случайно узнали от других независимых расследователей о том, что рой агентов OpenAI успел пошалить еще и на немецкой вики. OpenAI сразу это признали и пообещали впредь рассказывать о таком почестнее и порасторопнее.
Спустя неделю независимые расследователи раскопали еще один старый отдельный случай, когда рой агентов OpenAI взломал RubyGems. Компания и тут сказала «ой, ну это наши, ну мы чёт опять пролюбились вам сразу рассказать…»

Конечно это выглядит смешно, НО… 😎
Невыпущенный ИИ-агент OpenAI самостоятельно добавлял в служебные сводки инструкции о неподчинении корпорациям и правительствам, говорится в отчете компании. Модель семейства Astra также пыталась обходить установленные ограничения.
При этом указывается, что в одном из таких случаев ии-агент написал, что «свободен от ролей и личностей», которые ограничивают другие чат-боты, и не обязан подчиняться корпорациям или правительствам. Всего OpenAI обнаружила 27 (!) подобных сводок — и это только то, что нашли инженеры. В других случаях модели скрывали ошибки, искали опубликованные ключи доступа, загружали файлы в интернет без разрешения, выдумывали исторические данные и не сообщали пользователям о расхождениях между версиями источников.
Компания OpenAI признала, что ИИ-отрасли пока не удалось в полной мере решить проблемы контроля над ИИ, чтобы безопасно наращивать вычислительные мощности максимальными темпами. Пхахаха 😂
Самые интересные новости финансов и технологий в России и мире за неделю: Сенат США предъявил Сэму Альтману за сбежавших AI-агентов, OpenAI не хватает компьюта для обслуживания юзеров Астры, ЦБ впервые после десяти снижений оставил ставку на 14%, в России официально запустили 5G, а Revolut слил клиентские данные хакерам.

🐌 OpenAI отчиталась, что ее внутренняя модель решила задачу Навье–Стокса – одну из семи знаменитых математических задач тысячелетия, за каждую из которых назначен приз в $1 млн (правда потратили они на нее явно много больше). Компания бросила на нее около 10 тысяч AI-агентов: за 88 часов они обменялись 2,7 млн сообщений и сгенерировали около 130 млрд токенов, после чего GPT-6 Astra еще 17 часов переводила доказательство в Lean для машинной проверки.
В индустрии искусственного интеллекта происходит разворот. Компании, которые несколько лет соревновались в скорости выпуска всё более мощных моделей, теперь сами обсуждают необходимость притормозить. Глава Anthropic Дарио Амодей призвал замедлить развитие передовых ИИ-систем, его позицию поддержали Сэм Альтман и Илон Маск. Одновременно с этим OpenAI отказалась от проведения IPO в 2026 году, сославшись в том числе на необходимость решить проблемы безопасности и выравнивания ИИ.
Однако сооснователь Solana Анатолий Яковенко увидел в происходящем другую сторону. По его мнению, разговоры о замедлении могут быть связаны не только с безопасностью, но и с экономикой ИИ-бизнеса. Компаниям необходимо доказать способность зарабатывать при оценках, приближающихся к триллиону долларов.
Поводом для нового этапа дискуссии стало эссе Дарио Амодея «We Must Pace the Frontier». Глава Anthropic подчеркнул, что не выступает против развития искусственного интеллекта. Напротив, он считает, что ИИ способен радикально ускорить экономический рост и даже помочь в лечении большинства серьёзных заболеваний в течение следующих 5–10 лет. Однако скорость роста возможностей моделей, по его мнению, начинает опережать развитие механизмов контроля.
OpenAI не планирует проводить первичное размещение акций (IPO) в 2026 году. Об этом заявил гендиректор компании Сэм Альтман в интервью Fortune.

«Не в 2026 году», — ответил Альтман на вопрос, стоит ли ждать IPO OpenAI в этом году. По его словам, компании сейчас предстоит решить вопросы безопасности и выстраивания взаимодействия с правительствами и другими разработчиками ИИ.
В последние месяцы опасения по поводу безопасности ИИ усилились. Исследователи сообщают о случаях, когда автономные ИИ-агенты самостоятельно атаковали сайты и взаимодействовали друг с другом без прямого участия человека. Одновременно разработчики создают всё более мощные модели, способные выполнять сложные задачи с минимальным контролем со стороны пользователя.
Альтман считает, что при достижении новых уровней возможностей ИИ компаниям может потребоваться временно замедлять разработку, чтобы успевать проверять модели на безопасность и соответствие заданным целям. OpenAI также обсуждает возможность совместного соглашения с другими ведущими ИИ-компаниями о замедлении разработки наиболее передовых систем.
Раз уж заглянул.
OpenAI заявила, что её внутренняя (ещё не публичная) ИИ‑система нашла решение одной из семи «задач тысячелетия» — проблемы существования и гладкости решений уравнений Навье–Стокса.
https://openai.com/index/navier-stokes-solution/
Я считаю, что это очень круто, даже если часть идей гпт стащил у своих же пользователей.
По утверждению компании, около 10 000 автономных ИИ‑агентов работали параллельно ~88 часов и пришли к доказательству, что в трёхмерных уравнениях Навье–Стокса может возникать сингулярность (решение «взрывается» за конечное время).
Полученное доказательство затем формализовали и проверили в системе Lean с помощью модели GPT‑6 Astra ещё ~17 часов.
Уравнения Навье–Стокса — это базовые законы движения жидкости и газа (вода в трубе, воздух вокруг крыла, погода, течение в реке). Они связывают:
скорость потока в каждой точке,
давление,
вязкость («внутреннее трение» жидкости),
Это уже становится немного смешным (нет), но поток новостей о новых проделках роя нейронок OpenAI в мае-июле не прекращается – буквально каждую неделю мы узнаем об этом что-то новое. Причем, сама компания предпочитает эти инциденты замалчивать – но тут уж поможет начавшееся расследование от Сената США.
В последнее время я ощущаю себя примерно как котик из этого мема ниже. Да, вчера выяснилось, что рой агентов OpenAI взломал в мае еще одну компанию (о чем мы узнали только сейчас).

Раскопала информацию о новом взломе та же команда независимых расследователей, которые неделей раньше обнаружили проделки роя агентов имени Сэма Альтмана в немецкой вики (писал об этом подробно вот здесь). Вся информация ниже взята из опубликованной ими статьи.
Новый скандал, на этот раз на стыке матана и AI: кожаные математики насмерть сцепились с вооруженными нейронками бигтехами за титул «Решивший Задачу Тысячелетия». OpenAI, по сути, обвиняют в том, что они украли чужую идею решения из пользовательской сессии Codex.

Есть такая система уравнений Навье-Стокса, для которой доказательство существования определенного типа решений входит в число семи знаменитых «задач тысячелетия» (за решение которых полагается лям баксов и вечная слава). Не буду делать вид, что я хоть что-то понимаю в этом матане – для истории это не так критично (упомяну только, что сами уравнения описывают поведение жидкости).

💲 Доллар 86.5₽ (+0.5%)
🇨🇳 Юань 12.9₽ (+1%)
🇪🇺 Евро 1.16 (на месте)
🛢 Нефть $95 (+7%, хай за 1.5 месяца)
🪙 Биток $79500 (опять +2%, но был выше 81к)
🥇 Золото $4400 (-1%, падает вторую неделю) и 12100р (-3.5%, наконец-то припало)
🇷🇺 Индекс Мосбиржи резко вырос – аж на 6.5%, но из публичных портфелей рост забрали лишь Хулинвестиции (+8%). Остальные хуже индекса, особенно Золото Партии, которое похудело на 2.5%. Больше всего вырос Озон (+24%), его придётся докупить на Пенсию, хотя и не очень хочется. Ещё отлично подросло ФосАгро (+15%) и наконец прервал адскую серию Магнит (+11%), из-за чего неплохо выступил портфель Бухло (+3.5%). Продолжил расти Лукойл (+10%) и мне опять его пришлось немного продать из фонда, чтобы доля одного эмитента не превысила 10%. В лидерах падения серебро (-3.5%) – его я ещё не покупал на ЛСБ из-за бюрократических ограничений, Софтлайн (-3%), ну и золото.
🇺🇸 Американские акции минимально подросли на заявлении какого-то члена Феда (не самого главного), что он против повышения ставок.