Кратко
- В июле 2026 на рынке ИИ сошлись сразу три волны: новые флагманские модели и агенты, более жёсткие правила маркировки и доступа, и заметный рост стоимости топового сегмента.
- OpenAI, Anthropic, Google и xAI за последние недели выпустили или анонсировали GPT-5.6, Claude Sonnet 5, Grok 4.5 и готовят к общему доступу Gemini 3.5 Pro — агенты в их продуктах впервые работают часами без постоянного контроля человека.
- С 2 августа в ЕС вступает в силу маркировка ИИ-контента, а 8 июля Госдума приняла закон о маркировке в России — пока добровольной для авторов.
- Big Tech потратит на ИИ-инфраструктуру в 2026 году около $725 млрд — на 77% больше, чем годом раньше, и это давление уже видно в ценах на топовые модели.
Июль 2026 подтвердил три параллельных тренда на рынке ИИ. Модели стали заметно способнее — особенно в агентных сценариях, где раньше требовалось постоянное участие человека. Одновременно регуляторы в ЕС и России сузили правила игры вокруг ИИ-контента и доступа к самым мощным моделям. А инфраструктура и топовые тарифы ощутимо подорожали: счёт капитальных расходов Big Tech идёт на сотни миллиардов долларов. Разбираем все три тренда по порядку — и что это значит для тех, кто пользуется нейросетями каждый день.
Полезнее: модели и агенты сделали шаг вперёд
26 июня OpenAI показала превью семейства GPT-5.6 — моделей Sol, Terra и Luna. Доступ на старте открыли только проверенным партнёрам через API и Codex: перед публичным релизом OpenAI, по требованию июньской директивы американской администрации, отправила модель на проверку в Center for AI Standards and Innovation при Министерстве торговли США. Подробности о том, чем отличаются три версии и что показали бенчмарки, — в разборе GPT-5.6.
Anthropic 30 июня выпустила Claude Sonnet 5. На бенчмарке GDPval-AA v2, который оценивает прикладную профессиональную работу — анализ документов, письмо, структурированные выводы, — Sonnet 5 набрала 1618 баллов против 1615 у более мощной Opus 4.8. Формально мид-тир модель впервые обошла флагманскую Opus того же поколения на этом тесте (MarkTechPost). А 1 июля к работе вернулась Claude Fable 5 — 12 июня её глобально приостановили после того, как исследователи Amazon нашли джейлбрейк, позволявший модели находить уязвимости в коде и писать эксплойты; экспортные ограничения США сняли 30 июня, и Anthropic обучила новый классификатор безопасности, блокирующий этот конкретный приём больше чем в 99% случаев (CNBC).
У Google релиз идёт не так гладко. Gemini 3.5 Pro анонсировали ещё на I/O 19 мая с прицелом на июньский общий доступ, но окно пропустили: разработчики жаловались на нехватку токен-эффективности и качество кода не флагманского уровня, а Google затеяла архитектуру с нуля вместо доработки Gemini 2.5 Pro. На момент этой публикации модель всё ещё в preview, а новая цель — 17 июля (TechTimes). Пока Google доводит 3.5 Pro, действующий флагман линейки — Gemini 3.1 Pro — уже показывает 94,3% на GPQA Diamond (тест уровня аспирантуры по химии, биологии и физике, где случайный неспециалист набирает около 34%) и 44,4% без инструментов на Humanity's Last Exam, обгоняя по этому показателю Claude Opus 4.6 и GPT-5.2 (SmartChunks).
xAI пока держит Grok 4.5 в закрытой бете: 28 июня Илон Маск объявил, что модель тестируют внутри SpaceX и Tesla, без публичного доступа и без единого независимого бенчмарка. В основе — фундаментальная модель V9 на 1,5 трлн параметров, это примерно втрое больше архитектуры v8-small, которая сейчас работает в публичном Grok (DigitalApplied). Подробный разбор возможностей и позиционирования модели — в статье Grok 4.5.
Показательнее всего сдвиг виден не в самих моделях, а в том, что вокруг них строят. На том же I/O Google показала Gemini Spark — первого агента, который работает круглосуточно на облачных серверах Google, а не только пока открыта вкладка: следит за почтой, ведёт календарь, выполняет многошаговые задачи в фоне (TechCrunch). У Anthropic похожую роль на десктопе играет Claude Cowork — агент, который сам планирует работу, разбивает её на подзадачи и доводит до результата; в июле его расширили на веб и мобильные устройства, и по данным Anthropic меньше 10% сессий Cowork приходится на разработку — большую часть занимают бизнес-операции и контент (TechCrunch). Похожую логику — агент, который не бросает задачу на середине, — мы разбирали в статье про персистентных ИИ-агентов, а общий разворот индустрии от чат-ботов к самостоятельно действующим агентам — в материале «От чата к агентам».
Строже: правила доступа и маркировки закручиваются
Пока модели становятся способнее, регуляторы закручивают правила вокруг того, что они производят, и вокруг того, кто получает к ним доступ в первую очередь.
В Евросоюзе Еврокомиссия опубликовала финальный Code of Practice — свод практических правил маркировки ИИ-контента. С 2 августа 2026 года вступают в силу требования прозрачности из AI Act: дипфейки и созданный или изменённный ИИ текст на общественно значимые темы должны быть промаркированы в машиночитаемом формате — так, чтобы маркировку можно было распознать автоматически, а не только прочитать глазами (European Commission).
В России 8 июля 2026 года Госдума приняла закон о маркировке контента, созданного с помощью крупных фундаментальных ИИ-моделей — речь идёт про аудио и видео (vz.ru). В отличие от европейского подхода, для авторов маркировка добровольная: человек сам решает, ставить ли предупреждение на свой материал. Обязанность здесь ложится на другую сторону — владельцы крупных интернет-ресурсов должны обеспечить техническую возможность такой маркировки. Обязательный контроль за соцсетями и маркетплейсами из итоговой версии закона убрали: по признанию самих разработчиков, надёжных и недорогих инструментов для автоматического выявления генеративного контента пока просто нет (РИА Новости). Что это значит для пользователей и бизнеса на практике — подробно разобрано в материале «Регулирование ИИ и маркировка нейроконтента в России в 2026».
Ужесточается и доступ к самим моделям, а не только к контенту. GPT-5.6 — характерный пример: превью открыли не всем желающим, а узкому кругу партнёров, прошедших государственную проверку ещё до релиза. Разработчикам самых мощных моделей всё чаще приходится согласовывать выход с регуляторами раньше, чем модель доходит до широкой публики.
Дороже: инфраструктура и цены на топ-модели растут
Третий тренд — деньги. Растёт и то, что стоит за кулисами (капитальные расходы на дата-центры), и то, что видит пользователь напрямую (цена доступа к топовым моделям).
Amazon, Microsoft, Google и Meta в сумме потратят на ИИ-инфраструктуру около 410 млрд годом раньше. Это рост на 77% за один год. Часть роста объясняется подорожавшей памятью и накопителями: серверные комплектующие заметно прибавили в цене за последние кварталы. При этом больше 60% capex у крупных облачных провайдеров уходит не в сами чипы, а в энергетику, охлаждение и строительство дата-центров — узким местом всё чаще становится не производство GPU, а доступная электроэнергия (Dell'Oro Group; ValueAddVC).

Рост капитальных расходов постепенно транслируется и в цену доступа к самим моделям — по крайней мере в топовом сегменте. Anthropic уже объявила: вводная цена Claude Sonnet 5 — 10 за миллион выходных токенов — действует только до 31 августа 2026 года. С 1 сентября цена станет стандартной: 15 соответственно, то есть подорожает сразу на 50% (EdenAI).

У GPT-5.6 схема другая: три уровня по разной цене. Sol, самая мощная модель линейки, стоит 30 за миллион выходных токенов, Terra — 15, а Luna, самый бюджетный вариант, — 6 (DataCamp). Разница между самым дорогим и самым дешёвым уровнем — впятеро, и это осознанный выбор OpenAI: не тянуть всех пользователей в дорогой тариф, а дать выбрать уровень под задачу — подробнее в разборе GPT-5.6.
Стоит различать две вещи. Розничные цены для конечных пользователей в массовом сегменте конкуренция пока сдерживает: на рынке хватает новых мощностей, и разработчики соревнуются за клиентов. А вот в топовом сегменте, где нужна максимальная мощность модели, цена растёт вместе с расходами на её создание и обслуживание, и повышение тарифа Claude Sonnet 5 в сентябре вряд ли останется единственным примером в этом году.
Как быть, если каждая нейросеть — отдельная подписка
За тремя перечисленными трендами стоит один практический вопрос: если самые мощные модели дорожают, а каждая приходит со своим сайтом, своей подпиской и часто со своими ограничениями по доступу из России — что делать тому, кто просто хочет решить рабочую задачу?
Держать в закладках десяток вкладок с разными нейросетями и оплачивать каждую отдельной иностранной картой — не обязательно. Veruna AI собирает 100+ нейросетей, включая ChatGPT, Claude, Gemini, DeepSeek, Grok и десятки других, в одном чате. Сервис работает без VPN, оплата — в рублях, российский эквайринг, а начать можно бесплатно: гостевой чат открыт сразу, часть токенов дают за регистрацию. Мы уже разбирали, зачем в 2026 году вообще нужна такая единая точка входа, — в статье «Один ИИ вместо десяти вкладок».
Спросите Veruna AI прямо сейчас, какая модель лучше подойдёт под вашу задачу: ассистент поможет сориентироваться среди новых релизов, не заставляя разбираться в каждом тарифе по отдельности.
Кому и зачем это важно уже сейчас
Бизнесу — прежде чем платить за подписку на конкретную модель, стоит сравнить, как несколько нейросетей справляются с одной и той же рабочей задачей, не оформляя для этого пять разных аккаунтов и не привязывая пять карт.
Авторам контента — с ужесточением правил маркировки лучше заранее решить, как помечать материалы, сделанные или доработанные нейросетью, особенно если вы публикуете на площадках с большой аудиторией: в ЕС на это уже есть жёсткий срок.
Для разработчиков и технических команд выбор между дорогим топовым тарифом и бюджетным уровнем той же линейки моделей (как Sol, Terra и Luna у GPT-5.6) теперь напрямую влияет на бюджет проекта. Закладывать это в архитектуру стоит заранее, а не после первого счёта за API.
Частые вопросы
Подорожают ли нейросети для обычных пользователей в России? Заметнее всего рост цен пока идёт в топовом сегменте — у самых мощных версий моделей вроде Claude Sonnet 5 или Sol в линейке GPT-5.6. Для массовых сценариев конкуренция между разработчиками пока сдерживает розничные цены. Актуальные условия доступа к моделям в России — на сайте Veruna AI.
Обязательно ли теперь маркировать ИИ-контент? В России — пока нет: закон, принятый 8 июля 2026 года, оставляет маркировку добровольной для авторов, обязательный контроль для соцсетей и маркетплейсов из итоговой версии убрали. В ЕС требования жёстче: с 2 августа 2026 года дипфейки и ИИ-текст на общественно значимые темы должны маркироваться в машиночитаемом формате.
Какая нейросеть сейчас самая мощная? Однозначного лидера нет — у каждой модели своя сильная сторона: GPT-5.6 Sol заметно выделяется в кодинге и агентных задачах, Claude Sonnet 5 обошла даже более мощную Opus 4.8 на бенчмарке профессионального письма GDPval-AA, а Gemini 3.1 Pro лидирует в научных бенчмарках вроде GPQA Diamond. Проще всего — сравнить модели напрямую на своей задаче.
Как попробовать топовые модели, не оформляя кучу подписок? Через агрегатор вроде Veruna AI: там уже собраны десятки нейросетей в одном чате, оплата в рублях и без VPN, а начать можно бесплатно.
