ИИ-компании xAI, Anthropic, OpenAI и Moonshot AI выпустят 4 модели Frontier Models в июле (July)

Key Takeaways
  • xAI, Anthropic, OpenAI и Moonshot AI каждая выпустили в июле 2026 фронтирные модели ИИ, ориентированные на выполнение задач в течение нескольких часов.
  • Grok 4.5 стоит $2 за вход и $6 за выход на миллион токенов — это более чем на 60% ниже, чем у Claude Opus 4.8 и GPT-5.5.
  • Moonshot AI пообещала опубликовать Kimi K3 с полностью открытыми весами к 27 июля после релиза модели с 2,8 трлн параметров 16 июля.

xAI, Anthropic, OpenAI и Moonshot AI выпустили четыре флагманские модели ИИ в течение трех недель в июле 2026 года. xAI выпустила Grok 4.5 8 июля, Anthropic выпустила Claude Opus 5 24 июля, OpenAI перевела GPT-5.6 в общедоступность 9 июля, а Moonshot AI опубликовала Kimi K3 16 июля. Каждая модель ориентирована на выполнение задач в течение многих часов — от исследования до кодинга и структурированной отчётности — без потери плана выполнения. Все четыре поддерживают контекстные окна от 500 000 токенов и более: три достигают 1 миллиона токенов, что позволяет за одну сессию обработать целые репозитории кода или подборки документов.

xAI выпускает Grok 4.5 с данными обучения Cursor

xAI выпустила Grok 4.5 8 июля. Модель работает на базе с 1,5 триллиона параметров и была обучена, в том числе, на реальных данных использования из Cursor — платформы для разработки, которую SpaceXAI приобрела ранее в этом году. Стоимость: $2 за миллион входных токенов и $6 за миллион выходных токенов при контекстном окне 500 000 токенов. Илон Маск назвал Grok 4.5 моделью уровня Opus-class model, которая работает быстрее и стоит дешевле. Независимые трекеры ставят её на четвертое место в Artificial Analysis Intelligence Index — впереди каждой модели с открытыми весами — при этом цена более чем на 60% ниже, чем у Claude Opus 4.8 и GPT-5.5. На Terminal-Bench 2.1, тесте, оценивающем, насколько хорошо модель выполняет задачи инженерии через командную строку, Grok 4.5 набрала 83,3%. xAI утверждает, что модели нужно примерно пятая часть выходных токенов, которые Opus 4.8 требовались для сопоставимых задач.

Elon X post screenshot.

OpenAI выводит GPT-5.6 в структуру из трех ценовых уровней

OpenAI перевела GPT-5.6 в общедоступность 9 июля после двухнедельного превью, ограниченного примерно 20 организациями, проверенными U.S. government, — после президентского указа, связанного с оценкой безопасности флагманских моделей. Линейка поставляется в виде трех уровней: Sol — флагман, по $5 за вход и $30 за выход за миллион токенов; Terra — средний уровень за $2,50 и $15, при этом OpenAI заявляет, что он соответствует GPT-5.5 за половину цены; и Luna — быстрый и бюджетный уровень за $1 и $6. OpenAI сообщает, что Sol лидирует в Artificial Analysis Coding Agent Index и набирает 88,8% на Terminal-Bench 2.1, поднимаясь до 91,9%, когда модель запускает четыре суб-агента параллельно в рамках нового ultra mode. Все три уровня несут самый высокий внутренний риск-рейтинг OpenAI за возможность злоупотреблений в кибер- и биологической сфере.

OpenAI X post screenshot.

Anthropic выпускает Claude Opus 5 как модель по умолчанию с максимумом

Anthropic выпустила Claude Opus 5 24 июля, позиционировав её как модель, которая почти достигает производительности Claude Fable 5 при половине цен на Fable — $10 за вход и $50 за выход. Opus 5 сохраняет те же расценки $5 за вход и $25 за выход, что и её предшественница Opus 4.8. Модель поставляется с контекстным окном 1 миллион токенов, максимумом 128 000 выходных токенов и настраиваемой степенью усилий в рассуждениях — от low до нового режима xhigh mode. Anthropic заявляет, что Opus 5 ставит новые рекорды на Frontier-Bench и GDPval-AA — двух оценках кодинга и интеллектуальной работы, — хотя уступает ограниченной модели Claude Mythos 5 в задачах по кибербезопасности. Теперь Opus 5 — модель по умолчанию в Claude Max и самый сильный вариант в Claude Pro.

Claude X post screenshot.

Moonshot AI публикует Kimi K3 как крупнейшую модель с открытыми весами

Moonshot AI выпустила Kimi K3 16 июля — смесь экспертов на 2,8 триллиона параметров с 896 экспертами всего и 16 активными на задачу. Модель поддерживает контекстное окно 1 миллион токенов и нативный мультимодальный ввод, а цена через API составляет $3 за вход и $15 за выход за миллион токенов. Moonshot обязалась опубликовать полные открытые веса к 27 июля. K3 — крупнейшая из выпущенных на сегодняшний день моделей с открытыми весами: примерно на 75% больше, чем предыдущая крупнейшая широко используемая открытая модель. Независимые трекеры ставят K3 четвертой среди текущих флагманских систем — после Claude Fable 5 и GPT-5.6 Sol — но впереди Claude Opus 4.8.

Kimi Moonshot X post screenshot.

Расширенные контекстные окна позволяют обрабатывать полный репозиторий

Контекстные окна ниже 200 000 токенов раньше заставляли разработчиков дробить большие кодовые базы или исследовательские пакеты на фрагменты. Теперь каждая модель из этой группы работает на 500 000 токенов или более: три из четырех достигают 1 миллиона, позволяя одной сессии хранить в памяти полный репозиторий или пачку первичных исходных документов. Системы периода 2023 и 2024 годов часто теряли план после нескольких вызовов инструментов. Модели, выпущенные в этом месяце, созданы, чтобы удерживать десятки согласованных шагов и восстанавливаться, если вызов инструмента возвращает ошибочные данные, вместо того чтобы зависать. Контроль усилий в Opus 5, многоуровневая цена в GPT-5.6 и заявления об эффективности за Grok 4.5 указывают на одну и ту же цель: позволить командам выбирать, сколько вычислений заслуживает задача, вместо того чтобы платить флагманские цены за каждый запрос. Пересмотренный с ограничением правительства выпуск GPT-5.6 показывает, что надзор теперь встроен в расписания релиза для крупнейших моделей. Краткая приостановка доступа к Fable и Mythos в June — по указанию правительства — была более ранней версией того же паттерна.

FAQ

Что общего у четырех AI-моделей, выпущенных в июле 2026 года?

Grok 4.5, Claude Opus 5, GPT-5.6 и Kimi K3 все нацелены на выполнение задач в течение многих часов — от исследования до кодинга и структурированной отчётности — без потери плана выполнения. Каждая модель имеет контекстное окно минимум 500 000 токенов, при этом три достигают 1 миллиона токенов, что позволяет за одну сессию обрабатывать целые репозитории кода или коллекции документов без фрагментации.

Почему OpenAI выпустила GPT-5.6 через превью с ограничением U.S. government?

OpenAI перевела GPT-5.6 в общедоступность 9 июля после двухнедельного превью, ограниченного примерно 20 организациями, проверенными U.S. government, — после президентского указа, связанного с обзором безопасности флагманских моделей. Все три ценовых уровня GPT-5.6 несут самый высокий внутренний риск-рейтинг OpenAI за возможность злоупотреблений в кибер- и биологической сфере, что и стало причиной дополнительной проверки.

Как сравнивается цена Grok 4.5 с Claude Opus 4.8?

Grok 4.5 стоит $2 за миллион входных токенов и $6 за миллион выходных токенов — более чем на 60% дешевле, чем Claude Opus 4.8 и GPT-5.5. xAI говорит, что модели требуется примерно пятая часть выходных токенов, которые Opus 4.8 требовались для сопоставимых задач, что снижает стоимость запуска долгих агентских сессий.

Дисклеймер: Информация на этой странице может быть получена из источников третьих сторон и предоставляется только для ознакомления. Она не отражает взгляды или мнения Gate и не является финансовой, инвестиционной или юридической рекомендацией. Торговля виртуальными активами связана с высоким риском. Пожалуйста, не основывайте свои решения исключительно на данных этой страницы. Подробнее смотрите в Дисклеймере.
комментарий
0/400
Нет комментариев