Grok 4.3 и Grok 4.5: что изменилось и какую модель выбрать
Обзоры нейросетей

Grok 4.3 и Grok 4.5: что изменилось и какую модель выбрать

2 августа 2026 г.
~2840 слов
Grok 4.3 и Grok 4.5: что изменилось и какую модель выбрать — обложка статьи
Коротко: берите Grok 4.5 для кода, агентных сценариев и обычных рабочих задач — он умнее и тратит в разы меньше токенов. Берите Grok 4.3, когда нужно загрузить очень длинный документ: у него контекстное окно вдвое больше, 1 миллион токенов против 500 тысяч. Да, у более новой версии окно меньше — это не опечатка. Обе модели доступны в Нейрочате без VPN, с оплатой картой российского банка и вместе с ChatGPT, Claude, DeepSeek и Gemini в одном окне: neirochat.io
Разбираем что реально изменилось между версиями Grok 4.3 и Grok 4.5, где новая модель действительно лучше, где заголовки про «обошёл Opus» расходятся с цифрами, и для каких задач подходит.
500K
контекст Grok 4.5
1 млн
контекст Grok 4.3
4-е
место в индексе Artificial Analysis
4,2×
экономия токенов на задачу

Какую версию выбрать под задачу

Если нужен только ответ, вот он в виде таблицы. Всё остальное в статье — обоснование.

Задача Модель Почему
Написать или починить код Grok 4.5 Модель обучалась вместе с командой Cursor и заточена именно под инженерные задачи
Длинная цепочка действий с инструментами Grok 4.5 Тратит в разы меньше токенов на ту же задачу — длинные сессии выходят дешевле
Разбор документа на 300+ страниц Grok 4.3 Окно в 1 миллион токенов против 500 тысяч, документ поместится целиком
Анализ большой переписки или базы кода Grok 4.3 Тот же аргумент: важнее вместить всё сразу, чем выиграть пару пунктов в тестах
Ресёрч, письмо, разбор документов Grok 4.5 Компания отдельно позиционирует его под офисные сценарии
Задачи с изображениями Любая Обе принимают картинки на вход, разница здесь не принципиальна
💡 Универсальное правило для линейки Grok перестало работать. Раньше можно было просто брать версию с большим номером. Теперь у 4.5 и 4.3 разные сильные стороны, и выбор зависит от того, что для вас критичнее — качество рассуждения или объём, который влезает за раз.

Главный подвох: у новой модели окно меньше

Это первое, что стоит знать, и именно этого не говорят заголовки.

Контекстное окно Grok 4.5 — 500 000 токенов. Это примерно 350 страниц текста, очень много по обычным меркам. Но у Grok 4.3 окно вдвое больше — 1 миллион токенов. То есть переход на свежую версию для кого-то будет понижением, а не апгрейдом.

Есть и вторая деталь, которая в обзорах почти не всплывает. В документации xAI отдельно предупреждает: запросы длиннее 200 000 токенов тарифицируются по повышенной ставке. Для длинных агентных циклов этот порог важнее, чем заявленный максимум окна — по нему считается счёт.

Практический вывод простой. Если ваша работа — это разбор гигантских документов, кодовых баз или многомесячной переписки, версия 4.3 остаётся рабочим инструментом и не считается устаревшей. Если вы пишете код или гоняете агента по цепочке шагов, переходите на 4.5.

Grok 4.5: что это за модель

Grok 4.5 вышел 8 июля 2026 года. Компания описывает его как самую способную свою модель, созданную под три сценария: программирование, агентные задачи и работу со знаниями — под последним понимаются офисные вещи вроде ресёрча, письма и разбора документов.

Grok 4.3 и Grok 4.5: что изменилось и какую модель выбрать — иллюстрация раздела
ПараметрЗначение
Дата выхода8 июля 2026
Контекстное окно500 000 токенов (~350 страниц)
Порог повышенной ценысвыше 200 000 токенов
Цена в API2 доллара за миллион входящих, 6 за миллион исходящих
Кешированный ввод0,5 доллара за миллион токенов
Скорость80 токенов в секунду по данным компании, 91,3 по независимому замеру Artificial Analysis
Входтекст и изображения
Рассуждениетри уровня, по умолчанию максимальный, отключить нельзя
Инструментывызов функций, поиск в интернете, поиск по X, исполнение кода

Экономия токенов — главный аргумент модели

Самое интересное в релизе не бенчмарки, а расход токенов. По собственным замерам xAI на тесте SWE Bench Pro модель тратит в среднем около 16 тысяч исходящих токенов на задачу против примерно 67 тысяч у Claude Opus 4.8 в максимальном режиме — разница в 4,2 раза.

К цифрам от самого производителя всегда стоит относиться сдержанно, но здесь независимая проверка идёт в ту же сторону: Artificial Analysis намерила около 14 тысяч исходящих токенов на задачу своего индекса, больше чем на 60% меньше, чем у Opus 4.8.

Для обычного пользователя чата это переводится так: ответы короче и по делу, без длинных рассуждений вслух, и ждать приходится меньше. Для тех, кто платит за API, — счёт за длинные агентные сессии выходит заметно ниже.

Обучение вместе с Cursor

Компания указывает, что модель обучалась совместно с командой Cursor — популярного редактора кода с искусственным интеллектом, который SpaceX приобрела незадолго до релиза. Отсюда и заточка под инженерные задачи. Это же объясняет, почему модель заметно сильнее в коде, чем в свободном разговоре.

⚠️ Про параметры и архитектуру. В прессе разошлись цифры про 1,5 триллиона параметров и новую архитектуру V9. Это слова Илона Маска из его постов, а не официальные данные: ни в релизном материале, ни в документации размер модели не публикуется, и Artificial Analysis прямо отмечает, что компания его не раскрывала. Считать это подтверждённым фактом не стоит.

Grok 4.3: чем остаётся полезна

Grok 4.3 вышел в конце апреля 2026 года и позиционировался как флагман с упором на агентные возможности, низкий процент выдумок и выгодное соотношение цены и качества.

ПараметрЗначение
Дата выходаконец апреля 2026
Контекстное окно1 000 000 токенов
Цена в API1,25 доллара за миллион входящих, 2,5 за миллион исходящих
Сильные сторонысверхдлинный контекст, следование инструкциям, цена

Списывать её со счетов рано по двум причинам. Первая — окно в миллион токенов, которое у преемника урезано вдвое. Вторая — цена: 4.3 примерно вдвое дешевле по входящим токенам и почти в два с половиной раза по исходящим. Для задач, где не нужен максимум интеллекта, это ощутимая разница.

Разрыв в качестве при этом реальный: по независимому индексу Artificial Analysis переход от 4.3 к 4.5 дал прирост в 16 пунктов. Это много — редко когда версия внутри одного поколения прибавляет столько.

Бенчмарки без преувеличений

Здесь важно отделить три разные вещи: заявления компании, независимые замеры и высказывания Илона Маска в соцсетях. В пересказах они обычно смешиваются в одно.

В релизном материале xAI опубликовала четыре сравнения с Claude Opus 4.8. Счёт получился ровно 2:2: Grok 4.5 впереди в тестах DeepSWE 1.0 и Terminal Bench 2.1, уступает в DeepSWE 1.1 и SWE Bench Pro.

Тест Grok 4.5 Opus 4.8 GPT-5.5 Fable 5
DeepSWE 1.0 (на стендах самих разработчиков)62,0%55,75%64,31%66,1%
DeepSWE 1.1 (нейтральный стенд)53%59%67%70%
Terminal Bench 2.183,3%78,9%83,4%84,3%
SWE Bench Pro64,7%69,2%58,6%80,4%

Обратите внимание на первые две строки — это один и тот же тест, но в разных условиях. В версии 1.0 каждая компания прогоняла модель на своём стенде, в версии 1.1 замер делала независимая сторона. И картина переворачивается: там, где на своём стенде Grok опережает Opus, на нейтральном уступает. Это хороший урок про то, как читать любые релизные таблицы.

Отдельно стоит отметить честность самой компании: в свою же таблицу xAI включила Claude Fable 5, который лидирует во всех четырёх строках. Прятать неудобное сравнение было бы проще, и то, что этого не сделали, говорит в пользу материалов.

Независимая оценка

По индексу Artificial Analysis, который считает общий уровень модели, Grok 4.5 набирает 54 балла и занимает четвёртое место. Впереди: Fable 5 с 60 баллами, Opus 4.8 с 56 и GPT-5.5 с 55.

Это отличный результат, но не первое место. Формулировка Маска «модель класса Opus, только быстрее, экономнее по токенам и дешевле» цифрам соответствует. Заголовки в духе «новый Grok обошёл Opus» — уже нет. В своём же посте Маск сравнивал модель с Opus 4.7, а не с более новой 4.8.

Честный вывод по бенчмаркам: Grok 4.5 — не новый абсолютный лидер, а очень выгодное соотношение интеллекта к стоимости. Если нужен максимум качества на сложном коде, цифры отправляют к Fable 5 или Opus 4.8. Если у вас много однотипных задач с инструментами и важна цена — Grok 4.5 стоит протестировать на своих задачах.

Grok против ChatGPT, Claude и Gemini

Сравнивать модели в вакууме бесполезно — разница по общим индексам в один-два балла ничего не говорит о вашей конкретной задаче. Полезнее смотреть, кто под что заточен.

Модель Сильная сторона Когда выбирать
Grok 4.5 Экономия токенов, код, агентные цепочки Много однотипных задач, длинные сессии с инструментами
Grok 4.3 Контекст в 1 миллион токенов, низкая цена Очень длинные документы и переписки
Claude Длинные тексты, аккуратность в рассуждении, работа с документами Аналитика, редактура, сложные текстовые задачи
ChatGPT Универсальность, изображения, широкая экосистема Смешанные задачи, когда нужно всё в одном
Gemini Мультимодальность, работа с видео Задачи с разными типами медиа
DeepSeek Цена при достойном качестве Большие объёмы рутины

Универсально лучшей модели нет, и это не отговорка. Разница между четвёркой лидеров по общим индексам сейчас — единицы баллов, то есть в пределах того, что вы всё равно не заметите на своей задаче. А вот разница в поведении на конкретном типе работы бывает разительной. Самый надёжный способ выбрать — взять свою типовую задачу и прогнать через несколько моделей подряд. Если интересна общая картина по текстовым моделям, есть отдельный разбор.

5 замечаний из практики

1. Рассуждение отключить нельзя

У Grok 4.5 три уровня, по умолчанию максимальный. На простых задачах это может быть избыточно — модель думает дольше, чем требуется.

2. Ответы короче, чем у конкурентов

Это следствие экономии токенов. Если нужен развёрнутый разбор, просите его явно — по умолчанию модель отвечает сжато.

3. Не путайте номера версий

В линейке Grok есть промежуточные выпуски с разными окнами и ценами. Проверяйте характеристики конкретной версии, а не порядок номеров.

4. Компания сменила имя

xAI вошла в состав SpaceX, и в свежих материалах встречается название SpaceXAI. Речь об одной и той же компании и той же линейке моделей.

5. Проверяйте цифры и факты

Модель ищет в интернете и в X, но это не отменяет проверки: свежесть источника не гарантирует его достоверность.

6. Сравнивайте на своей задаче

Один и тот же запрос в двух моделях за две минуты скажет больше, чем любые бенчмарки из релизных материалов.

Как пользоваться из России

Прямой доступ к сервисам xAI из России требует зарубежной карты и обхода региональных ограничений — модель, кстати, на старте была недоступна и в Евросоюзе. Это отдельная возня, которая к самой работе с нейросетью отношения не имеет.

Grok 4.3 и Grok 4.5: что изменилось и какую модель выбрать — иллюстрация раздела

В Нейрочате Grok 4.3 и Grok 4.5 подключены наравне с остальными моделями: русский интерфейс, оплата картой российского банка, без VPN и зарубежных карт. Главное удобство не в самом доступе, а в том, что рядом в одном окне лежат ChatGPT, Claude, DeepSeek и Gemini — ту же задачу можно переспросить у другой модели, не заводя новый аккаунт и не загружая файл заново.

Итог: Grok 4.5 — лучший выбор для кода, агентных сценариев и повседневной работы: он умнее предшественника на заметную величину и тратит в разы меньше токенов. Grok 4.3 остаётся нужен там, где важен объём: миллион токенов контекста против 500 тысяч и цена почти вдвое ниже. Обе модели доступны в Нейрочате без VPN и с оплатой российской картой, вместе с ChatGPT, Claude, DeepSeek и Gemini в одном окне.

Попробуйте Grok 4.5 прямо сейчас

В Нейрочате собраны все лучшие нейросети — Grok, ChatGPT, Claude, DeepSeek, Gemini — без VPN и сложных настроек.

▶ Попробовать бесплатно

Часто задаваемые вопросы

Чем Grok 4.5 отличается от Grok 4.3?

Grok 4.5 вышел 8 июля 2026 года и заточен под код, агентные сценарии и работу с документами. Он умнее по независимым замерам и тратит заметно меньше токенов на ту же задачу. Но контекстное окно у него меньше — 500 000 токенов против 1 миллиона у Grok 4.3, и стоит он дороже: 2 и 6 долларов за миллион токенов против 1,25 и 2,5 у версии 4.3. Поэтому для очень длинных документов старшая по номеру версия не всегда лучше.

Правда ли, что Grok 4.5 обошёл Claude Opus?

Не полностью. В собственной таблице xAI из четырёх тестов Grok 4.5 опережает Opus 4.8 в двух и уступает в двух. При этом во всех четырёх тестах впереди Claude Fable 5, и компания не стала убирать это сравнение из релизных материалов. По независимому индексу Artificial Analysis Grok 4.5 занимает четвёртое место с результатом 54, уступая Fable 5, Opus 4.8 и GPT-5.5. Формулировка «модель класса Opus» корректна, «обошёл Opus» — преувеличение.

Какой контекст у Grok 4.5?

500 000 токенов — это примерно 350 страниц текста. Важная деталь: запросы длиннее 200 000 токенов тарифицируются по повышенной ставке, о чём xAI предупреждает в документации. У предыдущей версии Grok 4.3 окно вдвое больше — 1 миллион токенов.

Как пользоваться Grok в России?

Самый простой способ — через Нейрочат: русский интерфейс, оплата картой российского банка, без VPN и зарубежных карт. Grok 4.3 и Grok 4.5 доступны там вместе с ChatGPT, Claude, DeepSeek и Gemini в одном окне, так что одну и ту же задачу можно прогнать через несколько моделей и сравнить ответы.

Grok 4.5 лучше ChatGPT?

По общему индексу Artificial Analysis GPT-5.5 немного впереди: 55 против 54 у Grok 4.5. Разница в пределах погрешности, поэтому выбирать стоит по задаче, а не по рейтингу. Grok сильнее там, где важна экономия токенов в длинных агентных сценариях, ChatGPT — в универсальных задачах и работе с изображениями. Надёжнее всего прогнать свою типовую задачу через обе модели и сравнить.

Читайте также

Готовы попробовать?

Доступ к 50+ нейросетям — ChatGPT, Claude, DeepSeek, Gemini, FLUX — без VPN и без регистрации

Попробовать бесплатно в Нейрочат