Какую версию выбрать под задачу
Если нужен только ответ, вот он в виде таблицы. Всё остальное в статье — обоснование.
| Задача | Модель | Почему |
|---|---|---|
| Написать или починить код | Grok 4.5 | Модель обучалась вместе с командой Cursor и заточена именно под инженерные задачи |
| Длинная цепочка действий с инструментами | Grok 4.5 | Тратит в разы меньше токенов на ту же задачу — длинные сессии выходят дешевле |
| Разбор документа на 300+ страниц | Grok 4.3 | Окно в 1 миллион токенов против 500 тысяч, документ поместится целиком |
| Анализ большой переписки или базы кода | Grok 4.3 | Тот же аргумент: важнее вместить всё сразу, чем выиграть пару пунктов в тестах |
| Ресёрч, письмо, разбор документов | Grok 4.5 | Компания отдельно позиционирует его под офисные сценарии |
| Задачи с изображениями | Любая | Обе принимают картинки на вход, разница здесь не принципиальна |
Главный подвох: у новой модели окно меньше
Это первое, что стоит знать, и именно этого не говорят заголовки.
Контекстное окно Grok 4.5 — 500 000 токенов. Это примерно 350 страниц текста, очень много по обычным меркам. Но у Grok 4.3 окно вдвое больше — 1 миллион токенов. То есть переход на свежую версию для кого-то будет понижением, а не апгрейдом.
Есть и вторая деталь, которая в обзорах почти не всплывает. В документации xAI отдельно предупреждает: запросы длиннее 200 000 токенов тарифицируются по повышенной ставке. Для длинных агентных циклов этот порог важнее, чем заявленный максимум окна — по нему считается счёт.
Практический вывод простой. Если ваша работа — это разбор гигантских документов, кодовых баз или многомесячной переписки, версия 4.3 остаётся рабочим инструментом и не считается устаревшей. Если вы пишете код или гоняете агента по цепочке шагов, переходите на 4.5.
Grok 4.5: что это за модель
Grok 4.5 вышел 8 июля 2026 года. Компания описывает его как самую способную свою модель, созданную под три сценария: программирование, агентные задачи и работу со знаниями — под последним понимаются офисные вещи вроде ресёрча, письма и разбора документов.
| Параметр | Значение |
|---|---|
| Дата выхода | 8 июля 2026 |
| Контекстное окно | 500 000 токенов (~350 страниц) |
| Порог повышенной цены | свыше 200 000 токенов |
| Цена в API | 2 доллара за миллион входящих, 6 за миллион исходящих |
| Кешированный ввод | 0,5 доллара за миллион токенов |
| Скорость | 80 токенов в секунду по данным компании, 91,3 по независимому замеру Artificial Analysis |
| Вход | текст и изображения |
| Рассуждение | три уровня, по умолчанию максимальный, отключить нельзя |
| Инструменты | вызов функций, поиск в интернете, поиск по X, исполнение кода |
Экономия токенов — главный аргумент модели
Самое интересное в релизе не бенчмарки, а расход токенов. По собственным замерам xAI на тесте SWE Bench Pro модель тратит в среднем около 16 тысяч исходящих токенов на задачу против примерно 67 тысяч у Claude Opus 4.8 в максимальном режиме — разница в 4,2 раза.
К цифрам от самого производителя всегда стоит относиться сдержанно, но здесь независимая проверка идёт в ту же сторону: Artificial Analysis намерила около 14 тысяч исходящих токенов на задачу своего индекса, больше чем на 60% меньше, чем у Opus 4.8.
Для обычного пользователя чата это переводится так: ответы короче и по делу, без длинных рассуждений вслух, и ждать приходится меньше. Для тех, кто платит за API, — счёт за длинные агентные сессии выходит заметно ниже.
Обучение вместе с Cursor
Компания указывает, что модель обучалась совместно с командой Cursor — популярного редактора кода с искусственным интеллектом, который SpaceX приобрела незадолго до релиза. Отсюда и заточка под инженерные задачи. Это же объясняет, почему модель заметно сильнее в коде, чем в свободном разговоре.
Grok 4.3: чем остаётся полезна
Grok 4.3 вышел в конце апреля 2026 года и позиционировался как флагман с упором на агентные возможности, низкий процент выдумок и выгодное соотношение цены и качества.
| Параметр | Значение |
|---|---|
| Дата выхода | конец апреля 2026 |
| Контекстное окно | 1 000 000 токенов |
| Цена в API | 1,25 доллара за миллион входящих, 2,5 за миллион исходящих |
| Сильные стороны | сверхдлинный контекст, следование инструкциям, цена |
Списывать её со счетов рано по двум причинам. Первая — окно в миллион токенов, которое у преемника урезано вдвое. Вторая — цена: 4.3 примерно вдвое дешевле по входящим токенам и почти в два с половиной раза по исходящим. Для задач, где не нужен максимум интеллекта, это ощутимая разница.
Разрыв в качестве при этом реальный: по независимому индексу Artificial Analysis переход от 4.3 к 4.5 дал прирост в 16 пунктов. Это много — редко когда версия внутри одного поколения прибавляет столько.
Бенчмарки без преувеличений
Здесь важно отделить три разные вещи: заявления компании, независимые замеры и высказывания Илона Маска в соцсетях. В пересказах они обычно смешиваются в одно.
В релизном материале xAI опубликовала четыре сравнения с Claude Opus 4.8. Счёт получился ровно 2:2: Grok 4.5 впереди в тестах DeepSWE 1.0 и Terminal Bench 2.1, уступает в DeepSWE 1.1 и SWE Bench Pro.
| Тест | Grok 4.5 | Opus 4.8 | GPT-5.5 | Fable 5 |
|---|---|---|---|---|
| DeepSWE 1.0 (на стендах самих разработчиков) | 62,0% | 55,75% | 64,31% | 66,1% |
| DeepSWE 1.1 (нейтральный стенд) | 53% | 59% | 67% | 70% |
| Terminal Bench 2.1 | 83,3% | 78,9% | 83,4% | 84,3% |
| SWE Bench Pro | 64,7% | 69,2% | 58,6% | 80,4% |
Обратите внимание на первые две строки — это один и тот же тест, но в разных условиях. В версии 1.0 каждая компания прогоняла модель на своём стенде, в версии 1.1 замер делала независимая сторона. И картина переворачивается: там, где на своём стенде Grok опережает Opus, на нейтральном уступает. Это хороший урок про то, как читать любые релизные таблицы.
Отдельно стоит отметить честность самой компании: в свою же таблицу xAI включила Claude Fable 5, который лидирует во всех четырёх строках. Прятать неудобное сравнение было бы проще, и то, что этого не сделали, говорит в пользу материалов.
Независимая оценка
По индексу Artificial Analysis, который считает общий уровень модели, Grok 4.5 набирает 54 балла и занимает четвёртое место. Впереди: Fable 5 с 60 баллами, Opus 4.8 с 56 и GPT-5.5 с 55.
Это отличный результат, но не первое место. Формулировка Маска «модель класса Opus, только быстрее, экономнее по токенам и дешевле» цифрам соответствует. Заголовки в духе «новый Grok обошёл Opus» — уже нет. В своём же посте Маск сравнивал модель с Opus 4.7, а не с более новой 4.8.
Grok против ChatGPT, Claude и Gemini
Сравнивать модели в вакууме бесполезно — разница по общим индексам в один-два балла ничего не говорит о вашей конкретной задаче. Полезнее смотреть, кто под что заточен.
| Модель | Сильная сторона | Когда выбирать |
|---|---|---|
| Grok 4.5 | Экономия токенов, код, агентные цепочки | Много однотипных задач, длинные сессии с инструментами |
| Grok 4.3 | Контекст в 1 миллион токенов, низкая цена | Очень длинные документы и переписки |
| Claude | Длинные тексты, аккуратность в рассуждении, работа с документами | Аналитика, редактура, сложные текстовые задачи |
| ChatGPT | Универсальность, изображения, широкая экосистема | Смешанные задачи, когда нужно всё в одном |
| Gemini | Мультимодальность, работа с видео | Задачи с разными типами медиа |
| DeepSeek | Цена при достойном качестве | Большие объёмы рутины |
Универсально лучшей модели нет, и это не отговорка. Разница между четвёркой лидеров по общим индексам сейчас — единицы баллов, то есть в пределах того, что вы всё равно не заметите на своей задаче. А вот разница в поведении на конкретном типе работы бывает разительной. Самый надёжный способ выбрать — взять свою типовую задачу и прогнать через несколько моделей подряд. Если интересна общая картина по текстовым моделям, есть отдельный разбор.
5 замечаний из практики
1. Рассуждение отключить нельзя
У Grok 4.5 три уровня, по умолчанию максимальный. На простых задачах это может быть избыточно — модель думает дольше, чем требуется.
2. Ответы короче, чем у конкурентов
Это следствие экономии токенов. Если нужен развёрнутый разбор, просите его явно — по умолчанию модель отвечает сжато.
3. Не путайте номера версий
В линейке Grok есть промежуточные выпуски с разными окнами и ценами. Проверяйте характеристики конкретной версии, а не порядок номеров.
4. Компания сменила имя
xAI вошла в состав SpaceX, и в свежих материалах встречается название SpaceXAI. Речь об одной и той же компании и той же линейке моделей.
5. Проверяйте цифры и факты
Модель ищет в интернете и в X, но это не отменяет проверки: свежесть источника не гарантирует его достоверность.
6. Сравнивайте на своей задаче
Один и тот же запрос в двух моделях за две минуты скажет больше, чем любые бенчмарки из релизных материалов.
Как пользоваться из России
Прямой доступ к сервисам xAI из России требует зарубежной карты и обхода региональных ограничений — модель, кстати, на старте была недоступна и в Евросоюзе. Это отдельная возня, которая к самой работе с нейросетью отношения не имеет.
В Нейрочате Grok 4.3 и Grok 4.5 подключены наравне с остальными моделями: русский интерфейс, оплата картой российского банка, без VPN и зарубежных карт. Главное удобство не в самом доступе, а в том, что рядом в одном окне лежат ChatGPT, Claude, DeepSeek и Gemini — ту же задачу можно переспросить у другой модели, не заводя новый аккаунт и не загружая файл заново.
Попробуйте Grok 4.5 прямо сейчас
В Нейрочате собраны все лучшие нейросети — Grok, ChatGPT, Claude, DeepSeek, Gemini — без VPN и сложных настроек.
▶ Попробовать бесплатноЧасто задаваемые вопросы
Grok 4.5 вышел 8 июля 2026 года и заточен под код, агентные сценарии и работу с документами. Он умнее по независимым замерам и тратит заметно меньше токенов на ту же задачу. Но контекстное окно у него меньше — 500 000 токенов против 1 миллиона у Grok 4.3, и стоит он дороже: 2 и 6 долларов за миллион токенов против 1,25 и 2,5 у версии 4.3. Поэтому для очень длинных документов старшая по номеру версия не всегда лучше.
Не полностью. В собственной таблице xAI из четырёх тестов Grok 4.5 опережает Opus 4.8 в двух и уступает в двух. При этом во всех четырёх тестах впереди Claude Fable 5, и компания не стала убирать это сравнение из релизных материалов. По независимому индексу Artificial Analysis Grok 4.5 занимает четвёртое место с результатом 54, уступая Fable 5, Opus 4.8 и GPT-5.5. Формулировка «модель класса Opus» корректна, «обошёл Opus» — преувеличение.
500 000 токенов — это примерно 350 страниц текста. Важная деталь: запросы длиннее 200 000 токенов тарифицируются по повышенной ставке, о чём xAI предупреждает в документации. У предыдущей версии Grok 4.3 окно вдвое больше — 1 миллион токенов.
Самый простой способ — через Нейрочат: русский интерфейс, оплата картой российского банка, без VPN и зарубежных карт. Grok 4.3 и Grok 4.5 доступны там вместе с ChatGPT, Claude, DeepSeek и Gemini в одном окне, так что одну и ту же задачу можно прогнать через несколько моделей и сравнить ответы.
По общему индексу Artificial Analysis GPT-5.5 немного впереди: 55 против 54 у Grok 4.5. Разница в пределах погрешности, поэтому выбирать стоит по задаче, а не по рейтингу. Grok сильнее там, где важна экономия токенов в длинных агентных сценариях, ChatGPT — в универсальных задачах и работе с изображениями. Надёжнее всего прогнать свою типовую задачу через обе модели и сравнить.