Grok 4.6 вышла 12 августа 2026 года, через пять недель после Grok 4.5. Это не новая база, а глубокий пост-тренинг поверх той же архитектуры. SpaceXAI сохранила основание модели неизменным и вложила ресурсы в дополнительное обучение: курируемые данные, более качественные инженерные примеры, обновлённый оптимизатор.
Интересно устроено само дообучение. Примеры для обучения Grok 4.6 создавала предыдущая версия - Grok 4.5. Она генерировала решения разного уровня сложности рассуждений, для разных агентных сценариев и по разным темам: точные науки, разработка ПО, работа с базами знаний. Слабые и неудачные примеры потом отсеивали автоматической проверкой.
- effeefeffeefeffeefeffeefeffeefeffeefeffeefeffeefeffeefeffeefeffeefeffeefeffeefef
- efeffe
- ffe
Что нового по сравнению с 4.5
Grok 4.6 набирает 61 балл по Artificial Analysis Intelligence Index. Это на 5 пунктов больше, чем у Grok 4.5, и на уровне GPT-5.6 Sol. Важная оговорка: совпадение результатов справедливо только для сводного индекса из девяти тестов. В собственной таблице SpaceXAI из десяти строк по числу первых мест лидирует Claude Fable 5 Max, а Grok 4.6 первенствует в задачах, связанных со знаниевой работой и юридическим анализом.
Наибольший прирост, в агентных и инженерных бенчмарках: DeepSWE v1.1 вырос на 11,9 пункта до 65,9%, APEX-Agents на 10,4 пункта, Terminal-Bench v3.0 почти удвоился, с 15,7% до 26%. При этом модель не берёт первенство везде: на DeepSWE и Terminal-Bench её всё ещё обходит GPT-5.6 Sol Max, 73% и 34,6% против 65,9% и 26% у Grok 4.6 соответственно.
Ценовое позиционирование осталось прежним: $2 за 1 млн входных и $6 за 1 млн выходных токенов, это примерно на 60% дешевле GPT-5.6 Sol по собственным вводным ценам. Формула SpaceXAI простая: модель почти догнала лидеров по интеллекту, но заметно дешевле в использовании. Это и есть её основное позиционирование, а не абсолютное лидерство на каждом отдельном тесте.
Технические характеристики
Контекстное окно: 500 000 токенов. Модель принимает текст и изображения, отвечает только текстом, явного лимита на длину ответа не заявлено.
Уровень рассуждения задаётся параметром reasoning effort и имеет четыре ступени: low, medium, high (используется по умолчанию) и новую xhigh. Последняя добавлена именно в этом релизе для самых сложных задач, где важнее качество, чем скорость и стоимость обработки запроса.
Может собрать сложный интерфейс с несколькими экранами и визуальными элементами за один раз, без множества правок. Умеет планировать и выполнять исследовательские задачи в несколько этапов, попутно проверяя и перепроверяя собственные результаты.
Как использовать Grok 4.6 на Syntasy
- Открыть вкладку Текст в верхнем меню
- Выбрать модель Grok 4.6 в панели настроек
- Задать уровень рассуждения: low или medium для простых и быстрых запросов, high
- При необходимости прикрепить изображение: модель учитывает его как часть запроса
- Сформулировать задачу целиком, с конечным результатом и критериями готовности
- Отправить запрос и дать модели пройти длинную цепочку рассуждений при high и xhi
Чем Grok 4.6 отличается от других моделей
Grok 4.6 и Grok 4.5
Разница проявляется на длинных агентных задачах. Grok 4.6 заметно лучше держит контекст репозитория, реже теряет план на середине выполнения и добавляет самопроверку шагов, которой не было у 4.5. Для коротких разовых запросов разница между версиями почти не ощущается, для многошаговых агентных сценариев она существенна.
Grok 4.6 и GPT-5.6 Sol
По сводному индексу интеллекта модели идут почти вровень, но распределение сильных сторон разное. GPT-5.6 Sol Max по-прежнему впереди на самых требовательных инженерных тестах, DeepSWE и Terminal-Bench, где нужно долго и точно работать с кодом и терминалом. Grok 4.6 сильнее в задачах со знаниевой и юридической работой и выигрывает по цене: токены стоят примерно вдвое дешевле. Выбор между ними зависит от того, что важнее для задачи: предельная точность в сложном инженерном сценарии или сопоставимое качество при заметно меньшей стоимости.
Когда использовать
- многошаговые агентные сценарии: анализ кода по всему проекту, рефакторинг, сборк
- интерактивные и визуально сложные интерфейсы, собираемые за один проход
- исследовательские задачи, которые требуют сбора и синтеза материала в несколько
- знаниевая и юридическая работа с высокой ценой ошибки
- проекты, где на первом месте - стоимость токенов, при этом качество остаётся на



