Обновлено 13 августа 2026 года.
12 августа SpaceXAI выпустила Grok 4.6 — новую frontier-модель для программирования, длинных агентных задач и knowledge work. Она получила контекст 500 000 токенов, текстовый и графический вход, четыре уровня reasoning и встроенные инструменты. API стоит от $2 за 1 млн входных и $6 за 1 млн выходных токенов.
Коротко: главное изменение Grok 4.6 — не новый чат-интерфейс, а устойчивость в длинных рабочих траекториях: модель обучали на agentic RL-задачах, коде, CAD, веб-разработке и knowledge work. По опубликованным SpaceXAI тестам она заметно сильнее Grok 4.5, но это всё ещё требует проверки в вашем harness.
Материал предназначен для разработчиков, CTO и владельцев AI-продуктов. Он охватывает API-модель grok-4.6, а не тарифы потребительского SuperGrok и не отдельные продукты Imagine или Voice.
Содержание
- Что нового в Grok 4.6
- Характеристики и API
- Что показывают тесты
- Сколько стоит Grok 4.6
- Как подключить модель
- Чем Grok 4.6 отличается от 4.5
- Для каких задач подходит
- Риски и ограничения
- FAQ
- Как AI рассвет помогает проверить Grok на бизнес-задаче
- Итог
Что нового в Grok 4.6
В официальном анонсе SpaceXAI делает акцент на длинных агентных сценариях: исследование темы, работа с кодовой базой, анализ информации и создание интерактивных приложений. Модель прошла более длинный дополнительный training run, чем 4.5, после чего траектории SFT были заново сгенерированы Grok 4.5 для разных reasoning effort и agent harness.
Разработчик также сообщает о расширенном RL на knowledge work, общем и специализированном коде, оптимизации ядер, веб-разработке и CAD. На длинных задачах команда наблюдала больше самопроверки, а в визуальных и интерактивных проектах — более сильный первый проход. Это наблюдения поставщика, а не независимый тест AI рассвет.
Характеристики и API
| Параметр | Grok 4.6 |
|---|---|
| Model ID | grok-4.6 |
| Контекст | 500 000 токенов |
| Knowledge cutoff | 1 февраля 2026 года |
| Вход | текст и изображения |
| Выход | текст; отдельный лимит в документации не указан |
| Reasoning | low, medium, high по умолчанию, xhigh |
| API | Responses API и Chat Completions |
| Инструменты | function calling, web search, X search, code execution |
| Доступность | xAI API, Grok Build, Cursor, OpenRouter, Vercel и Cloudflare |
Knowledge cutoff не означает, что модель знает только старые события: web search и X search могут принести актуальные данные во время запроса. Но без инструмента сведения после 1 февраля 2026 года нельзя считать встроенными в веса.
Что показывают тесты
SpaceXAI публикует сравнение Grok 4.6 High с Grok 4.5 High и конкурентами. Часть сопоставлений берётся из self-reported результатов и публичных leaderboard, поэтому таблица помогает отбирать кандидатов, но не заменяет единый независимый прогон.
| Benchmark | Grok 4.6 High | Grok 4.5 High | Изменение |
|---|---|---|---|
| AA Intelligence Index | 61 | 56 | +5 пунктов |
| GDPVal-AA v2 | 1753 | 1526 | +227 |
| CursorBench v3.2 | 69,9% | 66,7% | +3,2 п.п. |
| DeepSWE v1.1 | 65,9% | 54,0% | +11,9 п.п. |
| FrontierCode v1.1 Extended | 61,3% | 56,6% | +4,7 п.п. |
| Terminal-Bench v3.0 | 26,0% | 15,7% | +10,3 п.п. |
В AA Intelligence Index Grok 4.6 получил 61 — столько же, сколько GPT-5.6 Sol Max в таблице анонса. Это не означает равенство на каждой задаче: индекс объединяет девять тестов, а отдельные профили моделей различаются.
Сколько стоит Grok 4.6
Стандартный API-тариф начинается с $2 за 1 млн входных и $6 за 1 млн выходных токенов. Fast-вариант стоит вдвое дороже: $4 и $12 соответственно. Точная цена кэшированного входа и rate limits отображаются на detail page команды и могут зависеть от аккаунта.
Пример: 100 000 входных и 20 000 выходных токенов стандартного варианта стоят 0,1 × $2 + 0,02 × $6 = $0,32. Это расчёт без web/X search, повторов, кэширования и проверки результата.
Для длинного агента считайте стоимость принятой задачи, а не вызова. В неё входят reasoning, повторная история, tool results, ретраи и человеческое ревью.
Как подключить модель
from openai import OpenAI
import os
client = OpenAI(
api_key=os.environ["XAI_API_KEY"],
base_url="https://api.x.ai/v1",
)
response = client.responses.create(
model="grok-4.6",
input="Найди ошибку, исправь её и предложи регрессионный тест",
reasoning={"effort": "high"},
prompt_cache_key="project-auth-migration",
)
print(response.output_text)
SpaceXAI рекомендует передавать prompt_cache_key в Responses API или заголовок x-grok-conv-id в Chat Completions. Это направляет запросы одной беседы на тот же сервер и повышает вероятность cache hit; без ключа длинная история часто оплачивается как холодный вход.
Для длинных циклов используйте context compaction. Не позволяйте модели автоматически сокращать критические требования, журнал решений и security policy: эти блоки лучше сохранять отдельно и возвращать явно.
Чем Grok 4.6 отличается от 4.5
| Область | Grok 4.5 | Grok 4.6 |
|---|---|---|
| Основной акцент | coding, агенты, knowledge work | более длинные агенты, визуальные и интерактивные проекты |
| Контекст в актуальных docs | модель предыдущего поколения | 500 тыс. токенов |
| Reasoning | интеллектуальный/эффективный режим | low, medium, high, xhigh |
| API-цена | $2 / $6 за 1M | от $2 / $6; fast вдвое дороже |
| Published evals | базовая точка | рост на всех показанных xAI тестах |
Миграция оправдана, если длинные задачи в 4.5 обрываются, агент теряет цель после серии инструментов или первый проход по приложению требует слишком много ручных итераций. Для короткой классификации обновление может не дать экономического эффекта.
Для каких задач подходит
- изменение нескольких связанных модулей и самостоятельный запуск тестов;
- исследование темы с web/X search и сводным отчётом;
- прототипирование интерактивного приложения;
- анализ больших документов и изображений;
- длинные агентные процессы с function calling и code execution.
Не выдавайте агенту необратимые права по умолчанию. Платежи, удаление данных, публикация и production-деплой должны требовать отдельного подтверждения.
Риски и ограничения
Во-первых, результаты анонса не являются вашим benchmark. Harness, reasoning effort, инструменты и лимит времени меняют ответ. Во-вторых, 500 тыс. токенов — ёмкость, а не гарантия сохранения каждой детали. В-третьих, web/X search приносит внешнее недоверенное содержимое и создаёт риск prompt injection.
Пилот должен включать 50–100 реальных обезличенных задач, одинаковые права, заранее заданный критерий успеха, задержку p50/p95, токены, число ретраев и долю результатов, принятых человеком. Это практическая рекомендация, не статистическая гарантия.
FAQ
Когда вышел Grok 4.6?
SpaceXAI выпустила модель 12 августа 2026 года. В тот же день обновились официальный анонс и API-документация.
Какой контекст у Grok 4.6?
500 000 токенов. Для длинных agent loops документация рекомендует prompt caching и context compaction.
Сколько стоит Grok 4.6?
Стандартный API — $2 за 1 млн входных и $6 за 1 млн выходных токенов. Fast-вариант стоит вдвое дороже.
Поддерживает ли Grok 4.6 изображения?
Да, официальная карточка указывает text и image input, а выход — текстовый.
Есть ли поиск по интернету и X?
Да. Web search и X search доступны как серверные инструменты наряду с code execution и function calling.
Как AI рассвет помогает проверить Grok на бизнес-задаче
AI рассвет может подготовить тестовый набор и критерии приёмки, спроектировать RAG и контур данных, интегрировать агента с корпоративными системами и настроить подтверждение опасных действий. Для закрытого контура команда может сравнить внешний API с on-premise LLM по требованиям к данным и стоимости владения.
Первый шаг — выбрать один процесс, зафиксировать базовую линию, источники данных, ограничения и критерий приёмки. Обсудить задачу.
Итог
Grok 4.6 — эволюция 4.5 с явным фокусом на длинные агенты, код и визуально-интерактивные проекты. Модель получила 500K контекст, xhigh reasoning, изображения и полный набор серверных инструментов при прежней стартовой цене $2/$6.
Опубликованные тесты показывают рост, но решение о миграции нужно принимать по своим задачам. Прогоните 4.5 и 4.6 в одном harness, измерьте принятие результата, задержку и полную стоимость — и обновляйте маршрут только там, где разница воспроизводится.