Grok 4.6 вышел: что нового, API, цена и сравнение с 4.5

Grok 4.6
Grok 4.6 API
Grok 4.6 цена
Grok 4.6 характеристики
Grok 4.6 vs 4.5

Обновлено 13 августа 2026 года.

12 августа SpaceXAI выпустила Grok 4.6 — новую frontier-модель для программирования, длинных агентных задач и knowledge work. Она получила контекст 500 000 токенов, текстовый и графический вход, четыре уровня reasoning и встроенные инструменты. API стоит от $2 за 1 млн входных и $6 за 1 млн выходных токенов.

Коротко: главное изменение Grok 4.6 — не новый чат-интерфейс, а устойчивость в длинных рабочих траекториях: модель обучали на agentic RL-задачах, коде, CAD, веб-разработке и knowledge work. По опубликованным SpaceXAI тестам она заметно сильнее Grok 4.5, но это всё ещё требует проверки в вашем harness.

Материал предназначен для разработчиков, CTO и владельцев AI-продуктов. Он охватывает API-модель grok-4.6, а не тарифы потребительского SuperGrok и не отдельные продукты Imagine или Voice.

Содержание

Что нового в Grok 4.6

В официальном анонсе SpaceXAI делает акцент на длинных агентных сценариях: исследование темы, работа с кодовой базой, анализ информации и создание интерактивных приложений. Модель прошла более длинный дополнительный training run, чем 4.5, после чего траектории SFT были заново сгенерированы Grok 4.5 для разных reasoning effort и agent harness.

Разработчик также сообщает о расширенном RL на knowledge work, общем и специализированном коде, оптимизации ядер, веб-разработке и CAD. На длинных задачах команда наблюдала больше самопроверки, а в визуальных и интерактивных проектах — более сильный первый проход. Это наблюдения поставщика, а не независимый тест AI рассвет.

Характеристики и API

Параметр Grok 4.6
Model ID grok-4.6
Контекст 500 000 токенов
Knowledge cutoff 1 февраля 2026 года
Вход текст и изображения
Выход текст; отдельный лимит в документации не указан
Reasoning low, medium, high по умолчанию, xhigh
API Responses API и Chat Completions
Инструменты function calling, web search, X search, code execution
Доступность xAI API, Grok Build, Cursor, OpenRouter, Vercel и Cloudflare

Knowledge cutoff не означает, что модель знает только старые события: web search и X search могут принести актуальные данные во время запроса. Но без инструмента сведения после 1 февраля 2026 года нельзя считать встроенными в веса.

Что показывают тесты

SpaceXAI публикует сравнение Grok 4.6 High с Grok 4.5 High и конкурентами. Часть сопоставлений берётся из self-reported результатов и публичных leaderboard, поэтому таблица помогает отбирать кандидатов, но не заменяет единый независимый прогон.

Benchmark Grok 4.6 High Grok 4.5 High Изменение
AA Intelligence Index 61 56 +5 пунктов
GDPVal-AA v2 1753 1526 +227
CursorBench v3.2 69,9% 66,7% +3,2 п.п.
DeepSWE v1.1 65,9% 54,0% +11,9 п.п.
FrontierCode v1.1 Extended 61,3% 56,6% +4,7 п.п.
Terminal-Bench v3.0 26,0% 15,7% +10,3 п.п.

В AA Intelligence Index Grok 4.6 получил 61 — столько же, сколько GPT-5.6 Sol Max в таблице анонса. Это не означает равенство на каждой задаче: индекс объединяет девять тестов, а отдельные профили моделей различаются.

Сколько стоит Grok 4.6

Стандартный API-тариф начинается с $2 за 1 млн входных и $6 за 1 млн выходных токенов. Fast-вариант стоит вдвое дороже: $4 и $12 соответственно. Точная цена кэшированного входа и rate limits отображаются на detail page команды и могут зависеть от аккаунта.

Пример: 100 000 входных и 20 000 выходных токенов стандартного варианта стоят 0,1 × $2 + 0,02 × $6 = $0,32. Это расчёт без web/X search, повторов, кэширования и проверки результата.

Для длинного агента считайте стоимость принятой задачи, а не вызова. В неё входят reasoning, повторная история, tool results, ретраи и человеческое ревью.

Как подключить модель

from openai import OpenAI
import os

client = OpenAI(
    api_key=os.environ["XAI_API_KEY"],
    base_url="https://api.x.ai/v1",
)

response = client.responses.create(
    model="grok-4.6",
    input="Найди ошибку, исправь её и предложи регрессионный тест",
    reasoning={"effort": "high"},
    prompt_cache_key="project-auth-migration",
)

print(response.output_text)

SpaceXAI рекомендует передавать prompt_cache_key в Responses API или заголовок x-grok-conv-id в Chat Completions. Это направляет запросы одной беседы на тот же сервер и повышает вероятность cache hit; без ключа длинная история часто оплачивается как холодный вход.

Для длинных циклов используйте context compaction. Не позволяйте модели автоматически сокращать критические требования, журнал решений и security policy: эти блоки лучше сохранять отдельно и возвращать явно.

Чем Grok 4.6 отличается от 4.5

Область Grok 4.5 Grok 4.6
Основной акцент coding, агенты, knowledge work более длинные агенты, визуальные и интерактивные проекты
Контекст в актуальных docs модель предыдущего поколения 500 тыс. токенов
Reasoning интеллектуальный/эффективный режим low, medium, high, xhigh
API-цена $2 / $6 за 1M от $2 / $6; fast вдвое дороже
Published evals базовая точка рост на всех показанных xAI тестах

Миграция оправдана, если длинные задачи в 4.5 обрываются, агент теряет цель после серии инструментов или первый проход по приложению требует слишком много ручных итераций. Для короткой классификации обновление может не дать экономического эффекта.

Для каких задач подходит

  • изменение нескольких связанных модулей и самостоятельный запуск тестов;
  • исследование темы с web/X search и сводным отчётом;
  • прототипирование интерактивного приложения;
  • анализ больших документов и изображений;
  • длинные агентные процессы с function calling и code execution.

Не выдавайте агенту необратимые права по умолчанию. Платежи, удаление данных, публикация и production-деплой должны требовать отдельного подтверждения.

Риски и ограничения

Во-первых, результаты анонса не являются вашим benchmark. Harness, reasoning effort, инструменты и лимит времени меняют ответ. Во-вторых, 500 тыс. токенов — ёмкость, а не гарантия сохранения каждой детали. В-третьих, web/X search приносит внешнее недоверенное содержимое и создаёт риск prompt injection.

Пилот должен включать 50–100 реальных обезличенных задач, одинаковые права, заранее заданный критерий успеха, задержку p50/p95, токены, число ретраев и долю результатов, принятых человеком. Это практическая рекомендация, не статистическая гарантия.

FAQ

Когда вышел Grok 4.6?

SpaceXAI выпустила модель 12 августа 2026 года. В тот же день обновились официальный анонс и API-документация.

Какой контекст у Grok 4.6?

500 000 токенов. Для длинных agent loops документация рекомендует prompt caching и context compaction.

Сколько стоит Grok 4.6?

Стандартный API — $2 за 1 млн входных и $6 за 1 млн выходных токенов. Fast-вариант стоит вдвое дороже.

Поддерживает ли Grok 4.6 изображения?

Да, официальная карточка указывает text и image input, а выход — текстовый.

Есть ли поиск по интернету и X?

Да. Web search и X search доступны как серверные инструменты наряду с code execution и function calling.

Как AI рассвет помогает проверить Grok на бизнес-задаче

AI рассвет может подготовить тестовый набор и критерии приёмки, спроектировать RAG и контур данных, интегрировать агента с корпоративными системами и настроить подтверждение опасных действий. Для закрытого контура команда может сравнить внешний API с on-premise LLM по требованиям к данным и стоимости владения.

Первый шаг — выбрать один процесс, зафиксировать базовую линию, источники данных, ограничения и критерий приёмки. Обсудить задачу.

Итог

Grok 4.6 — эволюция 4.5 с явным фокусом на длинные агенты, код и визуально-интерактивные проекты. Модель получила 500K контекст, xhigh reasoning, изображения и полный набор серверных инструментов при прежней стартовой цене $2/$6.

Опубликованные тесты показывают рост, но решение о миграции нужно принимать по своим задачам. Прогоните 4.5 и 4.6 в одном harness, измерьте принятие результата, задержку и полную стоимость — и обновляйте маршрут только там, где разница воспроизводится.

← Все статьи

Комментарии (0)

Пока нет комментариев. Будьте первым!

Оставить комментарий
Регистрация не требуется