Технические характеристики Grok 4.6
| Параметр | Grok 4.6 |
|---|---|
| Провайдер | xAI |
| Идентификатор модели | grok-4.6 |
| Тип модели | Передовая мультимодальная модель для рассуждения и агентных задач |
| Ключевые сильные стороны | Длительно работающие агенты, программирование, работа с знаниями, создание интерактивных/визуальных приложений |
| Входные модальности | Текст и изображения |
| Выходная модальность | Текст |
| Контекстное окно | 500,000 токенов |
| Срез знаний | 1 февраля 2026 года |
| Лимит вывода | xAI не публикует лимит текстового вывода |
| Режимы рассуждения | low, medium, high (по умолчанию), xhigh |
| API | Responses API, Chat Completions |
| Инструменты | Вызов функций, веб-поиск, X search, выполнение кода |
| Цены API | $2 / 1M входных токенов; $6 / 1M выходных токенов |
| Быстрый вариант | Доступен по цене 2× от стандартной |
| Выпуск | 12 августа 2026 года |
Что такое Grok 4.6?
Grok 4.6 — новейшая передовая модель xAI, ориентированная на агентный интеллект.
Его отличие от традиционного чат-бота принципиально.
xAI подчёркивает способность модели дольше держаться на сложных проектах, работать с различными кодовыми базами, исследовать незнакомые темы, создавать приложения и проверять собственную работу.
Это делает Grok 4.6 особенно актуальной для стремительно растущего рынка агентов для программирования ИИ и автономных агентов.
Основные возможности Grok 4.6
- Длительное выполнение агентных сценариев: Grok 4.6 обучена поддерживать сложную работу на протяжении многих шагов, а не оптимизироваться лишь под одноходовые ответы.
- Агентное программирование: Нацелена на инженерную работу на уровне репозитория, генерацию кода, отладку, итерационное тестирование и отраслевые среды разработки.
- Исследования в сфере работы с знаниями: Модель может исследовать незнакомые области, организовывать информацию, рассуждать над сложными требованиями и превращать выводы в конкретный результат.
- Создание визуальных и интерактивных приложений: xAI отмечает более сильные результаты «с первого прохода» для визуальных и интерактивных проектов, включая превращение продуктовой идеи в рабочее приложение и его улучшение через циклы обратной связи.
- Самопроверка и верификация: На длинных траекториях xAI наблюдала больше поведения, при котором модель проверяет свою работу перед продолжением.
- Нативное использование инструментов: Grok 4.6 поддерживает вызов функций, веб‑поиск, X search и выполнение кода через API.
- Настраиваемые уровни рассуждения: Разработчики могут выбирать
low,medium,highилиxhigh, что делает модель адаптивной как для чувствительных к задержкам, так и для задач с глубоким рассуждением.
Результаты бенчмарков Grok 4.6
По данным xAI, Grok 4.6 сопоставим с GPT-5.6 Sol по Artificial Analysis Intelligence Index, составленному из девяти бенчмарков. Самые сильные опубликованные результаты включают:
| Бенчмарк | Grok 4.6 High | Grok 4.5 High | GPT-5.6 Sol Max | Claude Fable 5 Max |
|---|---|---|---|---|
| Artificial Analysis Intelligence Index | 61 | 56 | 61 | 62 |
| GDPVal-AA v2 | 1753 | 1526 | 1728 | 1741 |
| CursorBench v3.2 | 69.9% | 66.7% | 67.2% | 70.5% |
| DeepSWE v1.1 | 65.9% | 54.0% | 73.0% | 70.0% |
| FrontierCode v1.1 (Extended) | 61.3% | 56.6% | 60.6% | 63.6% |
| APEX-Agents | 57.5% | 47.1% | 56.7% | 59.2% |
| Terminal-Bench v3.0 | 26.0% | 15.7% | 34.6% | 34.1% |
| APEX-SWE | 56.4% | 53.6% | — | 58.8% |
| AA-Briefcase | 1577 | 1313 | 1502 | 1574 |
| Harvey LAB (Vals) | 15.8% | 12.9% | 2.5% | 11.3% |
Эти цифры взяты из объявления о запуске xAI от 12 августа. xAI отмечает, что сторонние показатели взяты из карточек систем разработчиков или публичных лидербордов бенчмарков, поэтому сопоставление результатов разных моделей следует трактовать с учётом методологии оценки и настроек моделей.
Grok 4.6 vs Grok 4.5 vs GPT-5.6 Sol vs Claude Fable 5
| Модель | Основное позиционирование | Контекст | AA Intelligence | Профиль по программированию/агентности |
|---|---|---|---|---|
| Grok 4.6 | Длительные агенты, программирование, работа с знаниями | 500K | 61 | Сильные агентное программирование и интерактивные проектные процессы |
| Grok 4.5 | Быстрая передовая универсальная и кодовая модель | 500K | 56 | Сильная базовая модель для программирования и агентных процессов |
| GPT-5.6 Sol | Передовое общее рассуждение и агентная работа | Опубликованный контекст конкурентов варьируется по развертыванию | 61 | Сильные результаты на DeepSWE и Terminal-Bench |
| Claude Fable 5 | Передовая работа с знаниями и программирование | Опубликованный контекст конкурентов варьируется по развертыванию | 62 | Очень сильные CursorBench, FrontierCode, APEX-SWE |
Grok 4.6 наиболее привлекателен, когда рабочая нагрузка требует длительного исполнения, а не единственного высококачественного ответа. Особенно интересен разработчикам, создающим агентов, которые многократно исследуют, вызывают инструменты, редактируют код, тестируют результаты и продолжают работу, накапливая контекст. Claude Fable 5 сохраняет преимущество в ряде опубликованных кодовых и агентных бенчмарков, тогда как GPT-5.6 Sol опережает Grok 4.6 в DeepSWE и Terminal-Bench в сравнении xAI.
Ограничения и замечания
- Результаты бенчмарков зависят от задач: Grok 4.6 не во всех случаях показывает наивысшие баллы. Опубликованные результаты демонстрируют явные сильные и слабые стороны в различных агентных оценках.
- Длительные нагрузки могут потреблять много токенов: Большое контекстное окно и итеративное использование инструментов увеличивают суммарное потребление, даже при конкурентной цене за токен.
- Важна конфигурация инструментов: Веб‑поиск, X search, выполнение кода и вызов функций требуют архитектуры приложения, которая безопасно обрабатывает права инструментов и возвращаемые данные.
- Срез знаний: Документированный срез — 1 февраля 2026 года. Для более свежей информации разработчикам следует использовать соответствующую выборку/веб‑поиск, а не полагаться на статические знания модели.
- Кэширование требует продуманной конфигурации: xAI рекомендует
prompt_cache_keyдля Responses API иx-grok-conv-idдля Chat Completions, чтобы повысить надёжность попаданий в кэш.
Сценарии использования Grok 4.6
- Автономные кодовые агенты — анализ репозитория, реализация, отладка, тестирование и итеративные исправления.
- Прототипирование продукта — превращение общих продуктовых требований в функциональные интерактивные приложения.
- Технические исследовательские агенты — изучение незнакомых технических областей и выпуск структурированных результатов.
- Копилоты для разработчиков — генерация кода, ревью, отладка и многошаговые рабочие процессы разработки.
- Автоматизация работы с документами — анализ документов, синтез информации, планирование и генерация структурированного вывода.
- Ассистенты с инструментами — приложения, сочетающие рассуждение модели с веб‑поиском, X search, выполнением кода и пользовательскими вызовами функций.
Как получить доступ к API Grok 4.6
Для приложений, уже использующих унифицированный слой API CometAPI, используйте идентификатор модели Grok 4.6, предоставляемый CometAPI, и следуйте текущей конечной точке/схеме, описанной в документации CometAPI. Это может снизить трудоёмкость интеграции с конкретными провайдерами, когда приложению нужно переключаться между передовыми LLM.
Типовой рабочий процесс:
- Создайте или войдите в аккаунт CometAPI.
- Создайте API‑токен в консоли CometAPI.
- Выберите конечную точку модели
grok-4.6. - Отправляйте запросы через конечную точку CometAPI, используя схему запросов, задокументированную для модели.
- Обрабатывайте возвращаемый текст, вызовы инструментов или структурированный вывод в вашем приложении.