Коротко
Grok 4.7 и Xiaomi MiMo‑V2.6 вышли с разницей в один день, но представляют два разных подхода к передовому ИИ. Grok 4.7 делает ставку на проприетарный, тесно интегрированный агентный стек для программирования и профессиональной работы с знаниями, тогда как MiMo‑V2.6‑Pro сочетает открытые веса, большее окно контекста, нативное мультимодальное понимание и агрессивные цены на API.
SpaceXAI позиционирует Grok 4.7 как свой передовой модельный ряд для программирования, агентных задач и работы с знаниями с окном контекста в 500K токенов и настраиваемыми усилиями на рассуждение.
Xiaomi позиционирует MiMo‑V2.6‑Pro как мультимодальный флагман с контекстом в 1M с открытыми весами и поддержкой понимания текста, изображений, аудио и видео.
Итого: Grok 4.7 — более вертикально интегрированный управляемый агентный продукт; MiMo‑V2.6‑Pro дает разработчикам больше контроля над развертыванием и значительно более низкую цену за необработанные токены. Лучший выбор зависит от рабочего профиля, а не от единственной оценки в бенчмарке.
Основные выводы
- Grok 4.7 создан для долгосрочного программирования и профессиональных агентов. В опубликованной поставщиком оценке SpaceXAI он набирает 46.3% на CursorBench 4.0, 71.0% на DeepSWE v1.1 при высоком усилии и 1 657 на AA Briefcase v1.1.
- MiMo‑V2.6‑Pro необычно конкурентоспособен для открытой модели. Xiaomi публикует веса модели и приводит результаты, близкие к проприетарным передовым системам на ряде бенчмарков по программированию и агентам, но кросс-вендорные оценки напрямую несопоставимы.
- У MiMo преимущество по контексту и мультимодальности. MiMo‑V2.6‑Pro поддерживает окно контекста 1M токенов и понимание текста, изображений, аудио и видео, в то время как у Grok 4.7 — 500K контекст с вводом текста и изображений.
- MiMo существенно дешевле по «сырым» токенам API. Официальные стандартные тарифы составляют $0.435/$0.87 за миллион некэшированных входных/выходных токенов для MiMo‑V2.6‑Pro против $2/$6 для Grok 4.7.
- Архитектура развертывания — решающий компромисс. Grok предлагает более сильный хостинговый стек фирменных инструментов; открытые веса MiMo позволяют приватное развертывание, кастомный сервинг и более глубокий контроль инфраструктуры.
Grok 4.7 vs MiMo‑V2.6‑Pro одним взглядом
| Измерение | Grok 4.7 | MiMo-V2.6-Pro |
|---|---|---|
| Релиз | September 21, 2026 | September 22, 2026 |
| Доступ и контроль | Проприетарный API и управляемая экосистема агентов | Открытые веса, опция самостоятельного хостинга и доступ через API |
| Доказательства производительности | Заявленная поставщиком сила в программировании и долгоработающих агентных задачах; валидируйте на том же каркасе задач | Заявленная поставщиком сила в рассуждениях, программировании и мультимодальных задачах; валидируйте на том же каркасе задач |
| Уникальные сильные стороны | Фирменные инструменты, управляемые процессы и агенты с подключением к вебу/X | Контроль развертывания, контекст 1M токенов и понимание текста/изображений/аудио/видео |
| Окно контекста | 500K токенов | 1M токенов |
| Входные модальности | Текст и изображение | Текст, изображение, аудио и видео |
| Официальная стандартная цена за 1M вход/выход токенов | $2 / $6 | $0.435 / $0.87 |
| Рассуждение | От низкого до xHigh | Глубокие рассуждения |
| Открытые веса | Нет | Нет |
| Наилучшее соответствие | Управляемые процессы программирования и агенты | Приватное развертывание, мультимодальный ввод и более низкая стоимость токенов |
Что такое Grok 4.7?
SpaceXAI официально выпустила Grok 4.7 21 сентября 2026 года как свою наиболее способную модель для программирования и работы с знаниями. Этот релиз важен, поскольку до него в отчетах смешивались подтвержденные факты и утечки об архитектуре. Итоговая документация не публикует общее или активное число параметров, поэтому предположительные оценки не следует считать официальными спецификациями.
Согласно официальному анонсу, Grok 4.7 использует новую, более крупную базовую модель по сравнению с Grok 4.6 и обучался более длительным циклом RL с акцентом на задачи, требующие многих часов для завершения.
Модели оптимизируют разные слои стека. Grok 4.7 предоставляет более богатую управляемую среду вокруг модели; MiMo‑V2.6‑Pro открывает разработчикам больше слоев модели и развертывания.
Для подсказок свыше 200K токенов SpaceXAI применяет цены для высокого контекста. Опубликованный уровень — $4 за миллион входных токенов, $1 за миллион кэшированных входных токенов и $12 за миллион выходных токенов.
Изменения в Grok 4.7
Наиболее значимое изменение — цель обучения, а не просто более высокая цифра в бенчмарке. SpaceXAI говорит, что смесь RL сместилась в сторону более длительных, многочасовых задач, а модель обучалась тщательнее проверять собственную работу и нативно понимать каркас Grok Bot. Эта комбинация нацелена на реальное исполнение агентами: поддержание состояния, использование инструментов, проверка промежуточной работы и сохранение связности на длинных траекториях задач.
Производительность Grok 4.7
| Бенчмарк, опубликованный SpaceXAI | Grok 4.7 | Grok 4.6 | GPT-5.6 Sol | Fable 5.1 |
|---|---|---|---|---|
| CursorBench 4.0 | 46.3% | 40.4% | 41.7% | 51.8% |
| DeepSWE v1.1 | 71.0%* | 65.2% | 72.7% | 70.0% |
| EEBench | 64.0% | 53.0% | 39.4% | 56.4% |
| AA Briefcase v1.1 | 1,657 | 1,546 | 1,487 | 1,678 |
| Terminal-Bench 4.0 | 38.0% | 20.3% | 37.3% | 57.9% |
| Harvey Legal Agent Benchmark | 19.6% | 15.8% | 2.5% | 6.7% |
| HealthBench Professional | 56.7% | 48.5% | 60.5% | 62.1% |
SpaceXAI отмечает DeepSWE Grok 4.7 как high effort. Это оценки, опубликованные поставщиком, и их следует интерпретировать с учетом задокументированного каркаса и настроек рассуждений.
SpaceXAI представляет стартовые графики как веб-контент на официальной странице анонса; приведенная выше таблица сохраняет раскрытые значения бенчмарков без перерисовки.
Что такое Xiaomi MiMo‑V2.6?
Xiaomi официально выпустила и открыла MiMo‑V2.6 22 сентября 2026 года. В семейство входят MiMo‑V2.6‑Pro и MiMo‑V2.6‑Flash, с опцией Pro‑UltraSpeed для чувствительных к задержкам задач. Для прямого сравнения с Grok 4.7 уместен флагманский MiMo‑V2.6‑Pro.
Официальные материалы Xiaomi отдельно документируют открытые веса, нативный мультимодальный ввод и цены API. Эта комбинация делает MiMo‑V2.6 актуальным далеко за пределами лидербордов.
MiMo‑V2.6 vs MiMo‑V2.5: что улучшено?
Архитектурный акцент — не просто более крупная контрольная точка. Публичный релиз Xiaomi сильно фокусируется на постобучении и Live RL. Согласно официальным релиз-нотсам, Pro и Flash прошли по 30 шагов RL и вместе сгенерировали примерно 750 000 траекторий; раскрытая стоимость RL-этапа составила примерно $2.62 млн для Pro и $850 000 для Flash.
Одна деталь бенчмаркинга требует внимательного обращения: кривая Live RL Xiaomi показывает, что MiMo‑V2.6‑Pro достигает около 72.6 на DeepSWE v1.1 в ходе тренировки, тогда как итоговая сравнительная таблица сообщает 71.9. Эти числа относятся к разным контекстам оценивания и не должны сливаться без пояснений.

Grok 4.7 vs MiMo‑V2.6‑Pro: сравнение бенчмарков
Прямые сравнения бенчмарков требуют осторожности. Поставщики не всегда используют идентичные каркасы, бюджеты рассуждений, контрольные точки или конфигурации инструментов. Даже при совпадении названий бенчмарков небольшие различия в баллах могут значить меньше, чем кажется. Безопаснее отделять действительно согласованные измерения от направляющих свидетельств.
Artificial Analysis Intelligence Index
Xiaomi сообщает 46.32 для MiMo‑V2.6‑Pro по составному индексу Artificial Analysis. Любое сравнение с Grok должно быть привязано к точному снимку Artificial Analysis и конфигурации модели; «округленное равенство» не следует заявлять без источника.

Производительность в программировании и агентах
| Бенчмарк | Grok 4.7 — SpaceXAI | MiMo‑V2.6‑Pro — Xiaomi | Интерпретация |
|---|---|---|---|
| DeepSWE v1.1 | 71.0* | 71.9** | Численно близко; опубликованные прогоны и настройки различаются |
| GDPval-AA | См. график SpaceXAI | 1,673 | Лишь направляюще, если каркасы не согласованы |
| AA Briefcase | 1,657 | См. график Xiaomi | Используйте данные поставщиков с учетом контекста |
| Terminal-Bench 4.0 | 38.0 | 34.9 | Схожая тенденция; важен каркас |
| Окно контекста | 500K | 1M | MiMo поддерживает больший рабочий контекст |
*SpaceXAI сообщает DeepSWE Grok 4.7 при high effort. *Итоговая таблица Xiaomi сообщает 71.9; кривая Live RL достигает примерно 72.6. Эти цифры взяты из разных контекстов оценивания.

Соответствие рабочим процессам программирования
Для программирования различие зависит от того, означает ли «программирование» чистое решение репозитория или полноценный управляемый опыт кодирующего агента. На DeepSWE v1.1 опубликованные числа достаточно близки, чтобы разница менее одного пункта сама по себе не решала выбор для продакшена.
Преимущество Grok 4.7 — выше по стеку. Он интегрирован с Grok Build, доступен в Cursor, разработан для нативного понимания каркаса Grok Bot и сочетается с фирменными инструментами исполнения кода и поиска.
Преимущество MiMo‑V2.6‑Pro — ниже по стеку. Открытые веса делают практичным создание приватного помощника для программирования, кастомизацию сервинга, соблюдение требований к локализации данных или эксперименты с собственным агентным каркасом.
Для команд, выбирающих между ними, производственный A/B‑тест на репрезентативных репозиториях будет информативнее одного публичного бенчмарка.
Grok 4.7 vs MiMo‑V2.6‑Pro: различия в мультимодальных возможностях
Это одно из самых ясных различий. Grok 4.7 принимает текст и изображения и выдает текст. Более широкая платформа Grok предлагает отдельные медийные продукты, но их не следует смешивать с модальной поверхностью самой модели grok‑4.7.
MiMo‑V2.6‑Pro поддерживает понимание текста, изображений, аудио и видео. В сочетании с окном контекста 1M это расширяет спектр рабочих процессов, которые можно вести в одном контексте модели.
- Анализ скриншотов и кода в одной задаче
- Понимание видео с сопровождающими инструкциями
- Обработка длинного аудио
- Агенты компьютерного использования с визуальной обратной связью
- Мультимодальные исследовательские ассистенты
- Крупномасштабное мультимодальное извлечение и контроль качества
Grok 4.7 vs MiMo‑V2.6‑Pro: сравнение цен на API
| Официальные цены API | Grok 4.7 | MiMo‑V2.6‑Pro |
|---|---|---|
| Вход / 1M токенов | $2.00 | $0.435 |
| Кэшированный вход / 1M | $0.50 | $0.0036 |
| Выход / 1M | $6.00 | $0.87 |
| Надбавка за длинный контекст | Да, свыше 200K токенов подсказки | Сопоставимый стандартный уровень не опубликован |
| Открытые веса/самохостинг | Нет | Да |
По «стикерной» цене MiMo‑V2.6‑Pro в несколько раз дешевле как по обычному входу, так и по сгенерированному выходу, с особенно большой разницей для кэшированного контекста. Это существенно влияет на экономику агентов, которые многократно обрабатывают репозитории, длинные документы или постоянный контекст.
Важная заметка о ценах: окно контекста Grok 4.7 в 500K не означает, что весь контекст тарифицируется по стандартной ставке. Запросы свыше 200K токенов подсказки тарифицируются по уровню длинного контекста.
По состоянию на 24 сентября 2026 года CometAPI указывает Grok 4.7 по $1.60 за вход и $4.80 за выход за 1M токенов против официальных $2.00 и $6.00. Для MiMo‑V2.6‑Pro CometAPI указывает $0.348 за вход и $0.696 за выход против официальных $0.435 и $0.87. Эти указанные стандартные ставки на 20% ниже соответствующих официальных. Цены и условия могут меняться; перед бюджетированием подтверждайте актуальные страницы моделей.
Цена за токен — не то же самое, что стоимость завершенной задачи. Модели рассуждений могут потреблять разные объемы токенов, использовать разное число вызовов инструментов и требовать разные частоты повторов. Поэтому в продакшене следует отслеживать стоимость завершенной задачи, задержку и долю успехов вместе.
Grok 4.7 vs MiMo‑V2.6‑Pro: доступ и доступность
Разница в доступе проста: Grok 4.7 доступен через API и управляемые процессы Grok, при этом веса модели не предлагаются для самостоятельного хостинга. MiMo‑V2.6‑Pro доступен через API и как открытые веса, предоставляя командам дополнительный путь самохостинга.
Доступность отлична от лицензирования или гибкости развертывания. По состоянию на 24 сентября 2026 года обе модели также имеют живые страницы в каталоге CometAPI. Командам следует подтверждать конечную точку, регион, лимиты скорости и доступ к аккаунту перед продакшеном; наличие модели в списке не гарантирует одинаковую доступность или уровень сервиса для всех.
| Вопрос о доступности | Grok 4.7 | MiMo‑V2.6‑Pro |
|---|---|---|
| Официальный API | Доступен через xAI | Доступен через Xiaomi MiMo |
| Каталог CometAPI | Указан как доступный | Указан как доступный |
| Самостоятельные веса | Недоступны | Опция открытых весов |
| Операционная проверка | Подтвердите доступ аккаунта, регион, лимиты и наличие инструментов | Подтвердите доступ аккаунта, готовность конечной точки и требования к самохостингу |
Открытые веса и проприетарный доступ
Открытые веса MiMo‑V2.6‑Pro меняют сравнение сильнее, чем разница в один пункт бенчмарка. Это создает возможности для приватного развертывания, настройки движка вывода, кастомного постобучения, контроля локализации данных и более глубокой интеграции с инфраструктурой.
Grok 4.7 делает противоположный компромисс: меньше контроля над внутренностями модели в обмен на управляемый, постоянно работающий сервис и тесно интегрированную экосистему фирмы. Для многих организаций требования по управлению и инфраструктуре определят шортлист раньше, чем производительность бенчмарков.
Как использовать API Grok 4.7 и MiMo V2.6 в CometAPI
Разработчики могут получить доступ к API Grok 4.7 в CometAPI через унифицированный рабочий процесс API, снижая потребность в поддержке отдельных интеграций под каждого провайдера.
Для команд, бенчмаркающих несколько передовых моделей, унифицированный слой API особенно полезен, поскольку одни и те же продакшн‑подсказки, тестовый каркас, учет токенов и код приложения можно воспроизводить на разных моделях с меньшим числом интеграционных переменных.
CometAPI теперь указывает MiMo‑V2.6‑Pro как доступный, с подтвержденной доступностью API на 22 сентября 2026 года. Перед продакшеном проверяйте живой каталог и доступ аккаунта.
С учетом того, что страницы обеих моделей теперь указаны как доступные, A/B‑тест на уровне приложения может держать подсказки, инструменты, настройки рассуждений и критерии успеха максимально неизменными, а затем сравнить завершение задач, задержку, использование токенов и режимы сбоев.
Grok 4.7 vs MiMo‑V2.6‑Pro: соответствие моделям по кейсам
| Требование | Соответствие модели / рекомендации оценки |
|---|---|
| Фирменный веб‑поиск и поиск по X | Grok 4.7 |
| Управляемые долгоработающие агенты | Grok 4.7 |
| Рабочие процессы Grok Build / Cursor | Grok 4.7 |
| Окно контекста 1M | MiMo‑V2.6‑Pro |
| Нативное понимание аудио/видео | MiMo‑V2.6‑Pro |
| Открытые веса, самохостинг и контроль модели | MiMo‑V2.6‑Pro |
| Самая низкая цена за токены API | MiMo‑V2.6‑Pro |
| Репозиторное программирование | Бенчмаркайте обе на репрезентативных репо |
| Профессиональные агенты знаний | Бенчмаркайте обе на продукционных задачах |
Решение следует формулировать вокруг архитектуры рабочей нагрузки. Grok 4.7 призван сделать управляемый агентный стек более способным; MiMo‑V2.6‑Pro призван сделать высокоуровневый интеллект дешевле, мультимодальным и более контролируемым.
Какую выбрать?
Выбирайте Grok 4.7, если вам нужен управляемый агентный опыт с фирменным веб‑поиском и поиском по X, нативным исполнением кода и меньшим объемом инфраструктуры для эксплуатации. Это более практичный вариант для команд, ценящих интегрированный стек инструментов и долгоработающие профессиональные или кодовые процессы.
Выбирайте MiMo‑V2.6‑Pro, если вам нужны открытые веса, приватное развертывание, окно контекста 1M, нативное понимание аудио и видео или существенно более низкая цена по «сырым» токенам API. Это более сильный вариант, когда первичны контроль развертывания, охват мультимодальности и эффективность затрат.
Если выбор все еще неясен, прогоните обе модели на тех же репрезентативных задачах с идентичными подсказками, инструментами, бюджетами рассуждений, таймаутами и политиками повторов. Выберите ту, что обеспечивает лучшую комбинацию доли завершения, задержки, общей стоимости успешной задачи и затрат на человеческую проверку.
Заключение
Grok 4.7 против MiMo V2.6 показателен тем, что «сырой интеллект» больше не единственный значимый дифференциатор. Обе модели занимают схожую полосу высокой способности в текущих публичных оценках, но их продуктовые стратегии резко расходятся.
Grok 4.7 сочетает окно контекста 500K, настраиваемые рассуждения, сильную подготовку к длинным агентным траекториям и зрелый фирменный стек поиска и исполнения. MiMo‑V2.6‑Pro сочетает окно контекста 1M, нативный мультимодальный ввод, открытые веса и цены API, существенно ниже многих проприетарных передовых систем.
Для разработчиков практический вопрос — меньше «у кого выше бенчмарк?», а больше «где должна жить интеллектуальная часть?». Управляемая экосистема агентов и открытый настраиваемый стек модели решают разные операционные задачи. Правильный выбор — тот, что лучше соответствует рабочей нагрузке, ограничениям инфраструктуры и модели затрат.
Частые вопросы
Является ли Grok 4.7 моделью на 2.1 трлн параметров?
До релиза циркулировала цифра около 2.1T, но итоговая документация SpaceXAI по Grok 4.7 не публикует общее или активное число параметров. Подтверждено лишь, что Grok 4.7 использует более крупную базовую модель, чем Grok 4.6.
Является ли MiMo‑V2.6 открытым исходным кодом?
Xiaomi выпустила MiMo‑V2.6 как открытое семейство моделей с доступными для скачивания весами и сопутствующими исследовательскими материалами. При планировании продакшена командам все равно следует изучить лицензию модели и условия распространения под их сценарий использования.
Сколько стоит завершенная агентная задача в Grok 4.7 vs MiMo‑V2.6‑Pro?
Нормализуйте набор задач, подсказки, разрешения на инструменты, политику повторов и критерии успеха. Отслеживайте суммарные входные, кэшированные входные, рассуждательные и выходные токены, вызовы инструментов, задержку, повторы и время человеческой проверки. Цена за токен — лишь один компонент стоимости завершенной задачи.
Насколько надежны сравнения бенчмарков Grok 4.7 vs MiMo‑V2.6‑Pro?
Используйте один и тот же репозиторий или набор задач, агентный каркас, инструменты, бюджет рассуждений, таймаут, политику повторов и шкалу оценивания. Сообщайте доверительные интервалы или вариацию при повторных прогонах и держите данные, опубликованные вендорами, отдельно от внутренних результатов.
Взимает ли Grok 4.7 повышенную плату за длинные подсказки?
SpaceXAI документирует более высокие ставки при превышении 200K токенов подсказки. Поскольку более высокий уровень применяется к запросу, командам, использующим большие репозитории или постоянный контекст агента, следует явно моделировать этот порог.
