xAI выпустила Grok 4.7: флагманская модель для программирования и AI-агентов
2

xAI выпустила Grok 4.7: флагманская модель для программирования и AI-агентов

Автор: admin

xAI представила Grok 4.7 — новую флагманскую модель с контекстом 500 тыс. токенов, встроенной поддержкой AI-агентов и ценой $2/$6 за млн токенов. Доступна в API, Cursor и Grok Build.

Компания xAI анонсировала выпуск Grok 4.7 — обновлённой флагманской языковой модели, ориентированной на сложные задачи программирования, работу AI-агентов и длительную интеллектуальную работу. В отличие от чат-ориентированных моделей, Grok 4.7 рассчитана на автономное выполнение задач, которые могут занимать часы: модель планирует работу, использует инструменты, проверяет результаты и реже теряет контекст.

Новая версия построена на более крупной базовой модели по сравнению с Grok 4.6. Обучение с подкреплением (RL) проводилось дольше и включало больше сложных многочасовых задач. Ключевое новшество — встроенное понимание среды Grok Bot: системы постоянных AI-агентов, работающих с приложениями, файлами и внешними сервисами.

Технические характеристики: контекстное окно 500 тысяч токенов (помещает крупную кодовую базу или несколько объёмных документов), приём текста и изображений, текстовый вывод без жёсткого лимита, четыре уровня рассуждений (Low, Medium, High, xHigh), function calling, поиск в интернете и X, запуск кода, дата отсечения знаний — май 2026 года.

По официальным бенчмаркам: на CursorBench 4.0 (продолжительные задачи в Cursor) Grok 4.7 набрала 46,3% против 40,4% у предшественника, 41,7% у GPT-5.6 Sol Max и 51,8% у Fable 5.1 Max. На DeepSWE v1.1 (реальные задачи в репозиториях) — 71,0% (GPT-5.6 Sol Max 72,7%, Fable 5.1 Max 70,0%, Grok 4.6 65,2%). На Terminal-Bench 4.0 — 38% (Grok 4.6 20,3%, GPT-5.6 Sol Max 37,3%, Fable 5.1 Max 57,9%). На EEBench (электротехника) — 64%, опередив всех трёх конкурентов из таблицы xAI. Важно: цифры опубликованы самим разработчиком, модели запускались в разных режимах (xHigh, High, Max).

Цены остались на уровне Grok 4.6: $2 за млн входных и $6 за млн выходных токенов. Для сравнения: GPT-5.6 Sol Max — $4/$20, Fable 5.1 Max — $10/$50. Появилась версия Fast (в 2 раза быстрее и дороже), пока доступная только в Cursor и Grok Build. Обычная версия доступна через xAI API, OpenRouter, Vercel, Cloudflare; в Grok Build стала моделью по умолчанию, в Cursor — на всех тарифах.

Безопасность: на тесте LatchBio (биология) — 62,4%, на HackerBench v0.3 пропущено 3,3% опасных запросов при редких ложных срабатываниях. Независимого подтверждения результатов нет. Итог: Grok 4.7 не лидирует во всех бенчмарках, но предлагает сильную комбинацию большого контекста, агентных инструментов и низкой цены, что для разработчиков может быть важнее пиковых показателей в тестах.

Похожие материалы

Лауреаты Филдсовской премии: ИИ-бенчмарки по математике убивают науку
Искусственный интеллект Математика Филдсовская премия LLM

Лауреаты Филдсовской премии: ИИ-бенчмарки по математике убивают науку

25 лауреатов Филдсовской премии предупреждают: использование решения математических задач как метрики качества …

Nvidia PAIR: объединяем ПК в локальный кластер для запуска ИИ-моделей
Nvidia ИИ локальный кластер LLM

Nvidia PAIR: объединяем ПК в локальный кластер для запуска ИИ-моделей

Nvidia выпустила открытый инструмент PAIR (Personal AI Router), объединяющий несколько компьютеров в …

Инженеры OpenAI не смогли объяснить код, сгенерированный Codex для AI-ускорителя Jalapeño
OpenAI Codex AI-ускорители генерация кода

Инженеры OpenAI не смогли объяснить код, сгенерированный Codex для AI-ускорителя Jalapeño

Аналитик SemiAnalysis Джордан Нанос сообщил, что инженеры OpenAI не могут построчно объяснить …

Официальная документация Python теперь доступна на русском языке
Python документация обучение программирование

Официальная документация Python теперь доступна на русском языке

Сообщество Python анонсировало перевод официальной документации на русский: доступны руководство и первые …