SpaceXAI выпустила Grok 4.6 для ИИ-агентов
SpaceXAI выпустила модель Grok 4.6 для длинных многошаговых задач ИИ-агентов. Ее разрабатывали для долгоработающих агентов, которые работают с кодовой базой, создают приложения, анализируют данные, исследуют темы и выполняют интерактивные визуальные сценарии. Модель уже доступна в Cursor, CLI-агенте Grok Build, API и через OpenRouter, Vercel и Cloudflare.
В сводном индексе Artificial Analysis Intelligence Index, который учитывает девять бенчмарков, Grok 4.6 набрала 61 балл. Для сравнения, у GPT-5.6 Sol столько же, а у Fable 5 с максимальным уровнем рассуждений 62 балла. На бенчмарке GDPval-AA с реальными рабочими задачами из 44 профессий модель получила 1753 балла против 1741 у Fable 5 и 1728 у GPT-5.6 Sol.
В наборе DeepSWE на длинные задачи по разработке ПО Grok 4.6 справилась с 65,9% заданий. У Fable 5 и GPT-5.6 Sol показатели составили 70% и 73% соответственно, поэтому в чистом кодинге модель пока уступает лидерам. Стоимость API составит 2 доллара за 1 млн входных токенов и 6 долларов за 1 млн выходных, а ускоренная версия обойдется вдвое дороже базовой.
Grok 4.6 продолжает линейку моделей xAI, которую компания развивает совместно с инструментами для разработчиков. Ранее Cursor представила модель Grok 4.5 в начале июля 2026 года, а новая версия усиливает сценарии для агентов, которым нужны длинные цепочки действий в коде, данных и интерфейсах.
Для разработчиков и команд Grok 4.6 расширяет выбор моделей под агентную разработку и автоматизацию рутины в коде и данных. В проектах, где искусственный интеллект помогает в создании сайтов и приложений, модель может конкурировать с флагманами OpenAI и Anthropic по рабочим бенчмаркам, хотя в DeepSWE пока уступает лидерам рынка в августе 2026 года.