mimile
На главную

Grok 4.6 от SpaceXAI сравнялся с GPT-5.6 Sol от OpenAI и дешевле на 60%

AI-дайджест

Материал подготовлен искусственным интеллектом на основе нескольких источников — ссылки на оригиналы приведены ниже.

Grok 4.6 от SpaceXAI сравнялся с GPT-5.6 Sol от OpenAI и дешевле на 60%

Grok 4.6 от SpaceXAI набрал 61 балл в индексе Artificial Analysis, сравнявшись с GPT-5.6 Sol от OpenAI и уступив лишь Claude Opus 5 и Claude Fable 5 от Anthropic. Модель доступна по цене $2 за миллион входных токенов и $6 за миллион выходных — более чем на 60 процентов ниже, чем у флагманов OpenAI и Anthropic. На бенчмарке агентных задач GDPval-AA v2 она занимает второе место, выполняя сложные задачи примерно за 53 шага против 103 у Claude Opus 5.

Показатели бенчмарков

Grok 4.6 от SpaceXAI набирает 61 балл в индексе Artificial Analysis Intelligence — столько же, сколько GPT-5.6 Sol от OpenAI, и на один балл меньше Claude Fable 5 от Anthropic. Выше только Claude Opus 5 (63) и Claude Fable 5 (62). По сравнению с предыдущей версией Grok 4.5 прирост составил пять баллов. Wccftech охарактеризовал уровень модели как сопоставимый с Fable 5, что подтверждают данные индекса, приведённые The Decoder.

Цены и доступность

Grok 4.6 выходит по цене $2 за миллион входных токенов и $6 за миллион выходных, без изменений по сравнению с Grok 4.5. По данным The Decoder, это более чем на 60 процентов дешевле Claude Opus 5 ($5/$25) и GPT-5.6 Sol ($5/$30). Wccftech в заголовке назвал скидку 80-процентной, но в тексте база сравнения не раскрыта. Модель уже доступна через API, Cursor, Grok Build и партнёров OpenRouter, Vercel и Cloudflare. В первую неделю x.ai удваивает квоту использования в Grok Build и Cursor.

Агентные задачи

На бенчмарке GDPval-AA v2, оценивающем реальную работу с компьютером, Grok 4.6 занимает второе место с рейтингом Эло 1 753, уступая лишь Claude Opus 5. Сложные задачи модель выполняет примерно за 53 шага, тогда как Claude Opus 5 требуется около 103. Это различие усиливает позиции SpaceXAI в многошаговых агентных сценариях, где, по оценке The Decoder, Grok 4.6 особенно силён.

Что дальше

Ближайшая проверка — устойчивое использование модели разработчиками на партнёрских платформах OpenRouter, Vercel и Cloudflare. Пока неясно, ответят ли Anthropic или OpenAI снижением цен либо новыми релизами на ценовое преимущество Grok 4.6.

2 источника

Grok 4.6 от SpaceXAI сравнялся с GPT-5.6 Sol от OpenAI и дешевле на 60%