xAI выпустила Grok 4.5: 1,5 трлн параметров MoE, 83,3% на Terminal-Bench 2.1
xAI выпустила Grok 4.5 — Mixture-of-Experts модель с 1,5 трлн параметрами, обученную в том числе на данных взаимодействий Cursor IDE. На Terminal-Bench 2.1 Grok 4.5 набрал 83,3%, используя на 75% меньше output-токенов, чем Opus 4.8 на аналогичных задачах. Доступ через SuperGrok Heavy — $99/мес. промо, $149/мес. стандарт.
xAI (компания Илона Маска) выпустила Grok 4.5 — следующее поколение флагманской модели, впервые построенное на архитектуре Mixture-of-Experts (MoE) с колоссальным числом параметров.
Технические характеристики:
| Параметр | Grok 4.5 |
|---|---|
| Архитектура | Mixture-of-Experts (MoE) |
| Общее число параметров | 1,5 трлн |
| Данные для дообучения | Cursor IDE interactions |
| Terminal-Bench 2.1 | 83,3% (новый лидер) |
| Token efficiency vs Opus 4.8 | –75% output токенов |
Ценообразование:
| Тариф | Цена | Включает |
|---|---|---|
| SuperGrok Heavy (промо) | $99/мес. | Grok 4.5, Grok Build, высокие лимиты |
| SuperGrok Heavy (стандарт) | $149/мес. | То же после промо-периода |
| Доступ через X.com | Платный | Ограниченные использования |
Ключевое преимущество — токенная эффективность: Grok 4.5 решает кодинговые задачи примерно на 75% более коротким ответом, чем Opus 4.8, при сопоставимом качестве. Для enterprise, платящих за токены, это значительная экономия в batch-обработке кода.
Конкурентная таблица (кодинг, конец июля 2026):
| Модель | Terminal-Bench 2.1 | Провайдер |
|---|---|---|
| Grok 4.5 | 83,3% | xAI |
| Claude Opus 5 | ~80% | Anthropic |
| GPT-5.6 Sol | ~79% | OpenAI |
Обучение на Cursor: Grok 4.5 стал первой крупной моделью, прошедшей специализированное дообучение на данных реального программирования из IDE Cursor. Это объясняет выдающиеся результаты на терминальных задачах.
Для российского IT:
- Grok 4.5 доступен через x.com — доступность из РФ зависит от VPN
- Для легальных AI-агентов в РФ: GigaCode (Сбер), Cotype (МТС) — локализованные альтернативы для кодинга
- MoE-архитектура с 1,5T параметрами — ориентир для будущих российских моделей (GigaChat Ultra 2.0 анонсирован на Q4 2026)
Это краткое изложение. Полный текст статьи доступен на сайте источника:
Читать полностью на ThursdAI / Zack Tech VenturesЕщё по теме ai-трансформация
Fable 5.1 лидирует в Real-SWE бенчмарке с 38,8% против GPT-6 Astra (33,8%) и Gemini 3.8 Flash (31,2%)
Meta разворачивает «плоскую» организацию Applied AI: IC-сотрудников просят вернуться в роль менеджеров
DeepSeek выпустила V4.1-Flash и продлила API DeepSeek V4 Pro после 14 сентября 2026
Хотите узнать, как это применимо к вашему бизнесу?
Рассчитаем ROI от AI за 60 минут. Покажем конкретные метрики для вашей отрасли.
