Kimi K3 vs Grok 4.5: цена против качества
Grok 4.5 от xAI (Илон Маск) и Kimi K3 от Moonshot AI вышли с разницей в 8 дней. Обе — топ-модели, но с разной философией: Grok делает ставку на цену, K3 — на качество. Кто кого?
Цены
| Метрика | Grok 4.5 | Kimi K3 |
|---|---|---|
| Input | $2 / млн токенов | $3 / млн токенов |
| Output | $6 / млн токенов | $15 / млн токенов |
| Контекст | 500K токенов | 1 млн токенов |
| Open-weight | Нет | Да (с 27 июля) |
Grok дешевле в 2 раза на output и в 1,5 раза на input. Но контекст — вдвое меньше.
Бенчмарки: разгром
Kimi K3 выигрывает по всем общим бенчмаркам:
| Бенчмарк | Grok 4.5 | Kimi K3 | Отрыв |
|---|---|---|---|
| DeepSWE | 62,0% | 67,5% | K3 +5,5 |
| Terminal-Bench 2.1 | 83,3% | 88,3% | K3 +5,0 |
| Next.js Evals | 83% | 92% | K3 +9,0 |
| GDPval-AA (Elo) | 1 535 | 1 685 | K3 +150 |
| BullshitBench v2 | 54% | 73% | K3 +19 |
Единственное, где Grok силён — Omniscience Accuracy (52,1% vs 46,0%). Но по интеллекту в целом (AA Index) K3 ведёт 57 vs 54.
Скорость и латентность
Grok 4.5 быстрее генерация (73 токен/с vs 62), но TTFT — 12,7 с против 2,0 с у K3. K3 начинает отвечать в 6 раз быстрее, что критично для чатов.
Итог
| Сценарий | Лучший выбор |
|---|---|
| Бюджет критичен, задачи простые | Grok 4.5 — вдвое дешевле |
| Нужно качество кода и агентов | Kimi K3 — выигрывает все бенчмарки |
| Длинный контекст (500K+) | Kimi K3 — 1M против 500K |
| Self-hosting / контроль данных | Kimi K3 — open-weight |
| Чат/интерактив (низкая TTFT) | Kimi K3 — 2с vs 13с |
Grok 4.5 — король цены. Kimi K3 — король качества. Если можете платить на $2-9 больше за миллион токенов — берите K3. Если считаете каждый цент — Grok не подведёт.