Стоимость по уровням использования
Каждая ячейка: жирным — стоимость по API, курсивом — подписка на этот объём. ★ у названия модели — лучший баланс цены и возможностей.
| Модель input / cache / output за 1M |
Новичок ~1–10M токенов / мес |
Базовый 10–50M токенов / мес |
Активный 50–200M токенов / мес |
Power User 200–800M токенов / мес |
Профи 800M–4B токенов / мес |
|---|---|---|---|---|---|
| Сценарий использования | 1–3 запроса в день через веб-интерфейс | Автокомплиты, эпизодический чат, Copilot от случая к случаю | Ежедневное использование: тексты, анализ, ChatGPT Plus / Claude Pro | Агентные циклы, Sonnet-tier, ежедневная разработка с Claude Code / Cursor | Мульти-агентные пайплайны, Opus-tier, автономные агенты с subagents |
|
Claude Sonnet 4.6
$3.0 / $0.3 / $15.0 за 1M
|
$8–83 Free ($0) |
$60–302 Pro ($20) |
$216–864 Pro ($20) |
$419–2K Max 5x ($100) |
$502–3K Max 20x ($200) |
|
Claude Opus 4.7
$5.0 / $0.5 / $25.0 за 1M
|
$14–138 Free ($0) |
$101–503 Pro ($20) |
$360–1K Pro ($20) |
$699–3K Max 5x ($100) |
$836–4K Max 20x ($200) |
|
GPT 5.4
$2.5 / $0.25 / $15.0 за 1M · 1.1M ctx
|
$8–80 Free / Go ($5) |
$58–289 Plus ($20) |
$205–820 Plus ($20) |
$389–2K Pro ($100) |
$448–2K Pro ($100) |
|
GPT 5.5
$5.0 / $0.5 / $30.0 за 1M
|
$16–160 Free / Go ($5) |
$116–578 Plus ($20) |
$410–2K Plus ($20) |
$779–3K Pro ($100) |
$896–4K Pro ($100) |
|
DeepSeek V4 Flash
$0.14 / $0.0028 / $0.28 за 1M
|
$0.20–2 |
$2–8 |
$6–23 |
$11–45 |
$10–49 |
|
DeepSeek V4 Pro
$0.435 / $0.003625 / $0.87 за 1M
|
$0.61–6 |
$5–24 |
$17–70 |
$34–138 |
$27–134 |
|
Kimi K2.6
$0.95 / $0.16 / $4.0 за 1M · 262K ctx
|
$2–23 Adagio ($0) |
$17–85 Moderato ($15) |
$62–249 Allegretto ($31) |
$130–519 Allegro ($79) |
$199–995 Vivace ($159) |
Как архитектура влияет на стоимость
Каждый шаг усложнения AI-системы умножает потребление токенов на один пользовательский запрос. Таблица показывает множители и итоговую стоимость в месяц.
| Архитектура | Множитель токенов | Примерная стоимость в месяц | Риск |
|---|---|---|---|
| Простой чат-бот | 1× база | ~$10 | Низкий |
| С RAG | 3–5× | $30–50 | Средний |
| Агентный (1 шаг) | 5–10× | $50–100 | Высокий |
| Многошаговый агентный | 10–20× | $100–200 | Очень высокий |
| Агент мониторинга 24/7 | ∞ (непрерывно) | $500–2,000+ | Критический |
Почему агентная разработка стоит в 1 000 раз дороже обычного чата
Microsoft Research проанализировала потребление токенов AI-агентами на задачах SWE-bench (стандартный бенчмарк для coding agents). Разница между простым запросом «напиши функцию» и полноценным агентом, который сам ищет файлы, правит код, запускает тесты и исправляет ошибки — три порядка.
Источник →
Реальные кейсы
Выводы (апрель–май 2026)
- Разброс 20× между начальным и продвинутым пользователем одного инструмента. Два разработчика на одной платформе могут отличаться в 20× по стоимости (LeanOps).
- Агентные системы = множитель 10–30× против простого чата (Gartner, март 2026). Простые мульти-шаговые агентные циклы тратят в 10–20× больше токенов на одну задачу.
- Маршрутизация моделей экономит 60–70% — направление простых запросов на бюджетные модели не снижает качество на рутинных задачах, но сокращает счёт в 2–3 раза.
- Prompt caching снижает реальную плату — 96% токенов у профи Claude Code пришлось на cache reads. API-счёт гораздо ниже, чем следует из сырого числа токенов.
- Обновление модели может удвоить счёт — Opus 4.6 → 4.7 добавил +46% токенов (новый токенизатор) и +190% output на turn (adaptive thinking). Одному пользователю это стоило +$25K в месяц.
- Убывающая отдача после оптимума — пользователи среднего уровня (p25–p75) лучше всех конвертируют токены в PR. Верхние 5% по затратам потребляют без пропорционального результата.
- Медианный разработчик: ~$50–500/мес. Power User: $400–1,000/мес. Профи: $1,500–4,200+/мес. Выбросы: до $77K/мес (но это единичные случаи).