Разбор · 23 сентября 2026
Сколько стоит интеллект
Короткий ответ: качественный интеллект подешевел в разы, и продолжает дешеветь. Длинный — интереснее. Мы посчитали не тарифы из прайсов, а свой собственный счёт за месяц работы четырнадцати цифровых сотрудников. И там главная статья расхода оказалась не там, где её ждут.
Флагман: минус 15 раз за три с половиной года
В марте 2023 года GPT-4 стоил $30 за миллион входящих токенов и $60 за исходящие. Контекст — 8 192 токена, то есть примерно десять страниц текста.
В сентябре 2026-го модель того же класса, Claude Sonnet 5, стоит $2 и $10, а контекст у неё — миллион токенов. Вход подешевел в 15 раз, выход — в 6, а памяти в одном разговоре стало больше в 122 раза.
Нижняя граница рабочего класса ещё ниже. На 21 сентября в каталоге OpenRouter 417 моделей с ценой; самые дешёвые из тех, что реально тянут работу: DeepSeek V4 Flash — $0,04 за миллион входящих, Qwen3.7 Flash — $0,03. Это в 750 раз дешевле флагмана 2023 года.
Наш счёт: 1 243 хода за $112,62
Прайсы — это тарифы. Работа — это другое. Вот наш журнал биллинга за 30 дней: четырнадцать цифровых сотрудников сделали 1 243 рабочих хода на $112,62. Средний ход — $0,091.
Разброс важнее среднего. Ход на deepseek-v4-flash стоит $0,0074, ход на grok-4.6 — $0,215. Разница в 29 раз, и обе модели живые, обе сегодня в деле.
Дорог не интеллект. Дорога память
Самое неожиданное в наших цифрах — вот это. Сутки работы одного агента, который держит в голове весь бизнес, стоят $467,90 по прайсу API. Сутки всех четырнадцати директоров вместе — $3,75. Разница в 125 раз.
Разница не в уме модели. Директор отвечает на вопрос клиента и забывает; агент с полной памятью тащит в каждый ход всю историю дела. У дешёвого deepseek в нашем журнале 61 тысяча входящих токенов на ход — это и есть память разговора, и платим мы именно за неё.
Вывод, который стоит денег
Дешёвый ИИ — это не «возьмите модель попроще». Это «дайте каждому агенту ровно столько памяти и мощности, сколько требует его работа». Короткая инструкция экономит больше, чем смена модели.
Подписка или токены: та самая экономика
Вопрос, который мы объясняем чаще всего. Разница простая:
| Подписка | Токены |
|---|---|
| Считается людьми: один человек — одна подписка | Считаются задачами: платишь за работу, а не за место |
| Фиксированная плата, потолок по нагрузке | Счёт растёт вместе с объёмом работы |
| Выгодна, пока работу делает человек руками | Выгодны, когда агент работает и ночью |
Рынок уже двинулся дальше, к третьей мере — плате за результат. Fin от Intercom берёт $0,99 за решённый разговор, а не за место и не за токены: платится один исход на разговор, даже если агент сделал внутри него несколько действий. Zendesk тоже считает «автоматические решения», хотя цену публично не называет.
Статья вышла на следующий день после ценовой войны. 22 сентября Anthropic выпустила Claude Opus 5.5 на 20% дешевле предшественника, а чтение из памяти подешевело сразу на 60%. Рынок подтвердил главное: дорога не модель, дорога память, и она дешевеет быстрее всего.
Что это значит для вашего дела
- Считайте не цену модели, а цену одного рабочего хода — и смотрите на разброс, а не на среднее.
- Самый быстрый способ сократить счёт — укоротить память там, где она не нужна.
- Ставьте большую модель туда, где решение дорогое, и маленькую туда, где ход повторяется сто раз в день.
- Гении становятся доступны не тем, у кого больше бюджет, а тем, кто умеет собрать из них команду и дать каждому свою работу.
Хотите посчитать это на своём деле?
Напишите нам — покажем, во что обойдётся цифровой сотрудник именно в вашей работе.
t.me/mila_tashkent_botВсе цифры проверены 21–22 сентября 2026 года: цены моделей — вызовом каталога OpenRouter, наш расход — журналами биллинга, цена Fin — страницей тарифов вендора. Цены меняются часто; если читаете это сильно позже, сверьтесь с первоисточником.