Разбор · 23 сентября 2026

Сколько стоит интеллект

Короткий ответ: качественный интеллект подешевел в разы, и продолжает дешеветь. Длинный — интереснее. Мы посчитали не тарифы из прайсов, а свой собственный счёт за месяц работы четырнадцати цифровых сотрудников. И там главная статья расхода оказалась не там, где её ждут.

Флагман: минус 15 раз за три с половиной года

В марте 2023 года GPT-4 стоил $30 за миллион входящих токенов и $60 за исходящие. Контекст — 8 192 токена, то есть примерно десять страниц текста.

В сентябре 2026-го модель того же класса, Claude Sonnet 5, стоит $2 и $10, а контекст у неё — миллион токенов. Вход подешевел в 15 раз, выход — в 6, а памяти в одном разговоре стало больше в 122 раза.

Нижняя граница рабочего класса ещё ниже. На 21 сентября в каталоге OpenRouter 417 моделей с ценой; самые дешёвые из тех, что реально тянут работу: DeepSeek V4 Flash — $0,04 за миллион входящих, Qwen3.7 Flash — $0,03. Это в 750 раз дешевле флагмана 2023 года.

Наш счёт: 1 243 хода за $112,62

Прайсы — это тарифы. Работа — это другое. Вот наш журнал биллинга за 30 дней: четырнадцать цифровых сотрудников сделали 1 243 рабочих хода на $112,62. Средний ход — $0,091.

Цена одного рабочего хода по моделям: от $0,0074 до $0,215
Замер 21.09.2026. Один и тот же рабочий ход у разных моделей.

Разброс важнее среднего. Ход на deepseek-v4-flash стоит $0,0074, ход на grok-4.6 — $0,215. Разница в 29 раз, и обе модели живые, обе сегодня в деле.

Дорог не интеллект. Дорога память

Самое неожиданное в наших цифрах — вот это. Сутки работы одного агента, который держит в голове весь бизнес, стоят $467,90 по прайсу API. Сутки всех четырнадцати директоров вместе — $3,75. Разница в 125 раз.

Цена суток работы: один агент с полной памятью $467,90 против всех директоров $3,75
Расход директоров за 30 дней приведён к суткам. Замер 21.09.2026.

Разница не в уме модели. Директор отвечает на вопрос клиента и забывает; агент с полной памятью тащит в каждый ход всю историю дела. У дешёвого deepseek в нашем журнале 61 тысяча входящих токенов на ход — это и есть память разговора, и платим мы именно за неё.

Вывод, который стоит денег

Дешёвый ИИ — это не «возьмите модель попроще». Это «дайте каждому агенту ровно столько памяти и мощности, сколько требует его работа». Короткая инструкция экономит больше, чем смена модели.

Подписка или токены: та самая экономика

Вопрос, который мы объясняем чаще всего. Разница простая:

ПодпискаТокены
Считается людьми: один человек — одна подпискаСчитаются задачами: платишь за работу, а не за место
Фиксированная плата, потолок по нагрузкеСчёт растёт вместе с объёмом работы
Выгодна, пока работу делает человек рукамиВыгодны, когда агент работает и ночью

Рынок уже двинулся дальше, к третьей мере — плате за результат. Fin от Intercom берёт $0,99 за решённый разговор, а не за место и не за токены: платится один исход на разговор, даже если агент сделал внутри него несколько действий. Zendesk тоже считает «автоматические решения», хотя цену публично не называет.

Статья вышла на следующий день после ценовой войны. 22 сентября Anthropic выпустила Claude Opus 5.5 на 20% дешевле предшественника, а чтение из памяти подешевело сразу на 60%. Рынок подтвердил главное: дорога не модель, дорога память, и она дешевеет быстрее всего.

Что это значит для вашего дела

Хотите посчитать это на своём деле?

Напишите нам — покажем, во что обойдётся цифровой сотрудник именно в вашей работе.

t.me/mila_tashkent_bot

Все цифры проверены 21–22 сентября 2026 года: цены моделей — вызовом каталога OpenRouter, наш расход — журналами биллинга, цена Fin — страницей тарифов вендора. Цены меняются часто; если читаете это сильно позже, сверьтесь с первоисточником.