Оплата за нейросети устроена не как подписка, а как счётчик такси: вы платите за объём обработанного текста, измеренный в токенах. Понимание того, что такое токен и как формируется цена, помогает прогнозировать расходы и экономить в разы. Разбираемся по порядку.
Что такое токен
Токен — это кусочек текста, которым оперирует модель. Это не буква и не слово, а что-то среднее: частое слово может быть одним токеном, а редкое или длинное — разбиться на несколько.
- Для английского текста: 1 токен ≈ 4 символа или ≈ 0,75 слова.
- Для русского текста токенов уходит больше — кириллица «дороже», ориентируйтесь на 2–3 символа на токен.
- Знаки препинания, пробелы и переносы строк тоже считаются.
Из чего складывается стоимость запроса
Каждый запрос тарифицируется по двум ставкам, которые почти всегда различаются:
- Input (входные токены) — всё, что вы отправляете модели: системный промпт, история диалога, ваш вопрос и вложенные данные.
- Output (выходные токены) — то, что модель генерирует в ответ. Обычно стоит в 3–5 раз дороже входных.
Стоимость = (input-токены × цена за input) + (output-токены × цена за output). Цены указывают за 1 миллион токенов.
Пример расчёта
Допустим, вы делаете чат-бота поддержки. Средний запрос: 500 токенов на входе (промпт + вопрос) и 300 на выходе (ответ). Пусть модель стоит условно 200 ₽ за миллион input и 800 ₽ за миллион output.
| Показатель | Значение |
|---|---|
| Input | 500 токенов × 200 ₽ / 1M = 0,10 ₽ |
| Output | 300 токенов × 800 ₽ / 1M = 0,24 ₽ |
| Один диалог | ≈ 0,34 ₽ |
| 10 000 диалогов/мес | ≈ 3 400 ₽ |
Как снизить расходы на API
Не гоняйте флагман там, где справится дешёвая модель. Разница в цене между GPT-5.6 и GPT-5-nano — кратная.
Убирайте лишний контекст и историю. Каждое сообщение в диалоге — это input-токены в каждом следующем запросе.
Параметр max_tokens не даст модели генерировать лишнее — а output дороже input.
Одинаковые запросы храните у себя, чтобы не платить за повторную генерацию.
На zapros.ai вы тарифицируетесь по фактической стоимости запроса, а расход по каждому ключу и модели виден в личном кабинете. Никаких скрытых списаний и абонентской платы.
Сколько закладывать в бюджет
Практическое правило: начните со 100–500 ₽, снимите реальную статистику по своим запросам за пару дней и умножьте на ожидаемый объём. Так вы получите точный прогноз вместо гадания по прайсу.
Почему русский текст дороже английского?+
Токенизаторы моделей исторически оптимизированы под английский. Кириллица разбивается на большее число токенов, поэтому один и тот же по смыслу текст на русском стоит дороже.
Плачу ли я за системный промпт каждый раз?+
Да. Системный промпт и вся переданная история отправляются с каждым запросом и считаются как input-токены. Поэтому длинные промпты стоит оптимизировать.
Есть ли абонентская плата?+
На zapros.ai — нет. Вы платите только за использование, баланс списывается по факту запросов.
Считайте расходы честно
Прозрачная тарификация по токенам, детальная статистика в кабинете, пополнение от 100 ₽. Начните с малого и масштабируйтесь.
Смотреть цены на модели
zapros.ai