Небольшой AI-ассистент может расходовать всего несколько долларов в месяц на саму модель. Надёжный сервис для бизнеса стоит дороже: кто-то должен подготовить материалы, защитить доступ, проверять ответы и поддерживать информацию в актуальном состоянии. Сравнивать только цену токенов — всё равно что сравнивать расход электричества станка со стоимостью работы всей мастерской.
Для небольшого ассистента на сайте отправной точкой может стать примерный бюджет настройки от 1 500 до 5 000 евро, плюс хостинг, использование модели и регулярное сопровождение. Это редакционная оценка для описанного ниже объёма работ, а не статистика рынка и не коммерческое предложение LindenTech. Готовые стандартные продукты могут стоить меньше, индивидуальные интеграции — значительно больше.
Три категории расходов, которые должны быть в предложении
| Статья расходов | Что оплачивается | Возможный способ расчёта |
|---|---|---|
| Первоначальная настройка | Цели, подготовка базы знаний, конфигурация, подключение, тестирование и передача в работу | Разово или по этапам проекта |
| Техническая эксплуатация | Приложение, база данных, поиск, резервное копирование и мониторинг | Ежемесячная базовая плата плюс потребление |
| Использование и сопровождение | Вызовы модели, каналы сообщений, контроль качества и изменения | По потреблению, часам или согласованному пакету |
Низкая абонентская плата мало о чём говорит, если обновление документов всегда оплачивается отдельно или за каждую передачу диалога человеку берут дополнительную плату. И наоборот, более дорогой пакет необязательно невыгоден, если он действительно заменяет регулярную работу. Важно понимать полный состав услуги и её границы.
Какой диапазон настройки соответствует вашему проекту?
Следующие суммы намеренно обозначены как предположения для планирования в евро без НДС. Их можно проверить через условную трудоёмкость: 15–50, 50–150 и 150–400 часов соответственно при исключительно расчётной ставке 100 евро в час. Эта ставка не является опубликованным тарифом LindenTech.
| Пример объёма работ | Разовый ориентир бюджета | Принятые предположения |
|---|---|---|
| Ответы на вопросы посетителей сайта | 1 500–5 000 € | Один язык, готовые проверенные материалы, без запросов клиентских данных, простая передача обращения |
| Ассистент с одной интеграцией | 5 000–15 000 € | Дополнительно один документированный интерфейс, определённые права доступа и проверка рабочих сценариев |
| Индивидуальный ассистент для бизнес-процессов | 15 000–40 000 € и более | Несколько систем, роли, согласования, обработка ошибок и более сложные требования к эксплуатации |
Сюда, например, не входят очистка старых клиентских данных, комплексная юридическая консультация, разработка новых интерфейсов сторонних систем или круглосуточная работа сотрудников поддержки. Особенно важно согласовать эти пункты до фиксации цены. Количество PDF само по себе плохо отражает трудоёмкость: десять противоречащих друг другу прайс-листов могут потребовать больше работы, чем сто аккуратных справочных страниц.
Стоимость токенов: расчёт, который можно повторить
Для примера возьмём GPT-5 mini, не рекомендуя эту модель для любой задачи. Стандартный тариф, проверенный 10 сентября 2026 года, составляет 0,25 доллара США за миллион входных токенов и 2,00 доллара за миллион выходных токенов. Для повторно используемого входа есть более низкий тариф, но здесь мы его не применяем. Источник: официальная документация модели и тарифов.
Под «запросом» здесь понимается ровно один вызов модели, а не весь разговор. Предположим, что в среднем на инструкции, вопрос, историю и найденные фрагменты приходится 3 000 входных токенов, а на оплачиваемый выход — 600 токенов. В последнюю величину при необходимости должны входить и внутренние токены рассуждения: 600 видимых токенов ответа не были бы надёжной верхней границей расходов.
Стоимость запроса = (3 000 × 0,25 + 600 × 2,00) / 1 000 000 = 0,00195 USD.
Знаете свой объём? В калькуляторе в конце статьи можно изменить число вызовов и токенов.
| Вызовы модели в месяц | Входные токены | Выходные токены | Только расходы на модель в месяц |
|---|---|---|---|
| 500 | 1,5 млн | 0,3 млн | 0,975 USD, после округления 0,98 USD |
| 2 000 | 6 млн | 1,2 млн | 3,90 USD |
| 10 000 | 30 млн | 6 млн | 19,50 USD |
Это результаты расчёта при фиксированных предположениях, а не измеренные данные клиентов. Разговор из пяти таких вызовов будет стоить в пять раз больше. Поисковые инструменты, эмбеддинги, хранение файлов, голос, изображения, дополнительные вызовы модели, повторные попытки и плата за каналы не включены. Не учтены также налоги, конвертация валюты и платёжные комиссии. Поэтому мы не переводим доллары в евро с искусственной точностью.
Хостинг и сопровождение — отдельные строки бюджета
Следующая таблица — дополнительный редакционный пример бюджета, а не расчёт на основе тарифов провайдеров. Предполагается небольшое управляемое приложение с ограниченным объёмом данных, резервным копированием и базовым мониторингом, без гарантированного круглосуточного времени реакции. На сопровождение условно выделено от одного до трёх, от двух до шести и от четырёх до двенадцати часов в месяц по указанной выше расчётной ставке.
| Вызовы модели в месяц | Хостинг, база данных и поиск | Сопровождение и проверка материалов | Модель по нашему примеру |
|---|---|---|---|
| 500 | 20–80 € / месяц | 100–300 € / месяц | 0,98 USD / месяц |
| 2 000 | 40–150 € / месяц | 200–600 € / месяц | 3,90 USD / месяц |
| 10 000 | 100–400 € / месяц | 400–1 200 € / месяц | 19,50 USD / месяц |
Строки описывают три сценария планирования, а не технически обязательные ступени потребления. Хорошо настроенное приложение может обработать 10 000 вызовов и на более скромном тарифе хостинга. При этом большое количество одновременных запросов, крупные поисковые индексы или строгие требования к доступности способны повысить расходы даже при небольшом трафике. При самостоятельном сопровождении работа не исчезает — её выполняет ваша команда.
Когда это экономически оправданно?
Считайте подтверждённо высвобождённые минуты, а не количество выданных ответов. Пример: если 300 операций в месяц действительно занимают на четыре минуты меньше каждая, освобождается 20 часов. При условной полной внутренней стоимости часа 40 евро это соответствует 800 евро расчётного рабочего ресурса. Из результата нужно вычесть проверку, исправления и эксплуатацию. Свободное время ещё не означает такую же экономию денег на счёте.
Во время пилота сравнивайте похожие операции до и после внедрения. Учитывайте неверные ответы, прерванные чаты и необходимые уточнения. Бот, который якобы «закрывает» обращения, но затем вызывает дополнительные телефонные звонки, не улучшает результат.
Пять вопросов перед заказом
- Что считается запросом: сообщение, разговор, вызов модели или завершённая операция?
- Какие изменения, языки и объёмы документов включены?
- Каковы лимит расходов и резервный сценарий при перегрузке?
- Кто регулярно проверяет качество ответов и разбирает неясные случаи?
- Можно ли экспортировать материалы, конфигурацию и данные при смене провайдера?
С этими ответами коммерческие предложения можно сравнивать по существу. Подробнее о реализации — в разделе AI и автоматизация. Расчёт платы за каналы дополняет руководство по WhatsApp.
Тарифы и источники проверены 10 сентября 2026 года. Цены провайдеров могут меняться. Перед вложением средств сведите в один расчёт измеренное потребление, актуальный тариф и конкретный объём услуги.
Рассчитайте по своим условиям
Как меняются расходы на модель?
Один вызов модели считается одним запросом. В диалоге может быть несколько вызовов. Измените объём и среднее число токенов: расчёт выполняется полностью в вашем браузере.
Выходные токены включают оплачиваемые токены рассуждения, если они есть. На вход также передаются инструкции, история диалога и фрагменты документов.
GPT-5 mini: 0,25 USD за миллион входных токенов и 2,00 USD за миллион выходных. Проверено: 10 сентября 2026. Без скидки за кеширование, инструментов, хостинга, сопровождения, платы за каналы и налогов. Официальные тарифы.
