MAATRIX / Блог / Как поднять AI-ассистента в Telegram на сервере

Как поднять AI-ассистента в Telegram на сервере

Как поднять AI-ассистента в Telegram на сервере

MAATRIX

Личный ассистент в мессенджере, который отвечает на вопросы, разбирает документы и помогает с текстами прямо в переписке, — удобнее любого веб-интерфейса. AI-ассистент в Telegram на сервере собирается за вечер: бот принимает сообщения, передаёт их модели и возвращает ответ. Разберём по шагам, из чего он состоит, какой сервер нужен, как выбрать модель и как встроить память диалога и безопасность.

Обсудить статью, задать вопрос или начать новую тему

Есть вопрос по этой статье, идея для обсуждения или просто хотите поделиться опытом? Сообщество MAATRIX ждёт. Для общения, пожалуйста, зарегистрируйтесь в нашем личном кабинете.

Перейти в сообщество →

Что такое AI-ассистент в Telegram

AI-ассистент в Telegram — это бот, за которым стоит языковая модель. Пользователь пишет боту как обычному собеседнику, бот передаёт сообщение модели, получает ответ и отправляет его обратно в чат. Снаружи это выглядит как переписка с умным помощником, а внутри — связка из трёх частей: бот Telegram, ваш серверный код-логика и модель, которая генерирует ответы.

Такой ассистент удобнее веб-чатов тем, что он всегда под рукой в привычном мессенджере, работает на всех устройствах через один аккаунт и не требует отдельного приложения. К нему легко добавить полезные функции: память диалога, ответы по вашим документам, обработку голосовых сообщений, работу в группах. По сути вы получаете персонального ChatGPT в Telegram, полностью под вашим контролем.

Модель за ботом может быть облачной или своей. Облачная (через API OpenAI, Anthropic) даёт максимальное качество без своего железа, но требует зарубежного доступа и оплаты токенов. Своя локальная модель через Ollama обеспечивает приватность и отсутствие оплаты за токены, но требует GPU. Выбор зависит от приоритетов — качество и простота или приватность и независимость.

Какой сервер нужен

Требования к серверу зависят от выбора модели. Если ассистент работает на облачном API, сервер нужен минимальный: 1–2 ядра, 1–2 ГБ RAM. Логика бота почти не нагружает железо, вся тяжёлая работа идёт на стороне провайдера модели. GPU в этом случае не нужен. Единственный нюанс — доступ: зарубежные AI-API недоступны из России напрямую, поэтому сервер разумно разместить в США ради чистого IP и стабильного доступа к модели.

Если же вы хотите приватного ассистента на своей модели, нужен GPU-сервер. Объём VRAM определяет размер модели: 7–8B требуют около 5–6 ГБ, 13B — порядка 10 ГБ. Для личного ассистента модели среднего размера более чем достаточно, и карта на 8–12 ГБ их уверенно тянет. Тогда все диалоги остаются на вашем сервере, а платить за токены не нужно.

У MAATRIX подходят оба варианта: обычный VPS в США под облачную модель и GPU-сервер под локальную, оба с оплатой из России картой, СБП или криптой. Начните с того, что ближе вашим задачам, — простой бот на облачной модели поднимается на дешёвом VPS, а приватного ассистента на своей модели разворачивают на GPU-сервере.

Нужен сервер под эту задачу?

Разверните VPS MAATRIX за пару минут: NVMe, AMD EPYC, root-доступ, локации UK, США и РФ. Оплата картой РФ и по СБП.

Арендовать VPS

Создание бота и подключение

Начните с регистрации бота в Telegram: напишите служебному боту BotFather, создайте нового бота и получите токен доступа — это ключ, которым ваш код управляет ботом. Храните токен в секрете, он даёт полный контроль над ботом. Дальше готовим серверную часть — логику на Python или Node.js с использованием библиотеки для Telegram:

apt update && apt install -y python3-venv python3-pip
python3 -m venv venv && source venv/bin/activate
pip install python-telegram-bot

Логика бота устроена просто: он получает сообщение пользователя, формирует запрос к модели (с системным промптом и историей диалога), отправляет его в API модели и возвращает ответ в чат. Для облачной модели вы указываете её API-ключ, для локальной — адрес Ollama. Уже на этом этапе у вас работающий ассистент, отвечающий на сообщения.

Задайте боту роль через системный промпт — это определяет его характер и специализацию: универсальный помощник, консультант по конкретной теме, редактор текстов. Хорошо описанная роль делает ассистента предсказуемым и полезным именно под ваши задачи, а не абстрактной болталкой.

Память диалога и функции

Чтобы ассистент был удобным, он должен помнить контекст беседы, а не отвечать на каждое сообщение с нуля. Для этого логика хранит историю диалога для каждого пользователя и передаёт её модели вместе с новым сообщением. Тогда бот понимает отсылки к сказанному ранее и ведёт связный разговор. Историю разумно ограничивать по длине, чтобы не раздувать запрос и не превышать контекст модели.

Поверх базового ассистента легко добавить полезные функции. Обработка документов: пользователь присылает файл, бот извлекает текст и отвечает по нему. Голосовые сообщения: связка с Whisper переводит речь в текст, и ассистент отвечает на надиктованный вопрос. Ответы по базе знаний: подключив поиск по вашим документам (RAG), бот отвечает фактами из ваших инструкций и материалов, а не общими словами.

Эти функции превращают простого бота в полноценного рабочего инструмента. Для команды ассистента добавляют в группу, где он помогает всем участникам, или настраивают под конкретные задачи отдела. Каждая функция — это дополнительный шаг в логике бота, а ядро (модель плюс обработка сообщений) остаётся общим.

Вебхуки и стабильная работа

Бот получает сообщения двумя способами. Long polling — код сам регулярно спрашивает Telegram о новых сообщениях; это проще в настройке и годится для старта. Вебхук — Telegram сам присылает сообщения на ваш публичный HTTPS-адрес; это эффективнее для нагрузки и рекомендуется для продакшена. Для вебхука нужен домен с сертификатом:

apt install -y nginx certbot python3-certbot-nginx
certbot --nginx -d bot.ваш-домен.ru

Nginx проксирует запросы Telegram на локальный порт вашей логики, а сертификат обеспечивает обязательный для вебхуков HTTPS. Оформите логику бота на автозапуск как системный сервис, чтобы ассистент поднимался после перезагрузки сервера сам и работал бесперебойно. Для локальной модели так же оформляют автозапуск Ollama.

Следите за стабильностью: обрабатывайте ошибки, чтобы сбой на одном сообщении не ронял бота целиком, и логируйте обращения для отладки. При росте числа пользователей продумайте очередь запросов к модели, особенно если модель локальная и карта обрабатывает запросы последовательно. Нарастить сервер у MAATRIX можно из панели с оплатой из России, если аудитория ассистента вырастет.

Безопасность и приватность

Ассистент в Telegram требует внимания к безопасности. Токен бота и ключи API держите только на сервере в защищённой конфигурации, никогда не в открытом коде и не в репозитории — их утечка отдаёт бота и ваш баланс чужим. Ограничьте доступ к боту, если он личный или командный: проверяйте ID пользователей и отвечайте только своим, иначе посторонние будут расходовать ваши ресурсы, найдя бота.

Приватность зависит от модели. С локальной моделью через Ollama все диалоги остаются на вашем сервере и никуда не уходят — это важно для работы с чувствительной информацией. С облачной моделью сообщения проходят через провайдера, что стоит учитывать для конфиденциальных данных. Многие совмещают: приватные вопросы через локальную модель, сложные — через облачную.

Настройте разумные ограничения частоты, чтобы защититься от спама и перегрузки, и следите за расходом, если модель облачная. Собрать приватного AI-ассистента в Telegram на своей модели у MAATRIX можно на GPU-сервере, а простого бота на облачной модели — на недорогом VPS в США, оба с привычной оплатой из России. В итоге вы получаете умного помощника прямо в мессенджере, полностью под вашим контролем.

Нужен сервер под эту задачу?

Разверните VPS MAATRIX за пару минут: NVMe, AMD EPYC, root-доступ, локации UK, США и РФ. Оплата картой РФ и по СБП.

Арендовать VPS

Обсудить статью, задать вопрос или начать новую тему

Есть вопрос по этой статье, идея для обсуждения или просто хотите поделиться опытом? Сообщество MAATRIX ждёт. Для общения, пожалуйста, зарегистрируйтесь в нашем личном кабинете.

Перейти в сообщество →

Частые вопросы

Нужен ли GPU для ассистента в Telegram?

Зависит от модели. На облачном API хватит обычного VPS без GPU. Для приватной локальной модели через Ollama нужен GPU-сервер с 8–12 ГБ VRAM под модели на 7–13B.

Как сделать, чтобы бот помнил разговор?

Логика хранит историю диалога для каждого пользователя и передаёт её модели вместе с новым сообщением, ограничивая по длине. Тогда ассистент ведёт связную беседу, а не отвечает с чистого листа.

Можно ли обрабатывать голос и документы?

Да: голос переводит в текст связка с Whisper, документы бот принимает файлом и отвечает по их содержимому. Эти функции добавляются как шаги в логике бота.

Как оплатить сервер из России?

У MAATRIX доступна оплата картой российского банка, по СБП, криптовалютой и токеном MAAT, зарубежная карта не требуется.

Нужны сами нейросети для контента?

Генерируйте изображения, видео и озвучку нейросетями на falapi.io — десятки моделей в одном окне. Оплата картой РФ и по СБП.