ИИ чат-поддержка на сайте через свой VPS
Умный чат снимает с поддержки поток типовых вопросов и отвечает клиентам круглосуточно. Соберём такую поддержку на VPS: бэкенд с ИИ, база знаний и виджет на сайт.
Содержание
Обсудить статью, задать вопрос или начать новую тему
Есть вопрос по этой статье, идея для обсуждения или просто хотите поделиться опытом? Сообщество MAATRIX ждёт. Для общения, пожалуйста, зарегистрируйтесь в нашем личном кабинете.
Перейти в сообщество →Что даёт ИИ-поддержка на сайте
ИИ-виджет отвечает мгновенно и круглосуточно, разгружая операторов от повторяющихся вопросов о доставке, тарифах и статусе заказа. Клиент получает ответ сразу, а не ждёт менеджера.
Держать бэкенд на своём VPS выгоднее готовых SaaS: нет абонентки за каждого оператора, база знаний и переписка остаются у вас. VPS MAATRIX с NVMe отдаёт ответы быстро, а зарубежная локация нужна для доступа к ИИ-API.
Ещё один плюс своего решения — гибкость. Готовые виджеты навязывают свой дизайн, лимиты и логику, а свой бэкенд вы затачиваете под реальные сценарии: подключаете CRM, показываете статус заказа, передаёте диалог живому оператору с полной историей. Начать можно с простого чата на пару вопросов, а потом наращивать функции, не переезжая на другую платформу.
Нужен сервер под эту задачу?
Разверните VPS MAATRIX за пару минут: NVMe, AMD EPYC, root-доступ, локации UK, США и РФ. Оплата картой РФ и по СБП.
Арендовать VPS для ИИ-поддержкиАрхитектура решения
Схема простая и надёжная:
- Виджет — JS-скрипт на страницах сайта
- Бэкенд — FastAPI на VPS, принимает вопрос, ходит в LLM
- База знаний — ваши статьи и FAQ для RAG
- LLM — локальная модель или внешний API
Нужны сами нейросети для контента?
Генерируйте изображения, видео и озвучку нейросетями на falapi.io — десятки моделей в одном окне. Оплата картой РФ и по СБП.
Бэкенд на FastAPI
Установите зависимости и поднимите API:
python3 -m venv ~/venv && source ~/venv/bin/activate
pip install fastapi uvicorn openai
from fastapi import FastAPI
from pydantic import BaseModel
from openai import OpenAI
app = FastAPI()
ai = OpenAI(api_key="...", base_url="http://127.0.0.1:11434/v1")
SYS = "Ты вежливый ассистент поддержки. Отвечай кратко и по делу."
class Q(BaseModel):
text: str
@app.post("/ask")
def ask(q: Q):
r = ai.chat.completions.create(model="qwen2.5:7b",
messages=[{"role": "system", "content": SYS},
{"role": "user", "content": q.text}])
return {"answer": r.choices[0].message.content}
uvicorn main:app --host 127.0.0.1 --port 8000
Виджет на страницу
Минимальный клиентский код, который шлёт вопрос на ваш /ask:
async function askAI(text) {
const res = await fetch("/api/ask", {
method: "POST",
headers: {"Content-Type": "application/json"},
body: JSON.stringify({text})
});
const data = await res.json();
return data.answer;
}
nginx проксирует /api на бэкенд, а сам виджет отдаётся со статикой сайта — CORS-проблем нет. Визуально это оформляется плавающей кнопкой в углу и всплывающим окном чата: пара десятков строк HTML и CSS поверх показанной функции askAI. Ответы модели удобно выводить с эффектом печати — стримить токены по мере генерации, чтобы клиент не смотрел на пустой экран, пока формируется длинный ответ.
nginx и HTTPS
Проксируем API и закрываем сайт сертификатом:
location /api/ {
proxy_pass http://127.0.0.1:8000/;
proxy_set_header Host $host;
}
apt install -y certbot python3-certbot-nginx
certbot --nginx -d example.com
HTTPS здесь не формальность: чат передаёт вопросы клиентов, а иногда и персональные данные, поэтому канал обязан быть зашифрован. Сертификат Let's Encrypt бесплатный и продлевается автоматически. Бэкенд при этом слушает только localhost и наружу не выходит — единственная публичная точка входа остаётся под контролем nginx, где удобно повесить и rate limit, и базовую защиту от ботов.
База знаний и эскалация на человека
Чтобы ИИ отвечал по вашим материалам, добавьте RAG: проиндексируйте FAQ и статьи в векторную базу и подмешивайте найденные куски в промпт. Если бот не уверен — оставьте кнопку «позвать оператора». Именно RAG превращает общего ассистента в вашего: без него модель отвечает по общим знаниям и легко ошибается в деталях вашего продукта, с ним — цитирует ваши регламенты и цены. Переиндексацию базы удобно запускать по cron, чтобы бот всегда знал актуальные тарифы и условия.
- Галлюцинации — жёсткий системный промпт «отвечай только по контексту».
- Пустой ответ — фолбэк на оператора и форму заявки.
- Спам к API — rate limit по IP на nginx.
- Долгий ответ — стриминг ответа токенами, чтобы клиент видел печать.
Нужен сервер под эту задачу?
Разверните VPS MAATRIX за пару минут: NVMe, AMD EPYC, root-доступ, локации UK, США и РФ. Оплата картой РФ и по СБП.
Арендовать VPS для ИИ-поддержкиОбсудить статью, задать вопрос или начать новую тему
Есть вопрос по этой статье, идея для обсуждения или просто хотите поделиться опытом? Сообщество MAATRIX ждёт. Для общения, пожалуйста, зарегистрируйтесь в нашем личном кабинете.
Перейти в сообщество →Частые вопросы
Заменит ли ИИ операторов полностью?
Нет, но снимет 60-80% типовых вопросов. Сложные случаи стоит эскалировать на человека.
Можно ли обучить бота на своих статьях?
Да, через RAG: индексируете базу знаний и подмешиваете релевантные фрагменты в запрос к модели.
Где лучше держать бэкенд?
На отдельном VPS: быстрый NVMe и стабильный аптайм важны, чтобы чат не тормозил. MAATRIX подходит по железу и оплате из РФ.
Сколько это стоит в месяц?
Аренда VPS от $8/мес плюс, при локальной модели, ноль за токены. Дешевле помесячных SaaS на объёме.
Нужны сами нейросети для контента?
Генерируйте изображения, видео и озвучку нейросетями на falapi.io — десятки моделей в одном окне. Оплата картой РФ и по СБП.