K
| kostya_gw |
| Junior |
Сообщения: 3 |
Репутация: 1 |
| Дата регистрации: |
| 20.09.2026 |
АВТОР ТЕМЫ20 сент. 2026 г., 17:24 (GMT+3)
Привет. У меня уже стоит Heka с оламой, и накопилась проблема архитектуры: сервисов, которые ходят к моделям, стало несколько — бот, пара скриптов, n8n. Каждый лезет либо в оламу напрямую, либо в облако со своим ключом. Ключи расползлись по конфигам, а модель хочется дёргать единообразно и иногда переключать (локальная для дешёвого, облако для сложного), не переписывая каждого клиента.
Смотрю в сторону litellm как единого шлюза: один OpenAI-совместимый эндпоинт, за ним и олама, и облака, ключи в одном месте, роутинг по модели. Кто так делал на vps — litellm себя оправдывает как прокси, или это лишний слой и проще каждому клиенту свой конфиг? И как с ним по памяти на Heka рядом с оламой?
Смотрю в сторону litellm как единого шлюза: один OpenAI-совместимый эндпоинт, за ним и олама, и облака, ключи в одном месте, роутинг по модели. Кто так делал на vps — litellm себя оправдывает как прокси, или это лишний слой и проще каждому клиенту свой конфиг? И как с ним по памяти на Heka рядом с оламой?
0