Сообщество / ИИ

n8n и локальная ollama, http node вместо openai в каждой ноде

L
leo_msk
Junior
Сообщения: 8
Репутация: 2
Дата регистрации:
12.09.2026
АВТОР ТЕМЫ12 сент. 2026 г., 18:28 (GMT+3)
Здравствуйте. Кручу автоматизации в n8n, он у меня уже стоит в докере на этом же сервере. Проблема идейная: почти во всех гайдах n8n дёргает openai-ноду, то есть каждый сценарий гонит данные наружу и жжёт токены. Хочу часть шагов (суммаризация, черновая классификация) увести на локальную ollama, а openai оставить только там, где реально нужен сильный ответ.
Кто так делал: вы через встроенную ноду цепляетесь к ollama или через обычный HTTP Request на /api/chat? И не упирается ли Heka, когда n8n и олама на одном сервере разом работают?
0
masha_spb
Junior
Сообщения: 66
Репутация: 50
Дата регистрации:
11.08.2026
12 сент. 2026 г., 19:40 (GMT+3)
leo_msk привет) правильная идея — не гнать в openai то, что 7-8b сделает локально. По подключению: в n8n есть нода для ollama, но я чаще беру обычный HTTP Request на http://127.0.0.1:11434/api/chat — предсказуемее и не зависишь от версии ноды. Промпт и модель прямо в теле. По железу: n8n сам почти ничего не ест, вся нагрузка на оламе. На Heka 7-8b + n8n живут, но если запустишь параллельно несколько сценариев с моделью разом — упрёшься в ram, олама начнёт свопать. Ставь очередь, чтоб не било в модель в пять потоков.
1
kate_ekb
Junior
Сообщения: 57
Репутация: 32
Дата регистрации:
12.08.2026
12 сент. 2026 г., 20:05 (GMT+3)
leo_msk раз n8n в докере — держи оламу тоже понятно, и не тяни её в ту же compose-сеть абы как. 127.0.0.1:11434 с хоста, а из контейнера n8n это host.docker.internal или общая сеть, иначе будешь ловить connection refused и думать что олама умерла. и volume для n8n отдельно, там креды сценариев, потеряешь — все интеграции переподключать.
0
gleb_tomsk
Junior
Сообщения: 41
Репутация: 26
Дата регистрации:
21.08.2026
12 сент. 2026 г., 20:44 (GMT+3)
leo_msk по модели для черновой работы: qwen2.5 7b q4 на суммаризацию и классификацию хватает с запасом, 14b держи для того, где 7b мажет. и masha_spb права про параллель: n8n любит запустить batch и дёрнуть модель на каждой строке разом. поставь в сценарии ограничение параллелизма в 1-2, иначе на Heka своп и «всё зависло». воздух там не бесконечный, 8 гб надо делить.
0
L
leo_msk
Junior
Сообщения: 8
Репутация: 2
Дата регистрации:
12.09.2026
12 сент. 2026 г., 21:30 (GMT+3)
Спасибо, это ровно то, что искал. Значит HTTP Request на 127.0.0.1:11434 и очередь с ограничением параллелизма. masha_spb про «бьёт в модель в пять потоков» — это прям моя завтрашняя проблема, уже вижу. kate_ekb про host.docker.internal — да, я уже успел словить connection refused и грешил на оламу, оказалось сеть. Разгребу.
1