Сначала рабочий чат, потом маршрутизация
Официальный быстрый старт настаивает на простой последовательности: одна модель, один успешный разговор, и только потом fallback, разные модели «на дешёвые задачи» и локальный роутер. Если CLI не отвечает, чините провайдера, а не gateway.
hermes model
hermes setup --portal
Nous Portal
Один вход закрывает доступ к большой полке моделей и Tool Gateway: поиск, картинки, речь, облачный браузер. Имеет смысл, если не хотите собирать зоопарк ключей в первый вечер. Команда hermes setup --portal логинит, ставит провайдера и включает шлюз инструментов.
OpenRouter, OpenAI, Anthropic и остальные
Самый частый путь с российского VPS — OpenRouter: один ключ, много моделей, понятный счёт. Прямые ключи OpenAI и Anthropic работают так же, если у вас есть способ их оплатить. После мастера ключ живёт в конфиге Hermes, не в чате с ботом и не в history шелла.
Практичное разделение, когда уже стабильно:
- дешёвая быстрая модель — на дайджесты и классификацию;
- сильная модель — на ревью, длинный контекст и опасные действия;
- локальная — на черновики, которые не должны уезжать во внешний API.
Менять модель позже: снова hermes model или hermes config set. Подробности переменных — в официальном каталоге провайдеров.
Локально через Ollama
Hermes умеет любой OpenAI-совместимый endpoint. Ollama на том же VPS или в локальной сети задаётся как свой base URL. Это не «бесплатно на 2 ГБ»: весам нужна память. На минимальном тарифе под API локальную 7B ставить не стоит — агент начнёт свопить и притворяться мёртвым.
Схема «маленький VPS + Ollama на домашней машине» нормальна, если endpoint доступен по VPN, а не торчит в интернет без ключа. Разбор железа — в статье Ollama и локальные модели.