Документация · провайдеры

Чем думает агент на вашем VPS.

Hermes не привязан к одной лаборатории. Вы выбираете endpoint. Сервер хранит память и инструменты, модель можно сменить командой.

Сначала рабочий чат, потом маршрутизация

Официальный быстрый старт настаивает на простой последовательности: одна модель, один успешный разговор, и только потом fallback, разные модели «на дешёвые задачи» и локальный роутер. Если CLI не отвечает, чините провайдера, а не gateway.

hermes model
hermes setup --portal

Nous Portal

Один вход закрывает доступ к большой полке моделей и Tool Gateway: поиск, картинки, речь, облачный браузер. Имеет смысл, если не хотите собирать зоопарк ключей в первый вечер. Команда hermes setup --portal логинит, ставит провайдера и включает шлюз инструментов.

OpenRouter, OpenAI, Anthropic и остальные

Самый частый путь с российского VPS — OpenRouter: один ключ, много моделей, понятный счёт. Прямые ключи OpenAI и Anthropic работают так же, если у вас есть способ их оплатить. После мастера ключ живёт в конфиге Hermes, не в чате с ботом и не в history шелла.

Практичное разделение, когда уже стабильно:

  • дешёвая быстрая модель — на дайджесты и классификацию;
  • сильная модель — на ревью, длинный контекст и опасные действия;
  • локальная — на черновики, которые не должны уезжать во внешний API.

Менять модель позже: снова hermes model или hermes config set. Подробности переменных — в официальном каталоге провайдеров.

Локально через Ollama

Hermes умеет любой OpenAI-совместимый endpoint. Ollama на том же VPS или в локальной сети задаётся как свой base URL. Это не «бесплатно на 2 ГБ»: весам нужна память. На минимальном тарифе под API локальную 7B ставить не стоит — агент начнёт свопить и притворяться мёртвым.

Схема «маленький VPS + Ollama на домашней машине» нормальна, если endpoint доступен по VPN, а не торчит в интернет без ключа. Разбор железа — в статье Ollama и локальные модели.