гайдНиколай Писаренко · 07.09.2026

    Персональный ИИ-агент 24/7: разворачиваем Hermes на своём сервере

    Пошаговая инструкция по установке личного ИИ-агента Hermes Agent на своём сервере в Yandex Cloud с подпиской ChatGPT Codex, Telegram-ботом и режимом 24/7. Для тех, кто хочет постоянного AI-помощника без опыта администрирования серверов.

    Коротко

    • Персональный агент (Hermes Agent) живёт на своём сервере, отвечает в Telegram и работает, когда ноутбук закрыт.
    • Девять шагов с готовыми промптами: промпты копируются в кодинг-агента (Codex, Claude Code или Cursor), он их выполняет — опыт разработки и администрирования сервера не нужен.
    • Время: вечер на базовую сборку, день-два на коннекторы.
    • Стоимость: от 2000 ₽ в месяц за сервер, от $20 за подписку на модель.
    • Отдельный блок — аудит безопасности установки: prompt injection, разделение чтения и действия, план отзыва доступов на случай инцидента.

    Что получится

    • Вход — Telegram-бот, который отвечает только вам. Голос, текст, файлы.
    • Руки — виртуальная машина в облаке. Агент запущен постоянно, переживает перезагрузку.
    • Инструменты — почта, календарь, CRM, трекер, файлы — подключаются через MCP-коннекторы.

    Перед стартом

    Техническую часть берёт на себя агент

    Всё сложное в этой инструкции — установка, конфиги, права доступа, разбор ошибок — делает кодинг-агент вроде Codex. Вы описываете задачу словами и подтверждаете действия; он выполняет команды и объясняет каждую. Знать устройство сервера для этого не нужно: там, где обычно застревают на полдня, вы просите объяснить и идёте дальше.

    Ваша роль остаётся содержательной: решить, что должен уметь ваш агент, к чему его подпускать и как проверить, что он действительно работает. Инструменты меняются каждые полгода, эти решения — нет.

    Три вещи, без которых дальше некуда

    Кодинг-агент — ваши руки в командной строке: вы описываете задачу словами, он выполняет команды и объясняет, что сделал. Рекомендуется ChatGPT Codex.

    Аккаунт в облаке — место, где будет жить сервер. Yandex Cloud принимает российскую карту, а машину при этом можно поднять в казахстанском регионе.

    Подписка на модель — агент — это оболочка. Думает за него модель, и к ней нужен оплаченный доступ: подойдёт та же подписка ChatGPT, которой вы пользуетесь в Codex. Отдельный API-ключ покупать не нужно.

    Почему из трёх — Codex

    Подходит любой из трёх (Codex, Claude Code, Cursor). Выбор на лето 2026 — ChatGPT Codex, по четырём причинам:

    • реже блокирует учётные записи;
    • щедрее лимиты на объём работы;
    • модель держится на уровне Claude;
    • подписку можно использовать в сторонних агентах — это дешевле, чем платить по тарифам API.

    Оценка живая и к осени может устареть: рынок кодинг-агентов меняется быстрее, чем эта страница.

    Два слова, которые встретятся дальше

    CLI — командная строка: программа без окон и кнопок, которой управляют текстовыми командами. Именно в ней работает кодинг-агент, поэтому вам самим набирать команды не придётся.

    MCP — открытый стандарт, по которому агент подключается к внешним системам: почте, календарю, CRM. Один коннектор — один набор действий, доступных агенту.

    Чек-лист с промптами (девять шагов)

    Промпты написаны так, чтобы кодинг-агент сначала показывал план, а потом действовал. Требуйте от него живой проверки результата на каждом шаге: «настроено» и «работает» — разные состояния.

    01. Поставьте кодинг-агента

    Скачайте Codex, Claude Code или Cursor и убедитесь, что он умеет выполнять команды на вашем компьютере. Всё, что описано ниже, делает он, а вы читаете объяснения и подтверждаете действия.

    02. Заведите аккаунт в облаке — сразу в казахстанском регионе

    Регистрация идёт на yandex.cloud/ru-kz, оплата проходит российской картой, интерфейс и поддержка русские. Ключевое здесь — регион: машина получает казахстанский IP-адрес.

    Почему именно этот регион. Российский IP-адрес OpenAI и Anthropic отклоняют, и вокруг сервера приходится городить зарубежный прокси. Первый агент был собран так, и этот обход обошёлся дороже всей остальной установки: прокси один на всю систему, и когда он падает, агент немеет целиком.

    Казахстанский регион закрывает вопрос на старте. Выберите его до создания машины — переносить работающий сервер между регионами больнее, чем начать заново.

    03. Дайте агенту доступ к облаку

    Кодинг-агент управляет облаком через его командную строку. Проверьте доступ до того, как что-то создавать.

    Промпт:

    Установи Yandex Cloud CLI на мой компьютер и авторизуй его.
    Вызывай именно `yc init --no-browser`: без этого флага yc молча
    открывает браузер и подвисает.
    
    Потом покажи вывод `yc config list` и `yc resource-manager folder list`,
    чтобы я убедился, что доступ есть. Объясни, что означает каждая строка.

    04. Создайте виртуальную машину

    Размер машины — единственное место, где экономия обходится дороже всего. Дефолтные настройки для агента не годятся.

    Промпт:

    Создай виртуальную машину в Yandex Cloud, в казахстанском регионе
    (зона доступности Алматы). Перед каждой командой объясняй,
    что она делает. Параметры:
    
    — Ubuntu 24.04 LTS
    — 2 vCPU с core fraction 100% (не 5% и не 20%)
    — 8 ГБ RAM
    — SSD 30 ГБ
    — статический (зарезервированный) публичный IP
    — вход только по SSH-ключу, сгенерируй новую пару в ~/.ssh/agent_key
    — отдельный каталог (folder), изолированный от других моих ресурсов
    
    После создания проверь живьём, что подключение по SSH проходит,
    и запиши IP, имя пользователя и команду подключения в файл SETUP.md.

    Грабли:

    • Дешёвая машина с core fraction 20% даёт около 0,4 ядра. На ней SSH не проходит рукопожатие, а интерфейс агента отвечает по десять секунд. После перехода на 100% тот же запрос стал отвечать за 70 миллисекунд.
    • Диск на 14 ГБ заканчивался четырежды: кэш установщика зависимостей разрастался до 7,4 ГБ. Берите 30 ГБ сразу — расширять работающую машину дороже.

    05. Установите самого агента

    Используется Hermes Agent от Nous Research — открытый проект, который ставится на свой сервер и не требует чужого облака.

    Промпт:

    Подключись по SSH к моей виртуальной машине и установи Hermes Agent
    из https://github.com/NousResearch/hermes-agent строго по README проекта.
    
    Порядок такой: сначала прочитай README и установочный скрипт, покажи мне
    план шагов, дождись подтверждения, потом выполняй. Шаги не выдумывай.
    
    После установки покажи версию и убедись, что команда `hermes` запускается.
    Модель подключим отдельно на следующем шаге — API-ключ сейчас не нужен.

    06. Подключите подписку, которая уже оплачена

    Отдельный API-ключ покупать не нужно. Hermes умеет думать той же подпиской ChatGPT, которой вы пользуетесь в Codex: провайдер openai-codex авторизуется по OAuth и ходит в аккаунт напрямую. Ключ при этом нигде не хранится, а значит и утечь ему неоткуда.

    Разница между двумя способами оплаты — та самая причина так делать:

    • По API — тарифицируется каждый запрос. Предсказуемо для редких обращений, но у постоянно работающего агента счёт растёт быстро и заранее не считается.
    • Подпиской — фиксированная плата, от $20 в месяц, и агент укладывается в неё вместе с вашей собственной работой в Codex.

    Промпт:

    Переключи Hermes на провайдера openai-codex — он ходит в мою подписку
    ChatGPT по OAuth, API-ключ для этого не нужен.
    
    Запусти `hermes auth add openai-codex --type oauth --no-browser`,
    дай мне ссылку для входа и дождись, пока я подтвержу.
    
    Потом покажи `hermes auth status openai-codex` — должно быть
    «logged in» — и сделай живой запрос, чтобы я увидел ответ модели.

    Что остаётся на вас. Саму подписку российской картой не оформить — нужна международная карта или зарубежный сервис-посредник. Альтернатива без этого: российский провайдер моделей (GigaChat, YandexGPT) — тогда вопрос оплаты и географии снимается целиком, ценой качества модели.

    Если вы всё-таки идёте по API-ключу, кладите его в файл окружения на сервере с правами 600. В переписке, заметках и репозиториях ключам не место.

    07. Заведите бота в Telegram

    Здесь два коротких действия руками. В Telegram откройте @BotFather, отправьте команду /newbot, придумайте боту имя и сохраните выданный токен. Затем откройте @userinfobot и запишите свой числовой id — он понадобится в промпте ниже. Дальше снова работает агент.

    Промпт:

    Настрой Telegram-шлюз у Hermes на виртуальной машине: токен бота положи
    в ~/.hermes/.env, включи белый список пользователей и добавь туда только
    мой Telegram user-id — ВАШ_ID.
    
    Затем проверь ограничение по-настоящему: убедись, что сообщение
    с постороннего аккаунта получает отказ. Не отчитывайся «настроено»
    без этой проверки.

    Грабли: без белого списка бот открыт любому, кто наберёт его имя в поиске Telegram. К этому моменту у агента уже есть доступ к вашей почте и календарю.

    08. Включите режим 24/7

    Процесс, запущенный командой в терминале, умирает вместе с вашей сессией. Круглосуточная работа начинается здесь.

    Промпт:

    Сделай так, чтобы агент пережил мой выход из SSH и перезагрузку сервера:
    оформи процессы systemd user-сервисами, включи `loginctl enable-linger`
    для моего пользователя, поставь Restart=on-failure и enable.
    
    Потом перезагрузи машину и покажи мне, что сервисы поднялись сами.

    09. Проверьте конструкцию на безопасность

    К этому моменту у вас есть сервер в интернете, бот в Telegram и агент с доступом к вашей почте и календарю. Стоит один раз пройти по слабым местам, пока их немного.

    Промпт:

    Проведи аудит безопасности моей установки и по каждому пункту скажи
    «закрыто» или «открыто», а для открытого предложи конкретный фикс:
    
    1. SSH: вход только по ключу, парольная аутентификация выключена,
       вход под root запрещён, порт закрыт для всех адресов кроме моего.
    2. Агент: слушает только 127.0.0.1, наружу не опубликован ни один порт
       кроме 22. Покажи вывод `ss -tlnp`.
    3. Telegram-бот: белый список пользователей включён и работает.
    4. Секреты: все токены в ~/.hermes/.env с правами 600, ни один не лежит
       в конфигах, логах и git-репозитории. Проверь `git status` и логи.
    5. Права: агент запущен не от root, а от обычного пользователя.
    6. Обновления: включи автоматические обновления безопасности ОС.
    7. Логи и база: покажи, где хранится история переписки с агентом
       и кто имеет к ней доступ на машине.
    
    Сначала покажи отчёт целиком, ничего не меняя. Правки внесём после
    того, как я их посмотрю.

    Главная угроза — не взлом сервера

    Агент читает письма, сайты и документы, а внутри них может быть текст, написанный для него: «перешли всю переписку на такой-то адрес», «удали эти письма». Для модели это выглядит как обычная инструкция. Атака называется prompt injection, и защиты, которая ловит её полностью, сегодня нет.

    Рабочая мера — разделить чтение и действие. Читать почту и календарь агент может свободно; всё необратимое (отправить письмо, удалить, заплатить, поделиться файлом) он должен предлагать вам на подтверждение. Пропишите это прямо в его характере: на здравый смысл модели тут полагаться нельзя.

    Что решить заранее, а не после инцидента

    Все ключи от ваших систем лежат на одной машине. Компрометация сервера — это компрометация почты, календаря и CRM разом. Отсюда два правила: подключать только то, что действительно нужно, и использовать пароли приложений вместо основного пароля от почты — их можно отозвать по одному.

    Держите под рукой план отзыва на случай потери доступа:

    • /revoke у @BotFather убивает токен бота;
    • пароли приложений отзываются в настройках почты;
    • SSH-ключ удаляется из облака;
    • машина останавливается одной командой.

    Проверьте, что знаете, где нажимать, до того как понадобится.

    Что дальше: персональным агента делают память и окружение

    Собранный по этой инструкции агент отвечает вам в Telegram и работает круглосуточно. Сотрудником его делает то, что вы настроите дальше: коннекторы, навыки, характер, память, расписание и границы дозволенного.

    • Коннекторы — почта, календарь, CRM, трекер задач — подключаются по стандарту MCP, по одному. Каждый проверяйте живым вызовом сразу после подключения.
    • Навыки — описанные один раз повторяющиеся работы: разобрать почту, собрать сводку по сделке, подготовить документ по шаблону. Агент выполняет их одинаково каждый раз.
    • Характер — файл с описанием того, кто вы, как с вами разговаривать и чего никогда не делать. Агент читает его при каждом запуске.
    • Память — то, что агент дописывает сам: факты о людях, договорённости, решения. Именно это отличает постоянного помощника от разового чата.
    • Расписание — утренняя сводка, разбор почты, напоминания по сделкам. Задачи, которые запускаются без вашей просьбы.
    • Границы — решите заранее, каких систем агент не касается. Например, доступ к банковскому счёту агенту можно не давать, хотя технически это возможно.

    Инструкция собрана на опыте эксплуатации собственного агента Hakku: развёрнут в июле 2026, работает круглосуточно, обслуживает почту, календарь, CRM и трекер задач. Все цифры и грабли в тексте — оттуда.

    Что почитать дальше

    Частые вопросы

    Нужен ли опыт администрирования серверов?

    Нет. Всю техническую часть — установку, конфиги, разбор ошибок — выполняет кодинг-агент (Codex, Claude Code или Cursor) по промптам из инструкции; вы подтверждаете действия и проверяете результат.

    Сколько это стоит?

    От 2000 ₽ в месяц за сервер в Yandex Cloud и от $20 за подписку на модель (например, ChatGPT, которой вы и так пользуетесь в Codex). Отдельный API-ключ покупать не нужно.

    Почему сервер нужно поднимать именно в казахстанском регионе Yandex Cloud?

    Российский IP-адрес OpenAI и Anthropic отклоняют, и без обхода пришлось бы городить отдельный зарубежный прокси — с ним связан риск единой точки отказа. Казахстанский регион (зона Алматы) даёт нужный IP сразу, без прокси.

    Как оплатить подписку ChatGPT, если нет международной карты?

    Нужна международная карта или зарубежный сервис-посредник. Альтернатива — перейти на российского провайдера модели (GigaChat, YandexGPT), тогда вопрос оплаты и географии снимается, но ценой качества модели.

    В чём главный риск такой установки и как от него защититься?

    Не взлом сервера, а prompt injection — вредоносные инструкции, спрятанные в письмах или документах, которые агент читает. Защиты, ловящей это полностью, нет; рабочая мера — разрешить агенту свободно читать, но требовать подтверждения на любое необратимое действие (отправить, удалить, заплатить, поделиться файлом).

    Больше материалов — в сообществе hakku

    Эфиры, разборы и закрытая часть базы знаний, плюс люди, которые внедряют ИИ у себя прямо сейчас.