Agents / Context / Урок 06

Production-контур агента

Добавляем наблюдаемость, очереди, лимиты и безопасное выполнение задач.

Видео · 1:04Материалы · 14 минутРусскийОбновлён 02 августа 2026
Для кого
Инженеры, которым нужен управляемый agent-сервис под реальную нагрузку.
Перед началом
Проверенный agent loop, tool policy и eval-набор.
01:04 Озвучка · встроенный текст

Моё обучение

Прогресс и заметка

Войдите, чтобы сохранять прогресс, закладки и личные заметки.

Войти

Материалы / 14 минут

Развернуть agent worker с очередью, checkpoint, политиками и наблюдаемостью каждого задания.

01

Долгая задача становится job

HTTP-запрос создаёт job и быстро возвращает идентификатор. Worker забирает задачу, продлевает lease и сохраняет checkpoint после значимого шага.

Повторная доставка является нормой. Side effect защищается idempotency key, а job не считается завершённым до проверки результата.

02

Состояние должно переживать рестарт

Prompt, tool results и статус не могут существовать только в памяти процесса. После рестарта worker продолжает с подтверждённого checkpoint или безопасно начинает шаг заново.

Отмена пользователя переводит job в cancelling, останавливает активные вызовы и не допускает новых действий.

03

Наблюдаемость связывает весь путь

Используйте общий job ID и trace ID в логах, метриках и вызовах инструментов. Минимальные метрики: queue wait, run duration, tool errors, retries, human escalations и стоимость.

Новая модель или prompt сначала проходит eval, затем небольшой процент трафика. Возможность быстро вернуть предыдущую версию важнее автоматического полного rollout.

Состояния production job text
queued -> running -> verifying -> completed
             |             |-> failed
             |-> waiting_for_approval
             |-> retry_scheduled
             |-> cancelling -> cancelled

Практика

Оберните агента в worker

Перенесите один долгий сценарий из HTTP-handler в воспроизводимую job.

  1. 01

    Создайте job ID, состояния и lease.

  2. 02

    Сохраняйте checkpoint после каждого side effect.

  3. 03

    Добавьте cancel, retry с backoff и dead-letter состояние.

  4. 04

    Свяжите логи и метрики общим trace ID.

Критерии готовности

  • Повторная доставка не дублирует side effect.
  • Рестарт worker не теряет состояние job.
  • Пользователь может отменить задачу.
  • Для каждого job доступны latency, retries и tool errors.