AIFLY

Архитектура ИИ-агентов — компоненты и проектирование

Архитектура ИИ-агентов

Современный ИИ-агент — это многослойная система. Рассказываем о компонентах, из которых мы строим надёжные решения.

Сенсорный слой (Perception)

Получает данные из внешних источников: REST/GraphQL API, WebSocket-стримы, файловые системы, веб-скрапинг, IoT-сенсоры. Нормализует и преобразует данные в единый формат для ядра агента.

Технологии: API Gateway, Kafka, RabbitMQ, gRPC.

Ядро рассуждений (Reasoning Core)

Центральный компонент на базе LLM или гибридной модели. Реализует паттерны: Chain of Thought, Tree of Thoughts, ReAct, Reflexion. Принимает решение о следующем действии на основе контекста и истории.

Технологии: GPT-4o, Claude 3.5, Gemini 2.0, Llama 3.3.

Модуль памяти (Memory)

Три типа памяти: кратковременная (контекст диалога), долговременная (векторная БД, суммаризации) и эпизодическая (логи выполненных действий). Позволяет агенту учиться на опыте и не повторять ошибок.

Технологии: Pinecone, Weaviate, pgvector, Redis.

Инструментальный слой (Tool Use)

Набор инструментов (функций), которые агент может вызывать: создание документов, отправка email, SQL-запросы, вызов внешних API, работа с файлами. Каждый инструмент имеет схему, валидацию и грейд доступа.

Технологии: OpenAI Function Calling, Anthropic Tool Use, LangChain Tools.

Планировщик (Planner)

Разбивает высокоуровневую цель на атомарные задачи с дедлайнами. Может перепланировать при возникновении ошибок. Поддерживает параллельное выполнение независимых подзадач.

Паттерны: Plan-and-Execute, Hierarchical Task Network.

Safety-обёртка (Guardrails)

Проверяет каждое действие агента до выполнения: соответствие политикам, лимиты, PII-фильтрация, детекция аномалий. Может блокировать, перенаправлять на подтверждение или логировать подозрительные действия.

Технологии: Guardrails AI, Nemo Guardrails, кастомные валидаторы.

Этапы разработки архитектуры ИИ-агента

  1. Анализ требований — какие задачи будет решать агент, какие данные нужны, какие интеграции требуются
  2. Выбор LLM и фреймворка — определяем оптимальную модель (GPT, YandexGPT, Llama) и фреймворк (LangChain, AutoGen, CrewAI)
  3. Проектирование компонентов — сенсорный слой, ядро, память, инструменты, планировщик, safety
  4. Разработка и интеграция — подключение к API, базам данных, настройка инструментов
  5. Тестирование и safety-аудит — проверка на инъекции, jailbreak, корректность действий
  6. Развёртывание и мониторинг — деплой в приватном облаке, настройка логирования и алертов

Цены на проектирование архитектуры

УслугаСтоимость (ориентир)Сроки
Аудит и проектирование архитектуры агентаот 50 000 руб.1-2 недели
Разработка сенсорного слоя (Perception)от 60 000 руб.1-2 недели
Настройка ядра рассуждений (Reasoning Core)от 80 000 руб.1-3 недели
Настройка модуля памяти (Memory)от 50 000 руб.1-2 недели
Разработка инструментов (Tool Use)от 30 000 руб./инструмент3-7 дней
Настройка планировщика (Planner)от 70 000 руб.1-2 недели
Safety-аудит и Guardrailsот 100 000 руб.1-2 недели
Развёртывание и CI/CD для агентаот 60 000 руб.1-2 недели