Привет, Хабр! На связи команда Рег.облака. Современные ИИ-платформы — это сложные распределенные системы, где за одним пользовательским запросом стоит целый конвейер микросервисов, GPU-кластеров и систем хранения. Но с точки зрения разработчика взаимодействие обычно выглядит просто: отправил запрос в API или через веб-интерфейс и получил ответ.Что происходит между этими двумя точками? Как запрос авторизуется, маршрутизируется, попадает на инференс, обрабатывает контекст и возвращается обратно? В этой статье разберем архитектуру ИИ-платформы для тех, кто хочет заглянуть под капот, но не имеет бэкграунда в ML-инфраструктуре.Важно: эта статья — обзорный материал по типовой архитектуре ИИ-платформ, а не описание конкретной реализации Рег.облака. Мы не претендуем на универсальность или эталонность описанных решений. В реальности каждый провайдер выстраивает архитектуру под свою целевую аудиторию и конкретные бизнес-задачи — компромиссы и технические решения могут сильно отличаться. Наша цель — дать общее представление о том, как устроен конвейер обработки запросов «от и до», чтобы новичкам было проще погрузиться в тему.Навигация по тексту: Читать далее