About This Architecture
Classifier Distributor Subsystem Pipeline orchestrates end-to-end NLP-driven professional classification using RabbitMQ, feature extraction, semantic embeddings, and dual persistence layers. Data flows from RabbitMQ Input Queue through validation, NLP feature extraction (Technical Skills, Soft Skills, Experience/Seniority), normalization, and semantic classification into Professional Categories, Occupational Families, and Industry Sectors. The pipeline generates semantic vectors via Embedding Generator, storing embeddings and metadata in PostgreSQL with pgvector and MinIO Object Storage while maintaining a Feature Store and Model Registry for reproducibility. This architecture enables scalable, production-grade classification with vector similarity search and artifact versioning for continuous model improvement.