Document intelligence & RAG engine. 7 API endpoints, FAISS vector indexing, semantic chunking, parallel LLM inference with VRAM monitoring. 24 docs/min throughput. Pub+sub NATS integration for bidirectional knowledge flow with Cerebro
-
Updated
Sep 5, 2026 - Python