LangChain — фреймворк для приложений с языковыми моделями. RAG (Retrieval-Augmented Generation) объединяет поиск по документам и генерацию ответа. Для RAG используют векторные базы (например Qdrant) и эмбеддинги (например nomic-embed-text в Ollama). Агент может вызывать инструменты search_knowledge_base и add_to_knowledge_base для работы с памятью.