RAG (Retrieval-Augmented Generation)
Также: RAG-пайплайн, retrieval augmented generation, поиск с дополнением генерации, RAG-архитектура
RAG - архитектурный паттерн, при котором языковая модель перед генерацией ответа получает релевантные фрагменты из внешнего хранилища и включает их в контекст запроса. Это позволяет модели отвечать на вопросы по корпоративным или актуальным данным без переобучения. Типичный пайплайн: запрос пользователя превращается в вектор, по нему ищутся ближайшие фрагменты в векторной базе, затем они передаются модели вместе с исходным вопросом.
Статьи с этим термином · 14
- План H2 2026: что модернизируем в инфраструктуре, куда двигаем AI-автоматизацию и какие регуляторные дедлайны не пропустить · 30 июля 2026
- Паттерны оркестрации LLM-агентов: что победило в корпоративном проде · 4 июня 2026
- Планирование H1 2026: AI-инфраструктура, ПДн и консолидация отечественного стека · 30 декабря 2025
- GPU-кластеры, RAG и LLM-агенты в production: итоги года с локальной AI-инфраструктурой · 23 декабря 2025
- GigaChat и YandexGPT в корпоративном RAG: контрактные ограничения, latency и сравнение с локальным инференсом · 5 августа 2025
- pgvector 0.7 vs Weaviate в продакшне: как мы выбирали векторное хранилище под RAG для двух разных клиентов · 29 июля 2025
- GPU-кластер для инференса LLM на отечественных серверах: архитектура, bottleneck'и и реальные цифры · 15 июля 2025
- pgvector 0.8 vs отдельные векторные базы: когда Postgres достаточно для RAG · 2 июня 2025
- LLM + RAG для корпоративной wiki: переход от пилота к тиражированию · 14 апреля 2025
- LLM-агент на IT-хелпдеске: первый месяц в проде · 30 января 2025
- OWASP LLM Top 10 v1.1: применяем к нашим RAG-пилотам · 27 ноября 2024
- RAG с локальными LLM: итоги четырёх пилотов за 2024 год · 21 октября 2024
- RAG на Ollama + Mistral 7B + pgvector: подняли поиск по 50 тысячам страниц документации без выхода данных · 28 марта 2024
- Векторное хранилище для корпоративного RAG: pgvector против Qdrant на 500K документов · 23 ноября 2023