RAG
Также: Retrieval-Augmented Generation, ретриeval augmented generation, поиск с генерацией, RAG-система
RAG (Retrieval-Augmented Generation) - архитектурный паттерн для LLM-приложений, при котором перед генерацией ответа модель получает релевантные фрагменты из внешнего хранилища знаний. Хранилищем служит векторная база данных или поисковый индекс - документы разбиваются на части, переводятся в векторное представление и при запросе ищутся по семантической близости. Подход позволяет работать с корпоративными или актуальными данными без переобучения модели.
Статьи с этим термином · 19
- Год корпоративного RAG в проде: что работает и что нет · 7 июля 2026
- Итоги 2025 года: КИИ закрыт формально, ПДн бьёт штрафами, AI входит в инфраструктуру · 25 декабря 2025
- GigaChat и YandexGPT в корпоративном RAG: контрактные ограничения, latency и сравнение с локальным инференсом · 5 августа 2025
- GigaChat on-premise: переносим внутреннего AI-ассистента с облака на своё железо · 3 апреля 2025
- OWASP LLM Top 10 v1.1: применяем к нашим RAG-пилотам · 27 ноября 2024
- Managed PostgreSQL в отечественных облаках: сравниваем Yandex Cloud, VK Cloud и Selectel · 28 октября 2024
- AI-автодополнение для Ansible: Lightspeed хорош, но только на английском · 4 июня 2024
- Prompt injection в корпоративных LLM: угроза №1 по OWASP и что с этим делать · 25 апреля 2024
- GigaChat и YandexGPT в закрытом контуре: первые пилоты с российскими LLM · 20 февраля 2024
- H1 2024: план на финальный год до дедлайна КИИ, LLM в закрытом контуре и аудит под оборотные штрафы · 25 декабря 2023
- Итоги 2023 от команды ADG: MOVEit, локальные LLM, семь миграций с VMware и десять дорожных карт КИИ · 21 декабря 2023
- pgvector 0.6 и HNSW: добавляем векторный поиск в PostgreSQL 16 без отдельной СУБД · 14 декабря 2023
- CodeLlama 13B внутри корпоративного контура: VS Code указывает на внутренний endpoint · 6 ноября 2023
- RAG над внутренней документацией: ChromaDB + Llama 2 без передачи данных наружу · 12 октября 2023
- Ollama и локальный helpdesk-ассистент: от одной команды до рабочего прототипа · 21 сентября 2023
- Llama 2 на A10G внутри DMZ: замеряем латентность и убеждаемся, что модель не звонит домой · 3 августа 2023
- pgvector 0.4 и HNSW: мигрируем RAG-пилот с Chroma на PostgreSQL · 6 июня 2023
- Prompt injection в LLM-пилотах: OWASP Top 10 для LLM и что делать с корпоративным RAG · 11 мая 2023
- RAG для корпоративной базы знаний: LangChain + Chroma + OpenAI в деле · 2 марта 2023