ADG Оставить заявку

LLM-инференс

Также: LLM inference, локальный инференс, on-premise LLM, вывод языковой модели

LLM-инференс - процесс выполнения вычислений языковой модели для генерации ответа на GPU или CPU сервера внутри корпоративного периметра без передачи данных во внешние API. В отличие от облачного варианта, данные не покидают инфраструктуру компании - это принципиально для регулируемых отраслей и обработки конфиденциальной информации. Основные затраты - аппаратное обеспечение и потребление электроэнергии; зато нет зависимости от внешнего провайдера и ограничений по пропускной способности.

Статьи с этим термином · 21