Данные и аналитика
-
Данные и аналитика
ClickHouse 26.5 + Apache Iceberg: federated query без ETL и сколько это реально стоит
ClickHouse 26.5 улучшил query cache и добавил полноценную поддержку Iceberg для внешних таблиц. Тестируем federated query на нашем кластере и замеряем overhead.
-
Данные и аналитика
Data mesh на отечественном стеке: domain ownership, ClickHouse и где федерация данных ломается
Помогаем заказчику внедрить data mesh: каждый домен владеет ClickHouse-кластером, публикует data contract через единый каталог. Разбираем сложности governance и федерации.
-
Данные и аналитика
Полгода PostgreSQL 18 в продакшне: что сработало, что регрессировало и как мы обошли
Инкрементальные чекпоинты убрали пики IO, async I/O дал прирост на batch SELECT. Одна нагрузка регрессировала - разбираем почему и как исправили через ALTER SYSTEM.
-
Данные и аналитика
Tantor SE на PostgreSQL 18 получает сертификат ФСТЭК: что меняется для КИИ
Tantor SE на базе PG18 сертифицирован ФСТЭК в мае 2026. Сравниваем Tantor SE и Postgres Pro Enterprise по функциональности и условиям поддержки для КИИ-объектов.
-
Данные и аналитика
Postgres Pro 18 Enterprise в очереди на сертификацию ФСТЭК: что это значит для КИИ
Postgres Pro 18 Enterprise подана на сертификацию ФСТЭК. Разбираем, чем сертифицированная версия отличается от несертифицированной для объектов КИИ.
-
Данные и аналитика
Data lakehouse на отечественном стеке: ClickHouse + MinIO + Iceberg и то, что пришлось допиливать
Строим lakehouse на ClickHouse, MinIO и Apache Iceberg для российского корпоратива. Что не работает из коробки и какие патчи нам пришлось писать.
-
Данные и аналитика
Kafka 4.1 tiered storage: переносим старые топики на MinIO и считаем экономию
Apache Kafka 4.1 выпустил tiered storage со стабильным Remote Log Manager. Переносим горячие данные на NVMe (7 дней), архив - на S3-совместимый MinIO. Считаем реальную экономию.
-
Данные и аналитика
ClickHouse 26.1: JSON v2 хоронит наши костыли с CodecJSON-колонками
Обновили аналитический кластер до ClickHouse 26.1 с нативным JSON v2 и улучшенным параллельным чтением S3. Сравниваем размер хранения и скорость ingest до и после.
-
Данные и аналитика
PostgreSQL 18 в продакшне: месяц спустя после GA
Инкрементальные чекпоинты убрали пики I/O, async I/O ускорил сканирование - разбираем реальные эффекты PG18 в продакшне и один неожиданный регресс в VACUUM.
-
Данные и аналитика
GPU-кластеры, RAG и LLM-агенты в продакшне: итоги года с локальной AI-инфраструктурой
Подводим итоги первого полного года с локальной AI-инфраструктурой у клиентов: что реально работает в продакшне, что осталось на PoC и чего ждём от 2026.
-
Данные и аналитика
PostgreSQL 18 GA: подводим итоги нашего тестирования с beta и RC
PostgreSQL 18 вышел в продакшн: разбираем что подтвердилось за полгода тестирования с beta и RC, что оказалось лучше или хуже ожиданий и когда планируем первую миграцию.
-
Данные и аналитика
Data mesh на отечественном стеке: что закрыли, что не закрыли совсем
Помогали крупному клиенту перейти от монолитного DWH к data mesh - разбираем, какие отечественные инструменты закрыли data catalog, data contract и lineage, а что не закрыли совсем.
-
Данные и аналитика
Tantor SE на PostgreSQL 18: следим за получением сертификата ФСТЭК и что это меняет для КИИ
Tantor SE получает сертификат ФСТЭК на базе PostgreSQL 18 - разбираем timeline процесса, что это значит для планирования миграций в КИИ и как дистрибутив отличается от upstream PG.
-
Данные и аналитика
ClickHouse 25.6 и параллелизм JOIN: что изменилось в планировщике и почему стало быстрее
После обновления аналитических кластеров до ClickHouse 25.6 запросы с широкими JOIN ускорились на 25-40%. Разбираем настройки планировщика и как читать новый EXPLAIN.
-
Данные и аналитика
Patroni 4.0 и PostgreSQL 18: тестируем автоматический switchover под нагрузкой и разбираем новый мониторинг кластера
Обновили Patroni до 4.0 в нескольких HA-кластерах: делимся тестом switchover под нагрузкой и тем, что изменилось в мониторинге состояния кластера.
-
Данные и аналитика
PostgreSQL 18 RC: гоняем нагрузочные тесты на реальных схемах и оцениваем продакшн-готовность
Прогнали нагрузочные тесты PostgreSQL 18 RC на схемах реальных клиентов: async I/O работает, разбираем конфигурацию и известные регрессии перед GA.
-
Данные и аналитика
Kafka 4.0 без ZooKeeper: как мы мигрировали продакшн-кластер на KRaft и что пошло не так с мониторингом
Перевели продакшн-кластер Kafka с ZooKeeper на KRaft до выхода 4.0: рассказываем о реальном downtime, проблемах с мониторингом и нюансах живой миграции.
-
Данные и аналитика
ClickHouse 25 LTS: переходим на нативный JSON и разбираемся с tiered storage на объектном хранилище
Обновили продакшн-кластер до ClickHouse 25 LTS: делимся опытом перехода на нативный JSON-тип, замерами скорости и изменениями в tiered storage на объектном хранилище.
-
Данные и аналитика
GigaChat и YandexGPT в корпоративном RAG: контрактные ограничения, latency и сравнение с локальным инференсом
Интегрировали отечественные LLM в RAG-пайплайн корпоративной базы знаний: разбираем контрактные ограничения, latency и качество ответов по сравнению с локальными моделями.
-
Данные и аналитика
pgvector 0.7 vs Weaviate в продакшне: как мы выбирали векторное хранилище под RAG для двух разных клиентов
Для двух клиентов подбирали векторную базу под RAG-пайплайн: в одном случае хватило pgvector 0.7, в другом пришлось взять Weaviate. Разбираем критерии выбора.