Российские озёра данных (Data Lake) 2026
32 продукта в каталоге, 17 в рейтинге. Сравнение по цене, реестру Минцифры, развёртыванию и отзывам. Обновлено 4 октября 2026.
Порядок: по уровню участия компании на платформе, затем по рейтингу и полноте профиля. Уровень участия зависит от тарифа. На рейтинги, «Топ» и «Призму» тариф не влияет — подробнее.
Mail.Ru Cloud Big Data
VK Data Platform
Arenadata Hadoop Platform T4 (ADH T4)
Arenadata One (AOne)
Сравнение озёра данных (Data Lake) 2026: топ-17
Весь рейтинг →Вопросы и ответы
Какие озёра данных (Data Lake) лучшие в 2026 году?
По рейтингу площадки в тройке лидеров – CedrusData, Arenadata Hadoop, Mail.Ru Cloud Big Data. Полный список с оценками и зонами – в рейтинге озёра данных (Data Lake).
Сколько озёра данных (Data Lake) в каталоге?
В каталоге 32 продукта, в рейтинге – 17. В реестре российского ПО – 24.
Как составлен рейтинг озёра данных (Data Lake)?
Автоматически, по данным каталога: функции продукта и полнота карточки, подтверждённые отзывы, закупки заказчиков по 44-ФЗ и 223-ФЗ, стаж на рынке и обращения. Анкеты разработчиков не используются. Рейтинг обновляется ежеквартально.
Ключевые функции озёра данных (Data Lake)
Перечень собран редакцией по рыночным обзорам, сравнениям и требованиям заказчиков.
Обязательные – есть у лидеров рынка
| Функция | Что это |
|---|---|
| Ролевая модель доступа на уровне таблиц и столбцов | |
| Реестр российского ПО | |
| Горизонтальное масштабирование | |
| Распределённая параллельная обработка | |
| Установка в собственном контуре (on-premise) | |
| Объектное хранилище S3 | |
| Открытые форматы таблиц (Iceberg, Delta Lake, Hudi) |
Важные – отличают решения друг от друга
- Разделение хранения и вычислений
- Маскирование данных
- Аудит доступа к данным
- Apache Spark
- Trino
- Apache Hadoop
- Сертификат ФСТЭК УД4
- Интеграция с BI-системами
- Интеграция с ML-фреймворками
- Репликация данных
- Резервное копирование и восстановление
- Потоковая обработка (Kafka, Flink)
- Обработка неструктурированных данных
- Развёртывание в Kubernetes
- Мониторинг состояния кластера
- Управление метаданными
- Data Lineage
- Контроль качества данных
- ACID-транзакции
- Time travel (версии таблиц)
- Партиционирование данных
Как выбрать: критерии, кроме функций
- Стоимость владения
- Поддержка 24/7 и сроки устранения уязвимостей
- Число внедрений и миграций
Как пользоваться рейтингом и каталогом
- Отметьте в фильтрах каталога обязательные для вас функции и модель поставки – список сократится до подходящих решений.
- Сверьтесь с рейтингом озёра данных (Data Lake): он учитывает функции, отзывы разных организаций, госзакупки, кейсы и срок на рынке. Как считается рейтинг.
- В карточке продукта смотрите блок «Проверено площадкой»: реестр российского ПО, ЕГРЮЛ разработчика, закупки, сертификаты ФСТЭК и ФСБ.
- Запросите демо или пробный доступ у двух-трёх финалистов и проверьте на них ключевые сценарии.
О категории «Озёра данных (Data Lake)»
Российское ПО для озер данных (Data Lake)
Подкатегория решений для хранения больших объемов сырых данных различных форматов. Российские Data Lake платформы позволяют компаниям хранить данные перед обработкой и анализом.
Назначение и область применения
Озера данных используются компаниями для хранения больших объемов данных в различных форматах. Решения позволяют компаниям гибко обрабатывать данные и создавать различные аналитические решения.
Ключевые функции и компоненты
Система хранения данных различных форматов (структурированные, полуструктурированные, неструктурированные), система управления каталогом данных, система контроля качества. Система управления доступом, система управления жизненным циклом данных, система оптимизации затрат на хранение.
Рекомендации по выбору
Выбирайте систему с поддержкой различных форматов данных. Оцените управление каталогом и метаданными. Рекомендуется проверить масштабируемость и затраты на хранение.