Data Ocean Nova — lakehouse-платформа данных ООО «Дата Бленд», центральный продукт семейства Data Ocean. Разработчик позиционирует её как замену классических MPP-систем и озёр данных на Hadoop. Построена на табличном формате Apache Iceberg и S3-совместимом хранилище с разделением слоёв хранения и вычислений. Внесена в реестр российского ПО.
О продукте
Data Ocean Nova — платформа данных ООО «Дата Бленд». Разработчик описывает её как «Lakehouse-платформу данных нового поколения: высокая производительность при минимальных затратах» и прямо адресует её на замену классических систем массивно-параллельных вычислений и озёр данных на экосистеме Hadoop.
Архитектура
Хранение и вычисления разведены: «Независимое масштабирование за счёт разделения слоя хранения и слоя вычислений». Данные лежат в S3-совместимом объектном хранилище. Про табличный формат разработчик пишет: «Iceberg используется в качестве табличного формата хранения реляционных данных. Реализует ACID-подход, эволюцию метаданных, data time travel операции».
Вычислительный слой собран из нескольких движков: Spark с ускорителем DataFusion Comet, Trino как SQL-движок федеративных запросов, а также Impala и StarRocks — «быстрые и эффективные SQL-движки массивной параллельной обработки данных».
Как подключаться
«Система может работать с любыми внешними клиентами посредством стандартных JDBC-, ODBC- и ADBC-подключений» — то есть платформа встаёт под уже используемые BI- и ETL-инструменты.
Остальные продукты семейства
Сайт называет Data Ocean «семейством отечественных IT-продуктов, готовых к внедрению». Кроме Nova в него входят:
- Data Ocean Store — «высокопроизводительное объектное хранилище данных для аналитики»: совместимость со стандартами S3, оптимизации для Apache Iceberg, отказоустойчивая конфигурация Active-Active между ЦОД, шифрование и интеграция с внешним KeyCloak;
- Data Ocean Flex Loader — «инструмент для быстрого наполнения хранилища или озера данных на базе GreenPlum, Hadoop или S3»;
- Data Ocean SDI — «Low-code инструмент для потоковой обработки и репликации данных»;
- Data Ocean Platform UI — UI Deploy для установки и обновления, UI Control для администрирования и UI Explore — «пользовательская self-service среда анализа данных».
Сценарии
Для Store разработчик перечисляет сценарии: подсистема хранения для lakehouse-платформ с разделением уровней хранения и вычисления; real-time data hub для обмена данными внутри предприятия; «охлаждение и отчуждение данных DWH с целью оптимизации стоимости владения»; файловое хранилище.
Поставка и реестр
Разворачивается в публичном и частном облаке, on-premise или гибридно. На сайте есть разделы документации и драйверов, релизной политики, лицензирования и поддержки, а также партнёрская программа; демо — по запросу. Разработчик заявляет: «Платформа Data Ocean Nova внесена в Реестр российского программного обеспечения как средство обработки больших данных. Реестровая запись № 19 390».
Что важно знать до выбора
Платформа собрана из открытых компонентов (Iceberg, Spark, Trino, Impala, StarRocks) с промышленной обвязкой и поддержкой разработчика — стоит заранее уточнить, какие движки входят в поставку и как лицензируются остальные продукты семейства. Сайт продуктов — dataplatform.ru, юрлицо — ООО «Дата Бленд»; с аналитическими платформами Data Sapience продукт связан через общую группу компаний.
Сколько стоит
Сумм мы не публикуем: они меняются чаще, чем мы успеваем их проверять, а устаревшая цифра подрывает доверие ко всему разбору. Актуальную стоимость называет сам разработчик.
Узнать цену у разработчикаПодключение по JDBC, ODBC и ADBC
«Система может работать с любыми внешними клиентами посредством стандартных JDBC-, ODBC- и ADBC-подключений» — платформа встаёт под уже используемые BI- и ETL-инструменты.
Страница модуля →Слой хранения на Apache Iceberg
Данные лежат в S3-совместимом объектном хранилище. Про табличный формат разработчик пишет: «Iceberg используется в качестве табличного формата хранения реляционных данных. Реализует ACID-подход, эволюцию метаданных, data time travel операции».
Страница модуля →Spark с ускорителем DataFusion Comet
Часть вычислительного слоя платформы. Хранение и вычисления разведены: «Независимое масштабирование за счёт разделения слоя хранения и слоя вычислений».
Страница модуля →Trino — федеративные SQL-запросы
SQL-движок федеративных запросов в составе вычислительного слоя.
Страница модуля →Impala и StarRocks — MPP SQL-движки
Разработчик описывает их как «быстрые и эффективные SQL-движки массивной параллельной обработки данных».
Страница модуля →Жёлтым со знаком «плюс» — то, что тарифицируется отдельно и добавляется к счёту. Зелёным с галочкой — то, что уже входит в тариф.
Структуру видно, сумму — нет: точную цифру называет только сам разработчик, и только на сегодня.
Модули (5)
Функциональные блоки в составе платформы
Данные лежат в S3-совместимом объектном хранилище. Про табличный формат разработчик пишет: «Iceberg используется в качестве табличного формата хранения реляционных данных. Реализует ACID-подход, эволюцию метаданных, data time travel операции».
Часть вычислительного слоя платформы. Хранение и вычисления разведены: «Независимое масштабирование за счёт разделения слоя хранения и слоя вычислений».
SQL-движок федеративных запросов в составе вычислительного слоя.
Разработчик описывает их как «быстрые и эффективные SQL-движки массивной параллельной обработки данных».
«Система может работать с любыми внешними клиентами посредством стандартных JDBC-, ODBC- и ADBC-подключений» — платформа встаёт под уже используемые BI- и ETL-инструменты.
Какие задачи это закрывает (2)
Формулировки владельца бизнеса, а не разработчика. Нажмите — увидите, какие ещё решения эту задачу закрывают.
Возможности (5)
Что решение умеет делать — по данным с сайта разработчика
Характеристики (7)
Паспортные данные — развёртывание, интеграции, безопасность
Ещё 1 характеристика
О разработчике
Редакция Soframe сверила факты с сайтом разработчика 7 сентября 2026 г. Что-то устарело — напишите нам, поправим.