Data Ocean Nova — lakehouse-платформа данных ООО «Дата Бленд», центральный продукт семейства Data Ocean. Разработчик позиционирует её как замену классических MPP-систем и озёр данных на Hadoop. Построена на табличном формате Apache Iceberg и S3-совместимом хранилище с разделением слоёв хранения и вычислений. Внесена в реестр российского ПО.

О продукте

Data Ocean Nova — платформа данных ООО «Дата Бленд». Разработчик описывает её как «Lakehouse-платформу данных нового поколения: высокая производительность при минимальных затратах» и прямо адресует её на замену классических систем массивно-параллельных вычислений и озёр данных на экосистеме Hadoop.

Архитектура

Хранение и вычисления разведены: «Независимое масштабирование за счёт разделения слоя хранения и слоя вычислений». Данные лежат в S3-совместимом объектном хранилище. Про табличный формат разработчик пишет: «Iceberg используется в качестве табличного формата хранения реляционных данных. Реализует ACID-подход, эволюцию метаданных, data time travel операции».

Вычислительный слой собран из нескольких движков: Spark с ускорителем DataFusion Comet, Trino как SQL-движок федеративных запросов, а также Impala и StarRocks — «быстрые и эффективные SQL-движки массивной параллельной обработки данных».

Как подключаться

«Система может работать с любыми внешними клиентами посредством стандартных JDBC-, ODBC- и ADBC-подключений» — то есть платформа встаёт под уже используемые BI- и ETL-инструменты.

Остальные продукты семейства

Сайт называет Data Ocean «семейством отечественных IT-продуктов, готовых к внедрению». Кроме Nova в него входят:

  • Data Ocean Store — «высокопроизводительное объектное хранилище данных для аналитики»: совместимость со стандартами S3, оптимизации для Apache Iceberg, отказоустойчивая конфигурация Active-Active между ЦОД, шифрование и интеграция с внешним KeyCloak;
  • Data Ocean Flex Loader — «инструмент для быстрого наполнения хранилища или озера данных на базе GreenPlum, Hadoop или S3»;
  • Data Ocean SDI — «Low-code инструмент для потоковой обработки и репликации данных»;
  • Data Ocean Platform UI — UI Deploy для установки и обновления, UI Control для администрирования и UI Explore — «пользовательская self-service среда анализа данных».

Сценарии

Для Store разработчик перечисляет сценарии: подсистема хранения для lakehouse-платформ с разделением уровней хранения и вычисления; real-time data hub для обмена данными внутри предприятия; «охлаждение и отчуждение данных DWH с целью оптимизации стоимости владения»; файловое хранилище.

Поставка и реестр

Разворачивается в публичном и частном облаке, on-premise или гибридно. На сайте есть разделы документации и драйверов, релизной политики, лицензирования и поддержки, а также партнёрская программа; демо — по запросу. Разработчик заявляет: «Платформа Data Ocean Nova внесена в Реестр российского программного обеспечения как средство обработки больших данных. Реестровая запись № 19 390».

Что важно знать до выбора

Платформа собрана из открытых компонентов (Iceberg, Spark, Trino, Impala, StarRocks) с промышленной обвязкой и поддержкой разработчика — стоит заранее уточнить, какие движки входят в поставку и как лицензируются остальные продукты семейства. Сайт продуктов — dataplatform.ru, юрлицо — ООО «Дата Бленд»; с аналитическими платформами Data Sapience продукт связан через общую группу компаний.

Сколько стоит

Цены — на сайте разработчика — там они всегда сегодняшние

Сумм мы не публикуем: они меняются чаще, чем мы успеваем их проверять, а устаревшая цифра подрывает доверие ко всему разбору. Актуальную стоимость называет сам разработчик.

Узнать цену у разработчика
1 · 5 модулей — что входит, а за что доплата
Подключение по JDBC, ODBC и ADBC

«Система может работать с любыми внешними клиентами посредством стандартных JDBC-, ODBC- и ADBC-подключений» — платформа встаёт под уже используемые BI- и ETL-инструменты.

Страница модуля →
Слой хранения на Apache Iceberg

Данные лежат в S3-совместимом объектном хранилище. Про табличный формат разработчик пишет: «Iceberg используется в качестве табличного формата хранения реляционных данных. Реализует ACID-подход, эволюцию метаданных, data time travel операции».

Страница модуля →
Spark с ускорителем DataFusion Comet

Часть вычислительного слоя платформы. Хранение и вычисления разведены: «Независимое масштабирование за счёт разделения слоя хранения и слоя вычислений».

Страница модуля →
Trino — федеративные SQL-запросы

SQL-движок федеративных запросов в составе вычислительного слоя.

Страница модуля →
Impala и StarRocks — MPP SQL-движки

Разработчик описывает их как «быстрые и эффективные SQL-движки массивной параллельной обработки данных».

Страница модуля →

Жёлтым со знаком «плюс» — то, что тарифицируется отдельно и добавляется к счёту. Зелёным с галочкой — то, что уже входит в тариф.

=
счёт

Структуру видно, сумму — нет: точную цифру называет только сам разработчик, и только на сегодня.

Модули (5)

Функциональные блоки в составе платформы

Слой хранения на Apache Iceberg Входит в тариф

Данные лежат в S3-совместимом объектном хранилище. Про табличный формат разработчик пишет: «Iceberg используется в качестве табличного формата хранения реляционных данных. Реализует ACID-подход, эволюцию метаданных, data time travel операции».

Spark с ускорителем DataFusion Comet Входит в тариф

Часть вычислительного слоя платформы. Хранение и вычисления разведены: «Независимое масштабирование за счёт разделения слоя хранения и слоя вычислений».

Trino — федеративные SQL-запросы Входит в тариф

SQL-движок федеративных запросов в составе вычислительного слоя.

Impala и StarRocks — MPP SQL-движки Входит в тариф

Разработчик описывает их как «быстрые и эффективные SQL-движки массивной параллельной обработки данных».

Подключение по JDBC, ODBC и ADBC Коннектор

«Система может работать с любыми внешними клиентами посредством стандартных JDBC-, ODBC- и ADBC-подключений» — платформа встаёт под уже используемые BI- и ETL-инструменты.

Какие задачи это закрывает (2)

Формулировки владельца бизнеса, а не разработчика. Нажмите — увидите, какие ещё решения эту задачу закрывают.

Возможности (5)

Что решение умеет делать — по данным с сайта разработчика

Характеристики (7)

Паспортные данные — развёртывание, интеграции, безопасность

В реестре отечественного ПО есть, номер опубликован
Класс продукта хранилище данных (DWH), озеро данных и lakehouse
Открытый исходный код собран на открытых компонентах, поставка коммерческая
Доступность в России российский разработчик
Развёртывание оба
Номер реестровой записи 19390
Ещё 1 характеристика
Визуализация и BI подключается внешний BI

О разработчике

Редакция Soframe сверила факты с сайтом разработчика 7 сентября 2026 г. Что-то устарело — напишите нам, поправим.

Похожие решения

Чем заменить Data Ocean Nova →