Блог

Здесь мы публикуем новости из мира Data Lakehouse и аналитики больших данных, рассказываем о релизаx продуктов CedrusData, делимся экспертными выступлениями команды наших инженеров

Актуальные проблемы реализации data-стратегии в российских компаниях | Запись выступления

В докладе рассмотрены сложности, с которыми сталкиваются российские компании при попытке масштабирования процессов принятия решений на основе данных: дефицит зрелой инфраструктуры, нерациональное использование внутренних ресурсов, и противоречивый информационный фон, создаваемый многочисленными новыми продуктами

CedrusData присоединяется к направлению дата-сервисов VK Tech

Мы объединяемся с VK Tech, чтобы усилить lakehouse-платформу VK Data Platform нашим высокопроизводительным массивно-параллельным SQL-движком CedrusData Engine и каталогом метаданных CedrusData Catalog с поддержкой Iceberg

Разработка нативного акселератора SQL-запросов на Rust для Trino | Запись выступления

Почему мы выбрали Rust и DataFusion в качестве основы решения CedrusData Engine, с какими сложностями столкнулись, какие преимущества получили в результате

Быстрая обработка данных в Data Lake с помощью SQL | Запись выступления

Популярные распределенные SQL-движки, такие как Trino, Presto и Dremio, умеют выполнять SQL-запросы непосредственно к файлам в озере данных, что позволяет компаниям более гибко и эффективно анализировать свои данные за счет уменьшения потребности в ETL

Composable systems | Запись выступления

Некоторые считают, что выбор Java в качестве платформы для создания базы данных является не самой рациональной опцией. Посмотрим, какой набор инструментов есть в арсенале у современных разработчиков баз данных на Java для повышения производительности и эффективности

partnership-zakroma
ЗАКРОМА.Хранение сертифицировано для работы CedrusData

Мы успешно завершили сертификацию технологической совместимости массивно-параллельного SQL-движка CedrusData Engine с объектным S3-хранилищем ЗАКРОМА.Хранение

Выбрасываем Java и кратно ускоряем Spark/Trino… Или пока нет? | Запись выступления

Velox — высокопроизводительная C++ библиотека для ускорения Presto, Spark и аналитических СУБД. Обсуждаем ее архитектуру, преимущества и готовность к использованию.

SQL-движок CedrusData совместим с Object Storage от VK Tech
SQL-движок CedrusData совместим с Object Storage от VK Tech

VK Tech и CedrusData подтвердили совместимость аналитического SQL-движка CedrusData Engine с объектным S3-хранилищем VK Object Storage

Безопасность lakehouse-платформ

Рассказываем о ключевых преимуществах архитектуры lakehouse — масштабируемости и высокой скорости внедрения новых функций, о проблеме устаревших методов обеспечения безопасности, которые традиционно применяются в озерах данных

Обработка данных в Data Lake с помощью Trino | Запись выступления

Как ключевые оптимизации и локальные кэши обеспечивают высокую производительность Trino при работе с озерами данных. Сравнение эффективности с классическими хранилищами

Выполнение SQL-запросов в Presto/Trino | Запись выступления

Особенности работы serverless SQL-движка для распределённых запросов: выполнение запросов, оптимизация, распределение задач и управление ресурсами

CedrusData подтвердила совместимость с S3-хранилищем YADRO
CedrusData подтвердила совместимость с S3-хранилищем YADRO

CedrusData подтвердила совместимость распределенной SQL-системы для создания аналитических платформ с S3-хранилищем YADRO TATLIN.OBJECT

Прокрутить вверх