メインコンテンツまでスキップ

データ統合

VeloDB Cloud は、ユースケースに応じて外部データを操作する3つのアプローチをサポートしています。

使用する場合ドキュメント
Import管理されたパイプラインが必要な場合:データベース、オブジェクトストレージ、またはイベントストリームからの継続的または定期的な取り込みImport
Catalogデータを移動せずに外部データをその場でクエリしたい場合Add Catalog
MigrationApache Doris または VeloDB から既存のウェアハウス全体を一度に移行する場合Migration

Import

Import はビジュアルインターフェースを持つ管理された取り込みパイプラインを提供します。以下をサポートしています:

  • データベース: CDC による MySQL および PostgreSQL、自動テーブル作成とオフセット追跡を含む。
  • オブジェクトストレージ: S3 からのバッチロード。
  • イベントストリーム: Kafka、Confluent、および Amazon MSK からの継続的な取り込み。

データが定期的またはリアルタイムで到着する必要があり、VeloDB にパイプラインの状態を管理させたい場合に Import を使用してください。

Add Catalog

Catalog では、外部データソース(Apache Hive、Iceberg、またはオブジェクトストレージなど)を登録し、データを物理的に移動することなく VeloDB Cloud から直接クエリできます。システム間でのフェデレーテッドクエリが必要な場合や重複を避けたい場合に Catalog を使用してください。

Migration

Migration は、既存の Apache Doris または VeloDB ウェアハウスからの一度限りの完全なデータ移動です。一時的なオブジェクトストレージのステージングエリアを使用し、完了後に自動的にクリーンアップします。

他のシステムからのオンボーディングを行い、運用開始前に完全なデータセットを移行する必要がある場合に Migration を使用してください。

このページでは