SQLデータリネージツール:列レベルの自動リネージ

Gudu SQLFlow 自動化されています SQLデータリネージツールSQL(クエリ、ストアドプロシージャ、dbtプロジェクト、またはデータベース全体)を入力すると、インタラクティブな 列レベルのデータリネージ あらゆるデータがどこから来てどこへ行くのかを正確に示す図。エージェントのインストールも、手動マッピングも、スプレッドシートも不要です。

39SQL方言にはそれぞれ専用のパーサーがある。
列レベル単なる食卓から食卓への系譜ではない
13,000+実世界のSQL回帰テストフィクスチャ
ゼロデータへのアクセス — 静的分析のみ

30秒で試してみましょう: 任意の SQL クエリを貼り付ける 無料オンラインSQL系統可視化ツール すると、列レベルの系統図が表示されます。公開されているサンプルを見るのに登録は不要です。

SQLデータリネージとは何ですか?

SQLデータリネージとは、SQLコード内でデータがどのように移動し、変換されるかを示すマップです。どのソーステーブルと列が各ターゲットテーブル、ビュー、レポートにデータを提供し、その過程でデータに何が起こるか(結合、フィルタ、集計、型変換、関数呼び出しなど)を示します。リネージは、すべてのデータチームが日々抱く2つの疑問に答えます。 「この数字はどこから来たのですか?」 (由来) 「この列を変更すると、何が壊れますか?」 (影響分析)

データウェアハウス内のデータ変換ロジックのほとんどは、ビュー、ストアドプロシージャ、ETLスクリプト、dbtモデル、スケジュール済みクエリなど、SQLで記述されているため、そのSQLを解析することが、データリネージを構築する上で最も正確かつ侵襲性の低い方法です。SQLFlowはまさにそれを実現します。SQLコードの静的解析を実行するため、データへのアクセスは一切不要で、ランタイムログベースのアプローチでは見逃してしまうロジックも捕捉します。

SQLFlowの仕組み

  1. SQLを取り込む。 SQLの貼り付け、ファイルのアップロード、JDBC経由でのデータベース接続によるDDLの取得と定義の表示、dbtマニフェストのインポート、またはデータウェアハウスのクエリ履歴のフィード(Snowflakeクエリ履歴とRedshiftクエリログはネイティブでサポートされています)が可能です。
  2. 解析する。 SQLFlowは、 汎用SQLパーサー(GSP)GSPは、2000年代半ばから開発され、13,000を超える方言ごとのSQLテストフィクスチャで検証された商用SQLコンパイラのフロントエンドです。GSPは、CTE、サブクエリ、ビュー、スター展開を通じてすべての列参照を解決し、SQLの完全なセマンティックモデルを構築します。その後、データフローアナライザーが列単位でソースとターゲットの関係を抽出します。
  3. 視覚化してエクスポートします。 その結果、ドリルダウンして詳細を確認したり、任意の列から上流と下流を追跡したり、JSON、CSV、PNG形式でエクスポートしたり、REST APIを介してプログラムでクエリを実行したりできるインタラクティブな図が作成されます。

テーブルレベルだけでなく、列レベルの系統情報

テーブルレベルの系統図は、 収益報告 から構築されています 注文顧客列レベルの系統図は、 レポート収益合計 は次のように計算されます SUM(orders.amount) フィルター 注文状況参加日 顧客ID そしてそれは 顧客メール は全く関与しない。その違いこそが、血統を法的措置の対象とする理由である。

  • スキーマ変更前の影響分析:単に同じテーブルにアクセスするだけのレポートではなく、列が実際にデータを提供するすべての下流レポートを特定します。
  • 数値が間違っている場合の根本原因分析:出力列の一つから逆方向にたどり、すべての変換を経て真の原因を特定します。
  • コンプライアンスと監査:どのソースフィールドが規制対象の出力に流れ込むかを正確に証明する ― BCBS 239やGDPRデータマッピングなどの粒度フレームワークが求めるレベル。

SQLFlowはさらに分離します 直系の血統 から 間接的(影響)系統. で使用される列 どこ 句、 参加する 状態、または グループ分け 出力には直接反映されませんが、結果に大きな影響を与えます。SQLFlowはこれらを個別の切り替え可能な関係タイプとしてモデル化するため、純粋なデータフローと影響範囲全体を確認できます。ほとんどのデータリネージツールでは、このような区別は一切ありません。

39種類のデータベースをサポート

SQLFlowは、39種類のデータベースとクエリエンジン向けに、汎用的なANSI文法ではなく、方言固有のパーサーを提供しています。

カテゴリデータベース
クラウドデータウェアハウスSnowflake、Google BigQuery、Amazon Redshift、Databricks、Azure SQL、Amazon Athena
従来のRDBMSOracle、SQL Server、MySQL、PostgreSQL、IBM DB2、Sybase、Informix、SQLite、EDB Postgres
MPPと分析Teradata、Netezza、Greenplum、Vertica、SAP HANA、ClickHouse、DuckDB、Doris、StarRocks
ビッグデータとクエリエンジンHive、Impala、Spark SQL、Presto、Trino、Flink SQL
その他のプラットフォームCouchbase、Salesforce SOQL、Power Query M、OpenEdge、ODBC、Dameng、GaussDB、OceanBase、MDX

方言のサポートは積極的に拡大しています。EDB Postgres、Dameng、OceanBase、Power Query M はすべて 2026 年に追加されました。お使いの方言がリストにない場合は、 私たちに尋ねてください顧客からの要望に応じて、新しい方言が追加されます。

ストアドプロシージャ、動的SQL、およびdbt

実際のデータウェアハウスは、整然としたSELECT文だけで構成されているわけではありません。SQLFlowは、複雑な部分を分析します。

  • ストアドプロシージャ: Oracle PL/SQLおよびSQL Server T-SQL専用の手続き文法は、手続き本体、パラメータ、および一時テーブルを通してトレースリネージを行い、対話型の コールグラフ どの手続きがどの手続きを呼び出すのか。
  • 動的SQL: プロシージャ内で組み立てられたSQLは、スキップされるのではなく、解決および分析される。これは、データリネージツールにおける最も一般的な盲点の1つである。
  • dbtプロジェクト: dbtマニフェストをインポートすると、モデル全体にわたる列レベルのデータリネージを取得でき、デプロイ先のデータウェアハウスと整合性が取れます。
  • SQLからER図を作成する: SQLFlowは、DDLから主キーと外部キーの関係を推論し、エンティティ関係図を作成します。これは、ドキュメントが存在しない場合に特に役立ちます。

家系に関する質問は、平易な英語で尋ねてください。

バージョン8.2.3以降、SQLFlowにはAIを活用した系統クエリが含まれています。次のような質問をしてください。 「どのレポートが顧客のメールに依存しているのですか?」 また 「revenue_totalの計算方法を要約してください」 系統図に直接照らし合わせて回答を作成します。回答は実際の系統図に基づいており、AIが参照するすべての表と列は、ユーザーに届く前に分析済みの系統図と照合して検証されます。

デプロイメントを選択してください

最適動作方法
SQLFlow クラウド今すぐ系譜を求める個人やチームSaaS、無料プランあり。SQLを貼り付けるか、ブラウザでソースに接続してください。
SQLFlow オンプレミス銀行、医療、規制環境ネットワーク内でDocker/Kubernetesを使用すれば、SQLはインフラストラクチャから決して外に出ることはありません。
REST APIパイプラインとプラットフォームにおける系統情報の自動化完全な分析結果はJSON over HTTPエンドポイントとして表示されます。
JavaScriptウィジェット自社製品に系統図を埋め込む30種類以上のメソッドを備えたJS APIで、あらゆるWebアプリに簡単に組み込めます。
Java ライブラリJVMアプリケーションに系統情報を組み込むGSP DataFlowAnalyzerをJAR依存関係として追加

エンタープライズ展開は、100 を超えるデータベースと 100 万を超える列の環境まで拡張可能で、増分スキャン、永続的なリネージ リポジトリ、エクスポート アダプタを備えています。 DataHub、Microsoft Purview、およびOpenMetadata つまり、SQLFlowは、既に実行しているカタログ内で系統追跡エンジンとして機能することができるのです。

データの出所を推測するのはやめましょう

クエリを貼り付けると、列レベルの履歴が表示されます。公開されているサンプルは無料で、登録も不要です。

SQLFlowをどのような目的で利用するのか

  • 影響分析: 列の名前を変更したり、入力し直したり、削除したりする前に、その列のすべての下流の利用者を把握しておいてください。
  • データ問題のデバッグ: ダッシュボード上の誤った数値を、すべてのビューと手順を遡って、数日ではなく数分でその発生源まで追跡する。
  • 規制遵守: BCBS 239、GDPR、SOX、および内部監査のために、列レベルの来歴文書を作成する。
  • 移行計画: OracleやTeradataからSnowflake、BigQuery、またはDatabricksに移行する前に、真の依存関係グラフをマッピングし、移行後に孤立したデータが残っていないことを確認してください。
  • データ ガバナンス: 手作業でデータカタログを管理する代わりに、正確で自動的に更新される系統情報をデータカタログに取り込むようにしましょう。

SQLFlowはオープンソースの選択肢と比べてどうですか?

オープンソースのパーサーは、本番環境のSQLが難しくなるとそこで止まってしまう。 次のようなプロジェクト SQL Lineage (Python) sqlglot これらは個々のクエリを解析するための優れたツールであり、単純な SELECT/INSERT ステートメントであれば、これだけで十分な場合もあります。しかし、実際の運用コードでは、そのギャップが顕著になります。ストアドプロシージャや動的 SQL、数十ものエンジンにまたがる方言固有の構文、データベースメタデータを必要とするスター展開やビュー解決、フィルタ条件や結合条件による間接的なリネージ、そして数千ものスクリプト規模でのリネージの可視化(抽出だけでなく)などです。SQLFlow のパーサーは、13,000 を超える実際の SQL フィクスチャからなる回帰テスト コーパスに対して、20 年近くにわたり商用開発されてきました。ハード SQL に対するこの深い理解こそが、お客様が支払う価値なのです。評価を検討されている場合は、最も複雑なストアドプロシージャを両方で実行して比較してみてください。

よくある質問

SQLFlowは私のデータにアクセスする必要がありますか?

いいえ。SQLFlowはSQLコードの静的解析を行い、必要に応じてスキーマメタデータ(テーブルと列の定義)を読み取ります。テーブルの行を読み取ることは決してありません。オンプレミス版では、SQLテキストもネットワーク内に留まります。

無料版はありますか?

はい。 SQLFlow クラウド 無料プランでは、SQL文を貼り付けるだけで、ブラウザ上で列レベルの系統図を取得できます。有料プランでは、より大きな入力データ、APIアクセス、チーム機能などが追加されます。

SQLFlowはストアドプロシージャを分析できますか?

はい、これはSQLFlowの最も優れた機能の一つです。Oracle PL/SQLとSQL Server T-SQLには専用のプロシージャパーサーが備わっています。SQLFlowはプロシージャパラメータ、一時テーブル、動的SQLを通して処理の流れを追跡し、プロシージャ間の呼び出しグラフを描画します。

列レベルの系統情報は、テーブルレベルの系統情報とどのように異なるのですか?

テーブルレベルの系統図は、どのテーブルがどのテーブルにデータを供給しているかを示します。列レベルの系統図は、出力列ごとに、その列にデータを供給している正確なソース列と適用された変換を示します。列レベルの系統図こそが、影響分析や監査の回答を概算ではなく正確なものにするのです。

SQLFlowはdbtをサポートしていますか?

はい。dbtマニフェストをインポートすると、SQLFlowがdbtモデル全体にわたる列レベルのデータリネージを生成し、モデルとそれらが構築するウェアハウスオブジェクトとの整合性を取ることができます。

データ系統情報をDataHub、Purview、またはOpenMetadataにエクスポートできますか?

はい。エンタープライズ向け展開では、DataHub、Microsoft Purview、OpenMetadata用のエクスポートアダプタに加え、JSONおよびCSVエクスポート機能、そしてカスタムデータに対応するREST APIが提供されます。

SQLFlowの料金はいくらですか?

SQLFlow Cloudは無料からスタート。プレミアムアカウントは月額$49.99。SQLFlow On-Premiseは月額$500、または選択したデータベースタイプごとに1回限りの$4,800で、2台のサーバーにインストール可能。詳細は以下を参照。 価格設定 詳細は

SQLの系統図を今すぐ確認しましょう

無料のビジュアライザーにクエリを貼り付けるか、所有地全体のスキャンについてご相談ください。