SQLFlow 온프레미스: 자체 호스팅 SQL 데이터 계보

온프레미스 SQLFlow 구내에 있습니다 데이터 계보 도구Gudu SQLFlow 엔진 전체 버전을 Docker 또는 Kubernetes를 사용하여 사용자 네트워크 내부에 배포합니다. SQL(쿼리, 뷰, 저장 프로시저, dbt 프로젝트, 전체 데이터베이스)을 분석하여 모든 SQL 코드는 방화벽 내부에 안전하게 유지되면서 열 수준의 대화형 계보 다이어그램을 생성합니다. 완전히 격리된 환경에서 실행되며, SQL 코드의 정적 분석을 통해 작동하므로 테이블의 행에는 절대 접근하지 않습니다.

에어갭Docker 또는 Kubernetes 환경에서는 외부 인터넷 연결이 없습니다.
39SQL 방언, 각 방언마다 전용 파서가 있습니다.
SQL이 인프라를 떠납니다
100+부동산별 데이터베이스, 증분 스캔

엔진을 먼저 평가해보고 싶으신가요? 동일한 분석이 실행됩니다. SQLFlow Cloud, 브라우저에서 무료로 이용 가능구매 담당자와 이야기하기 전에 민감하지 않은 쿼리를 붙여넣고 열 수준 출력을 확인하십시오.

규제 대상 팀이 온프레미스 데이터 계보 도구가 필요한 이유

SQL 텍스트는 데이터가 첨부되지 않은 경우에도 민감한 정보일 수 있습니다. DDL은 전체 스키마를 노출하고, 뷰와 프로시저는 위험 모델과 같은 비즈니스 로직을 인코딩합니다. 가격 규칙 및 사기 방지 필터가 있으며, 임시 SQL 쿼리에는 계좌 번호와 같은 리터럴 값이 자주 포함됩니다. 어디 절, 디버깅 쿼리의 환자 식별자. 해당 코퍼스를 SaaS 공급업체에 전송하는 것은 은행, 의료기관 및 정부 기관의 보안 검토가 존재하는 이유인 제3자 데이터 전송의 전형적인 예입니다.

동시에, 이러한 조직들은 데이터 계보를 제시해야 한다는 가장 큰 압박을 받고 있습니다. BCBS 239는 은행들이 위험 수치의 출처를 추적할 것을 요구하고, GDPR 데이터 매핑은 어떤 필드가 어디로 이동하는지 묻고 있으며, SOX 감사관은 재무 보고에 대한 출처 정보를 요구합니다. 이러한 모순을 해결하는 방법은 SQL이 이미 존재하는 곳에서 계보 엔진을 실행하는 것입니다. SQLFlow On-Premise는 바로 이러한 목적을 위해 만들어졌습니다. 당사 웹사이트에서 설명하는 것과 동일한 분석을 제공합니다. SQL 데이터 계보 도구 개요자체 호스팅 방식입니다.

배포 방식: Docker, Kubernetes, 에어갭 환경

SQLFlow On-Premise는 컨테이너 형태로 제공됩니다. Docker를 사용하여 단일 호스트에 배포하거나, 플랫폼 팀에서 소프트웨어를 실행하는 방식에 따라 Kubernetes 클러스터에 배포할 수 있습니다. 라이선스는 두 대의 서버에 대한 설치를 지원하므로 프로덕션 인스턴스와 스테이징 또는 재해 복구(DR) 인스턴스를 추가로 구축하는 데 추가 비용이 발생하지 않습니다. 단계별 설치 가이드는 다음에서 확인할 수 있습니다. docs.gudusoft.com.

이 배포는 완전히 격리된 네트워크 환경에서 작동합니다. 엔진은 클라우드에 종속되지 않으며 SQL 분석을 위해 외부 인터넷 연결이 필요하지 않습니다. 환경이 외부 경로가 차단된 기밀 네트워크 또는 결제 영역인 경우에도 SQLFlow는 계속 실행됩니다. 사용자는 네트워크 내부의 웹 인터페이스를 통해 SQLFlow에 접근할 수 있으며, 동일한 인스턴스는 자동화를 위한 REST API를 제공합니다.

개인정보 보호 정책: 정적 분석만 해당

SQLFlow의 개인정보 보호 모델은 두 가지 명확한 특징 덕분에 보안 검토자에게 설명하기 쉽습니다. 첫째, SQLFlow는 정적 분석기입니다. 런타임에 쿼리를 관찰하거나 테이블을 샘플링하는 방식이 아니라 SQL 코드를 파싱하여 계보를 계산하므로 행 데이터를 읽지 않습니다. 행 데이터를 읽는 코드 경로는 존재하지 않습니다. 둘째, 온프레미스 버전의 경우 SQL 텍스트 자체는 네트워크를 벗어나지 않습니다. SQLFlow가 JDBC를 통해 선택적으로 읽는 것은 해석에 필요한 스키마 메타데이터(테이블, 열, 뷰 정의)입니다. 선택하다 * 참고 자료를 정확하게 확인하십시오.

런타임 로그 기반 계보 분석 방식과 비교해 보면, 이 방식은 실제 운영 환경에서 실행된 내용을 파악하는 데는 탁월하지만 쿼리 로그에 지속적으로 접근해야 하고 실행된 쿼리만 확인할 수 있다는 한계가 있습니다. 반면 정적 분석은 분기말에만 실행되는 프로시저를 포함하여 존재하는 모든 코드를 분석할 수 있으며, SQL 코드 자체만 있으면 됩니다.

엔진이 하는 일

온프레미스 버전은 SQLFlow 클라우드에서 사용되는 것과 동일한 SQLFlow 엔진 전체를 실행합니다. 이 엔진은 2000년대 중반부터 개발되어 약 13,600개의 방언별 테스트 픽스처를 통해 검증된 상용 SQL 컴파일러 프런트엔드인 General SQL Parser를 기반으로 구축되었습니다.

  • 컬럼 수준 계보: 각 출력 열에 대해 해당 열에 데이터를 제공하는 정확한 소스 열과 그 과정에서 사용된 함수, 형변환, 하위 쿼리, 조인 및 집합 연산자를 CTE, 뷰 및 스타 확장을 통해 확인할 수 있습니다.
  • 직접 혈통 vs 간접 혈통: 컬럼은 다음과 같이 사용됩니다. 어디, 가입하다, 그리고 그룹화 기준 절은 결과에 나타나지 않고도 결과를 형성할 수 있습니다. SQLFlow는 이러한 영향을 별도의 전환 가능한 관계 유형으로 모델링하는데, 대부분의 경쟁 도구는 이러한 구분을 하지 않습니다.
  • 39개의 방언별 구문 분석기: Oracle, SQL Server, Teradata, DB2, Snowflake, BigQuery, Redshift, Databricks, PostgreSQL, Hive 및 29개 이상의 플랫폼에서 사용 가능하며, 단일 범용 ANSI 파서가 아닌 각 방언별로 전용 문법을 사용합니다.
  • 저장 프로시저 및 동적 SQL: Oracle PL/SQL 및 SQL Server T-SQL 전용 절차 파서는 매개변수와 임시 테이블을 통해 추적 계보를 추적하고, 동적 SQL을 해석하며, 프로시저 간 호출에 대한 대화형 호출 그래프를 생성합니다.
  • DDL에서 생성된 ER 다이어그램: SQL 쿼리에서 추론된 기본 키/외래 키 관계를 엔티티 관계 다이어그램으로 나타낸 것입니다.
  • AI 계보 조회 (버전 8.2.3부터): 질문은 쉬운 영어로 작성됩니다. AI가 인용하는 모든 표와 열은 표시되기 전에 분석된 그래프와 비교하여 유효성을 검사합니다.

저장 프로시저의 깊이는 온프레미스 환경을 구축하는 데 있어 가장 중요한 요소입니다. 기존의 은행 및 의료 시스템은 다음과 같은 패턴으로 가득 찬 PL/SQL 및 T-SQL 패키지를 기반으로 운영됩니다.

CREATE PROCEDURE dbo.load_regional_summary AS BEGIN DECLARE @sql nvarchar(max) = N'INSERT INTO rpt.daily_summary (region, total_amount) SELECT region, SUM(amount) FROM stg.sales_daily GROUP BY region'; EXEC sp_executesql @sql; END

여기서의 계보는 런타임에만 실행되는 문자열 내에 존재합니다. SQLFlow는 동적 SQL을 해석하고 연결합니다. rpt.daily_summary.total_amount 돌아가기 stg.sales_daily.amount동적 SQL을 건너뛰는 도구는 아무것도 보고하지 않는데, 이는 감사 측면에서 오류보다 더 심각한 문제입니다.

대규모 부동산 관리를 위해 설계되었으며, 개별 검색에는 적합하지 않습니다.

엔터프라이즈 환경에서는 100개 이상의 데이터베이스와 백만 개 이상의 컬럼으로 구성된 대규모 데이터베이스를 일괄 스캔하여 영구적인 데이터 계보 저장소에 저장합니다. 이후 증분 스캔을 통해 변경된 데이터만 처리하므로, 대규모 데이터베이스를 매일 밤 새로 고칠 때 모든 데이터를 다시 파싱할 필요가 없습니다. 입력 데이터는 JDBC를 통한 실시간 데이터베이스 메타데이터, 업로드된 SQL 파일, dbt 매니페스트, Snowflake 쿼리 기록, Redshift 쿼리 로그, Grabit 메타데이터 추출기 등을 포함하며, 출력 데이터는 JSON, CSV, PNG 형식으로 내보내거나 REST API를 통해 제공됩니다.

이미 데이터 카탈로그를 운영하고 있다면 SQLFlow는 기존 카탈로그와 경쟁하는 것이 아니라 오히려 카탈로그에 데이터를 제공합니다. DataHub, Microsoft Purview, OpenMetadata와 같은 카탈로그 우선 플랫폼은 메타데이터, 소유권 및 검색을 위한 훌륭한 기록 시스템이지만, 정확한 SQL 계보를 계산하려면 상위 시스템에 의존합니다. SQLFlow On-Premise는 이 세 가지 모두를 위한 내보내기 어댑터를 제공하므로 팀에서 이미 사용 중인 카탈로그의 계보 엔진 역할을 할 수 있습니다. 이러한 범주들이 어떻게 연관되는지에 대한 더 자세한 내용은 문서를 참조하세요. 최고의 데이터 계보 도구 비교.

가격

SQLFlow On-Premise는 사용자 수나 스캔한 행 수가 아닌 데이터베이스 유형(분석에 사용할 SQL 방언)별로 가격이 책정됩니다. 모든 라이선스에는 두 대의 서버에 대한 설치가 포함되며 기본적으로 50명의 사용자를 지원합니다.

특허신청일회성포함되는 사항
기본 라이선스(데이터베이스 유형 1개)$500/월$4,800서버 2대, 사용자 50명, 풀 엔진, REST API, 카탈로그 내보내기 어댑터
추가 데이터베이스 유형 각각+$100/월+$1,000동일한 설치에 추가되었습니다

Oracle, SQL Server 및 Snowflake를 포함하는 환경은 월 $700 또는 일회성 $6,800으로 책정되며, 영업 담당자와의 통화 없이 예산 요청에 이 금액을 포함할 수 있습니다. 자세한 내용은 다음을 참조하십시오. 가격 페이지.

온프레미스 vs SQLFlow 클라우드

SQLFlow 클라우드온프레미스 SQLFlow
그것이 달리는 곳sqlflow.gudusoft.com에서 SaaS를 이용하세요.네트워크에 Docker/Kubernetes를 설치하고, 에어갭 환경을 구축할 수 있습니다.
SQL이 저장되는 위치Gudu 호스팅 서버에서 분석됨인프라를 떠나지 않습니다
가격무료 요금제; 프리미엄 요금제 $49.99/월데이터베이스 유형별로 월 $500 또는 일회성 $4,800입니다.
사용자계정별기본적으로 사용자 50명
~에 가장 적합함오늘날 계보를 원하는 개인 및 팀은행, 의료기관, 정부기관 및 데이터 상주 규칙이 적용되는 모든 자산

두 버전 모두 동일한 파서를 실행하고 동일한 계보를 생성합니다. 일반적인 경로는 프로토타입을 만드는 것입니다. SQLFlow 클라우드 검증된 SQL을 사용하여 가장 까다로운 프로시저의 출력 품질을 확인한 다음 온프레미스 환경으로 이동하여 리소스를 관리하십시오.

계보 엔진을 방화벽 내부에 유지하십시오.

데이터베이스 구성과 규모를 알려주시면 배포 범위를 설정해 드리거나, 먼저 무료 클라우드 티어에서 검증된 SQL 데이터를 사용하여 엔진 성능을 확인해 드리겠습니다.

자주 묻는 질문

SQLFlow On-Prese는 완전히 독립된 환경에서 실행될 수 있습니까?

예. Docker 또는 Kubernetes 컨테이너로 배포되며, 외부 인터넷 연결이나 분석 경로에 클라우드 종속성 없이 작동합니다.

SQLFlow는 내 테이블의 데이터를 읽어들이는 건가요?

아니요. SQLFlow는 정적 분석기입니다. SQL 코드 파싱을 통해 계보를 계산합니다. 선택적으로 JDBC를 통해 스키마 메타데이터(테이블, 열 및 뷰 정의)를 읽을 수 있지만, 행 데이터는 절대 읽지 않으며, 온프레미스 환경에서는 SQL 텍스트 자체가 네트워크 내에 유지됩니다.

SQLFlow 온프레미스 버전은 얼마인가요?

선택한 데이터베이스 유형당 월 $500 또는 일회성 $4,800의 요금이 부과되며, 기본적으로 서버 2대와 사용자 50명에 대한 설치가 포함됩니다. 동일한 설치 환경에서 데이터베이스 유형을 추가할 경우, 각 추가 데이터베이스 유형당 월 $100 또는 일회성 $1,000이 추가됩니다.

라이선스 하나로 몇 명의 사용자를 지원할 수 있나요?

라이선스당 기본적으로 50명의 사용자가 이용 가능합니다. 더 큰 팀의 경우, 연락하다 Gudu Software는 배포 규모를 결정합니다.

SQLFlow On-Premise는 어떤 데이터베이스를 분석할 수 있습니까?

각각 고유한 파서를 갖춘 39개의 방언을 지원합니다. Oracle, SQL Server, Teradata, DB2, Sybase, Informix, PostgreSQL, MySQL, Snowflake, BigQuery, Redshift, Databricks, Hive, Spark SQL 등을 포함합니다. 라이선스는 데이터베이스 유형별로 제공되므로, 보유 자산에 해당하는 방언에 대해서만 비용을 지불하면 됩니다.

이 기능이 기존 데이터 카탈로그에 계보 정보를 제공할 수 있을까요?

예. DataHub, Microsoft Purview 및 OpenMetadata용 내보내기 어댑터가 포함되어 있으며, JSON 및 CSV 내보내기 기능과 사용자 지정 통합을 위한 REST API도 제공됩니다.

네트워크 내부에서 데이터 계보를 추적하세요

사용하시는 데이터베이스 구성과 시스템 규모를 알려주시면 배포 범위를 설정해 드리거나, 설치 가이드를 참고하여 직접 구축하실 수도 있습니다.