データ品質ファイアウォールは、ソフトウェアを使用して、誤ったデータ、重複したデータ、または低品質のデータの侵入からコンピュータ システムを保護するものです。ガートナーは2017 年に、低品質のデータによって組織が年間平均 1,500 万ドルの損失を被っていると推定しました。[1]以前のテクノロジでは、データ品質ソフトウェアの緊密な統合が必要でしたが、現在では、サービス指向アーキテクチャでテクノロジを疎結合することでこれを実現できます。
特徴と機能
データ品質ファイアウォールは、データベースの正確性と一貫性を保証します。このアプリケーションは、有効で高品質のデータのみがシステムに入力されることを保証し、データベースを間接的に損傷から保護します。データベースの整合性とセキュリティは絶対に不可欠であるため、これは非常に重要です。データ品質ファイアウォールは、システムに送信されたデータの品質に関するリアルタイムのフィードバック情報を提供します。
データ品質プロセスの主な目標は、エラーのある無効なデータをキャプチャし、それらを処理して重複を排除し、最後に、データベースにバックアップ コピーを保存せずに有効なデータをユーザーにエクスポートすることです。データ品質ファイアウォールは、ネットワーク セキュリティ ファイアウォールと同様に機能します。品質に問題があるデータをフィルタリングして、残りの有効なデータをデータベースに保存できるようにすることで、パケットが指定されたポートを通過できるようにします。つまり、ファイアウォールはデータ ソースとデータベースの間に位置し、データの抽出、処理、および読み込み全体にわたって機能します。
データ ストリームが正しい、または信頼できると判断されるには、正確な妥当性チェックを受ける必要があります。このようなチェックは、時間的、形式的、論理的、予測的なチェックです。
参照
参考文献
- ^ 「データ品質の課題を克服するための4つのステップ」。ガートナー。2023年12月27日閲覧。
