
❌ Pushdown-Optimierung ❌ Unkompliziert Informatica 6x schneller mit CoSort für PDO mit Filter, Sort, Join + Aggregate ❗
Ein Beispiel für eine ELT-Operation wäre die Option Pushdown-Optimierung von Informatica, bei der Benutzer Daten in einer relationalen Datenbank wie Oracle oder in Teradata transformieren. Laut Informatica ermöglicht dieser Ansatz "den IT-Systemen und ihren Betreibern, auf wechselnde Anforderungen und Spitzenverarbeitungsanforderungen zu reagieren".
Unsere Kunden sind der Meinung, dass die Arbeit der großen Datentransformation nicht in Datenbanken gehört, die für Speicherung und Abruf konzipiert sind. Transformationen in der Datenbankschicht können die Datenbank und das gesamte System belasten, Ressourcen aus der Wartung der Datenspeicherung ziehen und Abfragen verlangsamen.
Die Geschwindigkeit ist unter allen Umständen, ob es sich nun um eine ETL- oder ELT-Operation handelt, immer entscheidend für die Gleichung. Die IRI CoSort Engine und die moderne IRI Voracity-Plattform, die sie (oder Hadoop) verwendet, unterstützen beide das ETL-Paradigma. Sie optimieren die Leistung bei der Integration großer Datenmengen durch überlegene Transformationsalgorithmen, Aufgabenkonsolidierung und Nutzung der Dateisystemressourcen. Weitere Informationen finden Sie hier.
Solche externen Operationen sind effizienter, erschwinglicher und entlasten BI-, Datenbank- und ältere ETL-Tools von der Last der Datenintegration und -bereitstellung, so dass sie stattdessen die Aufgaben erledigen können, die sie am besten können. Teradaten-, Hadoop-, In-Memory- und Spaltendatenbanken sowie ELT-Anwendungen sind ebenfalls viel teurere und kompliziertere "First-Resort"-Optionen als CoSort!
Wie funktioniert das?
Wir werden häufig von Kunden angesprochen, die Plattformen wie Informatica PowerCenter verwenden und Produktionsaufträge beschleunigen müssen, bei denen Aufträge wie Sortieren, Zusammenfügen und Aggregieren getrennt voneinander ausgeführt werden.
Mit CoSort werden alle Datentransformationsaufgaben mit einem einzigen Auftragsskript und E/A-Durchlauf ausgeführt. Zu diesen Aufträgen können auch Filterung und Konvertierung, eine umfangreiche Reihe von Schutzmaßnahmen auf Feldebene, benutzerdefinierte Neuformatierung und Berichterstellung mit mathematischen Funktionen, spezielle Layouts, mehrere Ziele usw. gehören.
6x schneller, die "Push out"-Optimierung von Informatica an CoSort ist unkompliziert!
Alle 6 Schritte zur Push Out Optimierung von Informatica finden Sie hier im Blog-Artikel von IRI.
Zu Ihrer Information: Voracity ist die "totale Datenmanagementplattform", die CoSort- oder Hadoop-Engines verwendet (aber in beiden Fällen die gleichen Metadaten).
Voracity kombiniert:
1. Datenentdeckung (DB & Flat-File-Profiling, Klassifizierung, ERDs, Dark Data)
2. Datenintegration (ETL, CDC, SCD, usw.),
3. Datenmigration (für Datenbanken, Dateiformate, Datentypen usw.) und Replikation
4. Datenverwaltung (Bereinigung, Maskierung, EMM, MDM usw.)
5. Analytik (eingebettete Berichterstattung und Datenaufbereitung)
alle in der gleichen Eclipse-GUI. Voracity ist außerdem kompatibel mit Erwin (vorher: AnalytiX DS) Mapping Manager und CATfx-Vorlagen für die Verwaltung der ETL-Metadatenschichtung, Erstellung, Abstammung und Konvertierung.
Weltweite Referenzen: Seit über 40 Jahren nutzen unsere Kunden wie die NASA, American Airlines, Walt Disney, Comcast, Universal Music, Reuters, das Kraftfahrtbundesamt, das Bundeskriminalamt, die Bundesagentur für Arbeit, Rolex, Commerzbank, Lufthansa, Mercedes Benz, Osram,.. aktiv unsere Software für Big Data Wrangling und Schutz! Sie finden viele unserer weltweiten Referenzen hier und eine Auswahl deutscher Referenzen hier.
Partnerschaft mit IRI: Seit 1993 besteht unsere Kooperation mit IRI (Innovative Routines International Inc.) aus Florida, USA. Damit haben wir unser Portfolio um die Produkte CoSort, Voracity, DarkShield, FieldShield, RowGen, NextForm, FACT und CellShield erweitert. Nur die JET-Software GmbH besitzt die deutschen Vertriebsrechte für diese Produkte. Weitere Details zu unserem Partner IRI Inc. hier.
JET-Software entwickelt und vertreibt seit 1986 Software für die Datenverarbeitung für gängige Betriebssysteme wie BS2000/OSD, z/OS, z/VSE, UNIX & Derivate, Linux und Windows. Benötigte Portierungen werden bei Bedarf realisiert.
Wir unterstützen weltweit über 20.000 Installationen. Zu unseren langjährigen Referenzen zählen deutsche Bundes- und Landesbehörden, Sozial- und Privatversicherungen, Landes-, Privat- und Großbanken, nationale und internationale Dienstleister, der Mittelstand sowie Großunternehmen.
JET-Software
Edmund-Lang-Straße 16
64832 Babenhausen
Telefon: +49 (6073) 711-403
Telefax: +49 (6073) 711-405
https://www.jet-software.com
Telefon: +49 (6073) 711403
Fax: 06073-711405
E-Mail: amadeus.thomas@jet-software.com
![]()

❌ Einheitliche Metadaten ❌ Der Schlüssel zur nahtlosen Integration, Bereinigung, Maskierung, Analyse und Bewältigung von Änderungen ❗
Laut Guido de Simone von Gartner ist das Enterprise Metadata Management (EMM) darauf ausgelegt, die Informationen in unserem Unternehmen zu verknüpfen, abzustimmen und zu verwalten. Da die effektive Verwaltung von Metadaten ein Schlüssel zur ordnungsgemäßen Integration, Bereinigung, Sicherung und Bewältigung von Datenänderungen ist, ist eine einfache und einheitliche Metadateninfrastruktur wünschenswert.
Die Datenmanagement-Plattform IRI Voracity und ihre Produkte IRI Data Manager und die IRI Datenschutz-Suite nutzen dieselben einfachen 4GL-Metadaten für das Layout und die Manipulation der Daten. Im Gegensatz zu den Metadaten in älteren Plattformen sind die Datendefinitionsdatei (DDF), die Mapping-Aufgabe (Jobsteuerung) (.*CL), Skripte, Datenklassen- und Regelbibliotheken und ETL-XML-Projektmetadaten (Flow) zugänglich, explizit, portabel und übergreifend für alle Datenquellen und Plattformen, einschließlich Hadoop.
IRI-Metadaten werden in selbstdokumentierenden Textskripten dargestellt, die Sie ändern und überall ausführen können. Es wird auch in der IRI Workbench GUI unterstützt, die auf Eclipse™ basiert, wo es in EMF modelliert wird.
Erstellen & Erfassen: Erkennen, Definieren oder Importieren und Konvertieren von Metadaten.
Modifizieren: Anzeigen und Ändern von Attributen auf Quell- und Spaltenebene von Hand oder in Dialogen.
Regulieren: Definition, Anwendung, Speicherung, Änderung und Wiederverwendung von Regeln, die sich auf Daten an mehreren Stellen gleichzeitig auswirken.
Speichern & wiederverwenden: Lokale, entfernte und Drittanbieterdaten plattformübergreifend, projektspezifisch und in Repositories.
Wiederaufbereiten: Daten in Integrations-, Migrations-, Berichts-, Maskierungs- und Testaufträgen.
Nachverfolgung, Audit und Analyse: Data Governance (Provenienz) und Einhaltung von Vorschriften durch Vorwärts- und Rückwärtslauf sowie grafische Wirkungsanalyse.
Standardisieren und Speichern: Metadaten, Stammdatenwerte und -formate sowie Regeln (für Mapping, Maskierung oder Generierung).
Verwalten und Teilen: Verwenden Sie Git oder andere Eclipse-kompatible Asset-Hubs für Team-Sharing, Versionskontrolle, Abstammung und Sicherheit oder die erwin EDGE (ehemals AnalytiX DS) Plattform für Data Governance integriert mit Voracity.
Wussten Sie: Die Datenlayout- und Mapping-Metadaten von IRI sind seit 1992 weltweit im Einsatz. Es wurde für das Programm Sort Control Language (SortCL) in IRI CoSort (.scl Datentransformation und Reporting) Jobs erstellt. Es wird jetzt auch in Jobskripten von IRI NextForm (.ncl Datenmigration), IRI FieldShield (.fcl Datenmaskierung) und IRI RowGen (.rcl Testdatengenerierung) sowie in IRI Voracity (.xml ETL) Workflows verwendet.
Sie können diese Metadaten auch einfach ändern, exportieren und in Ihrer Anwendung und vielen Daten- und Metadaten-Governance-Plattformen von Drittanbietern verwenden. Erwin Mapping Manager (eMM) und die Meta Integration Model Bridge (MIMB) unterstützen auch IRI-Metadaten. Ihre Benutzer können BI-, CRM-, ETL- und Modellierungswerkzeug-Metadaten problemlos in das gängige Metadatenformat der IRI-Software konvertieren. Wer erwin (ehemals AnalytiX DS) mit Voracity einsetzt, kann auch modernste Metadaten-Linien- und Referenzdatenverwaltungstools in derselben Eclipse-GUI, IRI Workbench, nutzen.
Weitere Informationen finden Sie in diesem Artikel über die Erfassung des Geschäftswerts durch Enterprise Metadata Management.
Weltweite Referenzen: Seit über 40 Jahren nutzen unsere Kunden wie die NASA, American Airlines, Walt Disney, Comcast, Universal Music, Reuters, das Kraftfahrtbundesamt, das Bundeskriminalamt, die Bundesagentur für Arbeit, Rolex, Commerzbank, Lufthansa, Mercedes Benz, Osram,.. aktiv unsere Software für Big Data Wrangling und Schutz! Sie finden viele unserer weltweiten Referenzen hier und eine Auswahl deutscher Referenzen hier.
Partnerschaft mit IRI: Seit 1993 besteht unsere Kooperation mit IRI (Innovative Routines International Inc.) aus Florida, USA. Damit haben wir unser Portfolio um die Produkte CoSort, Voracity, DarkShield, FieldShield, RowGen, NextForm, FACT und CellShield erweitert. Nur die JET-Software GmbH besitzt die deutschen Vertriebsrechte für diese Produkte. Weitere Details zu unserem Partner IRI Inc. hier.
JET-Software entwickelt und vertreibt seit 1986 Software für die Datenverarbeitung für gängige Betriebssysteme wie BS2000/OSD, z/OS, z/VSE, UNIX & Derivate, Linux und Windows. Benötigte Portierungen werden bei Bedarf realisiert.
Wir unterstützen weltweit über 20.000 Installationen. Zu unseren langjährigen Referenzen zählen deutsche Bundes- und Landesbehörden, Sozial- und Privatversicherungen, Landes-, Privat- und Großbanken, nationale und internationale Dienstleister, der Mittelstand sowie Großunternehmen.
JET-Software
Edmund-Lang-Straße 16
64832 Babenhausen
Telefon: +49 (6073) 711-403
Telefax: +49 (6073) 711-405
https://www.jet-software.com
Telefon: +49 (6073) 711403
Fax: 06073-711405
E-Mail: amadeus.thomas@jet-software.com
![]()

❌ Inkrementelle Datenmaskierung + Mapping ❌ Änderungen in Quelltabelle erkennen, aktualisieren + in neues Ziel verschieben ❗
Alle Details zu diesen Operationen finden Sie hier im Blog-Artikel unseres Partners IRI Inc.
Dieser Artikel enthält ein Workflow-Beispiel, das Benutzer von Voracity, FieldShield, CoSort oder der DBMS-Edition NextForm implementieren können, um regelmäßig auf Änderungen in einer Quelltabelle (in diesem Fall Oracle) zu prüfen, um zu entscheiden, wann Daten in ein neues Ziel (MySQL) verschoben werden sollen. Es wird auch gezeigt, wie Daten als Teil dieses Prozesses bedingt maskiert werden können.
Änderungen können mit Hilfe einer aufgabengeplanten Batch-Datei oder eines Shell-Skripts in verschiedene Datenbanken oder Dateien geladen werden. Dies kann unter Verwendung eines Zeitstempels und spezifischer Felder in der Quelltabelle erfolgen. Eine Fehlerprüfung ist ebenfalls enthalten und kann ebenfalls durchgeführt werden.
Dieses Beispiel wurde auf einem Windows-Rechner erstellt und ausgeführt. Es kann leicht modifiziert werden, um auf einer Linux- oder Unix-Plattform zu funktionieren. Das Erstellen der Batch-Datei ist mit Hilfe eines Voracity-Flussdiagramms in WB einfach. In diesem Beispiel enthält die Quelltabelle Spalten mit den Namen CREATED_DATE und UPDATED_DATE, die für diesen Job wichtig sind.
Schlussfolgerung: Mit ein wenig Planung und der Verwendung von Befehlsblöcken können Änderungen an einer Datenbanktabelle mit Hilfe einer Batch-Datei automatisch erkannt und dann so geplant werden, dass sie in ausgewählten Intervallen ausgeführt werden, so dass Sie geänderte Daten auf inkrementeller Basis verschieben, zuordnen, maskieren und anderweitig manipulieren können.
Weltweite Referenzen: Seit über 40 Jahren nutzen unsere Kunden wie die NASA, American Airlines, Walt Disney, Comcast, Universal Music, Reuters, das Kraftfahrtbundesamt, das Bundeskriminalamt, die Bundesagentur für Arbeit, Rolex, Commerzbank, Lufthansa, Mercedes Benz, Osram,.. aktiv unsere Software für Big Data Wrangling und Schutz! Sie finden viele unserer weltweiten Referenzen hier und eine Auswahl deutscher Referenzen hier.
Partnerschaft mit IRI: Seit 1993 besteht unsere Kooperation mit IRI (Innovative Routines International Inc.) aus Florida, USA. Damit haben wir unser Portfolio um die Produkte CoSort, Voracity, DarkShield, FieldShield, RowGen, NextForm, FACT und CellShield erweitert. Nur die JET-Software GmbH besitzt die deutschen Vertriebsrechte für diese Produkte. Weitere Details zu unserem Partner IRI Inc. hier.
JET-Software entwickelt und vertreibt seit 1986 Software für die Datenverarbeitung für gängige Betriebssysteme wie BS2000/OSD, z/OS, z/VSE, UNIX & Derivate, Linux und Windows. Benötigte Portierungen werden bei Bedarf realisiert.
Wir unterstützen weltweit über 20.000 Installationen. Zu unseren langjährigen Referenzen zählen deutsche Bundes- und Landesbehörden, Sozial- und Privatversicherungen, Landes-, Privat- und Großbanken, nationale und internationale Dienstleister, der Mittelstand sowie Großunternehmen.
JET-Software
Edmund-Lang-Straße 16
64832 Babenhausen
Telefon: +49 (6073) 711-403
Telefax: +49 (6073) 711-405
https://www.jet-software.com
Telefon: +49 (6073) 711403
Fax: 06073-711405
E-Mail: amadeus.thomas@jet-software.com
![]()

❌ Cubeware Cockpit ❌ Schnellere Datenintegration und GDPR-anonymisierte Daten für BI-Analysen in Cubeware Cockpit ❗
Voracity ist zwar sehr schnell im Umgang mit Daten und verfügt über ein breites Spektrum an Datenmanipulations- und Datenschutzfunktionen, es fehlt jedoch ein Onboard-Visualisierungs- und Dashboarding-Tool. Hier kommt Cubeware ins Spiel. Umgekehrt steigert Voracity für Anwender von Cubeware Software den Wert ihres Importer-Prozesses durch schnelle, konsolidierte Datentransformation, Bereinigung und Maskierung.
Cubeware Cockpit: Cubeware wurde 1997 gegründet und ist ein innovativer Hersteller von BI-Software mit Sitz in Rosenheim, Deutschland. Cubeware bietet Lösungen für Datenmanagement, Visualisierung, Analyse und Planung. Eines der Cubeware Produkte ist Cockpit, der Dashboard-Designer des CSP C8. Cockpit kann Berichte für Windows, Web, Mobile und Snack (Cubeware’s agiles Instant Reporting Tool) erstellen. Es kann auch Daten aus relationalen und multidimensionalen Datenbanken integrieren.
Darüber hinaus bietet Cubeware mit dem Importer ein grafisches ETL-Tool zur Konsolidierung von Daten aus verschiedenen Quellsystemen mit umfassenden Transformationsprozessen an, das viele Funktionalitäten mit Voracity gemeinsam hat.
Warum brauche ich dann Voracity? Für mehr Geschwindigkeit bei der Vorbereitung von großen Big Data Dateien, zusätzliche Datenqualitätsmerkmale und datenzentrische Sicherheitsfunktionen (PII-Klassifizierung, Discovery und Maskierung) zur Einhaltung der GDPR etc.
Zunächst verwendet Voracity die SortCL-Engine, um Daten schneller zu integrieren und zu verarbeiten als der Cubeware Importer und die meisten ETL-Tools auf dem Markt. SortCL ist ein schnelles, aufgabenkonsolidierendes Datenverarbeitungsprogramm für strukturierte und halbstrukturierte Quellen, das Speicher, Threads und E/A optimiert. Es läuft auf Windows- und Linux/Unix-Befehlszeilen lokal oder in der Cloud.
SortCL-Jobs werden in einfachen 4GL-Job-Skripten spezifiziert, die auch in einer freien grafischen IDE namens IRI Workbench, die auf Eclipse™ basiert, entworfen und verwaltet werden können. SortCL-Programme sind nicht nur leicht verständlich, sondern unterstützen auch eine Vielzahl von Datenmanipulations-, Mapping-, Munging-, Maskierungs- und Mining-Funktionen für Hunderte von Anwendungsfällen in den Bereichen Datenverarbeitung, Schutz, Prototyping und Präsentation.
SortCL kann Voracity eine Vielzahl von Datenqualitätsfunktionen unterstützen! Die Datenvalidierungsfunktionen können die Datenqualität verbessern, z. B. durch die Schaffung von Bedingungen zum Testen auf leere Werte, groß- oder kleingeschriebene Werte, alphabetische und numerische Werte, druckbare Werte und vieles mehr. Es kann auch Datensätze filtern, die bestimmte Bedingungen, Bereiche oder Mengenschwellen erfüllen. GDPR-Konformität kann durch SortCL-unterstützte Daten-‚Schilde‘ erreicht werden, die PII wie Löschung, Verschlüsselung, Schwärzung und Pseudonymisierung usw. maskieren.
Vor allem aber können alle oben genannten Aktivitäten, die mit ETL, Datenqualität und Maskierung zu tun haben, gleichzeitig und im selben Job-Skript und E/A-Durchlauf durchgeführt werden, was zu einer erheblichen Zeitersparnis bei der Entwicklung und Ausführung von Jobs führt. SortCL kann auch benutzerdefinierte 2D-Detail- und Zusammenfassungsberichte erstellen, um einen schnellen Überblick über die Daten zu bieten und sicherzustellen, dass alles korrekt erscheint, bevor Cockpit mit den Übergaben gefüttert wird, die es für die schnelle Anzeige benötigt.
Schlussfolgerung: Der größte Vorteil von Voracity ist die schnelle und robuste Verarbeitung von Flat-Files. Wenn es in der Lage ist, einen großen Prozentsatz von Datensätzen aus einer sehr großen Datei herauszufiltern, kann sein SortCL-Programm einen schnellen Datentransfer von Datei zu Datenbank ermöglichen. Datentransformation, Validierung, Bereinigung, Maskierung und Neuformatierung sind alles unterstützte Funktionen, die in einem SortCL-Skript und E/A-Durchlauf kombiniert werden können.
Im Allgemeinen würden SortCL-Skripte von Datei zu Datenbank beim Schreiben einer großen Anzahl von Datensätzen in die Datenbank zu langsameren Ergebnissen führen als Cubeware. SortCL kann jedoch die Eingabe von Flat-Files schneller verarbeiten und sie dann auf viel kleinere Untermengen von Datensätzen filtern, die für eine Datenbank gebunden sind.
Beim Lesen aus einer Datenbank und beim Schreiben in eine Flat-File kann die SortCL-Engine einige Geschwindigkeitsvorteile bieten. Ein von Cubeware zur Verfügung gestellter Benchmark ergab einen Durchschnitt von 5m:32s, um ähnliche Filterungen und Transformationen durchzuführen, die SortCL in 2m:11s durchführte. Die Eingabe für diesen Benchmark war Microsoft SQL Server, und die Ausgabe war eine durch Semikolon getrennte Textdatei.
Fazit: Wenn Sie über IRI Voracity und Cubeware Cockpit verfügen, haben Sie einen erschwinglichen, technischen Best-of-Breed-Lösungsstapel für Datenintegration, Governance und visuelle Analysen!
Weltweite Referenzen: Seit über 40 Jahren nutzen unsere Kunden wie die NASA, American Airlines, Walt Disney, Comcast, Universal Music, Reuters, das Kraftfahrtbundesamt, das Bundeskriminalamt, die Bundesagentur für Arbeit, Rolex, Commerzbank, Lufthansa, Mercedes Benz, Osram,.. aktiv unsere Software für Big Data Wrangling und Schutz! Sie finden viele unserer weltweiten Referenzen hier und eine Auswahl deutscher Referenzen hier.
Partnerschaft mit IRI: Seit 1993 besteht unsere Kooperation mit IRI (Innovative Routines International Inc.) aus Florida, USA. Damit haben wir unser Portfolio um die Produkte CoSort, Voracity, DarkShield, FieldShield, RowGen, NextForm, FACT und CellShield erweitert. Nur die JET-Software GmbH besitzt die deutschen Vertriebsrechte für diese Produkte. Weitere Details zu unserem Partner IRI Inc. hier.
JET-Software entwickelt und vertreibt seit 1986 Software für die Datenverarbeitung für gängige Betriebssysteme wie BS2000/OSD, z/OS, z/VSE, UNIX & Derivate, Linux und Windows. Benötigte Portierungen werden bei Bedarf realisiert.
Wir unterstützen weltweit über 20.000 Installationen. Zu unseren langjährigen Referenzen zählen deutsche Bundes- und Landesbehörden, Sozial- und Privatversicherungen, Landes-, Privat- und Großbanken, nationale und internationale Dienstleister, der Mittelstand sowie Großunternehmen.
JET-Software
Edmund-Lang-Straße 16
64832 Babenhausen
Telefon: +49 (6073) 711-403
Telefax: +49 (6073) 711-405
https://www.jet-software.com
Telefon: +49 (6073) 711403
Fax: +49 (6073) 711405
E-Mail: amadeus.thomas@jet-software.com
![]()

❌ Schutz von PII in NoSQL ❌ Formaterhaltende Verschlüsselung, Schwärzung und Pseudonymisierung in NoSQL Datenbank-Tabellen❗
Würden jedoch alle PII oder andere sensible Informationen in diesen DBs maskiert, wären erfolgreiche Hacks und Entwicklungskopien unter Umständen unproblematisch. Der Zweck von IRI DarkShield ist es, diese Informationen in der Produktion oder im Test mit Hilfe von Anonymisierungsfunktionen, die dem Datenschutzrecht entsprechen, zu sperren.
Der Such- und Maskenassistent Elasticsearch in der grafischen IDE der IRI-Workbench für IRI DarkShield verwendet die gleichen Werkzeuge wie die in diesem Artikel beschriebenen MongoDB- und Cassandra-Konnektoren. Dieser Assistent kann verwendet werden, um PII und andere sensible Informationen in Elasticsearch-Sammlungen zu klassifizieren, zu lokalisieren und zu de-identifizieren oder zu löschen und um Such- und Prüfergebnisse zu erzeugen.
Wenn Sie keinen Elasticsearch-Cluster haben mit dem Sie sich verbinden können, können Sie einfach einen lokalen Cluster erstellen, indem Sie Elasticsearch von hier herunterladen und der Anleitung folgen.
Für unsere Demonstration dieses Assistenten verwenden wir einen einzelnen Index, der "customers" auf einem lokal gehosteten Cluster genannt wird. Dieser Index speichert grundlegende Kundeninformationen, die normalerweise in einem Konto zu sehen wären und ein reichhaltiges Ziel für Vergehen darstellen. Dazu gehören: E-Mail, Name und Telefonnummer.
Sehen Sie im Blog-Artikel alle weiteren Details zum Set-Up und zur PII-Suche und Maskierung.
Weltweite Referenzen: Seit über 40 Jahren nutzen weltweit Kunden wie die NASA, American Airlines, Walt Disney, Comcast, Universal Music, Reuters, das Kraftfahrtbundesamt, das Bundeskriminalamt, die Bundesagentur für Arbeit, Rolex, Lufthansa, Mercedes Benz,.. unsere Software für Big Data Wrangling und Schutz! Sie finden viele unserer Referenzen hier mit detaillierten Use Cases.
Partnerschaft mit IRI: Seit 1993 besteht unsere Kooperation mit IRI (Innovative Routines International Inc.) aus Florida, USA. Damit haben wir unser Portfolio um die Produkte CoSort, Voracity, DarkShield, FieldShield, RowGen, NextForm, FACT und CellShield erweitert. Nur die JET-Software besitzt die Vertriebsrechte für diese Produkte für ganz Deutschland. Hier finden Sie weitere Informationen zu unserem Partner IRI Inc.
JET-Software entwickelt und vertreibt seit 1986 Software für die Datenverarbeitung für gängige Betriebssysteme wie BS2000/OSD, z/OS, z/VSE, UNIX & Derivate, Linux und Windows. Benötigte Portierungen werden bei Bedarf realisiert.
Wir unterstützen weltweit über 20.000 Installationen. Zu unseren langjährigen Referenzen zählen deutsche Bundes- und Landesbehörden, Sozial- und Privatversicherungen, Landes-, Privat- und Großbanken, nationale und internationale Dienstleister, der Mittelstand sowie Großunternehmen.
JET-Software
Edmund-Lang-Straße 16
64832 Babenhausen
Telefon: +49 (6073) 711-403
Telefax: +49 (6073) 711-405
https://www.jet-software.com
Telefon: +49 (6073) 711403
Fax: 06073-711405
E-Mail: amadeus.thomas@jet-software.com
![]()

❌ Datenbank-Unloading ❌ Beschleunigung der Datenerfassung für Data Warehouse ETL, Datenbankmigration/Replikation, Archivierung + Offline-Reorgs ❗
IRI FACT verwendet native Datenbank-APIs und parallele Verarbeitung, um Tabellen schneller in Flat-Fiels umzuwandeln als jedes andere Entladetool oder -verfahren. FACT skaliert linear im Volumen, so dass das Entladen einer Zwei-Milliarden-Zeilentabelle nicht mehr als doppelt so lange dauern sollte wie das Entladen einer Ein-Milliarden-Zeilentabelle. Die Kombination der leistungsstarken Extraktion von FACT mit den leistungsstarken, konsolidierten Datentransformationen und vorsortierten Bulkladungen von IRI CoSort ist der schnellste und kostengünstigste Weg, um Big Data ETL– und Offline-Reorgs durchzuführen.
IRI FACT ist der schnellste Weg, um gleichzeitig:
- Entladen von sehr großen Datenbank-(VLDB)-Transaktions-(Fakten)-Tabellen
- formatierte Flat-Files aus einer Tabelle erzeugen
- Erstellen der Steuerdatei-Metadaten für Datenbank-Massenladeprogramme
- Erstellen von IRI CoSort (oder Voracity ETL) Metadaten für Transformationen, Rollups, Delta-Berichte und Preload-Sortierungen.
- Erstellen von IRI NextForm-Metadaten zur Konvertierung der exportierten Daten und Dateitypen
- Erstellung von IRI FieldShield-Metadaten zur Spaltenverschlüsselung, De-Identifizierung und Maskierung von Spalten
- Erstellen von IRI RowGen-Metadaten zur Generierung sicherer Testdaten im Tabellenformat
Weltweite Referenzen: Seit über 40 Jahren nutzen weltweit Kunden wie die NASA, American Airlines, Walt Disney, Comcast, Universal Music, Reuters, das Kraftfahrtbundesamt, das Bundeskriminalamt, die Bundesagentur für Arbeit, Rolex, Lufthansa, Mercedes Benz,.. unsere Software für Big Data Wrangling und Schutz! Sie finden viele unserer Referenzen hier mit detaillierten Use Cases.
Partnerschaft mit IRI: Seit 1993 besteht unsere Kooperation mit IRI (Innovative Routines International Inc.) aus Florida, USA. Damit haben wir unser Portfolio um die Produkte CoSort, Voracity, DarkShield, FieldShield, RowGen, NextForm, FACT und CellShield erweitert. Nur die JET-Software besitzt die Vertriebsrechte für diese Produkte für ganz Deutschland. Hier finden Sie weitere Informationen zu unserem Partner IRI Inc.
JET-Software entwickelt und vertreibt seit 1986 Software für die Datenverarbeitung für gängige Betriebssysteme wie BS2000/OSD, z/OS, z/VSE, UNIX & Derivate, Linux und Windows. Benötigte Portierungen werden bei Bedarf realisiert.
Wir unterstützen weltweit über 20.000 Installationen. Zu unseren langjährigen Referenzen zählen deutsche Bundes- und Landesbehörden, Sozial- und Privatversicherungen, Landes-, Privat- und Großbanken, nationale und internationale Dienstleister, der Mittelstand sowie Großunternehmen.
JET-Software
Edmund-Lang-Straße 16
64832 Babenhausen
Telefon: +49 (6073) 711-403
Telefax: +49 (6073) 711-405
https://www.jet-software.com
Telefon: +49 (6073) 711403
Fax: 06073-711405
E-Mail: amadeus.thomas@jet-software.com
![]()

❌ Realistische Testdaten ❌ Testdatenmanagement (TDM) für synthetische Erzeugung von sicheren und realistischen Testdaten❗
Testdatenverwaltung: Ein Leitfaden für Testdatenmanagement!
Wie jeder, der mit den Herausforderungen des Gesundheitswesens vertraut ist, kann Ihnen sagen, dass die Entwicklung komplexer Anwendungen einen angemessenen Zeitraum formaler Tests und umfassende Testdaten erfordert. Je besser und umfangreicher Ihre Testdaten sind, desto zuverlässiger können Ihre neuen Lösungen und Abläufe sein.
Ziel des Testdatenmanagements (TDM) ist es, die Generierung von Testdaten zu systematisieren – und die Qualität, Sicherheit und Nützlichkeit von Testdaten zu verbessern. TDM ist zu einer IT-Imperativität geworden. Laut dem InfoSys-Whitepaper "Testdatenmanagement, Ermöglichung zuverlässiger Tests durch realistische Testdaten:"
Testteams müssen nicht nur exakte Testmethoden befolgen, sondern auch die Genauigkeit der Testdaten sicherstellen. Sie müssen auch sicherstellen, dass die Tests die Produktionssituationen sowohl funktionell als auch technisch korrekt widerspiegeln.
In vielen Situationen ist es wichtig, die richtigen Testdatensätze zu haben zum Beispiel:
- Anwendungen und Softwareprogramme benötigen Daten, die ihre Funktionalität validieren und ihre Leistungsfähigkeit unter Belastung testen
- Neue Hardware- und Software-Plattformen benötigen konsistente Datenreihen, um ihre Leistung zu bewerten
- Sehr große Datenbank (VLDB)-Operationen und Enterprise Data Warehouse (EDW)-Prototypen erfordern Testdaten, die Produktionsstrukturen und -beziehungen aufrechterhalten, mit denen Last- und Abfrageszenarien korrekt simuliert werden können
Regressionstests in diesen Umgebungen erfordern Testdaten, die das sind:
- bereit, an den richtigen Orten und in den richtigen Formaten
- sicher, so dass es den Datenschutzgesetzen entspricht
- vollständig, in Form von guten, schlechten und null Datenwerten
- realistisch aussehend und transformationsfähig
- groß, für "Big Data"-Anwendungssimulationen
- richtig verteilt, um natürliche Vorkommnisse widerzuspiegeln
- referenziell korrekt, um die Integrität der Abfrage zu erhalten
Eine praktikable, gut überprüfte TDM-Strategie ist der beste Weg, um sicherzustellen, dass die realistischsten Testdaten zur Verfügung stehen. Die Artikel in dieser Serie skizzieren strategische Überlegungen, die den meisten Anwendern dienen werden und spielen manchmal auf Taktiken im IRI RowGen-Paket zur Generierung von Testdaten an.
Dies ist der einleitende Artikel, auf den eine 4-stufige Serie folgt. Klicken Sie hier für den nächsten Artikel, Schritt 1: Zielfestlegung & Teambildung
Weltweite Referenzen: Seit über 40 Jahren nutzen weltweit Kunden wie die NASA, American Airlines, Walt Disney, Comcast, Universal Music, Reuters, das Kraftfahrtbundesamt, das Bundeskriminalamt, die Bundesagentur für Arbeit, Rolex, Lufthansa, Mercedes Benz,.. unsere Software für Big Data Wrangling und Schutz! Sie finden viele unserer Referenzen hier mit detaillierten Use Cases.
Partnerschaft mit IRI: Seit 1993 besteht unsere Kooperation mit IRI (Innovative Routines International Inc.) aus Florida, USA. Damit haben wir unser Portfolio um die Produkte CoSort, Voracity, DarkShield, FieldShield, RowGen, NextForm, FACT und CellShield erweitert. Nur die JET-Software besitzt die Vertriebsrechte für diese Produkte für ganz Deutschland. Hier finden Sie weitere Informationen zu unserem Partner IRI Inc.
JET-Software entwickelt und vertreibt seit 1986 Software für die Datenverarbeitung für gängige Betriebssysteme wie BS2000/OSD, z/OS, z/VSE, UNIX & Derivate, Linux und Windows. Benötigte Portierungen werden bei Bedarf realisiert.
Wir unterstützen weltweit über 20.000 Installationen. Zu unseren langjährigen Referenzen zählen deutsche Bundes- und Landesbehörden, Sozial- und Privatversicherungen, Landes-, Privat- und Großbanken, nationale und internationale Dienstleister, der Mittelstand sowie Großunternehmen.
JET-Software
Edmund-Lang-Straße 16
64832 Babenhausen
Telefon: +49 (6073) 711-403
Telefax: +49 (6073) 711-405
https://www.jet-software.com
Telefon: +49 (6073) 711403
Fax: 06073-711405
E-Mail: amadeus.thomas@jet-software.com
![]()

❌ Big Data 50 ❌ Wieder in Folge von DBTA gelistet – 50 Unternehmen als Innovationstreiber für Big Data im Jahr 2020 ❗
Obwohl die heutigen CoSort-basierten Aktivitäten weitaus umfangreicher sind, laufen sie immer noch bekanntermaßen schnell im Volumen. Sie werden als Front-End in Eclipse ausgeführt und sind jetzt in einer erschwinglichen All-in-One-Datenmanagement-Plattform namens Voracity für mehrere Quellen verfügbar:
- Data Discovery: Klassifizierung, Diagrammerstellung, Profilerstellung und Suche von strukturierten, semistrukturierten und unstrukturierten Datenquellen, vor Ort oder in der Cloud
- Datenintegration: Individuell optimierte und konsolidierte E-, T- und L-Aufgaben sowie Änderungsdatenerfassung, sich langsam ändernde Dimensionen und die Möglichkeit, ETL-Altlasten zu beschleunigen oder ältere ETL-Tools zu verlassen
- Datenmigration und Konvertierung: Von Datentypen, Dateiformaten und Datenbankplattformen sowie inkrementelle oder Massendatenreplikation und Föderation
- Data Governance: PII-Datenmaskierung und Re-ID-Risiko-Scoring, DB-Subsetting, Erzeugung synthetischer Testdaten, Datenvalidierung, -bereinigung und -anreicherung, Stamm- und Metadatenverwaltung usw.
- Analyse: Eingebettete Berichte, Feeds für DataDog, KNIME und Splunk sowie schnelles Data Wrangling für BOBJ, Cognos, Cubeware, iDashboards, Microstrategy, Oracle, Power BI, Qlik, R, Spotfire und Tableau.
Die gemeinsamen, wiederverwendbaren Metadaten von Voracity und die Eclipse-IDE unterstützen mehrere Optionen für Entwurf, Bereitstellung und gemeinsame Nutzung von Jobs. Ganz gleich, ob Sie ein DBA, BI/DW-Architekt, Datenwissenschaftler, Datenschutzbeauftragter, Anwendungsentwickler oder IT-Manager sind, Sie können also das Beste aus alten und neuen Techniken nutzen und in einem One-Stop Solution Stack zusammenarbeiten.
Weltweite Referenzen: Seit über 40 Jahren nutzen weltweit Kunden wie die NASA, American Airlines, Walt Disney, Comcast, Universal Music, Reuters, das Kraftfahrtbundesamt, das Bundeskriminalamt, die Bundesagentur für Arbeit, Rolex, Lufthansa, Mercedes Benz,.. unsere Software für Big Data Wrangling und Schutz! Sie finden viele unserer Referenzen hier mit detaillierten Use Cases.
Partnerschaft mit IRI: Seit 1993 besteht unsere Kooperation mit IRI (Innovative Routines International Inc.) aus Florida, USA. Damit haben wir unser Portfolio um die Produkte CoSort, Voracity, DarkShield, FieldShield, RowGen, NextForm, FACT und CellShield erweitert. Nur die JET-Software besitzt die Vertriebsrechte für diese Produkte für ganz Deutschland. Hier finden Sie weitere Informationen zu unserem Partner IRI Inc.
JET-Software entwickelt und vertreibt seit 1986 Software für die Datenverarbeitung für gängige Betriebssysteme wie BS2000/OSD, z/OS, z/VSE, UNIX & Derivate, Linux und Windows. Benötigte Portierungen werden bei Bedarf realisiert.
Wir unterstützen weltweit über 20.000 Installationen. Zu unseren langjährigen Referenzen zählen deutsche Bundes- und Landesbehörden, Sozial- und Privatversicherungen, Landes-, Privat- und Großbanken, nationale und internationale Dienstleister, der Mittelstand sowie Großunternehmen.
JET-Software
Edmund-Lang-Straße 16
64832 Babenhausen
Telefon: +49 (6073) 711-403
Telefax: +49 (6073) 711-405
https://www.jet-software.com
Telefon: +49 (6073) 711403
Fax: 06073-711405
E-Mail: amadeus.thomas@jet-software.com
![]()

❌ IBM DB2 Datenbank ❌ Schnellere Methode zum Entladen, Laden, Reorg oder zur Migration/Replikation der Tabellen❗
- Große Tabellenentladung und Beladegeschwindigkeiten
- Komplexe Abfrage- oder Reorg-Performance
- Datenbankmigration oder -replikation
- "Change data capture" (CDC) und "slowly changing dimensions" (SCD)
- Persönlich identifizierbare Informationen (PII)
- Sichere, relationale Testdatenerstellung
SQL-Prozeduren können schwer zu kodieren sein und auch nach der Optimierung zu lange dauern. Online-Registrierungen sind zu langsam und Offline-Registrierungen sind schwer einzurichten.
Schnelle Entladung: Die IRI FACT (Fast Extract) Software beschleunigt das Entladen von UDBs. FACT verwendet native SQL-Syntax und DB2-Treiber, um Tabellendaten parallel in Flat-Files zu übertragen. Mit FACT können Sie Archivierung, Migration, ETL, Replikation, Reorganisation und Reporting beschleunigen. FACT wird auch bei Datenbankdatenmigrationen zu und von DB2 auf LUW unterstützt, die in der IRI NextForm DBMS Edition oder der IRI Voracity-Plattform durchgeführt werden.
Schnelle Ladungen, ETL und Mehr: Das Programm SortCL in IRI CoSort und Voracity verarbeitet Tabellendaten über ODBC – oder noch schneller bei Flat-Files außerhalb von UDB (über IRI FACT) – für hohe Volumina:
Indexvorsortierungen für DB2-Ladevorgänge
Datentransformation (Filter, Sortierung, Verknüpfung, Aggregation, etc.)
Delta-Berichte (change data capture / slowly changing dimensions)
Datenschutz (Spaltenverschlüsselung, Maskierung, etc.)
Datenbankmigration und Replikationsoperationen
Der "CoSort Load Accelerator for DB2" verbessert nahtlos die Geschwindigkeit von Massenimporten in UDB und ESE (v5-9) um bis zu das 6-fache gegenüber dem DB2 Load Utility. "CLA4DB2" ersetzt die interne Sortierbibliothek auf LUW-Plattformen durch eine kompatible Sortierroutine. Das Halten von Tabellen in Lookup- und Join-Aufträgen und damit die Verbesserung der Abfragezeiten ist mit CoSort viel einfacher. Kombinieren Sie SortCL mit FACT und DB2 Load in der IRI Workbench GUI für Voracity (basierend auf Eclipse™) für schnelle Offline-Reprotokolle, ETL, Datenbankmigration und Datenreplikation.
DB2 Spaltenschutz: Verwenden Sie das speziell entwickelte datenzentrische Schutzprodukt FieldShield von IRI — oder das übergeordnete CoSort Produkt oder die Voracity-Plattform — für die statische (SDM) oder dynamische Datenmaskierung (DDM) von PII und anderen innerhalb von DB2 gefährdeten Daten auf jeder Plattform, die über ODBC und JDBC verbunden ist. Verwenden Sie Assistenten in ihrem gemeinsamen Frontend der IRI Workbench, um die Daten in Ihren Tabellen zu entdecken und zu klassifizieren und wenden Sie dann automatisch und global die für jede Spalte geeigneten Maskierungsfunktionen an, basierend auf Ihren geschäfts- und datenschutzrechtlichen Compliance-Anforderungen. Während dieser Prozesse werden verschiedene Berichts- und Auditprotokolle erstellt, die Ihnen helfen, die Suche nach Aufträgen zu validieren und die Maskierung zu überprüfen.
DB2 Testdaten: Verwenden Sie IRI RowGen, wenn Sie sichere, intelligente und referenzfreie Testdaten für DB2 benötigen…. besonders wenn Sie keinen Zugriff auf echte Daten haben. RowGen analysiert die DDL, um eine beliebige Anzahl und Größe von Zieltabellen zu generieren und zu füllen, während die Struktur und die Beziehungen der Daten in der Produktion erhalten bleiben. Beachten Sie, dass alle diese Produkte – von FACT über CoSort bis NextForm und von FieldShield bis RowGen – in der IRI Workbench unterstützt werden und die meisten in den Abonnements der Voracity-Plattform enthalten sind.
Weltweite Referenzen: Seit über 40 Jahren nutzen weltweit Kunden wie die NASA, American Airlines, Walt Disney, Comcast, Universal Music, Reuters, das Kraftfahrtbundesamt, das Bundeskriminalamt, die Bundesagentur für Arbeit, Rolex, Lufthansa, Mercedes Benz,.. unsere Software für Big Data Wrangling und Schutz! Sie finden viele unserer Referenzen hier mit detaillierten Use Cases.
Partnerschaft mit IRI: Seit 1993 besteht unsere Kooperation mit IRI (Innovative Routines International Inc.) aus Florida, USA. Damit haben wir unser Portfolio um die Produkte CoSort, Voracity, DarkShield, FieldShield, RowGen, NextForm, FACT und CellShield erweitert. Nur die JET-Software besitzt die Vertriebsrechte für diese Produkte für ganz Deutschland. Hier finden Sie weitere Informationen zu unserem Partner IRI Inc.
JET-Software entwickelt und vertreibt seit 1986 Software für die Datenverarbeitung für gängige Betriebssysteme wie BS2000/OSD, z/OS, z/VSE, UNIX & Derivate, Linux und Windows. Benötigte Portierungen werden bei Bedarf realisiert.
Wir unterstützen weltweit über 20.000 Installationen. Zu unseren langjährigen Referenzen zählen deutsche Bundes- und Landesbehörden, Sozial- und Privatversicherungen, Landes-, Privat- und Großbanken, nationale und internationale Dienstleister, der Mittelstand sowie Großunternehmen.
JET-Software
Edmund-Lang-Straße 16
64832 Babenhausen
Telefon: +49 (6073) 711-403
Telefax: +49 (6073) 711-405
https://www.jet-software.com
Telefon: +49 (6073) 711403
Fax: 06073-711405
E-Mail: amadeus.thomas@jet-software.com
![]()

❌ ELT vs. ETL ❌ Die Unterschiede sowie Vor- und Nachteile der Data-Warehouse-Operationen ETL und ELT ❗
ETL vs. ELT: Unsere Zusammenfassung, Sie urteilen!
Vollständige Offenlegung: Da dieser Artikel von einem ETL-zentrierten Unternehmen verfasst wurde, das sich stark auf die Manipulation großer Datenmengen außerhalb von Datenbanken spezialisiert hat, wird das Folgende vielen nicht objektiv erscheinen. Nichtsdestotrotz soll er dennoch Denkanstöße geben und eröffnet das Wort zur Diskussion.
Seit ihren Anfängen wurden Data-Warehouse-Architekten (DWA) mit der Aufgabe betraut, ein Data-Warehouse mit Daten unterschiedlicher Herkunft und Formatierung zu erstellen und zu bestücken. Aufgrund des dramatischen Wachstums des Datenvolumens stehen dieselben DWAs vor der Herausforderung, ihre Datenintegrations- und Staging-Operationen effizienter zu implementieren. Die Frage, ob die Datentransformation innerhalb oder außerhalb der Zieldatenbank erfolgt, ist wegen der damit verbundenen Leistung, Bequemlichkeit und finanziellen Konsequenzen zu einer kritischen Frage geworden.
Bei ETL-Operationen (Extrahieren, Transformieren, Laden) werden Daten aus verschiedenen Quellen extrahiert, separat transformiert und in eine DW-Datenbank und möglicherweise andere Ziele geladen. Bei ELT werden die Extrakte in die Single-Staging-Datenbank eingespeist, die auch die Transformationen verarbeitet.
ETL ist nach wie vor weit verbreitet, weil der Markt mit bewährten Akteuren wie Informatica, IBM, Oracle – und mit IRI Voracity, das FACT (Fast Extract), CoSort- oder Hadoop-Transformationen und Bulk-Loading in derselben Eclipse-GUI kombiniert, um Daten zu extrahieren und zu transformieren – floriert. Dieser Ansatz verhindert die Belastung von Datenbanken, die für die Speicherung und den Abruf (Abfrageoptimierung) konzipiert sind, mit dem Overhead einer groß angelegten Datentransformation.
Mit der Entwicklung neuer Datenbanktechnologie und Hardwareanwendungen wie Oracle Exadata, die Transformationen "in a box" verarbeiten können, kann ELT jedoch unter bestimmten Umständen eine praktische Lösung sein. Und die Isolierung der Staging- (laden) und der semantischen (transformieren) Schicht hat spezifische Vorteile. Ein zitierter Vorteil von ELT ist die Isolierung des Belastungsprozesses vom Transformationsprozess, da sie eine inhärente Abhängigkeit zwischen diesen Phasen beseitigt.
Wir stellen fest, dass der ETL-Ansatz von IRI sie ohnehin isoliert, da Voracity die Daten im Dateisystem (oder HDFS) in Etappen anordnet. Jeder für die Datenbank gebundene Datenklumpen kann vor dem (vorsortierten) Laden extern erfasst, bereinigt und transformiert werden. Dies entlastet die Datenbank (sowie BI-/Analyse-Tools usw.) von der Last groß angelegter Transformationen.
Datenmengen und Budgets sind oft ausschlaggebend dafür, ob ein DWA eine ETL- oder ELT-Lösung entwickeln sollte. In seinem IT-Toolbox-Blog-Artikel "So What Is Better, ETL or ELT?" stellt Vincent McBurney seine Vor- und Nachteile beider Ansätze dar, die unten aufgelistet sind mit jeweils einer typische Antwort, die IRI ETL-orientierte Benutzer auf den Punkt bringen:
Vorteile ETL:
- ETL kann die Arbeitslast ausbalancieren und die Arbeitslast mit dem RDBMS teilen – und diese Arbeitslast tatsächlich durch die Transformation von Daten über das SortCL-Programm oder Hadoop ohne Kodierung in Voracity
- ETL kann über Daten-Maps komplexere Operationen in einzelnen Datenflussdiagrammen durchführen – wie bei Voracity-Mapping und Workflow-Diagrammen, die auch kurze, offene 4GL-Skripts gegenüber SQL abstrahieren
- ETL kann mit separater Hardware skaliert werden – bei Commodity-Boxen können Sie die Beschaffung und Wartung selbst vornehmen, und zwar zu wesentlich geringeren Kosten als bei Geräten eines einzelnen Anbieters
- ETL kann Partitionierung und Parallelität unabhängig vom Datenmodell, Datenbank-Layout und der Architektur des Quelldatenmodells handhaben – obwohl die CoSort SortCL-Jobs von Voracity überhaupt nicht partitioniert werden müssen…
- ETL kann Daten im Datenstrom verarbeiten, während sie von der Quelle zum Ziel übertragen werden – oder auch im Batch, wenn dies sinnvoll ist
- ETL erfordert keine Kollokation von Datensätzen, um seine Arbeit zu verrichten – so können Sie bestehende Datenquellen-Plattformen ohne Sorgen um die Datensynchronisation beibehalten
- ETL erfasst heute riesige Mengen an Metadatenabstammung – wie gut oder intuitiv kann eine Staging-DB das tun?
- ETL kann auf SMP- oder MPP-Hardware ausgeführt werden, die Sie wiederum kostengünstiger verwalten und ausnutzen können und sich keine Sorgen über Leistungskonflikte mit der DB machen müssen
- ETL verarbeitet Informationen Zeile für Zeile, und das scheint bei der Datenintegration in Produkte von Drittanbietern gut zu funktionieren – noch besser aber ist die vollständige Block-, Tabellen- oder Datei(en)-Verarbeitung, die Voracity im Volumen durchführt
Nachteile ETL:
- Für ETL-Engines sind zusätzliche Hardware-Investitionen erforderlich – es sei denn, sie laufen auf dem/den Datenbankserver(n)
- Zusätzliche Kosten für den Aufbau eines ETL-Systems oder die Lizenzierung von ETL-Tools – die im Vergleich zu ELT-Geräten immer noch billiger sind, aber noch billiger sind IRI-Tools wie Voracity, die Fast Extract (FACT) und CoSort kombinieren, um ETL ohne diese Komplexität zu beschleunigen
- Möglicherweise verringerte Leistung des zeilenbasierten Ansatzes – richtig, und schneller ist Voracity’s Fähigkeit, Profile zu erstellen, Daten zu erfassen, umzuwandeln und in größeren Brocken auszugeben
- Spezielle Fähigkeiten und Lernkurve, die für die Implementierung des ETL-Tools erforderlich sind – es sei denn, Sie verwenden eine ergonomische GUI wie die von Voracity, die mehrere Job-Design-Optionen in derselben Eclipse-IDE bietet
- Geringere Flexibilität aufgrund der Abhängigkeit vom Hersteller des ETL-Tools – wir sind nicht sicher, wie das verbessert werden kann, wenn man sich stattdessen auf einen einzigen ELT-/Gerätehersteller verlässt; ist die Herstellerunabhängigkeit nicht der Schlüssel zu Flexibilität und Kosteneinsparungen?
- Daten müssen noch eine weitere Ebene durchlaufen, bevor sie im Data Mart landen – es sei denn, der Mart ist nur eine weitere Ausgabe des ETL-Prozesses, wie es für Multi-Target Voracity-Operationen typisch ist
Vorteile ELT:
- ELT nutzt die RDBMS-Engine-Hardware für die Skalierbarkeit – besteuert aber auch DB-Ressourcen, die für die Abfrageoptimierung vorgesehen sind. CoSort- und Hadoop-Transformationen in Voracity nutzen lineare Skalierungsalgorithmen und Aufgabenkonsolidierung, nicht die Speicher- oder E/A-Ressourcen der DB
- ELT hält alle Daten die ganze Zeit im RDBMS – was in Ordnung ist, solange Quell- und Zieldaten in der gleichen DB sind
- ELT wird entsprechend dem Datensatz parallelisiert, und die Platten-E/A wird normalerweise auf Motorebene für einen schnelleren Durchsatz optimiert – ja, aber das gilt noch mehr für externe Transformationen, die nicht mit den Ressourcen des DB-Servers zu kämpfen haben
- ELT skaliert, solange die Hardware und die RDBMS-Engine weiter skalieren können – was kostet wie viel im Vergleich zur obigen Alternative?
- ELT kann das 3- bis 4-fache der Durchsatzraten auf der entsprechend abgestimmten MPP-RDBMS-Plattform erreichen – womit die Appliance im Vergleich zu ETL-Tools ebenfalls auf Voracity-Leistungsniveau liegt, jedoch zu 20-fachen Kosten
- Die ELT-Transformation wird auf dem RDBMS-Server durchgeführt, sobald sich die Datenbank auf der Zielplattform befindet und das Netzwerk nicht mehr belastet wird – die Datenbank (Benutzer) wird also stattdessen belastet?
- ELT hat einfache Transformationsspezifikationen über SQL – die nicht so einfach, flexibel oder funktionsreich sind wie die CoSort SortCL-Syntax oder die Drag-and-Drop-Feldzuordnung in der Eclipse-GUI von Voracity
Nachteile ELT:
- Eingeschränkte Tools mit voller Unterstützung für ELT verfügbar – und zu sehr hohen Preisen für DB-Geräte, die eine hohe Leistung bieten
- Verlust detaillierter Laufzeit-Überwachungsstatistiken und Datenherkunft – insbesondere Metadaten-Auswirkungsanalysen bei Änderungen an verschiedenen Dateien, Tabellen oder unstrukturierten Quellen
- Verlust der Modularität aufgrund des auf einem Set basierenden Designs für die Leistung – und der daraus resultierende Verlust an Funktionalität/Flexibilität
- Transformationen würden Datenbankressourcen nutzen, was sich potenziell auf die BI-Berichtsleistung auswirken könnte – ganz zu schweigen von der Leistung von Abfragen und anderen DB-Operationen
In der Folge entstehen hybride Architekturen wie ETLT, TELT und sogar TETLT, die versuchen, die Schwächen beider Ansätze zu beheben. Aber diese scheinen den bereits so belasteten Prozessen zusätzliche Komplexitätsebenen hinzuzufügen. Es gibt keinen wirklichen Königsweg, und viele Datenintegrationsprojekte scheitern unter dem Gewicht von SLAs, Kostenüberschreitungen und Komplexität.
Aus diesen Gründen wurde IRI Voracity entwickelt, um Daten über das Programm CoSort SortCL in bestehende Dateisysteme oder Hadoop-Fabrics ohne Neucodierung zu integrieren. Voracity ist die einzige ETL-orientierte (aber auch ELT-unterstützende) Plattform, die beide Optionen für externe Datentransformationen bietet. Neben einem überlegenen Preis-Leistungs-Verhältnis bei der Datenbewegung und -manipulation beinhaltet Voracity:
- erweiterte Datentransformation, Datenqualität, MDM und Berichterstattung
- Slowly Changing Dimensions, Change Data Capture, Datenfederation
- Datenprofilierung, Datenmaskierung, Testdatenerzeugung und Metadatenverwaltung
- einfache 4GL-Skripte, die Sie oder Eclipse-Assistenten, Diagramme und Dialoge erstellen und verwalten
- nahtlose Ausführung in Hadoop MR2, Spark, Spart Stream Storm und Tez
- Unterstützung für erwin Smart Connectors (Konvertierung von anderen ETL-Tools)
- native MongoDB-Treiber und Verbindungen zu anderen NoSQL-, Hadoop-, Cloud- und Legacy-Quellen
- eingebettete Berichts-, Statistik- und Prognosefunktionen, KNIME- und Splunk-Anbindungen und Datenfeeds für Analysewerkzeuge
Weltweite Referenzen: Seit über 40 Jahren nutzen unsere Kunden wie die NASA, American Airlines, Walt Disney, Comcast, Universal Music, Reuters, das Kraftfahrtbundesamt, das Bundeskriminalamt, die Bundesagentur für Arbeit, Rolex, Commerzbank, Lufthansa, Mercedes Benz, Osram,.. aktiv unsere Software für Big Data Wrangling und Schutz! Sie finden viele unserer weltweiten Referenzen hier und eine Auswahl deutscher Referenzen hier.
Partnerschaft mit IRI: Seit 1993 besteht unsere Kooperation mit IRI (Innovative Routines International Inc.) aus Florida, USA. Damit haben wir unser Portfolio um die Produkte CoSort, Voracity, DarkShield, FieldShield, RowGen, NextForm, FACT und CellShield erweitert. Nur die JET-Software GmbH besitzt die deutschen Vertriebsrechte für diese Produkte. Weitere Details zu unserem Partner IRI Inc. hier.
JET-Software entwickelt und vertreibt seit 1986 Software für die Datenverarbeitung für gängige Betriebssysteme wie BS2000/OSD, z/OS, z/VSE, UNIX & Derivate, Linux und Windows. Benötigte Portierungen werden bei Bedarf realisiert.
Wir unterstützen weltweit über 20.000 Installationen. Zu unseren langjährigen Referenzen zählen deutsche Bundes- und Landesbehörden, Sozial- und Privatversicherungen, Landes-, Privat- und Großbanken, nationale und internationale Dienstleister, der Mittelstand sowie Großunternehmen.
JET-Software
Edmund-Lang-Straße 16
64832 Babenhausen
Telefon: +49 (6073) 711-403
Telefax: +49 (6073) 711-405
https://www.jet-software.com
Telefon: +49 (6073) 711403
Fax: 06073-711405
E-Mail: amadeus.thomas@jet-software.com
![]()