Best Machine Learning Data Catalog Software - Page 5

How Many Machine Learning Data Catalog Software Products Does G2 Track?

Total Products under this Category: 88

Category Stats (Sep 2026)

  • Average Rating: 4.37/5 The average rating of products in this category, based on all submitted ratings
  • Top Trending Product: Cloudera (+2.21%) - Among all products in this category, Cloudera recorded the largest rating increase compared to last month

Last updated: September 01, 2026

How Does G2 Rank Machine Learning Data Catalog Software Products?

Why You Can Trust G2's Software Rankings:

  • 30 Analysts and Data Experts
  • 2,000+ Authentic Reviews
  • 88+ Products
  • Unbiased Rankings

G2's software rankings are built on verified user reviews, rigorous moderation, and a consistent research methodology maintained by a team of analysts and data experts. Each product is measured using the same transparent criteria, with no paid placement or vendor influence. While reviews reflect real user experiences, which can be subjective, they offer valuable insight into how software performs in the hands of professionals. Together, these inputs power the G2 Score, a standardized way to compare tools within every category.

G2 Grid® for Machine Learning Data Catalog Software

G2 Grid® for Machine Learning Data Catalog Software plotting products by satisfaction and market presence

Highlighted products: Atlan, AWS Glue, Alation, erwin Data Modeler, Google Cloud Data Catalog, Appen, Cloudera, and Informatica Data & AI Governance, Privacy.

Underlying data: [Grid® JSON](https://www.g2.com/categories/machine-learning-data-catalog/grids.json?focus%5B%5D=atlan&focus%5B%5D=aws-glue&focus%5B%5D=alation&focus%5B%5D=quest-software-erwin-data-modeler&focus%5B%5D=google-cloud-data-catalog&focus%5B%5D=appen&focus%5B%5D=cloudera&focus%5B%5D=informatica-data-ai-governance-privacy)

Data Collection

Sapien's Datensammlungsdienste bieten hochwertige, strukturierte Datensätze, die speziell darauf zugeschnitten sind, KI- und maschinelle Lernprojekte zu unterstützen. Um die Herausforderungen bei der Beschaffung und Vorbereitung von Daten für das KI-Training zu bewältigen, nutzt Sapien Echtzeit-Datensammlungssoftware und automatisierte Techniken, um relevante Daten für sowohl überwachte als auch unüberwachte Trainingsmodelle zu sammeln.

Who Is the Company Behind Data Collection?

  • Verkäufer: Sapien
  • Hauptsitz: New York City, US
  • LinkedIn®-Seite: www.linkedin.com
    8 Mitarbeiter*innen auf LinkedIn®

Dataland

Dataland ist ein einheitlicher Datenarbeitsbereich, der speziell für Frontline- und operative Benutzer wie Lieferketten, Logistik, Betrieb und Kundensupport entwickelt wurde. Dataland zentralisiert alle Daten an einem Ort, sodass Geschäftsanwender KI fragen, suchen, analysieren und Maßnahmen gegen Daten an einem Ort ergreifen können. Geschäftsteams nutzen Dataland, um einen 360-Grad-Blick auf alle Daten zu erhalten, die sie für ihre täglichen Arbeitsabläufe benötigen. So funktioniert Dataland: Echtzeit-Datensynchronisierung: Dataland verfügt über integrierte Konnektoren zu Datenbanken, Data Warehouses, SaaS-APIs und benutzerdefinierten Quellen. Im Gegensatz zu herkömmlichen Datenintegrationstools aktualisiert Dataland in Echtzeit von seinen Quellsystemen, was für operative Anwendungsfälle notwendig ist. Universelle Suche: Dataland indexiert die Daten in Echtzeit und ermöglicht es operativen Benutzern, schnell nach aktuellen Informationen über alle Attribute in allen Datenquellen zu suchen. Dies ermöglicht es den Benutzern, schnell den vollständigen Kontext zu erhalten, den sie benötigen, ohne wissen zu müssen, wo sie suchen sollen oder unflexible Tools zu verwenden, die Informationen nur auf spezifische vordefinierte Weise abrufen können. 360-Grad-Ansichten: Dataland kombiniert Informationen aus fragmentierten Datenquellen in einheitliche Ansichten, die das vollständige 360-Grad-Bild jeder Geschäftseinheit bieten. Dies eliminiert die Notwendigkeit für Benutzer, zwischen mehreren Tools zu wechseln. AI-Datenassistent: Benutzer können die KI bitten, Daten für sie zu analysieren, ohne SQL zu kennen. Automatisierungen und Benachrichtigungen: Benutzerdefinierte Geschäftsaktionen können operativen Benutzern zur Verfügung gestellt werden (z. B. Auslösen einer Zapier-Automatisierung, Aufrufen einer internen API, Ausführen von SQL-Updates usw.), sodass sie End-to-End-Workflows in Dataland abschließen können, ohne die Plattform jemals verlassen zu müssen. Benutzer können auch Benachrichtigungen über eine einfache Schnittstelle definieren, ohne Code zu kennen.

Who Is the Company Behind Dataland?

  • Verkäufer: Dataland
  • Gründungsjahr: 2021
  • Hauptsitz: N/A
  • LinkedIn®-Seite: www.linkedin.com
    8 Mitarbeiter*innen auf LinkedIn®

DataMarket

DataMarket ist ein Datenmarktplatz und eine Datenentdeckungslösung innerhalb der RightData-Plattform. Es bietet einen zentralen Ort, an dem Datensätze und Datenprodukte organisiert, dokumentiert und für die Nutzung durch Teams mit definierten Zugriffskontrollen verfügbar gemacht werden. Benutzer können verfügbare Daten durchsuchen und anzeigen, Metadaten einsehen und verstehen, was die Daten darstellen, bevor sie Zugriff anfordern. Dies hilft ihnen zu beurteilen, ob ein Datensatz für ihren Anwendungsfall relevant ist, ohne auf einen Hin-und-her-Austausch mit den Datenteams angewiesen zu sein. Zugriffsanfragen folgen Genehmigungs-Workflows basierend auf organisatorischen Richtlinien, und Aufzeichnungen werden für Prüfungs- und Nachverfolgungszwecke geführt. DataMarket vereint Datenkatalogisierung, Datenentdeckung und Zugriffsmanagement in einer einzigen Oberfläche. Datensätze sind strukturiert und kategorisiert, sodass sie leichter gefunden und verstanden werden können. Durch die Standardisierung der Veröffentlichung und des Zugriffs auf Daten werden Inkonsistenzen in der Interaktion verschiedener Teams mit Daten reduziert. Die Plattform unterstützt die Demokratisierung von Daten, indem sie mehr Benutzern innerhalb der Organisation ermöglicht, Daten unabhängig zu finden und zu nutzen, während sie dennoch innerhalb von Governance- und Sicherheitsgrenzen operieren. Dies reduziert die Abhängigkeit von Dateningenieuren für routinemäßigen Zugriff und hilft Teams, schneller bei Berichts- und Analyseaufgaben voranzukommen. DataMarket wird von Geschäftsanwendern, Analysten und Datenwissenschaftlern genutzt, die Zugriff auf Daten für Berichterstattung, Analyse und Entscheidungsfindung benötigen. Es wird auch von Dateningenieuren und Datenverantwortlichen genutzt, um Datensätze zu veröffentlichen, zu organisieren und zu verwalten, damit sie von anderen kontrolliert genutzt werden können.

Who Is the Company Behind DataMarket?

  • Verkäufer: RightData
  • Gründungsjahr: 2016
  • Hauptsitz: Atlanta, US
  • Twitter: @GetRightData
    121 Twitter-Follower
  • LinkedIn®-Seite: www.linkedin.com
    87 Mitarbeiter*innen auf LinkedIn®

Data World

data.world ist der am häufigsten angenommene Datenkatalog und Governance-Plattform auf dem Markt. Auf einer einzigartigen Wissensgraph-Basis aufgebaut, integriert sich data.world nahtlos in Ihre bestehenden Systeme. Wir setzen den Standard für schnelle, menschenzentrierte Governance. Wir verwalten nicht nur Daten; wir erschließen ihr Potenzial und ebnen den Weg für verantwortungsvolle KI-Einführung und datengetriebene Entscheidungsfindung im großen Maßstab. data.world ist eine zertifizierte B Corporation und eine gemeinnützige Gesellschaft und Heimat der weltweit größten kollaborativen Open-Data-Community mit mehr als zwei Millionen Mitgliedern, darunter neunzig Prozent der Fortune 500.

Who Is the Company Behind Data World?

  • Verkäufer: data.world
  • Gründungsjahr: 2016
  • Hauptsitz: Austin, Texas
  • Twitter: @datadotworld
    5,498 Twitter-Follower
  • LinkedIn®-Seite: www.linkedin.com
    100 Mitarbeiter*innen auf LinkedIn®

Deasie

Deasie bietet einen automatisierten Kennzeichnungs-Workflow, um unstrukturierte Daten schneller zu kennzeichnen, zu katalogisieren und zu filtern als jeder Mensch.

Who Is the Company Behind Deasie?

Dsense

Ermöglicht es Nicht-Technikern, mit Daten unter Verwendung beliebiger LLMs zu kommunizieren, sei es in einer VPC bereitgestellt oder über externe APIs, und gewährleistet dabei eine schnelle Abfrage mit außergewöhnlicher Geschwindigkeit, Genauigkeit und Präzision. Vollständig verwaltet und mit robusten Sicherheitsleitplanken ausgestattet, um Daten auf einer „Need-to-know“-Basis offenzulegen und so die Informationssicherheitsprotokolle einzuhalten. Es ermöglicht Organisationen, Analysen zu beschleunigen und KI-Anwendungen sicher mit ihren Unternehmensdaten zu erstellen, während sie ihre wertvollen Vermögenswerte schützen.

Who Is the Company Behind Dsense?

  • Verkäufer: Dview
  • Gründungsjahr: 2021
  • Hauptsitz: Bengaluru East, IN
  • Twitter: @DviewTech
    19 Twitter-Follower
  • LinkedIn®-Seite: www.linkedin.com
    16 Mitarbeiter*innen auf LinkedIn®

Entity Catalog

Der Entity Catalog ist eine umfassende Datenbank, die von Qloo entwickelt wurde und über 575 Millionen Entitäten in verschiedenen Bereichen wie Unterhaltung, Gastronomie, Reisen und Konsumgüter umfasst. Dieses umfangreiche Verzeichnis enthält detaillierte Informationen über Filme, Musik, Bücher, Restaurants, Hotels und mehr, wodurch Unternehmen tiefgehende Einblicke in Verbraucherpräferenzen und -trends gewinnen können.

Who Is the Company Behind Entity Catalog?

  • Verkäufer: Qloo
  • Gründungsjahr: 2012
  • Hauptsitz: New York, US
  • LinkedIn®-Seite: www.linkedin.com
    56 Mitarbeiter*innen auf LinkedIn®

Erisna

Erisna ist eine Unternehmensdatenkatalog- und Entdeckungsplattform, die es Datenanalysten, Dateningenieuren, Datenwissenschaftlern und Datenmanagern ermöglicht, das Beste aus ihren Daten herauszuholen. Verbinden Sie Erisna mit verschiedenen Datenquellen wie Amazon Redshift, Google BigQuery, Microsoft Azure Synapse, Snowflake, PostgreSQL und SQL Server, um Ihr Datenwörterbuch zu erstellen, sensible Daten automatisch zu erkennen, die Datenerkennung zu automatisieren, Anforderungen an die Datenpipeline zu sammeln und die Datenverwaltung zu verbessern, alles an einem Ort. Unsere Plattform hilft Organisationen, die Produktivität zu steigern, regulatorische Risiken zu reduzieren, bessere Entscheidungen zu treffen und die Kosten erheblich zu senken.

Who Is the Company Behind Erisna?

  • Verkäufer: Erisna
  • Gründungsjahr: 2021
  • Hauptsitz: London, GB
  • LinkedIn®-Seite: www.linkedin.com
    5 Mitarbeiter*innen auf LinkedIn®

Forcepoint Data Classification

Forcepoint Data Classification definiert die Datenklassifizierung mit KI-gesteuerter Präzision und Automatisierung neu, beseitigt manuelle Fehler und verbessert die Wirksamkeit von DLP. Wir verwenden ein fortschrittliches AI Mesh, um eine hochpräzise Datenklassifizierung zu liefern. Seine vernetzte KI-Architektur nutzt ein Small Language Model und fortschrittliche KI-Komponenten, um die Effizienz zu verbessern und Fehlalarme zu reduzieren. Durch kontinuierliches Lernen und Verbesserung liefert es sichere Empfehlungen, die die Durchsetzung von Richtlinien und die Einhaltung von Vorschriften für Organisationen verbessern.

Who Is the Company Behind Forcepoint Data Classification?

  • Verkäufer: Forcepoint
  • Gründungsjahr: 1994
  • Hauptsitz: Austin, TX
  • Twitter: @Forcepointsec
    65,335 Twitter-Follower
  • LinkedIn®-Seite: www.linkedin.com
    1,652 Mitarbeiter*innen auf LinkedIn®

Foursquare Spatial H3 Hub

FSQ Spatial H3 Hub beseitigt traditionelle Barrieren für die Übernahme von Geodaten in traditionellen ML-Modellen, indem es Datenwissenschaftlern analysenbereite Datensätze bereitstellt, die keine spezialisierten Geotools oder Fachkenntnisse erfordern. Datensätze, die Informationen in Raster- und Vektorformaten enthalten, werden in tabellarische Form umgewandelt und in H3-Zellen indexiert. Dies ermöglicht es Datenwissenschaftlern, ihre eigenen Datensätze, die Attribute wie Lat/Lon-Koordinaten, Städtenamen oder Postleitzahlen enthalten, einfach durch das Verbinden mit einem gemeinsamen H3-Index zu bereichern. Aufgebaut auf dem Enterprise-Metadaten-Managementsystem von DataHub, stellt die Plattform sicher, dass die Nachverfolgung der Datenherkunft, Versionierung und Governance-Fähigkeiten gewährleistet sind, die Unternehmensdaten-Teams benötigen. Diese Grundlage ermöglicht das erste Angebot im FSQ Spatial H3 Hub: einen Iceberg-Katalog, der über 20 offene Datensätze bietet, die auf H3-Zellen bei Auflösung 8 vorindexiert sind und in einer kostenlosen Vorschau verfügbar gemacht werden. Datenwissenschaftler können auf diesen Katalog aus ihrem bevorzugten Framework (Spark, Python, DuckDB) zugreifen und ihre ML-Modelle mit einer Vielzahl von räumlichen Merkmalen anreichern.

Who Is the Company Behind Foursquare Spatial H3 Hub?

  • Verkäufer: Foursquare
  • Gründungsjahr: 2009
  • Hauptsitz: New York, NY
  • Twitter: @foursquare
    22,906 Twitter-Follower
  • LinkedIn®-Seite: www.linkedin.com
    523 Mitarbeiter*innen auf LinkedIn®

Herus

Herus ist ein moderner Datenkatalog, der Teams dabei hilft, ihre Daten schneller zu organisieren, zu entdecken, zu verstehen und zu verwalten. Die Plattform integriert sich in Ihren Daten-Stack, um Metadaten, semantische Definitionen, Abstammung, Nutzungsinformationen und Datenverarbeitungscode zu importieren. Sie kann auch Feldbeschreibungen als native SQL-Kommentare zurück in Datenbanken übertragen. Benutzer können Daten über eine intuitive Benutzeroberfläche, erweiterte SQL-ähnliche Filter oder eine KI-gestützte Suche erkunden. Sie können die Abstammung von Tabellen und Feldern von Anfang bis Ende navigieren, Daten bis zu ihren Quellen zurückverfolgen und verstehen, wie sie in nachgelagerte Dashboards und Analysen fließen. Herus nutzt KI, um die manuelle Dokumentationsarbeit zu reduzieren, indem es Geschäftsdaten vorschlägt, Abstammung ableitet und natürliche Sprachinteraktionen innerhalb des Katalogs ermöglicht. Alle KI-generierten Vorschläge bleiben vollständig überprüfbar, bevor sie validiert werden, sodass die Teams die Kontrolle behalten. Über die Katalogisierung bestehender Assets hinaus umfasst Herus ein kollaboratives Datenboard, auf dem Analysten und Ingenieure visuell Transformationen entwerfen können. Basierend auf diesen Entwürfen kann die KI automatisch vollständige schriftliche Spezifikationen generieren, wodurch doppelte Arbeiten in Dokumentationstools und Wikis reduziert werden.

Who Is the Company Behind Herus?

  • Verkäufer: Herus
  • Hauptsitz: Paris, FR
  • LinkedIn®-Seite: www.linkedin.com
    1 Mitarbeiter*innen auf LinkedIn®

IQ Metadata Manager

IQ Metadata Manager hilft Unternehmen, ihre Daten freizuschalten, indem es Metadaten-Domänenkategorien an einem Ort vereint, um eine Echtzeitansicht aller Informationen zu erstellen. Erstellen Sie ein standardisiertes Glossar und einen Datenkatalog. Verbessern Sie die Datensichtbarkeit für die Datenvorbereitung und -analyse.

Who Is the Company Behind IQ Metadata Manager?

  • Verkäufer: InQuisient
  • Gründungsjahr: 2004
  • Hauptsitz: Reston, US
  • LinkedIn®-Seite: www.linkedin.com
    8 Mitarbeiter*innen auf LinkedIn®

Key Ward

Key Ward ist ein Deep-Tech-Unternehmen, das sich auf das Management von Ingenieurdaten und die Einführung von KI spezialisiert hat, insbesondere in der Automobil- und Luftfahrtindustrie. Ihre Flaggschiffprodukte, Key Ward HUB und Key Ward FLOW, nutzen künstliche Intelligenz, um Konstruktionsprozesse zu optimieren und zu verbessern. Key Ward HUB automatisiert die Extraktion und Umwandlung von Daten aus verschiedenen CAE/CAD-Dateiformaten in KI-bereite Datensätze und eliminiert so die Notwendigkeit manueller Datenvorbereitung. Key Ward FLOW verwendet vortrainierte KI-Modelle, um Bewertungen von Konstruktionsentwürfen vorherzusagen, wie z.B. Bewertungen der numerischen Strömungsmechanik (CFD), was es Ingenieuren ermöglicht, mehr Designvarianten in kürzerer Zeit zu erkunden. Dieser Ansatz beschleunigt nicht nur den Bewertungszyklus von Entwürfen, sondern liefert auch genauere Ergebnisse im Vergleich zu herkömmlichen Simulationsmethoden. Durch die Integration dieser Werkzeuge befähigt Key Ward Ingenieurteams, Designs effizient zu optimieren, das Risiko von Fehlern in späten Entwicklungsstadien zu reduzieren und die Gesamtleistung des Produkts zu verbessern, ohne dass vorherige Kenntnisse in Datenwissenschaft erforderlich sind.

Who Is the Company Behind Key Ward?

  • Verkäufer: Key Ward
  • Gründungsjahr: 2021
  • Hauptsitz: Berlin, DE
  • LinkedIn®-Seite: www.linkedin.com
    13 Mitarbeiter*innen auf LinkedIn®

Metaphor Data

Metapher ist ein modernes, umfassendes Datenkatalog, das sich durch zugängliches und effizientes Datenmanagement für sowohl Datenproduzenten als auch -konsumenten auszeichnet. Seine Stärken umfassen robuste Datenverwaltung und -herkunft, die Datenintegrität und Rückverfolgbarkeit gewährleisten, was entscheidend für die Aufrechterhaltung einer hochwertigen Datenverwaltung ist. Metapher erleichtert auch die effektive Zusammenarbeit, indem es Teammitgliedern aus verschiedenen Abteilungen ermöglicht, Daten leicht zuzugreifen, zu verstehen und zu nutzen. Beliebte Anwendungsfälle für Metapher umfassen die Dokumentation von Daten, bei der es hilft, ein klares und umfassendes Verständnis von Datenbeständen zu schaffen. Seine Such- und Entdeckungsfunktionen ermöglichen es den Benutzern, schnell die benötigten Daten zu finden, was die Produktivität und Effizienz der Entscheidungsfindung verbessert. Die Herkunftsfunktion von Metapher ist besonders wertvoll, da sie Einblicke in den Ursprung und die Transformation der Daten bietet, was für Datenanalyse und Compliance entscheidend ist. Durch die Balance von technischen Fähigkeiten mit benutzerfreundlichen Funktionen ist Metapher eine ideale Wahl für Organisationen, die ihre Daten effektiver nutzen möchten und eine datengestützte Kultur im gesamten Unternehmen fördern.

Who Is the Company Behind Metaphor Data?

  • Verkäufer: Metaphor Data
  • Gründungsjahr: 2020
  • Hauptsitz: Menlo Park, California
  • Twitter: @MetaphorData
    394 Twitter-Follower
  • LinkedIn®-Seite: www.linkedin.com
    23 Mitarbeiter*innen auf LinkedIn®

OpenMetadata

OpenMetadata is the #1 open context layer for humans, AI assistants, and agents. It unifies technical context, business semantics, and organizational memory into one graph, so AI agents and humans reason from the same trusted foundation. Built by the founders of Apache Hadoop, Atlas, and Uber Databook, OpenMetadata unlocks the value of data assets with an open-source context layer that includes data cataloging, discovery, governance, data quality, observability, lineage, semantics, and memory for people and AI.

Average Rating: 5.0/5.0

Total Reviews: 1

Who Is the Company Behind OpenMetadata?

  • Verkäufer: Collate
  • Gründungsjahr: 2021
  • Hauptsitz: Menlo Park, CA, USA
  • Twitter: @open_metadata
  • LinkedIn®-Seite: www.linkedin.com
    65 Mitarbeiter*innen auf LinkedIn®

Who Uses This Product?

  • Company Size: 100% Small

What Are Recent G2 Reviews of OpenMetadata?

Shalaka Joshi
SJ
Researched and written by Shalaka Joshi
Updated October 3, 2024