
Das Glossar.
Alle wichtigen Begriffe aus Data & AI, ERP und digitaler Transformation - klar erklärt, damit Projekte in der gleichen Sprache beginnen.
A2A-Protokoll (Agent2Agent)
Das A2A-Protokoll (Agent2Agent) ist ein offener Standard für die Kommunikation zwischen KI-Agenten. Definition, Funktionsweise und Abgrenzung zu MCP.
ABAC (Attribute-Based Access Control)
ABAC (Attribute-Based Access Control) entscheidet Zugriffe anhand von Attributen und Policies. Definition, Funktionsweise und Abgrenzung gegen RBAC.
ABC-Analyse
Die ABC-Analyse teilt Kunden, Artikel oder Materialien nach kumuliertem Wertanteil in Klassen A, B und C. Vorgehen, Beispiel, Abgrenzung zu RFM, XYZ und CLV.
BDC Connect
BDC Connect ist der Sharing-Weg der SAP Business Data Cloud über Delta Sharing an Databricks, Snowflake und Fabric. Definition, Funktionsweise und Abgrenzung.
Batch-Inferenz
Batch-Inferenz wendet ein trainiertes Modell im geplanten Lauf auf einen abgeschlossenen Datensatz an. Definition, Abgrenzung zu Real-Time und Training.
Bestandskunden
Bestandskunden sind Kunden mit bestehender Geschäftsbeziehung. Definition, Abgrenzung zu Neukunden und Stammkunden, Beispiel und Kennzahlen-Bezug.
CDS Views
CDS Views (Core Data Services Views) sind semantisch angereicherte Views im SAP-Stack. Definition, Rolle als Extraktionsschicht Richtung Datasphere und BDC.
CRISP-DM
CRISP-DM ist der Standard-Prozess für Data-Mining-Projekte mit sechs Phasen. Definition, Phasen-Modell und Abgrenzung zu MLOps, TDSP und SEMMA.
CRM
CRM (Customer Relationship Management): Ansatz und Software. Definition, die drei Säulen operativ, analytisch, kollaborativ plus Abgrenzung zur CDP und ERP.
DBRX
DBRX ist ein offenes Mixture-of-Experts-LLM von Databricks (März 2024). Definition, MoE-Architektur, Varianten und Abgrenzung zu Llama, Mixtral und GPT.
DBU (Databricks Unit)
DBU (Databricks Unit) ist die Verrechnungseinheit für Databricks-Compute. Was sie misst, wie die Rate nach Workload variiert, Serverless vs. Classic.
DTO (Data Transfer Object)
Data Transfer Object (DTO) ist ein Software-Muster zum Transport von Daten zwischen Schichten. Definition, Abgrenzung zu Entity, Value Object, Data Contract.
EDW
EDW (Enterprise Data Warehouse) bezeichnet ein unternehmensweites Data Warehouse. Definition, Inmon vs. Kimball und Abgrenzung zu Data Mart und Lakehouse.
ELT
ELT (Extract, Load, Transform) lädt Rohdaten ins Zielsystem und transformiert sie dort. Definition, Abgrenzung zu ETL, Zero-ETL und Reverse ETL.
ETL
ETL (Extract, Transform, Load) transformiert Daten in einer separaten Engine vor dem Load. Definition, Ablauf, Abgrenzung zu ELT, Zero-ETL, Reverse ETL.
Fairness in AI
Fairness in AI ist der normative Zielzustand vergleichbarer Behandlung. Definition, Fair-Metriken, Abgrenzung zu Bias, Explainable AI und Governance.
Feature Engineering
Feature Engineering ist die Ableitung numerischer Merkmale aus Rohdaten für Machine-Learning-Modelle. Definition, Abgrenzung zu Feature Store und AutoML.
Feature Platform
Eine Feature Platform vereint Definition, Compute, Speicherung und Serving von ML-Features. Definition, Kern-Komponenten und Abgrenzung zum Feature Store.
Generative AI
Generative AI erzeugt neue Inhalte in Text, Bild, Audio, Video oder Code. Definition, Modalitäten, Abgrenzung zu Predictive AI, LLM und Agentic AI im Überblick.
Genie
Databricks Genie ist die Text-to-SQL-Komponente des AI/BI-Bündels und übersetzt Fragen in SQL auf Lakehouse-Daten. Definition, Abgrenzung, Beispiel.
Genie Agents
Genie Agents sind spezialisierte Databricks-Genie-Instanzen mit Instructions, Tool-Nutzung und Unity-Catalog-Zugriff. Definition, Abgrenzung, Beispiel.
HANA Data Lake Files
HANA Data Lake Files (HDLF) ist der Objekt-Layer der SAP HANA Cloud Data Lake. Definition, Zugriffspfade und Abgrenzung zu HANA Cloud und Relational Engine.
HTAP (Hybrid Transactional/Analytical Processing)
HTAP (Hybrid Transactional/Analytical Processing) verbindet OLTP und OLAP in einer Engine. Definition, Vertreter und Abgrenzung gegen LTAP und Zero-ETL.
Hallucination
Hallucination bezeichnet plausibel klingende, aber falsche LLM-Outputs. Definition, Typologie intrinsisch/extrinsisch, Detektion, Abgrenzung zu Bias.
Image Models
Image Models sind trainierte Modelle für Bild-Ein- oder -Ausgabe: Diffusion, Vision Transformer, CNN. Definition, Familien-Landkarte und Abgrenzung.
In-Context Learning
In-Context Learning (ICL): Sprachmodell löst eine Aufgabe aus Beispielen im Prompt, ohne Gewichts-Update. Brown et al. 2020, Oberbegriff Zero-/Few-Shot.
Inference Engine
Eine Inference Engine ist die spezialisierte Laufzeit, die ein LLM auf GPU-Hardware ausführt. Definition, Abgrenzung zu Model Serving, Framework und Anbieter.
Jailbreak Defense
Jailbreak Defense ist die Abwehr adversarialer LLM-Prompts. Definition, vier Angriffsfamilien und Abgrenzung zu Guardrails, Injection und Red Teaming.
Joule
SAP Joule ist der KI-Copilot für S/4HANA, SuccessFactors, Ariba und die Business Data Cloud. Definition, Bausteine und Abgrenzung zu Copilot und Genie.
KV-Caching
KV-Caching speichert Key- und Value-Tensoren im Transformer-Decoder und macht LLM-Inference linear. Definition, Abgrenzung zu Context Caching, Beispiel.
Kappa-Architecture
Kappa-Architecture bedient Echtzeit und Historie mit einem einzigen Streaming-Pfad. Definition, Herkunft (Kreps 2014) und Abgrenzung zu Lambda.
Knowledge Graph
Knowledge Graph bezeichnet eine Datenstruktur mit Entitäten und typisierten Beziehungen. Definition, Funktionsweise, Abgrenzung zu Ontologie und Graphdatenbank.
LLM Gateway
LLM Gateway bündelt Aufrufe an mehrere Sprachmodell-Anbieter, sichert sie ab und ordnet Kosten zu. Definition, Funktionen und Abgrenzung zum AI Gateway.
LLM Security
LLM Security ist die Sicherheits-Disziplin auf Modell-Ebene von Large Language Models. Definition, Kern-Risiken und Abgrenzung zu Agent- und AI-Safety.
LLM-as-a-Judge
LLM-as-a-Judge nutzt ein Modell zur Bewertung anderer Modell-Ausgaben. Definition, Setup-Familien (Single-Score, Pairwise, Reference) und typische Bias-Muster.
MCP Clients
MCP Clients sind Host-Anwendungen wie Claude Desktop oder Cursor, die MCP-Server einbinden. Definition, Funktionsweise und Abgrenzung zu MCP-Server und A2A.
MCP-Server
Ein MCP-Server exponiert Tools, Resources und Prompts über das Model Context Protocol. Definition, Abgrenzung zu MCP-Client, REST-API und Function Calling.
ML Engineering Agents
ML Engineering Agents sind agentische KI-Assistenten in Databricks für Feature-Engineering, Training, Deployment und Wartung von ML-Pipelines. Definition.
Native Storage Extension
Native Storage Extension (NSE) ist der Warm-Data-Store in SAP HANA und HANA Cloud. Definition, Funktionsweise, Abgrenzung zu Data Aging und Data Tiering.
Neural Network
Ein Neural Network ist ein Schicht-Modell aus Neuronen, das per Backpropagation eine Funktion von Eingaben auf Ausgaben lernt. Basis für Deep Learning.
Next Best Action
Next Best Action (NBA) ist die datengetriebene Entscheidung über die beste nächste Kundenaktion. Definition, Abgrenzung zu NBO, Recommendern, Beispiel.
OLAP (Online Analytical Processing)
OLAP (Online Analytical Processing) bezeichnet analytische Datenbanksysteme mit aggregierenden Lesezugriffen. Definition und Abgrenzung zu OLTP, HTAP und LTAP.
OLTP (Online Transaction Processing)
OLTP (Online Transaction Processing) bezeichnet zeilenorientierte, transaktionale Datenbanken mit ACID-Garantien. Definition und Abgrenzung zu OLAP und HTAP.
OPTIMIZE und VACUUM
OPTIMIZE kompaktiert Small Files einer Delta-Tabelle, VACUUM entfernt alte Parquet-Dateien nach Ablauf der Aufbewahrungsfrist aus dem Objektspeicher.
PII in LLMs
PII in LLMs bezeichnet personenbezogene Daten in Prompts, Antworten, Logs, Caches und Trainingsdaten. Definition, Risiken und Abgrenzung zum DB-Schutz.
Permissions (Berechtigungen)
Permissions sind konkrete Rechte auf Ressourcen, die per GRANT und REVOKE an Prinzipale vergeben werden. Definition, Beispiel und Abgrenzung zu RBAC.
Personalisierung
Personalisierung passt Ansprache, Angebote und Inhalte je Kunde an. Definition, Abgrenzung zu Segmentierung, Recommender und Next Best Action, Beispiel.
Quantization
Quantisierung reduziert die Präzision der Modellgewichte auf INT8 oder INT4. Definition, Verfahren (PTQ, QAT, GPTQ, AWQ, GGUF, NF4) und Abgrenzung.
Query Rewriting
Query Rewriting formt Nutzeranfragen vor dem Retrieval um. Definition, Verfahren (LLM-Rewrite, HyDE, Multi-Query) und Abgrenzung zu Query Routing.
Query Routing
Query Routing verteilt Anfragen in RAG-Systemen auf die passende Datenquelle. Definition, vier Verfahren und Abgrenzung zu Query Rewriting und Reranking.
RAG Evaluation
RAG Evaluation misst Retrieval- und Generation-Qualität eines RAG-Systems getrennt. Definition, Metriken (Faithfulness, Context Recall), RAGAS, Abgrenzung.
RBAC (Role-Based Access Control)
RBAC (Role-Based Access Control) bindet Rechte an Rollen statt an Nutzer. Definition nach NIST INCITS 359, Beispiel und Abgrenzung zu ABAC und ACL.
RFM-Analyse
Die RFM-Analyse segmentiert Kunden nach Recency, Frequency und Monetary Value. Definition, Segmente, Berechnung und Abgrenzung zu Propensity und CLV.
SAP Analytics Cloud
SAP Analytics Cloud (SAC) ist die SaaS-BI- und Planungsplattform von SAP. Definition, Bausteine und Abgrenzung zu Datasphere, Power BI und BusinessObjects.
SAP BW Bridge
SAP BW Bridge ist die Migrationskomponente in SAP Datasphere, die bestehenden BW/4HANA-Content als eigenen Tenant übernimmt und dort weiter betreibt.
SAP Business Data Cloud
SAP Business Data Cloud (BDC) bündelt Datasphere, SAP Analytics Cloud, BW Bridge und eingebettetes Databricks. Definition, Bausteine und Abgrenzung.
Tags (Unity Catalog)
Tags in Unity Catalog sind Schlüssel-Wert-Metadaten an Katalog-Objekten. Definition, Governed vs. freie Tags, Abgrenzung zur Klassifikation.
Task Chain
Eine Task Chain ist eine Kette abhängiger Tasks in Databricks Lakeflow Jobs, modelliert als DAG. Definition, Bausteine und Abgrenzung im Überblick.
Temperature
Temperature ist der LLM-Sampling-Parameter, der Determinismus und Kreativität steuert. Wirkung, typische Werte und Abgrenzung zu Top-k, Top-p und Seed.
UniForm (Delta Lake Universal Format)
UniForm ist ein Delta-Lake-Feature ab Version 3.0, das Delta-Tabellen zusätzlich als Iceberg-Tabellen lesbar macht, ohne Datenkopie oder ETL-Job.
Unified Data Analytics Platform
Unified Data Analytics Platform bündelt Data Engineering, BI, Data Science, ML und Governance in einer Plattform. Definition, Aufbau, Abgrenzung im Überblick.
Unity Catalog
Unity Catalog ist Databricks' Governance-Layer für Daten- und AI-Assets. Definition, Namensraum, Rechte, Abgrenzung zu Hive Metastore und Data Catalog.
Vector Database (Vektordatenbank)
Vector Database kurz erklärt: Speicherung und Ähnlichkeitssuche über Embeddings via HNSW und IVF, mit Abgrenzung zu Vector Search und Search Engine.
Vector Search
Vector Search kurz erklärt: Ähnlichkeitssuche über Embeddings via HNSW und IVF-PQ, mit Abgrenzung zu Vector Database, Semantic, Lexical und Hybrid Search.
Vertical AI Agents
Vertical AI Agents sind LLM-Agenten für eine Branche oder Fachaufgabe, mit Fach-Prompts, Werkzeugen, Regulatorik-Wissen und Fach-RAG. Definition und Abgrenzung.
Z-Ordering
Z-Ordering ist eine Data-Layout-Technik in Delta Lake, die per OPTIMIZE ZORDER BY korrelierte Werte mehrerer Spalten physisch in wenigen Dateien bündelt.
Zero-ETL
Zero-ETL ist die automatisierte Pipeline zwischen OLTP-DB und Analyse-Store. Definition, Vertreter (Aurora, OneLake) und Abgrenzung zu HTAP und LTAP.
Zerobus Ingest
Zerobus Ingest ist der Databricks-Pfad, der Events per gRPC direkt in Delta schreibt. Definition, Architektur und Abgrenzung zu Kafka und Auto Loader.