Anwendung
Die Oberfläche, mit der Fachbereiche tatsächlich arbeiten – Chat, Dashboard oder API.
FastAPI · OpenAI-kompatible REST-APIs · LibreChat · Power BI
Beraterprofil · Data & AI Engineer
Datenplattform und KI-Anwendung aus einer Hand.
Rund zehn Jahre IT-Beratung, davon etwa sechs Jahre Data Engineering und drei Jahre Databricks. Ich baue und migriere Datenplattformen – Ingestion, ETL/ELT, Modellierung und Governance – und entwickle darauf RAG- und Agentensysteme bis in den Produktivbetrieb. Branchenschwerpunkt Banking und Versicherung, Projekte in regulierten Umgebungen mit Code-Reviews, Infrastructure as Code und formaler Abnahme.
Arbeitsweise
Der größte Teil der Arbeit liegt unten: in Pipelines, Datenmodellen und Governance. Ich arbeite über den gesamten Stack – von der Ingestion aus den Quellsystemen bis zur Oberfläche – und übernehme die Schichten einzeln oder komplett.
Die Oberfläche, mit der Fachbereiche tatsächlich arbeiten – Chat, Dashboard oder API.
FastAPI · OpenAI-kompatible REST-APIs · LibreChat · Power BI
Ein Supervisor entscheidet, welche Datenquelle oder welches Werkzeug eine Frage beantwortet – und führt Aktionen aus.
Mosaic AI Agent Framework · Genie Spaces · MCP-Server · LangChain / LangGraph
Sprachmodelle bereitstellen und Dokumentenwissen belegbar machen: Parsing, Chunking, Embeddings, semantische Suche.
Azure AI Foundry · Databricks Vector Search · MLflow · Prompt Engineering
Die Datenbasis, auf der alles steht: Ingestion aus heterogenen Quellen, Transformation, Modellierung entlang der Medallion-Architektur.
Databricks · PySpark · Delta Lake · dbt · Azure Data Factory · SQL
Zugriff, Nachvollziehbarkeit und reproduzierbare Deployments – in Banking und Versicherung keine Kür, sondern Voraussetzung.
Unity Catalog · Entra ID / OAuth 2.0 · Key Vault · Terraform · CI/CD · Git · Jira
Technologien
Nach Einsatztiefe geordnet – nicht nach Alphabet.
Ausgewählte Projekte
Data Engineer
Stabilisierung einer Terraform-verwalteten Lakehouse-Infrastruktur über mehrere Umgebungen. Diagnose und Behebung eines systemischen Drifts zwischen Terraform-State und Laufzeit im Credential- und Secret-Management; Wiederherstellung deterministischer, idempotenter Deployments. Gestufte Azure-DevOps-Pipelines mit getrennten Plan- und Apply-Schritten und Approval-Gates.
Terraform · Azure DevOps · Key Vault · Databricks · Unity Catalog · ADLS Gen2 · Entra ID
AI Engineer
Konzeption und Deployment eines Supervisor Agent (Mosaic AI), der mehrere Genie Spaces hinter einem zentral verwalteten Endpoint orchestriert – bereitgestellt als OpenAI-kompatible REST-API mit MCP-Tool-Integration und OAuth-2.0-Absicherung. Fachbereiche fragen Unternehmensdaten seither in natürlicher Sprache ab; der Bedarf an manuellem Ad-hoc-Reporting ging deutlich zurück.
Databricks · Mosaic AI · Genie Spaces · MCP · Azure AI Foundry · OAuth 2.0 · Entra ID · Python
Data Engineer
End-to-End-Ingestion-Pipeline, die einen SOAP-basierten externen Anbieter in ein governtes Cloud-Lakehouse integriert: wiederverwendbarer API-Client, serverlose Verarbeitung, orchestriertes Scheduling und strukturierte Aufbereitung in Delta-Tabellen – abgesichert durch formale Abnahmetests über den gesamten Funktionsumfang.
Databricks · Delta Lake · Unity Catalog · Azure Data Factory · Azure Functions · Python
Data Engineer
Konsolidierung heterogener Quellsysteme in ein governtes Azure-zu-Databricks-Lakehouse mit metadatengetriebenem Orchestrierungs-Framework. Darauf eine vollautomatisierte Abstimmung auf Transaktionsebene: interne Ledger-Buchungen gegen externe Nostro-Auszüge, mit Valuta-Logik, konfigurierbaren Toleranzen, Abweichungskategorisierung und Match-Reporting.
Azure Data Factory · Databricks · Delta Lake · Medallion Architecture · Python · SQL
Data Engineer / Trainer
Konzeption und Durchführung praxisorientierter Databricks-Trainings für Entwicklerteams und Fachanwender: Best Practices in PySpark, Delta Lake, Unity Catalog und Medallion-Architektur, Hands-on-Übungen und Referenzimplementierungen. Begleitendes Coaching während der Umsetzungsphase.
Databricks · PySpark · Delta Lake · Unity Catalog · Python · SQL · Power BI
Data Engineer / Data Analyst
Sichere, skalierbare Reporting-Architektur auf Azure: Datenmodelle und Governance-Konzepte, Dev-/Test-/Prod-Deploymentstrategie, RBAC und Row-Level Security, Performance-Optimierung sowie Abstimmung zwischen Fachbereich und IT.
Azure · Databricks · Power BI · SQL
Data Engineer / Data Analyst
Konzeption und Implementierung von ETL-Prozessen und DWH-Strukturen für große operative Datenmengen: Pipeline-Entwicklung mit Apache-Airflow-Orchestrierung, Administration und Optimierung bestehender Warehouse-Strukturen, Sicherstellung von Datenqualität und -konsistenz sowie operativer Support im laufenden Betrieb.
SAS DI · SAS Base · SQL · Apache Airflow
Data Engineer
Überführung einer gewachsenen BigQuery-Umgebung auf Databricks: Analyse der Bestandsarchitektur, Konzeption der Zielarchitektur, Datenextraktion, Reconciliation, Validierung und Cleanup. Anschließend Aufbau der Ingestion- und Verarbeitungspipelines für große Mengen an Wirtschafts- und Marktdaten aus heterogenen externen Quellen sowie Anbindung an das nachgelagerte Reporting.
Google BigQuery · Databricks · dbt · Python · SQL · Power BI · Tableau
Werdegang
Kontakt
Kurze Nachricht mit Rahmen, Laufzeit und Einsatzort genügt – ich melde mich am selben Tag zurück.