Produktionsreife AI · Wien & remote weltweit

AI, die deine Kunden begeistert und dich von der Konkurrenz abhebt.

Ich baue produktionsreife AI für B2B SaaS: zuverlässig, sodass deine Kunden sich darauf verlassen können, und so effizient, dass laufende AI-Kosten um bis zu 99 % sinken. 12+ Jahre Production-ML Erfahrung – lange vor dem LLM-Hype.

ex-CTO
Startup aufgebaut & skaliert
12+ Jahre
Production-ML & Engineering
Reguliert
AI in validierter Medizinsoftware
Alexander Dür

Über mich

Dein technischer Partner für AI — von der Idee bis zum Launch.

Ich bin ein Senior Engineer, der seit über einem Jahrzehnt Machine Learning & AI Modelle baut. Als ehemaliger Startup-CTO verstehe ich Technik und Business und baue AI, die maßgeschneidert deinen Business-Case perfekt löst.

Von Architektur und Modellauswahl bis zur Test-Strategie: Ich erkläre dir alle Optionen und Möglichkeiten klar, verständlich und ohne Fachjargon. Du bekommst ein Produkt, das deinen Vorstellungen entspricht, dich klar von der Konkurrenz abhebt und Kunden beeindruckt.

Sprachen

  • Deutsch
  • Englisch

Standort

  • Wien, Österreich (CET)
  • Remote weltweit & vor Ort

Ausbildung

  • WU Wien — MSc Quantitative Finance
  • TU Wien — MSc Business Informatics

Leistungen

Hauptangebot & weitere Leistungen

Hauptangebot

Produktionsreife AI

Ich designe und entwickle AI-Features und Produkte, die Kunden begeistern und dein Unternehmen von der Konkurrenz abheben.

Neue AI-Modelle nutzen

Ich zeige dir, was moderne AI-Modelle heute möglich machen und baue daraus Produkte und Features, die es vorher nicht gab.

Genau das bauen, was du dir vorstellst

Du hast einen klaren Plan – ich setze ihn um und baue dein AI-Feature oder AI-Produkt. LLM-basiert oder klassisches ML.

Fertige Prototypen über die Ziellinie bringen

Halluzinationen reduzieren, Latenz optimieren, Outputs stabilisieren: Damit sich Benutzer zu 100% auf dein Produkt verlassen können.

Inferenzkosten und Latenz optimieren

Caching, Routing, Model Selection, Batching, um 30–70% laufende Kosten einzusparen. Hybride LLM-Lösungen für bis zu 99% niedrigere Kosten.

Außerdem verfügbar für MVP-Entwicklung und Fractional-CTO-Mandate.

Stack

Die Werkzeuge, mit denen ich produktionsreife AI-Features baue und betreibe.

Sprachen

PythonTypeScriptJavaKotlinRust

ML & AI

PyTorchscikit-learnLangChainRegression TreesProbabilistic ModelsTF-IDF

Data

RaySparkPrestoPostgreSQLData Warehousing

Infrastructure

AWSDockerKubernetes (CKA 2025)CI/CDInfrastructure as Code

Auch erfahren mit: R · PHP · C++ · Go · Aerospike · Redis · Kafka · Hadoop · Hive · GraphQL · Next.js · React · Node.js

Projekte

Ausgewählte Projekte

Startup · CTO

PAXLY — Beschaffungsplattform für Verpackungen

ML-basierte Verpackungsoptimierung, die E-Commerce-Unternehmen wie Flaconi 10–15 % tägliche Versandkosten spart. 2016 mitgegründet und als CTO bis 2023 das gesamte Produkt von Null aufgebaut. Zwei Finanzierungsrunden über €1 Mio. bei €5 Mio. Bewertung abgeschlossen. Technisch so robust gebaut, dass kritische Hotfixes von ein bis zwei pro Monat auf etwa einen pro Jahr zurückgingen.

10–15 % Versandkosten gespart · Hotfixes ~1×/Jahr · €1 Mio.+ Funding

paxly.ai Mehr über Fractional CTO
PAXLY — Beschaffungsplattform für Verpackungen
Co-Founder · Technical Lead

Firmbase — Unternehmens-Suchmaschine für den UK-Markt

Unternehmens-Suchmaschine für den UK-Markt mit 5,5 Mio.+ Einträgen, Full-Stack gebaut. Eine Crawling-Pipeline erfasst ~100.000 Seiten pro Tag und Maschine; AI-gestützte Datenanreicherung end-to-end. Ergebnis: ~80 % relevante Treffer pro Suche statt ~20 % bei gängigen Tools – rund 5× präzisere Lead-Listen.

~5× präzisere Treffer · 5,5 Mio. Unternehmen

firmbase.co
Firmbase — Unternehmens-Suchmaschine für den UK-Markt

Relevante AI-Arbeit

AI & ML bei Kunden

Ausgewählte AI- und ML-Projekte mit messbarer Wirkung. Kundennamen nenne ich gerne im Gespräch.

Regulierte Medizinsoftware

Für große Kunden waren zentrale Features so langsam, dass sie praktisch unbrauchbar waren – Nutzer hielten sie für defekt. Durch optimierte Algorithmen, Caching und Optimierung von Datenbankabfragen laufen sie wieder zuverlässig: bis zu 90 % kürzere Ladezeiten. Dazu ein AI-Assistant mit Intent-Klassifikation: 95 % weniger Fehlantworten – entwickelt nach V-Modell.

95 % weniger Fehlantworten · bis zu 90 % schnellere Ladezeiten

TypeScript · Node.js · PostgreSQL · LLM

AdTech · Real-Time Advertising

Regression-Tree-Modell zur Floor-Price-Optimierung in Echtzeit-Werbeauktionen: rund +8 % Umsatz im Millionenbereich. Dazu eine Daten-Pipeline mit 80 % kleinerem Data-Warehouse und 75 % weniger Reporting-Last.

≈ +8 % Umsatz · −80 % Datenvolumen

Java · C++ · Spark · ML

Audit-Daten · Food Safety

Erklärbare Anomalie-Erkennung für Audit-Daten: Jede Auffälligkeit kommt mit einer vollständigen Begründungskette – das System sagt nicht nur, dass etwas ungewöhnlich ist, sondern warum. Entscheidungen bleiben für Auditoren nachvollziehbar und belastbar.

Vollständige Begründungskette · keine Black Box

Python · PGM · Neural Nets

Climate-Tech · Daten-Pipeline

Eine Pipeline schickte Dokumente durch ein teures LLM – bei Millionen Dokumenten explodieren die Kosten. Statt naiv mit dem LLM zu filtern, trainiert das LLM ein günstiges TF-IDF-Modell, das vorab filtert: nur ~10.000 statt 3 Mio. Dokumente erreichen die teure Stufe. LLM-Kosten um rund 99 % gesenkt.

≈ −99 % LLM-Kosten

Python · AWS · Ray · LLM

Kundenstimmen

Was meine Kund:innen sagen

„Alex hat unsere Daten-Pipeline neu aufgesetzt und das Datenvolumen um 75 % reduziert – ohne Verlust an Aussagekraft. Schnell, absolut zuverlässig und immer erreichbar, wenn es darauf ankam.“

„Alex hat unsere Marktplatz-Plattform in nur 8 Wochen von null auf voll funktionsfähig gebracht. Das hat unser Wachstum und schnelles Skalieren erst möglich gemacht.“

Sabine Niedermüller

Sabine Niedermüller

Geschäftsführerin, HeldYn

Prozess

Wie ich arbeite

01

Erstgespräch

Dein Problem verstehen

Ein kurzes, unverbindliches Gespräch, um dein Projekt und deine Ziele zu verstehen. Keine wochenlange Analyse. Wir klären die wichtigsten Fragen direkt. Kostenlos.

02

Umsetzung

Schnell und zuverlässig liefern

Fokussierte Sprints (1-4 Wochen), regelmäßige Updates und getesteter Code. Du siehst jederzeit, wo wir stehen, und kannst bei jeder Entscheidung mitreden.

03

Übergabe

Sauberer Abschluss

Dokumentation, Wissenstransfer und ein Produkt, das ohne mich weiterläuft. Kein Lock-in, keine versteckten Abhängigkeiten.

Investition

ab €150

Stundensatz

€1.200 – 1.500

Tagessatz für Projektarbeit

Genaue Einschätzung nach kostenlosem Erstgespräch.

Kontakt

Lass uns über deinen Anwendungsfall sprechen.

Egal, ob du ein neues AI-Feature oder AI-Produkt bauen willst, einen existierenden Prototyp live nehmen willst oder erst einmal einschätzen möchtest, was technisch machbar ist — in einem kurzen Gespräch finden wir heraus, wie ich helfen kann.

Aktuell verfügbar für neue Projekte

Kostenloses Erstgespräch buchen