DSGVO by Design
/ Software-Audit

KI schreibt Code. Wir sagen Ihnen, ob er hält.

Ob selbst mit KI gebaut, von einer Agentur geliefert oder kurz vor der Abnahme: Wir prüfen Ihre Software auf Sicherheitslücken, Datenschutz-Risiken und die Stellen, die beim Wachsen brechen. Fester Preis, feste Frist.

5,0 5 Google-Bewertungen
Selbst mit KI gebaut Agentur weg Vor der Abnahme
Was das Audit umfasst
/ Das Problem

Es läuft. Das heißt nicht, dass es hält.

KI-Werkzeuge schreiben in Stunden, wofür früher Wochen nötig waren. Der Code sieht ordentlich aus und funktioniert im Test. Was man ihm nicht ansieht: ob Daten geschützt sind, ob er standhält, wenn hundert Nutzer gleichzeitig darauf zugreifen, und ob ihn in einem halben Jahr noch jemand versteht.

Der Unterschied zwischen „läuft“ und „hält“ zeigt sich erst, wenn es teuer wird.

Deshalb prüfen wir vorher: das Software-Audit.

Sicherheitslücken, Datenschutz-Risiken und die Stellen, die beim Wachsen brechen. Sie bekommen eine Befundliste nach Schwere sortiert und eine Aufwandsschätzung für die Sanierung.

Zum Software-Audit
/ Und wenn die KI selbst arbeiten soll

Geprüfter Code ist die eine Hälfte. Geprüfte KI-Antworten sind die andere.

Wer KI im Betrieb einsetzt, hat ein zweites Problem: Das Programm kann fehlerfrei sein und die KI trotzdem Unsinn ausgeben. Auch das lässt sich prüfen, und genau das machen wir seit Jahren.

/ Das zweite Problem

Eine falsche Antwort sieht aus wie eine richtige.

KI-Ausgaben sind schnell und überzeugend formuliert, und manchmal trotzdem falsch. Klassische Überwachung sieht nur, dass eine Anfrage erfolgreich war und wie lange sie dauerte. Ob das Ergebnis stimmt, sieht sie nicht.

Dazu ändern sich Modelle, Eingaben verschieben sich, gestern kam ein anderes Ergebnis als heute.

In der Vorführung fällt das nicht auf, im Betrieb schon.

Dafür gibt es eine eigene Disziplin: LLMOps.

Sie macht jede KI-Ausgabe überprüfbar, und sorgt dafür, dass Ihre KI im Betrieb richtig liegt, nicht nur in der Vorführung.

/ Was wir machen

Jede KI-Ausgabe wird gemessen, aufgezeichnet und geprüft.

Klassische Software ist nur Code. KI besteht aus Code, Live-Daten und Modell, ändert sich ein Teil, schwankt das Ergebnis. LLMOps verbindet alle drei zu einem zuverlässigen System. So lösen wir unsere drei Zusagen ein, messbar, transparent und zuverlässig:

Messbar
Wir wissen, ob die KI richtig liegt.

Normale Überwachung sieht nur, ob eine Anfrage durchlief und wie lange. Ob die Antwort stimmt, sieht sie nicht. Diese Qualitätsprüfung heißt in LLMOps Evaluation, kurz Eval: Wir vergleichen Antworten mit geprüften Beispielen, vor jeder Freigabe und im laufenden Betrieb.

Eval-Datensätze (Ground Truth): geprüfte Beispiele als Maßstab, an denen wir jede Antwort messen.
Mehrfach bewertet: über feste Metriken, ein zweites Modell als Prüfer (LLM-as-Judge) und, wo nötig, einen Menschen.
Automatisch getestet (CI/CD): Jede Änderung läuft erst gegen die Eval-Datensätze und wird nur ausgeliefert (Deployment), wenn die Qualität hält. Im Betrieb messen wir weiter (Online-Eval), nicht nur Tempo und Kosten.
Transparent
Sie können nachsehen, wie eine Antwort entsteht.

Jeder Schritt wird aufgezeichnet, das nennt man in LLMOps Observability; die Spur einer einzelnen Anfrage heißt Tracing. So lässt sich zu jeder Antwort nachsehen, welches Modell sie erzeugt hat, welche Quelle es nutzte und welche Version der Anweisung galt.

Tracing: jeder KI-, Werkzeug- und Datenabruf ist als Spur einsehbar, filterbar nach Nutzer, Kosten und Zeit.
Prompt-Versionierung: Anweisungen an die KI sind versioniert, jede frühere Fassung lässt sich zurückholen.
Monitoring & Alerts: läuft die Qualität weg (Drift), werden wir automatisch benachrichtigt.
Zuverlässig
Nichts Ungeprüftes geht raus.

Eine Sprach-KI klingt überzeugend, auch wenn sie falsch liegt. Deshalb entscheidet sie bei uns nie allein: Ein regelbasierter Prüfschritt kontrolliert jede Ausgabe, bevor sie Sie erreicht. Passt sie nicht, wird sie verworfen oder neu angefordert.

Guardrails: feste Schutzregeln fangen unerwünschte Ein- und Ausgaben ab.
Strukturierte Ausgaben: jede Antwort muss einem festen Schema entsprechen, sonst gilt sie nicht.
Routing & Fallback: Anfragen gehen an das passende Modell; fällt eines aus, übernimmt automatisch ein anderes.
Und: Private AI

Auf Wunsch Ihre eigene KI, betrieben in Deutschland, DSGVO by Design, statt über US-Konzerne.

Die Methode im Detail
/ Wer wir sind

Zwei Gründer aus Osnabrück.

Wir bauen nur, was wir belegen können, und stehen mit unserem Namen dafür ein.

Niels Schild und Marcel Hammerich, Gründer von digital hoch x Mehr über uns
/ Im Einsatz

Gebaut, nicht versprochen.

OTpilot · Gesundheit Rund ein Drittel weniger Dokumentationszeit. KI-gestützte Dokumentation für Sanitätshäuser und Apotheken. Im Einsatz seit 2026, vorgestellt auf der OT World 2026.
/ Häufige Fragen

Was Entscheider zuerst fragen.

Alle Fragen ansehen

Lassen Sie uns sprechen.

15 Minuten, unverbindlich. Wir sagen Ihnen ehrlich, ob und wie Ihr Vorhaben machbar ist.

/ Software-Audit

KI schreibt Code. Wir sagen Ihnen, ob er hält.

Ob selbst mit KI gebaut, von einer Agentur geliefert oder kurz vor der Abnahme: Wir prüfen Ihre Software auf Sicherheitslücken, Datenschutz-Risiken und die Stellen, die beim Wachsen brechen. Fester Preis, feste Frist.

Was das Audit umfasst
15 Minuten, unverbindlich. Wir sagen Ihnen ehrlich, ob sich das Audit für Sie lohnt.
OTpilot
im Einsatz seit 2026
100 % Deutschland
Betrieb & Daten
DSGVO
by Design
Niels Schild und Marcel Hammerich, Gründer von digital hoch x
Niels Schild und Marcel Hammerich, Gründer
Osnabrück

Es läuft. Das heißt nicht, dass es hält.

KI-Werkzeuge schreiben in Stunden, wofür früher Wochen nötig waren. Der Code sieht ordentlich aus und funktioniert im Test. Was man ihm nicht ansieht: ob Daten geschützt sind, ob er standhält, wenn hundert Nutzer gleichzeitig darauf zugreifen, und ob ihn in einem halben Jahr noch jemand versteht.

Der Unterschied zwischen „läuft“ und „hält“ zeigt sich erst, wenn es teuer wird.

Deshalb prüfen wir vorher: das Software-Audit.

Sicherheitslücken, Datenschutz-Risiken und die Stellen, die beim Wachsen brechen. Sie bekommen eine Befundliste nach Schwere sortiert und eine Aufwandsschätzung für die Sanierung. Fester Preis, feste Frist.

Zum Software-Audit
/ Und wenn die KI selbst arbeiten soll

Eine falsche Antwort sieht aus wie eine richtige. In der Vorführung fällt das nicht auf, im Betrieb schon.

KI-Ausgaben sind schnell und überzeugend formuliert, und manchmal trotzdem falsch. Klassische Überwachung sieht nur, dass eine Anfrage erfolgreich war und wie lange sie dauerte. Ob das Ergebnis stimmt, sieht sie nicht.

Dazu ändern sich Modelle, Eingaben verschieben sich, gestern kam ein anderes Ergebnis als heute.

Dafür gibt es eine eigene Disziplin: LLMOps.

Sie macht jede KI-Ausgabe überprüfbar, und sorgt dafür, dass Ihre KI im Betrieb richtig liegt, nicht nur in der Vorführung.

/ Was wir machen

Jede KI-Ausgabe wird gemessen, aufgezeichnet und geprüft.

Klassische Software ist nur Code. KI besteht aus Code, Live-Daten und Modell, ändert sich ein Teil, schwankt das Ergebnis. LLMOps verbindet alle drei zu einem zuverlässigen System. So lösen wir unsere drei Zusagen ein, messbar, transparent und zuverlässig:

01 Messbar
Wir wissen, ob die KI richtig liegt.

Normale Überwachung sieht nur, ob eine Anfrage durchlief und wie lange. Ob die Antwort stimmt, sieht sie nicht. Diese Qualitätsprüfung heißt in LLMOps Evaluation, kurz Eval: Wir vergleichen Antworten mit geprüften Beispielen, vor jeder Freigabe und im laufenden Betrieb.

Eval-Datensätze (Ground Truth): geprüfte Beispiele als Maßstab, an denen wir jede Antwort messen.
Mehrfach bewertet: über feste Metriken, ein zweites Modell als Prüfer (LLM-as-Judge) und, wo nötig, einen Menschen.
Automatisch getestet (CI/CD): Jede Änderung läuft erst gegen die Eval-Datensätze und wird nur ausgeliefert (Deployment), wenn die Qualität hält. Im Betrieb messen wir weiter (Online-Eval), nicht nur Tempo und Kosten.
02 Transparent
Sie können nachsehen, wie eine Antwort entsteht.

Jeder Schritt wird aufgezeichnet, das nennt man in LLMOps Observability; die Spur einer einzelnen Anfrage heißt Tracing. So lässt sich zu jeder Antwort nachsehen, welches Modell sie erzeugt hat, welche Quelle es nutzte und welche Version der Anweisung galt.

Tracing: jeder KI-, Werkzeug- und Datenabruf ist als Spur einsehbar, filterbar nach Nutzer, Kosten und Zeit.
Prompt-Versionierung: Anweisungen an die KI sind versioniert, jede frühere Fassung lässt sich zurückholen.
Monitoring & Alerts: läuft die Qualität weg (Drift), werden wir automatisch benachrichtigt.
03 Zuverlässig
Nichts Ungeprüftes geht raus.

Eine Sprach-KI klingt überzeugend, auch wenn sie falsch liegt. Deshalb entscheidet sie bei uns nie allein: Ein regelbasierter Prüfschritt kontrolliert jede Ausgabe, bevor sie Sie erreicht. Passt sie nicht, wird sie verworfen oder neu angefordert.

Guardrails: feste Schutzregeln fangen unerwünschte Ein- und Ausgaben ab.
Strukturierte Ausgaben: jede Antwort muss einem festen Schema entsprechen, sonst gilt sie nicht.
Routing & Fallback: Anfragen gehen an das passende Modell; fällt eines aus, übernimmt automatisch ein anderes.
Und: Private AI

Auf Wunsch Ihre eigene KI, betrieben in Deutschland, DSGVO by Design, statt über US-Konzerne.

Die Methode im Detail
/ Wer wir sind

Zwei Gründer aus Osnabrück.

Wir bauen nur, was wir belegen können, und stehen mit unserem Namen dafür ein.

Wir kommen aus dem Gesundheitswesen (Sanitätshäuser und Apotheken), der am stärksten regulierten Branche. Das Vorgehen ist branchenunabhängig.

Mehr über uns
/ Unser Prinzip
„Wir bauen nur, was wir belegen können, und stehen mit unserem Namen dafür ein.“
Niels Schild & Marcel Hammerich · Gründer
/ Im Einsatz

Gebaut, nicht versprochen.

OTpilot · Im Einsatz bei
Logo Orthopädietechnik Klein GmbH Logo Sanitäts- und Wäschehaus Ackermann Logo LimbArt – Die Prothesenmanufaktur
OTpilot · Gesundheit
Rund ein Drittel weniger Dokumentationszeit.

KI-gestützte Dokumentation für Sanitätshäuser und Apotheken. Im Einsatz seit 2026, vorgestellt auf der OT World 2026.

Alle Referenzen
Datenschutz by Design

Betrieb in Deutschland und der EU, DSGVO-konform, mit Auftragsverarbeitungs-Verträgen und EU-Standardvertragsklauseln. Auf Wunsch vollständig in Deutschland.

/ Google-Bewertungen

Was Kunden sagen.

Auf Google ansehen →
5,0
★★★★★
5 Bewertungen auf Google
★★★★★ vor 3 Monaten

Der Föv der Eichsfelder Musikschule hat das Programm Nextcloud erworben, um die Fotos die sich über viele Jahre von Veranstaltungen auf den privaten Handys der Mitarbeiter angesammelt hatten, in einer Anwendung datenschutzkonform zu bündeln . Dabei wurden …

Katrin Dörnbach · via Google
★★★★★ vor 3 Monaten

Super erreichbar, lösungsorientiert und wirklich angenehm in der Zusammenarbeit. Man fühlt sich gut aufgehoben und ernst genommen. Klare Empfehlung!

Bastian Burau · via Google
★★★★★ vor 2 Monaten

super freundlicher Service, schnelle und vor allem verständliche Hilfe! Kann man nur empfehlen. Ich habe mir eine automatisierte Reservierungsübersicht erstellen lassen

Carolin Wagner · via Google
/ Häufige Fragen

Was Entscheider zuerst fragen.

Noch eine Frage offen? 15 Minuten, unverbindlich, wir antworten ehrlich.

Lassen Sie uns sprechen.

15 Minuten, unverbindlich. Wir sagen Ihnen ehrlich, ob und wie Ihr Vorhaben machbar ist.

Was das Audit umfasst