itundschnell.at

Souveräne KI-Infrastruktur aus Österreich

Eine API. Sechs europäische Provider. Kein Datenabfluss aus der EU.

itundschnell ist der OpenAI-kompatible Inference-Router für Europa: intelligentes Routing über ausschließlich europäische Rechenzentren — mit PII-Redaction, revisionssicherem Audit-Log und AV-Vertrag auf Knopfdruck.

main.py
client = OpenAI(
- base_url="https://api.openai.com/v1",
+ base_url="https://api.itundschnell.at/v1",
api_key=os.environ["ITUNDSCHNELL_API_KEY"],
)
  • OpenAI-kompatibel
  • DSGVO-konform
  • Rechenzentrum in Österreich
  • Keine Prompt-Speicherung

Geroutet wird ausschließlich über europäische Infrastruktur

  • eww ITandTEL (AT)
  • Hetzner (DE)
  • Exoscale (AT/CH)
  • OVHcloud (FR)
  • Nebius (EU)
  • Scaleway (FR)

Warum

Ihre Prompts gehören nicht in US-Clouds.

Wer KI produktiv einsetzt, verarbeitet Kundendaten, Verträge und Interna. Wohin diese Daten fließen, ist keine Detailfrage — es ist die Compliance-Frage.

Drittlandtransfer ist ein Rechtsrisiko

US CLOUD Act und die Folgen von Schrems II machen jeden Prompt an US-Anbieter zu einem Datentransfer, den Ihre Datenschutzerklärung tragen muss — inklusive aller personenbezogenen Daten darin.

DSGVO & AI Act ohne Eigenbau

PII-Erkennung, Audit-Pflichten und AV-Verträge selbst zu bauen kostet Monate an Engineering-Zeit. Hier sind sie Teil der Infrastruktur — zuschaltbar pro Request.

Ein Vertrag, ein Ansprechpartner

Sechs europäische Provider hinter einer API: ein AV-Vertrag, Abrechnung in Euro, Support aus Österreich. Kein Vertrags- und Compliance-Puzzle pro Anbieter.

Funktionsweise

Ein Endpunkt. Dahinter intelligentes Routing.

Sie sprechen mit einer einzigen OpenAI-kompatiblen API. Der Router wählt pro Request den besten europäischen Provider — nach Ihrer Strategie.

Ihre Anwendung

OpenAI SDK · beliebiger HTTP-Client

api.itundschnell.at

Auth · Routing · Compliance · Metering

  • eww ITandTEL
  • Hetzner
  • Exoscale
  • OVHcloud
  • Nebius
  • Scaleway

CostFirst

Der günstigste gesunde Provider gewinnt. Preise pro Million Tokens, abgerechnet in Euro — transparent pro Request.

LatencyFirst

Routing nach Time-to-First-Token, als gleitender Mittelwert laufend über alle Provider gemessen.

AustriaFirst

Immer zuerst nach Österreich (eww ITandTEL, Wels) — Fallback ausschließlich innerhalb der EU.

5 Fehler / 60 s
öffnen den Circuit Breaker — der Provider wird umgangen
alle 15 s
Health-Checks holen erholte Provider automatisch zurück
Failover
automatisch zum nächsten gesunden Provider gemäß Strategie
X-Router-Strategy
Strategie pro Request per Header steuerbar

Integration

Integriert in zwei Minuten.

Vollständig OpenAI-kompatibel — bestehende SDKs und Tools funktionieren ohne Änderung. Nur die base_url wird getauscht.

chat-completion.sh
curl https://api.itundschnell.at/v1/chat/completions \
  -H "Authorization: Bearer sk-eur-..." \
  -H "Content-Type: application/json" \
  -H "X-Router-Strategy: austria_first" \
  -d '{
    "model": "llama-3.3-70b",
    "messages": [{ "role": "user", "content": "Servus!" }],
    "stream": true
  }'

Optionale Header: X-Router-Strategy · X-Router-Provider · X-Compliance-Mode

Module

Zwei Module. Ein Baukasten.

Der Router ist die Basis — Compliance und Deployment schalten Sie zu, wenn Sie sie brauchen.

Modul Compliance

DSGVO im Datenpfad, nicht im Anhang.

  • PII-Redaction für Deutsch und Englisch (Microsoft Presidio)
  • Revisionssicheres Audit-Log — ohne Prompt-Inhalte
  • AV-Vertrag (DPA) als PDF auf Knopfdruck
  • AI-Act-Berichte je Risikoklasse
Details zur Compliance ↓

Modul Deployment

Ihr Modell. Unsere GPUs. In Österreich.

  • Eigene und feingetunte Modelle auf vLLM
  • GPUs (H100, L40S) im österreichischen Rechenzentrum
  • Scale-to-zero — Abrechnung nur bei Last
  • Erreichbar über dieselbe /v1/chat/completions-API
Zum Deploy-Tarif ↓

Compliance im Detail

Compliance ist Architektur, keine Checkbox.

Personenbezogene Daten werden erkannt und ersetzt, bevor ein Prompt das System verlässt — und in der Antwort transparent wiederhergestellt.

01

Erkennen

Microsoft Presidio analysiert jeden Prompt — Personen, E-Mail-Adressen, Telefonnummern, IBANs, Geburtsdaten, österreichische Sozialversicherungsnummern.

02

Ersetzen

„Hans Maier" wird zu „[PERSON_1]", bevor der Prompt das System verlässt. Der Originalwert bleibt bei uns.

03

Verarbeiten

Der Provider sieht ausschließlich Platzhalter — nie personenbezogene Daten. Auch beim Streaming.

04

Wiederherstellen

Originalwerte werden im Antwort-Stream re-injiziert. Die Zuordnung lebt maximal 60 Sekunden im Speicher und wird danach gelöscht.

pii-redaction — Beispiel
Eingabe  „Bitte prüfen Sie die Überweisung von Hans Maier, IBAN AT61 1904 3002 3457 3201."
Gesendet „Bitte prüfen Sie die Überweisung von [PERSON_1], IBAN [IBAN_1]."

Audit-Log: Was protokolliert wird

  • Request-ID, Provider, Modell
  • Token-Zahlen (Ein- und Ausgabe)
  • PII-Entitätstypen und -Anzahl
  • DSGVO-Rechtsgrundlage
  • Zeitstempel und Latenz

Append-only: UPDATE und DELETE sind auf Datenbankebene blockiert; monatliche WORM-Archivierung.

Was nie gespeichert wird

  • Prompt-Inhalte
  • Antwort-Inhalte
  • PII-Werte (nur Typen, nie die Daten selbst)

Das Gateway schreibt Prompt- und Antwort-Inhalte in keinen persistenten Speicher — nur Token-Zähler und Metadaten.

AV-Vertrag auf Knopfdruck

Auftragsverarbeitungsvertrag nach Art. 28 DSGVO — generiert als PDF mit allen aktiven Sub-Providern, deren Rechenzentren und Zertifizierungen (ISO 27001 / EN 50600).

Vorbereitet auf den AI Act

Berichte zur Risikoklassifizierung Ihrer Anwendungsfälle — vorbereitet auf die Dokumentationspflichten der EU-KI-Verordnung.

Sicherheit

Nachprüfbare Sicherheit.

Keine Marketing-Versprechen — Architekturentscheidungen.

TLS 1.3
Durchgehend verschlüsselt — Client → Gateway → Provider.
AES-256-GCM
Provider-Schlüssel ausschließlich verschlüsselt gespeichert.
SHA-256
API-Keys nur als Hash in der Datenbank; der Klartext ist einmalig bei der Erstellung sichtbar.
Keine Prompt-Speicherung
Nur Token-Zähler und Metadaten werden persistiert — nie Inhalte.
60 s TTL
PII-Zuordnungen leben maximal 60 Sekunden und werden dann gelöscht.
Append-only
Audit-Log blockiert UPDATE und DELETE; monatliche WORM-Archivierung.
Default-Deny-Egress
Ausgehender Traffic nur zu EU-Providern auf der Allow-List (NetworkPolicy).
AT-Wels
Gateway und Kontrollpfad in Österreich (eww ITandTEL, Wels) — Datenpfad ausschließlich in der EU.

Preise

Transparente Preise.

5 % auf den Provider-Verbrauch — Sie sehen jederzeit, was jeder Request kostet. Feste Monatsgebühren nur für Module, die Sie wirklich nutzen.

Early-Access-Konditionen

Starter

5 %

vom Provider-Verbrauch

Der Einstieg: ein Endpunkt, kostenoptimiertes Routing.

  • Inference-Router
  • 3 europäische Provider
  • CostFirst-Routing
  • Nutzungs-Dashboard
Frühzugang anfordern

Compliance+

Empfohlen

5 % + € 299

pro Monat

Für Teams mit DSGVO- und AI-Act-Pflichten.

  • Alle Provider & Routing-Strategien
  • PII-Redaction (Deutsch & Englisch)
  • Revisionssicheres Audit-Log & Export
  • AV-Vertrag (DPA) als PDF
  • AI-Act-Bericht
Frühzugang anfordern

Deploy

5 % + € 199

pro Monat

Eigene Modelle auf GPUs in Österreich betreiben.

  • Inference-Router
  • Custom-Model-Hosting (vLLM)
  • 1 Deployment inklusive
  • Scale-to-zero
  • Sekundengenaue GPU-Abrechnung
Frühzugang anfordern

Enterprise

Individuell

Für regulierte Branchen und hohe Volumina.

  • Alle Module
  • SLA & dedizierter Support
  • Private Provider
  • Eigene Routing-Regeln
Frühzugang anfordern

Alle Preise zzgl. USt. Early-Access-Konditionen.

FAQ

Häufige Fragen.

Ist die API wirklich OpenAI-kompatibel?

Ja. Alle Endpunkte (/v1/chat/completions, /v1/embeddings, /v1/models) folgen der OpenAI-API-Spezifikation — inklusive Streaming. Bestehende SDKs und Tools funktionieren nach dem Austausch der base_url ohne Code-Änderung.

Welche Modelle sind verfügbar?

Offene Modelle wie Llama 3.3 70B über alle angebundenen Provider; der Katalog wächst laufend. Über GET /v1/models sehen Sie jederzeit alle routbaren Modelle mit Kontextlänge und Preisen in Euro pro Million Tokens.

Wo werden meine Daten verarbeitet?

Der gesamte Datenpfad läuft über europäische Infrastruktur; das Gateway selbst wird im Rechenzentrum der eww ITandTEL in Wels, Österreich betrieben. Prompts und Antworten verlassen die EU-Jurisdiktion zu keinem Zeitpunkt — abgesichert auch technisch über Default-Deny-Egress-Regeln mit EU-Provider-Allow-List.

Speichern Sie Prompts oder Antworten?

Nein. Es werden ausschließlich Token-Zähler und Metadaten (Provider, Modell, Latenz, Zeitstempel) persistiert — niemals Prompt- oder Antwort-Inhalte. Das gilt auch für das Audit-Log.

Wie funktioniert die PII-Redaction technisch?

Vor dem Versand analysiert Microsoft Presidio (mit deutschen und englischen NLP-Modellen) jeden Prompt auf personenbezogene Daten — Namen, E-Mail-Adressen, Telefonnummern, IBANs, Geburtsdaten, österreichische Sozialversicherungsnummern. Erkannte Werte werden durch Platzhalter ersetzt; der Provider sieht nur die Platzhalter. In der Antwort werden die Originalwerte wieder eingesetzt. Die Zuordnungstabelle lebt maximal 60 Sekunden im Arbeitsspeicher und wird danach gelöscht.

Was passiert, wenn ein Provider ausfällt?

Ein Circuit Breaker pro Provider erkennt Ausfälle (5 Fehler in 60 Sekunden öffnen den Breaker) und nimmt den Provider aus dem Routing. Anfragen laufen automatisch über den nächstbesten Provider gemäß Ihrer Strategie; Health-Checks alle 15 Sekunden holen erholte Provider zurück.

Bekomme ich einen Auftragsverarbeitungsvertrag (AV-Vertrag)?

Ja. Im Compliance+-Tarif generieren Sie den AV-Vertrag nach Art. 28 DSGVO als PDF auf Knopfdruck — inklusive aller aktiven Sub-Provider, deren Rechenzentren und Zertifizierungen (ISO 27001 / EN 50600).

Kann ich eigene oder feingetunte Modelle betreiben?

Ja, im Deploy-Tarif. Sie laden Ihre Modellgewichte hoch, wählen den GPU-Typ (z. B. H100 oder L40S), und Ihr Modell läuft auf vLLM im österreichischen Rechenzentrum — erreichbar über dieselbe /v1/chat/completions-API. Scale-to-zero: Bei Inaktivität fallen keine GPU-Kosten an.

Wie wird abgerechnet?

Nutzungsbasiert und transparent: 5 % Aufschlag auf den tatsächlichen Provider-Verbrauch (Preise in Euro pro Million Tokens), plus fixe Monatsgebühr je nach Modul. Custom-Deployments werden sekundengenau nach GPU-Zeit abgerechnet. Alle Preise zzgl. USt.

Wann startet der Dienst?

Wir schalten den Zugang gestaffelt über die Warteliste frei. Tragen Sie sich ein — Frühzugangs-Kunden erhalten bevorzugten Zugang und Early-Access-Konditionen.

Warteliste

Sichern Sie sich Frühzugang.

Wir schalten den Zugang gestaffelt frei. Tragen Sie sich ein — Sie erhalten Antwort von einem Menschen, keinem Automaten.

Ihre Angaben verwenden wir ausschließlich zur Kontaktaufnahme im Rahmen des Frühzugangsprogramms. Details in der Datenschutzerklärung.

Keine Newsletter, keine Weitergabe. Details in der Datenschutzerklärung.