Inferenz in Deutschland
Zero Retention Policy
Flexibel und skalierbar
Bereit für Berufsgeheimnisträger
Wann sich ein zweiter Inferenzpfad lohnt
1. Enterprise-Deal hängt an Datenschutz, IT-Security oder Kanzlei-IT
Die Lösung: Inferenz in Deutschland mit Zero Retention und No Training Policy, definierter Vertragskette, AVV und zusätzlicher §203-Vereinbarung.
2. Das Produkt ist an einen Modellanbieter gebunden
Die Lösung: OpenAI-/Anthropic-kompatible Schnittstellen und mehrere Open-Weight-Modelle als alternative Failover- oder Produktionsschiene.
3. Frontier-Modelle machen hochvolumige Workloads zu teuer
Die Lösung: Unterschiedliche Modelle für Reasoning, Extraktion, Klassifikation oder Dokumentenanalyse statt ein teures Modell für jeden Request.
4. Kunden benötigen unterschiedliche Modelle, Budgets oder Compliance-Pfade
Die Lösung: Einfach administrierbare Plattform mit separaten API-Keys, Modellrestriktionen und Budgets pro Anwendung oder Kunde.
Einfache Vertragskette für kritische Kunden
Deutschland-Hosting ist kein Selbstzweck und keine pauschale gesetzliche Voraussetzung. Der Vorteil liegt in einer einfachen Vertragskette. Das kann Legal-Tech-Unternehmen dabei unterstützen, Kanzleien und anderen Berufsgeheimnisträgern einen klar abgegrenzten Inferenzpfad anzubieten.
Keine dauerhafte Speicherung
Prompts, Eingaben und generierte Antworten werden von AKI.IO flüchtig während der Inferenz verarbeitet und nicht dauerhaft gespeichert oder für Modelltraining verwendet.
Kein Modellhersteller im Inferenzpfad
AKI.IO betreibt Open-Weight-Modelle innerhalb der eigenen Inferenzumgebung, ohne Modellhersteller im Inferenzpfad, Hyperscaler oder Routing auf Dritte.
Datenverarbeitung in Deutschland
Die Datenverarbeitung und die eingesetzte Infrastruktur werden nach DSGVO vertraglich über die Vereinbarung zur Auftragsverarbeitung geregelt.
Bereit für §203-Anwendungsfälle
Für Anwendungen mit Anforderungen aus §203 StGB stellt AKI.IO eine zusätzliche vertragliche Vereinbarung bereit.
Mit dem bestehenden Stack testen
Gib deinem Coding-Agenten diesen Auftrag oder passe bei einer bestehenden OpenAI-/Anthropic-Integration Endpoint und API-Key an.
Integrate AKI.IO as the inference provider for this project.
Follow the integration instructions at:
https://aki.io/docs/compatibility/for-ai-coding-agents/
Inspect the existing OpenAI or Anthropic integration and make only the necessary changes.
Security:
- Never hardcode, print, log, or commit API keys or other secrets.
- Store the AKI.IO API key in an environment variable.
- Keep .env files out of Git and use placeholders in .env.example.
- Never expose existing secrets you encounter in the repository.
Preserve existing prompts, tools, streaming, error handling, and application behavior where possible.Klarheit für vertrauliche Legal-Tech-Anwendungen
Legal-Tech-Gründer wissen: Spätestens im Enterprise-Vertrieb wird die Inferenzinfrastruktur Teil des Produkts. IT-Sicherheit, Einkauf, Datenschutz und Kanzlei-IT wollen wissen:
- Wo werden Mandantendaten verarbeitet?
- Wer kann Prompts und generierte Antworten sehen?
- Erhält der Modellhersteller die Inhalte?
- Welche Dienstleister sind an der Verarbeitung beteiligt?
- Werden Daten außerhalb der EU verarbeitet?
- Was passiert mit den Inhalten nach Abschluss einer Anfrage?
AKI.IO bietet für solche Anforderungen einen klar beschreibbaren Inferenzpfad. Geeignet für Legal-Tech-Anwendungen, bei denen ein Open-Weight-Modell wirtschaftlich sinnvoller ist oder ein anderer Inferenzpfad benötigt wird.

Nicht jeder Request braucht das teuerste Modell.
Leistungsfähige Modelle dort, wo komplexes Reasoning erforderlich ist – und wirtschaftlichere Modelle für Extraktion, Klassifikation, strukturierte Antworten oder hochvolumige Dokumentenverarbeitung.
Was bedeutet das in einem echten Legal-Tech-Workflow?
Anwendungsfall: Ein Mandant lädt einen Schriftsatz hoch. Das Legal-Tech-System extrahiert den Text und erstellt daraus eine strukturierte Zusammenfassung mit Sachverhalt, Forderungen, Argumenten, Fristen und offenen Punkten.
Illustrative Tokenmenge pro Vorgang
Kosten pro Vorgang per Modell bei 50.000 Vorgängen
*: Claude Sonnet 5 API-Listenpreise von Anthropic, $2 Input / $10 Output je 1 Mio. Tokens; zur Vergleichbarkeit in Euro umgerechnet. Preise ohne Steuern, ohne Caching und ohne Volumenrabatte.
Häufige Fragen
AKI.IO ist eine Inferenz-API, die Zugriff auf kuratierte Open-Weight-Modelle für sicherheitskritische und vertrauliche Workloads bietet. Die Inferenz läuft auf europäischer Infrastruktur mit Zero Retention Policy, ohne auf die Infrastruktur von Hyperscalern zurückzugreifen.
Bei einer bestehenden OpenAI-kompatiblen Integration ist der Aufwand gering. Einfach API-Key erstellen und einen bestehenden Anwendungsfall mit einem AKI.IO-Modell ausführen.
Nein, nach unserer Zero Retention Policy werden Inferenzinhalte nicht dauerhaft protokolliert oder gespeichert und nicht für Modelltraining verwendet.
AKI.IO verarbeitet Inferenz auf GPU-Infrastruktur in deutschen Rechenzentren. Dabei werden keine Hyperscaler und kein externer Drittanbieter-Router eingesetzt.
Nein, die Open-Weight-Modelle werden innerhalb der AKI.IO-Inferenzumgebung ausgeführt. Die Anfrage muss deshalb nicht zur Verarbeitung an den jeweiligen Modellhersteller weitergeleitet werden.
Ja, wir stellen für entsprechende Anwendungsfälle eine zusätzliche §203-Vereinbarung bereit. Ob eine konkrete Gesamtlösung sämtliche berufsrechtlichen und gesetzlichen Anforderungen erfüllt, hängt vom jeweiligen Einsatzfall und der gesamten Verarbeitungskette ab.
Ja. Separate API-Keys, Modellzugriffsregeln und Budgets ermöglichen es, Kunden oder Anwendungen organisatorisch und wirtschaftlich voneinander zu trennen.
Ja, ihr könnt leistungsfähigere Modelle für komplexe Aufgaben und wirtschaftlichere Modelle für einfachere oder hochvolumige Anwendungen einsetzen. Alles über die AKI.IO-API einfach einzubinden.