KI-Inferenz für Legal Tech in Deutschland

KI-Inferenz für Legal Tech in Deutschland

Open-Weight-Modelle auf deutscher Infrastruktur für vertrauliche Legal-Tech-Anwendungen. Zero Retention, keine Hyperscaler und kein Drittanbieter-Routing – mit zusätzlicher Vereinbarung für § 203-Anwendungsfälle.

Inferenz-Stack mit einem Gründer prüfen!

Einfach Terminwunsch per E-Mail senden

Inferenz in Deutschland

Zero Retention Policy

Flexibel und skalierbar

Bereit für Berufsgeheimnisträger

Wann sich ein zweiter Inferenzpfad lohnt

1. Enterprise-Deal hängt an Datenschutz, IT-Security oder Kanzlei-IT

Die Lösung: Inferenz in Deutschland mit Zero Retention und No Training Policy, definierter Vertragskette, AVV und zusätzlicher §203-Vereinbarung.

2. Das Produkt ist an einen Modellanbieter gebunden

Die Lösung: OpenAI-/Anthropic-kompatible Schnittstellen und mehrere Open-Weight-Modelle als alternative Failover- oder Produktionsschiene.

3. Frontier-Modelle machen hochvolumige Workloads zu teuer

Die Lösung: Unterschiedliche Modelle für Reasoning, Extraktion, Klassifikation oder Dokumentenanalyse statt ein teures Modell für jeden Request.

4. Kunden benötigen unterschiedliche Modelle, Budgets oder Compliance-Pfade

Die Lösung: Einfach administrierbare Plattform mit separaten API-Keys, Modellrestriktionen und Budgets pro Anwendung oder Kunde.

Einfache Vertragskette für kritische Kunden

Deutschland-Hosting ist kein Selbstzweck und keine pauschale gesetzliche Voraussetzung. Der Vorteil liegt in einer einfachen Vertragskette. Das kann Legal-Tech-Unternehmen dabei unterstützen, Kanzleien und anderen Berufsgeheimnisträgern einen klar abgegrenzten Inferenzpfad anzubieten.

Keine dauerhafte Speicherung

Prompts, Eingaben und generierte Antworten werden von AKI.IO flüchtig während der Inferenz verarbeitet und nicht dauerhaft gespeichert oder für Modelltraining verwendet.

Kein Modellhersteller im Inferenzpfad

AKI.IO betreibt Open-Weight-Modelle innerhalb der eigenen Inferenzumgebung, ohne Modellhersteller im Inferenzpfad, Hyperscaler oder Routing auf Dritte.

Datenverarbeitung in Deutschland

Die Datenverarbeitung und die eingesetzte Infrastruktur werden nach DSGVO vertraglich über die Vereinbarung zur Auftragsverarbeitung geregelt.

Bereit für §203-Anwendungsfälle

Für Anwendungen mit Anforderungen aus §203 StGB stellt AKI.IO eine zusätzliche vertragliche Vereinbarung bereit.

Mit dem bestehenden Stack testen

Gib deinem Coding-Agenten diesen Auftrag oder passe bei einer bestehenden OpenAI-/Anthropic-Integration Endpoint und API-Key an.

Kostenloser API Key
Integrate AKI.IO as the inference provider for this project.

Follow the integration instructions at:
https://aki.io/docs/compatibility/for-ai-coding-agents/

Inspect the existing OpenAI or Anthropic integration and make only the necessary changes.

Security:
- Never hardcode, print, log, or commit API keys or other secrets.
- Store the AKI.IO API key in an environment variable.
- Keep .env files out of Git and use placeholders in .env.example.
- Never expose existing secrets you encounter in the repository.

Preserve existing prompts, tools, streaming, error handling, and application behavior where possible.

Klarheit für vertrauliche Legal-Tech-Anwendungen

Legal-Tech-Gründer wissen: Spätestens im Enterprise-Vertrieb wird die Inferenzinfrastruktur Teil des Produkts. IT-Sicherheit, Einkauf, Datenschutz und Kanzlei-IT wollen wissen:

  • Wo werden Mandantendaten verarbeitet?
  • Wer kann Prompts und generierte Antworten sehen?
  • Erhält der Modellhersteller die Inhalte?
  • Welche Dienstleister sind an der Verarbeitung beteiligt?
  • Werden Daten außerhalb der EU verarbeitet?
  • Was passiert mit den Inhalten nach Abschluss einer Anfrage?

AKI.IO bietet für solche Anforderungen einen klar beschreibbaren Inferenzpfad. Geeignet für Legal-Tech-Anwendungen, bei denen ein Open-Weight-Modell wirtschaftlich sinnvoller ist oder ein anderer Inferenzpfad benötigt wird.

Alle Dokumente für den Security-Review

Reseller-Rahmenvertrag auf Anfrage: sales@aki.io. Individualvertragliche Regelungen möglich.

Nicht jeder Request braucht das teuerste Modell.

Leistungsfähige Modelle dort, wo komplexes Reasoning erforderlich ist – und wirtschaftlichere Modelle für Extraktion, Klassifikation, strukturierte Antworten oder hochvolumige Dokumentenverarbeitung.

GLM 5.3

IN €1,00 | CACHE €0,25 | OUT €3,50

Frontier-Modell für komplexe Coding-Aufgaben und lange mehrstufige Prozesse.

DeepSeek V4 Flash

IN €0,20 | CACHE €0,10 | OUT €0,50

Für lange Kontexte, Reasoning, komplexes Tool Calling und Agenten.

Qwen 3.8 27B

IN €0,30 | CACHE €0,10 | OUT €2,20

Für professionelle Wissensarbeit, Recherche und lange agentische Aufgaben.

Gemma 4 26B

IN €0,10 | OUT €0,50

Für Dokumentenanalyse, multimodale Verarbeitung und strukturierte Anwendungen

Was bedeutet das in einem echten Legal-Tech-Workflow?

Anwendungsfall: Ein Mandant lädt einen Schriftsatz hoch. Das Legal-Tech-System extrahiert den Text und erstellt daraus eine strukturierte Zusammenfassung mit Sachverhalt, Forderungen, Argumenten, Fristen und offenen Punkten.

Illustrative Tokenmenge pro Vorgang

Schriftsatz + Systemprompt + Instruktionen
5.000 Input Tokens
strukturierte Zusammenfassung
2.000 Output Tokens

Kosten pro Vorgang per Modell bei 50.000 Vorgängen

Claude Sonnet 5*
ca 2.100 €
GLM 5.3 (AKI.IO)
ca 1.100 €
Qwen 3.8 27B (AKI.IO)
ca 445 €

*: Claude Sonnet 5 API-Listenpreise von Anthropic, $2 Input / $10 Output je 1 Mio. Tokens; zur Vergleichbarkeit in Euro umgerechnet. Preise ohne Steuern, ohne Caching und ohne Volumenrabatte.

Jetzt API-Key sichern und AKI.IO kostenlos testen!

Häufige Fragen

Was ist AKI.IO?

AKI.IO ist eine Inferenz-API, die Zugriff auf kuratierte Open-Weight-Modelle für sicherheitskritische und vertrauliche Workloads bietet. Die Inferenz läuft auf europäischer Infrastruktur mit Zero Retention Policy, ohne auf die Infrastruktur von Hyperscalern zurückzugreifen.

Wie aufwendig ist ein technischer Test?

Bei einer bestehenden OpenAI-kompatiblen Integration ist der Aufwand gering. Einfach API-Key erstellen und einen bestehenden Anwendungsfall mit einem AKI.IO-Modell ausführen.

Speichert AKI.IO Prompts oder generierte Antworten?

Nein, nach unserer Zero Retention Policy werden Inferenzinhalte nicht dauerhaft protokolliert oder gespeichert und nicht für Modelltraining verwendet.

Wo findet die Inferenz statt?

AKI.IO verarbeitet Inferenz auf GPU-Infrastruktur in deutschen Rechenzentren. Dabei werden keine Hyperscaler und kein externer Drittanbieter-Router eingesetzt.

Erhalten die Modellhersteller unsere Prompts?

Nein, die Open-Weight-Modelle werden innerhalb der AKI.IO-Inferenzumgebung ausgeführt. Die Anfrage muss deshalb nicht zur Verarbeitung an den jeweiligen Modellhersteller weitergeleitet werden.

Ist AKI.IO für §203-Anwendungsfälle geeignet?

Ja, wir stellen für entsprechende Anwendungsfälle eine zusätzliche §203-Vereinbarung bereit. Ob eine konkrete Gesamtlösung sämtliche berufsrechtlichen und gesetzlichen Anforderungen erfüllt, hängt vom jeweiligen Einsatzfall und der gesamten Verarbeitungskette ab.

Können wir einzelne Kunden über AKI.IO betreiben?

Ja. Separate API-Keys, Modellzugriffsregeln und Budgets ermöglichen es, Kunden oder Anwendungen organisatorisch und wirtschaftlich voneinander zu trennen.

Können wir unterschiedliche Modelle für unterschiedliche Aufgaben einsetzen?

Ja, ihr könnt leistungsfähigere Modelle für komplexe Aufgaben und wirtschaftlichere Modelle für einfachere oder hochvolumige Anwendungen einsetzen. Alles über die AKI.IO-API einfach einzubinden.