Die Akumi Inference API ist OpenAI-kompatibel und wird auf EU-Infrastruktur betrieben. Ändern Sie eine base_url und Ihr bestehender Code läuft auf EU-ansässigen Modellen: Chat, Tools, Streaming und strukturierte Ausgaben, abgerechnet pro Nutzung und auditiert ab dem ersten Token.
POST https://api.akumi.cloud/v1/chat/completions
Kein neues SDK, kein Umschreiben, kein Migrationsprojekt. Behalten Sie den OpenAI-Client, mit dem Sie bereits arbeiten, richten Sie ihn auf Akumi aus und fügen Sie Ihren Key ein. Chat, Function Calling, Streaming und JSON-Modus verhalten sich exakt wie bisher, jetzt auf EU-ansässigen Modellen mit einer gemeinsamen Abrechnung.
Endpunkte, Request-Bodies und Responses entsprechen der OpenAI API, sodass die Libraries, Frameworks und Tools, die Sie bereits nutzen, einfach funktionieren.
POST /v1/chat/completions mit der vollständigen Nachrichten- und Parameteroberfläche, die Sie bereits senden.
Token-für-Token Server-Sent Events, dieselbe Antwort wie bei stream=true.
Definieren Sie Tools, lassen Sie das Modell sie aufrufen und steuern Sie mit tool_choice. Tool-Inhalte werden ebenfalls geregelt.
response_format mit einem JSON-Schema für zuverlässige, typisierte Antworten, auf die Ihr Code sich verlassen kann.
POST /v1/embeddings auf EU-gehosteten Modellen für Suche, Clustering und Retrieval.
Ein nativer Endpunkt, wenn Sie die vollständige Akumi-Pipeline-Antwort mit Residenz- und Modulinformationen benötigen.
Anfragen werden auf EU-Infrastruktur bedient. Inferenz und Speicherung bleiben in der EU, ohne Exposition gegenüber dem US CLOUD Act.
Routing zu einem Nicht-EU-Modell ist gesperrt, sofern Sie es nicht explizit erlauben, mit personenbezogenen Daten, die pseudonymisiert werden, bevor sie die EU verlassen.
Jede Anfrage wird abgerechnet und in einem metadatenbasierten Audit-Trail mit Modell, Region und Modulen erfasst. Übergeben Sie dem Compliance-Team das Log.
Der Model Router stellt jedes Modell hinter derselben base_url bereit. Wählen Sie ein EU-souveränes Modell oder erlauben Sie ein externes unter einer Richtlinie. Legen Sie Routing-Regeln und automatisches Fallback fest und bringen Sie Ihre eigenen Provider-Keys mit.
Basis-Inferenz wird pro Token und Anfrage abgerechnet. Jedes Governance-Modul, das Sie aktivieren, wird in einer eigenen Position abgerechnet, sodass die Rechnung genau das widerspiegelt, was die Plattform tatsächlich geleistet hat. Keine Seats, keine Mindestmengen, keine überraschenden Tarifstufen.
Basis-Inferenz wird auf Basis der tatsächlichen Nutzung abgerechnet und aus vorausbezahlten Credits entnommen.
PII firewall, RAG, Memory, Guard und Cache werden bei Nutzung jeweils separat abgerechnet.
Ein einzelnes Credit-Ledger mit detaillierten Positionen, exportierbar für Finanzen und Compliance.
base_url.Erstellen Sie einen Key, richten Sie Ihren Client auf Akumi aus und betreiben Sie heute EU-souveräne Modelle.
We use privacy-friendly, EU-hosted analytics to understand how Akumi is used. Accept analytics cookies, or continue without them. See our cookie policy.