FutureWay AI
OpenAI-kompatibel · EU-gehostet

Eine OpenAI-kompatible API. Auf europäischen Modellen.

Basis-URL und Key austauschen — Ihr Code bleibt. Das Chat-Completions-Format ist der De-facto-Standard, also laufen vorhandene SDKs, CLI-Werkzeuge und Editor-Integrationen unverändert weiter, nur eben gegen EU-Infrastruktur.

In drei Schritten zum ersten Call

Kein Onboarding-Ticket, kein Vertrieb dazwischen: Key erstellen, Basis-URL setzen, losschicken.

  1. 1Key erstellen
    Persönliche API-Keys verwalten Sie in der Plattform unter „Einstellungen → API & CLI“ — erstellen, rotieren und widerrufen im Self-Service. Ein Key gilt ausschließlich für Ihre eigene Organisation.
  2. 2Basis-URL setzen
    Richten Sie Ihren vorhandenen OpenAI-Client auf unsere Basis-URL und legen Sie den Key in die Umgebungsvariable FUTUREWAY_API_KEY — nicht in den Quellcode.
  3. 3Ersten Call schicken
    Als „model“ geben Sie einen Modell-Alias an — fertig. Weiter unten stehen fertige Snippets für curl, Python und JavaScript.

Basis-URL und OpenAI-Kompatibilität

Ein Endpunkt, ein Standardformat. Was Sie heute gegen OpenAI schreiben, läuft hier weiter.

Basis-URL

https://api.futureway.ai/v1

Weitere Pfade hängen die Clients selbst an: /chat/completions, /embeddings und /models.

Warum das kompatibel bleibt
Das Chat-Completions-Format von OpenAI hat sich als De-facto-Standard etabliert — nahezu jede KI-Bibliothek und jedes Werkzeug spricht es. Deshalb genügt der Wechsel von Basis-URL und Key: offizielle SDKs, Terminal-Agenten wie OpenCode und Editor-Integrationen laufen unverändert weiter. Kein Lock-in in Ihrem Code.

Endpunkte

Drei Endpunkte — mehr braucht es nicht.

EndpunktWofür
POST /v1/chat/completionsAntworten erzeugen — am Stück oder gestreamt, je nach Modell mit Tool-Calling und Bildeingabe.
POST /v1/embeddingsText in Vektoren umwandeln, etwa für eigene Suche, Klassifikation und Ähnlichkeitsvergleiche.
GET /v1/modelsAuflisten, welche Modell-Aliase Ihr Key aufrufen darf.

Das ist die vollständige v1-Oberfläche. Audio-Transkription gehört bewusst nicht dazu: Sie läuft in der Plattform, nicht über Kunden-Keys.

Modell-Aliase

Sie rufen stabile Produkt-Aliase auf statt roher Modell-IDs.

AliasModellVerarbeitungKontextFähigkeiten
futureway-fastChatMistral Small 3.2 24B InstructParis, FR 🇪🇺128.000 TokensBilderTools
futureway-smartChatMistral Medium 3.5 128BParis, FR 🇪🇺180.000 TokensBilderTools
futureway-bigthinkChatQwen3.5 397B A17BParis, FR 🇪🇺250.000 TokensBilderTools
futureway-embedEmbeddingQwen3 Embedding 8B (1024 dim)Paris, FR 🇪🇺

Warum Aliase statt Modellnamen?

Modelle werden abgelöst, Aliase bleiben. Tauschen wir ein Modell gegen ein besseres, zeigt derselbe Alias auf das neue — Ihre Integration bricht nicht, und Sie müssen keine Modell-ID im Code nachziehen. Welches Modell aktuell hinter einem Alias steht, sehen Sie in der Tabelle oben und jederzeit über /v1/models.

Beispiel-Code

Dieselben Aufrufe in drei Sprachen — kopieren, Key setzen, ausführen.

Chat Completions

curl https://api.futureway.ai/v1/chat/completions \
  -H "Authorization: Bearer $FUTUREWAY_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "futureway-smart",
    "messages": [
      { "role": "user", "content": "Was ist die Hauptstadt von Frankreich?" }
    ]
  }'

Embeddings

curl https://api.futureway.ai/v1/embeddings \
  -H "Authorization: Bearer $FUTUREWAY_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "futureway-embed",
    "input": "Dein Text hier."
  }'

Modelle auflisten

curl https://api.futureway.ai/v1/models \
  -H "Authorization: Bearer $FUTUREWAY_API_KEY"

FUTUREWAY_API_KEY ist eine Umgebungsvariable, kein Beispiel-Key: Legen Sie Ihren eigenen Key dort ab, statt ihn in den Quellcode zu schreiben.

Fehlercodes

Zwei Antworten, die Sie im Betrieb tatsächlich sehen — und was jeweils zu tun ist. Beachten Sie, dass 429 zwei verschiedene Ursachen hat.

CodeBedeutungZu tun
401Der Key fehlt, ist ungültig oder wurde widerrufen.Den Authorization-Header prüfen; falls der Key widerrufen wurde, in der Key-Verwaltung einen neuen erstellen.
429Das Nutzungskontingent Ihrer Organisation ist aufgebraucht. Der Fehlertext lautet „budget_exceeded“ — daran unterscheiden Sie diesen Fall vom Rate-Limit.Warten Sie auf die nächste Abrechnungsperiode oder heben Sie das Kontingent an. Ein erneuter Versuch hilft hier nicht: Bis zum Zurücksetzen nehmen die Keys keine Anfragen mehr an.
429Zu viele Anfragen in kurzer Zeit. Ohne „budget_exceeded“ im Fehlertext ist es das Rate-Limit.Kurz warten und mit exponentiellem Backoff erneut senden. 429 deckt auch kurzfristige Lastspitzen am Gateway ab, nicht nur Ihr eigenes Limit.

Rate-Limits

Betriebsgrenzen, kein Funktionsunterschied zwischen den Stufen: Sie schützen das Gateway vor Lastspitzen. Stand heute gilt:

  • 60 Anfragen pro Minute im Standard.
  • 300 Anfragen pro Minute auf der Stufe Ultra.

Diese Werte können wir anpassen, wenn der Betrieb es erfordert — sie sind kein zugesichertes Leistungsmerkmal. Wenn Sie dauerhaft mehr brauchen, sprechen Sie uns an.

KI-Verarbeitung zu 100 % in der EU

Jeder Aufruf über diese API wird auf europäischer Infrastruktur verarbeitet — die Modelle hinter den Aliasen laufen in Paris, Frankreich. Kein Umweg über US-Rechenzentren, auch nicht im Hintergrund.

Welche Subprozessoren im Einzelnen beteiligt sind, steht vollständig im Auftragsverarbeitungsvertrag und in den Einstellungen der Plattform.

Mehr zur EU-Souveränität

Bereit, Ihre KI-Infrastruktur nach Europa zu holen?

In wenigen Minuten startklar — 14 Tage kostenlos testen, ohne Kreditkarte.

Wir starten in Kürze — sichern Sie sich einen der ersten Plätze.

Diese Website nutzt keine Cookies und erstellt keine Nutzerprofile — darum gibt es hier auch keinen Cookie-Banner. Die anonyme Reichweitenmessung läuft auf unseren eigenen Servern in Deutschland, ohne Analyse-Dienst.

Mehr erfahren