Eine OpenAI-kompatible API zu Open-Weights-Modellen auf eigener Hardware in Österreich. Aliase, die Policy tragen. Datenschutz in Stufen — bis hin zu einer LLM-gestützten Prüfinstanz. Und jede Zahl auf dieser Seite ist nächtlich gemessen, nicht versprochen.
Deine Anwendung spricht mit einem Namen. Was dahinter passiert — welches Modell, welcher Anbieter, wie viel Datenschutz — konfigurierst du hier und änderst es jederzeit, ohne eine Zeile Code anzufassen. Probier es aus:
Open-Weights-Modelle auf Hardware, die uns gehört — in Oberösterreich. Keine Sub-Prozessoren, keine Drittländer, kein Weiterverkauf fremder APIs.
Ein Alias bündelt Modell, Anbieter und Policy. Er zeigt auf unsere Modelle — oder mit deinem eigenen Key nach außen. Modell wechseln heißt: hier umstellen, sonst nichts.
Pro Alias in Stufen: Namen, Adressen, IBANs — und API-Keys, Tokens und Zugangsdaten, die versehentlich im Prompt landen. Raus geht nur, was raus darf.
Das Smarte war nie das Modell. Es ist das drumherum: Routing, Policy, Datenschutz, Nachweis.
Ein Alias ist mehr als ein Modellname — er bündelt Modell, Provider und Datenschutz-Policy. Modell zentral tauschen, deine Anwendung ändert sich nie.
Mask, pseudonymize oder strikt: eine LLM auf eigener Hardware prüft zusätzlich auf indirekte Kennungen, bevor irgendwas die EU verlässt.
Eigene Hardware in Österreich. Keine Sub-Prozessoren, keine Drittländer. Externe Frontier-Modelle sind erreichbar — aber nur durch die Masking-Schicht.
Nächtliche Benchmarks mit veröffentlichter Methodik. Detection-Recall der Privacy-Schicht als Zahl, nicht als Adjektiv.
Wenn deine Software OpenAI spricht, spricht sie schon ALLSmartLLM. Eine URL ändern.
10 Mio. Tokens gratis zum Testen und Einrichten. Keine Karte, kein Abo.
Ein Key, alle Modelle, alle Aliase. Nutzungsbasiert, sonst nichts.
Ruf einen Alias auf, keine Modellversion. Datenschutz ist ein Parameter.
curl https://api.smartllm.at/v1/chat/completions \ -H "Authorization: Bearer $KEY" \ -d '{ "model": "frontier", "privacy": {"mode": "pseudonymize"}, "messages": [...] }'
Später auf eigener Hardware: gleiche API auf deiner Hardware. Sobald deine Box läuft, änderst du eine URL — fertig.
Geprüft, gebenchmarkt, aktuell gehalten. Aliase folgen unserer Empfehlung — oder du pinnst eine Version fest.
| Modell | Alias | Kontext | Gemessen | Status |
|---|---|---|---|---|
| Qwen 3.5 397B | frontier | 256K | 26.5 t/s | geladen |
| Nemotron 3 Omni | — | 128K | 39.9 t/s | on-demand |
| Nemotron Cascade 2 | — | 256K | 40.2 t/s | on-demand |
| Phi 4 | — | 16K | — | on-demand |
| Qwen 3.6 35B | mid vision coder | 32K | 53.5 t/s | geladen |
Alle Modelle, ein Preis. 10 Mio. Tokens gratis. Keine Grundgebühr, kein Abo — nur Nutzung.