smartllm

Die smarte Schicht über dem Modell

Eine OpenAI-kompatible API zu Open-Weights-Modellen auf eigener Hardware in Österreich. Aliase, die Policy tragen. Datenschutz in Stufen — bis hin zu einer LLM-gestützten Prüfinstanz. Und jede Zahl auf dieser Seite ist nächtlich gemessen, nicht versprochen.

nightly-benchmark bench.smartllm — live datasheet
0
Tokens ausgeliefert
0
Gemessener Durchsatz, bis zu
0
Open-Weights-Modelle
0
Daten bleiben in der EU
Nächtlich gemessen mit veröffentlichter Methodik. Median wiederholter Läufe, Warm-up verworfen.
was das hier ist

Eine Schicht, die alles an einer Stelle organisiert

Deine Anwendung spricht mit einem Namen. Was dahinter passiert — welches Modell, welcher Anbieter, wie viel Datenschutz — konfigurierst du hier und änderst es jederzeit, ohne eine Zeile Code anzufassen. Probier es aus:

deine Anwendung
big-fat-model
unverändert in deinem Code
ALLSmartLLM
Ziel
  • eigene Modelle
  • OpenRouter · dein Key
aufgelöst auf Qwen 3.5 · 397B
Datenschutz
  • aus
  • pseudonymize
  • strict
nicht nötig — Prompt verlässt das Haus nicht
eigene Hardware · AT
15 Open-Weights-Modelle in Oberösterreich. Prompt endet auf Hardware, die uns gehört.
OpenRouter · dein Key
Dein Vertrag, dein Schlüssel. Verlässt die EU nur durch die Maskierung.
Was deine App schickt
Bitte antworte Herrn Huber, dem Bürgermeister von Musterstadt,
von der Bauer GmbH zu Rechnung 2026-0417,
Konto AT61 1904 3002 3457 3201.
API-Key für den Import: sk-live-9f2ac41b8e
Was das Zielmodell sieht — eigene Hardware
Bitte antworte Herrn Huber, dem Bürgermeister von Musterstadt,
von der Bauer GmbH zu Rechnung 2026-0417,
Konto AT61 1904 3002 3457 3201.
API-Key für den Import: sk-live-9f2ac41b8e
Unverändert — der Prompt bleibt auf unserer Hardware in Österreich.
01

Eigene Inferenz

Open-Weights-Modelle auf Hardware, die uns gehört — in Oberösterreich. Keine Sub-Prozessoren, keine Drittländer, kein Weiterverkauf fremder APIs.

15 Modelle · nächtlich gemessen · Betreiber sitzt in Wels
02

Ein Name, jedes Modell

Ein Alias bündelt Modell, Anbieter und Policy. Er zeigt auf unsere Modelle — oder mit deinem eigenen Key nach außen. Modell wechseln heißt: hier umstellen, sonst nichts.

frontier · big-fat-model · extern erlaubt
03

Datenschutz zuschaltbar

Pro Alias in Stufen: Namen, Adressen, IBANs — und API-Keys, Tokens und Zugangsdaten, die versehentlich im Prompt landen. Raus geht nur, was raus darf.

mask · pseudonymize · strict mit LLM-Prüfung auf eigener HW
schicht

Inferenz ist das Rohmaterial. Das hier ist die Schicht, die daraus etwas Brauchbares macht.

Das Smarte war nie das Modell. Es ist das drumherum: Routing, Policy, Datenschutz, Nachweis.

Eine API, deine Aliase

Ein Alias ist mehr als ein Modellname — er bündelt Modell, Provider und Datenschutz-Policy. Modell zentral tauschen, deine Anwendung ändert sich nie.

big-fat-model ──► kimi-k3 kimi-k3.1
// Alias aktualisiert · null Code-Änderungen · Apps laufen weiter

Datenschutz in Stufen

Mask, pseudonymize oder strikt: eine LLM auf eigener Hardware prüft zusätzlich auf indirekte Kennungen, bevor irgendwas die EU verlässt.

mask pseudonymize strict
Bitte antworte an <<PERSON_1>> von <<ORG_1>> wegen Rechnung <<IBAN_1>>
Mapping lebt nur im Request-Speicher. Nie gespeichert, nie geloggt.

Deine Daten bleiben in Europa

Eigene Hardware in Österreich. Keine Sub-Prozessoren, keine Drittländer. Externe Frontier-Modelle sind erreichbar — aber nur durch die Masking-Schicht.

deine App ──► ALLSmartLLM · AT ─▍ Drittland
Prompts enden auf Hardware, die uns gehört — oder gehen maskiert raus, nach deiner Policy.

Gemessen, nicht versprochen

Nächtliche Benchmarks mit veröffentlichter Methodik. Detection-Recall der Privacy-Schicht als Zahl, nicht als Adjektiv.

Qwen 3.5 397B
26.5 t/s
Nemotron 3 Omni
39.9 t/s
Nemotron Cascade 2
40.2 t/s
Decode-Rate, Streaming, Median wiederholter nächtlicher Läufe.
start

Erste Antwort in unter fünf Minuten

Wenn deine Software OpenAI spricht, spricht sie schon ALLSmartLLM. Eine URL ändern.

Schritt 1

Account anlegen

10 Mio. Tokens gratis zum Testen und Einrichten. Keine Karte, kein Abo.

Gratis-Tokens10.000.000
Schritt 2

API-Key holen

Ein Key, alle Modelle, alle Aliase. Nutzungsbasiert, sonst nichts.

SMARTLLM_API_KEY••••••••••••
Schritt 3

Ersten Request senden

Ruf einen Alias auf, keine Modellversion. Datenschutz ist ein Parameter.

curl https://api.smartllm.at/v1/chat/completions \
  -H "Authorization: Bearer $KEY" \
  -d '{
    "model": "frontier",
    "privacy": {"mode": "pseudonymize"},
    "messages": [...]
  }'

Später auf eigener Hardware: gleiche API auf deiner Hardware. Sobald deine Box läuft, änderst du eine URL — fertig.

modelle

Kuratierte Open-Weights-Modelle

Geprüft, gebenchmarkt, aktuell gehalten. Aliase folgen unserer Empfehlung — oder du pinnst eine Version fest.

Modell Alias Kontext Gemessen Status
Qwen 3.5 397B frontier 256K 26.5 t/s geladen
Nemotron 3 Omni 128K 39.9 t/s on-demand
Nemotron Cascade 2 256K 40.2 t/s on-demand
Phi 4 16K on-demand
Qwen 3.6 35B mid vision coder 32K 53.5 t/s geladen
15 Modelle · alle auf dedizierter Hardware in Oberösterreich Alle Modelle & nächtliche Benchmarks anzeigen →
preise

8 € pro Million Tokens. Das ist die Preisseite.

Alle Modelle, ein Preis. 10 Mio. Tokens gratis. Keine Grundgebühr, kein Abo — nur Nutzung.