Souveräne KI · Lokale Sprachmodelle · ADVISORI

Lokale KI für Unternehmen,in Europa gehostet.Ihre Daten bleiben bei Ihnen.

Sofort verfügbar per API: Leistung auf Augenhöhe mit den Top-US-Modellen, zu einem Bruchteil der Kosten.

Betrieben in unseren eigenen Rechenzentren in Berlin, Frankfurt, Wien, Zürich und Bozen. Kein CLOUD Act, kein Kill-Switch, kein Abfluss Ihrer Daten.

0,0×
günstiger als Frontier-API-Preise
5
Standorte: Berlin · Frankfurt · Wien · Zürich · Bozen · bald: Hamburg. Oder bei Ihnen
Sofort
einsatzbereit per API, kein Einführungsprojekt
0
Datenweitergabe an US-Modellanbieter
Souveränitäts-Ticker
16.07. Kimi K3 debütiert auf Platz 3 der Weltrangliste, direkt hinter Fable 5 und GPT-5.6; die offenen Gewichte sind seit 27.07. verfügbar, das Modell läuft bei uns im Katalog12.06. US-Regierung schaltet Claude Fable 5 weltweit ab, 19 Tage offline, für alle Kunden30.06. USA geben Fable 5 wieder frei, gegen dauerhafte Auflagen: künftige Modell-Releases nur noch in Abstimmung mit der US-Regierung08.07. Fable 5 nur noch gegen Credits: 10 $ / 50 $ pro Mio. Tokens, das teuerste Anthropic-Modell aller Zeiten26.06. GPT-5.6 startet nur für ~20 regierungsgeprüfte Partner, Washington entscheidet, wer Frontier-KI bekommt29.06. US-Supreme-Court-Urteil erschüttert die Rechtsgrundlage der EU-US-Datentransfers, noyb fordert Widerruf des Angemessenheitsbeschlusses28.06. Österreich bittet Brüssel, Anthropic in die EU zu holen, Konsequenz aus der Fable-5-Abschaltungab 02.08. EU AI Act: Die GPAI-Durchsetzung beginnt, Bußgelder bis 3 % des Weltumsatzes für Modell-Anbieter
Grundlagen

Was lokale KI für Unternehmen bedeutet

Lokale KI für Unternehmen bezeichnet Sprachmodelle, die auf eigener Hardware oder in einem dedizierten europäischen Rechenzentrum laufen, statt bei einem US-Anbieter. Keine Geschäftsdaten verlassen den kontrollierten Bereich, kein fremder Anbieter kann den Zugang abschalten, und der Betreiber bestimmt selbst, welches Modell in welcher Version arbeitet.

Abgrenzung

Lokal heißt nicht zwangsläufig im eigenen Serverraum

Der entscheidende Punkt ist die Kontrolle, nicht der Standort des Blechs. Ein Modell in einem dedizierten Rechenzentrum unter europäischem Recht erfüllt denselben Zweck wie eines im eigenen Keller, ohne dass Sie Hardware beschaffen und Fachleute für den Betrieb einstellen. Beide Wege sind lokale KI, der Unterschied liegt in Aufwand und Investitionshöhe.

Abgrenzung

Warum ein EU-Endpunkt allein nicht reicht

Viele Anbieter bewerben einen europäischen Zugangspunkt. Wenn das Unternehmen dahinter US-Recht unterliegt, greift der CLOUD Act trotzdem, und die Abschaltung des Zugangs bleibt eine Entscheidung außerhalb Ihres Einflusses. Der Souveränitätsabschnitt weiter unten zeigt die vier Stufen und wo diese Grenze genau verläuft.

Nutzen

Wofür Unternehmen sie tatsächlich einsetzen

Dokumentenanalyse mit vertraulichen Verträgen, Wissenssuche über interne Ablagen, Protokolle und Zusammenfassungen aus Besprechungen, Code-Unterstützung auf eigenem Quelltext, Auswertung von Kundenanfragen. Der gemeinsame Nenner ist immer derselbe: Daten, die ein Unternehmen nicht in eine fremde Cloud geben will oder darf.

Die Demo

Lokale KI im Einsatz: Leistung live erleben

Ein kurzer Blick in den souveränen Betrieb: vom Prompt zur Antwort, komplett auf unserer Infrastruktur an fünf europäischen Standorten.

Modelle & Preise

Offene Spitzenmodelle: sofort verfügbar, transparente Preise

Alle Modelle laufen bereits und sind sofort per API nutzbar, abgerechnet nach Verbrauch, pro Million Tokens, ohne Grundgebühr und ohne Mindestumsatz; GLM 5.3 und das neue DeepSeek V4 Pro folgen am 1. September. Dieselben Modelle betreiben wir auf Wunsch auch dediziert oder On-Premise zum Fixpreis.

Jetzt im Katalog

Kimi K3 ist live: souverän bei uns im Betrieb

Platz 3 der Weltrangliste, direkt hinter Claude Fable 5 und GPT-5.6, vor Opus 4.8, und das führende offene Modell. Bei uns souverän betrieben: 1 Mio. Token Kontext, 3,00 € Input / 15,00 € Output je 1 Mio. Tokens. Und der Katalog wächst weiter: Am 1. September folgen GLM 5.3, das aktuell stärkste offene Coding-Modell, und das neue DeepSeek V4 Pro.

Jetzt Kapazität sichern
ModellKlasseKontextStandorteInput€ / 1 Mio. TokensOutput€ / 1 Mio. Tokens
GLM 5.3ab 01.09.Allround1Mab 01.09.folgtfolgt
DeepSeek V4 Pro 0813ab 01.09.Allround1Mab 01.09.folgtfolgt
Kimi K3BestsellerAllround1MBerlin · Zürich3,0015,00
DeepSeek V4 ProAllround1MAlle 5 Standorte1,753,50
Qwen3.5 397BAllround256KAlle 5 Standorte0,603,60
Kimi K2.6Allround256KBerlin · Zürich0,954,00
GLM 5.2Allround1MAlle 5 Standorte1,404,40
GLM 5.1Allround200KFrankfurt · Wien1,404,40
MiniMax M3Allround1MWien · Zürich · Bozen0,301,20
Mistral LargeAllround256KBerlin · Frankfurt · Zürich0,501,50
DeepSeek V4 FlashEffizienz1MAlle 5 Standorte0,290,35
gpt-oss-120bEffizienz128KBerlin · Wien0,150,60
Qwen3.6 27BEffizienz256KAlle 5 Standorte0,402,70
Qwen3 Coder 480BCode256KAlle 5 Standorte0,401,60
Kimi K2.7 CodeCode256KBerlin · Zürich · Bozen1,445,18
Devstral SmallCode128KWien · Bozen0,100,30

Preise netto, Stand August 2026; Abrechnung nach tatsächlichem Verbrauch. Weitere Modelle auf Anfrage, der Katalog wächst laufend.

Dedizierter Betrieb oder On-Premise: Fixpreis nach Dimensionierung statt Token-Abrechnung, sprechen Sie uns an.

Fugi · Die Orchestrierung

Viele Modelle, ein Dirigent: der Router für lokale KI

Fugi ist unsere Orchestrierungs-Schicht über dem Modell-Pool: Ein kleines Koordinator-Modell nimmt jede Anfrage entgegen und entscheidet selbst, was zu tun ist, direkt antworten, oder ein Team aus Spezialisten zusammenstellen, Teilaufgaben vergeben, Ergebnisse gegenprüfen und zu einer Antwort verdichten.

FUGI · der DirigentClaude CodeCodexOpenCodeout of the boxIhre AnfrageFUGIgelernt, nicht verdrahtetModell-Pool · austauschbarGLM 5.2DenkerQwen3 CoderAusführerDeepSeek V4PrüferKimi K3MiniMax M3Fugi selbstIhre Regel: nur DACH-Standorte 🔒Eine geprüfte Antwort ✓einfach → antwortet direktDas Team schlägt den Star, Komposition statt Riesenmodell.
Der Unterschied

Gelernt statt verdrahtet

Klassische Router folgen von Hand gepflegten Wenn-dann-Regeln. Fugis Koordinator ist selbst ein trainiertes Modell: Seine Strategien, wer übernimmt was, wann wird geprüft, wann reicht eine Antwort, entstehen aus Erfahrung und werden mit jedem Training besser.

Der Effekt

Das Team schlägt den Star

Komplexe Aufgaben werden zerlegt und an die jeweils stärksten Spezialisten vergeben, mit Prüfschritt vor der Antwort. So erreicht ein Verbund offener Modelle Ergebnisse auf Frontier-Niveau, ohne dass ein einzelnes Riesenmodell nötig wäre.

Die Souveränität

Der Pool gehört Ihnen

Neue Modelle docken ohne Neutraining an, Abgekündigtes fliegt raus, Ihre Regeln gelten auf Systemebene, etwa „nur Modelle an DACH-Standorten“. Der ganze Verbund läuft auf unserer Infrastruktur an fünf europäischen Standorten.

Fugi orchestriert den Modell-Pool an allen fünf Standorten, den Zugang erhalten Sie über die Warteliste.

Preis-Rechner

Wählen Sie Ihr Modell und sehen Sie den Unterschied

Modell wählen, Monatsvolumen einstellen: Der Graph zeigt Ihre monatlichen Output-Kosten gegen Claude Fable 5 zum API-Marktpreis, und wie die Ersparnis mit jedem Token wächst.

Kimi K3 ist pro Output-Token 3,3× günstiger

Kimi K3 · lokal bei ADVISORIClaude Fable 5
010.00020.00030.00040.00050.00002505007501000€ / MonatMio. Output-Tokens / MonatIhre Ersparnis: 10.500 € / MonatClaude Fable 5Kimi K3
Kimi K3: 4.500 €/MonatClaude Fable 5: 15.000 €/MonatErsparnis / Monat: 10.500 €

Vergleichsbasis: Claude Fable 5 zum verifizierten API-Marktpreis (10 $ Input / 50 $ Output je 1 Mio. Tokens, Stand Juli 2026, das teuerste je gelistete Anthropic-Modell). Gerechnet wird über Output-Tokens, denn dort entstehen die Kosten: Fable 5 denkt immer mit, und Thinking-Tokens werden als Output abgerechnet. User-Äquivalenz: rund 0,3 Mio. Output-Tokens je Mitarbeiter und Monat, typischer Mix aus Assistenz-Anfragen, Wissensdatenbank-Abfragen (RAG) und agentischer Software-Entwicklung. Preise netto.

Der Leistungsbeweis

Auf Augenhöhe mit den US-Modellen, belegt im Benchmark

Offene Spitzenmodelle sind keine Kompromisslösung mehr. Der direkte Vergleich: GLM-5.2 (offen, bei uns im Katalog) gegen Claude Opus 4.8 (US-Frontier), gemessen, nicht behauptet. Und der Abstand schrumpft weiter: Kimi K3, Platz 3 der Weltrangliste, ist inzwischen offen verfügbar und läuft bei uns im Katalog.

GLM-5.2 · offenOpus 4.8 · US
Terminal-Bench 2.1agentisch82,778,9
AIME 2026Mathematik99,295,7
Gesamt-Scorecomposite9193
Kosten / 1M OutputAPI-Preis4,40 $25,00 $
Lizenz & ZugangMIT · offenproprietär · API
In der EU betreibbar

5,7× günstiger pro Output-Token. Bei agentischen Terminal-Tasks und Mathematik schlägt es Opus 4.8 schon heute, beide mit 1M-Token-Kontext. Der knappe Gesamt-Score-Rückstand kostet ein Fünftel des Preises.

benchlm.ai · llm-stats.com · Stand Juni 2026

GLM 5.2 steht oben in der Preistabelle, sofort per API beziehbar →

Die Integration

Base-URL tauschen, fertig: lokale KI per OpenAI-API

Unser Endpoint ist OpenAI-kompatibel: Bestehender Code läuft unverändert weiter, Sie ändern nur die Base-URL und das Modell. Kein SDK-Wechsel, kein Migrationsprojekt.

from openai import OpenAI

client = OpenAI(
    base_url="https://api.advisori.de/v1",
    api_key="IHR_ADVISORI_KEY",
)

antwort = client.chat.completions.create(
    model="glm-5.2",
    messages=[{"role": "user", "content": "Hallo!"}],
)
print(antwort.choices[0].message.content)
Out of the box kompatibel:Claude CodeOpenCodeCodex

Ihren API-Key erhalten Sie mit Ihrer Kapazitäts-Freigabe von der Warteliste.

Ihre Modelle wohnen hier.ATCHIhr europäischer Rechtsraum ✓BerlinNVIDIA B200Heiligenhaus · inaktivFrankfurtNVIDIA B200Hamburg · baldZürichBozenWienIhr Unternehmenkurze Wege · Ihr RechtUS-Cloud~ Atlantik ~CLOUD Act ✗Kein Ozean zwischen Ihnen und Ihrer KI, 5 Standorte aktiv · 1 im Aufbau · 100 % Europa
Der Maschinenraum

Ihre Modelle wohnen in Berlin, Frankfurt, Wien, Zürich und Bozen. Hamburg folgt.

Unsere Inferenz-Server stehen in Berlin, Frankfurt, Wien, Zürich und Bozen, betrieben auf NVIDIA B200, der aktuellen GPU-Generation. Hamburg ist im Aufbau. Hochperformant, hohe Qualität, kurze Wege. Und komplett in Europa: Betrieb, Daten und Recht bleiben, wo Sie sind.

5
Standorte aktiv: Berlin · Frankfurt · Wien · Zürich · Bozen, Hamburg im Aufbau
B200
NVIDIA-GPUs der aktuellen Generation
100 %
Europa, Betrieb, Daten, Recht
Sicherheit & Compliance

Gebaut von Sicherheitsleuten, nicht nachgerüstet

ADVISORI ist ein Security-Unternehmen. Der Modellbetrieb läuft nach denselben Maßstäben, nach denen wir Banken und Versicherer beraten.

Datenhaltung

Zero Data Retention

Prompts und Antworten werden nicht gespeichert, sie werden verarbeitet und verworfen. Ihre Daten fließen in kein Training und an keinen Dritten.

Verschlüsselung

Verschlüsselt, durchgehend

TLS 1.3 auf dem Transportweg, AES-256 für alles, was ruht. Gehärtet und überwacht durch das Security-Team der ADVISORI FTC.

Vertrag

AVV inklusive

Auftragsverarbeitung nach Art. 28 DSGVO ist Vertragsbestandteil, mit Verarbeitung ausschließlich an unseren europäischen Standorten (DE, AT, CH, IT). EU-AI-Act-Nachweise liefern wir mit.

Governance

Kontrolle für Ihre IT

Dedizierte API-Keys je Team, Budget-Limits und Audit-Trail über alle Anfragen, Ihre IT behält den Überblick, wer was nutzt.

Multimodale Guardrails, Ihre Policies, am Endpoint durchgesetzt

GUARDRAILS · die SchleusemultimodalTextBildDokument„…IBAN DE89 3704…“PII-MaskeInjection-FilterIhre Policy 🔒„…IBAN ▮▮▮▮ ▮▮▮▮…“ · maskiert ✓Ihre ModelleGLM · Qwen · DeepSeek …auch die Antwort wird geprüft ✓Prompt-Injectionblockiert ✗Audit-Loggeprüft ✓maskiert ✓blockiert ✗Nichts erreicht das Modell ungeprüft, und nichts verlässt es ungeprüft.
Eingaben

PII-Schutz, multimodal

Personenbezogene Daten werden in Text, Bildern und Dokumenten erkannt und maskiert, bevor sie das Modell erreichen, und auf Wunsch auch in den Antworten.

Abwehr

Prompt-Injection-Abwehr

Angriffe über manipulierte Eingaben, Dokumente oder Webinhalte werden am Endpoint erkannt und blockiert, bevor sie das Modell steuern können.

Ihre Regeln

Firmeneigene Policies

Ihre Richtlinien als durchsetzbare Leitplanken: Themen-Blocklisten, Compliance-Vorgaben, abteilungsspezifische Freigaben, zentral gepflegt, je Team und API-Key wirksam.

Nachweis

Jede Entscheidung im Audit-Log

Was geprüft, maskiert oder blockiert wurde, ist nachvollziehbar dokumentiert, pro Anfrage, pro Regel, revisionssicher für Ihre Compliance.

Die Guardrails greifen vor und nach jedem Modellaufruf, unabhängig davon, welches Modell Fugi wählt. Auch als eigenständiger Service vor jedem Modell: Fugi Guardrails →

Zertifizierte Sicherheit & Qualität der ADVISORI FTC
ISO 27001ISO 9001ISO/IEC 42001SOC 2 Typ IIEU AI ActDSGVO

Dieselben Zertifizierungen, mit denen ADVISORI regulierte Unternehmen berät. Kein „in Vorbereitung", kein „erwartet".

Der Betrieb

So sieht souveräner Betrieb aus

ADVISORI · Inferenz-KonsoleModelle: DeepSeek · GLM · Qwen · Kimi 🔒100 % Europa ✓Anfrage · live> Vertrag_2026.pdf analysierenAntwort in 1,2 s ✓Route: Berlin · B200verlässt das Haus: nieAuslastungBerlin100Frankfurt100Wien100Kosten-Ticker1 Mio. Tokens: 4,40 € statt 25,00 $5,7× günstiger ✓Datenschutzgespeichert: 0 BytesZero Retention ✓Audit-Trail: anAPI · Modelle · Budgets · Audit · StatusNVIDIA B200 · 5 Standorte in EuropaÖkostromIhr eigenes KI-Kraftwerk. Läuft schon, Slot sichern.
Warum jetzt

Wenn Washington den Stecker zieht: das Abhängigkeitsrisiko

Was lange ein hypothetisches Risiko war, ist seit Juni 2026 dokumentierte Realität: Abschaltung, Zugangslisten, Preiswechsel über Nacht.

Präzedenzfall

Der Off-Switch wurde benutzt

Kein Hypothetikum mehr: Im Juni 2026 war Claude Fable 5 auf US-Regierungsanweisung 19 Tage weltweit abgeschaltet, für alle Kunden. Kein Vertrag, kein SLA schützte davor.

Zugang

Zugang wird politisch vergeben

GPT-5.6 startete ausschließlich für rund 20 von Washington einzeln genehmigte Partner. Wer Frontier-KI nutzen darf, entscheidet zunehmend die US-Regierung, europäische Unternehmen sitzen nicht am Tisch.

Kosten

Preiswechsel über Nacht

Dasselbe Modell, eben noch im Abo enthalten, kostet ab 8. Juli 10 $ / 50 $ pro Mio. Tokens, ohne Bestandsschutz. Lokale Modelle drehen die Rechnung um: feste Infrastruktur, planbare Kosten. Der Preis-Rechner oben zeigt den Unterschied.

Recht

CLOUD Act & strukturelle Abhängigkeit

US-Behörden können auf Daten bei US-Anbietern zugreifen, egal, in welchem Rechenzentrum sie liegen. Und laut erstem UN-KI-Bericht stehen 75 % der weltweiten KI-Rechenleistung in den USA.

Regulierung

DSGVO & EU AI Act

Nachweispflichten, Datenminimierung, Transparenz. Am einfachsten zu erfüllen, wenn das Modell dort läuft, wo Ihre Daten ohnehin sind: bei Ihnen.

Chronik: die letzten 30 Tage
  1. 12.06.2026US-Regierung ordnet die Abschaltung von Claude Fable 5 & Mythos 5 an, weltweit, für alle Nutzer. Quelle →
  2. 26.06.2026OpenAI startet GPT-5.6 nur für ~20 regierungsgeprüfte Partner, Zugang wird Kunde für Kunde genehmigt. Quelle →
  3. 01.07.2026Erster UN-KI-Bericht: 75 % der weltweiten KI-Rechenleistung stehen in den USA, 15 % in China. Quelle →
  4. 08.07.2026Fable 5 nach 19 Tagen wieder online, gedrosselt, ab 8. Juli nur noch gegen Usage Credits (10 $ / 50 $ pro Mio. Tokens). Quelle →
  5. 16.07.2026Die offene Welt zieht nach: Moonshot stellt Kimi K3 vor, Platz 3 der Weltrangliste, vor Opus 4.8. Die Gewichte wurden am 27.07. veröffentlicht. Quelle →
Digitale Souveränität

Digitale Souveränität: was der Begriff konkret verlangt

Digitale Souveränität wird oft als Haltung diskutiert und selten als Prüfliste. Für den Betrieb von KI lässt sich digitale Souveränität aber genau beziffern: Es geht um vier Fragen, und jede davon hat eine überprüfbare Antwort. Wer kann Ihnen den Zugang abschalten? Wessen Recht gilt für Ihre Daten? Wer entscheidet über Modellwechsel und Preise? Und könnten Sie den Betrieb notfalls selbst übernehmen?

EU-Datenresidenz

Die Daten liegen physisch in Europa, der Anbieter unterliegt aber weiter US-Recht. Das erfüllt Anforderungen an den Speicherort und sonst nichts, mit digitaler Souveränität hat es noch nichts zu tun: Der CLOUD Act greift trotzdem, und die Abschaltung bleibt eine fremde Entscheidung. Die meisten Angebote, die mit europäischen Rechenzentren werben, enden hier.

Standort geklärt, Kontrolle nicht

Europäischer Betreiber

Betrieb und Vertrag liegen bei einem europäischen Unternehmen, das Modell stammt weiter von einem US-Anbieter mit dessen Nutzungsbedingungen. Für die digitale Souveränität ein deutlicher Sprung, technisch bleibt die Abhängigkeit aber bestehen: Wird das Modell abgeschaltet oder neu bepreist, trifft es Sie unverändert.

Recht geklärt, Modell nicht

Offene Gewichte im europäischen Rechenzentrum

Das Modell ist quelloffen beziehungsweise mit offenen Gewichten verfügbar und läuft bei einem europäischen Betreiber. Jetzt kann niemand mehr abschalten: Die Gewichte liegen vor, die Version ist eingefroren, bis Sie sie wechseln. Das ist die Stufe, auf der digitale Souveränität praktisch beginnt, auf der die meisten Unternehmen landen sollten, und die ADVISORI standardmäßig liefert.

Abschaltrisiko beseitigt

Voller Eigenbetrieb

Hardware, Modell und Betrieb liegen vollständig im eigenen Haus. Maximale digitale Souveränität, und der einzige Weg für Umgebungen mit Verschlusssachen oder strikter Netztrennung. Der Preis dafür sind Investitionen in Hardware, eigenes Fachpersonal und die Verantwortung für Verfügbarkeit und Aktualisierung.

Vollständig souverän, mit Aufwand

Die entscheidende Grenze liegt zwischen Stufe zwei und drei: Erst mit offenen Gewichten endet die Abhängigkeit von einer fremden Freigabeentscheidung. Alles darunter ist Datenschutz, nicht digitale Souveränität. Warum ein rein europäischer Zugangspunkt diese Grenze nicht überschreitet, steht im nächsten Abschnitt.

Die entscheidende Frage

Ein „EU-Endpoint“ ist keine Souveränität

Viele Anbieter werben mit „EU-Datenresidenz“, gemeint ist ein Gateway in Europa, das Ihre Anfragen entgegennimmt und an US-Modellanbieter weiterleitet. Entscheidend ist nicht, wo die Anfrage ankommt, sondern wo das Modell rechnet.

US-Cloud-APIOpenAI, Anthropic & Co. direktKI-Gateway„EU-Datenresidenz“ / EU-EndpointLokale ModelleADVISORI
Wo rechnet das Modell?In der US-CloudWeiterhin beim US-ModellanbieterBei Ihnen oder in unseren Rechenzentren (DE/AT/CH/IT)
Wer sieht Ihre Prompts?Der ModellanbieterGateway und ModellanbieterNur Sie
CLOUD-Act-Zugriff möglich?JaJa, beim ModellbetreiberNein
KostenmodellAPI-Preis pro TokenAPI-Preis + AufschlagFeste Infrastruktur, Nutzung unbegrenzt
Abschaltbar durch Dritte?JaJaNein, Sie betreiben es
Datenschutz

Lokale KI und DSGVO: was der eigene Betrieb ändert

Der Betrieb im eigenen Rechtsraum macht aus der DSGVO keine Formsache, aber er verschiebt sie von einer schwer belegbaren auf eine gut belegbare Ebene. Drei Punkte ändern sich konkret.

Drittland

Die Übermittlung entfällt, statt gerechtfertigt zu werden

Wer ein US-Modell ansteuert, muss die Übermittlung in ein Drittland nach der DSGVO begründen und laufend absichern. Läuft das Modell in einem europäischen Rechenzentrum, findet die Übermittlung schlicht nicht statt. Das ist der sauberere Weg: eine Verarbeitung, die nicht stattfindet, muss auch nicht gerechtfertigt werden.

Nachweis

Artikel 32 verlangt Wirksamkeit, nicht Absicht

Artikel 32 DSGVO fordert technische und organisatorische Maßnahmen nach dem Stand der Technik, die Vertraulichkeit, Integrität, Verfügbarkeit und Belastbarkeit sicherstellen, samt einem Verfahren zur regelmäßigen Überprüfung ihrer Wirksamkeit. Beim eigenen Betrieb liegen Protokolle, Zugriffe und Konfiguration bei Ihnen, und damit auch der Nachweis. Bei einem fremden Dienst haben Sie das Zertifikat des Anbieters und sonst wenig.

Rollen

Die Rollenverteilung wird eindeutig

Bei uns bleibt ADVISORI Auftragsverarbeiter nach Artikel 28 DSGVO, mit Auftragsverarbeitungsvertrag, benanntem Rechenzentrum und ohne Training auf Ihren Daten. Beim Eigenbetrieb entfällt der Auftragsverarbeiter ganz. In beiden Fällen ist die Kette kurz und schriftlich belegbar, statt über mehrere Unterauftragnehmer in wechselnden Rechtsräumen zu laufen.

Wie sich ein solcher Betrieb im Detail aufsetzen und dokumentieren lässt, von der Rollenverteilung bis zum Löschkonzept und zur DSGVO-Dokumentation, steht in unserem Leitfaden DSGVO-konforme KI. Die Einordnung Ihres konkreten Anwendungsfalls ersetzt er nicht, und genau dabei beraten wir seit Jahren.

Das Angebot

Offene Spitzenmodelle: drei Betriebswege, ein Verantwortlicher

Wir wählen das passende offene Modell für Ihre Anwendungsfälle, bauen den Betrieb auf und verantworten ihn, inklusive Härtung, Updates und Monitoring.

Variante A

On-Premise bei Ihnen

Betrieb auf Ihrer eigenen Hardware im eigenen Haus. Maximale Kontrolle, die richtige Wahl für Verschlusssachen, F&E und streng regulierte Daten.

Variante B

Rechenzentrum in Europa

Dedizierter Betrieb auf NVIDIA-B200-Infrastruktur an einem unserer fünf europäischen Standorte, ohne eigene Hardware-Investition, unter dem Recht des jeweiligen Standorts (DE/AT/CH/IT), mit klarem SLA.

Variante C

Hybrid mit Failover

Lokale Modelle als Standard, definierte Ausweichpfade für Lastspitzen, orchestriert über Synthara AI Studio, mit Regeln, die Sie festlegen.

Branchenmodelle · Feintraining

Ihr Modell spricht Ihre Branche

Über den Katalog hinaus feintrainieren wir offene Spitzenmodelle auf Ihre Branche und Ihre Dokumente: Fachsprache, Formulare, Prozesse, Regulatorik. Das Training läuft auf unseren B200-Clustern an fünf europäischen Standorten, das feingetunte Modell gehört exklusiv Ihnen und läuft als eigener Endpoint.

BRANCHENMODELL · das FeintrainingOffenes BasismodellGLM · Qwen · DeepSeek …+Ihre DokumenteFachsprache · Formulare · RegulatorikFEINTRAININGIhre Dokumente bleiben an unseren europäischen Standorten 🔒Ihr Branchenmodellexklusiv Ihres · eigener Endpoint 🔒„Ihre Fachsprache?“„Spreche ich.“Basismodell + Ihre Dokumente = ein Modell, das Ihre Sprache spricht.

Ein Klick auf Ihre Branche trägt sie direkt in die Wartelisten-Anfrage ein, wir melden uns mit einem konkreten Vorschlag.

Optionaler Ausbau

Die API ist komplett. Synthara bringt sie in die Fachbereiche.

Ihr Endpoint funktioniert für sich, Ihre Entwickler integrieren direkt per API, ohne weitere Software. Wer KI zusätzlich in Fachbereiche ohne Entwickler bringen will, setzt optional Synthara AI Studio auf dieselben souveränen Modelle: KI-Assistent, No-Code-Studio, Workflows und Reporting, mit automatischem Failover zwischen Ihren Modellen.

Synthara AI Studio kennenlernen →
So schnell geht’s

In drei Schritten am souveränen Endpoint

Eintragen

Auf die Warteliste, die geschäftliche E-Mail genügt. Wir geben Kapazität in Wellen frei und melden uns in der Reihenfolge der Eintragungen.

heute · 2 Minuten

Zugang & AVV erhalten

Sie bekommen Ihren API-Key, Ihre Standort-Zuordnung und den AV-Vertrag, alles, was Ihre IT und Ihr Datenschutz für die Freigabe brauchen.

nach 3–5 Tagen

Base-URL tauschen, loslegen

Der Endpoint ist OpenAI-kompatibel: eine Zeile Konfiguration, und Ihre Anwendungen, Claude Code oder OpenCode arbeiten auf souverän gehosteten Modellen. Abgerechnet wird nur der Verbrauch, Branchenmodell und On-Premise-Ausbau jederzeit als nächster Schritt.

Tag 1
Häufige Fragen

Was Entscheider uns am häufigsten fragen

Was ist lokale KI?
Lokale KI bedeutet, dass Sprachmodelle (LLMs) vollständig auf eigener Infrastruktur laufen (On-Premise im Unternehmen oder in einem dedizierten europäischen Rechenzentrum) statt in der Cloud eines US-Anbieters. Eingaben und Dokumente bleiben unter eigener Kontrolle: kein Datenabfluss, kein CLOUD-Act-Zugriff, DSGVO- und EU-AI-Act-konform, bei Leistung auf Augenhöhe mit offenen Spitzenmodellen.
Sind offene Modelle wirklich gut genug für den Unternehmenseinsatz?
Ja. Offene Spitzenmodelle liegen in unabhängigen Benchmarks auf Augenhöhe mit den Frontier-Anbietern. Für die allermeisten Unternehmensaufgaben (Dokumente, Assistenz, Extraktion, Code) ist der Unterschied in der Praxis nicht mehr messbar. Im Proof of Concept belegen wir das mit Ihren eigenen Aufgaben, bevor Sie sich entscheiden.
Was unterscheidet Sie von Anbietern mit „EU-Datenresidenz“?
Bei einem Gateway mit EU-Endpoint nimmt ein Server in Europa Ihre Anfrage entgegen, gerechnet wird trotzdem beim US-Modellanbieter, und dort greift der CLOUD Act. Bei uns läuft das Modell selbst auf Ihrer Infrastruktur oder in unseren Rechenzentren in Berlin, Frankfurt, Wien, Zürich und Bozen. Ihre Prompts erreichen zu keinem Zeitpunkt einen US-Anbieter.
Brauchen wir dafür eigene GPU-Hardware?
Nicht zwingend. Die Betriebsvariante in unseren Rechenzentren (Berlin, Frankfurt, Wien, Zürich, Bozen) kommt ohne eigene Investition aus. Für On-Premise beraten wir zur passenden Dimensionierung. Oft genügt deutlich weniger Hardware, als Kunden erwarten, weil moderne offene Modelle sehr effizient geworden sind.
Was kostet das im Vergleich zu unserer heutigen API-Nutzung?
Die Token-Preise stehen transparent auf dieser Seite: je nach Modell ein Bruchteil der Frontier-API-Kosten. Mit dem Preis-Rechner vergleichen Sie Ihr Wunschmodell direkt mit Claude Fable 5. Beim dedizierten oder On-Premise-Betrieb gilt ein Fixpreis nach Dimensionierung: Je mehr Sie nutzen, desto größer der Vorteil.
Wie schnell sind wir produktiv?
Über den API-Endpoint sofort: Die Modelle laufen bereits. Sobald Ihr Zugang freigeschaltet ist, integrieren Sie in Minuten. Aktuell sind die Kapazitäten vergeben; über die Warteliste erhalten Sie den nächsten freien Slot. Dedizierter oder On-Premise-Betrieb dauert typischerweise 3–4 Wochen von der Analyse bis zum Go-Live.
Wer betreibt und wartet die Modelle langfristig?
Beides ist möglich: Wir befähigen Ihr Team, den Betrieb selbst zu übernehmen, oder ADVISORI verantwortet ihn als Managed Service mit SLA, Updates und Monitoring. Viele Kunden starten managed und übernehmen später schrittweise.
Gibt es einen Auftragsverarbeitungsvertrag (AVV)?
Ja. Ein AVV nach Art. 28 DSGVO ist Bestandteil des Vertrags, auf Wunsch ergänzt um Ihre individuellen technischen und organisatorischen Maßnahmen. Verarbeitet wird ausschließlich an unseren europäischen Standorten (DE, AT, CH, IT); Prompts und Antworten werden nicht gespeichert und fließen in kein Training.
Können wir eigene Richtlinien (Guardrails) durchsetzen?
Ja. Am Endpoint laufen multimodale Guardrails: PII-Erkennung und -Maskierung in Text, Bildern und Dokumenten, Prompt-Injection-Abwehr und Inhaltsfilter. Darüber hinaus hinterlegen wir Ihre firmeneigenen Policies: Themen-Blocklisten, Compliance-Vorgaben, Freigaben je Team oder API-Key. Jede Entscheidung landet im Audit-Log, und die Leitplanken greifen unabhängig davon, welches Modell die Anfrage bearbeitet.
Welche Verfügbarkeit sichern Sie zu?
Der Endpoint läuft redundant über unsere fünf Standorte Berlin, Frankfurt, Wien, Zürich und Bozen. Für dedizierte Instanzen und On-Premise-Betrieb vereinbaren wir ein individuelles SLA mit definierten Reaktionszeiten. Die konkreten Zusagen legen wir gemeinsam im Vertrag fest.
Nächster Schritt

Sichern Sie sich den nächsten freien Slot

Die aktuellen Kapazitäten sind vergeben, wir erweitern laufend. Tragen Sie sich auf die Warteliste ein: Wir melden uns in der Reihenfolge der Eintragungen, sobald Ihr Zugang bereitsteht.

Auf die Warteliste

Fragen vorab? Schreiben Sie uns: info@advisori.de · ADVISORI FTC GmbH