LLMBUS Pilotplatz vormerken

On-Premise-KI · Betrieb aus Deutschland

Frontier-KI auf Ihrem Gelände.
Ohne Cloud.

Wir fahren ein Rechenzentrum mit einem offenen Modell der Spitzenklasse auf Ihren Hof. Ein Stromkabel, eine Glasfaser — Ihre Daten verlassen nie Ihr Gelände.

  • AVV nach Art. 28 DSGVO
  • § 203-Verpflichtungserklärung
  • Dokumentation fürs IKT-Register
  • Kein Internet-Uplink

Wo wir gerade stehen: Das erste Fahrzeug ist im Aufbau. Die ersten Pilotplätze vergeben wir ab Herbst 2026 — wer jetzt reserviert, bestimmt Termin und Use-Case mit. Referenzen können wir noch keine zeigen; wir sagen das lieber, als es zu verschweigen.

Ihr Gebäude CEE 32 A · Strom Glasfaser · Daten LLM BUS · 8× GPU · kein Uplink kein Internet-Uplink
Zwei Kabel: Strom und eine Glasfaser in Ihr VLAN — im Pilotbetrieb kein Funk, kein Uplink, kein Pfad nach außen. Der Bus fährt ohne Ihre Daten vom Hof: Ihre NVMe-Kassette bleibt bei Ihnen, alles Übrige wird verifizierbar gelöscht.

Ablauf

Von der Anfrage zur laufenden KI — in drei Schritten

1

Der Bus kommt

Ein Transporter parkt auf Ihrem Gelände — mit 8 GPUs und einem einsatzbereiten Sprachmodell an Bord. Kein Beschaffungsprojekt, keine Server-Lieferzeit, kein Umbau. Von der Zusage bis zur Ankunft planen wir 2–3 Wochen: Betriebsrat, AVV und — falls nötig — der Elektriker brauchen diese Zeit.

2

Zwei Kabel

CEE-Starkstrom und eine Glasfaser in ein dediziertes VLAN Ihrer IT — nur Port 443, kein Funk, kein Internet-Uplink. Glasfaser bewusst statt Kupfer: galvanisch getrennt, kein elektrischer Pfad zwischen Bus und Hausnetz. Fehlt die rote Steckdose, organisieren wir den Elektriker vorab.

3

Ihr Team arbeitet

Login mit Ihren Firmen-Zugängen (Active Directory), Chat und Suche über Ihre Dokumente (RAG). Ein Engineer von uns bleibt die ganze Zeit vor Ort — Einrichtung, Use-Cases und Schulung inklusive. Am Ende: Übergabe der kundeneigenen NVMe-Kassette und protokollierte, verifizierte Löschung.

Warum der Bus

Der günstigste Weg, ein Frontier-Modell auf dem eigenen Gelände zu erleben

Wer KI mit den eigenen Dokumenten testen will, hat heute vier realistische Wege — vom US-Cloud-Abo bis zum Beratungsprojekt. So schlagen sie sich im direkten Vergleich mit einer LLM-BUS-Pilotwoche:

OptionKosten für einen TestWo landen Ihre Daten?Modellgröße
US-Cloud-Abo ChatGPT, Copilot & Co. — Konto anlegen, lostippengeringUS-Cloud ✗Frontier
Gemietete GPU-Server KI-Server im deutschen Rechenzentrum, Zugriff übers Netzab ~€350/Monat für eine GPU Einstiegsangebote sind einzelne Karten. Für ein Modell dieser Klasse brauchen Sie acht davon — plus jemanden, der es betreibt.deutsches Rechenzentrum — Daten verlassen Ihr Haus ⚠je nach Karte
On-Prem-Appliance fertiger KI-Server zum Kauf, steht dauerhaft bei Ihnen~€25.000–50.000 vorabIhr Gelände ✓24B–70B
Integrator-Projekt Beratungshaus installiert KI auf Ihrer eigenen Hardwareab €30.000Ihre Infrastruktur ✓Open Models
LLM BUS Pilotwoche Rechenzentrum auf Rädern, 5 Tage bei Ihnen — dann fährt es wieder€12.000, ohne KaufzwangIhr Gelände, kein Uplink ✓1-Billion-Parameter-Klasse

Zum Vergleich: Die bekannteste On-Prem-Appliance am deutschen Markt liefert ein 24-Milliarden-Parameter-Modell auf einer GPU. Der Starter-Bus bringt ein 1-Billion-Parameter-Modell auf acht GPUs — dieselbe Hardware-Familie, das ~40-fache Modell. Wie sich dieses Modell in Benchmarks schlägt — samt der Disziplinen, in denen es verliert — steht datiert und mit Quellen auf Benchmarks & Belege.

Preise

Konfigurieren Sie Ihren Piloten

Der Bus

Starter-BusAb Herbst 2026 Kimi K2.6 · für 100–300 Mitarbeitende ab €8.000 / Woche

8× RTX PRO 6000 Blackwell an einer CEE-32-A-Dose, ein Engineer die ganze Zeit vor Ort — und eine kundeneigene NVMe-Kassette, die bei Ihnen bleibt.

Flagship-BusIn Vorbereitung Kimi K3 · für 500+ Mitarbeitende

Die offenen Gewichte werden Ende Juli 2026 erwartet. Wir bauen und verkaufen diese Konfiguration erst, wenn wir sie auf eigener Hardware gemessen haben — bis dahin nennen wir dafür keinen Preis.

Paket wählen

Ein Stromkabel, eine Glasfaser — dediziertes VLAN, im Pilotbetrieb kein Funk, kein Internet-Uplink. Ihre NVMe-Kassette bleibt beim Abschied bei Ihnen; alle übrigen Speicher werden protokolliert und verifizierbar gelöscht.

Compliance

Gebaut für die strengsten Häuser in Deutschland

Berufsgeheimnis · § 203 StGB

Für Kanzleien, Kliniken und Versicherer bleiben Ihre Daten physisch auf Ihrem Gelände. Der Mechanismus dahinter: Unser Personal wird schriftlich als mitwirkende Person nach § 203 Abs. 3 StGB verpflichtet, dazu kommt ein AVV nach Art. 28 DSGVO. Beides liegt vorbereitet im Vertragspaket. Ob das für Ihr Haus ausreicht, entscheidet Ihre Rechtsabteilung — wir liefern die Bausteine, kein Siegel.

Finanzaufsicht · DORA & MaRisk

Wir sind IKT-Drittdienstleister. Das heißt: Der Vertrag gehört in Ihr Informationsregister nach Art. 28 DORA — unabhängig davon, wie Sie den Piloten einstufen. Die dafür nötigen Angaben liefern wir vorausgefüllt mit; die Einstufung als kritisch oder wichtig treffen Sie. Kein US-Subprozessor, keine Datenübertragung, Audit vor Ort jederzeit möglich.

Herkunft der Modelle

Kimi kommt aus China — deshalb läuft es bei Ihnen ohne jeden Pfad nach außen, nachprüfbar in Ihren eigenen Firewall-Logs. Die Gewichte sind offen und inspizierbar, Telemetrie ist ohne Uplink technisch ausgeschlossen. Und der Bus ist modellagnostisch: Mistral (Apache 2.0, Frankreich), Llama, Qwen oder GPT-OSS laufen auf derselben Hardware. Die Modellwahl treffen Sie.

FAQ

Häufige Fragen

Gibt es den Bus schon?

Noch nicht. Das erste Fahrzeug ist im Aufbau, die ersten Pilotplätze vergeben wir ab Herbst 2026. Was Sie hier sehen, ist eine Konstruktionsansicht, kein Foto — sobald der Bus steht, tauschen wir sie gegen echte Bilder. Referenzkunden können wir entsprechend auch noch keine nennen. Wer zu den Ersten gehört, bestimmt dafür Termin, Use-Case und Konfiguration mit.

Welchen Stromanschluss brauchen wir?

Eine rote CEE-32A-Drehstromdose — Standard in Produktion und Werkstatt. Ist keine vorhanden, installiert ein Elektriker sie vorab für wenige hundert Euro; das organisieren wir als Teil des Onboardings.

Braucht der Bus Internet?

Nein — und das ist der Punkt. Das System arbeitet ohne Uplink. Die einzige Verbindung nach draußen ist eine Glasfaser in ein von Ihrer IT kontrolliertes VLAN, auf einem einzigen Port. Kein Funk, kein Weg ins Internet — nachprüfbar in Ihren eigenen Firewall-Logs. Modell-Updates spielen wir im Depot ein, nie beim Kunden. (Wir nennen das bewusst nicht „air-gapped": ein echter Air Gap hätte gar keine Netzverbindung. Wenn Sie das brauchen, arbeitet Ihr Team im Fahrzeug — dann geht kein Kabel ins Haus.)

Wie viele Mitarbeitende können gleichzeitig arbeiten?

Der Starter-Bus ist auf typische Büro-Nutzung von 100–300 Mitarbeitenden ausgelegt. Ehrlich dazu: Diese Zahl stammt aus Bandbreiten-Rechnung und veröffentlichten Benchmarks derselben Hardware-Klasse, nicht aus einer Messung an unserem eigenen Fahrzeug. Die holen wir vor dem ersten Piloten nach und veröffentlichen sie. Was Sie im Alltag eher spüren als die Tokenrate, ist die Zeit, bis ein sehr langes Dokument eingelesen ist — deshalb begrenzen wir im Pilotprofil das Kontextfenster bewusst.

Was passiert nach dem Piloten mit unseren Daten?

Ihre Dokumente und Indizes liegen auf einer kundeneigenen NVMe-Kassette, die beim Abschied bei Ihnen bleibt. Alles Übrige wird protokolliert und verifizierbar gelöscht — das Löschprotokoll gehört zur Übergabe.

Welches Modell läuft auf dem Bus?

Auf dem Starter-Bus läuft Kimi K2.6 — ein offenes Modell mit 1 Billion Parametern (davon 32 Milliarden pro Anfrage aktiv) und bis zu 256K Kontext. Wo es in Benchmarks steht, welche es gewinnt und welche es verliert, steht datiert und mit Quellen auf Benchmarks & Belege. Der Bus ist aber nicht auf ein Modell festgelegt: Mistral, Llama, Qwen oder GPT-OSS laufen auf derselben Hardware. Kimi K3 ist für einen zweiten, größeren Bus vorgesehen — sobald die Gewichte veröffentlicht und von uns selbst gemessen sind.

Wer steckt hinter LLM BUS?

LLM BUS ist ein Angebot der Zuse-Systeme Germany GmbH aus Berlin, geführt von Dmytro Gerasymchuk und Addnan Raza Ramma — ohne US-Mutterkonzern, damit auch ohne CLOUD-Act-Durchgriff. Die Modelle sind offene Gewichte unter freier Lizenz (Kimi K2.6: Modified-MIT) und laufen bei Ihnen ohne Uplink: kein Phone-home, keine Telemetrie, kein Hersteller-Zugriff. Zur Herkunft der Modelle siehe den Abschnitt Compliance.

Und wenn wir danach selbst kaufen wollen?

Perfekt — genau dafür ist der Pilot da. Die Pilotgebühr rechnen wir bei Beauftragung einer Festinstallation innerhalb von 90 Tagen vollständig an. Was die Festinstallation kostet, hängt von Größe, Integration und Betriebsmodell ab; die Hardware weisen wir dabei transparent aus.

Die ersten Pilotplätze ab Herbst 2026.

Platz vormerken

Wir melden uns innerhalb eines Werktags. Ihre Daten werden ausschließlich zur Bearbeitung der Anfrage verwendet.