Der Bus kommt
Ein 3,5-t-Sprinter parkt auf Ihrem Gelände — mit 8 GPUs und einem einsatzbereiten Sprachmodell an Bord. Kein Beschaffungsprojekt, keine Server-Lieferzeit, kein Umbau.
On-Premise-KI · Made in Germany
Wir fahren ein Rechenzentrum mit einem GPT‑5.5-klassigen Open-Weights-Modell auf Ihren Hof. Ein Stromkabel, ein Datenkabel — Ihre Daten verlassen nie Ihr Gelände.
Ablauf
Ein 3,5-t-Sprinter parkt auf Ihrem Gelände — mit 8 GPUs und einem einsatzbereiten Sprachmodell an Bord. Kein Beschaffungsprojekt, keine Server-Lieferzeit, kein Umbau.
CEE-Starkstrom und Glasfaser in ein dediziertes VLAN Ihrer IT — nur Port 443, kein Funk, kein Internet-Uplink. Fehlt die rote Steckdose, organisieren wir den Elektriker vorab.
Login mit Ihren Firmen-Zugängen (Active Directory), Chat und Suche über Ihre Dokumente (RAG). Am Ende: Übergabe der kundeneigenen NVMe-Kassette und protokollierte, verifizierte Löschung.
Warum der Bus
| Option | Testkosten | Datenstandort | Modellklasse |
|---|---|---|---|
| ChatGPT / US-Cloud-API | gering | US-Cloud ✗ | Frontier |
| Deutsches GPU-Hosting (z. B. Miet-Server) | ab ~€350/Monat | deutsches Rechenzentrum — Daten verlassen Ihr Haus ⚠ | beliebig |
| On-Prem-Appliance (Kauf) | ~€25.000–50.000 vorab | Ihr Gelände ✓ | 24B–70B |
| Integrator-PoC | ab €30.000 | Ihre Infrastruktur ✓ | Open Models |
| LLM BUS Pilotwoche | €12.000, ohne Kaufzwang | Ihr Gelände, air-gapped ✓ | 1-Billion-Parameter-Klasse |
Zum Vergleich: Die bekannteste deutsche On-Prem-Appliance liefert ein 24-Milliarden-Parameter-Modell auf einer GPU. Der Starter-Bus bringt ein 1-Billion-Parameter-Modell auf acht GPUs — dieselbe Hardware-Familie, das ~40-fache Modell.
Preise
Schritt 1 · Bus wählen
Schritt 2 · Paket wählen
🔒 Ein Stromkabel, ein Datenkabel — dediziertes VLAN, kein Funk, kein Internet-Uplink. Der Bus verlässt Ihr Gelände mit einer kundeneigenen, verifizierbar gelöschten NVMe-Kassette.
Compliance
Für Kanzleien, Kliniken und Versicherer: Ihre Daten bleiben physisch auf Ihrem Gelände. AVV (Art. 28 DSGVO) und §203-Verpflichtungserklärung liegen unterschriftsreif vor — ein Termin, zwei Unterschriften.
Ein Pilot ist keine kritische Auslagerung: kein US-Subprozessor, keine Datenübertragung, Audit vor Ort jederzeit möglich. Dokumentation für Ihr IKT-Register liefern wir mit.
Ein air-gapped Server auf Ihrem Gelände ist keine Cloud-Dienstleistung — der BSI-C5-Katalog greift gar nicht erst. Beschaffung als einfacher Dienstleistungsvertrag statt Cloud-Ausschreibung.
FAQ
Eine rote CEE-32A-Drehstromdose (Standard in Produktion und Werkstatt) für den Starter-Bus. Ist keine vorhanden, installiert ein Elektriker sie vorab für wenige hundert Euro — das organisieren wir als Teil des Onboardings. Der Flagship-Bus benötigt CEE 63A.
Nein — und das ist der Punkt. Das System arbeitet vollständig offline. Die einzige Datenverbindung ist ein Kabel in ein von Ihrer IT kontrolliertes VLAN. Modell-Updates spielen wir im Depot ein, nie beim Kunden.
Der Starter-Bus bedient typische Büro-Nutzung von 100–300 Mitarbeitenden; der Flagship-Bus 500 und mehr. Die Antwortgeschwindigkeit liegt für jeden Nutzer über der eigenen Lesegeschwindigkeit.
Ihre Dokumente und Indizes liegen auf einer kundeneigenen NVMe-Kassette, die beim Abschied bei Ihnen bleibt. Alles Übrige wird protokolliert und verifizierbar gelöscht — das Löschprotokoll gehört zur Übergabe.
Aktuell Kimi K2.6 (Starter) bzw. Kimi K3 (Flagship) — offene Modelle der GPT-5.5-Klasse. Offene Modelle entwickeln sich monatlich weiter; bei einer Festinstallation halten wir Ihr Modell auf Wunsch aktuell.
Perfekt — genau dafür ist der Pilot da. 50 % der Pilotgebühr rechnen wir bei Beauftragung einer Festinstallation innerhalb von 90 Tagen an. Die Hardware verkaufen wir zum Einkaufspreis plus transparenter 10–15 %-Pauschale.