Hosting · Wie Sie DripBack in Betrieb bekommen

Sie brauchen keine Hardware. Wir hosten alles.

DripBack ist Hosted-SaaS auf unseren dedizierten deutschen Servern (Hetzner Frankfurt, RTX-5090-GPUs). Sie bekommen Zugang über Web-Login, Telefon-Number-Forwarding, IMAP-Anbindung. Optional: für Kunden mit strengen Datenschutz-Anforderungen bauen wir dedizierte On-Premise-Hardware (Dual-RTX-5090-Workstation), die wir bei Ihnen installieren und remote betreuen.

Zwei Wege · DripBack in Betrieb

Hosted-SaaS oder On-Premise. Sie wählen.

Option B · On-Premise · Custom-Hardware

Wir bauen. Sie betreiben.

Für Kunden mit strengsten Datenschutz-Anforderungen (Berufsgeheimnis, Anwalt, Steuerberater, Healthcare): wir custom-builden eine GPU-Workstation und installieren sie bei Ihnen. Daten verlassen NIE Ihr Gebäude.

  • Custom-Build: Dual RTX 5090 32GB in Verbund · 256GB RAM · NVMe
  • Vor-Ort-Installation in Ihrem Server-Raum · 1 Tag Aufwand
  • Remote-Wartung via Wireguard-VPN · keine ständige Cloud-Verbindung nötig
  • 100% Air-Gap-Option: komplett offline-fähig wenn gewünscht
  • Daten-Souveränität absolut: Berufsgeheimnis-konform für Anwälte/Ärzte
  • Garantie + Support 36 Monate · Hardware-Tausch im Defekt-Fall
  • Schulung Ihres IT-Teams oder Wartungsvertrag mit uns
  • Skalierbar lokal: bis 200 parallele Anrufe / 50k Mails/Tag
Preise · On-Premise
ab 12.500 € einmalig · Hardware + Setup
ab 499 € / Monat · Wartungsvertrag (Pflicht)

Pilot-Phase (erste 3 Monate) reduziert auf 299 €/Monat, danach Standard-Tarif. Wartung umfasst: Security-Updates, Modell-Updates, Remote-Support 4h SLA, Hardware-Garantie 36 Monate.

Warum Pflicht? On-Premise-Hardware in regulierter Umgebung (Anwalt, Arzt, Steuerberater) muss permanent gepatcht und überwacht werden. Ein ungewarteter LLM-Server ist ein Compliance-Risiko — wir liefern keine ungewarteten Systeme aus.

On-Premise · Wie wir bauen

Zehn Schritte. Ein dedizierter AI-Server bei Ihnen vor Ort.

Scrollen Sie durch, der Server-Rack rechts wird mit jedem Schritt weiter zusammengebaut. Custom-Hardware, Burn-in-Test, Provisioning, Übergabe.

01 · Chassis

4U Tower · Tempered Glass + EMI-Schirmung

Wir starten mit einem robusten 4U-Tower-Case. Tempered-Glass-Fenster für Durchsicht, komplett EMI-geschirmt (Stahlinnengehäuse), Fußrollen für flexibles Platzieren im Server-Raum oder Büro. Gehäuse-Maße optimiert für dichte Komponenten-Anordnung.

02 · Seitenpanel ab

Werkzeuglos geöffnet · Innenraum frei

Das Seitenpanel wird abgenommen — der Blick auf den leeren, EMI-geschirmten Innenraum ist frei. Ab hier wird jede Komponente in dokumentierter Reihenfolge verbaut; jeder Schritt wird im Build-Protokoll festgehalten.

03 · Mainboard

ASUS WRX90E-SAGE · 8× DIMM + 7× PCIe 5.0

Premium-Workstation-Mainboard für Threadripper PRO. 8 DIMM-Slots für bis zu 256 GB DDR5-ECC, 7 volle PCIe-5.0-x16-Slots (single-lane-tauglich), 10G-Ethernet, IPMI+BMC für Out-of-Band-Management, integrierte Spannungsregler (VRM) für Multi-GPU-Last.

04 · CPU

AMD Threadripper PRO · 24 Kerne/48 Threads

AMD Threadripper PRO 7965WX (sTR5) wird in den Sockel eingesetzt — Schutzkappe ab, CPU rein, Retention-Rahmen zu. Genug parallele Lanes und Kerne für STT/TTS-Worker neben der LLM-Inferenz.

05 · CPU-Kühler

Dual-Tower · 6 Heatpipes · low-RPM

Noctua-Dual-Tower mit vernickelter Bodenplatte setzt direkt auf die CPU auf — Wärmeleitpaste, Anpressdruck über Kreuz angezogen. Low-RPM ausgelegt für Serverraum-Akustik im Dauerbetrieb.

06 · RAM

8× DDR5-ECC RDIMM · 256 GB total

Kingston Server Premier DDR5-5600 ECC, 8× 32 GB Module (Quad-Channel). ECC-Bitflip-Korrektur für 24/7-Dauerlast (kritisch bei Inferenz-Worker). Alle Module Single-Rank, low-power (1.1V), getestet auf Kompatibilität mit ASUS WRX90E + Threadripper.

07 · NVMe Storage

2× Samsung 990 Pro 4 TB · RAID-1

Zwei NVMe-SSDs im RAID-1-Mirror (2+2 TB Kapazität). Samsung 990 Pro mit PLP (Power-Loss-Protection), bis 7.100 MB/s, ≤3 DWPD Endurance. Hardware-RAID über Mainboard-Chip, Konversations-Logs + lokale Vault-DB, Verschlüsselung am Rest (LUKS auf /dev/md0).

08 · GPUs

2× NVIDIA RTX 5090 · 64 GB VRAM total

Zwei NVIDIA RTX 5090 in PCIe-5.0-Slots (je 32 GB GDDR7). Kosten-optimierte Variante für Multi-User-Inferenz mit lokalen LLMs (32B Modelle + Embeddings). Alternative: RTX A5000 24 GB (Workstation-SKU mit Pro-Treiber, für regulierte Branchen). Triple-Fan-Kühlung, 12VHPWR-Stromanschlüsse.

09 · Netzteil + Verkabelung

Corsair AX1600i · Fully Modular · 80+ Titanium

Redundantes 1.600W-Netzteil (80+ Titanium-Zertifizierung, 93% Effizienz bei voller Last). Alle Spannungsschienen stabilisiert (±3% Toleranz), modulare Kabelanschlüsse (PCIe 12VHPWR, 24-pin ATX, Sata). Sauberes Kabelmanagement mit Nylon-Sleeving, Airflow-optimiert.

10 · Lüfter + Airflow

3× be quiet! Silent Wings · Front-to-Back-Strömung

3 PWM-Lüfter (120 mm be quiet! Silent Wings 3, max 1.500 RPM, 54 dB(A)). Front-Intake + Top/Rear-Exhaust für stabilen Front-to-Back-Airflow. Temperatur-Sensoren an CPU-Sockel + GPU-Shroud triggern automatische Regelung (hysteretisch, 3°C Deadband gegen Flattern).

11 · Burn-in Test 72h

Labor-Validierung vor Versand

Nach Zusammenbau: 72-Stunden-Belastungstest im DripBack-Test-Lab. Prime95 auf allen CPU-Kernen, FurMark auf beide GPUs, 50% RAM-Last mit Memtest86. Logging: CPU-Temp, GPU-Temp, PSU-Rails, Fan-RPM. Bei Ausfällen: Komponenten-Tausch, Neutest. Test-Report (PDF, signiert) folgt mit Hardware.

12 · Provisioning + Übergabe

OS-Setup · Modelle geladen · Maintenance-Schlüssel

Vor Versand: Ubuntu Server 24.04 LTS installiert, NVIDIA-Treiber + CUDA 12.x, lokales LLM auf Ollama geladen (14B Basis-Variante), Vault-DB initialisiert, Wireguard-VPN-Schlüssel hinterlegt. Terminal-Logs der Provisioning-Schritte auf USB-Stick (Air-Gapped). 36-Monate-Garantie- Siegel + Übergabe-Checkliste (SLA, Kontakte, Notfall-Nummern). Erste Remote-Wartung: Q4 oder bei Bedarf.

Hosting-Details

Was unter der Haube läuft.

Vier Säulen unserer Infrastruktur , gilt sowohl für Hosted-SaaS als auch für On-Premise-Builds.

⌑ GPU-Stack

NVIDIA RTX 5090 · 64 GB VRAM

Dedizierte GPUs für Inferenz. 2× RTX 5090 in On-Premise-Builds (je 32 GB GDDR7). Alternativ: RTX A5000 Workstation für regulierte Branchen. Sub-1.5s Latenz für Phone-Anwendungen.

⌑ Modelle

Lokales LLM + Cloud-Routing

Lokales LLM auf Ollama (14b/32b Basisvarianten), Cloud-Fallback für spezialisierte Tasks (Code-Gen, Vision). STT via faster-whisper, TTS via VoxCPM2. Modulare Modell-Wahl pro Use-Case.

⌑ Compliance

DSGVO + BDSG + AVV

Hosting ausschließlich in DE. AVV-Vertrag mit jedem Kunden. Berufsrecht-Sonder-Setups für Anwalt/Arzt verfügbar. Audit-Logs 90 Tage aufbewahrt.

⌑ Support

4h Response · Mo-Fr

Direkter Zugang zu Tech-Lead Timo. Kein Call-Center, keine Eskalationsstufen. Antwort auf Tickets typisch unter 4h, garantiert unter 24h. Wochenendsupport on-call bei Pro/Enterprise.

Funktions-Matrix

Alle Module · Alle Hosting-Modelle.

Jedes Modul läuft sowohl in Hosted-SaaS als auch auf On-Premise-Hardware. Sie können später zwischen beiden Modi migrieren , kein Lock-in.

Modul Hosted-SaaS On-Premise Latenz typ. Kapazität
AI-Receptionist · Phone ✓ ab 699€/mo ✓ included 1.0-1.4s 1.000 parallele Calls
E-Mail-Triage ✓ ab 599€/mo ✓ included ~0.84s / 87 Mails 100k Mails/Tag
Workflow-Bundle (Buchh. · Einkauf · Kalender) ✓ ab 699€/mo ✓ included 60s/Beleg → DATEV 10k Belege/Monat
Websites-on-Demand ✓ Setup 2.500€ · Wartung 349€/mo via Hosted-SaaS 30-60s/Mockup Vercel-DE skaliert
Custom-AI ✓ Preis auf Anfrage · Wartung ab 449€/mo ✓ Custom-Build je Use-Case je Use-Case
60-Min Discovery-Audit

Welcher Pfad passt zu Ihnen?

Wir besprechen Ihren Pain-Point, klären Compliance-Anforderungen (Berufsgeheimnis ja/nein, Datenschutz-Level) und empfehlen ehrlich Hosted-SaaS oder On-Premise-Hardware. Kostenlos, 60 Minuten.

Audit anfragen →