Ihre massgeschneiderte KI-Maschine, in der Schweiz zusammengebaut.
GPU-Workstations und -Server für künstliche Intelligenz : LLM-Inferenz, Fine-Tuning, Bildgenerierung, Data Science. Dimensioniert nach Ihrem VRAM und Ihren Modellen. Personalisierte Offerte innert 24 h.
- NVIDIA-GPU für Profis & Consumer — von der RTX 5090 bis zur RTX PRO 6000 (bis zu 96 GB VRAM)
- Leiser Tower oder Rack-Gehäuse (2U–4U) für Rechenzentrum und Multi-GPU
- Kühlung & Netzteil dimensioniert für GPU-Lasten im 24/7-Betrieb
- In der Schweiz zusammengebaut, getestet & betreut — 2 Jahre Garantie, MwSt-Rechnung
Maschinen, die für GPU-Last konzipiert sind — keine zusammengebastelten PCs.
Eine KI-Station läuft stundenlang unter Volllast. Komponenten, Kühlung und Netzteil sind auf Dauerstabilität ausgelegt — und alles wird in unserer Werkstatt in der Schweiz montiert und getestet.
Der richtige GPU für Ihr VRAM
Das VRAM entscheidet, welche Modelle Sie laden können. Wir empfehlen Ihnen den richtigen NVIDIA-GPU (RTX 5090, RTX PRO 6000…) nach Ihren realen Modellen, ohne zu viel zu bezahlen.
Kühlung für den 24/7-Betrieb
Optimierter Airflow, Netzteil in Serverqualität und Rack-Option für Multi-GPU. Ausgelegt, um längere Trainingslasten ohne Throttling zu bewältigen.
Daten, die in der Schweiz bleiben
Eine lokale KI (On-Premise) bedeutet, dass Ihre Daten Ihre Infrastruktur nicht verlassen. Ideal für Vertraulichkeit, Compliance und Souveränität.
Einsatzbereit
Auf Wunsch : Vorinstallation der Umgebung (CUDA, Treiber, Python, Ollama, ComfyUI…), damit Sie Ihre Modelle direkt nach dem Auspacken starten können.
Massgeschneidert, erweiterbar
Mainboard und Netzteil so gewählt, dass Sie später einen 2. GPU oder RAM hinzufügen können. Sie investieren einmal und erweitern danach.
Ein technischer Ansprechpartner
Sie sprechen mit jemandem, der KI versteht, nicht mit einem Verkäufer. 2 Jahre Garantie auf Teile und Arbeit, direkter Support in der Schweiz.
Wie viel VRAM für welche KI-Nutzung ?
Der Videospeicher (VRAM) des GPU ist das Kriterium Nr. 1 einer KI-Maschine : Er bestimmt die Grösse der Modelle, die Sie laden können. Hier unsere Richtwerte. Nicht sicher ? Wählen Sie im Formular « auf Anraten », wir kümmern uns um die Dimensionierung.
| VRAM | Was Sie tun können | Typische GPU |
|---|---|---|
| 16 GB | Bildgenerierung (Stable Diffusion, SDXL), kleine quantisierte LLM (bis ~8B), Prototyping. | RTX 5070 Ti / 5080 |
| 24–32 GB | Lokale LLM-Inferenz 7–32B, leichtes Fine-Tuning (LoRA), hochauflösende Bildgenerierung, Vision. | RTX 5090 |
| 48 GB | Grosse quantisierte Modelle 30–70B, ernsthaftes Fine-Tuning, kontinuierliche Profi-Workloads. | RTX PRO 6000 (48 GB) |
| 96 GB & Multi-GPU | Modelle 70B+ in voller Präzision, Training, On-Premise-Bereitstellung für mehrere Benutzer. | RTX PRO 6000 96 GB / 2–4 GPU |
Richtwerte (2026). Der reale Bedarf hängt von der Quantisierung (4-Bit, 8-Bit, fp16), der Kontextlänge und dem gewünschten Durchsatz ab. Das feinen wir gemeinsam anhand Ihres Formulars ab. Sie können auch unsere Profi-PCs, unsere Gaming-PCs (hervorragend für Inferenz und Stable Diffusion) erkunden oder Ihre Basis mit dem Online-Konfigurator zusammenstellen.
Von Ihrem Bedarf zu Ihrer Maschine.
Sie beschreiben
Nutzung, VRAM, Modelle, Format, Budget. Eine Minute genügt — auch wenn Sie sich bei den Specs nicht sicher sind.
Wir dimensionieren
Ein Ingenieur schlägt Ihnen innert 24 h eine für Ihre Modelle optimierte Konfiguration vor.
Zusammenbau in der Schweiz
Sorgfältige Montage, GPU-Stresstests, optionale Vorinstallation der KI-Umgebung.
Lieferung & Support
Verfolgte Lieferung in der ganzen Schweiz, 2 Jahre Garantie, direkter technischer Support.
KI-Maschine : Ihre Fragen.
Welche Maschine, um ein LLM lokal in der Schweiz auszuführen ?
Um ein LLM lokal auszuführen (Llama, Mistral, Qwen…), ist der entscheidende Faktor das VRAM des GPU. Rechnen Sie mit etwa 24 GB für quantisierte Modelle mit 7 bis 32 Milliarden Parametern und 48 bis 96 GB für Modelle mit 70B+ oder voller Präzision. SwissHardware baut die für Ihre Modelle passende Maschine zusammen und installiert sie bei Bedarf mit Ollama oder vLLM.
Tower oder Rack : was für die KI wählen ?
Ein Tower eignet sich perfekt für einen individuellen KI-Arbeitsplatz : leise, neben dem Schreibtisch aufgestellt, 1 bis 2 GPU. Ein Rack-Gehäuse (2U–4U) ist für einen Serverraum gedacht : Dichte, Multi-GPU, 24/7-Betrieb, Integration im Rechenzentrum. Wenn Sie unsicher sind, wählen Sie im Formular « auf Anraten ».
Wie viel kostet eine massgeschneiderte KI-Maschine ?
Eine leistungsstarke KI-Station beginnt bei rund CHF 3'000–6'000 mit einem 24 GB-GPU (ideal für Inferenz und Bildgenerierung). Professionelle Konfigurationen mit grossem VRAM oder Multi-GPU steigen auf CHF 12'000–25'000 und mehr. Die Offerte ist kostenlos und auf Ihre reale Nutzung abgestimmt.
Können Sie CUDA, die Treiber und die KI-Umgebung vorinstallieren ?
Ja, auf Wunsch. Wir können die Maschine mit bereits installierten und getesteten NVIDIA-Treibern, CUDA, Python und Ihren Tools (Ollama, ComfyUI, PyTorch, vLLM…) liefern, damit Sie Ihre Modelle direkt nach dem Auspacken starten.
Warum eine lokale KI statt der Cloud ?
Eine lokale KI-Maschine hält Ihre Daten bei Ihnen (Vertraulichkeit, DSGVO/DSG-Konformität, Souveränität), eliminiert die wiederkehrenden Cloud-Kosten und bietet minimale Latenz. Langfristig ist der Kauf bei regelmässiger Nutzung oft wirtschaftlicher als die GPU-Miete.
Ist die Maschine erweiterbar (später einen GPU hinzufügen) ?
Ja. Wir wählen Mainboard, Netzteil und Gehäuse so, dass später ein zweiter GPU oder RAM hinzugefügt werden kann. Sie investieren einmal und erweitern die Maschine entsprechend dem Wachstum Ihres Bedarfs.
Unsicher bei der idealen Konfiguration ?
Sprechen Sie direkt mit einem SwissHardware-Ingenieur, Montag bis Freitag von 9 bis 18 Uhr.