Inferenz und RAG
Sechs NVIDIA-GPUs in der Schweiz. Datasets und Secrets im Land.
Hikube für KI stellt sechs dedizierte NVIDIA-GPUs (L4, L40S, A100-80, RTX 6000 Pro, H100, H200) auf VMs oder Kubernetes bereit, mit Object Storage und Vault in derselben Schweizer Jurisdiktion: für Modelle und Daten, die das Land nicht verlassen dürfen. Alle sechs Karten sind in der 14-Tage-Trial.
- 1. Korpus auf S3
- 2. Schlüssel in Vault
- 3. GPU angebunden
- ISO 27001
- 3 RZ
- SLA 99,99 %
Für Teams, die in der Schweiz trainieren oder inferieren: dieselben sechs Karten auf isolierter VM oder Kubernetes-Node-Gruppe. GPU Operator installiert Treiber und Device-Plugin. HAMi, optional, teilt eine Karte auf Pods und braucht GPU Operator. Keine CNCF-AI-Conformance. Katalog: den GPU-Katalog. 14-Tage-Trial.
Pfad
01
1. Korpus auf S3
Dokumente und Checkpoints in einem Schweizer Bucket. Object Lock, wenn der Korpus unveränderlich bleiben muss, Verschlüsselung pro Bucket.
02
2. Schlüssel in Vault
Modellschlüssel, DB-Zugänge und API-Token in Vault as a Service, nicht im Manifest. Images in der privaten Registry.
03
3. GPU angebunden
Gleicher Katalog. Auf K8s: GPU Operator, optionales HAMi. Worker automatisch verteilt, keine RZ-Wahl.
04
API
Provisioning per API und Konsole. Terraform: in Vorbereitung.
Im Detail
Alle sechs Katalogkarten: L4 24G (165 CHF/Monat), L40S 48G (760), A100-80 (1495), RTX 6000 Pro 96G (1550), H100 80G (1999), H200 141G (2499). Publizierte Produktionspreise. Die 14-Tage-Trial ohne Kreditkarte umfasst sie. Ein Ingenieur dimensioniert Modell, Dauer und VPC. Drei CH-RZ, Hidora SA. Die HA-Kapazitätsgarantie im Normalbetrieb gilt nicht für GPUs.
VM für isolierte Data Scientists oder lange Jobs. Kubernetes für Sharing, Autoscaling und Addons. Gleicher Kartenkatalog, gleiche Jurisdiktion. Auf dem Managed Cluster: GPU Operator (optionales Addon) installiert NVIDIA-Treiber und Device-Plugin. HAMi, ebenfalls optional, virtualisiert eine Karte auf Pods und braucht GPU Operator. Hikube verteilt Worker über Genf, Gland und Luzern: Sie platzieren Nodes nicht RZ für RZ. Plattform-Detail: die Kubernetes-Plattform.
S3 Object Storage in der Schweiz. Zugangs-Secrets im Vault. Images in Registry as a Service, nicht GHCR oder ECR standardmässig. Ein us-east-1-Checkpoint bricht die Job-Souveränität. Produkte: den S3-Objektspeicher, den Secrets-Vault, die Image-Registry.
Hidora SA betreibt die RZ, GPU-Anbindung, die Kubernetes-Control-Plane falls genutzt, und Support FR/EN. Sie behalten Images, Checkpoints, Trainingscode, Pod-Topology-Spread und die Wahl VM vs Node-Gruppe. Terraform-Integration in Vorbereitung: heute Hikube-API und Konsole. Keine CNCF-AI-Conformance.
Inferenz in der Schweiz auf Daten, die nicht raus dürfen. Fine-Tuning auf internen Datasets. Batch-Jobs auf VMs. Kartenteilung via HAMi auf Kubernetes. Das ist kein weltweiter Katalog mit Tausenden GPUs und kein opakes ML-PaaS.
Sechs publizierte SKUs, keine Farm. L4 24G (165 CHF/Monat): Inferenz und Vision auf kleinen Modellen. L40S 48G (760): grössere Inferenz, Rendering. A100-80 (1495): Fine-Tuning und Training. RTX 6000 Pro 96G (1550): mehr VRAM, Workstation-Profil. H100 80G (1999): anspruchsvolleres Training. H200 141G (2499): mehr Speicher für lange Kontexte. Keine Tokens/s, keine IOPS. Der Ingenieur kalibriert in der Trial. Katalog: den GPU-Katalog.
Checkpoints, Gewichte und kalte Sets: S3 Object Storage in der Schweiz. Zugangs-Secrets im Vault, kein US-KMS. Für Scratch-Disk an VM oder Pod: Netzwerk-NVMe-Volumes, immer geo-redundant über Genf, Gland und Luzern, synchrone (Echtzeit) oder asynchrone (bessere Leistung) Replikation. Sync und Async haben nicht dasselbe RPO; wir publizieren weder Zahl noch IOPS. Kein nicht repliziertes lokales Block-Volume. Produkte: den S3-Objektspeicher, den Block-Storage, den Secrets-Vault.
Nein. Hikube verteilt Worker, inklusive GPU-Node-Gruppen, automatisch über Genf, Gland und Luzern. Sie wählen das RZ nicht. Topology-Spread und PodDisruptionBudget für Pods bleiben Ihre. Die HA-Kapazitätsgarantie im Normalbetrieb gilt nicht für GPUs: eine Karte ist kein austauschbarer CPU-Worker. Plattform-Detail: die Kubernetes-Plattform.
Nein. Terraform- und Cluster-API-Integration in Vorbereitung. Heute: Hikube-API und Konsole. kubectl, Helm und S3-Clients bleiben. Ein Pflichtenheft, das Terraform heute in Produktion verlangt, passt noch nicht zum Katalog. Ein Ingenieur sagt das beim Rahmen der Trial.
Wenn Modell oder Dataset Schweizer Gesundheitsdaten berührt, ist der Rahmen das nDSG, nicht HDS. Hikube ist kein HDS-Hoster und nicht HDS-zertifiziert. Datasets, Checkpoints und Backups bleiben in Genf, Gland und Luzern. Ein US-Bucket zerstört das Dossier. Gesundheitsseite: das Gesundheitswesen. Engineer-Support FR/EN.
Passende Produkte
GPU-CloudSechs dedizierte NVIDIA-Karten, 24 bis 141 GB.
Managed KubernetesDediziertes Managed Kubernetes in der Schweiz, Worker in Ihrem Tenant.
Schweizer S3S3 Object Storage in der Schweiz: WORM, optionale Verschlüsselung, Residenz Schweiz.- Vault as a ServiceSecrets und Schlüssel in der Schweiz, für Apps, CI und Kubernetes.
Häufige Fragen
L4, L40S, A100-80, RTX 6000 Pro, H100, H200. Publizierte CHF/Monat-Preise. Stündlich oder monatlich. Alle sechs in der 14-Tage-Trial.
Nein. Sie sind in der 14-Tage-Trial.
Ja, als optionale Addons auf Managed Kubernetes. HAMi braucht GPU Operator. Details: die Kubernetes-Plattform.
Terraform- und Cluster-API-Integration in Vorbereitung. Heute: Hikube-API und Konsole.
Nein. Hikube verteilt Worker automatisch über Genf, Gland und Luzern. Topology-Spread und PDBs für Pods bleiben bei Ihnen.
Nein. Hikube Managed Kubernetes ist Certified Kubernetes Hosted. Hidora SA ist KCSP. Wir beanspruchen keine CNCF-AI-Conformance.
Engineer-Support auf Französisch und Englisch, aus Genf.
Bereit für 100 % Schweizer Infrastruktur?
14-Tage-Trial, keine Karte. GPUs inklusive.
