Methodik und Transparenz

GPUs.io hat das Ziel, den Vergleich von Cloud-GPU-Preisen zu erleichtern. Hier erfahren Sie, wie die Daten erfasst und präsentiert werden und worauf Sie achten sollten.

Zuletzt aktualisiert: 29. Juli 2026

Was wir vergleichen

Wir konzentrieren uns auf On-Demand-Cloud-GPU-Instanzen und versuchen, Preise konsistent darzustellen, damit Anbieter direkt verglichen werden können.

Preise und Verfügbarkeit können sich schnell ändern. GPUs.io ist nach bestem Bemühen und wird wie besehen bereitgestellt. Überprüfen Sie den endgültigen Preis immer auf der Anbieterseite, bevor Sie kaufen.

Datenquellen

Wir erfassen Preis- und Konfigurationsdaten aus öffentlich zugänglichen Quellen wie Anbieterdokumentation, Preisseiten und Anbieter-APIs, sofern verfügbar.

Wenn ein Anbieter mehrere Preispunkte veröffentlicht (Regionen, Rabatte für Laufzeitverträge, Spot-Preise, Aktionsguthaben), priorisieren wir generell die vergleichbarsten On-Demand-Preise.

Normalisierung

Anbieter beschreiben SKUs unterschiedlich (GPU-Bezeichnung, VRAM, CPU/RAM-Bundles, pro Stunde vs. pro Monat). Wir normalisieren, wo möglich, um konsistentes Filtern und Sortieren zu ermöglichen.

  • Einheiten: Preise werden typischerweise als Stundentarife angezeigt. Wenn Anbieter monatliche Preise veröffentlichen, rechnen wir auf Stundenbasis um, sofern das Abrechnungsmodell des Anbieters bekannt ist.
  • GPU-Zuordnung: Wir ordnen Hersteller-/Modellnamen einem kanonischen GPU-Typ zu, um Probleme durch gleiche GPU mit unterschiedlichen Bezeichnungen zu vermeiden.
  • Bundles: Viele Instanzen bündeln GPU + CPU + RAM. GPUs.io vergleicht die Instanz als Ganzes; wir versuchen nicht, einen GPU-Einzelpreis zu ermitteln.

Sortierung und Filterung

Die Sortierung basiert typischerweise auf der gewählten Preismetrik (z. B. Stundenpreis). Filter schränken die sichtbaren Instanzen/Anbieter nach Attributen wie GPU-Typ und Schlüsselspezifikationen ein.

Wenn zwei Einträge gleich erscheinen, kann es versteckte Unterschiede geben (Region, Netzwerk, Speicher, Mindestabrechnung, Steuern/MwSt.).

VRAM-Schätzungen für LLMs

GPU-Seiten listen beliebte Open-Weight-LLMs und den VRAM, den sie unserer Schätzung nach benötigen. Die Größe der Gewichte wird aus den Dateien des veröffentlichten Checkpoints auf Hugging Face gemessen und nicht aus der Parameterzahl berechnet — parameterbasierte Rechnungen sind bei Modellen in neueren quantisierten Formaten unzuverlässig. Ein Checkpoint, dessen gemessene Größe zu keiner uns bekannten Präzision passt, wird zurückgehalten statt geschätzt veröffentlicht.

Zu den Gewichten addieren wir 20 % für KV-Cache, Aktivierungen und Framework-Overhead, ausgehend von kurzen Kontextlängen. Lange Kontexte, große Batches, spekulatives Decoding und der parallele Betrieb mehrerer Modelle benötigen mehr. Größen für eine Präzision, in der ein Modell nicht veröffentlicht wurde (etwa eine 4-Bit-Version einer 16-Bit-Veröffentlichung), schätzen wir aus gemessenen Community-Quantisierungen und runden auf. Ein Modell, dessen Gewichte passen, dessen Overhead aber nicht, wird als knapper Fit ausgewiesen — mit dem Puffer, den diese Konfiguration tatsächlich lässt: Es lädt, aber ein langer Kontext oder ein großer Batch kann den Speicher trotzdem sprengen.

Ein „×N“-Wert bedeutet, dass das Modell in den gesamten VRAM von N dieser GPUs passt. Er sagt nichts über die Bandbreite der Verbindung aus, die wir nicht erfassen und die darüber entscheidet, ob die Aufteilung eines Modells auf mehrere Karten tatsächlich schnell ist. Betrachten Sie jede Angabe als Ausgangspunkt und prüfen Sie sie vor einer Buchung.

Aktualisierungsrhythmus

Wir aktualisieren Anbieterdaten fortlaufend. Einige Quellen aktualisieren sich sofort, andere mit Verzögerung. Die Website kann einen Zeitstempel der letzten Aktualisierung anzeigen, falls verfügbar.

Einschränkungen und Hinweise

  • Regionale Preise: Derselbe SKU kann je nach Region/Zone variieren.
  • Verfügbarkeit: Preise können veröffentlicht sein, auch wenn vorübergehend keine Kapazität verfügbar ist.
  • Steuern/Gebühren: MwSt., lokale Steuern und Übertragungsgebühren sind oft nicht in den veröffentlichten Stundentarifen enthalten.
  • Spot / preemptible: Wir vermeiden generell die Vermischung von Spot-Preisen mit On-Demand-Vergleichen, sofern nicht klar gekennzeichnet.
  • Serverless: Sekundengenaue Preise, die auf null skalieren, werden zum Vergleich als Stundenäquivalent dargestellt. Sie sind kein Stundenpreis für eine laufende Instanz — du zahlst nur während einer Anfrage, und Kaltstarts kosten zusätzlich Zeit.

Möchten Sie eine Korrektur melden? Schreiben Sie an [email protected] mit einem Quellenlink.