Zum Inhalt springen
S

Scaleway: KI-Tool Test & Bewertung

4.5
Hosting & Cloud Kostenpflichtig Serverless ab 0,15 € pro Mio. Token (Mistral Small), Gratis-Kontingent 1 Mio. Token, dedizierte GPUs ab 0,93 € pro Stunde Cloud DSGVO-konform

Scaleway ist ein französischer Cloud-Anbieter der Iliad-Gruppe und stellt mit den Generative APIs vortrainierte Open-Source-Sprachmodelle über eine OpenAI-kompatible Schnittstelle bereit. Die Inferenz läuft in einem Rechenzentrum in der Region Paris, abgerechnet wird pro Token. Wer konstante Last oder ein eigenes Modell hat, kann über Managed Inference dedizierte GPUs buchen.

Zuletzt aktualisiert: 15. Juli 2026

Viele deutsche Unternehmen suchen eine KI-Schnittstelle, die vertraglich in der EU bleibt und nicht über eine US-Konzernmutter dem amerikanischen CLOUD Act unterliegt. Scaleway gehört zum französischen Iliad-Konzern und betreibt eigene Rechenzentren in Frankreich, den Niederlanden und Polen. Die KI-Inferenz der Generative APIs läuft in Paris, sodass Anfragen und Antworten innerhalb der EU bleiben.

Wichtigste Funktionen

  • OpenAI-kompatible API: Bestehender Code mit der OpenAI-Bibliothek funktioniert sofort weiter. Nur Base-URL und API-Schlüssel tauschen, kein Refactoring nötig. Das macht den Wechsel von US-Diensten unkompliziert.
  • Generative APIs (Serverless): Open-Source-Modelle wie GLM 5.2, Mistral Large 3, Mistral Small und Qwen 3.6 für Chat, Coding und Textverarbeitung. Sie zahlen pro Token, ohne eigene GPU-Server zu betreiben oder Modelle aktuell zu halten.
  • Managed Inference (dediziert): Für konstante Last oder eigene Modelle lassen sich dedizierte GPUs mit festem Stundenpreis buchen, von der L4 für kleinere Modelle bis zur H100 für große. Das Modell läuft isoliert auf reservierter Hardware.
  • Reines Open-Weight-Portfolio: Scaleway hostet die Modelle selbst auf eigener Infrastruktur und reicht Anfragen nicht im Hintergrund an OpenAI, Google oder Anthropic weiter. Damit hält die Aussage zur EU-Datenresidenz für jedes angebotene Modell.
  • Sprach- und Embedding-Modelle: Whisper für die Audiotranskription sowie mehrsprachige Embedding-Modelle als Bausteine für eine semantische Suche und RAG-Systeme.
  • Zero Data Retention: Übermittelte Inhalte werden standardmäßig nicht gespeichert und nicht zum Training der Modelle verwendet.

Preise und Tarife

Scaleway rechnet die Generative APIs token-basiert ab, mit einem kostenlosen Startkontingent von 1 Mio. Token und 60 Audiominuten. Die Preise je Modell unterscheiden sich nach Größe. Mistral Small 3.2 liegt bei 0,15 € und 0,35 € pro Mio. Token, GLM 5.2 bei 1,80 € und 5,50 €, Mistral Medium 3.5 bei 1,50 € und 7,50 €. Die Audiotranskription mit Whisper kostet 0,003 € pro Minute, Embeddings 0,10 € pro Mio. Eingabe-Token.

Für Managed Inference fällt ein Stundenpreis je GPU an, unabhängig von der Tokenzahl. Eine L4 mit 24 GB beginnt bei 0,93 € pro Stunde, eine L40S bei 1,72 €, eine einzelne H100 mit 80 GB bei 3,40 € und eine Maschine mit acht H100 bei 30,06 € pro Stunde. Diese Variante lohnt sich bei gleichmäßig hoher Auslastung oder wenn ein eigenes, feinjustiertes Modell laufen soll.

Für wen ist Scaleway geeignet?

  • Unternehmen mit hohen Datenschutzanforderungen: Wer eine KI-API braucht, deren Inferenz nachweislich in der EU bleibt und deren Anbieter keiner US-Mutter untersteht, bekommt mit Scaleway einen vollständig europäischen Rechtsträger mit AVV und ISO-27001-Zertifizierung.
  • Entwickler und Teams beim Wechsel von OpenAI: Die OpenAI-kompatible API macht die Umstellung bestehender Anwendungen einfach. Wer bereits mit n8n oder AnythingLLM arbeitet, kann Scaleway als europäisches Backend einsetzen.
  • Teams mit konstanter Last oder eigenen Modellen: Über Managed Inference bekommen sie dedizierte GPUs zum festen Stundenpreis und können auch feinjustierte Open-Source-Modelle betreiben, ohne eine eigene GPU-Infrastruktur aufzubauen.

DSGVO und Datenschutz

Scaleway SAS hat seinen Sitz in Paris und gehört zur französischen Iliad-Gruppe, ohne US-Muttergesellschaft. Die Inferenz der Generative APIs läuft in einem Rechenzentrum in der Region Paris, Anfragen und Antworten bleiben damit in der EU. Übermittelte Inhalte speichert Scaleway standardmäßig nicht (Zero Data Retention) und nutzt sie nicht zum Training der Modelle. Ein Auftragsverarbeitungsvertrag (AVV), technische und organisatorische Maßnahmen sowie ein SLA stehen als Vertragsdokumente bereit. Die Plattform ist nach ISO 27001:2022 und für das Gesundheitswesen nach HDS zertifiziert. Die französische SecNumCloud-Qualifizierung durchläuft Scaleway aktuell, erteilt ist sie noch nicht. Nach eigener Darstellung unterliegt Scaleway als europäisches Unternehmen nicht dem US CLOUD Act. Für Firmen mit strengen Datenschutzanforderungen ist das eine der wenigen KI-Schnittstellen mit durchgängig europäischer Rechtsträgerschaft.

Alternativen zu Scaleway

  • IONOS AI Model Hub: Deutsche Alternative mit Servern in Deutschland und integrierter Vektor-Datenbank für RAG, ebenfalls OpenAI-kompatibel und token-basiert.
  • Infomaniak AI Tools: Schweizer Anbieter mit Open-Source-Modellen in Genf und Zürich, sinnvoll, wenn die Daten in der Schweiz statt in der EU liegen sollen.
  • Hetzner: Günstiger, wenn Sie Modelle selbst auf GPU-Servern installieren und betreiben möchten. Mehr Kontrolle, aber auch deutlich mehr Konfigurationsaufwand.

Vorteile

  • Vollständig europäischer Anbieter (Iliad-Gruppe, Paris), keine US-Muttergesellschaft und kein CLOUD-Act-Risiko
  • KI-Inferenz ausschließlich in Paris, Anfragen und Antworten verlassen die EU nicht
  • Nur selbst gehostete Open-Source-Modelle, keine Weiterleitung an US-APIs im Hintergrund
  • OpenAI-kompatible API, bestehender Code läuft nach Wechsel von Base-URL und Schlüssel weiter
  • Zero Data Retention und AVV, zertifiziert nach ISO 27001 und HDS

Nachteile

  • Generative APIs laufen aktuell nur in Paris, keine geografische Ausfallredundanz für die KI-Endpunkte
  • Französische SecNumCloud-Qualifizierung noch im Verfahren, nicht erteilt
  • Deutschsprachiger Support und deutsche Vertragssprache vorab klären
  • Kein Zugang zu proprietären Modellen wie GPT-4 oder Claude

Anwendungsgebiete

DSGVO-konforme KI-API mit EU-DatenresidenzMigration bestehender OpenAI-Anwendungen ohne Code-UmbauDedizierte GPU-Inferenz für eigene oder feinjustierte ModelleSprach- und Embedding-Modelle für RAG-Systeme