Stack & Vergleiche

Azure OpenAI, AWS Bedrock, Google Vertex oder Direktzugang: Einkauf, Datenschutz, Kosten

Von Veröffentlicht 28.09.2026 Aktualisiert 28.09.2026 7 Min. Lesezeit

Kurz gesagt

Der Direktzugang bringt neue Funktionen zuerst, bei Claude aber keine EU-Verarbeitung. Über Azure, AWS oder Google kaufen Sie über Ihren Cloudvertrag ein und können die Verarbeitung auf die EU begrenzen, für rund 10 % Aufschlag. Wir wählen den Weg nach Datenklasse und bestehendem Cloudvertrag. Umsetzung ab 4.900 € netto, Stand September 2026.

Inhalt
  1. Was unterscheidet Direktzugang und Hyperscaler?
  2. Welche Modelle gibt es auf welchem Weg?
  3. Wo bleiben die Daten in der EU?
  4. Was kostet der Weg über einen Hyperscaler?
  5. Wie läuft der Einkauf, und wer ist Vertragspartner?
  6. Welchen Weg empfehlen wir wann?
  7. Was bedeutet der Weg für den Betrieb?

Dasselbe Sprachmodell lässt sich auf mehreren Wegen einkaufen: direkt beim Hersteller oder über einen der großen Cloudanbieter, die Hyperscaler. Der Weg entscheidet, wer Ihr Vertragspartner ist, wo die Daten verarbeitet werden und was ein Token kostet. Wir vergleichen die vier Wege aus Sicht eines Teams, das Lösungen baut und betreibt, mit dem Stand September 2026.

Was unterscheidet Direktzugang und Hyperscaler?

Beim Direktzugang schließen Sie den Vertrag mit Anthropic, OpenAI oder Mistral und bekommen einen API-Schlüssel, also einen Zugangsschlüssel für die Programmierschnittstelle. Neue Modelle und Funktionen kommen hier zuerst an.

Beim Weg über einen Hyperscaler kaufen Sie über Ihren Vertrag mit Microsoft, Amazon oder Google ein. Die Kosten stehen auf der bestehenden Cloudrechnung, Zugriffe steuern Sie über die Rechteverwaltung der Cloud, und der Anbieter betreibt die Modelle in seinen Rechenzentren. Laut AWS werden Eingaben und Ausgaben in Bedrock nicht mit den Modellherstellern geteilt und nicht zum Verbessern der Basismodelle genutzt. Microsoft sagt für seine Modelle in Foundry dasselbe: Prompts und Antworten sind laut Microsoft Learn weder für OpenAI zugänglich noch werden sie ohne Ihre Zustimmung zum Training genutzt. Google schließt das Training in seinen Service Specific Terms aus.

Zwei Namen haben sich geändert. Azure OpenAI heißt inzwischen „Azure OpenAI in Microsoft Foundry Models“, und Googles Vertex AI läuft als Gemini Enterprise Agent Platform. Wir bleiben im Text bei Azure, Bedrock und Google.

Welche Modelle gibt es auf welchem Weg?

Die Zeiten, in denen jedes Modell nur bei einem Hyperscaler lag, sind vorbei. Stand September 2026:

Microsoft Foundry (Azure): die GPT-Familie bis GPT-6 Astra, Sol und Luna, dazu Claude. Claude läuft dort laut Anthropic nur als Global Standard oder US Data Zone, eine EU-Datenzone für Claude gibt es nicht.

Amazon Bedrock: Claude einschließlich Fable 5.1, Opus 5.5 und Sonnet 5, laut AWS seit September 2026 auch GPT-6 Astra, Sol und Luna von OpenAI, dazu offene Modelle.

Google Agent Platform: Gemini, Claude einschließlich Opus 5.5 und Sonnet 5, Modelle von Mistral und offene Modelle wie gpt-oss oder Llama, laut Googles Tabelle zur Datenresidenz.

Direktzugang: Anthropic, OpenAI und Mistral jeweils mit dem vollen eigenen Angebot.

Wo bleiben die Daten in der EU?

Das ist die wichtigste Frage für personenbezogene Daten, und die Antworten sind feiner, als die Marketingseiten vermuten lassen.

Wege zum Modell: Direkt-API und Hyperscaler mit DatenflussIhre Anwendung auf EU-Servern schickt Anfragen über einen von vier Wegen. Direkt-API mit Vertrag beim Modellanbieter: OpenAI in der EU nach Freischaltung, Mistral standardmäßig in der EU, Claude nur global oder USA. Microsoft Foundry mit Vertrag bei Microsoft: EU-Datenzone nach EU Data Boundary inklusive EFTA-Staaten, GPT-6 Astra nicht in der EU-Zone, Claude nur global oder USA. Amazon Bedrock mit Vertrag bei AWS: EU-Profil für Claude, GPT-6 Astra in der EU nur global, Zielregionen prüfen. Google Agent Platform mit Vertrag bei Google: Multi-Region eu nur in EU-Mitgliedstaaten, unter anderem Claude Opus 5.5, Sonnet 5 und Gemini 3.8 Flash. EU-Bindung kostet meist rund 10 Prozent Aufschlag.ZUGANGSWEG UND VERTRAGWO DAS MODELL RECHNETIhre AnwendungEU-Server,WissensbasisDirekt-APIVertrag mit dem ModellanbieterAnthropic, OpenAI, MistralMicrosoft Foundry (Azure)Vertrag und Rechnung: MicrosoftGPT-6, ClaudeAmazon BedrockVertrag und Rechnung: AWSClaude, GPT-6, offene ModelleGoogle Agent PlatformVertrag und Rechnung: GoogleGemini, Claude, MistralJe nach AnbieterOpenAI: EU nach FreischaltungMistral: EU als StandardClaude: nur global oder USADatenzone EUEU Data Boundary, auch EFTAGPT-6 Sol und Luna ja, Astra neinClaude: nur global oder USAEU-Profil (Geo)Claude in EU-RegionenGPT-6 Astra in der EU nur globalZielregionen prüfenMulti-Region eunur EU-MitgliedstaatenClaude Opus 5.5, Sonnet 5Gemini 3.8 FlashEU-Bindung kostet meist rund 10 % Aufschlag auf den Listenpreis. Stand September 2026.
Vier Wege zum Modell: Vertragspartner, Datenfluss und EU-Option je Weg. Bei Mistral im Direktzugang ist die EU der Standard.

Direktzugang: Die Claude API rechnet laut Anthropic global oder auf Wunsch nur in den USA, eine EU-Option gibt es dort nicht. OpenAI bietet eine Datenresidenz für Europa (EWR und Schweiz), die laut OpenAI über den Vertrieb freigeschaltet wird und eine Vertragsergänzung zur Aufbewahrung braucht. Mistral verarbeitet standardmäßig in der EU.

Azure: Microsoft kennt drei Arten der Bereitstellung. „Global“ rechnet in jeder Azure-Region, „Data Zone“ innerhalb einer Zone wie der EU, „Standard“ innerhalb einer gewählten Geografie. Die EU-Datenzone folgt laut Microsoft der EU Data Boundary und kann EFTA-Staaten wie Norwegen und die Schweiz einschließen. Microsoft darf Regionen ohne Vorankündigung ergänzen. Neue Modelle kommen zuerst global, dann in die Datenzonen. In der Verfügbarkeitstabelle stehen GPT-6 Sol und Luna in der EU-Datenzone, etwa in Germany West Central und Sweden Central, GPT-6 Astra dort noch nicht.

Bedrock: Für Claude gibt es globale Endpunkte und regionale Endpunkte, dazu Profile für eine Geografie wie die EU. Laut AWS bleiben Anfragen über ein EU-Profil in der Geografie, können aber zwischen Regionen wandern. In der Regionstabelle von Anthropic tragen auch London und Zürich das EU-Kennzeichen. Wenn Ihr Datenschutzkonzept ausschließlich EU-Mitgliedstaaten verlangt, prüfen wir die Zielregionen vor dem Start. GPT-6 Astra ist laut Modellkarte in europäischen Regionen nur über die globale Verarbeitung erreichbar.

Google: Der Multi-Region-Endpunkt „eu“ deckt laut Google ausschließlich EU-Mitgliedstaaten ab, Großbritannien und die Schweiz sind ausgeschlossen. Claude Opus 5.5 und Sonnet 5 sind dort ebenso verfügbar wie Gemini 3.8 Flash. Neuere Claude-Modelle laufen laut Anthropic nur noch über globale oder Multi-Region-Endpunkte, nicht über einzelne Regionen. Globale Endpunkte geben keine Zusage zum Ort.

Ein Punkt wird oft übersehen: die Aufbewahrung zur Missbrauchserkennung. Bei Bedrock werden laut AWS für Claude Fable 5 und 5.1 alle Anfragen bis zu 30 Tage gespeichert, bei mehreren GPT-Modellen die vom Filter markierten. Die Daten bleiben bei AWS und in der Region der Verarbeitung. Für streng vertrauliche Inhalte wählen wir deshalb ein Modell ohne diese Pflicht oder beantragen die Ausnahme.

Was kostet der Weg über einen Hyperscaler?

Die Listenpreise sind nahe an denen der Hersteller, der Aufpreis steckt in der EU-Bindung. Beispiele, Stand September 2026:

Weg Beispiel Aufschlag für regionale Verarbeitung
Azure, Global GPT-5.6 Sol: 4,00 USD Eingabe, 20,00 USD Ausgabe je Million Tokens keiner
Azure, Data Zone GPT-5.6 Sol: 4,40 USD und 22,00 USD 10 %
Bedrock, Claude regionale Endpunkte und EU-Profile 10 % gegenüber global
Bedrock, GPT-6 Astra in einer Region 11,00 USD und 55,00 USD 10 % gegenüber OpenAI
Google, Claude Multi-Region und regionale Endpunkte 10 % gegenüber global
OpenAI direkt, EU Modelle ab dem 05.03.2026 10 %

Quellen: Azure-Preisliste, Claude in Amazon Bedrock, GPT-6 Astra auf Bedrock, Claude on Google Cloud, OpenAI.

Die Regel ist also einfach: EU-Bindung kostet rund 10 %. Bei einem Assistenten mit 80 US-Dollar Modellkosten im Monat sind das 8 US-Dollar, gemessen am Aufwand eines Datenschutzgesprächs vernachlässigbar. Mehr fällt ins Gewicht, dass Ihr Unternehmen vielleicht schon Rabatte oder Zusagen bei einem Hyperscaler hat. Dann ist dieser Weg oft der günstigste, und der Einkauf muss keinen neuen Lieferanten anlegen.

Wie läuft der Einkauf, und wer ist Vertragspartner?

Direkt: Sie schließen die Geschäftsbedingungen und den Auftragsverarbeitungsvertrag (AVV) direkt mit dem Hersteller. Die EU-Residenz bei OpenAI erfordert zusätzlich eine Freigabe durch den Vertrieb.

Azure: Vertragspartner ist Microsoft, es gilt das Microsoft Products and Services Data Protection Addendum. Claude in Foundry wird über den Azure Marketplace in eigenen Verbrauchseinheiten abgerechnet und erscheint auf der Azure-Rechnung. Anthropic handelt dabei laut Dokumentation als unabhängiger Auftragsverarbeiter für Microsoft, bei Hosting auf Azure bleiben Prompts und Antworten in Azure.

AWS: Bedrock ist ein normaler AWS-Dienst, abgerechnet über Ihr AWS-Konto. Die Modellhersteller haben laut AWS keinen Zugriff auf Ihre Eingaben und Ausgaben.

Google: Vertragspartner ist Google Cloud mit dem Cloud Data Processing Addendum.

Für die Einkaufsabteilung ist oft entscheidend, ob ein neuer Lieferant angelegt werden muss. Über den Hyperscaler, mit dem Sie schon arbeiten, entfällt das meist.

Welchen Weg empfehlen wir wann?

Aus unserer Umsetzungssicht gilt:

Sie haben Microsoft 365 und Azure, und GPT reicht: Azure mit Data Zone EU. Kurzer Einkauf, Abrechnung über die Azure-Rechnung, Verarbeitung in der EU-Datenzone.

Sie wollen Claude und brauchen EU-Verarbeitung: Bedrock mit EU-Profil oder Google mit dem Endpunkt „eu“, je nachdem, welche Cloud Sie schon nutzen. Bei strenger Auslegung auf EU-Mitgliedstaaten ist Google der klarere Weg.

Öffentliche oder interne Daten ohne Personenbezug, neueste Funktionen gewünscht: Direktzugang. Neue Modelle und Funktionen sind dort zuerst verfügbar.

Daten, die das Haus nicht verlassen dürfen: keiner der vier Wege, sondern ein Modell mit offenen Gewichten in Ihrer Umgebung. Welche Modelle sich für welche Aufgabe eignen, zeigt der Artikel Welches KI-Modell für welche Aufgabe.

Unabhängig vom Modellweg liegt die Wissensbasis bei uns standardmäßig in Frankfurt. Das Modell sieht nur die Abschnitte, die für die Antwort nötig sind. Wo die Daten in unseren Lösungen liegen, beschreiben wir auf der Seite Sicherheit.

Was bedeutet der Weg für den Betrieb?

Der Weg bestimmt auch, was nach dem Go-live passiert. Laut Anthropic folgt Microsoft Foundry dem Abschaltplan der Claude API, Google legt für Claude eigene Termine fest, die davon abweichen können. Kontingente, also wie viele Anfragen pro Minute erlaubt sind, vergibt jeder Hyperscaler selbst und je Region. Und Datenzonen können sich ändern, wie Microsoft ausdrücklich schreibt.

Das sind keine Gründe gegen einen Weg, aber Gründe für einen Betrieb, der die Änderungen verfolgt. Unser Betrieb prüft Modellstände, Regionen und Preise und stellt um, bevor ein Modell abgeschaltet wird. Die Umsetzung selbst gehört zu unserer Leistung KI-Software und Assistenten. Wenn Sie zunächst nur wissen wollen, welche Lizenz Ihr Team braucht, lesen Sie Copilot, Claude Enterprise oder ChatGPT Enterprise.

Quellen

  1. 1 Understanding deployment types in Microsoft Foundry Models , Microsoft Learn, 12.08.2026
  2. 2 Region availability for Foundry Models sold by Azure , Microsoft Learn, 28.09.2026
  3. 3 Data, privacy, and security for Foundry Models sold by Azure , Microsoft Learn, 19.05.2026
  4. 4 Azure OpenAI Service pricing , Microsoft Azure, 28.09.2026
  5. 5 Claude in Microsoft Foundry , Anthropic, Claude Platform Docs, 28.09.2026
  6. 6 Claude in Amazon Bedrock , Anthropic, Claude Platform Docs, 28.09.2026
  7. 7 OpenAI GPT-6 Sol and GPT-6 Luna are now generally available on Amazon Bedrock , Amazon Web Services, 22.09.2026
  8. 8 Geographic cross-Region inference , AWS Documentation, 28.09.2026
  9. 9 Amazon Bedrock FAQs , Amazon Web Services, 28.09.2026
  10. 10 GPT-6 Astra, Model card , AWS Documentation, 28.09.2026
  11. 11 Amazon Bedrock abuse detection , AWS Documentation, 28.09.2026
  12. 12 Data residency, Gemini Enterprise Agent Platform , Google Cloud Documentation, 28.09.2026
  13. 13 Zero data retention and training restriction , Google Cloud Documentation, 25.09.2026
  14. 14 Claude on Google Cloud , Anthropic, Claude Platform Docs, 28.09.2026
  15. 15 Data residency , Anthropic, Claude Platform Docs, 28.09.2026
  16. 16 Data controls in the OpenAI platform (Your data) , OpenAI API Docs, 28.09.2026

Prüfhinweis: Quartalsweise, nächster Termin 31.12.2026: Modellverfügbarkeit je EU-Datenzone (Azure), EU-Profile und Regionstabellen (Bedrock), Multi-Region-Tabelle (Google), Aufschläge für regionale Endpunkte, Aufbewahrungsregeln für Missbrauchserkennung und die Namen der Plattformen (Microsoft Foundry, Gemini Enterprise Agent Platform) neu prüfen.

Passende Lösungen aus dem Katalog

Wissen Klasse XL

Interner Wissensassistent

Ihr Team fragt in Teams, Slack oder im Browser und bekommt Antworten aus Ihren Dokumenten, mit Quelle und nur aus dem, was es sehen darf.

  • SharePoint oder Google Drive
  • Microsoft Teams oder Slack
Preis
ab 4.900 €
Lieferzeit
3 bis 5 Wochen

Wissen Klasse XL

KI-Agent mit Systemzugriff

Ein Agent erledigt eine wiederkehrende Aufgabe über mehrere Systeme, mit Freigabe vor jedem schreibenden Schritt und Protokoll.

  • je nach Fall
  • Microsoft 365 oder Google Workspace
Preis
ab 4.900 €
Lieferzeit
3 bis 5 Wochen

Verwaltung Klasse L

Vertragsdaten und Fristen erfassen

Die Lösung liest Ihre Verträge aus, trägt Laufzeit, Kündigungsfrist und Ansprechpartner in eine Übersicht ein und erinnert rechtzeitig vor jedem Kündigungstermin.

  • Google Drive oder SharePoint
  • Google Sheets, Excel oder Notion
Preis
ab 2.490 €
Lieferzeit
10 bis 15 Werktage

Nächster Schritt

Angebot innerhalb eines Werktags

Beschreiben Sie in zwei Sätzen, was automatisch laufen soll. Sie bekommen ein Festpreisangebot mit Lieferzeit, oder eine ehrliche Antwort, wenn ein Werkzeug von der Stange reicht.

Zwei, drei Sätze reichen. Welche Systeme Sie nutzen, hilft uns beim Angebot.

Antwort mit Angebot innerhalb eines Werktags. Netto, für Unternehmen.

Angebot anfordern