Scaleway Generative APIs ist ein verwalteter Dienst für Modellinferenz aus Frankreich. Die serverlosen APIs bieten OpenAI-kompatiblen Zugriff auf Sprach-, Reasoning-, Vision-, Audio-, Embedding- und Reranking-Modelle, während dedizierte Bereitstellungen kuratierte oder von Kund:innen ausgewählte Modelle ausführen können. Die Endpunkte zur Textgenerierung unterstützen Chat Completions, strukturierte Ausgaben, Tool-Aufrufe, Streaming und Stapelverarbeitung. Die serverlose Nutzung wird nach Token oder Aufgabe abgerechnet und umfasst ein dauerhaftes kostenloses Kontingent.
Europäische LLM-APIs
LLM-APIs ermöglichen Softwareanwendungen den programmatischen Zugriff auf verwaltete KI-Modelle zur Erzeugung und Verarbeitung von Text. Entwickler:innen können diese Dienste für dialogorientierte Assistenten, Zusammenfassungen, Übersetzungen, Informationsextraktion, Codegenerierung, strukturierte Ausgaben und weitere Sprachaufgaben nutzen, ohne eine eigene Infrastruktur für die Modellbereitstellung zu betreiben. Ein Dienst kann zusätzlich Embeddings oder multimodale Modelle anbieten, die Textgenerierung muss jedoch eine zentrale Funktion der API sein. Diese Kategorie umfasst europäische LLM-API-Anbieter, deren zentrale Inferenzverarbeitung in der EU, im EWR oder in der EFTA auf Infrastruktur geeigneter europäischer Unternehmen gehostet wird. Reine KI-Chatbots für Endnutzer:innen, API-Gateways, die Anfragen lediglich an Drittanbieter weiterleiten, reines GPU-Hosting und ausschließlich selbst hostbare Modelle sind ausgeschlossen.
Diese Kategorie enthält Dienstleistungen von Unternehmen mit Sitz in einem Mitgliedsstaat der Europäischen Union (EU), des Europäischen Wirtschaftsraums (EWR) und der Europäischen Freihandelsassoziation (EFTA).
Weitere Informationen zu den Zulassungskriterien finden Sie den Zulassungskriterien.
Europäische Services
Nebius Token Factory bietet verwaltete Inferenz für Open-Source-Sprachmodelle über eine OpenAI-kompatible API. Entwickler:innen können den Dienst für Chat-Completions, Schlussfolgerungen, Codegenerierung, Embeddings und verwandte Anwendungsfälle nutzen, ohne eine eigene Infrastruktur für die Modellbereitstellung zu betreiben. Die öffentlichen serverlosen Endpunkte werden tokenbasiert abgerechnet, während optionale dedizierte Endpunkte reservierte Kapazität und die Auswahl einer Bereitstellungsregion ermöglichen. Der Dienst unterstützt die Authentifizierung per API-Schlüssel, einen browserbasierten Playground und modellspezifische Leistungsstufen.
OVHcloud AI Endpoints ist ein verwalteter Dienst für generative KI-APIs aus Frankreich. Entwickler:innen erhalten serverlosen Zugriff auf vortrainierte Sprach-, Reasoning-, Vision-, Embedding-, Bild- und Sprachmodelle, ohne selbst eine Inferenzinfrastruktur bereitstellen zu müssen. Die mit OpenAI kompatiblen Routen für Chat Completions und Responses unterstützen unter anderem Textgenerierung, strukturierte Ausgaben und Funktionsaufrufe. Der Zugriff kann mit API-Schlüsseln authentifiziert werden, die Abrechnung richtet sich nach dem gewählten Modell.
IONOS AI Model Hub ist eine verwaltete Plattform für generative KI aus Deutschland. Sie bietet OpenAI-kompatible und native APIs für Text- und Bilderzeugung, Embeddings, Dokumentsammlungen, semantische Suche und Retrieval-Augmented Generation. Entwickler:innen können kuratierte Open-Source-Sprachmodelle für Chat, Text- und Codegenerierung nutzen, ohne GPU-Infrastruktur verwalten zu müssen. Die Abrechnung richtet sich nach dem gewählten Modell und den verarbeiteten Token oder Bildern.