Zum Inhalt

AI

Unser LLMaaS Gateway (Large Language Models as a Service) bietet hochperformanten Zugriff auf eine kuratierte Auswahl aktueller Open-Weight-Sprachmodelle. Die Inferenz läuft vollständig auf unserer in der Schweiz betriebenen GPU-Infrastruktur — Ihre Prompts, Embeddings und generierten Antworten verlassen die Schweiz nicht.

Verfügbare Modelle

Die folgenden Modelle sind aktuell produktiv über das Gateway verfügbar. Die Liste wird live von der API geladen.

*Modelle werden geladen…*

Weitere Top-Modelle befinden sich in der Evaluierungsphase und werden in Kürze hinzugefügt. Alle Modelle sind nach dem Format provider/model (z.B. ew/glm-5.2) ansprechbar, so dass ein Modellwechsel in der Regel ein Einzeiler bleibt.

OpenAI-kompatible API

Das Gateway exponiert eine OpenAI-kompatible REST-Schnittstelle — bestehender Code, der das OpenAI-SDK (Python, Node, Go, …) nutzt, kann ohne Anpassung der Anwendungslogik auf unsere Endpoints zeigen:

  • POST /v1/chat/completions — Chat- und Reasoning-Anfragen, inkl. Streaming und Tool-Calling
  • POST /v1/embeddings — Vektor-Embeddings für RAG, semantische Suche, Klassifikation
  • POST /v1/rerank — Re-Ranking von Suchergebnissen für höhere Trefferqualität
  • GET /v1/models — Liste aller aktuell verfügbaren Modelle

→ Vollständige Schnittstellenbeschreibung unter API Reference.

Virtuelle Keys & Governance

Das Gateway unterstützt Virtual Keys (Prefix sk-bf-...) für feingranulare Zugriffskontrolle, Modell-Routing und Verbrauchsverfolgung pro Team, Projekt oder Anwendungsfall. Sie können Ihre Virtual Keys selbst im Cloud Services Portal unter AI anlegen und verwalten.

→ Siehe AI-Verwaltung zum Anlegen von AI-Projekten und Erzeugen von API-Keys.

Typische Anwendungsfälle

  • RAG-Pipelines — Dokumentensuche mit Embeddings + Rerank, kontextbasierte Antwortgenerierung
  • Code-Assistenz — interne Entwicklerwerkzeuge, Code-Review und Refactoring-Vorschläge
  • Klassifikation & Extraktion — strukturierte Datenextraktion aus E-Mails, Berichten, Tickets
  • Agenten & Automatisierung — Tool-Calling-fähige Workflows mit kontrollierten Schreibrechten
  • Mehrsprachige Inhalte — Übersetzung und Lokalisierung mit Fokus auf DACH-Sprachräume

Early Adopter Access

Möchten Sie LLMaaS bereits jetzt für interne Pilotprojekte evaluieren? Das Gateway wird aktuell schrittweise für ausgewählte Early Adopter geöffnet.

Zugang anfragen

Wenden Sie sich an unseren Support, um Zugangsdaten, einen API-Key sowie passende Modellempfehlungen für Ihren Anwendungsfall zu erhalten.