Zum Inhalt springen

API-Übersicht

Die noris “LLM as a Service”-API ist vollständig OpenAI-kompatibel. Die Basis-URL für alle Endpunkte lautet:

https://ai.noris.de/v1
EndpunktMethodeBeschreibung
/v1/modelsGETVerfügbare Modelle auflisten
/v1/chat/completionsPOSTChat Completions (inkl. Streaming, Tool Calling, Vision)
/v1/completionsPOSTText Completions (Legacy)
/v1/responsesPOSTOpenAI Responses API
/v1/embeddingsPOSTText Embeddings
/v1/rerankPOSTReranking (Query/Documents)
/v1/images/generationsPOSTBildgenerierung (falls verfügbar)

Mit einem einfachen GET-Request lassen sich alle verfügbaren Modelle abrufen:

Terminal-Fenster
curl https://ai.noris.de/v1/models \
-H "Authorization: Bearer YOUR_API_KEY"

Eine erfolgreiche Antwort enthält die Liste aller aktuell verfügbaren Modelle:

{
"object": "list",
"data": [
{ "id": "vllm/release/gpt-oss-120b", "object": "model", "owned_by": "openai" },
{ "id": "vllm/release/gemma-4-31b-it", "object": "model", "owned_by": "google" },
{ "id": "vllm/release/harrier-oss-v1-0.6b", "object": "model", "owned_by": "microsoft" },
{ "id": "vllm/release/bge-reranker-v2-m3", "object": "model", "owned_by": "baai" }
]
}

Die vollständige und aktuelle Modell-Übersicht inklusive Tiers und Spezifikationen findet sich unter Modelle.

Alle Endpunkte unterliegen Rate Limits (RPM und TPM), um eine faire Ressourcenverteilung zu gewährleisten. Die Limits skalieren mit dem Commitment des Kunden. Details finden Sie unter Rate Limits.