API-Übersicht
Die noris “LLM as a Service”-API ist vollständig OpenAI-kompatibel. Die Basis-URL für alle Endpunkte lautet:
https://ai.noris.de/v1Verfügbare Endpunkte
Abschnitt betitelt „Verfügbare Endpunkte“| Endpunkt | Methode | Beschreibung |
|---|---|---|
/v1/models | GET | Verfügbare Modelle auflisten |
/v1/chat/completions | POST | Chat Completions (inkl. Streaming, Tool Calling, Vision) |
/v1/completions | POST | Text Completions (Legacy) |
/v1/responses | POST | OpenAI Responses API |
/v1/embeddings | POST | Text Embeddings |
/v1/rerank | POST | Reranking (Query/Documents) |
/v1/images/generations | POST | Bildgenerierung (falls verfügbar) |
Modelle auflisten
Abschnitt betitelt „Modelle auflisten“Mit einem einfachen GET-Request lassen sich alle verfügbaren Modelle abrufen:
curl https://ai.noris.de/v1/models \ -H "Authorization: Bearer YOUR_API_KEY"Eine erfolgreiche Antwort enthält die Liste aller aktuell verfügbaren Modelle:
{ "object": "list", "data": [ { "id": "vllm/release/gpt-oss-120b", "object": "model", "owned_by": "openai" }, { "id": "vllm/release/gemma-4-31b-it", "object": "model", "owned_by": "google" }, { "id": "vllm/release/harrier-oss-v1-0.6b", "object": "model", "owned_by": "microsoft" }, { "id": "vllm/release/bge-reranker-v2-m3", "object": "model", "owned_by": "baai" } ]}Die vollständige und aktuelle Modell-Übersicht inklusive Tiers und Spezifikationen findet sich unter Modelle.
Rate Limits
Abschnitt betitelt „Rate Limits“Alle Endpunkte unterliegen Rate Limits (RPM und TPM), um eine faire Ressourcenverteilung zu gewährleisten. Die Limits skalieren mit dem Commitment des Kunden. Details finden Sie unter Rate Limits.
