Zum Hauptinhalt springen

Nutzungshinweise LLM Proxy

Diese Seite enthält Hinweise zur direkten API-Nutzung des LLM Proxy. Für allgemeine Informationen zum KI-Zugang besuchen Sie bitte KI-API-Zugang.

Eingeschränkter Zugang

Der Zugang zur KI-API ist derzeit eingeschränkt, da das ZIM die Entscheidung über den GPR-Mitbestimmungsantrag abwartet. Nach der Zustimmung durch den Gesamtpersonalrat wird der Zugang für alle Mitarbeitenden der Universität Potsdam freigeschaltet.

Der LLM Proxy ist eine LiteLLM-Installation. Weitere Informationen zu LiteLLM finden Sie in der offiziellen LiteLLM-Dokumentation.

API-Schlüssel setzen

Behandeln Sie Ihren API-Schlüssel wie ein Passwort. Geben Sie ihn nicht weiter und speichern Sie ihn nicht in öffentlich zugänglichen Dateien, Tickets, Chatverläufen oder Code-Repositorys. Ausnahme: Zur Nutzung durch Studierende und in Lehrveranstaltungen können Mitarbeitende API-Schlüssel erzeugen und in geschütztem Rahmen weitergeben.

Für die direkte Nutzung benötigen Sie einen gültigen API-Schlüssel. Informationen zur Beantragung und Verwaltung von API-Schlüsseln finden Sie unter KI-API-Zugang. In den folgenden Beispielen steht $API_KEY für Ihren persönlichen API-Schlüssel im Format sk-....

Eine Möglichkeit, den API-Schlüssel in der Bash Shell zu setzen, ohne ihn direkt in der History zu speichern:

export API_KEY=$(cat)

Anschließend den Schlüssel einfügen und die Eingabe mit Strg+D beenden.

Modelle auflisten

Mit dem Models-Endpunkt können alle aktuell verfügbaren Modelle abgerufen werden:

curl https://llm.ki.k8s.rz.uni-potsdam.de/models -H "Authorization: Bearer $API_KEY" | jq .

Die verfügbaren Modelle können sich im Laufe der Zeit ändern. Sollten Sie nicht verfügbare Modelle benötigen, dann kontaktieren Sie uns bitte.

Endpunkte

Es folgt eine Auswahl wichtiger Endpunkte für Text- und Bildgenerierung. Weitere Informationen zu LiteLLM-Endpunkten finden Sie in der offiziellen LiteLLM-Dokumentation der Endpunkte. Der Basis für alle Endpunkte ist https://llm.ki.k8s.rz.uni-potsdam.de.

  • Endpoint zur Textgenerierung im OpenAI-kompatiblen Chat-Completions-Format. Eingabeparameter sind unter anderem model und eine Liste von Chatnachrichten im Feld messages.
  • Endpoint zur Textgenerierung im OpenAI-kompatiblen Responses-Format. Der Endpoint eignet sich, wenn Anwendungen oder Skripte die Responses API nutzen.
  • Endpoint zur Textgenerierung im Anthropic-kompatiblen Messages-Format. Der Request ist an das Anthropic-Format angelehnt und nutzt unter anderem model, messages und je nach Modell weitere Parameter wie max_tokens.
  • Endpoint zur Bildgenerierung. Der Request enthält mindestens einen Prompt und ein geeignetes Modell zur Bildgenerierung.

Hinweis zur Nutzung mit KI-Coding-Agenten

Codex

Diese Hinweise gelten für die Verwendung von OpenAI Codex in Verbindung mit gpt-5.1-codex-max.

  • Das Suchwerkzeug wird abgelehnt: “Tool 'tool_search' is not supported with gpt-5.1-codex-max-2025-12-04”. Lösung: Der Client darf es dem Modell nicht anbieten.
  • text.verbosity akzeptiert nur “medium” (Fehlermeldung: "Unsupported value: 'low' ... Supported values are: 'medium'")

Weitere Hinweise zur Nutzung

Vor der Nutzung des LLM Proxy sind die geltenden Nutzungsbedingungen, Datenschutzvorgaben und Hinweise zum EU AI Act zu beachten. Diese Hinweise finden Sie in Account.UP sowie im Leitfaden zur Nutzung.

Bitte prüfen Sie vor der Verarbeitung von Daten, ob deren Nutzung über den LLM Proxy zulässig ist. Modellantworten können fehlerhaft oder unvollständig sein und müssen fachlich überprüft werden.

Die Verfügbarkeit einzelner Modelle und Parameter kann sich ändern. Je nach Modell oder Endpoint können Einschränkungen bei Tokenumfang, Antwortformaten oder Nutzungskontingenten bestehen.