Request Body Parameter Beschreibung & Info
Der Ablauf der Workflow Action ist sehr ähnlich zu der OpenAI Workflow Action. Der Unterschied besteht darin, dass die KI in einem gesonderten Azure Container existiert und nur Informationen aus dem Container nutzen kann. Dies lässt deutlich zielgerichtetere Ergebnisse zu, erfordert aber auch selektierte Daten im vorliegenden Container.
Model : Name der Bereitstellung. Aktuell werden die Werte in der „Azure OpenAI Einstellungen“ im Marini Systems Admin Bereich eingetragen. Hier lässt sich das gewünschte Modell für die Verarbeitung des Prompts auswählen. Die offizielle OpenAI-Dokumentation bietet einen guten Überblick über die verfügbaren Modelle sowie deren Stärken Einsatzbereiche. Je nach Modell können außerdem verschiedene Parameter individuell angepasst werden, um optimale Ergebnisse zu erzielen. Die Preisliste der jeweiligen Modelle findest du hier.
Max Tokens: Begrenzt die Antwortlänge. Die maximale Anzahl von Token, die in der Chatvervollständigung generiert werden können. Die Gesamtlänge der Eingabetoken und generierten Token wird durch die Kontextlänge des Modells begrenzt. Das Übergeben von NULL bewirkt, dass das Modell seine maximale Kontextlänge verwendet.
Temperature: Beeinflusst Antwortkreativität (eine Zahl zwischen 0 und 2,0; vorgegebener Wert 1). Niedrig (0,2) für konservative, hoch (0,8) für kreative Antworten. Nicht negative Zahl Gibt 422 zurück, wenn der Wert vom Modell nicht unterstützt wird.
Top P Kontrolliert Token-Auswahl (eine Zahl zwischen 0 und 1,0; vorgegebener Wert 1). Niedrig (0,1) für wahrscheinliche, hoch (1,0) für diverse Antworten. Eine Alternative zur Stichprobenentnahme mit Temperatur, die sogenannte Kernstichprobenentnahme (Nucleus Sampling), bei dem das Modell die Ergebnisse der Token mit der Wahrscheinlichkeitsmasse „top_p“ berücksichtigt. Daher bedeutet 0,1, dass nur die Token berücksichtigt werden, die die oberen 10 % der Wahrscheinlichkeitsmasse umfassen.
Frequency Penalty Beeinflusst die Wiederholung von Tokens. Niedrig (0) ermutigt, hoch (0,8) vermeidet (eine Zahl zwischen -2,0 und 2,0; vorgegebener Wert 0). Verhindert Wortwiederholungen, indem die Wahrscheinlichkeit reduziert wird, dass ein Wort ausgewählt wird, wenn es bereits verwendet wurde. Je höher die Häufigkeitsstrafe ist, desto geringer ist die Wahrscheinlichkeit, dass das Modell dieselben Wörter in seiner Ausgabe wiederholt. Gibt einen 422-Fehler zurück, wenn der Wert oder Parameter vom Modell nicht unterstützt wird.
Presence Penalty Ein höherer Wert (z. B. 1,5) verringert die Wahrscheinlichkeit von Wiederholungen in den Antworten des Modells (eine Zahl zwischen -2,0 und 2,0; vorgegebener Wert 0). Verhindert, dass dieselben Themen wiederholt werden, indem ein Wort bestraft wird, wenn es bereits in der Vervollständigung vorhanden ist, selbst wenn es nur einmal ist. Gibt einen 422-Fehler zurück, wenn der Wert oder Parameter vom Modell nicht unterstützt wird.
API Version: Die Version der API, die benutzt werden sollte. Aktuell werden die Werte in der „Azure OpenAI Einstellungen“ im Marini Systems Admin Bereich eingetragen. Die Version der API im Format „JJJJ-MM-TT“ oder „JJJJ-MM-TT-Vorschau“.
Zusammenfassung
- Model: Name der Bereitstellung. Aktuell werden die Werte in der „Azure OpenAI Einstellungen“ im Marini Systems Admin Bereich eingetragen.
- Max Tokens: Begrenzt die Antwortlänge.
- Temperature: Beeinflusst Antwortkreativität. Niedrig (0,2) für konservative, hoch (0,8) für kreative Antworten.
- Top P: Kontrolliert Token-Auswahl. Niedrig (0,1) für wahrscheinliche, hoch (1,0) für diverse Antworten.
- Frequency Penalty: Beeinflusst die Wiederholung von Tokens. Niedrig (0) ermutigt, hoch (0,8) vermeidet.
- Presence Penalty: Ein höherer Wert (z. B. 1,5) verringert die Wahrscheinlichkeit von Wiederholungen in den Antworten des Modells.
- API Version: Die Version der API, die benutzt werden sollte. Aktuell werden die Werte in der „Azure OpenAI Einstellungen“ im Marini Systems Admin Bereich eingetragen.