Modellmetadaten und Fallback-Überprüfung
Erfassen Sie den bereitgestellten Modellwert für jede Arbeitslast und definieren Sie ein Fallback-Verhalten, bevor der kundenorientierte Datenverkehr zunimmt.
Halten Sie bereitgestellte Modell-IDs, Fallback-Pläne, Endpunkt-Standardeinstellungen und Paketannahmen sichtbar, bevor der Datenverkehr zunimmt.
Kontrollebene
Erfassen Sie den bereitgestellten Modellwert für jede Arbeitslast und definieren Sie ein Fallback-Verhalten, bevor der kundenorientierte Datenverkehr zunimmt.
Planen Sie Anfragen mit geringerem Risiko rund um die genauen Modelle, die für das gekaufte Paket zurückgegeben werden, anstatt davon auszugehen, dass ein öffentlicher Anzeigename aufrufbar ist.
Bereiten Sie Chat-, Einbettungs- und Bildrichtlinien-Standardeinstellungen separat vor, anstatt eine Regel für jede Funktion zu erzwingen.
Überprüfen Sie Modell, Latenz, Status und geschätzte Kosten in Anforderungsprotokollen, damit Richtlinienentscheidungen messbar bleiben.
Arbeitsablauf
Jedes Modul ist darauf ausgelegt, Entwicklern schnelle Integrationspfade zu bieten und den Betreibern gleichzeitig die Kontrollen zu geben, die sie benötigen, bevor der Datenverkehr zunimmt.
Beginnen Sie mit der Anforderungsform, die Ihr Produkt am häufigsten verwendet: Chat-Vervollständigungen, Einbettungen oder Bilder.
Notieren Sie den genauen Modellwert aus der Einrichtung-E-Mail und authentifizierten GET /v1/models, den Fallback-Plan und ob die Richtlinie hinsichtlich Qualität, Geschwindigkeit oder Kosten optimiert werden soll.
Rufen Sie die bereitgestellte OpenAI-kompatible Basis-URL mit einem expliziten Modellwert auf und überprüfen Sie dann die Token-Nutzung, den 4-Verbindungsdruck und das Ratenbegrenzungsverhalten.
Verwenden Sie Anforderungsprotokolle und Nutzungsberichte, um Richtlinienmetadaten anzupassen, bevor das Datenverkehrsvolumen zunimmt.
Anfrage mit einem expliziten Modellwert
# Replace DELIVERED_MODEL_ID using the setup email and authenticated GET /v1/models.
POST /v1/chat/completions
Authorization: Bearer $UCX_API_KEY
Content-Type: application/json
{
"model": "DELIVERED_MODEL_ID",
"messages": [
{ "role": "user", "content": "Summarize this support ticket." }
]
}KI-Produkte ändern sich schnell. Die Einrichtung-E-Mail und die authentifizierten GET /v1/models sorgen dafür, dass genaue Modellwerte sichtbar sind, sodass Entwickler Nutzung, Latenz und Fallback-Pläne überprüfen können, bevor der Zugriff zu einer Abhängigkeit wird.
FAQ
Ja. Senden Sie die genaue ID des gelieferten Modells aus der Einrichtung-E-Mail und authentifizieren Sie GET /v1/models.. Richtlinienstandards, Fallback-Pläne und Kostenpräferenzen bleiben im Paket-Einrichtung-Datensatz sichtbar.
Nein. Anfragen werden weiterhin in den Nutzungs- und Anfrageprotokollen mit dem angeforderten Modell, Status, Latenz, Token-Anzahl und geschätzten Kosten angezeigt.
Ja. Chat, Einbettungen und Bilder können jeweils unterschiedliche Standardeinstellungen, Fallback-Pläne und Kostenpräferenzen dokumentieren.
Bereit zum Bauen?