Modell pro Call
Du wählst das Modell bei jeder Request. Router, Guardrails, Knowledge und Memory bleiben unter demselben Key und denselben Organisations-Policies.
AI Router
Die AI Router liefert den kompletten gemanagten Model-Fleet von deiner regionalen Endpoint: LLM, Vision, Embeddings und Speech unter einem API-Key, denselben Guardrails und dieselben Governance-Control-Plane.
Routing ist eine Control-Plane-Fähigkeit: Die Endpoint bleibt in deiner Region und jeder Request durchläuft dieselben Identity-, Guardrail- und Knowledge-Prüfungen wie jeder andere Plattform-Request.
Du wählst das Modell bei jeder Request. Router, Guardrails, Knowledge und Memory bleiben unter demselben Key und denselben Organisations-Policies.
Die regionale v1 API spricht dasselbe Request- und Response-Schema wie die OpenAI API, so können bestehende OpenAI-Clients auf deine Endpoint mit demselben Key-Format zeigen.
Die Endpoint in der URL benennt die Region, die den Call ausführt. Das Routing verlässt nie den gewählten Markt.
Zeige deinen bestehenden OpenAI-Client auf deine regionale Endpoint, und der gemanagte Model-Fleet ist einen API-Key entfernt.
Regionsspezifische Inferenz über den gesamten Live-Modellkatalog, unter einem SLA.
Trainiere und justiere Modelle auf deiner eigenen Kapazität.
Baue Agenten mit Tools, MCP-Zugang und mehrstufiger Ausführung.