Zum Hauptinhalt springen
ccsio.ai

Produkt

KI-Inferenz & Modelle

Private Inferenz auf dedizierter Hardware, verankert in deiner Region. Deine Modelle, deine Daten, deine Region — mit Schlüsseln, die du kontrollierst.

API ansehen

Was du bekommst

Drei Eigenschaften, alle pro Region nachprüfbar.

Dedizierte Hardware

Deine Inferenz läuft auf dedizierten Servern — dir zugeteilt, nicht gepoolt.

Langer Kontext

Qwen 3.8 mit 320K-Kontext, ab sofort verfügbar.

Fair-Use-Schlüssel

API-Schlüssel pro Plan: Fair-Use mit Limits pro Key und Frontier-Tokens zu veröffentlichten Preisen.

Eine API, zwei Modellklassen

Die gleiche, governance-gestützte API bedient beide Klassen. Der Unterschied ist, wo die Inferenz läuft — und die Seite verwechselt die beiden nie.

Gemanagte Open-Weight-Modelle

Qwen 3.8 — Kontext von 320K Token — läuft als gemanagte Inferenz in deinem Markt, auf dedizierter Infrastruktur am Betriebsort der Region.

Gestützter Zugang zu Frontier-Modellen

Genehmigte Frontier-Modelle bleiben provider-gehostet und werden immer als extern gekennzeichnet — nie als ccsio.ai-Kapazität. Sie steigen in dieselbe API unter denselben Governance-Regeln ein, und die Verfügbarkeit öffnet über die Warteliste.

Welche Modelle gibt es

Verfügbar

Qwen 3.8

Jetzt verfügbar

Open-weight-Modell, jetzt verfügbar, mit einem Kontextfenster von 320K.

Deine Prompts und Antworten werden standardmäßig nicht gespeichert. Brain- oder Memory-Daten, die deine Organisation bewusst speichert, werden verschlüsselt, an die ausgewählte Region gebunden, innerhalb der autorisierten Organisationsbereiche isoliert und niemals zum Training gemeinsamer oder fremder Modelle verwendet.

  • Kontextfenster: 320K
  • Regionale Zuordnung, dedizierte Infrastruktur
  • EU
  • USA
  • LATAM

Gemma 4

Jetzt verfügbar

Offenes Modell, verfügbar, mit einem Kontextfenster von 256K Token.

Deine Prompts und Antworten werden standardmäßig nicht gespeichert. Brain- oder Memory-Daten, die deine Organisation bewusst speichert, werden verschlüsselt, an die ausgewählte Region gebunden, innerhalb der autorisierten Organisationsbereiche isoliert und niemals zum Training gemeinsamer oder fremder Modelle verwendet.

  • Kontextfenster: 256K
  • EU
  • USA
  • LATAM

Demnächst

DeepSeek 4.1

Bald verfügbar

Angekündigt für Ende Q4 2026; der Zugang startet über die Warteliste.

    • EU
    • USA
    • LATAM

    GLM 5.3

    Bald verfügbar

    Angekündigt für Ende Q4 2026; der Zugang startet über die Warteliste.

      • EU
      • USA
      • LATAM

      Laut Roadmap; Verfügbarkeit über die Warteliste.

      Regionale Endpunkte und Residency-Grenzen

      Die API-Basis deines Marktes ist an die Region gebunden: Anfragen laufen über den Endpunkt deines Marktes und werden innerhalb seiner Grenze verarbeitet.

      EU

      https://api.eu.ccsio.ai/v1

      Betrieben aus Deutschland

      USA

      https://api.us.ccsio.ai/v1

      Betrieben aus USA

      LATAM

      https://api.latam.ccsio.ai/v1

      Betrieben aus Kolumbien

      Jeder Markt nennt seinen Betriebsort. ccsio.ai erhebt keine transparenten Cross-Residency-Inferenz-Ansprüche.

      Häufige Fragen

      Welches Modell ist heute verfügbar?

      Qwen 3.8 — Kontext von 320K Token — und Gemma 4 sind in allen drei Regionen verfügbar, in jedem Plan. GLM 5.3 und DeepSeek 4.1 sind angekündigt — Ende Q4 2026.

      Welchen Endpunkt rufe ich auf?

      Die Basis deines Marktes: api.eu.ccsio.ai/v1, api.us.ccsio.ai/v1 oder api.latam.ccsio.ai/v1. Die Inferenz bleibt in diesem Markt.

      Ist die API mit OpenAI-Tooling kompatibel?

      Ja. Die API ist OpenAI-kompatibel — bestehende OpenAI-Clients funktionieren mit deiner regionalen Basis-URL.

      Wo läuft die Inferenz?

      Gemanagte Open-Weight-Inferenz läuft am Betriebsort deines Marktes. Provider-gehostete Frontier-Modelle sind extern und werden immer so gekennzeichnet.

      Hostet ccsio.ai Frontier-Modelle?

      Nein. Frontier-Modelle bleiben provider-gehostet und tragen die Extern-Kennzeichnung; ccsio.ai serviert sie nie als eigene Kapazität.

      Wie bekomme ich Zugang?

      Melde dich in der Warteliste für ein Konsolen-Konto in deiner Region an; für Enterprise-Anforderungen nutze die Kontaktseite.

      So startest du

      Die API-Konsole öffnet sich mit der Warteliste. Trag dich ein, wähle deine Region — dann ist dein erster privater Inferenzaufruf ein POST entfernt.

      API ansehen

      Deine erste private Inferenz

      Trag dich in die Warteliste für ein Konto in deiner Region ein — dein erster API-Schlüssel folgt.

      ;

      Verwandte Plattform-Fähigkeiten

      AI Router

      Ein einziger Endpunkt, der jede Anfrage ans gewählte Modell und in deine Region leitet.

      Jetzt verfügbar