Skip to main content
Ottili AI Platform

Eine KI-Plattform hinter jedem Ottili-Produkt — und deinen eigenen Apps.

Ottili AI Platform ist die geteilte KI-Fähigkeitsschicht für Ottili ONE. Sie stellt jedem Produkt — Ottili AI, Ottili Coder, Ottili LD3 und Ottili Cloud — dieselben Modelle, Credits und Controls bereit und öffnet dieselbe Fähigkeit für Entwickler über eine OpenAI-kompatible API.

Plattform, nicht ein einzelnes Produkt

Eine geteilte Foundation, nicht noch ein Chatbot.

Ottili AI ist ein auf dieser Plattform gebautes Produkt — der Assistent, Missionen und Freigaben, die du im Workspace nutzt. Die Plattform darunter ist der Teil, den alle Produkte teilen: Model-Zugriff, Routing, Credits, Usage-Controls und Reliability. Entwickler erreichen dieselben Modelle über api.ai.ottili.one, sodass deine Apps denselben OpenAI-kompatiblen Vertrag sprechen wie Ottilis eigene Produkte.

Model-Zugriff & Routing

Modelle, Routing und Provider-Abstraktion.

Eine kuratierte Modelllinie mit adaptivem Router, ausgeliefert über eine Provider-Abstraktion. Routing schlägt fehlergeschlossen fehl: ein nicht verfügbares Modell wird gemeldet, nie still auf einen bezahlten oder Mock-Provider herabgestuft. Bring-your-own-key ist explizit und unternehmensbezogen.

  • Model-Zugriff

    Beta

    Ottili Vale 1.2 (effizient), Ottili Cairn 1.2 (premium) und Ottili Auto (adaptiver Router) — eine stabile Menge öffentlicher Modell-IDs.

  • Model-Routing & Provider-Abstraktion

    Live

    Eine Routing-Ebene bildet öffentliche Modell-IDs auf Backing-Provider ab. Provider-Credentials verlassen nie die öffentliche Grenze.

  • Adaptiver Router

    Beta

    Ottili Auto wählt pro Request das effiziente Modell für schnelle Alltagsarbeit und das premium Modell für schwere oder agentische Arbeit.

  • Unternehmensbezogenes BYOK

    Beta

    Bring-your-own-key-Credentials leben nur im freigegebenen Credential-Speicher — nie zurückgegeben, geloggt oder über Mandanten geteilt.

  • Reserviertes Flaggschiff

    Planned

    Ottili Spire 1.2 ist für eine spätere Veröffentlichung reserviert. Es hat kein öffentliches Backing-Modell und wird erst bei Launch ausgeliefert.

Öffentliche Modelllinie: Ottili Vale 1.2, Ottili Cairn 1.2, Ottili Auto. Ottili Spire 1.2 ist reserviert.

  • Ottili Vale 1.2

    VerfügbarEffizient-Stufe

    Effizient-Stufe

    Das effiziente Alltagsmodell für Chat, Entwürfe und schnelle Coding-Aufgaben.

  • Ottili Cairn 1.2

    VerfügbarPremium-Preis-Leistungs-Stufe

    Premium-Preis-Leistungs-Stufe

    Das Premium-Preis-Leistungs-Modell für anspruchsvolle agentische und reasoning-lastige Software-Arbeit.

  • Ottili Auto

    VerfügbarAdaptiver Router

    Adaptiver Router

    Der adaptive Router. Er wählt pro Request Ottili Vale für schnelle Alltagsarbeit und Ottili Cairn für schwere oder agentische Aufgaben.

  • Ottili Spire 1.2

    In KürzeFlaggschiff-Stufe

    Flaggschiff (reserviert)

    Das reservierte Ottili-KI-Flaggschiff. Noch nicht verfügbar — für eine spätere Veröffentlichung geplant.

OpenAI-kompatible API

Derselbe Vertrag, den dein Tooling schon spricht.

Die öffentliche Grenze ist OpenAI-kompatibel und deterministisch. Ein API-Key, Unternehmenskontext vor jeder Anfrage, und keine privaten Details in der Antwort.

GET /v1/models

Liste der öffentlichen Modelllinie mit Fähigkeiten, Lebenszyklus-Status und Verfügbarkeit — nie reservierte oder zurückgezogene Modelle.

POST /v1/chat/completions

Chat- und Streaming-Completions mit derselben Request-Form, Finish-Reasons und normalisierten Fehler-Hülle wie OpenAI.

POST /v1/responses

Eine echte Responses-API: provider-unabhängige Eingabe, Output-Items und korrelierte Usage — kein dünner Chat-Wrapper.

API-Keys & SDKs

Stelle unternehmensbezogene Keys im Konsolenbereich aus und rufe die Plattform aus jedem OpenAI-kompatiblen SDK auf.

Company-Credits & Usage-Controls

Credits, Quotas und Mandanten-Isolation.

Usage wird gegen ein Company-Wallet gemessen. Jede abrechenbare Anfrage nimmt eine Worst-Case-Reservierung vor der Arbeit, settlelt bei Erfolg und gibt bei Abbruch frei — sodass Retries und Replays nie doppelt belasten.

Company-Credits

Ein einzelnes Company-Wallet deckt AI-Usage über alle Produkte und die öffentliche API. Spende wird pro Request gemessen.

Reservieren → Finalisieren → Freigeben

Idempotency-Keys und eine Preflight-Reservierung settleln genau einmal. Abbrüche geben die ungenutzte Reservierung frei.

Rate Limits & Quotas

Pro Unternehmen, Projekt und Nutzer begrenzen Limits die faire Nutzung und schützen die geteilte Plattform.

Mandanten-Isolation

Jede Anfrage löst einen authentifizierten Key oder Session plus Unternehmenskontext vor dem Dispatch auf. Keine Daten über Mandanten hinweg.

Routing & Kostenkontrolle

Wie jede Anfrage geroutet, berechnet und gedeckelt wird.

Dieselbe Kontrollebene, die Ottili AI, Coder, Ottili LD3 und Cloud antreibt, regelt, wie jede Anfrage geroutet, gecached, berechnet und gedeckelt wird. Die folgenden Regeln sind auf Produktebene: keine internen Provider-Namen, keine Credentials, keine privaten Unified-API-Details (Website-Audit P0.2).

  • Provider-Routing

    Live

    Eine Routing-Ebene bildet öffentliche Modell-IDs nach Fähigkeit und Stufe auf Backing-Provider ab. Der adaptive Router (Ottili Auto) wählt pro Request das effiziente Modell für schnelle Arbeit und das Premium-Modell für schwere oder agentische Arbeit.

  • Fehlergeschlossene Fallbacks

    Live

    Wenn ein Modell oder Provider degradiert ist, wird die Anfrage gemeldet — nie still auf einen bezahlten oder Mock-Provider herabgestuft. Du weißt immer, welches Modell geantwortet hat.

  • Circuit Breaker

    Live

    Ein fehlerhafter Provider oder Route wird hinter einem Circuit Breaker isoliert, sodass eine degradierte Abhängigkeit die geteilte Plattform nicht lahmlegen kann. Ein ausgelöster Breaker liefert einen normalisierten Fehler statt eines Hangs.

  • Cache-Nutzung

    Beta

    Wiederholte Präfix-Tokens werden pro Unternehmen gecached, sodass Workloads mit stetigem Kontext weniger kosten und schneller laufen. Der Cache ist auf dein Unternehmen begrenzt und wird nie mandantenübergreifend geteilt.

  • Credit-Berechnung

    Beta

    Jede abrechenbare Anfrage nimmt eine Worst-Case-Reservierung vor der Arbeit, settlelt bei Erfolg und gibt bei Abbruch frei. Idempotency-Keys sorgen dafür, dass Retries und Replays nie doppelt belasten.

  • Harte Obergrenzen

    Live

    Pro Unternehmen, Projekt und Nutzer stoppen harte Obergrenzen die Ausgaben an einer Decke — unabhängig von Retries. Ein Überschreiten liefert einen strukturierten, maschinenlesbaren Fehler — keine stille Überziehung.

  • Wallet-Aufladung

    Beta

    Company-Wallets werden über den aktiven Plan oder gekaufte Credit-Packs aufgeladen. Die Ausgaben werden pro Request gegen das Wallet gemessen, sodass Usage sauber dem Bezahlten zugeordnet wird.

  • Company-Wallets

    Beta

    Ein einzelnes Company-Wallet deckt AI-Usage über Ottili AI, Coder, Ottili LD3, Cloud und die öffentliche API. Die Ausgaben sind unternehmensbezogen und isoliert — keine mandantenübergreifenden Belastungen.

Caching, Reliability & Structured Output

Gemacht für Produktions-Workloads.

Die Plattform ist für vorhersehbare, beobachtbare Inferenz ausgelegt: Prompt-Caching, strukturierte Outputs, Tool-Calling und fehlergeschlossene Reliability.

Prompt-Caching

Wiederholte Präfix-Tokens werden gecached, sodass Workloads mit stetigem Kontext weniger kosten und schneller laufen.

Strukturierte Outputs

Fordere JSON-Mode-Output für deterministische, parsebare Antworten an, auf die sich dein Code verlassen kann.

Tool-Calling

Function-Calling mit validierter Allow-Liste — begrenzte Tool-Anzahl, Namen und Payload-Größen.

Fehlergeschlossene Reliability

Normalisierte Fehler, idempotente Retries und Streaming, das bei Disconnect genau einmal settlelt.

In jedem Ottili-Produkt verbaut

Eine Plattform, geteilt vom ganzen Ökosystem.

Die Plattform ist keine separate Fläche, die du eigenständig adoptierst. Sie ist die KI-Ebene, auf der Ottili-Produkte bereits laufen — und dieselbe Ebene, die deine Entwickler direkt aufrufen können.

Ottili AI

Der Assistent, Missionen und Freigaben sind auf den Modellen, Credits und Controls der Plattform gebaut.

Ottili Coder

Coder nutzt die Plattform für agentisches Coding, Planung und Code-Review über local, cloud und hybrid Runs.

Ottili LD3

Ottili LD3 entwirft, prüft und veröffentlicht Inhalte mit den Modellen und strukturierten Outputs der Plattform.

Ottili Cloud

Cloud betreibt Plattform-Inferenz und Coder-Workloads über eine Ottili-eigene Control Plane.

Verfügbarkeit

Verfügbar im Early Access.

Ottili AI Platform ist über das Ottili-Early-Access-Programm verfügbar. Die öffentliche OpenAI-kompatible API, die Modelllinie und Company-Credits sind heute erreichbar; als beta markierte Fähigkeiten sind im aktiven Rollout. Hier werden keine Termine versprochen.

Baue auf der Ottili AI Platform

Stelle einen API-Key aus, lies die öffentliche Referenz und rufe dieselben Modelle auf, die Ottili ONE antreiben.