GET /v1/models
Liste der öffentlichen Modelllinie mit Fähigkeiten, Lebenszyklus-Status und Verfügbarkeit — nie reservierte oder zurückgezogene Modelle.
Ottili AI Platform ist die geteilte KI-Fähigkeitsschicht für Ottili ONE. Sie stellt jedem Produkt — Ottili AI, Ottili Coder, Ottili LD3 und Ottili Cloud — dieselben Modelle, Credits und Controls bereit und öffnet dieselbe Fähigkeit für Entwickler über eine OpenAI-kompatible API.
Ottili AI ist ein auf dieser Plattform gebautes Produkt — der Assistent, Missionen und Freigaben, die du im Workspace nutzt. Die Plattform darunter ist der Teil, den alle Produkte teilen: Model-Zugriff, Routing, Credits, Usage-Controls und Reliability. Entwickler erreichen dieselben Modelle über api.ai.ottili.one, sodass deine Apps denselben OpenAI-kompatiblen Vertrag sprechen wie Ottilis eigene Produkte.
Eine kuratierte Modelllinie mit adaptivem Router, ausgeliefert über eine Provider-Abstraktion. Routing schlägt fehlergeschlossen fehl: ein nicht verfügbares Modell wird gemeldet, nie still auf einen bezahlten oder Mock-Provider herabgestuft. Bring-your-own-key ist explizit und unternehmensbezogen.
Ottili Vale 1.2 (effizient), Ottili Cairn 1.2 (premium) und Ottili Auto (adaptiver Router) — eine stabile Menge öffentlicher Modell-IDs.
Eine Routing-Ebene bildet öffentliche Modell-IDs auf Backing-Provider ab. Provider-Credentials verlassen nie die öffentliche Grenze.
Ottili Auto wählt pro Request das effiziente Modell für schnelle Alltagsarbeit und das premium Modell für schwere oder agentische Arbeit.
Bring-your-own-key-Credentials leben nur im freigegebenen Credential-Speicher — nie zurückgegeben, geloggt oder über Mandanten geteilt.
Ottili Spire 1.2 ist für eine spätere Veröffentlichung reserviert. Es hat kein öffentliches Backing-Modell und wird erst bei Launch ausgeliefert.
Öffentliche Modelllinie: Ottili Vale 1.2, Ottili Cairn 1.2, Ottili Auto. Ottili Spire 1.2 ist reserviert.
Effizient-Stufe
Das effiziente Alltagsmodell für Chat, Entwürfe und schnelle Coding-Aufgaben.
Premium-Preis-Leistungs-Stufe
Das Premium-Preis-Leistungs-Modell für anspruchsvolle agentische und reasoning-lastige Software-Arbeit.
Adaptiver Router
Der adaptive Router. Er wählt pro Request Ottili Vale für schnelle Alltagsarbeit und Ottili Cairn für schwere oder agentische Aufgaben.
Flaggschiff (reserviert)
Das reservierte Ottili-KI-Flaggschiff. Noch nicht verfügbar — für eine spätere Veröffentlichung geplant.
Die öffentliche Grenze ist OpenAI-kompatibel und deterministisch. Ein API-Key, Unternehmenskontext vor jeder Anfrage, und keine privaten Details in der Antwort.
Liste der öffentlichen Modelllinie mit Fähigkeiten, Lebenszyklus-Status und Verfügbarkeit — nie reservierte oder zurückgezogene Modelle.
Chat- und Streaming-Completions mit derselben Request-Form, Finish-Reasons und normalisierten Fehler-Hülle wie OpenAI.
Eine echte Responses-API: provider-unabhängige Eingabe, Output-Items und korrelierte Usage — kein dünner Chat-Wrapper.
Stelle unternehmensbezogene Keys im Konsolenbereich aus und rufe die Plattform aus jedem OpenAI-kompatiblen SDK auf.
Usage wird gegen ein Company-Wallet gemessen. Jede abrechenbare Anfrage nimmt eine Worst-Case-Reservierung vor der Arbeit, settlelt bei Erfolg und gibt bei Abbruch frei — sodass Retries und Replays nie doppelt belasten.
Ein einzelnes Company-Wallet deckt AI-Usage über alle Produkte und die öffentliche API. Spende wird pro Request gemessen.
Idempotency-Keys und eine Preflight-Reservierung settleln genau einmal. Abbrüche geben die ungenutzte Reservierung frei.
Pro Unternehmen, Projekt und Nutzer begrenzen Limits die faire Nutzung und schützen die geteilte Plattform.
Jede Anfrage löst einen authentifizierten Key oder Session plus Unternehmenskontext vor dem Dispatch auf. Keine Daten über Mandanten hinweg.
Dieselbe Kontrollebene, die Ottili AI, Coder, Ottili LD3 und Cloud antreibt, regelt, wie jede Anfrage geroutet, gecached, berechnet und gedeckelt wird. Die folgenden Regeln sind auf Produktebene: keine internen Provider-Namen, keine Credentials, keine privaten Unified-API-Details (Website-Audit P0.2).
Eine Routing-Ebene bildet öffentliche Modell-IDs nach Fähigkeit und Stufe auf Backing-Provider ab. Der adaptive Router (Ottili Auto) wählt pro Request das effiziente Modell für schnelle Arbeit und das Premium-Modell für schwere oder agentische Arbeit.
Wenn ein Modell oder Provider degradiert ist, wird die Anfrage gemeldet — nie still auf einen bezahlten oder Mock-Provider herabgestuft. Du weißt immer, welches Modell geantwortet hat.
Ein fehlerhafter Provider oder Route wird hinter einem Circuit Breaker isoliert, sodass eine degradierte Abhängigkeit die geteilte Plattform nicht lahmlegen kann. Ein ausgelöster Breaker liefert einen normalisierten Fehler statt eines Hangs.
Wiederholte Präfix-Tokens werden pro Unternehmen gecached, sodass Workloads mit stetigem Kontext weniger kosten und schneller laufen. Der Cache ist auf dein Unternehmen begrenzt und wird nie mandantenübergreifend geteilt.
Jede abrechenbare Anfrage nimmt eine Worst-Case-Reservierung vor der Arbeit, settlelt bei Erfolg und gibt bei Abbruch frei. Idempotency-Keys sorgen dafür, dass Retries und Replays nie doppelt belasten.
Pro Unternehmen, Projekt und Nutzer stoppen harte Obergrenzen die Ausgaben an einer Decke — unabhängig von Retries. Ein Überschreiten liefert einen strukturierten, maschinenlesbaren Fehler — keine stille Überziehung.
Company-Wallets werden über den aktiven Plan oder gekaufte Credit-Packs aufgeladen. Die Ausgaben werden pro Request gegen das Wallet gemessen, sodass Usage sauber dem Bezahlten zugeordnet wird.
Ein einzelnes Company-Wallet deckt AI-Usage über Ottili AI, Coder, Ottili LD3, Cloud und die öffentliche API. Die Ausgaben sind unternehmensbezogen und isoliert — keine mandantenübergreifenden Belastungen.
Die Plattform ist für vorhersehbare, beobachtbare Inferenz ausgelegt: Prompt-Caching, strukturierte Outputs, Tool-Calling und fehlergeschlossene Reliability.
Wiederholte Präfix-Tokens werden gecached, sodass Workloads mit stetigem Kontext weniger kosten und schneller laufen.
Fordere JSON-Mode-Output für deterministische, parsebare Antworten an, auf die sich dein Code verlassen kann.
Function-Calling mit validierter Allow-Liste — begrenzte Tool-Anzahl, Namen und Payload-Größen.
Normalisierte Fehler, idempotente Retries und Streaming, das bei Disconnect genau einmal settlelt.
Die Plattform ist keine separate Fläche, die du eigenständig adoptierst. Sie ist die KI-Ebene, auf der Ottili-Produkte bereits laufen — und dieselbe Ebene, die deine Entwickler direkt aufrufen können.
Der Assistent, Missionen und Freigaben sind auf den Modellen, Credits und Controls der Plattform gebaut.
Coder nutzt die Plattform für agentisches Coding, Planung und Code-Review über local, cloud und hybrid Runs.
Ottili LD3 entwirft, prüft und veröffentlicht Inhalte mit den Modellen und strukturierten Outputs der Plattform.
Cloud betreibt Plattform-Inferenz und Coder-Workloads über eine Ottili-eigene Control Plane.
Ottili AI Platform ist über das Ottili-Early-Access-Programm verfügbar. Die öffentliche OpenAI-kompatible API, die Modelllinie und Company-Credits sind heute erreichbar; als beta markierte Fähigkeiten sind im aktiven Rollout. Hier werden keine Termine versprochen.
Stelle einen API-Key aus, lies die öffentliche Referenz und rufe dieselben Modelle auf, die Ottili ONE antreiben.