Modelle
Custodos bietet KI-Modelle mehrerer Anbieter in einer Oberfläche. Diese Seite zeigt, wie Sie im Chat ein Modell wählen, was der Eintrag „Auto“ bedeutet und woran Sie erkennen, was ein Modell kann.
Zuletzt geprüft am 28. September 2026
Auf dieser Seite
Ein Modell wählen
Das Modell wählen Sie im Eingabefeld des Chats. Sie können es jederzeit wechseln, auch mitten in einem Chat. Jede Antwort zeigt, welches Modell sie geschrieben hat.
- 1
Modellwähler öffnen
Klicken Sie im Eingabefeld auf den Namen des aktuellen Modells oder auf Modell wählen. Auf dem Handy zeigt die Schaltfläche nur ein Logo, ohne den Namen. - 2
Modelle vergleichen
Fahren Sie mit der Maus über einen Eintrag oder wählen Sie ihn mit der Tastatur an. Daneben erscheint eine Infokarte zu diesem Modell. - 3
Modell übernehmen
Klicken Sie auf das Modell oder auf Auto. Die aktuelle Wahl ist in der Liste hervorgehoben, die nächste Nachricht geht an dieses Modell.
Auto: der Standard Ihres Workspace
Ganz oben im Modellwähler steht Auto. Dahinter steht das Standardmodell, das ein Admin für neue Chats festgelegt hat. Hat niemand eines festgelegt, nimmt Custodos ein eigenes Standardmodell. Custodos wählt dafür ein Modell, das Werkzeuge nutzen kann, sofern Ihr Workspace eines erlaubt.
Unter Auto steht, welches Modell gerade dahintersteht. Wer keine besonderen Anforderungen hat, bleibt bei Auto. Ein anderes Modell lohnt sich zum Beispiel für sehr lange Dokumente, für anspruchsvolle Analysen oder wenn Sie zwei Antworten vergleichen wollen. Für den Vergleich nutzen Sie Mit … neu generieren an der letzten Antwort, siehe Grundlagen des Chats.
Die Modellgruppen
Der Modellwähler ordnet die Modelle in Gruppen. Die Gruppe sagt, wer das Modell entwickelt hat und wo es betrieben wird.
| Gruppe | Was dazu gehört | Wo es läuft |
|---|---|---|
| Frontier | Die leistungsstärksten Modelle großer US-Anbieter, etwa Claude, Gemini und GPT | in Rechenzentren in der EU oder der Schweiz |
| Offene Modelle | Modelle mit offenen Gewichten, etwa von Mistral, Qwen, MiniMax und GLM | auf europäischer Infrastruktur |
Was die Infokarte zeigt
Die Infokarte neben der Liste beschreibt das Modell, auf dem Maus oder Tastatur gerade stehen. Auf schmalen Bildschirmen wird sie ausgeblendet.
- Anbieter und Name sowie eine kurze Beschreibung, wofür sich das Modell eignet.
- Kreditverbrauch in drei Stufen: Niedrig, Mittel oder Hoch, darunter die ungefähren Credits pro Antwort. Gerechnet wird mit einer Frage und einer Antwort durchschnittlicher Länge. Wie Credits funktionieren, steht unter Credits und Drosselung.
- Kontextfenster in Token: wie viel Text das Modell in einem Chat auf einmal verarbeiten kann, samt Anhängen.
- Hosting-Ort: in welchem Land oder in welcher Region und bei welchem Infrastruktur-Anbieter das Modell läuft.
- Hinweise, wenn ein Modell vor der Antwort nachdenkt oder keine Werkzeuge nutzen kann (siehe unten).
Modelle ohne Werkzeuge
Einige Modelle können keine Werkzeuge nutzen. Sie beantworten Fragen und lesen angehängte Dateien, aber sie suchen nicht im Web, nicht im Company Brain und erstellen oder bearbeiten keine Dateien. Die Infokarte sagt das mit dem Satz Ohne Web- und Brain-Suche, erstellt keine Dateien.
Ist ein Brain an den Chat angehängt, sind diese Modelle im Modellwähler ausgegraut und lassen sich nicht wählen. Die Infokarte zeigt trotzdem, warum.
Modelle, die vor der Antwort nachdenken
Einige Modelle denken nach, bevor sie antworten. Solange noch kein Text erscheint, zeigt der Chat bei ihnen Denkt nach…. Das Nachdenken wird wie Ausgabe abgerechnet. Solche Antworten verbrauchen deshalb mehr Credits, als ihre Länge vermuten lässt. Die Infokarte weist bei diesen Modellen darauf hin.
Verfügbare Chat-Modelle
Die Tabelle zeigt die Chat-Modelle im Katalog von Custodos mit Stand 28.09.2026. Welche davon Sie sehen, hängt von der Verarbeitungsregion Ihres Workspace und von der Freigabe durch Ihren Admin ab. Maßgeblich ist immer der Modellwähler.
| Modell | Gruppe | Bilder lesen | Werkzeuge | Kontextfenster |
|---|---|---|---|---|
| Claude Opus 5 (Anthropic) | Frontier | ja | ja | 1 Mio. Token |
| Claude Sonnet 5 (Anthropic) | Frontier | ja | ja | 1 Mio. Token |
| Claude 3 Haiku (Anthropic) | Frontier | ja | ja | 200 000 Token |
| Gemini 3.7 Flash (Google) | Frontier | ja | ja | 1 Mio. Token |
| Gemini 3.5 Flash-Lite (Google) | Frontier | ja | ja | 1 Mio. Token |
| Gemini 2.5 Pro (Google) | Frontier | ja | ja | 200 000 Token |
| GPT-5.6 Sol, Terra und Luna (OpenAI) | Frontier | ja | ja | 272 000 Token |
| GPT-5.4 Mini (OpenAI) | Frontier | ja | ja | 400 000 Token |
| Mistral Pixtral Large (Mistral AI) | Offene Modelle | ja | nein | 128 000 Token |
| Qwen3 235B und Qwen3 Coder 30B (Qwen) | Offene Modelle | nein | nein | 256 000 Token |
| MiniMax M2.5 (MiniMax) | Offene Modelle | nein | ja | 192 000 Token |
| GLM 4.7 Flash (Z.ai) | Offene Modelle | nein | nein | 128 000 Token |
Wer festlegt, welche Modelle es gibt
Admins legen im Bereich Modelle fest, in welcher Region der Workspace verarbeitet, welche Modelle erlaubt sind und welches Modell neue Chats bekommen. Mitglieder wählen im Chat frei unter den erlaubten Modellen. Wie das geht, steht unter Modelle verwalten.
Ist noch kein Modell erlaubt, zeigt der Modellwähler Noch kein Modell freigegeben. Bitten Sie dann einen Admin, ein Modell freizugeben.
Weiterlesen
Frage offen? Schreiben Sie uns.
