> ## Documentation Index
> Fetch the complete documentation index at: https://docs.varios-ai.com/llms.txt
> Use this file to discover all available pages before exploring further.

# Chat-Modelle

> Konfiguration von Chat-Modellen für Textgenerierung und Konversationen

Chat-Modelle sind die Kernkomponente für KI-gestützte Konversationen in VARIOS AI. Sie unterstützen Textgenerierung, Dokumentenverarbeitung und optional Code-Ausführung.

## Grunddaten

| Feld      | Pflicht | Beschreibung                                                     |
| --------- | ------- | ---------------------------------------------------------------- |
| **Bild**  | Nein    | Profilbild für das Modell (wird in der Modell-Auswahl angezeigt) |
| **Titel** | Ja      | Anzeigename des Modells (z. B. „Azure GPT 5.2")                  |

## API-Konfiguration

| Feld             | Pflicht | Beschreibung                                                                                    |
| ---------------- | ------- | ----------------------------------------------------------------------------------------------- |
| **API**          | Ja      | API-Typ – siehe [Verfügbare API-Typen](#verfügbare-api-typen) weiter unten.                     |
| **Zugangsdaten** | Ja      | Hinterlegte Zugangsdaten für den gewählten Provider (Dropdown-Auswahl).                         |
| **Modell Name**  | Ja      | Technischer Modellname, der an die API übermittelt wird (z. B. `gpt-5.2`, `claude-sonnet-4-5`). |

### Verfügbare API-Typen

| API-Typ                                   | Beschreibung                                             |
| ----------------------------------------- | -------------------------------------------------------- |
| **OpenAI Chat API** (`/chat/completions`) | Standard OpenAI Chat Completions API für Textgenerierung |
| **OpenAI Assistant API** (`/assistants`)  | OpenAI Assistant API für strukturierte Assistenten       |
| **OpenAI Responses API** (`/responses`)   | OpenAI Responses API für spezielle Response-Formate      |
| **IONOS API** (`/chat/completions`)       | IONOS-kompatible Chat Completions API                    |
| **OpenAI Chat API ohne HTTP Proxy**       | Direkte Verbindung ohne Proxy-Unterstützung              |

## Kosten und Limits

| Feld                                        | Pflicht | Beschreibung                                                                                    |
| ------------------------------------------- | ------- | ----------------------------------------------------------------------------------------------- |
| **Kosten in \$ pro Millionen Input-Token**  | Nein    | Kosten pro eine Million Input-Token ab dem Kontext-Schwellwert.                                 |
| **Kosten in \$ pro Millionen Output-Token** | Nein    | Kosten pro eine Million Output-Token ab dem Kontext-Schwellwert.                                |
| **Kosten in \$ pro Millionen Cache-Token**  | Nein    | Kosten pro eine Million Cache-Token ab dem Kontext-Schwellwert.                                 |
| **Kontextfenster**                          | Nein    | Maximale Anzahl Tokens, die im Kontext einer Anfrage verarbeitet werden können (z. B. 1050000). |
| **Ausgabe Token Limit**                     | Nein    | Maximalen Anzahl Tokens, die ein Modell in einer Antwort generieren darf (z. B. 128000).        |

<Tip>
  Wenn Sie die höheren Kosten einer Preisstaffel vermeiden möchten, wählen Sie ein Kontextfenster kleiner oder gleich dem konfigurierten Schwellwert.
</Tip>

## Verhaltenseinstellungen

| Feld                      | Pflicht | Beschreibung                                                                                                                                     |
| ------------------------- | ------- | ------------------------------------------------------------------------------------------------------------------------------------------------ |
| **Temperature**           | Nein    | Steuerung der Kreativität (0–2). Checkbox **Temperature verwenden** muss aktiviert sein. Niedrig = deterministisch, hoch = kreativ.              |
| **Top P**                 | Nein    | Nucleus-Sampling-Parameter (0–1). Checkbox **Top P verwenden** muss aktiviert sein. Alternative zur Temperature-Steuerung.                       |
| **Zusätzliche Parameter** | Nein    | Zusätzliche API-Parameter als JSON-Objekt. Geben Sie gültiges JSON ein (z. B. `{}`). Diese Parameter werden direkt an die API-Anfrage angehängt. |
| **Denkaufwand**           | Nein    | Kognitive Anstrengung des Modells. Checkbox **Denkaufwand verwenden** muss aktiviert sein. Wert: **Niedrig**, **Mittel** oder **Hoch**.          |

<Tip>
  Erlauben sie die Überschreibung der Modell-Verhaltenseinstellungen, um ihre Assistenten noch genauer an ihre Bedürfnisse anzupassen. (Expertenansicht benötigt)
</Tip>

## Streaming

| Feld                      | Pflicht | Beschreibung                                                                                                      |
| ------------------------- | ------- | ----------------------------------------------------------------------------------------------------------------- |
| **Unterstützt Streaming** | Nein    | Checkbox **Nutze ein streaming Modell** – Aktiviert Streaming-Responses (Antwort wird Stück für Stück angezeigt). |
| **Stream-Optionen**       | Nein    | Checkbox **Stream-Optionen verwenden** – Aktiviert erweiterte Streaming-Optionen (z. B. Token-Nutzung im Stream). |

## Benutzer-Identifikation und MIME-Typen

| Feld                        | Pflicht | Beschreibung                                                                                                                                                                        |
| --------------------------- | ------- | ----------------------------------------------------------------------------------------------------------------------------------------------------------------------------------- |
| **Benutzer-Identifikation** | Nein    | Checkbox **Benutzer-Identifikation verwenden** – Fügt der API-Anfrage einen eindeutigen Nutzer-Bezeichner hinzu.                                                                    |
| **Erlaubte MIME-Typen**     | Nein    | Dateitypen, die **direkt an das Modell** gesendet werden (z. B. Bilder für Vision-Modelle). Alle anderen Dateitypen werden automatisch über die Dokumentenverarbeitung abgewickelt. |

<Tip>
  Die **Erlaubten MIME-Typen** bestimmen, welche Dateien ohne Umweg über die
  Dokumentenverarbeitung direkt an das Modell gehen. Typisches Beispiel:
  `image/png`, `image/jpeg` für Vision-Modelle.
</Tip>

## Dienstzustand überprüfen

* Legen Sie fest, ob Test-Token zur Prüfung der Erreichbarkeit des Modells gesendet werden und in welchem Intervall dies geschieht. Pro Prüfung fallen Kosten an.

## DLP-Sicherheitseinstellungen

### Basis DLP Einstellungen

#### GDPR Protection

Erkennt personenbezogene Daten im Chat und verschlüsselt diese vor dem Transfer zur KI.

| Option          | Beschreibung                                                                  |
| --------------- | ----------------------------------------------------------------------------- |
| **aktiviert**   | GDPR-Schutz ist immer aktiv und kann vom Nutzer nicht deaktiviert werden.     |
| **optional**    | GDPR-Schutz ist standardmäßig aktiv, kann aber vom Nutzer deaktiviert werden. |
| **deaktiviert** | GDPR-Schutz ist deaktiviert.                                                  |

#### Sensitive File Protection

Blockiert den Upload von Dokumenten mit vertraulicher Klassifizierung.

| Option          | Beschreibung                                   |
| --------------- | ---------------------------------------------- |
| **aktiviert**   | Upload vertraulicher Dokumente wird blockiert. |
| **deaktiviert** | Upload vertraulicher Dokumente ist erlaubt.    |

### Enterprise DLP Einstellungen

#### DLP Interface (ICAP)

Sendet Texte und Dateien zur Überprüfung an den konfigurierten ICAP-Server.

| Option          | Beschreibung                                 |
| --------------- | -------------------------------------------- |
| **aktiviert**   | ICAP-Server wird für alle Inhalte verwendet. |
| **deaktiviert** | ICAP-Server wird nicht verwendet.            |
