> ## Documentation Index
> Fetch the complete documentation index at: https://docs.itellico.ai/llms.txt
> Use this file to discover all available pages before exploring further.

# KI-Modell auswählen

> Wähle das Sprachmodell, das das Denken und die Antworten deines Agenten steuert

export const Screenshot = ({lightSrc, darkSrc, alt, caption, maxWidth = "880px"}) => {
  return <div style={{
    margin: "1rem auto",
    maxWidth,
    width: "100%"
  }}>
      <Frame>
        <img className="block dark:hidden" src={lightSrc} alt={alt} />
        <img className="hidden dark:block" src={darkSrc} alt={alt} />
      </Frame>
      {caption ? <p style={{
    marginTop: "0.5rem",
    fontSize: "0.875rem",
    color: "inherit",
    opacity: 0.8
  }}>
          {caption}
        </p> : null}
    </div>;
};

**Zugriff:** Öffne einen Agenten und gehe zu **Allgemein** → **Denken**.

<Screenshot lightSrc="/images/agent__ai-model_DE-light.png" darkSrc="/images/agent__ai-model_DE-dark.png" alt="Auswahl des KI-Modells mit den Preset-Optionen und dem Anbieter-Katalog" />

## Was das Modell macht

Das KI-Modell liest das Gesprächstranscript und entscheidet, was als Nächstes gesagt wird. Es folgt deinem Prompt, greift auf Wissensdatenbanken zu und löst Tools wie Weiterleitungen und Buchungen aus. Das richtige Modell zu wählen bedeutet, Qualität, Latenz und Kosten auszubalancieren.

<Note>
  Einige Modelle verursachen zusätzliche Kosten pro Minute zusätzlich zum Basistarif. Prüfe den Kostenindikator neben jedem Modell im Katalog oder sieh dir [Premium-Funktionen](/de/billing/premium-features) an.
</Note>

***

<Tabs>
  <Tab title="Einfach">
    | Preset          | Was es macht                                                                                                                     |
    | --------------- | -------------------------------------------------------------------------------------------------------------------------------- |
    | **Intelligent** | Höhere Antwortqualität mit mehr Latenz. Nutze das für komplexes Denken, mehrstufige Gespräche oder markensensible Interaktionen. |
    | **Ausgewogen**  | Gute Qualität und Geschwindigkeit für die meisten Anwendungsfälle. Empfohlen für die meisten Agenten.                            |
    | **Fast**        | Niedrigste Latenz. Nutze das für hohes Volumen oder einfache Routing- und Qualifizierungs-Workflows.                             |

    Wechsle nur dann, wenn Tests zeigen, dass du mehr Qualität oder mehr Geschwindigkeit brauchst.
  </Tab>

  <Tab title="Profi">
    Der Profi öffnet den vollständigen Anbieter-Katalog unter **Allgemein → Denken**. Nutze ihn, wenn du ein bestimmtes Modell brauchst, EU-gehostete Verarbeitung möchtest oder Anbieter direkt vergleichen willst.

    ### Anbieter-Vergleich

    | Anbieter              | Am besten für                               | Hinweise                                                                       |
    | --------------------- | ------------------------------------------- | ------------------------------------------------------------------------------ |
    | **Azure OpenAI**      | Die meisten produktiven Agenten             | Empfohlen - dieselben GPT-Modelle wie OpenAI, EU-gehostet, geringere Latenz    |
    | **OpenAI**            | Wenn Azure nicht verfügbar ist              | Dieselben Modelle wie Azure OpenAI, aber ohne EU-Hosting                       |
    | **Anthropic**         | Gesprächsqualität, komplexes Denken         | Claude-Modelle sind ausführlicher und dialogorientierter als GPT               |
    | **Groq**              | Maximale Geschwindigkeit, einfache Aufgaben | Antworten unter 500 ms; für komplexes Denken weniger geeignet                  |
    | **Benutzerdefiniert** | Eigenen Modell-Endpunkt mitbringen          | OpenAI-kompatibler Endpunkt mit Basis-URL, Modellname und API-Schlüssel-Secret |

    Der Katalog zeigt Kosten-, Geschwindigkeits- und Intelligenz-Bewertungen für jedes Modell. Klicke auf einen Anbieter, um die Liste zu filtern.

    ### Benutzerdefiniertes LLM

    <Badge>Profi</Badge>

    Wähle **Custom**, wenn du einen OpenAI-kompatiblen Endpunkt anbinden musst, der nicht Teil des integrierten Katalogs ist.

    Das Formular für das Custom-Modell fragt nach:

    * **Basis-URL** - die API-Basis-URL deines Modellanbieters
    * **Modellname** - die Modellkennung, die bei Requests gesendet wird
    * **API-Schlüssel-Secret** - ein gespeichertes Team-Secret zur Authentifizierung von Requests

    Die Custom-LLM-Konfiguration ist nur im Profi verfügbar. Wenn ein Agent bereits ein Custom-Modell nutzt und du wieder in den Einfach wechselst, bleibt das Modell konfiguriert, erscheint aber als Einstellung des Profi.

    ### Empfohlene Modelle

    | Modell                      | Wann verwenden                                                             |
    | --------------------------- | -------------------------------------------------------------------------- |
    | Azure OpenAI - GPT-4.1 Mini | Beste Standardwahl - schnell, zuverlässig, guter Tool-Einsatz, EU-gehostet |
    | Azure OpenAI - GPT-4.1      | Wenn du stärkere Reasoning- oder Mehrschritt-Logik brauchst, EU-gehostet   |
    | Claude Haiku 4.5            | Für latenzkritische oder hochvolumige Deployments                          |
    | Claude Sonnet 4.5           | Maximale Gesprächsqualität - höhere Latenz einplanen                       |
    | Groq-Modelle                | Sub-500ms-Geschwindigkeit, nur einfache Flows                              |
  </Tab>
</Tabs>

***

## Antwortstil

Der Schieberegler **Antwortstil** erscheint unter **Allgemein → Denken**, wenn das gewählte Modell eine anpassbare Temperatur unterstützt.

Die Temperatur steuert, wie konsistent oder variierend die Antworten des Agenten sind:

| Bereich     | Verhalten            | Geeignet für                                                                |
| ----------- | -------------------- | --------------------------------------------------------------------------- |
| **0.0**     | Voll deterministisch | Die meisten Agenten - maximiert Zuverlässigkeit beim Tool-Calling           |
| **0.1-0.3** | Leichte Variation    | Agenten, die natürliche Formulierungsvarianten brauchen                     |
| **0.4-0.7** | Kreativer            | Persönlichkeitsgetriebene Agenten, bei denen Konsistenz weniger wichtig ist |
| **0.8+**    | Unvorhersehbar       | In Produktion vermeiden                                                     |

<Tip>
  Nutze 0.0 für Agenten, die Calls weiterleiten, Termine buchen oder APIs aufrufen. Höhere Temperatur reduziert die Zuverlässigkeit der Tool-Ausführung.
</Tip>

***

## Nächste Schritte

<CardGroup cols={2}>
  <Card title="Stimme auswählen" icon="microphone" href="/de/build/voice-speech/select-voice">
    Wähle, wie dein Agent für Anrufende klingt
  </Card>

  <Card title="Transkribierer" icon="ear" href="/de/build/voice-speech/transcriber">
    Die Speech-to-Text-Ebene konfigurieren
  </Card>

  <Card title="Spracheinstellungen" icon="sliders" href="/de/build/voice-speech/voice-settings">
    Geschwindigkeit, Stabilität und Stil feinjustieren
  </Card>

  <Card title="Agent testen" icon="vial" href="/de/test/web-simulator">
    Modellleistung im Browser testen
  </Card>
</CardGroup>
