Temperature (LLM-Parameter)
Temperature steuert, wie zufällig oder kreativ ein Sprachmodell antwortet: niedrige Werte machen die Ausgabe deterministisch, hohe Werte vielfältiger.
Temperature ist ein Steuerparameter bei der Textgenerierung eines Sprachmodells. Er beeinflusst, wie stark das Modell bei der Wahl des jeweils nächsten Wortes vom wahrscheinlichsten Vorschlag abweichen darf. Ein Sprachmodell berechnet für jeden Schritt eine Wahrscheinlichkeitsverteilung über mögliche nächste Tokens - Temperature entscheidet, wie entschlossen oder wie offen aus dieser Verteilung ausgewählt wird.
Was Temperature bewirkt
- Niedrige Temperature: Das Modell wählt fast immer die wahrscheinlichsten Tokens. Die Ausgabe wird deterministischer, wiederholbarer und faktennäher - ideal für Aufgaben mit einer klaren richtigen Antwort wie Extraktion, Klassifikation oder Code.
- Hohe Temperature: Auch unwahrscheinlichere Tokens kommen häufiger zum Zug. Die Ausgabe wird vielfältiger und weniger vorhersehbar - passend für Brainstorming, Varianten oder kreative Texte, aber mit höherem Risiko für Abschweifen und Halluzinationen.
- Mittelwerte: Ein ausgewogener Bereich hält die Ausgabe natürlich, ohne sie starr oder beliebig werden zu lassen.
Temperature und Top-p
Temperature wird meist zusammen mit Top-p (Nucleus Sampling) betrachtet. Beide steuern die Vielfalt der Ausgabe, aber auf unterschiedliche Weise: Temperature skaliert die gesamte Wahrscheinlichkeitsverteilung, während Top-p die Auswahl auf die kleinste Menge an Tokens begrenzt, deren Wahrscheinlichkeiten zusammen einen Schwellenwert erreichen. In der Praxis verändert man üblicherweise einen der beiden Werte gezielt, statt beide gleichzeitig aggressiv zu drehen, um die Wirkung nachvollziehbar zu halten.
Wann welcher Wert?
Die richtige Einstellung folgt aus der Aufgabe, nicht aus einer festen Regel. Faktenarbeit, strukturierte Ausgaben und reproduzierbare Ergebnisse verlangen niedrige Werte; kreative oder explorative Aufgaben profitieren von höheren. Temperature ist damit ein Baustein des Prompt Engineering und wirkt zusammen mit der Prompt-Gestaltung - auch Techniken wie Few-Shot-Prompting stabilisieren das Ergebnis zusätzlich, unabhängig vom gewählten Temperature-Wert.
Temperature bei Elasticbrains
Wir stimmen Temperature, Top-p und Prompt-Aufbau je Anwendungsfall aufeinander ab - deterministisch dort, wo Verlässlichkeit zählt, offener dort, wo Varianz gewünscht ist. Wie daraus eine belastbare KI-Anwendung entsteht, zeigen wir auf unserer Leistungsseite KI-Entwicklung.
Weiterführende Ressourcen
- Glossar: Prompt Engineering, LLM, Few-Shot-Prompting
- Leistung: KI-Entwicklung
Häufige Fragen
Was macht der Temperature-Parameter bei einem LLM?
Welche Temperature ist die richtige?
Was ist der Unterschied zwischen Temperature und Top-p?
Verhindert eine niedrige Temperature Halluzinationen?
Weitere Glossarbegriffe
Agentic Coding - KI-gestützte Softwareentwicklung mit autonomen Agenten
Agentic Coding: autonome KI-Agenten planen, implementieren und testen - der Mensch steuert als Architekt und Reviewer. Professioneller Weg zur KI-Entwicklung.
AI Pair Programming - KI als Programmierpartner
AI Pair Programming bezeichnet den Einsatz eines KI-Agenten als gleichwertigen Programmierpartner - verfügbar rund um die Uhr, mit konsistenter Qualität.
E-Rechnung, ZUGFeRD und XRechnung - strukturierte Rechnungsformate erklärt
E-Rechnung, ZUGFeRD und XRechnung erklärt: Unterschied zwischen Hybrid-Format (PDF+XML) und reinem XML - plus E-Rechnungspflicht in Deutschland.
Bereit, das in die Praxis zu bringen?
Lassen Sie uns in einem kostenlosen Erstgespräch über Ihr Vorhaben sprechen - unverbindlich und konkret.