Schlussfolgern und Gedankenkette
Ein schweres Problem in Zwischenschritte zerlegen
Der vollständige Artikel liegt auf Englisch vor; Titel und Zusammenfassung sind lokalisiert.
WAS DIESE FÄHIGKEIT BEDEUTET
Takes a problem requiring several steps — a maths problem, a logic puzzle, a task needing a plan — and returns the answer together with intermediate steps. Unlike free generation the goal is correctness rather than fluency, and unlike ordinary conversation it spends much of its compute on an internal scratchpad, showing the user mainly the result and a short rationale.
Wie sie technisch umgesetzt wird
One family relies on prompting: examples or instructions ask the model to think before answering, writing steps out explicitly — chain-of-thought. Another relies on training: large-scale reinforcement learning on verifiable problems such as maths and code teaches the model to generate a longer deliberation before committing. Self-consistency voting over several sampled chains, and combining deliberation with tool calls or search, are now common too.
Repräsentative Produkte
23o3
2025Es denkt lange nach, bevor es antwortet: Rechenzeit bei der Inferenz gegen mehr Treffsicherheit
DeepSeek-R1
2025Ein mit RL auf Gedankenketten trainiertes Schlussfolgerungsmodell, dessen Gewichte unter MIT-Lizenz offen sind
Gemini
2023Ein von Grund auf multimodales Allzweckmodell für sehr langen Kontext
Claude
2023Ein allgemeines Dialogmodell, bekannt für langen Kontext und Sicherheitsausrichtung
Qwen
2023Eine Open-Weights-Familie über viele Größen hinweg, mit multimodalen Versionen
MiniMax-M
2025Ein Open-Weights-Schlussfolgerungsmodell mit hybridem Attention und einer Million Token Kontext
DeepSeek-V3
2024Ein Open-Weights-MoE mit 671B Parametern, das pro Token nur 37B aktiviert
GPT-4o
2024Ein von Grund auf multimodales Allzweckmodell: Text, Bild und Audio über einen Zugang
Jamba
2024Ein Open-Weights-Modell, das ein Zustandsraummodell mit einem Transformer mischt
DBRX
2024Offenes MoE-Sprachmodell von Databricks
Mistral Large
2024Das kommerzielle Flaggschiffmodell eines europäischen Open-Weights-Labors
Gemini
2024Ein Chat-Eingang, der Suche, Office-Apps und ein multimodales Modell bündelt
Grok
2023Ein Dialogmodell, an die Daten einer Social-Plattform gekoppelt
Yi
2023Ein zweisprachiges (Chinesisch–Englisch) Open-Weights-Modell mit sehr langem Kontext
Hunyuan
2023Tencent Generalmodell-Familie mit Open-Weights-Versionen
Doubao
2023ByteDances allgemeines Dialogmodell und App
Phi
2023Kleine, effiziente Modelle aus kuratierten Daten
Step
2023Eine Allzweck-Modellfamilie für Multimodalität und On-Device-Betrieb
Baichuan
2023Ein Open-Weights-Allzweckmodell für den chinesischen Sprachraum
GLM
2023Ein chinesisches Allzweckmodell, das mit autoregressivem Lückenfüllen begann
Llama
2023Die Modellfamilie, die offene Gewichte zum Mainstream machte
ChatGPT
2022Das Chatfenster, das ein großes Sprachmodell für alle zugänglich machte
Pangu
2020Huaweis Pangu-Familie von Basismodellen
Beteiligte Organisationen
Typische Verwendungen
- Solving maths and physics problems
- Multi-step planning and scheduling
- Code and data problems needing derivation
- Reasoned choices under constraints
Wie sie bewertet wird
- Math benchmark accuracy
- Correct-answer rate on sets such as GSM8K, MATH, AIME
- pass@k
- Share of problems solved by at least one of k samples
- Chain-of-thought faithfulness
- Whether the written steps actually reflect how the answer was reached
Grenzen und schwierige Punkte
- The written reasoning can be unfaithful: the answer comes first and a plausible rationale is added after
- In long chains an early misstep propagates, yet the final answer still sounds assured
- Deliberating at length on trivial questions inflates latency and cost
Konzepte dahinter
Prompt-Engineering und Alignment
Ein Modell hilfreich, ehrlich und harmlos zu machen ist schwieriger, als es einfach größer zu machen
Bestärkendes Lernen aus menschlichem Feedback
Wenn die „gute Antwort" keine Formel hat, übernehmen Menschen die Rolle der Belohnungsfunktion
Transformer-Architektur
Statt Wort-für-Wort-Stafette ein Raum, in dem alle zugleich sprechen — und weite Abhängigkeiten sind nur einen Schritt entfernt