Zum Inhalt springen
KI-Atlas

Schlussfolgern und Gedankenkette

Ein schweres Problem in Zwischenschritte zerlegen

Sprache & WissenFortgeschritten #08
EingabeTextText

Der vollständige Artikel liegt auf Englisch vor; Titel und Zusammenfassung sind lokalisiert.

WAS DIESE FÄHIGKEIT BEDEUTET

Takes a problem requiring several steps — a maths problem, a logic puzzle, a task needing a plan — and returns the answer together with intermediate steps. Unlike free generation the goal is correctness rather than fluency, and unlike ordinary conversation it spends much of its compute on an internal scratchpad, showing the user mainly the result and a short rationale.

Wie sie technisch umgesetzt wird

One family relies on prompting: examples or instructions ask the model to think before answering, writing steps out explicitly — chain-of-thought. Another relies on training: large-scale reinforcement learning on verifiable problems such as maths and code teaches the model to generate a longer deliberation before committing. Self-consistency voting over several sampled chains, and combining deliberation with tool calls or search, are now common too.

Repräsentative Produkte

23

o3

2025
OpenAI

Es denkt lange nach, bevor es antwortet: Rechenzeit bei der Inferenz gegen mehr Treffsicherheit

Modell Geschlossen
TextBildText

DeepSeek-R1

2025
DeepSeek

Ein mit RL auf Gedankenketten trainiertes Schlussfolgerungsmodell, dessen Gewichte unter MIT-Lizenz offen sind

Modell Offene Gewichte
TextText

Gemini

2023
Google DeepMind

Ein von Grund auf multimodales Allzweckmodell für sehr langen Kontext

Modell Geschlossen
TextBildAudioVideoText

Claude

2023
Anthropic

Ein allgemeines Dialogmodell, bekannt für langen Kontext und Sicherheitsausrichtung

Modell Geschlossen
TextBildText

Qwen

2023
Alibaba (Qwen)

Eine Open-Weights-Familie über viele Größen hinweg, mit multimodalen Versionen

Modell Offene Gewichte
TextBildText

MiniMax-M

2025
MiniMax

Ein Open-Weights-Schlussfolgerungsmodell mit hybridem Attention und einer Million Token Kontext

Modell Offene Gewichte
TextText

DeepSeek-V3

2024
DeepSeek

Ein Open-Weights-MoE mit 671B Parametern, das pro Token nur 37B aktiviert

Modell Offene Gewichte
TextText

GPT-4o

2024
OpenAI

Ein von Grund auf multimodales Allzweckmodell: Text, Bild und Audio über einen Zugang

Modell Geschlossen
TextBildAudioTextAudio

Jamba

2024
AI21 Labs

Ein Open-Weights-Modell, das ein Zustandsraummodell mit einem Transformer mischt

Modell Offene Gewichte
TextText

DBRX

2024
Databricks

Offenes MoE-Sprachmodell von Databricks

Modell Offene Gewichte
TextText

Mistral Large

2024
Mistral AI

Das kommerzielle Flaggschiffmodell eines europäischen Open-Weights-Labors

Modell Geschlossen
TextText

Gemini

2024
Google DeepMind

Ein Chat-Eingang, der Suche, Office-Apps und ein multimodales Modell bündelt

App Freemium
TextBildAudioTextBildAudio

Grok

2023
xAI

Ein Dialogmodell, an die Daten einer Social-Plattform gekoppelt

Modell Geschlossen
TextBildText

Yi

2023
01.AI

Ein zweisprachiges (Chinesisch–Englisch) Open-Weights-Modell mit sehr langem Kontext

Modell Offene Gewichte
TextText

Hunyuan

2023
Tencent (Hunyuan)

Tencent Generalmodell-Familie mit Open-Weights-Versionen

Modell Offene Gewichte
TextBildText

Doubao

2023
ByteDance (Seed)

ByteDances allgemeines Dialogmodell und App

Modell Geschlossen
TextBildText

Phi

2023
Microsoft

Kleine, effiziente Modelle aus kuratierten Daten

Modell Offene Gewichte
TextText

Step

2023
StepFun

Eine Allzweck-Modellfamilie für Multimodalität und On-Device-Betrieb

Modell Geschlossen
TextBildText

Baichuan

2023
Baichuan AI

Ein Open-Weights-Allzweckmodell für den chinesischen Sprachraum

Modell Offene Gewichte
TextText

GLM

2023
Zhipu AI

Ein chinesisches Allzweckmodell, das mit autoregressivem Lückenfüllen begann

Modell Geschlossen
TextText

Llama

2023
Meta AI (FAIR)

Die Modellfamilie, die offene Gewichte zum Mainstream machte

Modell Offene Gewichte
TextText

ChatGPT

2022
OpenAI

Das Chatfenster, das ein großes Sprachmodell für alle zugänglich machte

App Freemium
TextBildAudioTextBildAudio

Pangu

2020
Huawei

Huaweis Pangu-Familie von Basismodellen

Modell Geschlossen
TextText

Beteiligte Organisationen

Typische Verwendungen

  • Solving maths and physics problems
  • Multi-step planning and scheduling
  • Code and data problems needing derivation
  • Reasoned choices under constraints

Wie sie bewertet wird

Math benchmark accuracy
Correct-answer rate on sets such as GSM8K, MATH, AIME
pass@k
Share of problems solved by at least one of k samples
Chain-of-thought faithfulness
Whether the written steps actually reflect how the answer was reached

Grenzen und schwierige Punkte

  • The written reasoning can be unfaithful: the answer comes first and a plausible rationale is added after
  • In long chains an early misstep propagates, yet the final answer still sounds assured
  • Deliberating at length on trivial questions inflates latency and cost

Konzepte dahinter