o3
Es denkt lange nach, bevor es antwortet: Rechenzeit bei der Inferenz gegen mehr Treffsicherheit
Der vollständige Artikel liegt auf Englisch vor; Titel und Zusammenfassung sind lokalisiert.
WAS ES IST
o3 is a reasoning model OpenAI released in April 2025, part of the o series. Unlike models that answer directly, it performs an internal chain of reasoning before producing its output, then derives the answer from that reasoning. The series is trained with reinforcement learning so the model learns to spend more reasoning steps when they buy a more reliable answer. o3 accepts text and image input and serves as the main version for mathematics, coding and scientific reasoning tasks.
Warum es wichtig ist
It turned test-time compute into a product: by reasoning at length before answering, o3 spends more compute at inference to buy steadier correctness, and made this the default shape of mainstream reasoning models.
Wichtige Eckdaten
- Type
- Reasoning model
- Context window
- 200K tokens
- Modality
- Text, image in; text out
- Released
- 2025-04
Fähigkeiten
Verwandte Konzepte
Bestärkendes Lernen aus menschlichem Feedback
Wenn die „gute Antwort" keine Formel hat, übernehmen Menschen die Rolle der Belohnungsfunktion
Prompt-Engineering und Alignment
Ein Modell hilfreich, ehrlich und harmlos zu machen ist schwieriger, als es einfach größer zu machen
Vergleichbare Produkte
DeepSeek-R1
2025Ein mit RL auf Gedankenketten trainiertes Schlussfolgerungsmodell, dessen Gewichte unter MIT-Lizenz offen sind
Gemini
2023Ein von Grund auf multimodales Allzweckmodell für sehr langen Kontext
Grok
2023Ein Dialogmodell, an die Daten einer Social-Plattform gekoppelt
Claude
2023Ein allgemeines Dialogmodell, bekannt für langen Kontext und Sicherheitsausrichtung
MiniMax-M
2025Ein Open-Weights-Schlussfolgerungsmodell mit hybridem Attention und einer Million Token Kontext