मुख्य सामग्री पर जाएँ

तर्क और विचार-शृंखला

कठिन समस्या को मध्यवर्ती चरणों में बाँटकर हल करना

भाषा और ज्ञानमध्यवर्ती #08
इनपुटटेक्स्टटेक्स्ट

यह पृष्ठ अंग्रेज़ी में प्रस्तुत है; शीर्षक और सारांश का स्थानीयकरण किया गया है।

यह क्षमता क्या है

Takes a problem requiring several steps — a maths problem, a logic puzzle, a task needing a plan — and returns the answer together with intermediate steps. Unlike free generation the goal is correctness rather than fluency, and unlike ordinary conversation it spends much of its compute on an internal scratchpad, showing the user mainly the result and a short rationale.

तकनीकी रूप से कैसे

One family relies on prompting: examples or instructions ask the model to think before answering, writing steps out explicitly — chain-of-thought. Another relies on training: large-scale reinforcement learning on verifiable problems such as maths and code teaches the model to generate a longer deliberation before committing. Self-consistency voting over several sampled chains, and combining deliberation with tool calls or search, are now common too.

प्रतिनिधि उत्पाद

23

o3

2025
OpenAI

उत्तर देने से पहले लंबी तर्क-श्रृंखला, अनुमान के समय गणना से अधिक सटीकता

मॉडल बंद स्रोत
टेक्स्टइमेजटेक्स्ट

DeepSeek-R1

2025
DeepSeek

तर्क-श्रृंखला पर RL से प्रशिक्षित तर्क मॉडल, भार MIT लाइसेंस के तहत खुले

मॉडल खुले वेट
टेक्स्टटेक्स्ट

Gemini

2023
Google DeepMind

मूल रूप से बहुविध, अति-लंबे संदर्भ के लिए बना सामान्य मॉडल

मॉडल बंद स्रोत
टेक्स्टइमेजऑडियोवीडियोटेक्स्ट

Claude

2023
Anthropic

लंबे संदर्भ और सुरक्षा-संरेखण के लिए जाना जाने वाला सामान्य संवाद मॉडल

मॉडल बंद स्रोत
टेक्स्टइमेजटेक्स्ट

Qwen

2023
Alibaba (Qwen)

अनेक आकारों और बहुविध संस्करणों वाला ओपन-वेट परिवार

मॉडल खुले वेट
टेक्स्टइमेजटेक्स्ट

MiniMax-M

2025
MiniMax

हाइब्रिड अटेंशन और दस लाख टोकन संदर्भ वाला ओपन-वेट तर्क मॉडल

मॉडल खुले वेट
टेक्स्टटेक्स्ट

DeepSeek-V3

2024
DeepSeek

671B पैरामीटर वाला ओपन-वेट MoE, प्रति टोकन केवल 37B सक्रिय

मॉडल खुले वेट
टेक्स्टटेक्स्ट

GPT-4o

2024
OpenAI

मूल रूप से बहुविध सामान्य मॉडल — पाठ, चित्र और ऑडियो एक ही द्वार से

मॉडल बंद स्रोत
टेक्स्टइमेजऑडियोटेक्स्टऑडियो

Jamba

2024
AI21 Labs

स्टेट-स्पेस मॉडल और Transformer को मिलाने वाला ओपन-वेट मॉडल

मॉडल खुले वेट
टेक्स्टटेक्स्ट

DBRX

2024
Databricks

Databricks का ओपन-वेट MoE भाषा मॉडल

मॉडल खुले वेट
टेक्स्टटेक्स्ट

Mistral Large

2024
Mistral AI

यूरोपीय ओपन-वेट लैब का फ़्लैगशिप वाणिज्यिक मॉडल

मॉडल बंद स्रोत
टेक्स्टटेक्स्ट

Gemini

2024
Google DeepMind

खोज, ऑफ़िस और बहुविध मॉडल को एक चैट द्वार में समेटता है

ऐप फ़्रीमियम
टेक्स्टइमेजऑडियोटेक्स्टइमेजऑडियो

Grok

2023
xAI

सोशल प्लेटफ़ॉर्म के डेटा से जुड़ा संवाद मॉडल

मॉडल बंद स्रोत
टेक्स्टइमेजटेक्स्ट

Yi

2023
01.AI

चीनी-अंग्रेज़ी द्विभाषी ओपन-वेट मॉडल, अति-लंबे संदर्भ संस्करणों के साथ

मॉडल खुले वेट
टेक्स्टटेक्स्ट

Hunyuan

2023
Tencent (Hunyuan)

ओपन-वेट संस्करणों सहित टेनसेंट का सामान्य मॉडल परिवार

मॉडल खुले वेट
टेक्स्टइमेजटेक्स्ट

Doubao

2023
ByteDance (Seed)

बाइटडांस का सामान्य संवाद मॉडल और ऐप

मॉडल बंद स्रोत
टेक्स्टइमेजटेक्स्ट

Phi

2023
Microsoft

चुने हुए डेटा से बने छोटे और कुशल मॉडल

मॉडल खुले वेट
टेक्स्टटेक्स्ट

Step

2023
StepFun

बहुविधता और ऑन-डिवाइस उपयोग पर लक्षित सामान्य मॉडल परिवार

मॉडल बंद स्रोत
टेक्स्टइमेजटेक्स्ट

Baichuan

2023
Baichuan AI

चीनी-भाषा उपयोग के लिए ओपन-वेट सामान्य मॉडल

मॉडल खुले वेट
टेक्स्टटेक्स्ट

GLM

2023
Zhipu AI

ऑटोरेग्रेसिव ब्लैंक-भरने वाले प्रीट्रेनिंग से शुरू हुआ चीनी सामान्य मॉडल

मॉडल बंद स्रोत
टेक्स्टटेक्स्ट

Llama

2023
Meta AI (FAIR)

खुले भार के रास्ते को मुख्यधारा बनाने वाला मॉडल परिवार

मॉडल खुले वेट
टेक्स्टटेक्स्ट

ChatGPT

2022
OpenAI

वह चैट विंडो जिसने बड़े भाषा मॉडल को हर किसी तक पहुँचाया

ऐप फ़्रीमियम
टेक्स्टइमेजऑडियोटेक्स्टइमेजऑडियो

Pangu

2020
Huawei

हुवावे के Pangu फ़ाउंडेशन मॉडल परिवार

मॉडल बंद स्रोत
टेक्स्टटेक्स्ट

संबंधित संस्थान

सामान्य उपयोग

  • Solving maths and physics problems
  • Multi-step planning and scheduling
  • Code and data problems needing derivation
  • Reasoned choices under constraints

इसका मूल्यांकन कैसे होता है

Math benchmark accuracy
Correct-answer rate on sets such as GSM8K, MATH, AIME
pass@k
Share of problems solved by at least one of k samples
Chain-of-thought faithfulness
Whether the written steps actually reflect how the answer was reached

सीमाएँ और कठिनाइयाँ

  • The written reasoning can be unfaithful: the answer comes first and a plausible rationale is added after
  • In long chains an early misstep propagates, yet the final answer still sounds assured
  • Deliberating at length on trivial questions inflates latency and cost

इसके पीछे की अवधारणाएँ