मुख्य सामग्री पर जाएँ

टेक्स्ट जनरेशन

पहले के पाठ को शब्द-दर-शब्द आगे बढ़ाता है

भाषा और ज्ञानप्रारंभिक #01
इनपुटटेक्स्टटेक्स्ट

यह पृष्ठ अंग्रेज़ी में प्रस्तुत है; शीर्षक और सारांश का स्थानीयकरण किया गया है।

यह क्षमता क्या है

Given a passage as context, the model writes what comes next. Both input and output are text and no particular transformation is targeted: it can continue a story, finish an explanation or draft an email. It differs from conversation in that no instruction format is required, and from summarisation or translation in that neither compression nor a language switch is the goal — both ends stay in the same modality.

तकनीकी रूप से कैसे

The dominant route is an autoregressive Transformer language model: text is split into tokens, the model predicts the probability of the next token position by position, and training maximises likelihood over the corpus. GPT, Llama and Qwen all follow it, differing in scale, data and post-training recipe. At inference, temperature, top-k and top-p shape diversity, while long outputs reuse cached keys and values to cut cost.

प्रतिनिधि उत्पाद

27

GPT-4o

2024
OpenAI

मूल रूप से बहुविध सामान्य मॉडल — पाठ, चित्र और ऑडियो एक ही द्वार से

मॉडल बंद स्रोत
टेक्स्टइमेजऑडियोटेक्स्टऑडियो

Llama

2023
Meta AI (FAIR)

खुले भार के रास्ते को मुख्यधारा बनाने वाला मॉडल परिवार

मॉडल खुले वेट
टेक्स्टटेक्स्ट

Qwen

2023
Alibaba (Qwen)

अनेक आकारों और बहुविध संस्करणों वाला ओपन-वेट परिवार

मॉडल खुले वेट
टेक्स्टइमेजटेक्स्ट

DeepSeek-V3

2024
DeepSeek

671B पैरामीटर वाला ओपन-वेट MoE, प्रति टोकन केवल 37B सक्रिय

मॉडल खुले वेट
टेक्स्टटेक्स्ट

Mistral Large

2024
Mistral AI

यूरोपीय ओपन-वेट लैब का फ़्लैगशिप वाणिज्यिक मॉडल

मॉडल बंद स्रोत
टेक्स्टटेक्स्ट

Gemini

2023
Google DeepMind

मूल रूप से बहुविध, अति-लंबे संदर्भ के लिए बना सामान्य मॉडल

मॉडल बंद स्रोत
टेक्स्टइमेजऑडियोवीडियोटेक्स्ट

Claude

2023
Anthropic

लंबे संदर्भ और सुरक्षा-संरेखण के लिए जाना जाने वाला सामान्य संवाद मॉडल

मॉडल बंद स्रोत
टेक्स्टइमेजटेक्स्ट

MiniMax-M

2025
MiniMax

हाइब्रिड अटेंशन और दस लाख टोकन संदर्भ वाला ओपन-वेट तर्क मॉडल

मॉडल खुले वेट
टेक्स्टटेक्स्ट

DeepSeek-R1

2025
DeepSeek

तर्क-श्रृंखला पर RL से प्रशिक्षित तर्क मॉडल, भार MIT लाइसेंस के तहत खुले

मॉडल खुले वेट
टेक्स्टटेक्स्ट

Apple Intelligence

2024
Apple

सिस्टम-स्तरीय एआई जो काम को डिवाइस और निजी क्लाउड में बाँटता है

ऐप बंद स्रोत
टेक्स्टइमेजऑडियोटेक्स्टइमेज

Command R

2024
Cohere

पुनर्प्राप्ति-संवर्धन और टूल उपयोग के लिए बना वाणिज्यिक मॉडल

मॉडल खुले वेट
टेक्स्टटेक्स्ट

Jamba

2024
AI21 Labs

स्टेट-स्पेस मॉडल और Transformer को मिलाने वाला ओपन-वेट मॉडल

मॉडल खुले वेट
टेक्स्टटेक्स्ट

DBRX

2024
Databricks

Databricks का ओपन-वेट MoE भाषा मॉडल

मॉडल खुले वेट
टेक्स्टटेक्स्ट

Gemini

2024
Google DeepMind

खोज, ऑफ़िस और बहुविध मॉडल को एक चैट द्वार में समेटता है

ऐप फ़्रीमियम
टेक्स्टइमेजऑडियोटेक्स्टइमेजऑडियो

Grok

2023
xAI

सोशल प्लेटफ़ॉर्म के डेटा से जुड़ा संवाद मॉडल

मॉडल बंद स्रोत
टेक्स्टइमेजटेक्स्ट

Yi

2023
01.AI

चीनी-अंग्रेज़ी द्विभाषी ओपन-वेट मॉडल, अति-लंबे संदर्भ संस्करणों के साथ

मॉडल खुले वेट
टेक्स्टटेक्स्ट

Kimi

2023
Moonshot AI

लंबे संदर्भ के लिए जाना जाने वाला चीनी संवाद सहायक

मॉडल बंद स्रोत
टेक्स्टटेक्स्ट

Hunyuan

2023
Tencent (Hunyuan)

ओपन-वेट संस्करणों सहित टेनसेंट का सामान्य मॉडल परिवार

मॉडल खुले वेट
टेक्स्टइमेजटेक्स्ट

Microsoft Copilot

2023
Microsoft

ऑपरेटिंग सिस्टम और ऑफ़िस ऐप्स में बुनी हुई संवादात्मक एआई

ऐप फ़्रीमियम
टेक्स्टइमेजऑडियोटेक्स्टइमेज

Doubao

2023
ByteDance (Seed)

बाइटडांस का सामान्य संवाद मॉडल और ऐप

मॉडल बंद स्रोत
टेक्स्टइमेजटेक्स्ट

Phi

2023
Microsoft

चुने हुए डेटा से बने छोटे और कुशल मॉडल

मॉडल खुले वेट
टेक्स्टटेक्स्ट

Step

2023
StepFun

बहुविधता और ऑन-डिवाइस उपयोग पर लक्षित सामान्य मॉडल परिवार

मॉडल बंद स्रोत
टेक्स्टइमेजटेक्स्ट

Baichuan

2023
Baichuan AI

चीनी-भाषा उपयोग के लिए ओपन-वेट सामान्य मॉडल

मॉडल खुले वेट
टेक्स्टटेक्स्ट

GLM

2023
Zhipu AI

ऑटोरेग्रेसिव ब्लैंक-भरने वाले प्रीट्रेनिंग से शुरू हुआ चीनी सामान्य मॉडल

मॉडल बंद स्रोत
टेक्स्टटेक्स्ट

ChatGPT

2022
OpenAI

वह चैट विंडो जिसने बड़े भाषा मॉडल को हर किसी तक पहुँचाया

ऐप फ़्रीमियम
टेक्स्टइमेजऑडियोटेक्स्टइमेजऑडियो

Character.AI

2022
Character.AI

अपने बनाए पात्रों के साथ लंबी बातचीत वाला रोल-प्ले चैट

ऐप फ़्रीमियम
टेक्स्टऑडियोटेक्स्टऑडियो

ERNIE

2019
Baidu

ज्ञान-संवर्धित प्रीट्रेनिंग से शुरू हुआ चीनी मॉडल, शुरुआती प्रतिनिधि संस्करण

मॉडल बंद स्रोत
टेक्स्टटेक्स्ट

संबंधित संस्थान

सामान्य उपयोग

  • First drafts and rewriting
  • Drafting email, documents and copy
  • Code comments and API docs
  • Test data and synthetic corpora

इसका मूल्यांकन कैसे होता है

Perplexity
Predictive uncertainty on held-out text; lower is better
Human-preference Elo
Preference ranking from pairwise comparison
ROUGE/BLEU on constrained tasks
Reference overlap when an answer key exists

सीमाएँ और कठिनाइयाँ

  • Fluency is not truth: the model states wrong facts with confidence — hallucination
  • Over long outputs, earlier setup drifts and the text contradicts itself
  • Poor sampling settings can trap the model in repetitive or degenerate loops

इसके पीछे की अवधारणाएँ