Aller au contenu
Atlas de l'IA

Génération de texte

Poursuit un texte mot après mot

Langage et connaissancesDébutant #01
entréeTexteTexte

Le texte intégral est présenté en anglais ; le titre et le résumé sont localisés.

CE QUE DÉSIGNE CETTE CAPACITÉ

Given a passage as context, the model writes what comes next. Both input and output are text and no particular transformation is targeted: it can continue a story, finish an explanation or draft an email. It differs from conversation in that no instruction format is required, and from summarisation or translation in that neither compression nor a language switch is the goal — both ends stay in the same modality.

Comment c'est fait

The dominant route is an autoregressive Transformer language model: text is split into tokens, the model predicts the probability of the next token position by position, and training maximises likelihood over the corpus. GPT, Llama and Qwen all follow it, differing in scale, data and post-training recipe. At inference, temperature, top-k and top-p shape diversity, while long outputs reuse cached keys and values to cut cost.

Produits représentatifs

27

GPT-4o

2024
OpenAI

Un modèle général nativement multimodal : texte, image et audio par une même entrée

Modèle Fermé
TexteImageAudioTexteAudio

Llama

2023
Meta AI (FAIR)

La famille qui a fait des poids ouverts une voie grand public

Modèle Poids ouverts
TexteTexte

Qwen

2023
Alibaba (Qwen)

Une famille à poids ouverts couvrant de nombreuses tailles, avec des versions multimodales

Modèle Poids ouverts
TexteImageTexte

DeepSeek-V3

2024
DeepSeek

Un MoE à poids ouverts de 671B paramètres, activant 37B par token

Modèle Poids ouverts
TexteTexte

Mistral Large

2024
Mistral AI

Le modèle commercial phare d’un laboratoire européen de poids ouverts

Modèle Fermé
TexteTexte

Gemini

2023
Google DeepMind

Un modèle général nativement multimodal, conçu pour de très longs contextes

Modèle Fermé
TexteImageAudioVidéoTexte

Claude

2023
Anthropic

Un modèle de conversation général réputé pour son long contexte et son alignement sécurisé

Modèle Fermé
TexteImageTexte

MiniMax-M

2025
MiniMax

Un modèle de raisonnement à poids ouverts, à attention hybride et contexte d’un million de tokens

Modèle Poids ouverts
TexteTexte

DeepSeek-R1

2025
DeepSeek

Un modèle de raisonnement entraîné par RL sur des chaînes de pensée, à poids ouverts sous licence MIT

Modèle Poids ouverts
TexteTexte

Apple Intelligence

2024
Apple

Une IA au niveau du système, répartie entre l’appareil et le cloud privé

Application Fermé
TexteImageAudioTexteImage

Command R

2024
Cohere

Un modèle commercial conçu pour la recherche augmentée et l’usage d’outils

Modèle Poids ouverts
TexteTexte

Jamba

2024
AI21 Labs

Un modèle à poids ouverts mêlant un modèle d’espace d’états à un Transformer

Modèle Poids ouverts
TexteTexte

DBRX

2024
Databricks

Modèle de langage MoE à poids ouverts de Databricks

Modèle Poids ouverts
TexteTexte

Gemini

2024
Google DeepMind

Une entrée de discussion qui réunit recherche, bureautique et modèle multimodal

Application Freemium
TexteImageAudioTexteImageAudio

Grok

2023
xAI

Un modèle de conversation lié aux données d’une plateforme sociale

Modèle Fermé
TexteImageTexte

Yi

2023
01.AI

Un modèle à poids ouverts bilingue chinois-anglais, avec des versions à très long contexte

Modèle Poids ouverts
TexteTexte

Kimi

2023
Moonshot AI

Un assistant de conversation chinois réputé pour les longs contextes

Modèle Fermé
TexteTexte

Hunyuan

2023
Tencent (Hunyuan)

La famille de modèles généraux de Tencent, avec des versions à poids ouverts

Modèle Poids ouverts
TexteImageTexte

Microsoft Copilot

2023
Microsoft

Une IA conversationnelle intégrée au système d’exploitation et à la bureautique

Application Freemium
TexteImageAudioTexteImage

Doubao

2023
ByteDance (Seed)

Le modèle de conversation général et l’application de ByteDance

Modèle Fermé
TexteImageTexte

Phi

2023
Microsoft

Des petits modèles efficaces, bâtis sur des données sélectionnées

Modèle Poids ouverts
TexteTexte

Step

2023
StepFun

Une famille de modèles généraux visant le multimodal et l’exécution locale

Modèle Fermé
TexteImageTexte

Baichuan

2023
Baichuan AI

Un modèle général à poids ouverts visant l’usage en chinois

Modèle Poids ouverts
TexteTexte

GLM

2023
Zhipu AI

Un modèle général chinois parti d’un préentraînement par remplissage de blancs autorégressif

Modèle Fermé
TexteTexte

ChatGPT

2022
OpenAI

La fenêtre de discussion qui a mis un grand modèle de langage entre toutes les mains

Application Freemium
TexteImageAudioTexteImageAudio

Character.AI

2022
Character.AI

Un chat de rôle avec des personnages que vous définissez et côtoyez dans la durée

Application Freemium
TexteAudioTexteAudio

ERNIE

2019
Baidu

Un modèle chinois parti d’un préentraînement enrichi par la connaissance, version phare précoce

Modèle Fermé
TexteTexte

Organisations concernées

Usages typiques

  • First drafts and rewriting
  • Drafting email, documents and copy
  • Code comments and API docs
  • Test data and synthetic corpora

Comment on l'évalue

Perplexity
Predictive uncertainty on held-out text; lower is better
Human-preference Elo
Preference ranking from pairwise comparison
ROUGE/BLEU on constrained tasks
Reference overlap when an answer key exists

Limites et points difficiles

  • Fluency is not truth: the model states wrong facts with confidence — hallucination
  • Over long outputs, earlier setup drifts and the text contradicts itself
  • Poor sampling settings can trap the model in repetitive or degenerate loops

Concepts sous-jacents