Chuyển đến nội dung
Bản đồ AI

Sinh văn bản

Viết tiếp văn bản từng từ một

Ngôn ngữ & tri thứcCơ bản #01
đầu vàoVăn bảnVăn bản

Toàn văn của trang này được trình bày bằng tiếng Anh; tiêu đề và phần dẫn đã được bản địa hóa.

NĂNG LỰC NÀY NGHĨA LÀ GÌ

Given a passage as context, the model writes what comes next. Both input and output are text and no particular transformation is targeted: it can continue a story, finish an explanation or draft an email. It differs from conversation in that no instruction format is required, and from summarisation or translation in that neither compression nor a language switch is the goal — both ends stay in the same modality.

Làm ra sao về mặt kỹ thuật

The dominant route is an autoregressive Transformer language model: text is split into tokens, the model predicts the probability of the next token position by position, and training maximises likelihood over the corpus. GPT, Llama and Qwen all follow it, differing in scale, data and post-training recipe. At inference, temperature, top-k and top-p shape diversity, while long outputs reuse cached keys and values to cut cost.

Sản phẩm tiêu biểu

27

GPT-4o

2024
OpenAI

Mô hình đa phương thức gốc, xử lý văn bản, hình ảnh và âm thanh qua một cửa vào

Mô hình Đóng
Văn bảnHình ảnhÂm thanhVăn bảnÂm thanh

Llama

2023
Meta AI (FAIR)

Dòng mô hình đưa trọng số mở trở thành xu hướng chính

Mô hình Trọng số mở
Văn bảnVăn bản

Qwen

2023
Alibaba (Qwen)

Dòng trọng số mở với nhiều kích cỡ và bản đa phương thức

Mô hình Trọng số mở
Văn bảnHình ảnhVăn bản

DeepSeek-V3

2024
DeepSeek

MoE trọng số mở 671B tham số, chỉ kích hoạt 37B mỗi token

Mô hình Trọng số mở
Văn bảnVăn bản

Mistral Large

2024
Mistral AI

Mô hình thương mại chủ lực của phòng lab trọng số mở châu Âu

Mô hình Đóng
Văn bảnVăn bản

Gemini

2023
Google DeepMind

Mô hình đa phương thức gốc, xử lý ngữ cảnh siêu dài

Mô hình Đóng
Văn bảnHình ảnhÂm thanhVideoVăn bản

Claude

2023
Anthropic

Mô hình hội thoại phổ thông nổi bật với ngữ cảnh dài và căn chỉnh an toàn

Mô hình Đóng
Văn bảnHình ảnhVăn bản

MiniMax-M

2025
MiniMax

Mô hình suy luận trọng số mở với attention lai và ngữ cảnh một triệu token

Mô hình Trọng số mở
Văn bảnVăn bản

DeepSeek-R1

2025
DeepSeek

Mô hình suy luận huấn luyện bằng RL trên chuỗi suy nghĩ, trọng số mở theo giấy phép MIT

Mô hình Trọng số mở
Văn bảnVăn bản

Apple Intelligence

2024
Apple

AI cấp hệ thống chia việc giữa thiết bị và đám mây riêng

Ứng dụng Đóng
Văn bảnHình ảnhÂm thanhVăn bảnHình ảnh

Command R

2024
Cohere

Mô hình thương mại dành cho tăng cường truy hồi và gọi công cụ

Mô hình Trọng số mở
Văn bảnVăn bản

Jamba

2024
AI21 Labs

Mô hình trọng số mở kết hợp mô hình không gian trạng thái với Transformer

Mô hình Trọng số mở
Văn bảnVăn bản

DBRX

2024
Databricks

Mô hình ngôn ngữ MoE trọng số mở của Databricks

Mô hình Trọng số mở
Văn bảnVăn bản

Gemini

2024
Google DeepMind

Một cửa vào trò chuyện gom tìm kiếm, ứng dụng văn phòng và mô hình đa phương thức

Ứng dụng Freemium
Văn bảnHình ảnhÂm thanhVăn bảnHình ảnhÂm thanh

Grok

2023
xAI

Mô hình hội thoại gắn với dữ liệu mạng xã hội

Mô hình Đóng
Văn bảnHình ảnhVăn bản

Yi

2023
01.AI

Mô hình trọng số mở song ngữ Trung–Anh, có bản ngữ cảnh siêu dài

Mô hình Trọng số mở
Văn bảnVăn bản

Kimi

2023
Moonshot AI

Trợ lý hội thoại tiếng Trung nổi bật với xử lý ngữ cảnh dài

Mô hình Đóng
Văn bảnVăn bản

Hunyuan

2023
Tencent (Hunyuan)

Dòng mô hình phổ thông của Tencent, có bản trọng số mở

Mô hình Trọng số mở
Văn bảnHình ảnhVăn bản

Microsoft Copilot

2023
Microsoft

AI hội thoại gắn thẳng vào hệ điều hành và ứng dụng văn phòng

Ứng dụng Freemium
Văn bảnHình ảnhÂm thanhVăn bảnHình ảnh

Doubao

2023
ByteDance (Seed)

Mô hình hội thoại phổ thông và ứng dụng của ByteDance

Mô hình Đóng
Văn bảnHình ảnhVăn bản

Phi

2023
Microsoft

Mô hình nhỏ, hiệu quả, xây từ dữ liệu chọn lọc

Mô hình Trọng số mở
Văn bảnVăn bản

Step

2023
StepFun

Dòng mô hình phổ thông hướng tới đa phương thức và chạy trên thiết bị

Mô hình Đóng
Văn bảnHình ảnhVăn bản

Baichuan

2023
Baichuan AI

Mô hình phổ thông trọng số mở hướng tới tiếng Trung

Mô hình Trọng số mở
Văn bảnVăn bản

GLM

2023
Zhipu AI

Mô hình phổ thông tiếng Trung khởi đầu bằng tiền huấn luyện điền khuyết tự hồi quy

Mô hình Đóng
Văn bảnVăn bản

ChatGPT

2022
OpenAI

Cửa sổ trò chuyện đưa mô hình ngôn ngữ lớn đến tay mọi người

Ứng dụng Freemium
Văn bảnHình ảnhÂm thanhVăn bảnHình ảnhÂm thanh

Character.AI

2022
Character.AI

Trò chuyện nhập vai với nhân vật bạn tự tạo và trò chuyện lâu dài

Ứng dụng Freemium
Văn bảnÂm thanhVăn bảnÂm thanh

ERNIE

2019
Baidu

Mô hình tiếng Trung khởi đầu bằng tiền huấn luyện tăng cường tri thức, bản đầu tiên tiêu biểu

Mô hình Đóng
Văn bảnVăn bản

Tổ chức liên quan

Cách dùng tiêu biểu

  • First drafts and rewriting
  • Drafting email, documents and copy
  • Code comments and API docs
  • Test data and synthetic corpora

Đánh giá nó tốt hay không thế nào

Perplexity
Predictive uncertainty on held-out text; lower is better
Human-preference Elo
Preference ranking from pairwise comparison
ROUGE/BLEU on constrained tasks
Reference overlap when an answer key exists

Ranh giới và điểm khó

  • Fluency is not truth: the model states wrong facts with confidence — hallucination
  • Over long outputs, earlier setup drifts and the text contradicts itself
  • Poor sampling settings can trap the model in repetitive or degenerate loops

Các khái niệm đằng sau