Chuyển đến nội dung
Bản đồ AI

PRODUCTS

Danh mục sản phẩm

Lớp biến năng lực thành sản phẩm cụ thể. Có thể lọc theo năng lực, loại hình và mức độ mở — điều đáng hỏi trước tiên là: bạn có thể tự triển khai nó không.

Họ năng lực
Loại sản phẩm
Mức độ mở

tổng cộng 82 mục

GPT-4o

2024
OpenAI

Mô hình đa phương thức gốc, xử lý văn bản, hình ảnh và âm thanh qua một cửa vào

Mô hình Đóng
Văn bảnHình ảnhÂm thanhVăn bảnÂm thanh

o3

2025
OpenAI

Suy luận dài trước khi trả lời, đổi tính toán lúc suy luận lấy độ chính xác ổn định hơn

Mô hình Đóng
Văn bảnHình ảnhVăn bản

Claude

2023
Anthropic

Mô hình hội thoại phổ thông nổi bật với ngữ cảnh dài và căn chỉnh an toàn

Mô hình Đóng
Văn bảnHình ảnhVăn bản

Gemini

2023
Google DeepMind

Mô hình đa phương thức gốc, xử lý ngữ cảnh siêu dài

Mô hình Đóng
Văn bảnHình ảnhÂm thanhVideoVăn bản

Llama

2023
Meta AI (FAIR)

Dòng mô hình đưa trọng số mở trở thành xu hướng chính

Mô hình Trọng số mở
Văn bảnVăn bản

Grok

2023
xAI

Mô hình hội thoại gắn với dữ liệu mạng xã hội

Mô hình Đóng
Văn bảnHình ảnhVăn bản

Phi

2023
Microsoft

Mô hình nhỏ, hiệu quả, xây từ dữ liệu chọn lọc

Mô hình Trọng số mở
Văn bảnVăn bản

Mistral Large

2024
Mistral AI

Mô hình thương mại chủ lực của phòng lab trọng số mở châu Âu

Mô hình Đóng
Văn bảnVăn bản

Command R

2024
Cohere

Mô hình thương mại dành cho tăng cường truy hồi và gọi công cụ

Mô hình Trọng số mở
Văn bảnVăn bản

Jamba

2024
AI21 Labs

Mô hình trọng số mở kết hợp mô hình không gian trạng thái với Transformer

Mô hình Trọng số mở
Văn bảnVăn bản

DeepSeek-V3

2024
DeepSeek

MoE trọng số mở 671B tham số, chỉ kích hoạt 37B mỗi token

Mô hình Trọng số mở
Văn bảnVăn bản

DeepSeek-R1

2025
DeepSeek

Mô hình suy luận huấn luyện bằng RL trên chuỗi suy nghĩ, trọng số mở theo giấy phép MIT

Mô hình Trọng số mở
Văn bảnVăn bản

Qwen

2023
Alibaba (Qwen)

Dòng trọng số mở với nhiều kích cỡ và bản đa phương thức

Mô hình Trọng số mở
Văn bảnHình ảnhVăn bản

Kimi

2023
Moonshot AI

Trợ lý hội thoại tiếng Trung nổi bật với xử lý ngữ cảnh dài

Mô hình Đóng
Văn bảnVăn bản

GLM

2023
Zhipu AI

Mô hình phổ thông tiếng Trung khởi đầu bằng tiền huấn luyện điền khuyết tự hồi quy

Mô hình Đóng
Văn bảnVăn bản

ERNIE

2019
Baidu

Mô hình tiếng Trung khởi đầu bằng tiền huấn luyện tăng cường tri thức, bản đầu tiên tiêu biểu

Mô hình Đóng
Văn bảnVăn bản

Hunyuan

2023
Tencent (Hunyuan)

Dòng mô hình phổ thông của Tencent, có bản trọng số mở

Mô hình Trọng số mở
Văn bảnHình ảnhVăn bản

Doubao

2023
ByteDance (Seed)

Mô hình hội thoại phổ thông và ứng dụng của ByteDance

Mô hình Đóng
Văn bảnHình ảnhVăn bản

MiniMax-M

2025
MiniMax

Mô hình suy luận trọng số mở với attention lai và ngữ cảnh một triệu token

Mô hình Trọng số mở
Văn bảnVăn bản

Step

2023
StepFun

Dòng mô hình phổ thông hướng tới đa phương thức và chạy trên thiết bị

Mô hình Đóng
Văn bảnHình ảnhVăn bản

Yi

2023
01.AI

Mô hình trọng số mở song ngữ Trung–Anh, có bản ngữ cảnh siêu dài

Mô hình Trọng số mở
Văn bảnVăn bản

Baichuan

2023
Baichuan AI

Mô hình phổ thông trọng số mở hướng tới tiếng Trung

Mô hình Trọng số mở
Văn bảnVăn bản

DALL·E 3

2023
OpenAI

Viết lại câu lệnh dài thành mô tả chi tiết rồi vẽ hình ảnh

Mô hình Đóng
Văn bảnHình ảnh

Sora

2024
OpenAI

Tạo video mạch lạc dài tới khoảng một phút từ một mô tả

Mô hình Đóng
Văn bảnHình ảnhVideo

Whisper

2022
OpenAI

Chuyển giọng nói nhiều ngôn ngữ thành văn bản và dịch sang tiếng Anh

Mô hình Trọng số mở
Âm thanhVăn bản

Imagen

2022
Google DeepMind

Tạo ảnh chân thực bằng khuếch tán theo tầng và bộ mã hóa văn bản lớn

Mô hình Đóng
Văn bảnHình ảnh

Veo

2024
Google DeepMind

Tạo clip video 1080p với các cảnh mạch lạc

Mô hình Đóng
Văn bảnHình ảnhVideo

Lyria

2023
Google DeepMind

Tạo nhạc không lời và có giọng hát từ câu lệnh văn bản

Mô hình Đóng
Văn bảnÂm thanh

AlphaFold

2020
Google DeepMind

Dự đoán cấu trúc ba chiều của protein từ trình tự axit amin

Mô hình Mã nguồn mở

Stable Diffusion

2022
Stability AI

Mở công khai trọng số tạo ảnh từ văn bản, đủ nhẹ để chạy trên GPU phổ thông

Mô hình Trọng số mở
Văn bảnHình ảnhHình ảnh

Stable Video Diffusion

2023
Stability AI

Biến một ảnh tĩnh thành video ngắn bằng mô hình khuếch tán

Mô hình Trọng số mở
Hình ảnhVideo

Stable Video 3D

2024
Stability AI

Tái tạo nhiều góc nhìn và hình dạng 3D của vật thể từ một ảnh

Mô hình Trọng số mở
Hình ảnh3D

FLUX

2024
Black Forest Labs

Tạo ảnh độ phân giải cao bằng transformer luồng chỉnh lưu

Mô hình Trọng số mở
Văn bảnHình ảnhHình ảnh

Midjourney

2022
Midjourney

Dịch vụ tạo ảnh từ văn bản nổi bật về phong cách thẩm mỹ

Ứng dụng Đóng
Văn bảnHình ảnhHình ảnh

Firefly

2023
Adobe

Công cụ tạo và chỉnh sửa ảnh cho người sáng tạo

Ứng dụng Đóng
Hình ảnhVăn bảnHình ảnh

Gen-3 Alpha

2024
Runway

Mô hình văn bản thành video dễ điều khiển cho phim và quảng cáo

Mô hình Đóng
Văn bảnHình ảnhVideo

Dream Machine

2024
Luma AI

Tạo video ngắn có chuyển động từ văn bản hoặc ảnh

Mô hình Đóng
Văn bảnHình ảnhVideo

Genie

2023
Luma AI

Tạo mô hình 3D có kết cấu từ văn bản trong vài giây

API Đóng
Văn bảnHình ảnh3D

Kling

2024
Kuaishou (Kling)

Mô hình video ngắn cho cả văn bản thành video và ảnh thành video

Mô hình Đóng
Văn bảnHình ảnhVideo

Hailuo

2024
MiniMax

Mô hình video ngắn chú trọng tuân thủ chỉ dẫn và ngôn ngữ máy quay

Mô hình Đóng
Văn bảnHình ảnhVideo

Seedance

2024
ByteDance (Seed)

Mô hình tạo video hướng tới kể chuyện nhiều cảnh

Mô hình Đóng
Văn bảnHình ảnhVideo

Seedream

2024
ByteDance (Seed)

Mô hình văn bản thành ảnh có độ phân giải cao gốc và hiển thị chữ tốt

Mô hình Đóng
Văn bảnHình ảnh

ElevenLabs

2022
ElevenLabs

Dịch vụ chuyển văn bản thành giọng nói đa ngôn ngữ với giọng tự nhiên, có thể nhân bản

API Đóng
Văn bảnÂm thanh

Suno

2023
Suno

Tạo bài hát hoàn chỉnh có giọng hát từ một mô tả

Ứng dụng Đóng
Văn bảnÂm thanh

SparkTTS

2023
iFlytek

Giao diện chuyển văn bản thành giọng nói hướng tới tiếng Trung

API Đóng
Văn bảnÂm thanh

H100

2022
NVIDIA

GPU trung tâm dữ liệu kiến trúc Hopper cho huấn luyện mô hình lớn

Phần cứng Đóng

B200 (Blackwell)

2024
NVIDIA

GPU kiến trúc Blackwell hướng tới mô hình nghìn tỷ tham số

Phần cứng Đóng

SenseAvatar

2022
SenseTime

Tạo video người kỹ thuật số khớp khẩu hình từ ảnh chân dung và một đoạn âm thanh

API Đóng
Hình ảnhÂm thanhVideo

ChatGPT

2022
OpenAI

Cửa sổ trò chuyện đưa mô hình ngôn ngữ lớn đến tay mọi người

Ứng dụng Freemium
Văn bảnHình ảnhÂm thanhVăn bảnHình ảnhÂm thanh

Claude Code

2025
Anthropic

Tác nhân lập trình hoàn thành việc nhiều bước ngay trong terminal

Công cụ Đóng
Văn bảnMãMã

Gemini

2024
Google DeepMind

Một cửa vào trò chuyện gom tìm kiếm, ứng dụng văn phòng và mô hình đa phương thức

Ứng dụng Freemium
Văn bảnHình ảnhÂm thanhVăn bảnHình ảnhÂm thanh

GitHub Copilot

2021
Microsoft

Hoàn thiện và viết lại mã trong trình soạn thảo theo ngữ cảnh

Công cụ Freemium
Văn bảnMãMã

Microsoft Copilot

2023
Microsoft

AI hội thoại gắn thẳng vào hệ điều hành và ứng dụng văn phòng

Ứng dụng Freemium
Văn bảnHình ảnhÂm thanhVăn bảnHình ảnh

NotebookLM

2023
Google DeepMind

Chỉ trả lời từ nguồn bạn đưa, kèm trích dẫn từng chỗ

Ứng dụng Freemium
Văn bảnBảngÂm thanhVăn bảnÂm thanh

Cursor

2023
Anysphere (Cursor)

Trình soạn thảo mã trên máy tính lấy cả kho mã làm ngữ cảnh

Ứng dụng Freemium
Văn bảnMãMã

Devin

2024
Cognition (Devin)

Tác nhân lập trình tự chủ có shell, trình soạn thảo và trình duyệt riêng

Ứng dụng Đóng
Văn bảnMãMã

Perplexity

2022
Perplexity AI

Trả lời trong lúc tìm kiếm, mỗi câu đều kèm nguồn

Ứng dụng Freemium
Văn bảnVăn bản

Apple Intelligence

2024
Apple

AI cấp hệ thống chia việc giữa thiết bị và đám mây riêng

Ứng dụng Đóng
Văn bảnHình ảnhÂm thanhVăn bảnHình ảnh

Siri

2011
Apple

Trợ lý giọng nói sớm đưa điều khiển bằng lời nói vào điện thoại phổ thông

Ứng dụng Đóng
Âm thanhÂm thanhVăn bản

Character.AI

2022
Character.AI

Trò chuyện nhập vai với nhân vật bạn tự tạo và trò chuyện lâu dài

Ứng dụng Freemium
Văn bảnÂm thanhVăn bảnÂm thanh

DeepL Translator

2017
DeepL

Dịch máy nơ-ron đặt trọng tâm vào chất lượng bản dịch

Ứng dụng Freemium
Văn bảnVăn bản

Synthesia

2019
Synthesia

Nhập văn bản, nhận video có nhân vật ảo đang nói

Ứng dụng Đóng
Văn bảnVideo

Waymo Driver

2009
Waymo

Hệ thống tự lái vận hành taxi robot thương mại không có người giám sát

Mô hình Đóng

Full Self-Driving

2020
Tesla

Mạng lái xe đầu-cuối chỉ dùng camera

Mô hình Đóng

Optimus

2022
Tesla

Dự án robot hình người tái sử dụng nhận thức của xe tự lái

Phần cứng Đóng

Figure 02

2024
Figure AI

Robot hình người thế hệ hai điều khiển bằng mô hình thị giác–ngôn ngữ–hành động

Phần cứng Đóng

Hugging Face Hub

2016
Hugging Face

Nơi quy tụ mô hình và dữ liệu mở

Nền tảng Mã nguồn mở

Transformers

2018
Hugging Face

Một API để nạp và huấn luyện mô hình tiền huấn luyện

Công cụ Mã nguồn mở

Diffusers

2022
Hugging Face

Cách triển khai và bộ lập lịch thống nhất cho mô hình khuếch tán

Công cụ Mã nguồn mở

Datasets

2020
Hugging Face

Nạp và truyền phát tập dữ liệu bằng một dòng lệnh

Công cụ Mã nguồn mở

Spaces

2021
Hugging Face

Lưu trữ bản demo mô hình thành trang web

Nền tảng Freemium

Ollama

2023
Ollama

Chạy mô hình mở tại máy chỉ với một lệnh

Công cụ Mã nguồn mở

Together API

2022
Together AI

API suy luận cho các mô hình mở

API Đóng

Replicate

2019
Replicate

Chạy mô hình do cộng đồng đăng qua API

Nền tảng Đóng

LangChain

2022
LangChain

Ghép mô hình, công cụ và truy hồi lại với nhau

Công cụ Mã nguồn mở

Pinecone

2019
Pinecone

Cơ sở dữ liệu vector được quản lý cho tìm kiếm tương đồng

Hạ tầng Đóng

vLLM

2023
UC Berkeley (LMSYS)

Engine suy luận và phục vụ LLM thông lượng cao

Công cụ Mã nguồn mở

DBRX

2024
Databricks

Mô hình ngôn ngữ MoE trọng số mở của Databricks

Mô hình Trọng số mở
Văn bảnVăn bản

NeMo

2019
NVIDIA

Bộ công cụ huấn luyện và tùy biến mô hình lớn

Công cụ Mã nguồn mở

CUDA

2007
NVIDIA

Nền tảng lập trình tính toán đa dụng trên GPU NVIDIA

Công cụ Đóng

Ascend

2018
Huawei

Bộ xử lý và kiến trúc tính toán Ascend của Huawei

Phần cứng Đóng

Pangu

2020
Huawei

Họ mô hình nền tảng Pangu của Huawei

Mô hình Đóng
Văn bảnVăn bản