PRODUCTS
产品图鉴
把能力落成具体产品的那一层。可以按能力、类型与开放程度筛选——尤其值得先问一句:它能不能自己部署。
共 82 条
GPT-4o
2024原生多模态的通用模型,文本、图像与音频走同一个入口
o3
2025回答前先生成长的推理链,用推理时的算力换更稳的正确率
Claude
2023以长上下文与安全对齐见长的通用对话模型
Gemini
2023原生多模态、可处理超长上下文的通用模型
Llama
2023把开放权重路线做成主流的通用模型家族
Grok
2023与社交平台数据绑定的对话模型
Phi
2023用小体量和精选数据做成的高效小模型
Mistral Large
2024欧洲开源实验室的旗舰商用模型
Command R
2024为检索增强与工具调用设计的商用模型
Jamba
2024把状态空间模型与 Transformer 混合的开放权重模型
DeepSeek-V3
2024671B 总参数、每 token 只激活 37B 的开放权重 MoE 模型
DeepSeek-R1
2025用强化学习训练推理链、权重以 MIT 许可开放的推理模型
Qwen
2023覆盖多规格、含多模态版本的开放权重模型家族
Kimi
2023以长上下文处理见长的中文对话助手
GLM
2023以自回归填空预训练起步的中文通用模型
ERNIE
2019以知识增强预训练起步的中文模型,早期的代表版本
Hunyuan
2023腾讯的通用模型家族,含开放权重版本
Doubao
2023字节跳动的通用对话模型与应用
MiniMax-M
2025采用混合注意力、上下文达百万 token 的开放权重推理模型
Step
2023面向多模态与端侧的通用模型系列
Yi
2023中英双语、提供超长上下文版本的开放权重模型
Baichuan
2023面向中文场景的开放权重通用模型
DALL·E 3
2023把长提示词先改写成详细描述,再据此生成图像
Sora
2024从一句描述生成最长约一分钟的连贯视频
Whisper
2022把多语种语音转写成文字,并翻译成英文
Imagen
2022用级联扩散与大型文本编码器生成写实图像
Veo
2024生成 1080p、镜头连贯的视频片段
Lyria
2023根据文字提示生成器乐与人声音乐
AlphaFold
2020从氨基酸序列预测蛋白质的三维结构
Stable Diffusion
2022把文生图权重开源,并压到消费级显卡可运行
Stable Video Diffusion
2023用扩散模型把一张静态图变成一段短视频
Stable Video 3D
2024从单张图片重建物体的多视角与三维形状
FLUX
2024用整流流 Transformer 生成高分辨率图像
Midjourney
2022以审美风格见长的文生图服务
Firefly
2023面向创作者的图像生成与编辑工具
Gen-3 Alpha
2024面向影视与广告的高可控文生视频模型
Dream Machine
2024从文字或图片生成带运动的短视频
Genie
2023在数秒内从文字生成带纹理的三维模型
Kling
2024可文生视频也可图生视频的短视频模型
Hailuo
2024主打指令遵循与镜头语言的短视频模型
Seedance
2024面向多镜头叙事的视频生成模型
Seedream
2024原生高分辨率、擅长文字排版的文生图模型
ElevenLabs
2022自然、可克隆声音的多语种语音合成服务
Suno
2023用一句话生成带人声的完整歌曲
SparkTTS
2023面向中文场景的语音合成接口
H100
2022面向大模型训练的 Hopper 架构数据中心 GPU
B200 (Blackwell)
2024面向万亿参数模型的 Blackwell 架构 GPU
SenseAvatar
2022从一张人像与一段语音生成口型同步的数字人视频
ChatGPT
2022把大模型变成一个人人可用的对话窗口
Claude Code
2025在终端里自主完成多步编码任务的智能体
Gemini
2024把搜索、办公与多模态模型收进一个对话入口
GitHub Copilot
2021在编辑器里根据上下文续写与改写代码
Microsoft Copilot
2023把对话式 AI 嵌进操作系统与办公软件
NotebookLM
2023只用你给它的资料作答,并逐条给出出处
Cursor
2023以整仓库为上下文的桌面代码编辑器
Devin
2024自带命令行、编辑器与浏览器的自主编程智能体
Perplexity
2022边检索边作答、每条答案都带出处
Apple Intelligence
2024端侧与私有云协同的系统级 AI 功能
Siri
2011把语音助手带进主流手机的早期产品
Character.AI
2022自定角色、可以长期聊下去的角色扮演式对话
DeepL Translator
2017以译文质量为卖点的神经机器翻译服务
Synthesia
2019输入文字即可生成数字人口播视频
Waymo Driver
2009无安全员的商业 Robotaxi 自动驾驶系统
Full Self-Driving
2020只用摄像头的端到端驾驶网络
Optimus
2022复用自动驾驶感知的人形机器人项目
Figure 02
2024用视觉-语言-动作模型驱动的二代人形机器人
Hugging Face Hub
2016开放模型与数据集的集散地
Transformers
2018一套接口加载与训练预训练模型
Diffusers
2022扩散模型的统一实现与调度
Datasets
2020一行代码加载与流式读取数据集
Spaces
2021把模型演示托管成可访问的网页
Ollama
2023在本机一条命令跑起开源模型
Together API
2022托管开源模型的推理接口
Replicate
2019用 API 运行社区上传的模型
LangChain
2022把模型、工具与检索串成链
Pinecone
2019托管式向量数据库与相似度检索
vLLM
2023高吞吐的 LLM 推理与服务引擎
DBRX
2024Databricks 的开放权重 MoE 语言模型
NeMo
2019训练与定制大模型的框架工具集
CUDA
2007在 NVIDIA GPU 上做通用计算的编程平台
Ascend
2018华为的昇腾 AI 处理器与计算架构
Pangu
2020华为的盘古系列基础模型