本文へスキップ
AI図鑑

PRODUCTS

製品図鑑

能力を具体的な製品へと落とし込む層です。能力・種類・公開度で絞り込めます。とりわけ、自分でデプロイできるかどうかをまず確かめる価値があります。

能力ファミリー
製品タイプ
公開度

全 82 件

GPT-4o

2024
OpenAI

ネイティブにマルチモーダルな汎用モデル。テキスト・画像・音声をひとつの入口で扱う

モデル クローズド
テキスト画像音声テキスト音声

o3

2025
OpenAI

答える前に長い推論を重ね、推論時の計算で正答率を上げる

モデル クローズド
テキスト画像テキスト

Claude

2023
Anthropic

長い文脈と安全性の調整で知られる汎用対話モデル

モデル クローズド
テキスト画像テキスト

Gemini

2023
Google DeepMind

ネイティブにマルチモーダルで、超長文脈を扱う汎用モデル

モデル クローズド
テキスト画像音声動画テキスト

Llama

2023
Meta AI (FAIR)

オープンウェイト路線を主流にした汎用モデル群

モデル オープンウェイト
テキストテキスト

Grok

2023
xAI

ソーシャルプラットフォームのデータと結びついた対話モデル

モデル クローズド
テキスト画像テキスト

Phi

2023
Microsoft

小さな規模と厳選データで作られた高効率な小モデル

モデル オープンウェイト
テキストテキスト

Mistral Large

2024
Mistral AI

欧州のオープンウェイト研究所による商用フラッグシップモデル

モデル クローズド
テキストテキスト

Command R

2024
Cohere

検索拡張とツール呼び出しのために設計された商用モデル

モデル オープンウェイト
テキストテキスト

Jamba

2024
AI21 Labs

状態空間モデルと Transformer を混合したオープンウェイトモデル

モデル オープンウェイト
テキストテキスト

DeepSeek-V3

2024
DeepSeek

総パラメータ 671B、1 トークンあたり 37B だけを活性化するオープンウェイト MoE

モデル オープンウェイト
テキストテキスト

DeepSeek-R1

2025
DeepSeek

強化学習で推論の連鎖を訓練し、MIT ライセンスで重みを公開した推論モデル

モデル オープンウェイト
テキストテキスト

Qwen

2023
Alibaba (Qwen)

多様な規模とマルチモーダル版を備えたオープンウェイトのモデル群

モデル オープンウェイト
テキスト画像テキスト

Kimi

2023
Moonshot AI

長い文脈の処理を得意とする中国語の対話アシスタント

モデル クローズド
テキストテキスト

GLM

2023
Zhipu AI

自己回帰空白穴埋め事前学習から始まった中国語の汎用モデル

モデル クローズド
テキストテキスト

ERNIE

2019
Baidu

知識増強の事前学習から始まった中国語モデル、その初期の代表的版

モデル クローズド
テキストテキスト

Hunyuan

2023
Tencent (Hunyuan)

開放ウェイト版を含むテンセントの汎用モデル群

モデル オープンウェイト
テキスト画像テキスト

Doubao

2023
ByteDance (Seed)

バイトダンスの汎用対話モデルとアプリ

モデル クローズド
テキスト画像テキスト

MiniMax-M

2025
MiniMax

ハイブリッド注意と100万トークン文脈をもつオープンウェイトの推論モデル

モデル オープンウェイト
テキストテキスト

Step

2023
StepFun

マルチモーダルとオンデバイスを狙う汎用モデル群

モデル クローズド
テキスト画像テキスト

Yi

2023
01.AI

中英バイリンガルで超長文脈版もあるオープンウェイトモデル

モデル オープンウェイト
テキストテキスト

Baichuan

2023
Baichuan AI

中国語シーンに向けたオープンウェイトの汎用モデル

モデル オープンウェイト
テキストテキスト

DALL·E 3

2023
OpenAI

長い指示を詳細な説明に書き換えてから画像を生成する

モデル クローズド
テキスト画像

Sora

2024
OpenAI

一文の説明から最長約1分の一貫した動画を生成する

モデル クローズド
テキスト画像動画

Whisper

2022
OpenAI

多言語の音声を文字起こしし、英語へ翻訳する

モデル オープンウェイト
音声テキスト

Imagen

2022
Google DeepMind

カスケード拡散と大規模テキストエンコーダで写実的な画像を生成する

モデル クローズド
テキスト画像

Veo

2024
Google DeepMind

1080pでショットの一貫した動画クリップを生成する

モデル クローズド
テキスト画像動画

Lyria

2023
Google DeepMind

テキスト指示から器楽曲や歌唱を含む音楽を生成する

モデル クローズド
テキスト音声

AlphaFold

2020
Google DeepMind

アミノ酸配列からタンパク質の立体構造を予測する

モデル オープンソース

Stable Diffusion

2022
Stability AI

テキストから画像生成の重みを公開し、民生用GPUで動く規模に収めた

モデル オープンウェイト
テキスト画像画像

Stable Video Diffusion

2023
Stability AI

拡散モデルで一枚の静止画を短い動画に変える

モデル オープンウェイト
画像動画

Stable Video 3D

2024
Stability AI

一枚の画像から物体の多視点と三次元形状を再構成する

モデル オープンウェイト
画像3D

FLUX

2024
Black Forest Labs

整流フローTransformerで高解像度画像を生成する

モデル オープンウェイト
テキスト画像画像

Midjourney

2022
Midjourney

美的スタイルで知られるテキストから画像生成サービス

アプリ クローズド
テキスト画像画像

Firefly

2023
Adobe

クリエイター向けの画像生成・編集ツール

アプリ クローズド
画像テキスト画像

Gen-3 Alpha

2024
Runway

映像・広告向けの制御性の高いテキスト動画生成モデル

モデル クローズド
テキスト画像動画

Dream Machine

2024
Luma AI

テキストや画像から動きのある短い動画を生成する

モデル クローズド
テキスト画像動画

Genie

2023
Luma AI

数秒でテキストからテクスチャ付き三次元モデルを生成する

API クローズド
テキスト画像3D

Kling

2024
Kuaishou (Kling)

テキストからも画像からも動画を生成できるショート動画モデル

モデル クローズド
テキスト画像動画

Hailuo

2024
MiniMax

指示追従とカメラワークを重視したショート動画モデル

モデル クローズド
テキスト画像動画

Seedance

2024
ByteDance (Seed)

マルチショットの物語表現を狙った動画生成モデル

モデル クローズド
テキスト画像動画

Seedream

2024
ByteDance (Seed)

ネイティブ高解像度で文字描画に強いテキスト画像生成モデル

モデル クローズド
テキスト画像

ElevenLabs

2022
ElevenLabs

自然でクローン可能な音声を提供する多言語音声合成サービス

API クローズド
テキスト音声

Suno

2023
Suno

一文からボーカル入りの楽曲を丸ごと生成する

アプリ クローズド
テキスト音声

SparkTTS

2023
iFlytek

中国語シーンを想定した音声合成API

API クローズド
テキスト音声

H100

2022
NVIDIA

大規模モデル訓練向けのHopper世代データセンターGPU

ハードウェア クローズド

B200 (Blackwell)

2024
NVIDIA

兆パラメータモデル向けのBlackwell世代GPU

ハードウェア クローズド

SenseAvatar

2022
SenseTime

一枚の人物画像と音声からリップシンクしたデジタルヒューマン動画を生成する

API クローズド
画像音声動画

ChatGPT

2022
OpenAI

大規模言語モデルを誰もが使える対話画面にした

アプリ フリーミアム
テキスト画像音声テキスト画像音声

Claude Code

2025
Anthropic

ターミナルから多段のコーディング作業をこなすエージェント

ツール クローズド
テキストコードコード

Gemini

2024
Google DeepMind

検索・オフィス・マルチモーダルモデルを一つの対話入口に集約

アプリ フリーミアム
テキスト画像音声テキスト画像音声

GitHub Copilot

2021
Microsoft

エディタ上で文脈に沿ってコードを補完・改写する

ツール フリーミアム
テキストコードコード

Microsoft Copilot

2023
Microsoft

対話型 AI を OS とオフィスソフトに組み込む

アプリ フリーミアム
テキスト画像音声テキスト画像

NotebookLM

2023
Google DeepMind

与えた資料だけを根拠に答え、出典を逐一示す

アプリ フリーミアム
テキスト表音声テキスト音声

Cursor

2023
Anysphere (Cursor)

リポジトリ全体を文脈にするデスクトップコードエディタ

アプリ フリーミアム
テキストコードコード

Devin

2024
Cognition (Devin)

シェル・エディタ・ブラウザを備えた自律型コーディングエージェント

アプリ クローズド
テキストコードコード

Perplexity

2022
Perplexity AI

検索しながら答え、どの答えにも出典が付く

アプリ フリーミアム
テキストテキスト

Apple Intelligence

2024
Apple

端末とプライベートクラウドで分担する OS 級の AI 機能

アプリ クローズド
テキスト画像音声テキスト画像

Siri

2011
Apple

音声アシスタントを主流のスマホに広めた初期の存在

アプリ クローズド
音声音声テキスト

Character.AI

2022
Character.AI

自分で作ったキャラクターと長く会話できるロールプレイ

アプリ フリーミアム
テキスト音声テキスト音声

DeepL Translator

2017
DeepL

訳文の質を売りにするニューラル機械翻訳サービス

アプリ フリーミアム
テキストテキスト

Synthesia

2019
Synthesia

テキストを入力するとアバターが話す動画ができる

アプリ クローズド
テキスト動画

Waymo Driver

2009
Waymo

安全員なしで商用ロボタクシーを運行する自動運転システム

モデル クローズド

Full Self-Driving

2020
Tesla

カメラだけで走るエンドツーエンドの運転ネットワーク

モデル クローズド

Optimus

2022
Tesla

自動運転の知覚を再利用する人型ロボット計画

ハードウェア クローズド

Figure 02

2024
Figure AI

視覚・言語・行動モデルで動く第2代人型ロボット

ハードウェア クローズド

Hugging Face Hub

2016
Hugging Face

オープンモデルとデータセットの集積地

プラットフォーム オープンソース

Transformers

2018
Hugging Face

単一のAPIで学習済みモデルを読み込み・学習

ツール オープンソース

Diffusers

2022
Hugging Face

拡散モデルの統合実装とスケジューラ

ツール オープンソース

Datasets

2020
Hugging Face

一行のコードでデータセットを読み込み・ストリーミング

ツール オープンソース

Spaces

2021
Hugging Face

モデルのデモを公開ページとしてホスト

プラットフォーム フリーミアム

Ollama

2023
Ollama

ローカルで1コマンドでオープンモデルを実行

ツール オープンソース

Together API

2022
Together AI

オープンモデル向けの推論API

API クローズド

Replicate

2019
Replicate

API経由でコミュニティのモデルを実行

プラットフォーム クローズド

LangChain

2022
LangChain

モデル・ツール・検索をつなぐ

ツール オープンソース

Pinecone

2019
Pinecone

マネージドなベクトルDBと類似検索

インフラ クローズド

vLLM

2023
UC Berkeley (LMSYS)

高スループットのLLM推論・配信エンジン

ツール オープンソース

DBRX

2024
Databricks

DatabricksのオープンウェイトMoE言語モデル

モデル オープンウェイト
テキストテキスト

NeMo

2019
NVIDIA

大規模モデルの学習・カスタマイズ用ツールキット

ツール オープンソース

CUDA

2007
NVIDIA

NVIDIA GPUで汎用計算を行うためのプログラミング基盤

ツール クローズド

Ascend

2018
Huawei

華為の昇騰AIプロセッサと計算アーキテクチャ

ハードウェア クローズド

Pangu

2020
Huawei

華為の盤古シリーズ基盤モデル

モデル クローズド
テキストテキスト