PRODUCTS
製品図鑑
能力を具体的な製品へと落とし込む層です。能力・種類・公開度で絞り込めます。とりわけ、自分でデプロイできるかどうかをまず確かめる価値があります。
全 82 件
GPT-4o
2024ネイティブにマルチモーダルな汎用モデル。テキスト・画像・音声をひとつの入口で扱う
o3
2025答える前に長い推論を重ね、推論時の計算で正答率を上げる
Claude
2023長い文脈と安全性の調整で知られる汎用対話モデル
Gemini
2023ネイティブにマルチモーダルで、超長文脈を扱う汎用モデル
Llama
2023オープンウェイト路線を主流にした汎用モデル群
Grok
2023ソーシャルプラットフォームのデータと結びついた対話モデル
Phi
2023小さな規模と厳選データで作られた高効率な小モデル
Mistral Large
2024欧州のオープンウェイト研究所による商用フラッグシップモデル
Command R
2024検索拡張とツール呼び出しのために設計された商用モデル
Jamba
2024状態空間モデルと Transformer を混合したオープンウェイトモデル
DeepSeek-V3
2024総パラメータ 671B、1 トークンあたり 37B だけを活性化するオープンウェイト MoE
DeepSeek-R1
2025強化学習で推論の連鎖を訓練し、MIT ライセンスで重みを公開した推論モデル
Qwen
2023多様な規模とマルチモーダル版を備えたオープンウェイトのモデル群
Kimi
2023長い文脈の処理を得意とする中国語の対話アシスタント
GLM
2023自己回帰空白穴埋め事前学習から始まった中国語の汎用モデル
ERNIE
2019知識増強の事前学習から始まった中国語モデル、その初期の代表的版
Hunyuan
2023開放ウェイト版を含むテンセントの汎用モデル群
Doubao
2023バイトダンスの汎用対話モデルとアプリ
MiniMax-M
2025ハイブリッド注意と100万トークン文脈をもつオープンウェイトの推論モデル
Step
2023マルチモーダルとオンデバイスを狙う汎用モデル群
Yi
2023中英バイリンガルで超長文脈版もあるオープンウェイトモデル
Baichuan
2023中国語シーンに向けたオープンウェイトの汎用モデル
DALL·E 3
2023長い指示を詳細な説明に書き換えてから画像を生成する
Sora
2024一文の説明から最長約1分の一貫した動画を生成する
Whisper
2022多言語の音声を文字起こしし、英語へ翻訳する
Imagen
2022カスケード拡散と大規模テキストエンコーダで写実的な画像を生成する
Veo
20241080pでショットの一貫した動画クリップを生成する
Lyria
2023テキスト指示から器楽曲や歌唱を含む音楽を生成する
AlphaFold
2020アミノ酸配列からタンパク質の立体構造を予測する
Stable Diffusion
2022テキストから画像生成の重みを公開し、民生用GPUで動く規模に収めた
Stable Video Diffusion
2023拡散モデルで一枚の静止画を短い動画に変える
Stable Video 3D
2024一枚の画像から物体の多視点と三次元形状を再構成する
FLUX
2024整流フローTransformerで高解像度画像を生成する
Midjourney
2022美的スタイルで知られるテキストから画像生成サービス
Firefly
2023クリエイター向けの画像生成・編集ツール
Gen-3 Alpha
2024映像・広告向けの制御性の高いテキスト動画生成モデル
Dream Machine
2024テキストや画像から動きのある短い動画を生成する
Genie
2023数秒でテキストからテクスチャ付き三次元モデルを生成する
Kling
2024テキストからも画像からも動画を生成できるショート動画モデル
Hailuo
2024指示追従とカメラワークを重視したショート動画モデル
Seedance
2024マルチショットの物語表現を狙った動画生成モデル
Seedream
2024ネイティブ高解像度で文字描画に強いテキスト画像生成モデル
ElevenLabs
2022自然でクローン可能な音声を提供する多言語音声合成サービス
Suno
2023一文からボーカル入りの楽曲を丸ごと生成する
SparkTTS
2023中国語シーンを想定した音声合成API
H100
2022大規模モデル訓練向けのHopper世代データセンターGPU
B200 (Blackwell)
2024兆パラメータモデル向けのBlackwell世代GPU
SenseAvatar
2022一枚の人物画像と音声からリップシンクしたデジタルヒューマン動画を生成する
ChatGPT
2022大規模言語モデルを誰もが使える対話画面にした
Claude Code
2025ターミナルから多段のコーディング作業をこなすエージェント
Gemini
2024検索・オフィス・マルチモーダルモデルを一つの対話入口に集約
GitHub Copilot
2021エディタ上で文脈に沿ってコードを補完・改写する
Microsoft Copilot
2023対話型 AI を OS とオフィスソフトに組み込む
NotebookLM
2023与えた資料だけを根拠に答え、出典を逐一示す
Cursor
2023リポジトリ全体を文脈にするデスクトップコードエディタ
Devin
2024シェル・エディタ・ブラウザを備えた自律型コーディングエージェント
Perplexity
2022検索しながら答え、どの答えにも出典が付く
Apple Intelligence
2024端末とプライベートクラウドで分担する OS 級の AI 機能
Siri
2011音声アシスタントを主流のスマホに広めた初期の存在
Character.AI
2022自分で作ったキャラクターと長く会話できるロールプレイ
DeepL Translator
2017訳文の質を売りにするニューラル機械翻訳サービス
Synthesia
2019テキストを入力するとアバターが話す動画ができる
Waymo Driver
2009安全員なしで商用ロボタクシーを運行する自動運転システム
Full Self-Driving
2020カメラだけで走るエンドツーエンドの運転ネットワーク
Optimus
2022自動運転の知覚を再利用する人型ロボット計画
Figure 02
2024視覚・言語・行動モデルで動く第2代人型ロボット
Hugging Face Hub
2016オープンモデルとデータセットの集積地
Transformers
2018単一のAPIで学習済みモデルを読み込み・学習
Diffusers
2022拡散モデルの統合実装とスケジューラ
Datasets
2020一行のコードでデータセットを読み込み・ストリーミング
Spaces
2021モデルのデモを公開ページとしてホスト
Ollama
2023ローカルで1コマンドでオープンモデルを実行
Together API
2022オープンモデル向けの推論API
Replicate
2019API経由でコミュニティのモデルを実行
LangChain
2022モデル・ツール・検索をつなぐ
Pinecone
2019マネージドなベクトルDBと類似検索
vLLM
2023高スループットのLLM推論・配信エンジン
DBRX
2024DatabricksのオープンウェイトMoE言語モデル
NeMo
2019大規模モデルの学習・カスタマイズ用ツールキット
CUDA
2007NVIDIA GPUで汎用計算を行うためのプログラミング基盤
Ascend
2018華為の昇騰AIプロセッサと計算アーキテクチャ
Pangu
2020華為の盤古シリーズ基盤モデル