输入文本图像音频文本图像音频
它是什么
Gemini 是 Google DeepMind 于 2024 年 2 月推出的对话应用,由此前名为 Bard 的产品更名而来。它以对话为主要入口,支持文本、图像与语音输入,并可从 Google 搜索与 Workspace 应用中取用信息。Gemini 提供网页端与移动端,随后加入图像生成与实时语音对话。
为什么值得记住
把 Google 的搜索、办公套件与多模态模型收进同一个对话入口,是 Google 面对对话式 AI 的主线产品。
关键规格
- 形态
- 网页端与移动端应用
- 支持模型
- Google 的 Gemini 系列模型
- 模态
- 文本、图像、音频输入;文本、图像、音频输出
所属能力
相关概念
同类产品
ChatGPT
2022OpenAI
把大模型变成一个人人可用的对话窗口
应用 免费增值
文本图像音频文本图像音频
Microsoft Copilot
2023Microsoft
把对话式 AI 嵌进操作系统与办公软件
应用 免费增值
文本图像音频文本图像
Claude
2023Anthropic
以长上下文与安全对齐见长的通用对话模型
模型 闭源
文本图像文本
Perplexity
2022Perplexity AI
边检索边作答、每条答案都带出处
应用 免费增值
文本文本
Apple Intelligence
2024Apple
端侧与私有云协同的系统级 AI 功能
应用 闭源
文本图像音频文本图像
Siri
2011Apple
把语音助手带进主流手机的早期产品
应用 闭源
音频音频文本
Character.AI
2022Character.AI
自定角色、可以长期聊下去的角色扮演式对话
应用 免费增值
文本音频文本音频
DeepL Translator
2017DeepL
以译文质量为卖点的神经机器翻译服务
应用 免费增值
文本文本