Command R
Um modelo comercial feito para recuperação aumentada e uso de ferramentas
O texto completo é apresentado em inglês; o título e o resumo estão traduzidos.
O QUE É
Command R is a model Cohere released in March 2024, with retrieval-augmented generation (RAG) and tool use as its primary design goals. Cohere was founded in Toronto in 2019 by former Google researchers and has long focused on enterprise text applications. Command R packs a 128K context into a 35B-parameter model and, in RAG settings, pairs with citation and tool-calling interfaces. It ships both as open weights and as a managed API, so enterprises can deploy it in their own environments.
Por que vale a pena lembrar
It made retrieval augmentation, citations and tool calling first-class design goals rather than after-the-fact patches, offering a ready-made shape for enterprises wiring models into their own data — and released the weights too.
Especificações-chave
- Parameters
- 35B (Command R)
- Context window
- 128K tokens
- Open weights
- Yes
- Released
- 2024-03
Capacidades
Conversa e seguimento de instruções
Entender a intenção ao longo do diálogo e agir
Perguntas e respostas com recuperação
Recupera a evidência primeiro e responde a partir dela
Uso de ferramentas e chamada de funções
Deixar o modelo escolher a API e preencher os argumentos
Geração de texto
Continua um texto palavra a palavra
Conceitos relacionados
Geração aumentada por recuperação
Em vez de espremer o conhecimento nos parâmetros, deixá-lo fora e consultá-lo sob demanda — como um exame com livro aberto
Arquitetura Transformer
Substituir o revezamento palavra a palavra por uma sala onde todos falam ao mesmo tempo, deixando dependências distantes a um salto
Agentes e uso de ferramentas
Que um modelo não só responda: pesquise, chame APIs, execute código — e decida o próximo passo a partir do resultado
Produtos semelhantes
Mistral Large
2024O modelo comercial principal de um laboratório europeu de pesos abertos
Llama
2023A família que tornou a rota de pesos abertos mainstream
GPT-4o
2024Um modelo geral nativamente multimodal: texto, imagem e áudio por uma única porta
Jamba
2024Um modelo de pesos abertos que mistura um modelo de espaço de estados com um Transformer