Command R 08 2024
Rede Neural
Command R 08 2024 é o modelo de linguagem da Cohere para RAG, chamadas de ferramentas e código, disponível via API no BotHub.
Comprimento máximo de resposta
(em tokens)
Tamanho do contexto
(em tokens)
Custo do prompt
(por 1M tokens)
Custo da resposta
(por 1M tokens)
Como funciona Command R 08 2024?
Command R 08 2024 é uma atualização do modelo Command R da Cohere: os desenvolvedores melhoraram o RAG multilíngue e o uso de ferramentas, além de aprimorar matemática, código e raciocínio. É um cavalo de batalha para cenários onde o modelo precisa se basear em seus documentos e chamar funções externas, em vez de apenas manter um diálogo. No BotHub, está disponível sem VPN e sem cartão estrangeiro, com pagamento por uso (tokens que não expiram). A API compatível com OpenAI permite conectar o Command R 08 2024 ao seu serviço e alternar para outro entre mais de 250 modelos sem reescrever a integração; as conversas são criptografadas com AES-GCM. Para empresas, oferecemos contrato, fatura, painel administrativo e limites por funcionário. Útil para criar busca em base de conhecimento com fontes, conectar o modelo a CRMs ou APIs internas via chamadas de função, analisar e refatorar código, verificar soluções matemáticas ou de engenharia e preparar respostas de suporte baseadas em documentação.Perguntas frequentes sobre Command R 08 2024
Você pode usar os resultados da geração para fins comerciais. Todos os direitos sobre o conteúdo criado pertencem a você. A única restrição: certifique-se de que a solicitação não inclua materiais de terceiros protegidos por direitos autorais. A responsabilidade pelo cumprimento dos direitos sobre os dados de entrada é do usuário.
É um modelo de texto da Cohere: responde a perguntas, escreve e edita materiais, resume e analisa documentos, ajuda com código. Aceita texto, documentos e imagens como entrada, e chama funções. Contexto de 128.000 tokens — você pode carregar um arquivo grande ou uma longa conversa e trabalhar com eles na íntegra.
Em uma única resposta, o modelo gera até 4.000 tokens — isso equivale a várias páginas de texto: um artigo ou instrução detalhada. Se precisar de mais, divida a tarefa em partes e peça para continuar: o contexto de 128.000 tokens é suficiente para que o modelo se lembre de tudo o que foi escrito anteriormente.
Em nossos dados, não há um modo de raciocínio separado para este modelo, portanto, não espere cadeias de pensamento ocultas. No entanto, você pode pedir para resolver a tarefa passo a passo diretamente no prompt — o modelo detalhará a lógica na resposta. Para cálculos complexos, existem modelos de raciocínio (reasoning) dedicados no catálogo do BotHub.
Sim, chamadas de função e saída estruturada em JSON são suportadas. O modelo decide qual ferramenta chamar e retorna os argumentos no esquema definido. Isso é útil para agentes, busca em bases de conhecimento e integrações: no BotHub, tudo funciona via uma API compatível com OpenAI, então o modelo pode ser substituído sem reescrever o código.
Imagens e documentos, sim, podem ser enviados no prompt: o modelo lerá o arquivo ou analisará o que está na imagem e responderá com texto. Áudio e vídeo não são suportados como entrada em nossos dados. A geração de imagens, som ou vídeo também não é suportada por este modelo — para essas tarefas, existem modelos específicos no BotHub.
As características por idioma não estão especificadas em nossos dados, portanto, não podemos prometer uma qualidade específica em russo — teste com sua tarefa. É rápido: no BotHub, o pagamento é feito por uso de tokens, sem assinatura, e você pode comparar a resposta com outro modelo na mesma janela.