Como funciona Inkling?
Inkling é um modelo multimodal de pesos abertos da Thinking Machines Lab com arquitetura mixture-of-experts: de 975 bilhões de parâmetros, cerca de 41 bilhões são ativados por solicitação, combinando o conhecimento de uma grande rede com computação econômica. Criado para raciocínio universal, escrita e análise de código e sistemas de agentes com chamada de ferramentas, o Inkling é ideal onde as respostas precisam ser estruturadas passo a passo. No BotHub, o modelo está disponível sem VPN ou cartão estrangeiro: você paga com cartão local em rublos apenas pelos tokens consumidos, que não expiram. Mais de 250 modelos estão disponíveis na mesma janela — compare respostas e alterne sem reescrever a integração: a API no BotHub é unificada. As conversas são criptografadas e as empresas têm acesso a contratos, faturas, EDI e painel administrativo com limites. Útil para analisar e refatorar código, encontrar erros via rastreamento, criar agentes com function calling, preparar documentação técnica ou analisar imagens com texto.Perguntas frequentes sobre Inkling
Você pode usar os resultados da geração para fins comerciais. Todos os direitos sobre o conteúdo criado pertencem a você. A única restrição: certifique-se de que a solicitação não inclua materiais de terceiros protegidos por direitos autorais. A responsabilidade pelo cumprimento dos direitos sobre os dados de entrada é do usuário.
O inkling:free da thinkingmachines é um modelo de texto com raciocínio antes da resposta. Ele analisa documentos e imagens, escreve e corrige código, ajuda com análises e tarefas STEM. A janela de contexto de 262.144 tokens permite trabalhar com arquivos grandes e conversas longas inteiras, sem dividir em fragmentos.
O limite de saída, segundo nossos dados, é de 262.144 tokens, o mesmo que o contexto. Ou seja, em uma única passagem você pode obter um documento longo, um grande módulo de código ou uma análise detalhada, sem precisar colar o resultado de várias partes manualmente.
Sim, o modo de raciocínio está confirmado. O modelo primeiro processa a tarefa passo a passo e só então formula a resposta, o que ajuda significativamente em matemática, lógica, depuração de código e cenários de várias etapas. Você paga conforme o uso por tokens, sem necessidade de assinatura.
Sim, o modelo suporta chamada de funções e saída estruturada em JSON — ele pode ser usado em cenários de agentes e conectado a ferramentas externas. O BotHub utiliza uma API unificada compatível com OpenAI, permitindo trocar de modelo sem reescrever a integração.
O modelo aceita imagens e documentos como entrada: você pode enviar capturas de tela, diagramas, PDFs ou tabelas e pedir para analisar o conteúdo. Não há informações sobre áudio e vídeo em nossos dados; para essas tarefas, o BotHub possui modelos especializados.
Não temos dados sobre idiomas, então não podemos prometer nada: teste o modelo com suas próprias solicitações reais. É rápido — o acesso da Rússia é feito sem VPN ou cartão estrangeiro, pagamento em rublos, e você pode comparar as respostas de outros modelos na mesma janela.