Kimi K2 Thinking
нейросеть
Kimi K2 Thinking — открытая модель рассуждений от Moonshot AI для агентных и многошаговых задач, доступная через kimi k2 thinking api
Макс. длина ответа
(в токенах)
Размер контекста
(в токенах)
Стоимость промпта
(за 1M токенов)
Стоимость ответа
(за 1M токенов)
Как работает Kimi K2 Thinking?
Kimi K2 Thinking — открытая модель рассуждений от Moonshot AI, продолжение серии K2 на архитектуре Mixture-of-Experts с триллионом параметров. Акцент сделан на агентных сценариях и длинных цепочках рассуждений: она рассчитана на задачи, которые не решаются одним ответом и требуют последовательности шагов. В BotHub модель открывается без VPN и зарубежной карты, оплата идёт российскими картами в рублях и по факту использования, а не подпиской. Рядом в том же окне более 250 моделей, поэтому вы можете сравнить ответы Кими К2 с другими и переключиться на любую из них. Для интеграций есть единый OpenAI-совместимый API: подключение одно, модель меняется параметром запроса. Аналитикам модель пригодится для многошаговых выводов по большим массивам данных, исследователям — для проработки гипотез, разработчикам — как рассуждающее ядро агентов, продуктовым командам — для прототипов со сложной логикой.Частые вопросы о Kimi K2 Thinking
Вы можете использовать результаты генерации в коммерческих целях. Все права на созданный контент принадлежат вам. Единственное ограничение: убедитесь, что в запросе не использовались защищённые авторским правом материалы третьих сторон. Ответственность за соблюдение прав на входные данные лежит на пользователе.
Kimi K2 Thinking — модель с рассуждениями от moonshotai. Она работает с текстом и документами, принимает изображения, вызывает внешние функции. Контекст в 262 144 токена позволяет держать в диалоге большой репозиторий, техзадание или подборку файлов, поэтому модель удобна для кода, аналитики и агентных сценариев.
Лимит вывода — 235 929 токенов за ответ. Этого хватает на объёмный технический документ, большой модуль кода или развёрнутый разбор с выкладками. На практике длина зависит от задачи и вашего промта: если нужен максимум, прямо попросите подробный и полный ответ.
Да, это ключевая особенность версии thinking: перед ответом модель выстраивает цепочку рассуждений и только потом выдаёт результат. Такой режим заметно помогает в математике, логике, отладке кода и многошаговых задачах, где важен не быстрый, а верный ответ.
Да. Модель поддерживает вызов функций и структурированный вывод в JSON, поэтому её можно подключать к своим инструментам, базам и внешним сервисам. В BotHub это доступно через единый OpenAI-совместимый API — сменить модель вы сможете, не переписывая интеграцию.
Изображения и документы — да, их можно отправить на вход вместе с текстом: разобрать скриншот, схему, таблицу или файл. Поддержка аудио и видео в наших данных не отмечена. Генерация картинок или звука к этой модели не относится — на выходе только текст.
Отдельных замеров по языкам в наших данных нет, поэтому обещать что-то конкретное не станем — проще проверить модель на своей задаче, тем более переключиться на другую в BotHub можно в один клик. Доступ из России идёт без VPN, оплата рублями.