GPT Audio Mini
нейросеть
GPT Audio Mini — экономичная аудиомодель OpenAI для синтеза естественной речи и голосовых сценариев.
Макс. длина ответа
(в токенах)
Размер контекста
(в токенах)
Стоимость промпта
(за 1M токенов)
Стоимость ответа
(за 1M токенов)
Как работает GPT Audio Mini?
GPT Audio Mini — облегчённая версия GPT Audio от OpenAI, рассчитанная на экономичную работу с речью. В новом снапшоте обновлён декодер: голос звучит естественнее, а тембр остаётся стабильным на протяжении реплики — этим модель и отличается от предыдущего снапшота. Через BotHub вы подключаетесь к ней без VPN и зарубежной карты, платите рублями по факту за израсходованные токены, а не за подписку, и в одном окне переключаетесь между сотнями моделей, если задача потребует другой. Единый OpenAI-совместимый API позволяет встроить озвучку в продукт и заменить модель, не переписывая интеграцию, а данные защищены шифрованием AES-GCM. Пригодится, когда нужно озвучить обучающий курс или выпуск подкаста, собрать голосового ассистента для поддержки, наговорить реплики персонажей в игре или прототипе, добавить звуковое сопровождение к презентации. Командам доступны договор, счёт, ЭДО и админ-панель с лимитами на пользователей.Частые вопросы о GPT Audio Mini
Вы можете использовать результаты генерации в коммерческих целях. Все права на созданный контент принадлежат вам. Единственное ограничение: убедитесь, что в запросе не использовались защищённые авторским правом материалы третьих сторон. Ответственность за соблюдение прав на входные данные лежит на пользователе.
gpt-audio-mini от OpenAI работает с текстом и документами: отвечает на вопросы, пересказывает и разбирает загруженные файлы, помогает с кодом и черновиками. Модель поддерживает вызов функций, поэтому подходит и для сценариев, где ответ нужно встроить в ваш продукт через API.
За один ответ модель выдаёт до 16 384 токенов — этого хватает на большую статью, подробную инструкцию или объёмный фрагмент кода. Контекстное окно составляет 128 000 токенов, так что в запрос можно уложить длинный документ и всю предысторию диалога.
Отдельный режим рассуждений в наших данных не отмечен, и это не значит, что его нет. На практике выручает простой приём: попросите в промпте разобрать задачу по шагам, а потом дать итоговый вывод — на логике и расчётах это заметно помогает.
Да, и то и другое подтверждено нашими данными. Модель умеет вызывать функции и возвращать структурированный ответ по заданной JSON-схеме, что удобно для агентов и автоматизации. Через единый OpenAI-совместимый API BotHub это встраивается в ваш код без переписывания интеграции.
По нашим данным на вход принимаются текст и документы: вы загружаете файл и просите разобрать его содержимое. Пометок о приёме изображений, аудио и видео у нас нет, поэтому для таких задач удобнее переключиться в том же окне на мультимодальную модель.
Данных о языках промптов и ответов у нас нет, поэтому обещать конкретику мы не будем. Проверить проще всего на своей задаче: прогоните пару типовых запросов в BotHub и сравните с другой моделью. Переключение занимает секунды, VPN и зарубежная карта не нужны.