API распознавания эмоций в речи
Определяет эмоцию в загруженной аудиозаписи и возвращает оценку уверенности и подробные результаты для всех поддерживаемых эмоций.
Базовый URL
https://api.genderrecognition.com
Поддерживаемые эмоции
angrydisgustedfearfulhappyneutralothersadsurprised
Конечная точка
POST /v1/speech-emotion/api
Заголовки
apiKey: YOUR_API_KEY
Content-Type: multipart/form-data
Тело запроса
| Поле | Тип | Обязательно | Описание |
|---|---|---|---|
file | файл | Да | Аудиофайл для анализа. |
Пример
curl -X POST "https://api.genderrecognition.com/v1/speech-emotion/api" \
-H "apiKey: YOUR_API_KEY" \
-F "file=@audio.wav"
Ответ
{
"success": true,
"predicted_emotion": "happy",
"confidence": 87,
"expressions": {
"angry": 2,
"disgusted": 1,
"fearful": 1,
"happy": 87,
"neutral": 6,
"other": 0,
"sad": 2,
"surprised": 1
},
"remainingRequests": 2999
}
Поля ответа
| Поле | Тип | Описание |
|---|---|---|
success | boolean | true, если обработка аудио прошла успешно. |
predicted_emotion | string | Наиболее вероятная эмоция, обнаруженная в аудиозаписи. |
confidence | integer | Уверенность в predicted_emotion в процентах от 0 до 100. |
expressions | object | Оценка в процентах для каждой поддерживаемой эмоции. |
remainingRequests | integer | Количество запросов API после списания за этот успешный запрос. |
Значения указаны целыми числами в процентах, а не десятичными числами от 0 до 1.
Возможные ошибки
Отсутствует ключ API
{
"error": "API key is required"
}
Недействительный ключ API
{
"error": "Invalid API key"
}
Отсутствует файл
{
"error": "No file uploaded"
}
Файл слишком велик
{
"error": "File too large"
}
Недопустимый формат файла
{
"error": "Invalid file type. Allowed formats: WAV, MP3, FLAC, MP4, OGG, AIFF"
}
Не удалось преобразовать аудио
Возвращается, если расширение файла допустимо, но ffmpeg не может его преобразовать (например, если файл повреждён или не читается):
{
"error": "Audio conversion failed: <details>"
}
Квота исчерпана
{
"error": {
"code": "RATE_LIMIT_EXCEEDED",
"message": "You have exceeded your free tier limit of 50 requests.",
"detailedMessage": "Insufficient remaining requests. Required: 1, Available: 0",
"details": {
"limit": 50,
"used": 50,
"reset_date": "2026-07-01T00:00:00.000Z"
},
"suggested_action": "Please upgrade to a premium plan to continue using the API."
}
}
Ошибка обработки
{
"error": "Speech emotion detection failed"
}
Примечания
- Сервер принимает распространённые аудиоформаты, например WAV, MP3, FLAC, MP4, OGG, и AIFF, а файлы не в формате WAV преобразует перед анализом.
- Передавайте аудио в поле
file; размер файла не должен превышать 10 МБ. - Запрос списывается только после того, как служба прогнозирования успешно завершится.