API de reconocimiento de emociones en el habla
Detecta la emoción expresada en un archivo de audio y devuelve una puntuación de confianza y un desglose completo de todas las emociones admitidas.
URL base
https://api.genderrecognition.com
Emociones admitidas
angrydisgustedfearfulhappyneutralothersadsurprised
Endpoint
POST /v1/speech-emotion/api
Encabezados
apiKey: YOUR_API_KEY
Content-Type: multipart/form-data
Cuerpo de la solicitud
| Campo | Tipo | Obligatorio | Descripción |
|---|---|---|---|
file | file | Sí | Archivo de audio que se analizará. |
Ejemplo
curl -X POST "https://api.genderrecognition.com/v1/speech-emotion/api" \
-H "apiKey: YOUR_API_KEY" \
-F "file=@audio.wav"
Respuesta
{
"success": true,
"predicted_emotion": "happy",
"confidence": 87,
"expressions": {
"angry": 2,
"disgusted": 1,
"fearful": 1,
"happy": 87,
"neutral": 6,
"other": 0,
"sad": 2,
"surprised": 1
},
"remainingRequests": 2999
}
Campos de respuesta
| Campo | Tipo | Descripción |
|---|---|---|
success | boolean | true si el audio se procesó correctamente. |
predicted_emotion | string | Emoción más probable detectada en el audio. |
confidence | integer | Porcentaje de confianza de predicted_emotion, de 0 a 100. |
expressions | object | Puntuación porcentual de cada emoción admitida. |
remainingRequests | integer | Solicitudes API restantes tras descontar esta solicitud completada correctamente. |
Los valores son porcentajes enteros, no decimales entre 0 y 1.
Errores posibles
Falta la clave API
{
"error": "API key is required"
}
Clave API no válida
{
"error": "Invalid API key"
}
Falta el archivo
{
"error": "No file uploaded"
}
Archivo demasiado grande
{
"error": "File too large"
}
Tipo de archivo no válido
{
"error": "Invalid file type. Allowed formats: WAV, MP3, FLAC, MP4, OGG, AIFF"
}
Error al convertir el audio
Se devuelve cuando la extensión del archivo está permitida, pero ffmpeg no puede convertirlo (por ejemplo, si está dañado o no se puede leer):
{
"error": "Audio conversion failed: <details>"
}
Cuota excedida
{
"error": {
"code": "RATE_LIMIT_EXCEEDED",
"message": "You have exceeded your free tier limit of 50 requests.",
"detailedMessage": "Insufficient remaining requests. Required: 1, Available: 0",
"details": {
"limit": 50,
"used": 50,
"reset_date": "2026-07-01T00:00:00.000Z"
},
"suggested_action": "Please upgrade to a premium plan to continue using the API."
}
}
Error de procesamiento
{
"error": "Speech emotion detection failed"
}
Notas
- El servidor acepta formatos de audio habituales como WAV, MP3, FLAC, MP4, OGG y AIFF. Los archivos que no son WAV se convierten antes del análisis.
- Envía los archivos de audio en el campo
file; no pueden superar los 10 MB. - La solicitud solo se descuenta cuando el servicio de predicción responde correctamente.