API de reconhecimento de emoções na fala
Identifique a emoção expressa em um arquivo de áudio enviado, com uma pontuação de confiança e a distribuição completa entre todas as emoções compatíveis.
URL base
https://api.genderrecognition.com
Emoções compatíveis
angrydisgustedfearfulhappyneutralothersadsurprised
Endpoint
POST /v1/speech-emotion/api
Cabeçalhos
apiKey: YOUR_API_KEY
Content-Type: multipart/form-data
Corpo
| Campo | Tipo | Obrigatório | Descrição |
|---|---|---|---|
file | arquivo | Sim | Arquivo de áudio a analisar. |
Exemplo
curl -X POST "https://api.genderrecognition.com/v1/speech-emotion/api" \
-H "apiKey: YOUR_API_KEY" \
-F "file=@audio.wav"
Resposta
{
"success": true,
"predicted_emotion": "happy",
"confidence": 87,
"expressions": {
"angry": 2,
"disgusted": 1,
"fearful": 1,
"happy": 87,
"neutral": 6,
"other": 0,
"sad": 2,
"surprised": 1
},
"remainingRequests": 2999
}
Campos da resposta
| Campo | Tipo | Descrição |
|---|---|---|
success | boolean | true quando o áudio foi processado com sucesso. |
predicted_emotion | texto | Emoção mais provável identificada no áudio. |
confidence | inteiro | Porcentagem de confiança de predicted_emotion, de 0 a 100. |
expressions | objeto | Pontuação percentual para cada emoção compatível. |
remainingRequests | inteiro | Solicitações de API restantes após descontar esta solicitação bem-sucedida. |
Os valores são porcentagens inteiras, não números decimais entre 0 e 1.
Casos de erro
Chave de API ausente
{
"error": "API key is required"
}
Chave de API inválida
{
"error": "Invalid API key"
}
Arquivo ausente
{
"error": "No file uploaded"
}
Arquivo muito grande
{
"error": "File too large"
}
Tipo de arquivo inválido
{
"error": "Invalid file type. Allowed formats: WAV, MP3, FLAC, MP4, OGG, AIFF"
}
Falha na conversão de áudio
Retornado quando o arquivo tem uma extensão permitida, mas o ffmpeg não consegue convertê-lo (por exemplo, se estiver corrompido ou ilegível):
{
"error": "Audio conversion failed: <details>"
}
Cota excedida
{
"error": {
"code": "RATE_LIMIT_EXCEEDED",
"message": "You have exceeded your free tier limit of 50 requests.",
"detailedMessage": "Insufficient remaining requests. Required: 1, Available: 0",
"details": {
"limit": 50,
"used": 50,
"reset_date": "2026-07-01T00:00:00.000Z"
},
"suggested_action": "Please upgrade to a premium plan to continue using the API."
}
}
Falha no processamento
{
"error": "Speech emotion detection failed"
}
Observações
- O backend aceita formatos de áudio comuns, como WAV, MP3, FLAC, MP4, OGG, e AIFF, e converte arquivos que não sejam WAV antes da análise.
- Envie áudio no campo
file; o arquivo deve ter no máximo 10 MB. - A solicitação só é descontada depois que o serviço de previsão retorna com sucesso.