Media
Detecta provável atividade na faixa de voz e exporta intervalos de fala/não fala em JSON, CSV, SRT ou lista FFmpeg.
Chame esta ferramenta a partir do seu código em três idiomas.
# 1) Request a presigned URL → returns { uploadUrl, storageKey }
curl -X POST 'https://api.elysiatools.com/api/upload/presign/audio-voice-activity-segmentation' \
-H 'Content-Type: application/json' \
-d '{"filename":"audioFile.ext","contentType":"application/octet-stream","size":12345}'
# 2) PUT the file bytes directly to the presigned uploadUrl
curl -X PUT '<presigned uploadUrl>' \
--data-binary @/path/to/file.ext
# 3) Call the tool, passing the returned storageKey for each file field
curl -X POST 'https://api.elysiatools.com/pt/api/tools/audio-voice-activity-segmentation' \
-F 'audioFile=uploads/2026/01/01/your-tool-1700000000000-abc123.ext' \
-F 'sensitivity=balanced' \
-F 'minimumSpeechSeconds=0.3' \
-F 'minimumSilenceSeconds=0.25' \
-F 'exportFormat=json'Envie uma requisição POST com suas entradas em JSON. Parâmetros do tipo arquivo exigem upload prévio.
POST https://api.elysiatools.com/pt/api/tools/audio-voice-activity-segmentation| Nome | Tipo | Obrigatório | Descrição |
|---|---|---|---|
| audioFile | fileupload necessário | Sim | — |
| sensitivity | select | Sim | — |
| minimumSpeechSeconds | number | Não | — |
| minimumSilenceSeconds | number | Não | — |
| exportFormat | select | Sim | — |
Resultado de arquivo
{
"filePath": "/public/processing/randomid.ext",
"fileName": "output.ext",
"contentType": "application/octet-stream",
"size": 1024,
"metadata": {
"key": "value"
},
"error": "Error message (optional)",
"message": "Notification message (optional)"
}Adicione esta ferramenta ao seu servidor Model Context Protocol para que agentes de IA possam listá-la e chamá-la.
Adicione este bloco à configuração do seu cliente MCP:
{
"mcpServers": {
"elysiatools-audio-voice-activity-segmentation": {
"name": "audio-voice-activity-segmentation",
"description": "Detecta provável atividade na faixa de voz e exporta intervalos de fala/não fala em JSON, CSV, SRT ou lista FFmpeg.",
"baseUrl": "https://api.elysiatools.com/mcp/sse?toolId=audio-voice-activity-segmentation",
"command": "",
"args": [],
"env": {},
"isActive": true,
"type": "sse"
}
}
}Após conectar ao endpoint SSE, liste as ferramentas expostas:
{
"jsonrpc": "2.0",
"id": 1,
"method": "tools/list"
}Invoque a ferramenta pelo seu id; os argumentos são construídos a partir de seus parâmetros:
{
"jsonrpc": "2.0",
"id": 2,
"method": "tools/call",
"params": {
"name": "audio-voice-activity-segmentation",
"arguments": {
"audioFile": "https://example.com/file.ext",
"sensitivity": "balanced",
"minimumSpeechSeconds": 0.3,
"minimumSilenceSeconds": 0.25,
"exportFormat": "json"
}
}
}Dúvidas ou problemas? Contate [email protected]