Descripción General
Neuracall utiliza OpenAI Whisper para convertir grabaciones de audio en texto. La transcripción es el primer paso del proceso de análisis y es fundamental para la calidad del NeuraScore.Proceso de Transcripción
1
Recepcion del Audio
El archivo de audio se sube y almacena de forma segura en S3.
2
Conversion
Si es necesario, el audio se convierte a un formato optimizado para Whisper.
3
Transcripción
Whisper procesa el audio y genera el texto con timestamps.
4
Segmentación
El texto se divide en segmentos por hablante cuando es posible.
Formatos de Audio Soportados
Deteccion de Idioma
Whisper detecta automáticamente el idioma del audio. Los idiomas principales soportados incluyen:- Espanol
- Ingles
- Portugues
- Frances
- Y muchos mas…
Estructura de la Transcripción
Respuesta de API
Campos Principales
Segmentos
Cada segmento incluye:Estados de Transcripción
Factores de Calidad
Calidad del Audio
La precisión de la transcripción depende de:Recomendaciones
Uso en el Análisis
La transcripción es la base para:- NeuraScore: El análisis GPT evalúa el contenido transcrito
- Resumen: Se genera a partir del texto
- Keywords: Se extraen del contenido
- Insights: Se derivan del análisis
Reproduccion Sincronizada
En la aplicación web, puedes:- Reproducir el audio original
- Ver la transcripción con timestamps
- Hacer clic en un segmento para saltar a ese punto
- Leer mientras escuchas
Privacidad y Seguridad
- Los audios se almacenan de forma segura en AWS S3
- Solo usuarios autorizados pueden acceder
- Los datos se procesan en infraestructura de Neuracall
- Cumplimiento con estándares de seguridad
Ver detalle de llamada
Acceder a transcripciónes
API de Transcripción
Endpoint de transcripción
