Le das un video o una nota de voz. Te devuelve las escenas con su tiempo, lo que se dice palabra por palabra, y quién aparece en qué minuto. Sin que tengas que mirarlo entero.
Corta la película en escenas reales, describe cada tramo y te dice en qué minuto pasa lo que buscás.
Texto completo y cada palabra con su segundo. Sirve para subtitular, para buscar y para cortar exacto.
Dónde cambia el plano, qué pasa en cada tramo y un resumen que declara cuánto del video miró de verdad.
Reconocimiento facial contra tu propia galería, con la línea de tiempo de cada persona.
Una clave, un POST y un identificador. Consultás cuando quieras: los trabajos no se pierden.
Cuántos cuadros miró, qué décimos del video cubrió y qué quedó afuera. Si no lo vio, lo dice.
El cupo descuenta minutos procesados. Un trabajo que falla no te consume nada.
# 1. Mandás el trabajo curl -X POST https://growx-vision-production.up.railway.app/v1/jobs \ -H "Authorization: Bearer gxv_tu_clave" \ -H "Content-Type: application/json" \ -d '{"tipo":"transcribir","fuente":"https://…/charla.mp4"}' # 2. Te devuelve un id, y cuando está listo: curl https://growx-vision-production.up.railway.app/v1/jobs/<id> \ -H "Authorization: Bearer gxv_tu_clave"
Los trabajos se procesan en una GPU propia, de a uno por vez. En horas cargadas se hace cola: el trabajo espera, no falla. Preferimos decirlo antes que prometer un tiempo que no controlamos.
Es lo que cuesta de verdad: tiempo de GPU. Contar trabajos premiaría al que manda dos horas y castigaría al que manda una nota de voz.