segmentación automática de noticias en español

Tengo muchos datos de noticias en español acopladas con su transcripción completa (manualmente generada). Quisiera saber si se puede usar este método para segmentar en audios pequeños y generar data sets para Deep Speech.

Ejemplo de la transcripción:

JOAQUÍN LÓPEZ DÓRIGA, CONDUCTOR: Vamos con toda la información, le decía de este miércoles 13 de febrero. Voy a empezar contigo, Israel Aldave, la Reforma educativa, no hay consenso a la Cámara de diputados para que pase. Te escucho, Israel.

ISRAEL ALDAVE, REPORTERO: Joaquín, el Secretario de Educación, Esteban Moctezuma, afirmó que la Reforma educativa, impulsada por el gobierno del ex presidente Enrique Peña Nieto, no debió concebirse y advierte, ante senadores, que si no se echa atrás, los daños en el sistema educativo, en estudiantes y maestros serían irreparables. Joaquín.

JOAQUÍN LÓPEZ DÓRIGA: Bien, eso dice Esteban Moctezuma. ITS

Enlace al audio

carlfm01 / librivox-tools

segmentación automática de noticias en español #1