Ir al contenido principal

NLTK with Python

 Hoy es un día B'atz' 6.

Es un buen día para comenzar a leer nuevamente el libro de NLP with python para aprender a procesar los subtítulos de las películas que estoy viendo.

Comentarios

Entradas populares de este blog

Visita al CELALI

   Ayer fui a dar una hojeada al CELALI. Me llamó la atención el libro de Jan de Vos Nuestra raíz que editó la editorial CLIO. A ver si el lunes me doy otra vuelta para reportar los otros libros que me llamaron la atención y comenzar a leerlos y hacer mis apuntes de lingüista aficionado...

Bats'i k'op

Aprendiendo Tsotsil en tiempos del Big Data: Se dice que las lenguas mexicanas han sido poco documetadas, pero existiendo tanto trabajo de lingüistas y antropólogos no vale la pena batallar inventando el hilo negro...voy a intentar aprender a usar todos los recursos técnicos disponibles para aprender la lengua de la manera más eficiente posible... Aquí voy a ir dejando una bitácora de los métodos y materiales que voy descubriendo en el camino de aprender idiomas... WordClouds & Frequency Lists: Comencé con los PDFs y audios del proyecto Nuestras Raíces y después de escuchar uno de los capítulos mientras leía el texto decidí comenzar el proyecto de análisis estadístico del texto. Primeramente usé el Hermetic Word Frequency Counter para entender el proceso, porque la versión gratuita elimina información para que pagues. También conseguí un script de Phyton para sacar las listas de palabras frecuentes para comparar con los resultados de Hermetic. Ambas cosas las tenía desde que estab...