Saludos a todos:
Ya están disponibles las láminas de la clase de hoy. Esta sesión (y otra más) estarán dedicadas al tema de la indización, enfocándonos principalmente en cómo aprovechar técnicas de PLN para hacer estar tarea.
Complementario a esto, aquí van algunas lecutras interesantes:
1. Un manual de indización escrito por James D. Anderson para la National Information Standards Organization.
2. Un artículo escrito por Isidoro Gil Leiva y José V. Rodríguez Muñoz, en donde tratan el uso de descriptores para tareas de indización.
3. Otro artículo de Gil Leiva y Rodríguez Muñoz, el cual muestra una panorámica sobre los distintos procesos de indización automática que se siguen hoy en día.
Finalmente, aquí va la referencia a un artículo en línea elaborado por María Jesús Lamarca Lapuente, en donde ofrece una explicación muy clara sobre lo que es indización, y algunas relaciones que tiene con PLN: www.hipertexto.info/documentos/indiz_automat.htm.
Seguimos en contacto. Suerte con todo.
miércoles, 24 de marzo de 2010
jueves, 18 de marzo de 2010
Material para la clase: 18/03/2010
Saludos:
Aquí están las láminas para la clase de hoy. Básicamente, se trata de un complemento a lo que vimos la sesión pasada sobre metadatos. En esta sesión, hoy trabajarán con XML.
Como material anexo, les presento las notas de un curso que dio Marti Hearst y colaboradores sobre metadados facetados, que es justo la integración de metadatos con sistemas de búsquedas que identifican facetas asociadas.
Suerte con todo.
Aquí están las láminas para la clase de hoy. Básicamente, se trata de un complemento a lo que vimos la sesión pasada sobre metadatos. En esta sesión, hoy trabajarán con XML.
Como material anexo, les presento las notas de un curso que dio Marti Hearst y colaboradores sobre metadados facetados, que es justo la integración de metadatos con sistemas de búsquedas que identifican facetas asociadas.
Suerte con todo.
jueves, 11 de marzo de 2010
Láminas para la clase: 11/03/2010
Saludos a todos:
Ya pueden acceder a las láminas de la clase de hoy, la cual estará dedicada a dar una panorámica general sobre metadados. Al respecto, algunas lecturas que pueden resultar interesantes son:
1. Un manual preparado por la National Information Standards Organization (NISO) de los Estados Unidos, en donde se explica qué es un metadato, y cuál su formato estandar.
2. Un artículo escrito por Eva María Méndez, de la Universidad Carlos III de Madrid, en donde plantea el uso de metadatos como un recurso para generar tesauros y otros recursos para clasificación de conocimiento.
3. Finalmente, un artículo en colaboración entre Achim Steinacker (University of Technology of Darmstadt, Alemania), Amir Gahvam (University of Ottawa, Canadá) y Ralf Steinmetz (GNRCIT, Alemania), en donde explican el uso de metadatos para crear recursos WEBs.
Nota: ¿avances con la tarea de la clase pasada? Espero ver sus propuestas.
Suerte con todo.
Ya pueden acceder a las láminas de la clase de hoy, la cual estará dedicada a dar una panorámica general sobre metadados. Al respecto, algunas lecturas que pueden resultar interesantes son:
1. Un manual preparado por la National Information Standards Organization (NISO) de los Estados Unidos, en donde se explica qué es un metadato, y cuál su formato estandar.
2. Un artículo escrito por Eva María Méndez, de la Universidad Carlos III de Madrid, en donde plantea el uso de metadatos como un recurso para generar tesauros y otros recursos para clasificación de conocimiento.
3. Finalmente, un artículo en colaboración entre Achim Steinacker (University of Technology of Darmstadt, Alemania), Amir Gahvam (University of Ottawa, Canadá) y Ralf Steinmetz (GNRCIT, Alemania), en donde explican el uso de metadatos para crear recursos WEBs.
Nota: ¿avances con la tarea de la clase pasada? Espero ver sus propuestas.
Suerte con todo.
jueves, 4 de marzo de 2010
Láminas y lecturas para la clase: 04/03/2010
Saludos a todos:
Aquí están las láminas para la clase de hoy. Del mismo modo, las lecturas que la complementan son:
1. El capítulo 19 del manual de Jurafsky y Martin, el cual da una introducción a la semántica léxica computacional. Nota: Revisen la parte dedicada a relaciones léxicas (hiponimia, hiperonimia, meronimia, sinonimia, etc.), porque van a requerir saber estas relaciones para realizar la tarea que programamos hoy.
2. Un artículo escrito por Christiane Fellbaum (Princeton University), el cual describe a grandes rasgos qué es WordNet. El texto de Fellbaum puede darles pistas sobre cómo resolver la tarea de hoy.
3. Otro artículo, elaborado por Chris Baker, Charles Fillmore y John Lowe (Berkeley University), en donde describen de manera general el proyecto FrameNet.
4. Finalmente, un reporte elaborado por Marie-Claude L'Homme (Université de Montréal), en donde explica el Diccionario Fundamental para Informática (DiCoInfo). El texto está en francés. Otra opción es que revisen la versión en línea. La liga viene anotada en las láminas de la clase.
Suerte con todo.
Aquí están las láminas para la clase de hoy. Del mismo modo, las lecturas que la complementan son:
1. El capítulo 19 del manual de Jurafsky y Martin, el cual da una introducción a la semántica léxica computacional. Nota: Revisen la parte dedicada a relaciones léxicas (hiponimia, hiperonimia, meronimia, sinonimia, etc.), porque van a requerir saber estas relaciones para realizar la tarea que programamos hoy.
2. Un artículo escrito por Christiane Fellbaum (Princeton University), el cual describe a grandes rasgos qué es WordNet. El texto de Fellbaum puede darles pistas sobre cómo resolver la tarea de hoy.
3. Otro artículo, elaborado por Chris Baker, Charles Fillmore y John Lowe (Berkeley University), en donde describen de manera general el proyecto FrameNet.
4. Finalmente, un reporte elaborado por Marie-Claude L'Homme (Université de Montréal), en donde explica el Diccionario Fundamental para Informática (DiCoInfo). El texto está en francés. Otra opción es que revisen la versión en línea. La liga viene anotada en las láminas de la clase.
Suerte con todo.
miércoles, 24 de febrero de 2010
Láminas para la clase: 25/02/2010
Saludos:
Ya pueden acceder a las láminas para la clase de mañana.
Por otro lado, las lecturas que acompañan al tema son:
1. El capítulo 22 del libro de Daniel Jurafsky y James Martin, dedicado al tema de la extracción de información.
2. Un texto escrito por Christian Jacquemin (LIMS-CNRS, Francia) y Didier Bourigault (Université de Toulouse, Francia), en cual es una introducción breve a la extracción terminológica.
3. Un artículo escrito por David Nadeau (National Research Council Canada) y Satoshi Sekine (New York University), en donde explican qué es la extracción y clasificación de entidades nombradas.
Finalmente, para la tarea que van a hacer de extracción de términos, el alrchivo que van a ocupar lo pueden descargar dando un click aquí.
Suerte con todo.
Ya pueden acceder a las láminas para la clase de mañana.
Por otro lado, las lecturas que acompañan al tema son:
1. El capítulo 22 del libro de Daniel Jurafsky y James Martin, dedicado al tema de la extracción de información.
2. Un texto escrito por Christian Jacquemin (LIMS-CNRS, Francia) y Didier Bourigault (Université de Toulouse, Francia), en cual es una introducción breve a la extracción terminológica.
3. Un artículo escrito por David Nadeau (National Research Council Canada) y Satoshi Sekine (New York University), en donde explican qué es la extracción y clasificación de entidades nombradas.
Finalmente, para la tarea que van a hacer de extracción de términos, el alrchivo que van a ocupar lo pueden descargar dando un click aquí.
Suerte con todo.
jueves, 18 de febrero de 2010
Lecturas para la sexta clase
Saludos, nuevamente:
Las lecturas que pueden revisar después sobre los temas que vamos a ver hoy son:
1. Sobre corpus lingüísticos: en este texto, un lingüista computacional, Stefan Th. Gries (University of California at Santa Barbara) sostiene una conversación con un lingüista teórico, Frederick Newmeyer (Simon Fraser University) sobre lo que es un corpus lingüístico.
2. Sobre etiquetados de corpus: Steven Bird (University of Melbourne) y Marc Liberman (University of Pennsylvania) trabajaron juntos en un proyecto sobre anotación morfo-sintáctica en corpus: el famoso PennTreeBank. En este artículo, detallan varias ideas interesantes sobre lo que es anotación sintáctica, además de buscar una propuesta "universal" (si eso es posible, claro).
3. Un capítulo de un libro del libro de Jurafsky y Martin, el cual explica cómo hacer una gramática formal para el inglés. Va mucho más allá del concepto de chunking, pero vale la pena leerlo, sobre todo porque ofrece una buena visión sobre cuál es el valor que tiene en PLN el análisis sintáctico.
Suerte con todo.
Las lecturas que pueden revisar después sobre los temas que vamos a ver hoy son:
1. Sobre corpus lingüísticos: en este texto, un lingüista computacional, Stefan Th. Gries (University of California at Santa Barbara) sostiene una conversación con un lingüista teórico, Frederick Newmeyer (Simon Fraser University) sobre lo que es un corpus lingüístico.
2. Sobre etiquetados de corpus: Steven Bird (University of Melbourne) y Marc Liberman (University of Pennsylvania) trabajaron juntos en un proyecto sobre anotación morfo-sintáctica en corpus: el famoso PennTreeBank. En este artículo, detallan varias ideas interesantes sobre lo que es anotación sintáctica, además de buscar una propuesta "universal" (si eso es posible, claro).
3. Un capítulo de un libro del libro de Jurafsky y Martin, el cual explica cómo hacer una gramática formal para el inglés. Va mucho más allá del concepto de chunking, pero vale la pena leerlo, sobre todo porque ofrece una buena visión sobre cuál es el valor que tiene en PLN el análisis sintáctico.
Suerte con todo.
Láminas para la clase: 18/02/2010
Saludos a todos:
He aquí las láminas para la clase de hoy. En otra entrada tendrán acceso a las lecturas relacionadas con los temas que vamos a ver hoy.
Sobre la tarea de la clase pasada, Alexa y Cristina me escribieron para que les diera más pistas sobre cómo resolverla. Hoy en el transcurso de la mañana podrán ver en el blog la solución al ejercicio. De entrada, les comento: no se preocupen, por experiencia les digo que el único camino seguro para aprender expresiones regulares es la práctica: hay que equivocarse varias veces para dar con una buena solución (de hecho, aunque se vea muy abstracto, verán que al final resulta fácil, y que se pueden proponer varias soluciones para un mismo problema).
Suerte con todo.
He aquí las láminas para la clase de hoy. En otra entrada tendrán acceso a las lecturas relacionadas con los temas que vamos a ver hoy.
Sobre la tarea de la clase pasada, Alexa y Cristina me escribieron para que les diera más pistas sobre cómo resolverla. Hoy en el transcurso de la mañana podrán ver en el blog la solución al ejercicio. De entrada, les comento: no se preocupen, por experiencia les digo que el único camino seguro para aprender expresiones regulares es la práctica: hay que equivocarse varias veces para dar con una buena solución (de hecho, aunque se vea muy abstracto, verán que al final resulta fácil, y que se pueden proponer varias soluciones para un mismo problema).
Suerte con todo.
Suscribirse a:
Entradas (Atom)