@inproceedings{silberztein-etal-2001-intex,
title = "Intex et ses applications informatiques",
author = "Silberztein, Max and
Poibeau, Thierry and
Balvet, Antonio",
editor = "Maurel, Denis",
booktitle = "Actes de la 8{\`e}me conf{\'e}rence sur le Traitement Automatique des Langues Naturelles. Tutoriels",
month = jul,
year = "2001",
address = "Tours, France",
publisher = "ATALA",
url = "https://preview.aclanthology.org/fix-sig-urls/2001.jeptalnrecital-tutoriel.6/",
pages = "143--172",
language = "fra",
abstract = "Intex est un environnement de d{\'e}veloppement utilis{\'e} pour construire, tester et accumuler rapidement des motifs morpho-syntaxiques qui apparaissent dans des textes {\'e}crits en langue naturelle. Un survol du syst{\`e}me est pr{\'e}sent{\'e} dans [Silberztein, 1999] , le manuel d{'}instruction est disponible [Silberztein 2000]. Chaque description {\'e}l{\'e}mentaire est repr{\'e}sent{\'e}e par une grammaire locale, qui est habituellement entr{\'e}e en machine gr{\^a}ce {\`a} l'{\'e}diteur de graphe d{'}Intex. Une caract{\'e}ristique importante d{'}Intex est que chaque grammaire locale peut {\^e}tre facilement r{\'e}employ{\'e}e dans d{'}autres grammaires locales. Typiquement, les d{\'e}veloppeurs construisent des graphes {\'e}l{\'e}mentaires qui sont {\'e}quivalents {\`a} des transducteurs {\`a} {\'e}tats finis, et r{\'e}emploient ces graphes dans d{'}autres graphes de plus en plus complexes. Une seconde caract{\'e}ristique d{'}Intex est que les objets trait{\'e}s (grammaires, dictionnaires et textes) sont repr{\'e}sent{\'e}s de fa{\c{c}}on interne par des transducteurs {\`a} {\'e}tats finis. En cons{\'e}quence, toutes les fonctionnalit{\'e}s du syst{\`e}me se ram{\`e}nent {\`a} un nombre limit{\'e} d{'}op{\'e}rations sur des transducteurs. Par exemple, appliquer une grammaire {\`a} un texte revient {\`a} construire l{'}union des transducteurs {\'e}l{\'e}mentaires, la d{\'e}terminiser, puis {\`a} calculer l{'}intersection du r{\'e}sultat avec le transducteur du texte. Cette architecture permet d{'}utiliser des algorithmes efficaces (par ex. lorsqu{'}on applique un transducteur d{\'e}terministe {\`a} un texte pr{\'e}alablement index{\'e}), et donne {\`a} Intex la puissance d{'}une machine de Turing (gr{\^a}ce {\`a} la possibilit{\'e} d{'}appliquer des transducteurs en cascade). Dans ce tutoriel, nous montrerons comment utiliser un outil linguistique tel qu{'}Intex dans des environnements informatiques. Nous nous appuierons sur des applications de filtrage et d{'}extraction d{'}information, r{\'e}alis{\'e}es notamment au centre de recherche de Thales. Les applications suivantes seront d{\'e}taill{\'e}es, tant sur le plan linguistique qu{'}informatique filtrage d{'}information a partir d{'}un flux AFP [Meunier et al. l999] extraction de tables d{'}interaction entre g{\`e}nes {\`a} partir de bases de donn{\'e}es textuelles en g{\'e}nomique. [Poibeau 2001] Le tutoriel montrera comment Intex peut {\^e}tre employ{\'e} comme moteur de filtrage d{'}un flux de d{\'e}p{\^e}ches de type AFP dans un cadre industriel. Il d{\'e}taillera {\'e}galement les fonctionnalit{\'e}s de transformations des textes (transduction) permettant de passer rapidement de structures linguistiques vari{\'e}es {\`a} des formes normalis{\'e}es permettant de remplir une base de donn{\'e}es. Sur le plan informatique, on d{\'e}taillera l{'}appel aux routines Intex, les param{\'e}trages possibles (d{\'e}coupage en phrases, choix des dictionnaires...), et on survolera les nouvelles possibilit{\'e}s d{'}int{\'e}gration (Intex API)."
}
Markdown (Informal)
[Intex et ses applications informatiques](https://preview.aclanthology.org/fix-sig-urls/2001.jeptalnrecital-tutoriel.6/) (Silberztein et al., JEP/TALN/RECITAL 2001)
ACL
- Max Silberztein, Thierry Poibeau, and Antonio Balvet. 2001. Intex et ses applications informatiques. In Actes de la 8ème conférence sur le Traitement Automatique des Langues Naturelles. Tutoriels, pages 143–172, Tours, France. ATALA.