Le trameur est un logiciel de textométrie qui fonctionne sur windows. Il sert à compter les unités d’un texte en tenant en compte les éventuelles parties du texte, afin d’évaluer par exemple l’évolution du vocabulaire dans une chronologie ou de comparer le vocabulaire des parties.
Le trameur considère le texte comme un ensemble de positions avec à chaque position une unité à identifier, tout en ayant la possibilité d’ajouter à chaque position une annotation (lemme, forme, catégorie,…)
Tout d’abord, il faut charger le texte à étudier via l'onglet 'Cadre', et ensuite aller dans l’onglet « param » pour préciser au programme qu’on travaille en utf-8 et pour choisir la langue de travail.
Et voici un échantillon qui montre le dictionnaire des mots formes existants dans le fichier chargé et qui montre aussi la liste des mots formes contenant le motif (Dans notre cas, le motif est [Aa]m.ricani[sz].* ?
Il existe des paramètres qui facilitent le processus d’extraction. A titre d’exemple, en découpant un texte, nous pouvons ajouter aux éléments textuels des caractères pour matérialiser une phrase.
Il y a une certaine préparation à faire pour nettoyer le texte avant de pouvoir travailler sur les contextes. Nous avons vu, surtout avec les contextes en anglais britannique, qu'un certain nombre de caractères avaient été mal encodés, ce qui avait pour résultat des mots comme âsidewalkâ. En utilisant un éditeur de texte, il faudrait remplacer ces caractères par le bon caractère correspondant (dans ce cas â par le guillemet ') afin d'harmoniser l'encodage. Il est ainsi conseillé d'harmoniser la ponctuation - remplacer les guillemets et cotes non conformes par un standard pour le texte. Il serait éventuellement possible d'enlever quelques variations, comme des majuscules, qui pourraient introduire des distinctions non pertinentes pour l'analyse des formes.
Le fichier global des contextes est le résultat d'une concaténation de lignes contenant les contextes du mot, extraites de plusieurs sites. Chaque ligne correspond à une ligne qui contient le motif. Mais il n'y a pas forécement de la continuation entre les lignes. Il serait erroné de considérer que le texte devrait s'analyser de façon intégrale, sans délimiteurs explicites entre chaque ligne. Ajouter un délimiteur sert à bloquer l'analyse travers les contextes, et à empêcher de trouver des co-occurrents non pertinents.
Ici, par exemple, nous avons mis le signe “$” à la fin de chaque phrase pour bloquer les contextes (en faisant attention d'éliminer tous les '$' du texte avant de l'utiliser en tant que délimiteur).
Co-occurrents :
Le trameur nous permet aussi d’extraire les co-occurrents : les mots qui viennent souvent autour du mot choisi. Pourtant, il faut définir les contextes (fenêtres) dans lesquels le trameur va chercher les co-occurrents. Les contextes sont des phrases venant de l’extraction des lignes qui contiennent le pole, mais comme nous avons vu, ces contextes sont une concaténation de phrases.
Donc, après avoir modifié le fichier de départ en insérant le délimiteur de lignes, il faut recharger le fichier de nouveau en ajoutant dans l'onglet "Param" le caractère choisi comme délimiteur.
Ensuite, il faut aller dans l’onglet « cooc », taper le mot pole et préciser un nombre pour la co-freq (retenir un mot qui existe n fois avec le pole) et le seuil (indice de spécificité qui indique le poids du pole dans le texte) et enfin cliquer sur « calcul co-occurrents forme pole ».
Le résultat pour notre échantillon est comme suit :
La couleur et l’épaisseur de la flèche reflète le degré d’attraction
Retour aux contextes:
Le trameur permet également des retours aux contextes. Il suffit de taper le mot « pole » ou de taper une expression régulière et d’aller dans l’onglet « section ». Par cette étape, nous demandons au trameur de traduire une représentation graphique du texte. Chaque petit carré représente une section du texte et les sections avec une croix représentent les mots sélectionnés.
Il existe une possibilité de coprésence de deux mots sélectionnés simplement en cochant la case « co-présence »
Association de catégories :
Nous pouvons demander au trameur d’associer à chaque forme sa catégorie et son lemme grâce à « treetagger ». Il faut ainsi cocher la case « étiquetage ». Pour voir la représentation, il faut aller dans l’onglet « concordance ».
Il existe la possibilité de modifier l’annotation si elle n’est pas correcte, soit en cliquant droit sur le mot soit en cliquant sur « modification des annotations de la forme selectionée » dans l'onglet « forme-lemme ».
Extraction de patron :
Nous pouvons également demander au trameur d’extraire un patron pour avoir la séquence qui lui correspond dans le texte. Cela se fait à l’aide de l’onglet « patron » ou nous tapons le motif dans la case « patron 2 graphe » pour afficher le graphe après avoir indiquer le patron voulu.
Dans l’exemple qui suit c’est le cas des noms suivis d’une préposition.