<?xml version="1.0" encoding="UTF-8" ?>
<rss version="2.0" xmlns:dc="http://purl.org/dc/elements/1.1/">
    <channel>
        <link xmlns="http://www.w3.org/2005/Atom" rel="hub" href="https://overblog.superfeedr.com"/>
        <link xmlns="http://www.w3.org/2005/Atom" rel="self" href="https://projet-lvmmw.overblog.com/rss" type="application/rss+xml"/>
        <title><![CDATA[L'Américanisation]]></title>
        <link>https://projet-lvmmw.overblog.com/</link>
        <generator>Overblog - https://www.over-blog.com</generator>
        <description><![CDATA[Master 1 Plurital 2012]]></description>
                    <item>
    <title><![CDATA[Python : extraction des contextes]]></title>
    <link><![CDATA[https://projet-lvmmw.overblog.com/python-extraction-des-contextes]]></link>
    <guid>https://projet-lvmmw.overblog.com/python-extraction-des-contextes</guid>
    <pubDate>Tue, 01 Jan 2013 18:16:28 +0100</pubDate>
    <description><![CDATA[La dernière étape de la création du tableau est l'extraction des contextes de notre mot choisi par une expression régulière, à partir du texte brut qu'on vient d'extraire. Nous avons déjà vu les expressions régulières dans l'extraction du charset (avec... ]]></description>
        <dc:creator><![CDATA[Rachel Bawden, Dalia Megahed et Helena B. G.]]></dc:creator>
    </item>
                    <item>
    <title><![CDATA[Python : extraction du contenu textuel et encodage (2ème essai)]]></title>
    <link><![CDATA[https://projet-lvmmw.overblog.com/python-extraction-du-contenu-textuel-et-encodage-2eme-essai]]></link>
    <guid>https://projet-lvmmw.overblog.com/python-extraction-du-contenu-textuel-et-encodage-2eme-essai</guid>
    <pubDate>Tue, 01 Jan 2013 18:05:04 +0100</pubDate>
    <description><![CDATA[Suite aux problèmes rencontrés avec la détection de l'encodage avec chardet, nous avons cherché une autre solution. Nous avons entendu parler de la bibliothèque 'BeautifulSoup', qui pourrait peut-être mieux détecter l'encodage. C'est une bibliothèque... ]]></description>
        <dc:creator><![CDATA[Rachel Bawden, Dalia Megahed et Helena B. G.]]></dc:creator>
    </item>
                    <item>
    <title><![CDATA[Python : vérification de l'encodage et extraction du contenu textuel]]></title>
    <link><![CDATA[https://projet-lvmmw.overblog.com/python-verification-de-l-encodage-et-extraction-du-contenu-textuel]]></link>
    <guid>https://projet-lvmmw.overblog.com/python-verification-de-l-encodage-et-extraction-du-contenu-textuel</guid>
    <pubDate>Mon, 31 Dec 2012 19:11:27 +0100</pubDate>
    <description><![CDATA[Les pages ont été aspirées. Celles qui n'ont pas été aspirées ont renvoyé un code erreur, qui a été récupéré, afin d'étudier l'erreur et/ou de procéder avec le traitement uniquement des pages qui ont été correctement aspirées. La prochaine étape est de... ]]></description>
        <dc:creator><![CDATA[Rachel Bawden, Dalia Megahed et Helena B. G.]]></dc:creator>
    </item>
                    <item>
    <title><![CDATA[Le Trameur:]]></title>
    <link><![CDATA[https://projet-lvmmw.overblog.com/le-trameur]]></link>
    <guid>https://projet-lvmmw.overblog.com/le-trameur</guid>
    <pubDate>Wed, 19 Dec 2012 19:11:22 +0100</pubDate>
    <description><![CDATA[Le trameur est un logiciel de textométrie qui fonctionne sur windows. Il sert à compter les unités d’un texte en tenant en compte les éventuelles parties du texte, afin d’évaluer par exemple l’évolution du vocabulaire dans une chronologie ou de comparer... ]]></description>
        <dc:creator><![CDATA[Rachel Bawden, Dalia Megahed et Helena B. G.]]></dc:creator>
    </item>
                    <item>
    <title><![CDATA[Les nuages :]]></title>
    <link><![CDATA[https://projet-lvmmw.overblog.com/les-nuages]]></link>
    <guid>https://projet-lvmmw.overblog.com/les-nuages</guid>
    <pubDate>Mon, 17 Dec 2012 18:36:31 +0100</pubDate>
    <description><![CDATA[La première étape dans la phase 2 du projet consiste à faire des nuages de mots en utilisant des logiciels en ligne comme Wordle, Tagclouder ou Word it out. Ces logiciels travaillent sur la fréquence des mots dans le corpus et certains reposent sur un... ]]></description>
        <dc:creator><![CDATA[Rachel Bawden, Dalia Megahed et Helena B. G.]]></dc:creator>
    </item>
                    <item>
    <title><![CDATA[Python : Vérification de l'aspiration]]></title>
    <link><![CDATA[https://projet-lvmmw.overblog.com/python-verification-de-l-aspiration]]></link>
    <guid>https://projet-lvmmw.overblog.com/python-verification-de-l-aspiration</guid>
    <pubDate>Wed, 12 Dec 2012 08:45:38 +0100</pubDate>
    <description><![CDATA[Jusqu'à maintenant nous sommes arrivées à aspirer les pages web contenu dans plusieurs fichiers et stocker les liens vers les pages aspirées dans le tableau. Le processus est le même qu'avec Bash. ll faudrait : vérifier que l'aspiration du site n'a pas... ]]></description>
        <dc:creator><![CDATA[Rachel Bawden, Dalia Megahed et Helena B. G.]]></dc:creator>
    </item>
                    <item>
    <title><![CDATA[Séance du 05/12/2012:]]></title>
    <link><![CDATA[https://projet-lvmmw.overblog.com/seance-du-05-12-2012]]></link>
    <guid>https://projet-lvmmw.overblog.com/seance-du-05-12-2012</guid>
    <pubDate>Sun, 09 Dec 2012 01:09:23 +0100</pubDate>
    <description><![CDATA[La dernière étape dans la rédaction du script consiste à ajouter quelques lignes de code pour la création des fichiers globaux nécessaires pour la deuxième phase du projet. Pour chaque langue, il faut créer un fichier global "dump" pour le trameur et... ]]></description>
        <dc:creator><![CDATA[Rachel Bawden, Dalia Megahed et Helena B. G.]]></dc:creator>
    </item>
                    <item>
    <title><![CDATA[Séance du 28/11/2012 :]]></title>
    <link><![CDATA[https://projet-lvmmw.overblog.com/seance-du-28-11-2012]]></link>
    <guid>https://projet-lvmmw.overblog.com/seance-du-28-11-2012</guid>
    <pubDate>Wed, 05 Dec 2012 14:07:05 +0100</pubDate>
    <description><![CDATA[L'intégration dans le script: Nous avons 3 étapes à ajouter cette semaine : la détection d'encodage niveau 2 l'extraction des contextes et le nombre d'occurrences du motif choisi (fichier texte) l'extraction des contextes par le programme minigrep (fichier... ]]></description>
        <dc:creator><![CDATA[Rachel Bawden, Dalia Megahed et Helena B. G.]]></dc:creator>
    </item>
                    <item>
    <title><![CDATA[Egrep et les Expression régulières:]]></title>
    <link><![CDATA[https://projet-lvmmw.overblog.com/egrep-et-les-expression-regulieres]]></link>
    <guid>https://projet-lvmmw.overblog.com/egrep-et-les-expression-regulieres</guid>
    <pubDate>Wed, 05 Dec 2012 10:43:38 +0100</pubDate>
    <description><![CDATA[Durant cette séance, nous sommes revenues sur les problèmes d'encodage et nous avons vu le filtrage de motifs dans un fichier. Ceci va se faire à travers la commande "egrep" et avec le programme "minigrep" multilingue pour obtenir directement des contextes... ]]></description>
        <dc:creator><![CDATA[Rachel Bawden, Dalia Megahed et Helena B. G.]]></dc:creator>
    </item>
                    <item>
    <title><![CDATA[Séance du 21/11/2012 continuée (Une question d'encodage):]]></title>
    <link><![CDATA[https://projet-lvmmw.overblog.com/seance-du-21-11-2012-continuee-une-question-d-encodage]]></link>
    <guid>https://projet-lvmmw.overblog.com/seance-du-21-11-2012-continuee-une-question-d-encodage</guid>
    <pubDate>Tue, 27 Nov 2012 15:40:37 +0100</pubDate>
    <description><![CDATA[Nous allons travailler uniquement dans un environnement Unicode. Il est donc nécessaire que tous les textes soient encodés en Unicode. Nous avons vu pour l’instant que ce n’est pas le cas, et qu’il faudrait convertir les pages qui ne sont pas en UTF-8... ]]></description>
        <dc:creator><![CDATA[Rachel Bawden, Dalia Megahed et Helena B. G.]]></dc:creator>
    </item>
                    <item>
    <title><![CDATA[Séance du 21/11/2012 (Vérification de l'aspiration):]]></title>
    <link><![CDATA[https://projet-lvmmw.overblog.com/seance-du-21-11-2012-verification-de-l-aspiration]]></link>
    <guid>https://projet-lvmmw.overblog.com/seance-du-21-11-2012-verification-de-l-aspiration</guid>
    <pubDate>Tue, 27 Nov 2012 15:36:31 +0100</pubDate>
    <description><![CDATA[Comme nous avons vu pendant la dernière séance, nous visons d’extraire le contenu textuel des pages aspirées. Les étapes qui suivent nécessitent du travail sur les pages que nous avons aspirées en utilisant "wget" ou "curl". Donc, la première étape qu’il... ]]></description>
        <dc:creator><![CDATA[Rachel Bawden, Dalia Megahed et Helena B. G.]]></dc:creator>
    </item>
                    <item>
    <title><![CDATA[Aspiration en C:]]></title>
    <link><![CDATA[https://projet-lvmmw.overblog.com/aspiration-en-c]]></link>
    <guid>https://projet-lvmmw.overblog.com/aspiration-en-c</guid>
    <pubDate>Tue, 27 Nov 2012 15:28:50 +0100</pubDate>
    <description><![CDATA[Cette étape du projet est un peu en retard par rapport au script en bash et il est facile de comprendre pourquoi on m'a demandé pourquoi je voulais faire l'aspiration des sites en C au lieu de la faire en bash ou en python. La première grande étape était... ]]></description>
        <dc:creator><![CDATA[Rachel Bawden, Dalia Megahed et Helena B. G.]]></dc:creator>
    </item>
                    <item>
    <title><![CDATA[Séance du 14 de novembre:]]></title>
    <link><![CDATA[https://projet-lvmmw.overblog.com/seance-du-14-de-novembre]]></link>
    <guid>https://projet-lvmmw.overblog.com/seance-du-14-de-novembre</guid>
    <pubDate>Mon, 19 Nov 2012 18:15:42 +0100</pubDate>
    <description><![CDATA[1ère partie: Nous avons commencé le cours en apprenant une nouvelle commande d'unix : $locale Elle s'utilise pour savoir la configuration locale :
On voit bien là que mon ordinateur suit les usages de la langue française et utilise UTF-8 pour l'encodage.... ]]></description>
        <dc:creator><![CDATA[Rachel Bawden, Dalia Megahed et Helena B. G.]]></dc:creator>
    </item>
                    <item>
    <title><![CDATA[Aspiration des URLs en python]]></title>
    <link><![CDATA[https://projet-lvmmw.overblog.com/aspiration-des-urls-en-python]]></link>
    <guid>https://projet-lvmmw.overblog.com/aspiration-des-urls-en-python</guid>
    <pubDate>Thu, 15 Nov 2012 15:41:43 +0100</pubDate>
    <description><![CDATA[L'aspiration des pages en python a été assez simple et la plupart des pages ont été aspirées sans problème. Malgré tout, il reste quelques pages toujours problématiques. Il faut voir si nous pouvons résoudre ces problèmes et vérifier surtout que ces sites-là... ]]></description>
        <dc:creator><![CDATA[Rachel Bawden, Dalia Megahed et Helena B. G.]]></dc:creator>
    </item>
                    <item>
    <title><![CDATA[Aspiration des URLs...]]></title>
    <link><![CDATA[https://projet-lvmmw.overblog.com/aspiration-des-urls]]></link>
    <guid>https://projet-lvmmw.overblog.com/aspiration-des-urls</guid>
    <pubDate>Tue, 13 Nov 2012 18:08:01 +0100</pubDate>
    <description><![CDATA[Second script : Le second script consiste à créer un tableau de liens avec des liens externes vers les pages visées et de liens internes vers les pages correspondantes aspirées. Il s’agit ainsi de modifier le script 1 en ajoutant la commande « wget »... ]]></description>
        <dc:creator><![CDATA[Rachel Bawden, Dalia Megahed et Helena B. G.]]></dc:creator>
    </item>
                    <item>
    <title><![CDATA[Des scripts dans d'autres langages pour générer des tableaux html...]]></title>
    <link><![CDATA[https://projet-lvmmw.overblog.com/des-scripts-dans-d-autres-langages-pour-generer-des-tableaux-html]]></link>
    <guid>https://projet-lvmmw.overblog.com/des-scripts-dans-d-autres-langages-pour-generer-des-tableaux-html</guid>
    <pubDate>Mon, 05 Nov 2012 19:07:04 +0100</pubDate>
    <description><![CDATA[Un script en C pour générer le même fichier de tableau : (à voir s'il est possible de le simplifier) fichierin désigne le fichier où on se liront les informations à utiliser (les fichiers des urls). C’est l’input ! fichierout désigne le fichier où s’écriront... ]]></description>
        <dc:creator><![CDATA[Rachel Bawden, Dalia Megahed et Helena B. G.]]></dc:creator>
    </item>
                    <item>
    <title><![CDATA[Un Script bash pour générer des tableaux html...]]></title>
    <link><![CDATA[https://projet-lvmmw.overblog.com/un-script-bash-pour-generer-des-tableaux-html]]></link>
    <guid>https://projet-lvmmw.overblog.com/un-script-bash-pour-generer-des-tableaux-html</guid>
    <pubDate>Mon, 05 Nov 2012 19:06:33 +0100</pubDate>
    <description><![CDATA[Premier script: La création d’un tableau en HTML qui contient les urls des sites que nous avons trouvés. Il est possible de changer le formatage du tableau en ajoutant des attributs et des valeurs à l’intérieur des balises : Pour faire une "jolie"!! table... ]]></description>
        <dc:creator><![CDATA[Rachel Bawden, Dalia Megahed et Helena B.G.]]></dc:creator>
    </item>
                    <item>
    <title><![CDATA[Séance du 24/10/2012:]]></title>
    <link><![CDATA[https://projet-lvmmw.overblog.com/seance-du-24-10-2012]]></link>
    <guid>https://projet-lvmmw.overblog.com/seance-du-24-10-2012</guid>
    <pubDate>Mon, 05 Nov 2012 19:05:59 +0100</pubDate>
    <description><![CDATA[Solutions des exercices concernant les scripts Bash: 1)Création d'une page HTML ayant comme titre nos noms et contenant un tableau avec 2 lignes (sur la première, votre nom, sur la seconde, le mot choisi pour votre projet) et 2 colonnes.
2)Exercice 1:... ]]></description>
        <dc:creator><![CDATA[Rachel Bawden, Dalia Megahed et Helena B.G.]]></dc:creator>
    </item>
                    <item>
    <title><![CDATA[Arborescence de travail du projet]]></title>
    <link><![CDATA[https://projet-lvmmw.overblog.com/arborescence-de-travail-du-projet]]></link>
    <guid>https://projet-lvmmw.overblog.com/arborescence-de-travail-du-projet</guid>
    <pubDate>Mon, 05 Nov 2012 19:05:19 +0100</pubDate>
    <description><![CDATA[Afin d'avoir le même environnement de travail, nous devons toutes construire la même arborescence avec le script suivant : ]]></description>
        <dc:creator><![CDATA[Rachel Bawden, Dalia Megahed et Helena B.G.]]></dc:creator>
    </item>
                    <item>
    <title><![CDATA[A la recherche des URL...]]></title>
    <link><![CDATA[https://projet-lvmmw.overblog.com/a-la-recherche-des-url]]></link>
    <guid>https://projet-lvmmw.overblog.com/a-la-recherche-des-url</guid>
    <pubDate>Mon, 05 Nov 2012 19:04:39 +0100</pubDate>
    <description><![CDATA[Avant-propos: La première étape dans notre projet est la constitution d'un corpus multilingue. Ceci signifie la recherche des sites sur Internet correspondants à notre thématique choisie et le stockage de leurs URL dans un fichier .txt pour chaque langue... ]]></description>
        <dc:creator><![CDATA[Rachel Bawden, Dalia Megahed et Helena B. G.]]></dc:creator>
    </item>
                    <item>
    <title><![CDATA[Premier script Bash]]></title>
    <link><![CDATA[https://projet-lvmmw.overblog.com/premier-script-bash]]></link>
    <guid>https://projet-lvmmw.overblog.com/premier-script-bash</guid>
    <pubDate>Tue, 23 Oct 2012 21:36:27 +0200</pubDate>
    <description><![CDATA[Comment écrire mon premier script? Sur mon mac, j'ouvre l'éditeur de text aquamacs, qui me permet de créer des fichiers .txt. Sur cet éditeur, j'écris le script suivant, lequel j'ai nommé primerescript.txt:
La première ligne commence par les symboles... ]]></description>
        <dc:creator><![CDATA[Rachel Bawden, Dalia Megahed et Helena B.G.]]></dc:creator>
    </item>
                    <item>
    <title><![CDATA[Séance du 17/10/2012:]]></title>
    <link><![CDATA[https://projet-lvmmw.overblog.com/seance-du-17-10-2012]]></link>
    <guid>https://projet-lvmmw.overblog.com/seance-du-17-10-2012</guid>
    <pubDate>Tue, 23 Oct 2012 21:35:58 +0200</pubDate>
    <description><![CDATA[Voici les nouvelles commandes apprises pendant la séance du 17/10/12 : rm rm˽test.txt Remove – supprimer un fichier sans avertissement rm˽i rm˽i˽test.txt Remove (interactive) – supprimer un fichier avec une demande de confirmation avant la suppression... ]]></description>
        <dc:creator><![CDATA[Rachel Bawden, Dalia Megahed et Helena B. G.]]></dc:creator>
    </item>
                    <item>
    <title><![CDATA[UNIX: Les commandes]]></title>
    <link><![CDATA[https://projet-lvmmw.overblog.com/unix-les-commandes]]></link>
    <guid>https://projet-lvmmw.overblog.com/unix-les-commandes</guid>
    <pubDate>Sun, 14 Oct 2012 23:48:09 +0200</pubDate>
    <description><![CDATA[Pour interagir avec un terminal, il faut lui donner des commandes à réaliser. Sous Unix, la commande commence par son nom (ressource) unique et univoque. On peut y accéder par un chemin relatif ou un chemin absolu. Quelques commandes peuvent être créées... ]]></description>
        <dc:creator><![CDATA[Rachel Bawden, Dalia Megahed et Helena B.G.]]></dc:creator>
    </item>
                    <item>
    <title><![CDATA[UNIX : Introduction au système de stockage et aux chemins d'accès]]></title>
    <link><![CDATA[https://projet-lvmmw.overblog.com/unix-introduction-au-systeme-de-stockage-et-aux-chemins-d-acces]]></link>
    <guid>https://projet-lvmmw.overblog.com/unix-introduction-au-systeme-de-stockage-et-aux-chemins-d-acces</guid>
    <pubDate>Sun, 14 Oct 2012 23:47:21 +0200</pubDate>
    <description><![CDATA[Le système de stockage est organisé sous une forme d’arborescence - une hiérarchie de répertoires et de sous-répertoires structurés dans des branches depuis la racine. Pour pouvoir accéder à un fichier ou à un répertoire, il faut suivre un chemin d’accès.... ]]></description>
        <dc:creator><![CDATA[Rachel Bawden, Dalia Megahed et Helena B.G.]]></dc:creator>
    </item>
                    <item>
    <title><![CDATA[Séance du 10/10/2012:]]></title>
    <link><![CDATA[https://projet-lvmmw.overblog.com/seance-du-10-10-2012]]></link>
    <guid>https://projet-lvmmw.overblog.com/seance-du-10-10-2012</guid>
    <pubDate>Wed, 10 Oct 2012 23:47:58 +0200</pubDate>
    <description><![CDATA[Le choix d'une thématique pour le projet consiste, en effet, à définir un thème et choisir un couple de langues (ou plus) sur lequel nous travaillerons. Il faut repérer les URL des pages correspondant à notre thématique, tout en constituant un ficher... ]]></description>
        <dc:creator><![CDATA[Rachel Bawden, Dalia Megahed et Helena B.G.]]></dc:creator>
    </item>
            </channel>
</rss>

