<?xml version="1.0" encoding="UTF-8" ?>
<rss version="2.0" xmlns:dc="http://purl.org/dc/elements/1.1/">
    <channel>
        <link xmlns="http://www.w3.org/2005/Atom" rel="hub" href="https://overblog.superfeedr.com"/>
        <link xmlns="http://www.w3.org/2005/Atom" rel="self" href="https://parents-helicopteres.eklablog.com/rss" type="application/rss+xml"/>
        <title><![CDATA[]]></title>
        <link>https://parents-helicopteres.eklablog.com/</link>
        <generator>Overblog - https://www.over-blog.com</generator>
        <description><![CDATA[]]></description>
                    <item>
    <title><![CDATA[Corpus coréen et allemand, nuages de mots]]></title>
    <link><![CDATA[https://parents-helicopteres.eklablog.com/corpus-coreen-et-allemand-nuages-de-mots-a205122310]]></link>
    <guid>https://parents-helicopteres.eklablog.com/corpus-coreen-et-allemand-nuages-de-mots-a205122310</guid>
    <pubDate>Fri, 15 Jan 2021 16:29:56 +0100</pubDate>
    <description><![CDATA[Pour une analyse plus pertinente et sans confusion par les outils de textométrie et le site qui nous a permis de dessiner des "nuages de mots", nous avons modifié quelques formes lexicales, celles qui nous intéressent plus particulièrement pour le projet.... ]]></description>
        <dc:creator><![CDATA[kirstenb]]></dc:creator>
    </item>
                    <item>
    <title><![CDATA[Corpus chinois et français, nuages de mots]]></title>
    <link><![CDATA[https://parents-helicopteres.eklablog.com/corpus-chinois-et-francais-nuages-de-mots-a204947732]]></link>
    <guid>https://parents-helicopteres.eklablog.com/corpus-chinois-et-francais-nuages-de-mots-a204947732</guid>
    <pubDate>Tue, 29 Dec 2020 14:30:57 +0100</pubDate>
    <description><![CDATA[Avec les codes mises en oeuvres par Kristen, j'ai aussi crée les corpus pour le chinois et le français. Lors du nettoyage, j'ai cependant rencontré un problème: il restait des liens d'images sous la forme [ titredel'image . png ] , [ titredel'image .... ]]></description>
        <dc:creator><![CDATA[allcl]]></dc:creator>
    </item>
                    <item>
    <title><![CDATA[Création de corpus]]></title>
    <link><![CDATA[https://parents-helicopteres.eklablog.com/creation-de-corpus-a204590976]]></link>
    <guid>https://parents-helicopteres.eklablog.com/creation-de-corpus-a204590976</guid>
    <pubDate>Mon, 21 Dec 2020 16:07:02 +0100</pubDate>
    <description><![CDATA[Nous sommes parvenus à écrire deux scripts bash, l'un servant à nettoyer nos articles de chevrons inutiles (< et >), et l'autre créant un fichier corpus pour chaque langue, les articles annotés par <T = nom_fichier></T>. Nous avons donc créé deux dossiers... ]]></description>
        <dc:creator><![CDATA[kirstenb]]></dc:creator>
    </item>
                    <item>
    <title><![CDATA[Création de corpus - étape 1]]></title>
    <link><![CDATA[https://parents-helicopteres.eklablog.com/creation-de-corpus-etape-1-a204379786]]></link>
    <guid>https://parents-helicopteres.eklablog.com/creation-de-corpus-etape-1-a204379786</guid>
    <pubDate>Tue, 08 Dec 2020 14:55:26 +0100</pubDate>
    <description><![CDATA[Nous avons récupéré le contenu textuel de nos URLs, ainsi que le contexte où apparaît le motif que nous cherchons ("Helikopter-Eltern|헬리콥터 부모") et les bigrammes de chaque texte. La prochaine grande partie consiste en l'écriture de fichiers, un par langue,... ]]></description>
        <dc:creator><![CDATA[kirstenb]]></dc:creator>
    </item>
                    <item>
    <title><![CDATA[Suite du script Bash]]></title>
    <link><![CDATA[https://parents-helicopteres.eklablog.com/suite-du-script-bash-a204324278]]></link>
    <guid>https://parents-helicopteres.eklablog.com/suite-du-script-bash-a204324278</guid>
    <pubDate>Tue, 01 Dec 2020 23:15:49 +0100</pubDate>
    <description><![CDATA[L'écriture de la suite du script Bash sur le traitement de nos URLs consiste au repérage du motif, thème de notre projet. Premièrement, nous cherchons a récupérer deux lignes avant le motif, et deux lignes après, quelque soit la casse de l'occurrence.... ]]></description>
        <dc:creator><![CDATA[kirstenb]]></dc:creator>
    </item>
                    <item>
    <title><![CDATA[Finalisation du script Bash]]></title>
    <link><![CDATA[https://parents-helicopteres.eklablog.com/finalisation-du-script-bash-a204324108]]></link>
    <guid>https://parents-helicopteres.eklablog.com/finalisation-du-script-bash-a204324108</guid>
    <pubDate>Tue, 01 Dec 2020 22:36:41 +0100</pubDate>
    <description><![CDATA[A la séance de cours du 25 novembre, nous avons reprit le programme pour parvenir à la version finale. Nous nous étions arrêtés au traitement des URLs encodées en UTF-8. Cette fois-ci, nous avons ajouté le traitement de données qui ne sont pas en UTF-8.... ]]></description>
        <dc:creator><![CDATA[kirstenb]]></dc:creator>
    </item>
                    <item>
    <title><![CDATA[Tokenization du chinois]]></title>
    <link><![CDATA[https://parents-helicopteres.eklablog.com/tokenization-du-chinois-a204300500]]></link>
    <guid>https://parents-helicopteres.eklablog.com/tokenization-du-chinois-a204300500</guid>
    <pubDate>Sun, 29 Nov 2020 11:01:44 +0100</pubDate>
    <description><![CDATA[Pour tokeniser le chinois, j'ai regardé sur le blog des années passées les propositions des élèves. Il y avait deux solutions majeurs : l'utilisation de jieba ou de stanford segmenter. Sur un blog consulté, un étudiant à tester les deux propositions :... ]]></description>
        <dc:creator><![CDATA[allcl]]></dc:creator>
    </item>
                    <item>
    <title><![CDATA[Séance 6]]></title>
    <link><![CDATA[https://parents-helicopteres.eklablog.com/seance-6-a204258866]]></link>
    <guid>https://parents-helicopteres.eklablog.com/seance-6-a204258866</guid>
    <pubDate>Tue, 24 Nov 2020 17:23:01 +0100</pubDate>
    <description><![CDATA[Lors de cette séance, nous avons continuer à ajouter des traitements à la suite de ceux existant: On a extrait des contextes réduits au motif (1 ligne avant et 1 ligne après) # 1. construire des morceaux de corpus egrep -C 2 -i "$motif" ./DUMP-TEXT/utf8_"$compteur_tableau-$compteur".txt... ]]></description>
        <dc:creator><![CDATA[allcl]]></dc:creator>
    </item>
                    <item>
    <title><![CDATA[Créer un tableau HTML avec Bash (sites DE et KOR)]]></title>
    <link><![CDATA[https://parents-helicopteres.eklablog.com/creer-un-tableau-html-avec-bash-sites-de-et-kor-a204257762]]></link>
    <guid>https://parents-helicopteres.eklablog.com/creer-un-tableau-html-avec-bash-sites-de-et-kor-a204257762</guid>
    <pubDate>Tue, 24 Nov 2020 14:57:31 +0100</pubDate>
    <description><![CDATA[Une partie de notre projet consiste en la récupération des données sur lesquelles nous allons travailler plus tard. L’objectif de cette étape est d’obtenir un corpus de textes à partir de sites internet que nous avons choisis. Nous avons décidé de nous... ]]></description>
        <dc:creator><![CDATA[kirstenb]]></dc:creator>
    </item>
                    <item>
    <title><![CDATA[Séance 5]]></title>
    <link><![CDATA[https://parents-helicopteres.eklablog.com/seance-5-a204170584]]></link>
    <guid>https://parents-helicopteres.eklablog.com/seance-5-a204170584</guid>
    <pubDate>Fri, 13 Nov 2020 14:24:10 +0100</pubDate>
    <description><![CDATA[Durant ce cours, on a mis en place dans notre programme deux choses: 1. un traitement pour tester le bon déroulement de la récupération d'une URL par la commande curl 2. un traitement pour récupérer l'encodage d'une URL Pour cela, on a utilisé des options... ]]></description>
        <dc:creator><![CDATA[allcl]]></dc:creator>
    </item>
                    <item>
    <title><![CDATA[Séance 4]]></title>
    <link><![CDATA[https://parents-helicopteres.eklablog.com/seance-4-a204093490]]></link>
    <guid>https://parents-helicopteres.eklablog.com/seance-4-a204093490</guid>
    <pubDate>Tue, 03 Nov 2020 20:35:50 +0100</pubDate>
    <description><![CDATA[L'objectif de la séance: créer un programme qui avec une liste d'URLS, créer un tableau dans une page html. Ce tableau a trois colonnes: numéro de ligne de l'URL, lien de l'URL, ainsi qu'un lien interne vers la page html aspirée. Pour chaque fichier d'urls,... ]]></description>
        <dc:creator><![CDATA[allcl]]></dc:creator>
    </item>
                    <item>
    <title><![CDATA[Séance 3 - Exercice tableau html]]></title>
    <link><![CDATA[https://parents-helicopteres.eklablog.com/seance-3-exercice-tableau-html-a203689282]]></link>
    <guid>https://parents-helicopteres.eklablog.com/seance-3-exercice-tableau-html-a203689282</guid>
    <pubDate>Sun, 18 Oct 2020 11:31:41 +0200</pubDate>
    <description><![CDATA[Cet exercice consiste à compléter un script Bash que nous avons écrit en cours. Ce script écrit un code html comportant un tableau. A partir d'un fichier texte renseigné par l'utilisateur, le programme lit chaque ligne et les copie dans le tableau. Vous... ]]></description>
        <dc:creator><![CDATA[kirstenb]]></dc:creator>
    </item>
                    <item>
    <title><![CDATA[Séance 2 - Exercices sur le terminal Unix]]></title>
    <link><![CDATA[https://parents-helicopteres.eklablog.com/seance-2-exercices-sur-le-terminal-unix-a203687882]]></link>
    <guid>https://parents-helicopteres.eklablog.com/seance-2-exercices-sur-le-terminal-unix-a203687882</guid>
    <pubDate>Sun, 18 Oct 2020 10:58:21 +0200</pubDate>
    <description><![CDATA[Pour pouvoir mieux intégrer ce que avons appris lors du deuxième cours, nous avons résolut les exercices sur le terminal Unix, que nous pouvons trouver à la page du cours sur iCampus et également en suivant ce lien du site Plurital. Application 1 : Nous... ]]></description>
        <dc:creator><![CDATA[kirstenb]]></dc:creator>
    </item>
                    <item>
    <title><![CDATA[Présentation]]></title>
    <link><![CDATA[https://parents-helicopteres.eklablog.com/presentation-a203591284]]></link>
    <guid>https://parents-helicopteres.eklablog.com/presentation-a203591284</guid>
    <pubDate>Fri, 16 Oct 2020 18:14:14 +0200</pubDate>
    <description><![CDATA[Bonjour et bienvenue sur notre blog, créée pour le cours de M1 TAL "Projet Encadré" ! allcl est le pseudo d'Alexandra LI COMBEAU LONGUET, étudiante à l'INALCO. kristenb est le pseudo de Kristen BERLAND, étudiante à l'INALCO. Le thème de notre projet concerne... ]]></description>
        <dc:creator><![CDATA[allcl]]></dc:creator>
    </item>
                    <item>
    <title><![CDATA[Exercice de la séance 3]]></title>
    <link><![CDATA[https://parents-helicopteres.eklablog.com/exercice-de-la-seance-3-a203539458]]></link>
    <guid>https://parents-helicopteres.eklablog.com/exercice-de-la-seance-3-a203539458</guid>
    <pubDate>Thu, 15 Oct 2020 22:34:16 +0200</pubDate>
    <description><![CDATA[Exercice: à partir du script fait en cours, y ajouter une colonne supplémentaire au tableau final et y insérer le numéro de la ligne lue. Télécharger le script bash exercice2.sh Le résultat de ce script bash sur amants-utf8.txt: Télécharger « tableau-exo.html... ]]></description>
        <dc:creator><![CDATA[allcl]]></dc:creator>
    </item>
                    <item>
    <title><![CDATA[Exercice de la séance 2]]></title>
    <link><![CDATA[https://parents-helicopteres.eklablog.com/exercice-de-la-seance-2-a203539428]]></link>
    <guid>https://parents-helicopteres.eklablog.com/exercice-de-la-seance-2-a203539428</guid>
    <pubDate>Thu, 15 Oct 2020 22:33:40 +0200</pubDate>
    <description><![CDATA[Pour les manipulations suivantes, on se place dans le répertoire "Projet", dont le chemin absolu est /home/tim/Documents/Projet APPLICATION - Les entrées et les sorties - On crée deux répertoires "TEST1" et "TEST2" avec la commande mkdir et on vérifie... ]]></description>
        <dc:creator><![CDATA[allcl]]></dc:creator>
    </item>
            </channel>
</rss>

