{"id":{"repo_id":"moncton","oai_identifier":"oai:umoncton.scholaris.ca:20.500.14658/8148"},"canonical_url":"https://search.dev.ndltd.org/etd/moncton/oai:umoncton.scholaris.ca:20.500.14658/8148","repository":{"repo_id":"moncton","name":"University de Moncton","base_url":"https://umoncton.scholaris.ca/server/oai/request"},"display":{"title":"Identification d&apos;auteurs à l&apos;aide de n-grammes et de skip-grammes de tailles variables, constitués d&apos;étiquettes morphosyntaxiques","abstract":"&quot;L&apos;identification de l&apos;auteur d&apos;un texte anonyme par l&apos;analyse de ses écrits est un domaine qui a fait l&apos;objet de nombreuses recherches, depuis plusieurs siècles. En effet, les premières études datent du 19e siècle. À cette époque, les chercheurs utilisaient uniquement des techniques statistiques pour identifier les auteurs. Les études réalisées par Medenhall en 1887 en sont un très bon exemple, prouvant l&apos;efficacité des outils statistiques pour l&apos;identification d&apos;auteurs. Medenhall a mis en valeur la corrélation entre la distribution des mots et leur longueur dans les oeuvres d&apos;un même auteur. En appliquant ses méthodes sur les pièces de théâtre de shakespeariennes, il a découverty des liens entre les écrits de Shakespeare et de Marlowe. Cependant, l&apos;étude qui a le plus influencé l&apos;avenir de l&apos;identification d&apos;auteurs est sans doute celle de Mosteller et Wallace en 1964 sur le fédéraliste, un recueil de 146 articles politiques publiés anonymement sous le pseudonyme &quot;Publius&quot; entre 1787 et 1788. Mosteller et Wallace arrivèrent à identifier les auteurs du fédéraliste en utilisant les méthodes d&apos;identification d&apos;auteurs. Plusieurs autres travaux ont permis d&apos;isoler des indices caractérisant le style d&apos;écriture d&apos;auteurs afin d&apos;identifier l&apos;auteur d&apos;une oeuvre dont la paternité est mise en doute. Ces indices sont dits stylistiques car ils permettent de capturer le style des auteurs et sont généralement invariables dans les oeuvres d&apos;un auteur. En outre, les techniques d&apos;identification d&apos;auteurs ont de nombreuses applications telles que démasquer les individus qui profitent de l&apos;anonymat offert par Internet et les réseaux sociaux pour menacer ou commettre des crimes comme l&apos;intimidation. Dans plusieurs cas, les techniques d&apos;identification d&apos;auteurs ont permis de réduire les listes des potentiels suspects lors d&apos;enquêtes, et ont souvent été utilisées lors de procès pour inculper ou disculper des accusés. Entre temps, la stylométrie à vue le jour dans les années 1990. Il s&apos;agit d&apos;un nouveau domaine de recherche ayant pour mission de découvrir de nouveaux indices stylistiques. Plusieurs avancées ont été effectuées dans le domaine donnant naissance à un nombre élevé d&apos;indices de tout genre. En effet, il existe plus de 1000 différents indices stylométriques de plusieurs natures, soient lexicales, grammaticales ou sémantiques. Toutefois, il est crucial de trouver de nouveaux indices permettant d&apos;identifier les auteurs avec précision et pouvant être utilisés sur des textes de longueurs et de natures diverses. Dans le même contexte, des études ont démontré que la combinaison de plusieurs indices stylistiques améliore le taux de succès des techniques d&apos;identification d&apos;auteurs. Par conséquent, la découverte de nouveaux indices personnels qui peuvent capturer la signature stylistique d,un auteur est un domaine de recherche important avec de véritables défis. C&apos;est dans cette optique que nous proposons dans cette thèse deux nouveaux indices stylistiques de types syntaxiques utilisant les n-grammes ou skip-grammes (n-grammes avec sauts) constitués d&apos;étiquettes morphosyntaxiques. Notre choix s&apos;est porté sur les indices syntaxiques puisque leur usage est inconscient par les auteurs. Notre premier indice cherche les k motifs les plus fréquents constitués de n-grammes d&apos;étiquettes morphosyntaxiques à taille variable pour construire les signatures d&apos;auteurs. Une étude expérimentale avec un corpus, de 30 livres et 10 auteurs pour une total de 99, 903 phrases, extrait du Projet Gutenberg, démontre qu&apos;il est possible d&apos;identifier les auteurs avec un rappel de plus de 73% en utilisant un petit nombre de motifs (par exemple, k = 50). Le second indice exploite la possibilité qu&apos;offrent les skip-grammes de permettre des sauts entre des étiquettes morphosyntaxiques adjacentes. Cela permet de détecter les habitudes qu&apos;ont certains auteurs à utiliser des structures de phrases plus complexes. Une étude expérimentale utilisant le même corpus montre que les auteurs peuvent être identifiés avec un rappel de plus de 70% en utilisant un petit nombre de motifs (e.g. k = 250) et un seul saut (par exemple, saut = 1) entre les étiquettes morphosyntaxiques. En terminant, nous exploitons nos deux indices sur un corpus de billets de blogues écrits par 10 auteurs afin de mesurer les performances de nos indices et notre approche sur un corpus de thématique et de taille différente. Les résultats obtenus montrent que les auteurs peuvent être identifés avec une très bonne exactitude. Mots clés : identification d&apos;auteurs, stylométrie, étiquettes morphosyntaxiques, n-grammes, skip-grammes, motifs séquentiels à taille variable.&quot;--Résumé.","abstract_html":"&amp;quot;L&amp;apos;identification de l&amp;apos;auteur d&amp;apos;un texte anonyme par l&amp;apos;analyse de ses écrits est un domaine qui a fait l&amp;apos;objet de nombreuses recherches, depuis plusieurs siècles. En effet, les premières études datent du 19e siècle. À cette époque, les chercheurs utilisaient uniquement des techniques statistiques pour identifier les auteurs. Les études réalisées par Medenhall en 1887 en sont un très bon exemple, prouvant l&amp;apos;efficacité des outils statistiques pour l&amp;apos;identification d&amp;apos;auteurs. Medenhall a mis en valeur la corrélation entre la distribution des mots et leur longueur dans les oeuvres d&amp;apos;un même auteur. En appliquant ses méthodes sur les pièces de théâtre de shakespeariennes, il a découverty des liens entre les écrits de Shakespeare et de Marlowe. Cependant, l&amp;apos;étude qui a le plus influencé l&amp;apos;avenir de l&amp;apos;identification d&amp;apos;auteurs est sans doute celle de Mosteller et Wallace en 1964 sur le fédéraliste, un recueil de 146 articles politiques publiés anonymement sous le pseudonyme &amp;quot;Publius&amp;quot; entre 1787 et 1788. Mosteller et Wallace arrivèrent à identifier les auteurs du fédéraliste en utilisant les méthodes d&amp;apos;identification d&amp;apos;auteurs. Plusieurs autres travaux ont permis d&amp;apos;isoler des indices caractérisant le style d&amp;apos;écriture d&amp;apos;auteurs afin d&amp;apos;identifier l&amp;apos;auteur d&amp;apos;une oeuvre dont la paternité est mise en doute. Ces indices sont dits stylistiques car ils permettent de capturer le style des auteurs et sont généralement invariables dans les oeuvres d&amp;apos;un auteur. En outre, les techniques d&amp;apos;identification d&amp;apos;auteurs ont de nombreuses applications telles que démasquer les individus qui profitent de l&amp;apos;anonymat offert par Internet et les réseaux sociaux pour menacer ou commettre des crimes comme l&amp;apos;intimidation. Dans plusieurs cas, les techniques d&amp;apos;identification d&amp;apos;auteurs ont permis de réduire les listes des potentiels suspects lors d&amp;apos;enquêtes, et ont souvent été utilisées lors de procès pour inculper ou disculper des accusés. Entre temps, la stylométrie à vue le jour dans les années 1990. Il s&amp;apos;agit d&amp;apos;un nouveau domaine de recherche ayant pour mission de découvrir de nouveaux indices stylistiques. Plusieurs avancées ont été effectuées dans le domaine donnant naissance à un nombre élevé d&amp;apos;indices de tout genre. En effet, il existe plus de 1000 différents indices stylométriques de plusieurs natures, soient lexicales, grammaticales ou sémantiques. Toutefois, il est crucial de trouver de nouveaux indices permettant d&amp;apos;identifier les auteurs avec précision et pouvant être utilisés sur des textes de longueurs et de natures diverses. Dans le même contexte, des études ont démontré que la combinaison de plusieurs indices stylistiques améliore le taux de succès des techniques d&amp;apos;identification d&amp;apos;auteurs. Par conséquent, la découverte de nouveaux indices personnels qui peuvent capturer la signature stylistique d,un auteur est un domaine de recherche important avec de véritables défis. C&amp;apos;est dans cette optique que nous proposons dans cette thèse deux nouveaux indices stylistiques de types syntaxiques utilisant les n-grammes ou skip-grammes (n-grammes avec sauts) constitués d&amp;apos;étiquettes morphosyntaxiques. Notre choix s&amp;apos;est porté sur les indices syntaxiques puisque leur usage est inconscient par les auteurs. Notre premier indice cherche les k motifs les plus fréquents constitués de n-grammes d&amp;apos;étiquettes morphosyntaxiques à taille variable pour construire les signatures d&amp;apos;auteurs. Une étude expérimentale avec un corpus, de 30 livres et 10 auteurs pour une total de 99, 903 phrases, extrait du Projet Gutenberg, démontre qu&amp;apos;il est possible d&amp;apos;identifier les auteurs avec un rappel de plus de 73% en utilisant un petit nombre de motifs (par exemple, k = 50). Le second indice exploite la possibilité qu&amp;apos;offrent les skip-grammes de permettre des sauts entre des étiquettes morphosyntaxiques adjacentes. Cela permet de détecter les habitudes qu&amp;apos;ont certains auteurs à utiliser des structures de phrases plus complexes. Une étude expérimentale utilisant le même corpus montre que les auteurs peuvent être identifiés avec un rappel de plus de 70% en utilisant un petit nombre de motifs (e.g. k = 250) et un seul saut (par exemple, saut = 1) entre les étiquettes morphosyntaxiques. En terminant, nous exploitons nos deux indices sur un corpus de billets de blogues écrits par 10 auteurs afin de mesurer les performances de nos indices et notre approche sur un corpus de thématique et de taille différente. Les résultats obtenus montrent que les auteurs peuvent être identifés avec une très bonne exactitude. Mots clés : identification d&amp;apos;auteurs, stylométrie, étiquettes morphosyntaxiques, n-grammes, skip-grammes, motifs séquentiels à taille variable.&amp;quot;--Résumé.","abstract_has_math":false,"creators":["Pokou, Yao Jean Marc"],"institution":"Université de Moncton,","degree_name":"Maîtrise ès sciences (informatique)","degree_level":"2e cycle","degree_discipline":"Faculté des sciences","degree_department":null,"school":null,"contributors":[],"advisors":["Moghrabi, Chadia","Fournier-Viger, Philippe"],"committee_chairs":[],"committee_members":[],"year":2016,"date_issued":"2016","date_published":"2016","updated_at":"2026-07-24T03:09:42Z","subjects":["Linguistique informatique","Méthodes statistiques","Analyse automatique (Linguistique)","N-grammes","Art d&apos;écrire","Exploration de données (Informatique)","Reconnaissance des formes (Informatique)","Motifs (Mathématiques)","Traitement de texte","Intelligence artificielle"],"languages":["iso639-2b","fre"],"rights":["Author"],"rights_urls":[],"identifier_entries":[{"key":"dc:identifier","label":"Identifier","values":["oclc: 984676290"],"render_values":[{"text":"oclc: 984676290","href":null,"code":true}]},{"key":"dc:identifier.other","label":"Dc Identifier Other","values":["umir:1833"],"render_values":[{"text":"umir:1833","href":null,"code":true}]}]},"links":{"outbound_url":"https://hdl.handle.net/20.500.14658/8148","outbound_label":"Handle","outbound_source":"dc:identifier.uri"},"metadata_groups":[{"id":"people","label":"People","entries":[{"key":"dc:contributor.advisor","label":"Advisor","values":["Moghrabi, Chadia","Fournier-Viger, Philippe"]},{"key":"dc:creator","label":"Author","values":["Pokou, Yao Jean Marc"]}]},{"id":"academic_context","label":"Academic Context","entries":[{"key":"dc:date.accessioned","label":"Dc Date Accessioned","values":["2024-12-20T18:14:25Z","2025-05-13T19:55:01Z"]},{"key":"dc:date.available","label":"Dc Date Available","values":["2024-12-20T18:14:25Z","2025-05-13T19:55:01Z"]},{"key":"dc:date.issued","label":"Date","values":["2016"]},{"key":"dc:publisher","label":"Institution","values":["Université de Moncton,"]},{"key":"dc:type","label":"Dc Type","values":["Text","thèse"]},{"key":"thesis:degree_discipline","label":"Discipline","values":["Faculté des sciences"]},{"key":"thesis:degree_level","label":"Degree Level","values":["2e cycle"]},{"key":"thesis:degree_name","label":"Degree Name","values":["Maîtrise ès sciences (informatique)"]},{"key":"thesis:institution_name","label":"Thesis Institution Name","values":["Université de Moncton"]}]},{"id":"subjects_keywords","label":"Subjects and Keywords","entries":[{"key":"dc:subject","label":"Dc Subject","values":["Linguistique informatique","Méthodes statistiques","Analyse automatique (Linguistique)","N-grammes","Art d&apos;écrire","Exploration de données (Informatique)","Reconnaissance des formes (Informatique)","Motifs (Mathématiques)","Traitement de texte","Intelligence artificielle"]}]},{"id":"language_rights","label":"Language and Rights","entries":[{"key":"dc:language","label":"Dc Language","values":["fre"]},{"key":"dc:language.iso","label":"Language (ISO)","values":["iso639-2b"]},{"key":"dc:rights","label":"Dc Rights","values":["Author"]}]},{"id":"identifiers","label":"Identifiers","entries":[{"key":"dc:identifier","label":"Identifier","values":["oclc: 984676290"]},{"key":"dc:identifier.other","label":"Dc Identifier Other","values":["umir:1833"]},{"key":"dc:identifier.uri","label":"Identifier URI","values":["https://hdl.handle.net/20.500.14658/8148"]}]},{"id":"additional","label":"Additional Metadata","entries":[{"key":"dc:description.abstract","label":"Abstract","values":["&quot;L&apos;identification de l&apos;auteur d&apos;un texte anonyme par l&apos;analyse de ses écrits est un domaine qui a fait l&apos;objet de nombreuses recherches, depuis plusieurs siècles. En effet, les premières études datent du 19e siècle. À cette époque, les chercheurs utilisaient uniquement des techniques statistiques pour identifier les auteurs. Les études réalisées par Medenhall en 1887 en sont un très bon exemple, prouvant l&apos;efficacité des outils statistiques pour l&apos;identification d&apos;auteurs. Medenhall a mis en valeur la corrélation entre la distribution des mots et leur longueur dans les oeuvres d&apos;un même auteur. En appliquant ses méthodes sur les pièces de théâtre de shakespeariennes, il a découverty des liens entre les écrits de Shakespeare et de Marlowe. Cependant, l&apos;étude qui a le plus influencé l&apos;avenir de l&apos;identification d&apos;auteurs est sans doute celle de Mosteller et Wallace en 1964 sur le fédéraliste, un recueil de 146 articles politiques publiés anonymement sous le pseudonyme &quot;Publius&quot; entre 1787 et 1788. Mosteller et Wallace arrivèrent à identifier les auteurs du fédéraliste en utilisant les méthodes d&apos;identification d&apos;auteurs. Plusieurs autres travaux ont permis d&apos;isoler des indices caractérisant le style d&apos;écriture d&apos;auteurs afin d&apos;identifier l&apos;auteur d&apos;une oeuvre dont la paternité est mise en doute. Ces indices sont dits stylistiques car ils permettent de capturer le style des auteurs et sont généralement invariables dans les oeuvres d&apos;un auteur. En outre, les techniques d&apos;identification d&apos;auteurs ont de nombreuses applications telles que démasquer les individus qui profitent de l&apos;anonymat offert par Internet et les réseaux sociaux pour menacer ou commettre des crimes comme l&apos;intimidation. Dans plusieurs cas, les techniques d&apos;identification d&apos;auteurs ont permis de réduire les listes des potentiels suspects lors d&apos;enquêtes, et ont souvent été utilisées lors de procès pour inculper ou disculper des accusés. Entre temps, la stylométrie à vue le jour dans les années 1990. Il s&apos;agit d&apos;un nouveau domaine de recherche ayant pour mission de découvrir de nouveaux indices stylistiques. Plusieurs avancées ont été effectuées dans le domaine donnant naissance à un nombre élevé d&apos;indices de tout genre. En effet, il existe plus de 1000 différents indices stylométriques de plusieurs natures, soient lexicales, grammaticales ou sémantiques. Toutefois, il est crucial de trouver de nouveaux indices permettant d&apos;identifier les auteurs avec précision et pouvant être utilisés sur des textes de longueurs et de natures diverses. Dans le même contexte, des études ont démontré que la combinaison de plusieurs indices stylistiques améliore le taux de succès des techniques d&apos;identification d&apos;auteurs. Par conséquent, la découverte de nouveaux indices personnels qui peuvent capturer la signature stylistique d,un auteur est un domaine de recherche important avec de véritables défis. C&apos;est dans cette optique que nous proposons dans cette thèse deux nouveaux indices stylistiques de types syntaxiques utilisant les n-grammes ou skip-grammes (n-grammes avec sauts) constitués d&apos;étiquettes morphosyntaxiques. Notre choix s&apos;est porté sur les indices syntaxiques puisque leur usage est inconscient par les auteurs. Notre premier indice cherche les k motifs les plus fréquents constitués de n-grammes d&apos;étiquettes morphosyntaxiques à taille variable pour construire les signatures d&apos;auteurs. Une étude expérimentale avec un corpus, de 30 livres et 10 auteurs pour une total de 99, 903 phrases, extrait du Projet Gutenberg, démontre qu&apos;il est possible d&apos;identifier les auteurs avec un rappel de plus de 73% en utilisant un petit nombre de motifs (par exemple, k = 50). Le second indice exploite la possibilité qu&apos;offrent les skip-grammes de permettre des sauts entre des étiquettes morphosyntaxiques adjacentes. Cela permet de détecter les habitudes qu&apos;ont certains auteurs à utiliser des structures de phrases plus complexes. Une étude expérimentale utilisant le même corpus montre que les auteurs peuvent être identifiés avec un rappel de plus de 70% en utilisant un petit nombre de motifs (e.g. k = 250) et un seul saut (par exemple, saut = 1) entre les étiquettes morphosyntaxiques. En terminant, nous exploitons nos deux indices sur un corpus de billets de blogues écrits par 10 auteurs afin de mesurer les performances de nos indices et notre approche sur un corpus de thématique et de taille différente. Les résultats obtenus montrent que les auteurs peuvent être identifés avec une très bonne exactitude. Mots clés : identification d&apos;auteurs, stylométrie, étiquettes morphosyntaxiques, n-grammes, skip-grammes, motifs séquentiels à taille variable.&quot;--Résumé."]},{"key":"dc:format","label":"Dc Format","values":["application/pdf"]},{"key":"dc:format.medium","label":"Dc Format Medium","values":["electronic","sans médiatio","volume"]},{"key":"dc:title","label":"Title","values":["Identification d&apos;auteurs à l&apos;aide de n-grammes et de skip-grammes de tailles variables, constitués d&apos;étiquettes morphosyntaxiques"]}]}],"canonical_facts":{"dc:contributor.advisor":["Moghrabi, Chadia","Fournier-Viger, Philippe"],"dc:creator":["Pokou, Yao Jean Marc"],"dc:date.accessioned":["2024-12-20T18:14:25Z","2025-05-13T19:55:01Z"],"dc:date.available":["2024-12-20T18:14:25Z","2025-05-13T19:55:01Z"],"dc:date.issued":["2016"],"dc:description.abstract":["&quot;L&apos;identification de l&apos;auteur d&apos;un texte anonyme par l&apos;analyse de ses écrits est un domaine qui a fait l&apos;objet de nombreuses recherches, depuis plusieurs siècles. En effet, les premières études datent du 19e siècle. À cette époque, les chercheurs utilisaient uniquement des techniques statistiques pour identifier les auteurs. Les études réalisées par Medenhall en 1887 en sont un très bon exemple, prouvant l&apos;efficacité des outils statistiques pour l&apos;identification d&apos;auteurs. Medenhall a mis en valeur la corrélation entre la distribution des mots et leur longueur dans les oeuvres d&apos;un même auteur. En appliquant ses méthodes sur les pièces de théâtre de shakespeariennes, il a découverty des liens entre les écrits de Shakespeare et de Marlowe. Cependant, l&apos;étude qui a le plus influencé l&apos;avenir de l&apos;identification d&apos;auteurs est sans doute celle de Mosteller et Wallace en 1964 sur le fédéraliste, un recueil de 146 articles politiques publiés anonymement sous le pseudonyme &quot;Publius&quot; entre 1787 et 1788. Mosteller et Wallace arrivèrent à identifier les auteurs du fédéraliste en utilisant les méthodes d&apos;identification d&apos;auteurs. Plusieurs autres travaux ont permis d&apos;isoler des indices caractérisant le style d&apos;écriture d&apos;auteurs afin d&apos;identifier l&apos;auteur d&apos;une oeuvre dont la paternité est mise en doute. Ces indices sont dits stylistiques car ils permettent de capturer le style des auteurs et sont généralement invariables dans les oeuvres d&apos;un auteur. En outre, les techniques d&apos;identification d&apos;auteurs ont de nombreuses applications telles que démasquer les individus qui profitent de l&apos;anonymat offert par Internet et les réseaux sociaux pour menacer ou commettre des crimes comme l&apos;intimidation. Dans plusieurs cas, les techniques d&apos;identification d&apos;auteurs ont permis de réduire les listes des potentiels suspects lors d&apos;enquêtes, et ont souvent été utilisées lors de procès pour inculper ou disculper des accusés. Entre temps, la stylométrie à vue le jour dans les années 1990. Il s&apos;agit d&apos;un nouveau domaine de recherche ayant pour mission de découvrir de nouveaux indices stylistiques. Plusieurs avancées ont été effectuées dans le domaine donnant naissance à un nombre élevé d&apos;indices de tout genre. En effet, il existe plus de 1000 différents indices stylométriques de plusieurs natures, soient lexicales, grammaticales ou sémantiques. Toutefois, il est crucial de trouver de nouveaux indices permettant d&apos;identifier les auteurs avec précision et pouvant être utilisés sur des textes de longueurs et de natures diverses. Dans le même contexte, des études ont démontré que la combinaison de plusieurs indices stylistiques améliore le taux de succès des techniques d&apos;identification d&apos;auteurs. Par conséquent, la découverte de nouveaux indices personnels qui peuvent capturer la signature stylistique d,un auteur est un domaine de recherche important avec de véritables défis. C&apos;est dans cette optique que nous proposons dans cette thèse deux nouveaux indices stylistiques de types syntaxiques utilisant les n-grammes ou skip-grammes (n-grammes avec sauts) constitués d&apos;étiquettes morphosyntaxiques. Notre choix s&apos;est porté sur les indices syntaxiques puisque leur usage est inconscient par les auteurs. Notre premier indice cherche les k motifs les plus fréquents constitués de n-grammes d&apos;étiquettes morphosyntaxiques à taille variable pour construire les signatures d&apos;auteurs. Une étude expérimentale avec un corpus, de 30 livres et 10 auteurs pour une total de 99, 903 phrases, extrait du Projet Gutenberg, démontre qu&apos;il est possible d&apos;identifier les auteurs avec un rappel de plus de 73% en utilisant un petit nombre de motifs (par exemple, k = 50). Le second indice exploite la possibilité qu&apos;offrent les skip-grammes de permettre des sauts entre des étiquettes morphosyntaxiques adjacentes. Cela permet de détecter les habitudes qu&apos;ont certains auteurs à utiliser des structures de phrases plus complexes. Une étude expérimentale utilisant le même corpus montre que les auteurs peuvent être identifiés avec un rappel de plus de 70% en utilisant un petit nombre de motifs (e.g. k = 250) et un seul saut (par exemple, saut = 1) entre les étiquettes morphosyntaxiques. En terminant, nous exploitons nos deux indices sur un corpus de billets de blogues écrits par 10 auteurs afin de mesurer les performances de nos indices et notre approche sur un corpus de thématique et de taille différente. Les résultats obtenus montrent que les auteurs peuvent être identifés avec une très bonne exactitude. Mots clés : identification d&apos;auteurs, stylométrie, étiquettes morphosyntaxiques, n-grammes, skip-grammes, motifs séquentiels à taille variable.&quot;--Résumé."],"dc:format":["application/pdf"],"dc:format.medium":["electronic","sans médiatio","volume"],"dc:identifier":["oclc: 984676290"],"dc:identifier.other":["umir:1833"],"dc:identifier.uri":["https://hdl.handle.net/20.500.14658/8148"],"dc:language":["fre"],"dc:language.iso":["iso639-2b"],"dc:publisher":["Université de Moncton,"],"dc:rights":["Author"],"dc:subject":["Linguistique informatique","Méthodes statistiques","Analyse automatique (Linguistique)","N-grammes","Art d&apos;écrire","Exploration de données (Informatique)","Reconnaissance des formes (Informatique)","Motifs (Mathématiques)","Traitement de texte","Intelligence artificielle"],"dc:title":["Identification d&apos;auteurs à l&apos;aide de n-grammes et de skip-grammes de tailles variables, constitués d&apos;étiquettes morphosyntaxiques"],"dc:type":["Text","thèse"],"thesis:degree_discipline":["Faculté des sciences"],"thesis:degree_level":["2e cycle"],"thesis:degree_name":["Maîtrise ès sciences (informatique)"],"thesis:institution_name":["Université de Moncton"]},"updated_at":"2026-07-24T03:09:42Z"}