Olivier Kraif
Dados Biográficos
| ID | 2139017 |
|---|---|
| NOME | Olivier Kraif |
| PRENOMES | Olivier |
| SOBRENOME | Kraif |
| ASSINATURA | KRAIF O |
| AFILIAÇÕES | Laboratoire de Linguistique et Didactique des Langues Etrangères et Maternelles |
| ORCID | 0000-0002-8935-7342 |
| VERIFICADO | Sim |
| TOTAL DE OBRAS | 18 |
| TOTAL DE CITAÇÕES | 9 |
| TOTAL COMO AUTOR | 18 |
| TOTAL COMO EDITOR | 0 |
| PRIMEIRO ANO DE PUBLICAÇÃO | 2003 |
| ANO MAIS RECENTE DE PUBLICAÇÃO | 2026 |
| ÍNDICE H | 2 |
Littérature d’anticipation et science-fiction: Quelle filiation ? Un éclairage phraséologique sur corpus
Notre étude interroge la filiation entre la littérature d’anticipation (1862-1931) et les romans de science-fiction contemporains (1952-2014), en utilisant de manière inédite les outils de la linguistique de corpus puisque la caractérisation des sous-genres romanesques passe traditionnellement par l’analyse thématique du lexique ou bien par la distinction des régimes de lecture. Ainsi, nous proposons de repérer des constructions lexico-syntaxique…
Exploring the ‘language of intimacy’ in English and French romance novels by means of a corpus-driven approach
Subgenres of the novel have traditionally been defined first and foremost in terms of their content. Yet, in addition to revisiting themes, settings, plot patterns and character constellations, popular fiction — i.e. genres such as fantasy, science fiction and romance novels — in particular also tends to feature recurring linguistic patterns. These can be revealed by a corpus-driven approach that identifies statistically significant recurring lex…
Périmètres des motifs phraséologiques: Réflexion Conceptuelle Et Méthodologique Sur Corpus Littéraire Contemporain
L’objectif de cet article est de proposer une réflexion conceptuelle et méthodologique sur les périmètres de réalisation des motifs phraséologiques. Pour ce faire, nous nous appuyons sur une approche guidée par les données (corpus driven) extraites grâce à la méthode des Arbres Lexico-syntaxiques Récurrents (ALR) qui a permis de montrer que le motif phraséologique pouvait jouer le rôle de marqueur générique. Pour poursuivre cette réflexion, nous …
Annotation de textes d’états de langue anciens: Pour le redéploiement de l’existant
Dans le cadre de la construction du corpus PhraseoRoChe, un corpus diachronique rassemblant des romans de chevalerie du 13e au 17e siècle, cet article s’intéresse aux performances de différents analyseurs (étiqueteurs, lemmatiseurs, parseurs en dépendances) entrainés sur des états de langue connexes allant de l’ancien français au moyen français et au français moderne. Nous étudions ainsi la possibilité d’étendre ces analyseurs au-delà des états d…
Le corpus PhraséoRoChe: Les défis de l’établissement des textes et de l’hétérogénéité des états de la langue
Le corpus PhraséoRoChe se centre sur le roman de chevalerie de langue française écrit en prose. Il rassemble des textes issus d’œuvres produites entre le XIIIe siècle et le XVIIe siècle, période bornée par la naissance et la disparition de ce genre textuel. Pour permettre des interrogations par le lecteur d’aujourd’hui d’un corpus outillé embrassant une diachronie aussi longue, il faut faire des choix concernant l’évolution de la langue, non seul…
La constitution de corpus en diachronie longue: Méthodologies, objectifs et exploitations linguistiques et stylistiques
Depuis plusieurs décennies, la numérisation des textes anciens et les progrès du TAL pour les traiter et les interroger ont largement modifié nos habitudes de travail. Il est désormais possible d’obtenir des données quantitatives massives qui affinent notre perception des phénomènes linguistiques et stylistiques dans des corpus écrits dans des états de langue anciens. Les corpus numériques créés depuis maintenant près d’un quart de siècle permett…
Comparaison d’un texte original et de ses rétrotraductions: Que disent les mesures textométriques
Cet article présente les premiers résultats de l’analyse d’un corpus littéraire composé de poèmes et d’un essai, ainsi que de leurs 16 rétroversions en français, après traduction dans 8 langues, typologiquement et diachroniquement diversifiées (l’italien, l’allemand, l’arabe, le farsi, le japonais, le coréen, le latin et le grec ancien). Cet ensemble fait l’objet d’une approche interdisciplinaire, interrogeant la rétrotraduction d’un point de vue…
Repérage et analyse des routines sémantico-rhétoriques dans le discours scientifique: Application Aux Routines De Guidage Du Lecteur
Cet article aborde un type de phraséologisme « étendu », la routine sémantico-rhétorique, définie comme une phrase préfabriquée associée à une fonction rhétorique spécifique au sein d'un genre discursif donné. Selon nous, ce type d'expression ne doit pas seulement être envisagé sous l'angle des contraintes pour le locuteur mais aussi comme élément d'intégration dans une communauté de discours. Notre approche est illustrée par une étude des routin…
La phraséologie du roman contemporain dans les corpus et les applications de la PhraseoBase
Cet article présente les ressources développées dans le cadre du projet franco-allemand ANR DFG PhraseoRom (2016-2020). Son objectif était de caractériser la phraséologie du genre romanesque contemporain dans trois langues (français, anglais, allemand). Nous détaillons ici les choix ayant présidé à la constitution des corpus littéraires trilingues, ainsi qu’à la méthodologie inédite d’extraction des données et de leur analyse linguistique et styl…
Émilie Née (dir.), Méthodes et outils informatiques pour l’analyse des discours: Presses universitaires de Rennes, 2017, 250 p
Cet ouvrage collectif est conçu comme un manuel à vocation didactique, qui s’adresse aux étudiants et aux chercheurs intéressés par les méthodes et outils informatiques mis en œuvre dans le cadre de l’analyse des discours. Comme le notent les auteurs « la spécificité du présent ouvrage est de questionner ces outils et leurs méthodes en les articulant directement à des problématiques d’analyse du discours » (p. 15). Il ne s’agit donc pas simplemen…
Des motifs séquentiels aux motifs hiérarchiques: L’apport des arbres lexico-syntaxiques récurrents pour le repérage des routines discursives
Cet article propose une réflexion à la fois théorique et méthodologique sur les objets de la phraséologie étendue, qui s’intéresse à des unités préfabriquées du discours au-delà des critères de figement. Plus précisément, nous tentons de clarifier le concept général de motif, ainsi que celui, plus spécifique, de routine discursive. Nous proposons ensuite de comparer deux approches méthodologiques différentes pour l’identification des routines en …
Routines sémantico-rhétoriques dans l’écrit scientifique de sciences humaines: L’apport Des Arbres Lexico-Syntaxiques Récurrents
International audience
Constructions lexico-syntaxiques spécifiques dans le roman policier et la science-fiction
International audience
Traitement des lexies d’émotion dans les corpus et les applications d’EmoBase
Cet article détaille la méthodologie mise en place dans le projet EMOLEX qui a abouti à la mise à disposition de corpus multilingues, d’interfaces d’interrogation et d’analyse de ces corpus ainsi que d’applications permettant d’exploiter les analyses linguistiques portant sur le lexique des affects dans cinq langues européennes
Automating the compilation of specialized dictionaries: Use and analysis of term extraction and lexical alignment
In this paper, we study how single-word term extraction and bilingual lexical alignment can be used and combined to assist terminologists when they compile bilingual specialized dictionaries. Two specific tools — namely a term extractor called TermoStat and a sentence and lexical aligner called Alinea — are tested in a specific project the aim of which is the development of an English-French dictionary on climate change. We analyze the results of…
Corpus massifs et corpus bilingues alignés
La linguistique de corpus offre un renouvellement complet de la methodologie de la recherche en linguistique. Le caractere massif des corpus utilises actuellement permet d'avoir une nouvelle approche du concept de frequence d'occurrence et revele des regularites que les methodes traditionnelles ne permettaient pas d'atteindre. Le corpus donne aussi a voir le discours d'une communaute notamment dans la langue specialisee au sein de laquelle les fo…
From translational data to contrastive knowledge: Using bi-text for bilingual lexicons extraction
Textual aligning consists in pairing segments (e.g. sentences or phrases) that are translational equivalents across corpora of translations. An interesting application of textual aligning is the automatic extraction of bilingual lexicons. As it has been pointed out during previous evaluation campaigns, such as Arcade, lexical aligning remains problematic. In order to solve problems of consistency linked with the concept of translational compositi…
Propositions pour l’intégration d’outils TAL aux dispositifs informatisés d’apprentissage des langues
En attendant de numériser les fichiers originaux, les Ellug mettent à votre disposition un fac-similé de cet article (pdf) à télécharger en cliquant sur le lien ci-dessus
Périmètres des motifs phraséologiques: Réflexion Conceptuelle Et Méthodologique Sur Corpus Littéraire Contemporain
L’objectif de cet article est de proposer une réflexion conceptuelle et méthodologique sur les périmètres de réalisation des motifs phraséologiques. Pour ce faire, nous nous appuyons sur une approche guidée par les données (corpus driven) extraites grâce à la méthode des Arbres Lexico-syntaxiques Récurrents (ALR) qui a permis de montrer que le motif phraséologique pouvait jouer le rôle de marqueur générique. Pour poursuivre cette réflexion, nous …
Routines sémantico-rhétoriques dans l’écrit scientifique de sciences humaines: L’apport Des Arbres Lexico-Syntaxiques Récurrents
International audience
Repérage et analyse des routines sémantico-rhétoriques dans le discours scientifique: Application Aux Routines De Guidage Du Lecteur
Cet article aborde un type de phraséologisme « étendu », la routine sémantico-rhétorique, définie comme une phrase préfabriquée associée à une fonction rhétorique spécifique au sein d'un genre discursif donné. Selon nous, ce type d'expression ne doit pas seulement être envisagé sous l'angle des contraintes pour le locuteur mais aussi comme élément d'intégration dans une communauté de discours. Notre approche est illustrée par une étude des routin…
Propositions pour l’intégration d’outils TAL aux dispositifs informatisés d’apprentissage des langues
En attendant de numériser les fichiers originaux, les Ellug mettent à votre disposition un fac-similé de cet article (pdf) à télécharger en cliquant sur le lien ci-dessus
From translational data to contrastive knowledge: Using bi-text for bilingual lexicons extraction
Textual aligning consists in pairing segments (e.g. sentences or phrases) that are translational equivalents across corpora of translations. An interesting application of textual aligning is the automatic extraction of bilingual lexicons. As it has been pointed out during previous evaluation campaigns, such as Arcade, lexical aligning remains problematic. In order to solve problems of consistency linked with the concept of translational compositi…
Propositions pour l’intégration d’outils TAL aux dispositifs informatisés d’apprentissage des langues
En attendant de numériser les fichiers originaux, les Ellug mettent à votre disposition un fac-similé de cet article (pdf) à télécharger en cliquant sur le lien ci-dessus
Corpus massifs et corpus bilingues alignés
La linguistique de corpus offre un renouvellement complet de la methodologie de la recherche en linguistique. Le caractere massif des corpus utilises actuellement permet d'avoir une nouvelle approche du concept de frequence d'occurrence et revele des regularites que les methodes traditionnelles ne permettaient pas d'atteindre. Le corpus donne aussi a voir le discours d'une communaute notamment dans la langue specialisee au sein de laquelle les fo…
Automating the compilation of specialized dictionaries: Use and analysis of term extraction and lexical alignment
In this paper, we study how single-word term extraction and bilingual lexical alignment can be used and combined to assist terminologists when they compile bilingual specialized dictionaries. Two specific tools — namely a term extractor called TermoStat and a sentence and lexical aligner called Alinea — are tested in a specific project the aim of which is the development of an English-French dictionary on climate change. We analyze the results of…
Traitement des lexies d’émotion dans les corpus et les applications d’EmoBase
Cet article détaille la méthodologie mise en place dans le projet EMOLEX qui a abouti à la mise à disposition de corpus multilingues, d’interfaces d’interrogation et d’analyse de ces corpus ainsi que d’applications permettant d’exploiter les analyses linguistiques portant sur le lexique des affects dans cinq langues européennes
Routines sémantico-rhétoriques dans l’écrit scientifique de sciences humaines: L’apport Des Arbres Lexico-Syntaxiques Récurrents
International audience
Constructions lexico-syntaxiques spécifiques dans le roman policier et la science-fiction
International audience
Des motifs séquentiels aux motifs hiérarchiques: L’apport des arbres lexico-syntaxiques récurrents pour le repérage des routines discursives
Cet article propose une réflexion à la fois théorique et méthodologique sur les objets de la phraséologie étendue, qui s’intéresse à des unités préfabriquées du discours au-delà des critères de figement. Plus précisément, nous tentons de clarifier le concept général de motif, ainsi que celui, plus spécifique, de routine discursive. Nous proposons ensuite de comparer deux approches méthodologiques différentes pour l’identification des routines en …
Émilie Née (dir.), Méthodes et outils informatiques pour l’analyse des discours: Presses universitaires de Rennes, 2017, 250 p
Cet ouvrage collectif est conçu comme un manuel à vocation didactique, qui s’adresse aux étudiants et aux chercheurs intéressés par les méthodes et outils informatiques mis en œuvre dans le cadre de l’analyse des discours. Comme le notent les auteurs « la spécificité du présent ouvrage est de questionner ces outils et leurs méthodes en les articulant directement à des problématiques d’analyse du discours » (p. 15). Il ne s’agit donc pas simplemen…
La phraséologie du roman contemporain dans les corpus et les applications de la PhraseoBase
Cet article présente les ressources développées dans le cadre du projet franco-allemand ANR DFG PhraseoRom (2016-2020). Son objectif était de caractériser la phraséologie du genre romanesque contemporain dans trois langues (français, anglais, allemand). Nous détaillons ici les choix ayant présidé à la constitution des corpus littéraires trilingues, ainsi qu’à la méthodologie inédite d’extraction des données et de leur analyse linguistique et styl…
Comparaison d’un texte original et de ses rétrotraductions: Que disent les mesures textométriques
Cet article présente les premiers résultats de l’analyse d’un corpus littéraire composé de poèmes et d’un essai, ainsi que de leurs 16 rétroversions en français, après traduction dans 8 langues, typologiquement et diachroniquement diversifiées (l’italien, l’allemand, l’arabe, le farsi, le japonais, le coréen, le latin et le grec ancien). Cet ensemble fait l’objet d’une approche interdisciplinaire, interrogeant la rétrotraduction d’un point de vue…
Repérage et analyse des routines sémantico-rhétoriques dans le discours scientifique: Application Aux Routines De Guidage Du Lecteur
Cet article aborde un type de phraséologisme « étendu », la routine sémantico-rhétorique, définie comme une phrase préfabriquée associée à une fonction rhétorique spécifique au sein d'un genre discursif donné. Selon nous, ce type d'expression ne doit pas seulement être envisagé sous l'angle des contraintes pour le locuteur mais aussi comme élément d'intégration dans une communauté de discours. Notre approche est illustrée par une étude des routin…
Annotation de textes d’états de langue anciens: Pour le redéploiement de l’existant
Dans le cadre de la construction du corpus PhraseoRoChe, un corpus diachronique rassemblant des romans de chevalerie du 13e au 17e siècle, cet article s’intéresse aux performances de différents analyseurs (étiqueteurs, lemmatiseurs, parseurs en dépendances) entrainés sur des états de langue connexes allant de l’ancien français au moyen français et au français moderne. Nous étudions ainsi la possibilité d’étendre ces analyseurs au-delà des états d…
Le corpus PhraséoRoChe: Les défis de l’établissement des textes et de l’hétérogénéité des états de la langue
Le corpus PhraséoRoChe se centre sur le roman de chevalerie de langue française écrit en prose. Il rassemble des textes issus d’œuvres produites entre le XIIIe siècle et le XVIIe siècle, période bornée par la naissance et la disparition de ce genre textuel. Pour permettre des interrogations par le lecteur d’aujourd’hui d’un corpus outillé embrassant une diachronie aussi longue, il faut faire des choix concernant l’évolution de la langue, non seul…
La constitution de corpus en diachronie longue: Méthodologies, objectifs et exploitations linguistiques et stylistiques
Depuis plusieurs décennies, la numérisation des textes anciens et les progrès du TAL pour les traiter et les interroger ont largement modifié nos habitudes de travail. Il est désormais possible d’obtenir des données quantitatives massives qui affinent notre perception des phénomènes linguistiques et stylistiques dans des corpus écrits dans des états de langue anciens. Les corpus numériques créés depuis maintenant près d’un quart de siècle permett…
Exploring the ‘language of intimacy’ in English and French romance novels by means of a corpus-driven approach
Subgenres of the novel have traditionally been defined first and foremost in terms of their content. Yet, in addition to revisiting themes, settings, plot patterns and character constellations, popular fiction — i.e. genres such as fantasy, science fiction and romance novels — in particular also tends to feature recurring linguistic patterns. These can be revealed by a corpus-driven approach that identifies statistically significant recurring lex…
Périmètres des motifs phraséologiques: Réflexion Conceptuelle Et Méthodologique Sur Corpus Littéraire Contemporain
L’objectif de cet article est de proposer une réflexion conceptuelle et méthodologique sur les périmètres de réalisation des motifs phraséologiques. Pour ce faire, nous nous appuyons sur une approche guidée par les données (corpus driven) extraites grâce à la méthode des Arbres Lexico-syntaxiques Récurrents (ALR) qui a permis de montrer que le motif phraséologique pouvait jouer le rôle de marqueur générique. Pour poursuivre cette réflexion, nous …
Littérature d’anticipation et science-fiction: Quelle filiation ? Un éclairage phraséologique sur corpus
Notre étude interroge la filiation entre la littérature d’anticipation (1862-1931) et les romans de science-fiction contemporains (1952-2014), en utilisant de manière inédite les outils de la linguistique de corpus puisque la caractérisation des sous-genres romanesques passe traditionnellement par l’analyse thématique du lexique ou bien par la distinction des régimes de lecture. Ainsi, nous proposons de repérer des constructions lexico-syntaxique…
Linguistics and Discourse Analysis (14 obras) · Natural Language Processing Techniques (11 obras) · Humanities (10 obras) · Philosophy (10 obras) · Art (5 obras) · French Language Learning Methods (5 obras) · Philosophy (5 obras) · Linguistics (4 obras) · linguistics and terminology studies (4 obras) · Political science (4 obras)