Skip to main content

ETHNOS_APP

Home • Search • Journals • List 0

Olivier Kraif

Biographic Data

ID2139017
NAMEOlivier Kraif
GIVEN NAMESOlivier
FAMILY NAMEKraif
SIGNATUREKRAIF O
AFFILIATIONSLaboratoire de Linguistique et Didactique des Langues Etrangères et Maternelles
ORCID0000-0002-8935-7342
VERIFIEDYes
TOTAL WORKS18
TOTAL CITATIONS9
AUTHOR COUNT18
EDITOR COUNT0
FIRST PUBLICATION YEAR2003
LATEST PUBLICATION YEAR2026
H-INDEX2
  • Littérature d’anticipation et science-fiction: Quelle filiation ? Un éclairage phraséologique sur corpus

    Open Access•Olivier Kraif, Iva Novakova et al.•ARTICLE•Tangence•2026

    Notre étude interroge la filiation entre la littérature d’anticipation (1862-1931) et les romans de science-fiction contemporains (1952-2014), en utilisant de manière inédite les outils de la linguistique de corpus puisque la caractérisation des sous-genres romanesques passe traditionnellement par l’analyse thématique du lexique ou bien par la distinction des régimes de lecture. Ainsi, nous proposons de repérer des constructions lexico-syntaxique…

  • Exploring the ‘language of intimacy’ in English and French romance novels by means of a corpus-driven approach

    Open Access•Iva Novakova, Olivier Kraif et al.•ARTICLE•International Journal of Corpus…•2025•References: 8

    Subgenres of the novel have traditionally been defined first and foremost in terms of their content. Yet, in addition to revisiting themes, settings, plot patterns and character constellations, popular fiction — i.e. genres such as fantasy, science fiction and romance novels — in particular also tends to feature recurring linguistic patterns. These can be revealed by a corpus-driven approach that identifies statistically significant recurring lex…

  • Périmètres des motifs phraséologiques: Réflexion Conceptuelle Et Méthodologique Sur Corpus Littéraire Contemporain

    Olivier Kraif, Iva Novakova et al.•ARTICLE•Corpus•2025•Cited by: 4•References: 8

    L’objectif de cet article est de proposer une réflexion conceptuelle et méthodologique sur les périmètres de réalisation des motifs phraséologiques. Pour ce faire, nous nous appuyons sur une approche guidée par les données (corpus driven) extraites grâce à la méthode des Arbres Lexico-syntaxiques Récurrents (ALR) qui a permis de montrer que le motif phraséologique pouvait jouer le rôle de marqueur générique. Pour poursuivre cette réflexion, nous …

  • Annotation de textes d’états de langue anciens: Pour le redéploiement de l’existant

    Adam Renwick, Olivier Kraif•ARTICLE•Corpus•2024

    Dans le cadre de la construction du corpus PhraseoRoChe, un corpus diachronique rassemblant des romans de chevalerie du 13e au 17e siècle, cet article s’intéresse aux performances de différents analyseurs (étiqueteurs, lemmatiseurs, parseurs en dépendances) entrainés sur des états de langue connexes allant de l’ancien français au moyen français et au français moderne. Nous étudions ainsi la possibilité d’étendre ces analyseurs au-delà des états d…

  • Le corpus PhraséoRoChe: Les défis de l’établissement des textes et de l’hétérogénéité des états de la langue

    Corinne Denoyelle, Olivier Kraif et al.•ARTICLE•Corpus•2024

    Le corpus PhraséoRoChe se centre sur le roman de chevalerie de langue française écrit en prose. Il rassemble des textes issus d’œuvres produites entre le XIIIe siècle et le XVIIe siècle, période bornée par la naissance et la disparition de ce genre textuel. Pour permettre des interrogations par le lecteur d’aujourd’hui d’un corpus outillé embrassant une diachronie aussi longue, il faut faire des choix concernant l’évolution de la langue, non seul…

  • La constitution de corpus en diachronie longue: Méthodologies, objectifs et exploitations linguistiques et stylistiques

    Julie Sorba, Olivier Kraif et al.•ARTICLE•Corpus•2024

    Depuis plusieurs décennies, la numérisation des textes anciens et les progrès du TAL pour les traiter et les interroger ont largement modifié nos habitudes de travail. Il est désormais possible d’obtenir des données quantitatives massives qui affinent notre perception des phénomènes linguistiques et stylistiques dans des corpus écrits dans des états de langue anciens. Les corpus numériques créés depuis maintenant près d’un quart de siècle permett…

  • Comparaison d’un texte original et de ses rétrotraductions: Que disent les mesures textométriques

    Open Access•Olivier Kraif, Pascale Roux•ARTICLE•Meta Journal des traducteurs•2022•References: 6

    Cet article présente les premiers résultats de l’analyse d’un corpus littéraire composé de poèmes et d’un essai, ainsi que de leurs 16 rétroversions en français, après traduction dans 8 langues, typologiquement et diachroniquement diversifiées (l’italien, l’allemand, l’arabe, le farsi, le japonais, le coréen, le latin et le grec ancien). Cet ensemble fait l’objet d’une approche interdisciplinaire, interrogeant la rétrotraduction d’un point de vue…

  • Repérage et analyse des routines sémantico-rhétoriques dans le discours scientifique: Application Aux Routines De Guidage Du Lecteur

    Agnès Tutin, Yujing Ji et al.•ARTICLE•Langages•2022•Cited by: 1•References: 23

    Cet article aborde un type de phraséologisme « étendu », la routine sémantico-rhétorique, définie comme une phrase préfabriquée associée à une fonction rhétorique spécifique au sein d'un genre discursif donné. Selon nous, ce type d'expression ne doit pas seulement être envisagé sous l'angle des contraintes pour le locuteur mais aussi comme élément d'intégration dans une communauté de discours. Notre approche est illustrée par une étude des routin…

  • La phraséologie du roman contemporain dans les corpus et les applications de la PhraseoBase

    Sascha Diwersy, Laetitia Gonon et al.•ARTICLE•Corpus•2021

    Cet article présente les ressources développées dans le cadre du projet franco-allemand ANR DFG PhraseoRom (2016-2020). Son objectif était de caractériser la phraséologie du genre romanesque contemporain dans trois langues (français, anglais, allemand). Nous détaillons ici les choix ayant présidé à la constitution des corpus littéraires trilingues, ainsi qu’à la méthodologie inédite d’extraction des données et de leur analyse linguistique et styl…

  • Émilie Née (dir.), Méthodes et outils informatiques pour l’analyse des discours: Presses universitaires de Rennes, 2017, 250 p

    Open Access•Olivier Kraif•ARTICLE•Lidil•2018

    Cet ouvrage collectif est conçu comme un manuel à vocation didactique, qui s’adresse aux étudiants et aux chercheurs intéressés par les méthodes et outils informatiques mis en œuvre dans le cadre de l’analyse des discours. Comme le notent les auteurs « la spécificité du présent ouvrage est de questionner ces outils et leurs méthodes en les articulant directement à des problématiques d’analyse du discours » (p. 15). Il ne s’agit donc pas simplemen…

  • Des motifs séquentiels aux motifs hiérarchiques: L’apport des arbres lexico-syntaxiques récurrents pour le repérage des routines discursives

    Olivier Kraif, Agnès Tutin•ARTICLE•Corpus•2017

    Cet article propose une réflexion à la fois théorique et méthodologique sur les objets de la phraséologie étendue, qui s’intéresse à des unités préfabriquées du discours au-delà des critères de figement. Plus précisément, nous tentons de clarifier le concept général de motif, ainsi que celui, plus spécifique, de routine discursive. Nous proposons ensuite de comparer deux approches méthodologiques différentes pour l’identification des routines en …

  • Routines sémantico-rhétoriques dans l’écrit scientifique de sciences humaines: L’apport Des Arbres Lexico-Syntaxiques Récurrents

    Open Access•Agnès Tutin, Olivier Kraif•ARTICLE•Lidil•2016•Cited by: 3•References: 3

    International audience

  • Constructions lexico-syntaxiques spécifiques dans le roman policier et la science-fiction

    Open Access•Olivier Kraif, Iva Novakova et al.•ARTICLE•Lidil•2016•References: 1

    International audience

  • Traitement des lexies d’émotion dans les corpus et les applications d’EmoBase

    Sascha Diwersy, Vannina Goossens et al.•ARTICLE•Corpus•2014

    Cet article détaille la méthodologie mise en place dans le projet EMOLEX qui a abouti à la mise à disposition de corpus multilingues, d’interfaces d’interrogation et d’analyse de ces corpus ainsi que d’applications permettant d’exploiter les analyses linguistiques portant sur le lexique des affects dans cinq langues européennes

  • Automating the compilation of specialized dictionaries: Use and analysis of term extraction and lexical alignment

    Annaïch Le Serrec, Marie-Claude L’homme et al.•ARTICLE•Terminology International Journal…•2010

    In this paper, we study how single-word term extraction and bilingual lexical alignment can be used and combined to assist terminologists when they compile bilingual specialized dictionaries. Two specific tools — namely a term extractor called TermoStat and a sentence and lexical aligner called Alinea — are tested in a specific project the aim of which is the development of an English-French dictionary on climate change. We analyze the results of…

  • Corpus massifs et corpus bilingues alignés

    Jean-Louis Duchet, Olivier Kraif et al.•ARTICLE•Bulletin de la Société de…•2008

    La linguistique de corpus offre un renouvellement complet de la methodologie de la recherche en linguistique. Le caractere massif des corpus utilises actuellement permet d'avoir une nouvelle approche du concept de frequence d'occurrence et revele des regularites que les methodes traditionnelles ne permettaient pas d'atteindre. Le corpus donne aussi a voir le discours d'une communaute notamment dans la langue specialisee au sein de laquelle les fo…

  • From translational data to contrastive knowledge: Using bi-text for bilingual lexicons extraction

    Olivier Kraif•ARTICLE•International Journal of Corpus…•2003

    Textual aligning consists in pairing segments (e.g. sentences or phrases) that are translational equivalents across corpora of translations. An interesting application of textual aligning is the automatic extraction of bilingual lexicons. As it has been pointed out during previous evaluation campaigns, such as Arcade, lexical aligning remains problematic. In order to solve problems of consistency linked with the concept of translational compositi…

  • Propositions pour l’intégration d’outils TAL aux dispositifs informatisés d’apprentissage des langues

    Open Access•Olivier Kraif•ARTICLE•Lidil•2003•Cited by: 1

    En attendant de numériser les fichiers originaux, les Ellug mettent à votre disposition un fac-similé de cet article (pdf) à télécharger en cliquant sur le lien ci-dessus

  • Périmètres des motifs phraséologiques: Réflexion Conceptuelle Et Méthodologique Sur Corpus Littéraire Contemporain

    Olivier Kraif, Iva Novakova et al.•ARTICLE•Corpus•2025•Cited by: 4•References: 8

    L’objectif de cet article est de proposer une réflexion conceptuelle et méthodologique sur les périmètres de réalisation des motifs phraséologiques. Pour ce faire, nous nous appuyons sur une approche guidée par les données (corpus driven) extraites grâce à la méthode des Arbres Lexico-syntaxiques Récurrents (ALR) qui a permis de montrer que le motif phraséologique pouvait jouer le rôle de marqueur générique. Pour poursuivre cette réflexion, nous …

  • Routines sémantico-rhétoriques dans l’écrit scientifique de sciences humaines: L’apport Des Arbres Lexico-Syntaxiques Récurrents

    Open Access•Agnès Tutin, Olivier Kraif•ARTICLE•Lidil•2016•Cited by: 3•References: 3

    International audience

  • Repérage et analyse des routines sémantico-rhétoriques dans le discours scientifique: Application Aux Routines De Guidage Du Lecteur

    Agnès Tutin, Yujing Ji et al.•ARTICLE•Langages•2022•Cited by: 1•References: 23

    Cet article aborde un type de phraséologisme « étendu », la routine sémantico-rhétorique, définie comme une phrase préfabriquée associée à une fonction rhétorique spécifique au sein d'un genre discursif donné. Selon nous, ce type d'expression ne doit pas seulement être envisagé sous l'angle des contraintes pour le locuteur mais aussi comme élément d'intégration dans une communauté de discours. Notre approche est illustrée par une étude des routin…

  • Propositions pour l’intégration d’outils TAL aux dispositifs informatisés d’apprentissage des langues

    Open Access•Olivier Kraif•ARTICLE•Lidil•2003•Cited by: 1

    En attendant de numériser les fichiers originaux, les Ellug mettent à votre disposition un fac-similé de cet article (pdf) à télécharger en cliquant sur le lien ci-dessus

  • From translational data to contrastive knowledge: Using bi-text for bilingual lexicons extraction

    Olivier Kraif•ARTICLE•International Journal of Corpus…•2003

    Textual aligning consists in pairing segments (e.g. sentences or phrases) that are translational equivalents across corpora of translations. An interesting application of textual aligning is the automatic extraction of bilingual lexicons. As it has been pointed out during previous evaluation campaigns, such as Arcade, lexical aligning remains problematic. In order to solve problems of consistency linked with the concept of translational compositi…

  • Propositions pour l’intégration d’outils TAL aux dispositifs informatisés d’apprentissage des langues

    Open Access•Olivier Kraif•ARTICLE•Lidil•2003•Cited by: 1

    En attendant de numériser les fichiers originaux, les Ellug mettent à votre disposition un fac-similé de cet article (pdf) à télécharger en cliquant sur le lien ci-dessus

  • Corpus massifs et corpus bilingues alignés

    Jean-Louis Duchet, Olivier Kraif et al.•ARTICLE•Bulletin de la Société de…•2008

    La linguistique de corpus offre un renouvellement complet de la methodologie de la recherche en linguistique. Le caractere massif des corpus utilises actuellement permet d'avoir une nouvelle approche du concept de frequence d'occurrence et revele des regularites que les methodes traditionnelles ne permettaient pas d'atteindre. Le corpus donne aussi a voir le discours d'une communaute notamment dans la langue specialisee au sein de laquelle les fo…

  • Automating the compilation of specialized dictionaries: Use and analysis of term extraction and lexical alignment

    Annaïch Le Serrec, Marie-Claude L’homme et al.•ARTICLE•Terminology International Journal…•2010

    In this paper, we study how single-word term extraction and bilingual lexical alignment can be used and combined to assist terminologists when they compile bilingual specialized dictionaries. Two specific tools — namely a term extractor called TermoStat and a sentence and lexical aligner called Alinea — are tested in a specific project the aim of which is the development of an English-French dictionary on climate change. We analyze the results of…

  • Traitement des lexies d’émotion dans les corpus et les applications d’EmoBase

    Sascha Diwersy, Vannina Goossens et al.•ARTICLE•Corpus•2014

    Cet article détaille la méthodologie mise en place dans le projet EMOLEX qui a abouti à la mise à disposition de corpus multilingues, d’interfaces d’interrogation et d’analyse de ces corpus ainsi que d’applications permettant d’exploiter les analyses linguistiques portant sur le lexique des affects dans cinq langues européennes

  • Routines sémantico-rhétoriques dans l’écrit scientifique de sciences humaines: L’apport Des Arbres Lexico-Syntaxiques Récurrents

    Open Access•Agnès Tutin, Olivier Kraif•ARTICLE•Lidil•2016•Cited by: 3•References: 3

    International audience

  • Constructions lexico-syntaxiques spécifiques dans le roman policier et la science-fiction

    Open Access•Olivier Kraif, Iva Novakova et al.•ARTICLE•Lidil•2016•References: 1

    International audience

  • Des motifs séquentiels aux motifs hiérarchiques: L’apport des arbres lexico-syntaxiques récurrents pour le repérage des routines discursives

    Olivier Kraif, Agnès Tutin•ARTICLE•Corpus•2017

    Cet article propose une réflexion à la fois théorique et méthodologique sur les objets de la phraséologie étendue, qui s’intéresse à des unités préfabriquées du discours au-delà des critères de figement. Plus précisément, nous tentons de clarifier le concept général de motif, ainsi que celui, plus spécifique, de routine discursive. Nous proposons ensuite de comparer deux approches méthodologiques différentes pour l’identification des routines en …

  • Émilie Née (dir.), Méthodes et outils informatiques pour l’analyse des discours: Presses universitaires de Rennes, 2017, 250 p

    Open Access•Olivier Kraif•ARTICLE•Lidil•2018

    Cet ouvrage collectif est conçu comme un manuel à vocation didactique, qui s’adresse aux étudiants et aux chercheurs intéressés par les méthodes et outils informatiques mis en œuvre dans le cadre de l’analyse des discours. Comme le notent les auteurs « la spécificité du présent ouvrage est de questionner ces outils et leurs méthodes en les articulant directement à des problématiques d’analyse du discours » (p. 15). Il ne s’agit donc pas simplemen…

  • La phraséologie du roman contemporain dans les corpus et les applications de la PhraseoBase

    Sascha Diwersy, Laetitia Gonon et al.•ARTICLE•Corpus•2021

    Cet article présente les ressources développées dans le cadre du projet franco-allemand ANR DFG PhraseoRom (2016-2020). Son objectif était de caractériser la phraséologie du genre romanesque contemporain dans trois langues (français, anglais, allemand). Nous détaillons ici les choix ayant présidé à la constitution des corpus littéraires trilingues, ainsi qu’à la méthodologie inédite d’extraction des données et de leur analyse linguistique et styl…

  • Comparaison d’un texte original et de ses rétrotraductions: Que disent les mesures textométriques

    Open Access•Olivier Kraif, Pascale Roux•ARTICLE•Meta Journal des traducteurs•2022•References: 6

    Cet article présente les premiers résultats de l’analyse d’un corpus littéraire composé de poèmes et d’un essai, ainsi que de leurs 16 rétroversions en français, après traduction dans 8 langues, typologiquement et diachroniquement diversifiées (l’italien, l’allemand, l’arabe, le farsi, le japonais, le coréen, le latin et le grec ancien). Cet ensemble fait l’objet d’une approche interdisciplinaire, interrogeant la rétrotraduction d’un point de vue…

  • Repérage et analyse des routines sémantico-rhétoriques dans le discours scientifique: Application Aux Routines De Guidage Du Lecteur

    Agnès Tutin, Yujing Ji et al.•ARTICLE•Langages•2022•Cited by: 1•References: 23

    Cet article aborde un type de phraséologisme « étendu », la routine sémantico-rhétorique, définie comme une phrase préfabriquée associée à une fonction rhétorique spécifique au sein d'un genre discursif donné. Selon nous, ce type d'expression ne doit pas seulement être envisagé sous l'angle des contraintes pour le locuteur mais aussi comme élément d'intégration dans une communauté de discours. Notre approche est illustrée par une étude des routin…

  • Annotation de textes d’états de langue anciens: Pour le redéploiement de l’existant

    Adam Renwick, Olivier Kraif•ARTICLE•Corpus•2024

    Dans le cadre de la construction du corpus PhraseoRoChe, un corpus diachronique rassemblant des romans de chevalerie du 13e au 17e siècle, cet article s’intéresse aux performances de différents analyseurs (étiqueteurs, lemmatiseurs, parseurs en dépendances) entrainés sur des états de langue connexes allant de l’ancien français au moyen français et au français moderne. Nous étudions ainsi la possibilité d’étendre ces analyseurs au-delà des états d…

  • Le corpus PhraséoRoChe: Les défis de l’établissement des textes et de l’hétérogénéité des états de la langue

    Corinne Denoyelle, Olivier Kraif et al.•ARTICLE•Corpus•2024

    Le corpus PhraséoRoChe se centre sur le roman de chevalerie de langue française écrit en prose. Il rassemble des textes issus d’œuvres produites entre le XIIIe siècle et le XVIIe siècle, période bornée par la naissance et la disparition de ce genre textuel. Pour permettre des interrogations par le lecteur d’aujourd’hui d’un corpus outillé embrassant une diachronie aussi longue, il faut faire des choix concernant l’évolution de la langue, non seul…

  • La constitution de corpus en diachronie longue: Méthodologies, objectifs et exploitations linguistiques et stylistiques

    Julie Sorba, Olivier Kraif et al.•ARTICLE•Corpus•2024

    Depuis plusieurs décennies, la numérisation des textes anciens et les progrès du TAL pour les traiter et les interroger ont largement modifié nos habitudes de travail. Il est désormais possible d’obtenir des données quantitatives massives qui affinent notre perception des phénomènes linguistiques et stylistiques dans des corpus écrits dans des états de langue anciens. Les corpus numériques créés depuis maintenant près d’un quart de siècle permett…

  • Exploring the ‘language of intimacy’ in English and French romance novels by means of a corpus-driven approach

    Open Access•Iva Novakova, Olivier Kraif et al.•ARTICLE•International Journal of Corpus…•2025•References: 8

    Subgenres of the novel have traditionally been defined first and foremost in terms of their content. Yet, in addition to revisiting themes, settings, plot patterns and character constellations, popular fiction — i.e. genres such as fantasy, science fiction and romance novels — in particular also tends to feature recurring linguistic patterns. These can be revealed by a corpus-driven approach that identifies statistically significant recurring lex…

  • Périmètres des motifs phraséologiques: Réflexion Conceptuelle Et Méthodologique Sur Corpus Littéraire Contemporain

    Olivier Kraif, Iva Novakova et al.•ARTICLE•Corpus•2025•Cited by: 4•References: 8

    L’objectif de cet article est de proposer une réflexion conceptuelle et méthodologique sur les périmètres de réalisation des motifs phraséologiques. Pour ce faire, nous nous appuyons sur une approche guidée par les données (corpus driven) extraites grâce à la méthode des Arbres Lexico-syntaxiques Récurrents (ALR) qui a permis de montrer que le motif phraséologique pouvait jouer le rôle de marqueur générique. Pour poursuivre cette réflexion, nous …

  • Littérature d’anticipation et science-fiction: Quelle filiation ? Un éclairage phraséologique sur corpus

    Open Access•Olivier Kraif, Iva Novakova et al.•ARTICLE•Tangence•2026

    Notre étude interroge la filiation entre la littérature d’anticipation (1862-1931) et les romans de science-fiction contemporains (1952-2014), en utilisant de manière inédite les outils de la linguistique de corpus puisque la caractérisation des sous-genres romanesques passe traditionnellement par l’analyse thématique du lexique ou bien par la distinction des régimes de lecture. Ainsi, nous proposons de repérer des constructions lexico-syntaxique…

Linguistics and Discourse Analysis (14 works) · Natural Language Processing Techniques (11 works) · Humanities (10 works) · Philosophy (10 works) · Art (5 works) · French Language Learning Methods (5 works) · Philosophy (5 works) · Linguistics (4 works) · linguistics and terminology studies (4 works) · Political science (4 works)

Ethnos_APP • Open Source Project • MIT License • Frontend v2.0.0 • Privacy and Cookies • API Documentation: api.ethnos.app/docs • API Source Code: GitHub • DOI: 10.5281/zenodo.17049435 • Frontend Source Code: GitHub • DOI: 10.5281/zenodo.17050053 • cruz.rio.br • Expectantes Misericordiae