L'extraction d'arguments (également appelée extraction d'argumentation) transforme une prose non structurée — un compte rendu de réunion, une consultation politique, un essai, un fil de forum — en une carte structurée de qui a argumenté quoi et sur quelles bases. Le domaine est généralement décrit comme quatre tâches liées : trouver les segments argumentatifs dans le texte, étiqueter chacun comme une affirmation, une prémisse ou une preuve, déterminer quel segment répond à quel autre, et décider si chaque relation est un soutien ou une attaque. Il est issu de la théorie de l'argumentation — le compte rendu de Stephen Toulmin de 1958 sur la façon dont les arguments quotidiens sont en réalité construits, et le catalogue de Douglas Walton des schémas de raisonnement récurrents — et est devenu une discipline computationnelle dans les années 2010 grâce à des corpus annotés tels que les essais persuasifs de Christian Stab et Iryna Gurevych et les microtextes argumentatifs d'Andreas Peldszus et Manfred Stede. Argumentree utilise l'extraction d'arguments pour transformer un compte rendu ou un document collé en un arbre d'arguments pour et contre que les gens peuvent ensuite lire, corriger, évaluer et étendre.

L'extraction d'arguments est la branche de l'IA qui lit un texte ordinaire et détermine sa structure argumentative — quelles phrases sont des affirmations, quelles sont les raisons données pour celles-ci, et si chaque raison soutient ou attaque le point auquel elle est attachée. C'est la technologie qui permet de transformer un compte rendu de réunion en un arbre structuré des pour et des contre.
Dernière mise à jour : 2026-07-29
Extraction d'arguments (ou extraction d'argumentation) extrait automatiquement le raisonnement à l'intérieur d'un texte non structuré. Là où l'analyse de sentiment demande comment ce texte se sent et où la synthèse demande que dit-il, l'extraction d'arguments demande qu'est-ce qui est affirmé, sur quelles bases, et quels sont les arguments contre. C'est ce qui permet aux logiciels de convertir un transcript, une réponse de consultation ou un essai en une carte d'arguments plutôt qu'en un résumé.
Les chercheurs décomposent généralement le problème en quatre tâches liées. Chacune est plus difficile que la précédente, et une erreur au début se propage à tout ce qui suit.
La plupart des phrases dans un document réel ne sont pas des arguments — ce sont des salutations, de la logistique, des informations de contexte ou des reformulations. La première tâche consiste à décider quels segments de texte portent réellement une affirmation ou une raison.
Une affirmation est une position que quelqu'un prend. Une prémisse est une raison avancée pour cela. La preuve est les données, l'étude ou l'exemple soutenant la raison. La même phrase peut être une affirmation dans un document et une prémisse dans un autre — le rôle dépend de ce qu'elle fait, et non de la façon dont elle est formulée.
Les arguments ne sont pas une liste plate. Une raison est liée à une affirmation spécifique ; une réfutation est liée à une raison spécifique. Récupérer cette structure est ce qui transforme un tas de phrases extraites en un arbre.
Pour chaque lien dans l'arbre : est-ce que cela renforce la chose à laquelle il est attaché, ou l'affaiblit-il ? C'est l'étape qui pose le plus souvent problème, et la raison est expliquée plus bas.
Ce n'est que lorsque les quatre sont faits que vous avez quelque chose que vous pouvez réellement naviguer : une revendication, les raisons qui la soutiennent, les objections à ces raisons et les réponses à ces objections.
L'extraction d'arguments est un domaine computationnel jeune reposant sur un domaine théorique beaucoup plus ancien. La théorie est apparue environ un demi-siècle plus tôt.
Dans Les usages de l'argument, Stephen Toulmin soutient que les véritables arguments ne ressemblent pas à des syllogismes. Il propose la revendication, les fondements, le garant, le soutien, le modificateur et la réfutation comme les parties d'un argument quotidien — le vocabulaire que tout le domaine utilise encore.
Douglas Walton documente des schémas récurrents de raisonnement quotidien — appel à l'opinion d'expert, argument par analogie, argument par les conséquences — chacun avec un ensemble de questions critiques qui révèlent où cela peut échouer.
James Freeman distingue les prémisses qui ne fonctionnent qu'ensemble de celles qui peuvent chacune se suffire à elles-mêmes, et sépare l'attaque d'une conclusion de l'attaque de l'inférence qui y mène — une distinction qui revêt une importance énorme une fois qu'une machine doit la faire.
L'extraction d'arguments devient une tâche computationnelle mesurable lorsque des ensembles de données annotées apparaissent. Stab et Gurevych annotent des revendications, des prémisses et des relations dans des essais persuasifs ; Peldszus et Stede construisent un corpus de courts textes argumentatifs spécifiquement pour étudier la structure des arguments. Des références communes rendent les progrès comparables.
Les systèmes apprennent à étiqueter les segments argumentatifs et à classer les relations à partir d'exemples étiquetés. La détection des composants devient raisonnablement fiable. La détection des relations — décider ce qui s'attache à quoi, et si cela soutient ou attaque — reste obstinément difficile.
Les modèles de langage à usage général peuvent effectuer des tâches d'extraction d'arguments sans avoir été préalablement entraînés sur un corpus annoté. Cela élimine le plus grand obstacle pratique — la nécessité de milliers d'exemples annotés à la main par domaine — et rend l'extraction d'arguments utilisable sur du texte commercial ordinaire.
L'extraction des revendications est la moitié facile. La difficulté réside dans les relations — et il y a trois raisons à cela.
« Le pont est dangereux, donc nous devrions le fermer » cache un principe non exprimé : que les structures dangereuses devraient être fermées. Toulmin a appelé cela le garant. Les gens ne le disent presque jamais à voix haute, ce qui signifie qu'une machine doit reconstruire une étape qui n'est pas dans le texte.
Dans la plupart des corpus annotés, la grande majorité des relations sont de soutien ; l'attaque est une petite minorité. Un modèle entraîné ou incité sur cette distribution apprend que deviner le soutien est généralement sûr — ce qui est exactement faux pour les cas qui comptent le plus dans une décision.
Sous une objection, une raison qui renforce l'objection soutient son parent tout en s'opposant à la proposition globale. Les systèmes qui jugent la position en fonction de ce que la phrase pense du sujet se trompent et l'erreur se propage le long de la branche.
Argumentree applique l'extraction d'arguments à un travail spécifique : transformer une transcription, un document ou un fil de discussion en un arbre d'arguments pour et contre avec lequel une équipe peut ensuite travailler. La conception suit la pratique du domaine plutôt que d'inventer une méthode privée.
Chaque argument extrait conserve le libellé exact d'où il provient. Si une affirmation ne peut pas être retracée à quelque chose de réellement présent dans la source, elle ne fait pas partie de l'arbre.
Selon Walton et Freeman, une objection peut contester une conclusion, contester les preuves qui la soutiennent, ou contester l'étape inférentielle qui les relie. Ce sont des mouvements différents et sont considérés comme des relations différentes.
L'extraction produit un arbre proposé. Les personnes le passent en revue, le corrigent, le re-parentent et l'évaluent avant qu'il ne devienne l'enregistrement. La machine effectue le premier passage fastidieux ; le jugement reste au sein du groupe.
Parce que le résultat est un arbre plutôt qu'un résumé, les contributeurs ultérieurs peuvent attacher une nouvelle objection à la raison précise qu'elle aborde, des mois après la discussion originale.
L'effet pratique est que le raisonnement derrière une décision reste inspectable — non seulement ce qui a été décidé, mais aussi quels arguments ont été avancés, ce qui y a répondu et ce qui n'a jamais été répondu du tout.
Le pendant manuel : présenter visuellement les revendications et les raisons à la main. L'extraction d'arguments automatise ce que la cartographie des arguments fait délibérément.
Le champ plus large sur lequel l'extraction d'arguments opère — la logique, la rhétorique, la dialectique et les cadres formels qui les sous-tendent.
L'anatomie en six parties d'un argument quotidien, et la source du vocabulaire de la revendication, des fondements et des garanties utilisé tout au long de l'extraction d'arguments.
L'extraction d'arguments appliquée aux transcriptions de réunions — capturer pourquoi une décision a été prise, pas seulement ce qui a été dit.
L'extraction d'arguments est un logiciel qui lit un texte et détermine l'argument qui s'y trouve : ce qui est affirmé, quelles raisons sont données et quelles raisons soutiennent ou s'opposent à quelles affirmations. Le résultat est une carte structurée plutôt qu'un bloc de prose.
Un résumé compresse un texte et vous dit à peu près ce qu'il a dit. L'extraction d'arguments préserve la structure : elle vous indique qu'une objection particulière a été soulevée contre une raison particulière, et que personne n'y a répondu. Les résumés perdent exactement le désaccord qui compte pour une décision.
Non. L'analyse des sentiments mesure l'attitude — positive, négative, neutre. L'extraction d'arguments récupère le raisonnement. Une phrase peut être formulée négativement tout en soutenant le point auquel elle est rattachée, et l'analyse des sentiments se trompera à chaque fois.
Il n'y a pas d'inventeur unique. Les bases théoriques reposent sur le modèle de structure d'argument de Stephen Toulmin de 1958, étendu par les schémas d'argumentation de Douglas Walton et le compte rendu de la macrostructure d'argument de James Freeman. Le domaine computationnel a pris forme dans les années 2010, avec les corpus annotés de Christian Stab et Iryna Gurevych ainsi que ceux d'Andreas Peldszus et Manfred Stede parmi les travaux qui l'ont rendu mesurable.
Deux raisons. Les attaques sont beaucoup plus rares que le soutien dans les ensembles de données dont ces systèmes s'inspirent, donc les modèles sont biaisés en faveur de la prédiction du soutien. De plus, une attaque doit souvent être jugée par rapport à son parent immédiat plutôt qu'au sujet global — une raison peut renforcer une objection tout en s'opposant à la proposition à laquelle cette objection est destinée.
Non, et le traiter de cette manière est une erreur. L'extraction produit un premier brouillon de la structure de l'argument. Décider si un argument est valable — si les preuves tiennent, si l'hypothèse implicite est acceptable — est un travail humain. La valeur réside dans le fait de ne pas avoir à construire la structure manuellement avant que ce travail puisse commencer.
Toulmin, S. E. (1958). Les usages de l'argumentation. Cambridge University Press.
Le modèle de Réclamation-Données-Garanties-Qualificateur-Réfutation - la base théorique de la structure d'argument.
View source →Walton, D., Reed, C., & Macagno, F. (2008). Schémas d'argumentation. Cambridge University Press.
Le catalogue des schémas de raisonnement récurrents et les questions critiques qui les testent - le vocabulaire pour les relations de soutien et d'attaque.
Freeman, J. B. (1991). Dialectique et la macrostructure des arguments : Une théorie de la structure des arguments. Foris / De Gruyter.
Soutien, réfutation et contrecarrer dans un échange entre un partisan et un opposant - la distinction entre attaquer une conclusion et attaquer l'inférence qui y mène.
View source →Peldszus, A., & Stede, M. (2013). Des diagrammes d'argumentation à l'extraction d'argumentation dans les textes : Une enquête. International Journal of Cognitive Informatics and Natural Intelligence, 7(1), 1-31.
Opérationnaliser le modèle de Freeman pour l'extraction automatisée d'arguments.
View source →Stab, C., & Gurevych, I. (2014). Annotation des composants d'argument et des relations dans les essais persuasifs. Actes de COLING 2014.
Extraction d'arguments computationnels fondamentaux - le corpus annoté et le schéma derrière l'extraction automatisée d'arguments.
View source →Lawrence, J., & Reed, C. (2019). L'extraction d'arguments : Une enquête. Linguistique computationnelle, 45(4), 765-818.
L'enquête standard du domaine - définitions des tâches, méthodes et problèmes ouverts.
View source →Collez une transcription de réunion, une réponse de consultation ou un document et obtenez un arbre structuré des pour et des contre que votre équipe peut examiner, corriger, évaluer et développer.
Commencer gratuitement