L'explicabilité au service de l'extraction de connaissances : application à des données médicales

02/06/2023
by   Robin Cugny, et al.
0

The use of machine learning has increased dramatically in the last decade. The lack of transparency is now a limiting factor, which the field of explainability wants to address. Furthermore, one of the challenges of data mining is to present the statistical relationships of a dataset when they can be highly non-linear. One of the strengths of supervised learning is its ability to find complex statistical relationships that explainability allows to represent in an intelligible way. This paper shows that explanations can be used to extract knowledge from data and shows how feature selection, data subgroup analysis and selection of highly informative instances benefit from explanations. We then present a complete data processing pipeline using these methods on medical data. – – L'utilisation de l'apprentissage automatique a connu un bond cette dernière décennie. Le manque de transparence est aujourd'hui un frein, que le domaine de l'explicabilité veut résoudre. Par ailleurs, un des défis de l'exploration de données est de présenter les relations statistiques d'un jeu de données alors que celles-ci peuvent être hautement non-linéaires. Une des forces de l'apprentissage supervisé est sa capacité à trouver des relations statistiques complexes que l'explicabilité permet de représenter de manière intelligible. Ce papier montre que les explications permettent de faire de l'extraction de connaissance sur des données et comment la sélection de variables, l'analyse de sous-groupes de données et la sélection d'instances avec un fort pouvoir informatif bénéficient des explications. Nous présentons alors un pipeline complet de traitement des données utilisant ces méthodes pour l'exploration de données médicales.

READ FULL TEXT

page 1

page 2

page 3

page 4

research
05/12/2017

Proof Mining with Dependent Types

Several approaches exist to data-mining big corpora of formal proofs. So...
research
10/03/2019

The Bouncer Problem: Challenges to Remote Explainability

The concept of explainability is envisioned to satisfy society's demands...
research
07/20/2020

Towards Ground Truth Explainability on Tabular Data

In data science, there is a long history of using synthetic data for met...
research
02/28/2023

Multi-Layer Attention-Based Explainability via Transformers for Tabular Data

We propose a graph-oriented attention-based explainability method for ta...
research
06/01/2020

Shapley-based explainability on the data manifold

Explainability in machine learning is crucial for iterative model develo...
research
06/01/2020

A Combined Approach To Detect Key Variables In Thick Data Analytics

In machine learning one of the strategic tasks is the selection of only ...

Please sign up or login with your details

Forgot password? Click here to reset