Comment utiliser l’outil SORTER pour trier dans une colonne ?
Nous retrouvons notre série Les 3 Minutes Analytics ! Aujourd’hui, cet article se focalise sur l’outil Sorter KNIME. Cette fonctionnalité permet de trier une ou plusieurs colonnes. En effet, l’outil Sorter organise les enregistrements d’une table dans l’ordre alphanumérique, à partir des valeurs des champs spécifiés.
Rappel du parcours 1 : suivez ce parcours de 10 articles pour apprendre à classer les produits les plus vendus, via une société que nous avons appelée SportUp.
Mydral vous propose également de découvrir en vidéo ce tutoriel :
Notre exemple présente une table de produits. L’objectif est de les trier par catégories et par chiffre d’affaires, afin de comprendre l’état des ventes de l’entreprise.
Let’s go ! Pour ce tutoriel, nous utilisons un fichier SportUp Sales Data. Je l’ai importé au préalable dans KNIME avec le node CSV Reader.

Tout d’abord, on peut regarder les données par un clic droit, puis « File Table ». Il s’agit d’une liste de produits avec plusieurs informations : Product Name, Cost Price, Category Name… En observant les colonnes Category Name et Sum of Sales, on constate un problème. Les catégories ne sont pas triées et les chiffres d’affaires restent difficiles à comparer. Ainsi, nous allons trier sur ces deux champs.

Pour faire le tri, nous cherchons le node Sorter dans la fenêtre Node Repository. Ensuite, vous pouvez soit taper dans la barre de recherche, soit le chercher dans Manipulation / Row / Transform / Sorter.

Puis je glisse le node dans le Workflow Editor. Je le relie au node CSV Reader, puis je le configure.
Propriétés de configuration de l’outil Sorter KNIME
Dans l’onglet Sorting Filter / Sort by :
- Tout d’abord, sélectionnez le nom du champ à trier.
- Ensuite, sélectionnez l’ordre du tri. Par défaut, il est croissant (de A à Z pour du texte, du plus petit au plus grand pour des nombres).
Concrètement, dans notre cas, je trie par deux colonnes. Tout d’abord par Category Name en Ascending, pour trier de A à Z. Ensuite par Sum of Sales en Descending, pour trier du plus grand au plus petit.

De plus, on peut trier les données sur plusieurs champs, en ajoutant des colonnes dans la zone du bas. Quand les données sont triées sur plusieurs colonnes, l’outil détermine l’ordre de haut en bas, en commençant par l’entrée la plus élevée.
Par ailleurs, KNIME propose d’autres options, comme mettre les valeurs nulles à la fin de la liste. Pour plus d’infos, consultez la boîte de description de l’outil. Ici, je ne les utilise pas.
Enfin, je valide (Apply → OK) et j’exécute le node.
La dernière étape consiste à regarder le résultat du tri, puis à renommer le node. Voici ci-dessous le workflow final :

Et voici la comparaison entre les deux tables, avant et après le tri. La colonne Category Name est triée de A à Z. Quant à la colonne Sum of Sales, elle est triée du plus grand au plus petit dans chaque catégorie.

Ce tutoriel s’achève ici. Testez l’outil Sorter KNIME dès aujourd’hui pour trier vos données !
Retrouvez davantage de tutoriels dans notre série 3 Minutes Analytics sur la thématique KNIME. Pourquoi ne pas commencer par vous familiariser avec l’interface KNIME pour débuter ?
Donnez-nous votre avis en laissant vos commentaires !
Suivez-nous sur les réseaux sociaux : LinkedIn & Twitter !
Author Profile
Latest entries
La minute Analytics5 août 2020Les 3 minutes Analytics : comment utiliser le node TIMER INFO dans KNIME
La minute Analytics31 juillet 2020Les 3 minutes Analytics – Comment utiliser les variables de FLUX dans KNIME ?
La minute Analytics31 juillet 2020Les 3 minutes Analytics – Comment utiliser le node LIST FILES dans KNIME ?
La minute Analytics30 juillet 2020Les 3 minutes Analytics : Comment utiliser l’outil RowID dans KNIME ?

