Traitement de données des employés

LinuxBeginner
Pratiquer maintenant

Introduction

Dans l'univers des utilitaires en ligne de commande Linux, join et awk sont des outils puissants capables d'améliorer considérablement vos capacités de traitement de données. Ce défi mettra à l'épreuve votre aptitude à utiliser ces commandes efficacement pour traiter et combiner des données provenant de sources multiples, en manipulant un jeu de données conséquent qui nécessite une automatisation.

Combinaison et traitement des données

Tâches

  1. Utilisez la commande join pour combiner les données de deux fichiers : employees.txt et departments.txt.
  2. Traitez les données combinées à l'aide de awk pour créer une sortie formatée.
  3. Créez des lignes au format LastName FirstName works in Department et triez le résultat par ordre alphabétique selon le nom de famille de l'employé.

Exigences

  • Toutes les opérations doivent être effectuées dans le répertoire ~/project.
  • Utilisez la commande join pour combiner les données de employees.txt et departments.txt.
  • Utilisez awk pour formater la sortie.
  • Le résultat final doit être enregistré dans un fichier nommé employee_departments.txt.
  • Chaque ligne de sortie doit respecter le format LastName FirstName works in Department.
  • La sortie doit être triée par ordre alphabétique selon le premier champ, qui correspond au nom de famille de l'employé.

Exemple

Fichiers d'entrée (tronqués pour plus de concision) :

employees.txt :

1 John Doe
2 Jane Smith
3 Bob Johnson
...

departments.txt :

1 Sales
2 Marketing
3 Engineering
...

Résultat attendu dans employee_departments.txt (tronqué pour plus de concision) :

Allen Barbara works in Marketing
Anderson Emily works in Resources
Bailey Michelle works in Marketing
...

En d'autres termes, déplacez le nom de famille dans la première colonne avant d'effectuer le tri.

Résumé

Dans ce défi, vous avez exploré la puissante combinaison des commandes join et awk sous Linux, en travaillant sur un jeu de données important composé de 50 employés. En fusionnant les données de deux fichiers distincts, en les traitant avec awk et en triant les résultats, vous avez généré une sortie formatée qui combine les informations de manière utile. Cet exercice démontre comment ces commandes peuvent être utilisées pour traiter et combiner efficacement des données provenant de sources multiples, une tâche courante dans la manipulation de données et l'administration système. L'échelle des données dans ce défi souligne l'importance d'utiliser des outils en ligne de commande pour l'automatisation, car un traitement manuel serait chronophage et sujet aux erreurs.

✨ Vérifier la solution et pratiquer