Обработка данных о сотрудниках

LinuxBeginner
Практиковаться сейчас

Введение

В мире утилит командной строки Linux команды join и awk являются мощными инструментами, которые значительно расширяют возможности обработки данных. В этом задании вам предстоит проверить умение эффективно применять эти команды для обработки и объединения данных из нескольких источников, работая с большим набором данных, требующим автоматизации.

Объединение и обработка данных

Задачи

  1. Используйте команду join, чтобы объединить данные из двух файлов: employees.txt и departments.txt.
  2. Обработайте объединённые данные с помощью awk, создав отформатированный вывод.
  3. Создайте строки в формате LastName FirstName works in Department и отсортируйте результат по алфавиту, используя фамилии сотрудников.

Требования

  • Все операции необходимо выполнять в каталоге ~/project.
  • Используйте команду join для объединения данных из employees.txt и departments.txt.
  • Используйте awk для форматирования вывода.
  • Итоговый результат сохраните в файле employee_departments.txt.
  • Каждая строка результата должна соответствовать формату LastName FirstName works in Department.
  • Результат необходимо отсортировать по алфавиту по первому полю — фамилии сотрудника.

Пример

Входные файлы (для краткости показана только часть содержимого):

employees.txt:

1 John Doe
2 Jane Smith
3 Bob Johnson
...

departments.txt:

1 Sales
2 Marketing
3 Engineering
...

Ожидаемый результат в employee_departments.txt (для краткости показана только часть содержимого):

Allen Barbara works in Marketing
Anderson Emily works in Resources
Bailey Michelle works in Marketing
...

Иными словами, перед сортировкой необходимо переместить фамилию в первый столбец.

Итоги

В этом задании вы изучили эффективное сочетание команд join и awk в Linux, работая с большим набором данных, содержащим сведения о 50 сотрудниках. Объединив данные из двух отдельных файлов, обработав их с помощью awk и отсортировав результат, вы создали отформатированный вывод, объединяющий информацию удобным для использования образом. Это упражнение показывает, как эти команды можно применять для эффективной обработки и объединения данных из нескольких источников — распространённой задачи при работе с данными и администрировании систем. Значительный объём данных в этом задании подчёркивает важность инструментов командной строки для автоматизации: ручная обработка заняла бы много времени и с большой вероятностью привела бы к ошибкам.

✨ Проверить решение и практиковаться