Лаб. работа "Мониторинг и анализ системы Linux"

Лабораторная работа по теме “Мониторинг и анализ системы Linux”


Цель работы

Изучить инструменты мониторинга и анализа производительности операционной системы Linux. Получить практические навыки использования системных утилит для отслеживания использования ресурсов, диагностики проблем производительности и анализа состояния системы в реальном времени.

Теоретические сведения

Мониторинг системы в Linux включает в себя отслеживание использования различных ресурсов: процессора, памяти, дискового пространства, сетевых интерфейсов и других компонентов системы. Эти инструменты критически важны для системных администраторов, DevOps-инженеров и разработчиков для обеспечения стабильной работы приложений и выявления узких мест в производительности.

Основные категории системного мониторинга:

1. Мониторинг процессора:

  • top - интерактивный просмотр процессов
  • htop - улучшенная версия top
  • uptime - время работы системы и средняя нагрузка
  • mpstat - статистика процессора

2. Мониторинг памяти:

  • free - использование оперативной памяти
  • vmstat - статистика виртуальной памяти
  • /proc/meminfo - детальная информация о памяти

3. Мониторинг дисков:

  • df - использование дискового пространства
  • du - анализ использования пространства каталогами
  • iostat - статистика ввода/вывода
  • iotop - мониторинг дисковой активности в реальном времени

4. Системная информация:

  • uname - информация о системе
  • lscpu - информация о процессоре
  • lsblk - информация о блочных устройствах
  • dmesg - системные сообщения ядра

5. Логи и системные события:

  • journalctl - просмотр системных логов (systemd)
  • tail - просмотр конца файлов
  • grep - поиск в логах

Необходимое программное обеспечение

  1. Операционная система Linux (Ubuntu, CentOS, Debian)
  2. Терминал с доступом к системе
  3. Права обычного пользователя (для большинства команд)
  4. Права суперпользователя (для некоторых диагностических команд)

Ход работы

Задание 1. Общая информация о системе

  1. Получите общую информацию о системе:
1uname -a
  1. Узнайте время работы системы:
1uptime
  1. Получите информацию о процессоре:
1lscpu
  1. Проверьте информацию о памяти:
1cat /proc/meminfo

Задание 2. Мониторинг процессора

  1. Запустите top для просмотра процессов в реальном времени:
1top

Нажмите q для выхода. Обратите внимание на:

  • Общую загрузку процессора (%Cpu(s))
  • Список процессов с наибольшим использованием CPU
  • Информацию о памяти в верхней части
  1. Используйте htop (если установлен) для более удобного просмотра:
1htop
  1. Получите статистику процессора:
1mpstat 1 3

Эта команда покажет статистику процессора каждые 1 секунду, 3 раза.

Задание 3. Анализ использования памяти

  1. Проверьте использование оперативной памяти:
1free -h
  1. Получите детальную информацию о памяти:
1cat /proc/meminfo | grep -E "MemTotal|MemFree|MemAvailable|Cached"
  1. Проверьте использование swap:
1swapon --show
  1. Используйте vmstat для мониторинга виртуальной памяти:
1vmstat 2 5

Задание 4. Мониторинг дискового пространства

  1. Проверьте использование дискового пространства:
1df -h
  1. Найдите самые большие каталоги в домашней папке:
1du -sh ~/* | sort -hr | head -10
  1. Проверьте информацию о блочных устройствах:
1lsblk
  1. Мониторьте дисковую активность:
1iotop

Нажмите q для выхода.

Задание 5. Анализ процессов

  1. Найдите процессы, потребляющие больше всего CPU:
1ps aux --sort=-%cpu | head -10
  1. Найдите процессы, потребляющие больше всего памяти:
1ps aux --sort=-%mem | head -10
  1. Найдите конкретный процесс по имени:
1pgrep -l bash
  1. Получите детальную информацию о процессе:
1ps -p $(pgrep bash | head -1) -f

Задание 6. Системные логи

  1. Просмотрите последние системные сообщения:
1journalctl -n 20
  1. Просмотрите логи за последний час:
1journalctl --since "1 hour ago"
  1. Найдите ошибки в системных логах:
1journalctl -p err
  1. Следите за логами в реальном времени:
1journalctl -f

Нажмите Ctrl+C для остановки.

Задание 7. Мониторинг сетевой активности

  1. Проверьте сетевые интерфейсы:
1ip -s link show
  1. Просмотрите сетевые соединения:
1ss -s
  1. Мониторьте сетевой трафик (требует установки iftop):
1sudo iftop

Задание 8. Создание скрипта мониторинга

Создайте скрипт system_monitor.sh, который собирает основную информацию о системе:

 1#!/bin/bash
 2
 3echo "=== МОНИТОРИНГ СИСТЕМЫ ==="
 4echo "Дата и время: $(date)"
 5echo
 6
 7echo "=== ИНФОРМАЦИЯ О СИСТЕМЕ ==="
 8echo "ОС: $(uname -s)"
 9echo "Ядро: $(uname -r)"
10echo "Архитектура: $(uname -m)"
11echo "Время работы: $(uptime -p)"
12echo
13
14echo "=== ЗАГРУЗКА ПРОЦЕССОРА ==="
15uptime
16echo
17
18echo "=== ИСПОЛЬЗОВАНИЕ ПАМЯТИ ==="
19free -h
20echo
21
22echo "=== ДИСКОВОЕ ПРОСТРАНСТВО ==="
23df -h | head -10
24echo
25
26echo "=== ТОП-5 ПРОЦЕССОВ ПО CPU ==="
27ps aux --sort=-%cpu | head -6
28echo
29
30echo "=== ТОП-5 ПРОЦЕССОВ ПО ПАМЯТИ ==="
31ps aux --sort=-%mem | head -6
32echo
33
34echo "=== СЕТЕВЫЕ СОЕДИНЕНИЯ ==="
35ss -tuln | head -10

Сделайте скрипт исполняемым:

1chmod +x system_monitor.sh

Запустите его:

1./system_monitor.sh

Задания для самостоятельной работы

Задание 9. Анализ производительности

  1. Создайте нагрузку на систему и проанализируйте ее:
1# Запустите несколько процессов для создания нагрузки
2yes > /dev/null &
3yes > /dev/null &
4sleep 60
5killall yes
  1. Во время нагрузки запустите мониторинг:
1# В другом терминале
2top
  1. Проанализируйте результаты и сделайте выводы о поведении системы.

Задание 10. Диагностика проблем

  1. Создайте скрипт troubleshoot.sh, который:
 1#!/bin/bash
 2
 3echo "=== ДИАГНОСТИКА СИСТЕМЫ ==="
 4
 5# Проверка загрузки системы
 6LOAD=$(uptime | awk -F'load average:' '{print $2}' | awk '{print $1}' | sed 's/,//')
 7echo "Средняя загрузка: $LOAD"
 8
 9# Проверка использования памяти
10MEM_USAGE=$(free | grep Mem | awk '{printf("%.1f"), $3/$2 * 100.0}')
11echo "Использование памяти: $MEM_USAGE%"
12
13# Проверка дискового пространства
14DISK_USAGE=$(df / | tail -1 | awk '{print $5}' | sed 's/%//')
15echo "Использование диска: $DISK_USAGE%"
16
17# Проверка процессов
18PROCESS_COUNT=$(ps aux | wc -l)
19echo "Количество процессов: $PROCESS_COUNT"
20
21# Проверка критических ситуаций
22if (( $(echo "$LOAD > 2.0" | bc -l) )); then
23    echo "ВНИМАНИЕ: Высокая загрузка системы!"
24fi
25
26if (( $(echo "$MEM_USAGE > 90" | bc -l) )); then
27    echo "ВНИМАНИЕ: Мало свободной памяти!"
28fi
29
30if (( DISK_USAGE > 90 )); then
31    echo "ВНИМАНИЕ: Мало места на диске!"
32fi
33
34echo "=== ЗАВЕРШЕНО ==="

Контрольные вопросы

  1. Какая команда показывает общую загрузку системы?
  2. Что означают три числа в выводе команды uptime?
  3. В чем разница между free -h и cat /proc/meminfo?
  4. Как найти процесс, который больше всего использует CPU?
  5. Что показывает команда df -h?
  6. Как просмотреть системные логи в реальном времени?
  7. В чем разница между ps aux и top?
  8. Как проверить использование swap?
  9. Что означает статус процесса в выводе ps?
  10. Какой инструмент лучше использовать для мониторинга дисковой активности?

Дополнительные материалы

  • man top - справочная страница top
  • man free - справочная страница free
  • man ps - справочная страница ps
  • man uptime - справочная страница uptime
  • man journalctl - справочная страница journalctl
← Лаб. работа "Сетевые инструменты в Linux" Лаб. работа "Основы Docker. Управление … →