ЁЯУИ рдзрдбрд╛ 11 тАФ Monitoring рдЖрдгрд┐ troubleshooting: рджреЛрди status checks, рджреЛрди рдЙрдкрд╛рдп
ЁЯУН рддреБрдореНрд╣реА рдЗрдереЗ рдЖрд╣рд╛рдд: 12 рдкреИрдХреА рдзрдбрд╛ 11 ┬╖ рдорд╛рдЧреАрд▓: lesson-10-load-balancing ┬╖ рдкреБрдвреАрд▓: lesson-12-lifecycle
ЁЯУж рдпрд╛ рдмреНрд░рдБрдЪрдордзреНрдпреЗ рдХрд╛рдп рдЖрд╣реЗ
рдзрдбреЗ 01тАУ10, рдЖрдгрд┐ рд╕рдорд╕реНрдпрд╛ рдХреЛрдгрд╛рдЪреА рдЖрд╣реЗ рд╣реЗ рдХрд╕реЗ рдУрд│рдЦрд╛рдпрдЪреЗ: system
status check (AWS рдЪреА рдмрд╛рдЬреВ) рд╡рд┐рд░реБрджреНрдз instance status check (рддреБрдордЪреА рдмрд╛рдЬреВ), рдлреБрдХрдЯ
рдорд┐рд│рдгрд╛рд░реЗ metrics рд╡рд┐рд░реБрджреНрдз рдлрдХреНрдд CloudWatch agent рд▓рд╛рдЪ рджрд┐рд╕рдгрд╛рд░реЗ metrics,
ec2/fleet.py рдордзреАрд▓ fleet.credits() рд╡рд░реВрди рдмрдирд╡рд▓реЗрд▓рд╛
CPUCreditBalance рд╡рд░рдЪрд╛ рдПрдХ alarm, рдЖрдгрд┐ "рдорд╛рдЭреНрдпрд╛ рдбреЗрд╕реНрдХрдкрд░реНрдпрдВрдд рдкреЛрд╣реЛрдЪрддрд╛ рдпреЗрдд
рдирд╛рд╣реА" рд╕рд╛рдареА troubleshooting рдЪрд╛ рдЫреЛрдЯрд╛ рдирдХрд╛рд╢рд╛.
ЁЯзТ 5 рд╡рд░реНрд╖рд╛рдВрдЪреНрдпрд╛ рдореБрд▓рд╛рд▓рд╛ рд╕рдордЬрд╛рд╡рд▓реНрдпрд╛рд╕рд╛рд░рдЦреЗ
рдкреНрд░рддреНрдпреЗрдХ рдбреЗрд╕реНрдХ рджрд░ рдорд┐рдирд┐рдЯрд╛рд▓рд╛ рджреЛрди рд╡реЗрдЧрд╡реЗрдЧрд│реЗ рдирд┐рд░реАрдХреНрд╖рдХ рддрдкрд╛рд╕рддрд╛рдд.
рдЗрдорд╛рд░рдд рдирд┐рд░реАрдХреНрд╖рдХ ЁЯПЧя╕П (system status check) рдбреЗрд╕реНрдХрдЪреНрдпрд╛ рдЦрд╛рд▓реА рдХрд╛рдп рдЖрд╣реЗ рддреЗ рдкрд╛рд╣рддреЛ: рдлрд░рд╢реА, рд╡реАрдЬреЗрдЪрд╛ socket, network cable тАФ рдХрдВрдкрдиреАрдЪреНрдпрд╛ рдорд╛рд▓рдХреАрдЪреНрдпрд╛ рдЧреЛрд╖реНрдЯреА. рддреЗ рдирд╛рдкрд╛рд╕ рдЭрд╛рд▓реЗ рддрд░ рдбреЗрд╕реНрдХрд╡рд░ рдмрд╕реВрди рддреБрдореНрд╣реА рдХрд╛рд╣реАрдЪ рджреБрд░реБрд╕реНрдд рдХрд░реВ рд╢рдХрдд рдирд╛рд╣реА. рддреБрдореНрд╣реА рдбреЗрд╕реНрдХ рджреБрд╕рд▒реНрдпрд╛ рдЬрд╛рдЧреА рд╣рд▓рд╡рддрд╛ (stop, рдордЧ start тАФ рдбреЗрд╕реНрдХ рдирд┐рд░реЛрдЧреА hardware рд╡рд░ рдкрд░рдд рдпреЗрддреЛ).
рдбреЗрд╕реНрдХ рдирд┐рд░реАрдХреНрд╖рдХ ЁЯФН (instance status check) рддреБрдордЪрд╛ рдбреЗрд╕реНрдХ рдкрд╛рд╣рддреЛ: рдХреЛрдгреА рдЙрддреНрддрд░ рджреЗрддреЗрдп рдХрд╛, рдбреНрд░реЙрд╡рд░ рдЗрддрдХрд╛ рднрд░рд▓рд╛рдп рдХрд╛ рдХреА рдХрд╛рд╣реАрдЪ рдЙрдШрдбрдд рдирд╛рд╣реА, рдХреЛрдгреА settings рдмрд┐рдШрдбрд╡рд▓реНрдпрд╛ рдХрд╛? рд╣реЗ рджреБрд░реБрд╕реНрдд рдХрд░рдгреЗ рддреБрдордЪреЗ рдХрд╛рдо: restart рдХрд░рд╛, рд╕реБрд░реВ рд╣реЛрддрд╛рдирд╛ рдбреЗрд╕реНрдХрдиреЗ рдХрд╛рдп рдЫрд╛рдкрд▓реЗ рддреЗ рд╡рд╛рдЪрд╛ (console log), рджреБрд░реБрд╕реНрдд рдХрд░рд╛.
рдЖрдгрд┐ рдХрд╛рд╣реА рдЧреЛрд╖реНрдЯреА рдХреЛрдгрддреНрдпрд╛рдЪ рдирд┐рд░реАрдХреНрд╖рдХрд╛рд▓рд╛ рдмрд╛рд╣реЗрд░реВрди рджрд┐рд╕рдд рдирд╛рд╣реАрдд тАФ рддреБрдордЪрд╛ рдбреНрд░реЙрд╡рд░ рдХрд┐рддреА рднрд░рд▓рд╛рдп, рддреБрдордЪреЗ programs рдХрд┐рддреА memory рд╡рд╛рдкрд░рддрд╛рдд. рддреНрдпрд╛рдВрдЪреНрдпрд╛рд╕рд╛рдареА рддреБрдореНрд╣реА рдбреЗрд╕реНрдХрд╡рд░ рдПрдХ рдЫреЛрдЯрд╛ reporter рдареЗрд╡рддрд╛ (CloudWatch agent) рдЬреЛ рддреЗ рд▓рд┐рд╣реВрди рдкрд╛рдард╡рддреЛ.
ЁЯЧ║я╕П рдЖрдХреГрддреА
flowchart LR
sys["тЭМ system status check<br/>AWS hardware, power, network under the desk"]
inst["тЭМ instance status check<br/>your OS: full disk, bad config, kernel, memory"]
fix1["тП╣я╕П stop + start тЖТ new host<br/>or automatic recovery"]
fix2["ЁЯФБ reboot ┬╖ read the console log ┬╖ fix the OS"]
sys -->|"1 AWS's side"| fix1
inst -->|"2 your side"| fix2
free["ЁЯУК free every 5 min: CPU, network, disk I/O, CPUCreditBalance"]
agent["ЁЯз╛ CloudWatch agent: memory, disk space used, logs"]
alarm["ЁЯФФ alarm: CPUCreditBalance below 50<br/>fires an hour before the throttle"]
free -->|"3"| alarm
agent -.->|"4 what the hypervisor cannot see"| alarm
ЁЯЧ║я╕П рдХрд╛рдврд▓реЗрд▓реА рдЖрдХреГрддреА + рдПрдХ lab: https://school-edh.pages.dev/ec2/lesson-diagrams.html#l11
тЭУ рдХрд╛рдп
- Status checks тАФ рджрд░ рдорд┐рдирд┐рдЯрд╛рд▓рд╛ рдЪрд╛рд▓рддрд╛рдд, рдкреНрд░рддреНрдпреЗрдХ рдкрд╛рд╕ рдХрд┐рдВрд╡рд╛ рдирд╛рдкрд╛рд╕ рд╣реЛрддреЛ:
- System status check тАФ instance рдЬреНрдпрд╛рд╡рд░ рдЪрд╛рд▓рддреЛ рддреА AWS рдЪреА infrastructure
(host hardware, рд╡реАрдЬ, network reachability). рдЙрдкрд╛рдп: stop рдЖрдгрд┐ start
(EBS-backed instances рдирд╡реНрдпрд╛ host рд╡рд░ рдЬрд╛рддрд╛рдд), рдХрд┐рдВрд╡рд╛ automatic recovery /
recoveraction рдЕрд╕рд▓реЗрд▓реНрдпрд╛ CloudWatch alarm рд▓рд╛ рддреЗ рдХрд░реВ рджреНрдпрд╛. - Instance status check тАФ рддреБрдордЪреА operating system рдЖрдгрд┐ configuration
(boot рдЕрдпрд╢рд╕реНрд╡реА, disk рднрд░рд▓реЗрд▓рд╛, memory рд╕рдВрдкрд▓реЗрд▓реА, рдмрд┐рдШрдбрд▓реЗрд▓рд╛ network config). рдЙрдкрд╛рдп:
reboot, рдордЧ
get-console-outputрдХрд┐рдВрд╡рд╛ console screenshot рд╡рд╛рдЪрд╛, рдХрд┐рдВрд╡рд╛ EC2 Serial Console рд╡рд╛рдкрд░рд╛ (рдзрдбрд╛ 06). - рдирд╡реЗ instances рддреНрдпрд╛рдВрдирд╛ рдЬреЛрдбрд▓реЗрд▓реНрдпрд╛ volumes рд╕рд╛рдареА attached EBS status check рджреЗрдЦреАрд▓ рдХрд│рд╡рддрд╛рдд.
- System status check тАФ instance рдЬреНрдпрд╛рд╡рд░ рдЪрд╛рд▓рддреЛ рддреА AWS рдЪреА infrastructure
(host hardware, рд╡реАрдЬ, network reachability). рдЙрдкрд╛рдп: stop рдЖрдгрд┐ start
(EBS-backed instances рдирд╡реНрдпрд╛ host рд╡рд░ рдЬрд╛рддрд╛рдд), рдХрд┐рдВрд╡рд╛ automatic recovery /
- CloudWatch metrics тАФ
CPUUtilization, network, disk I/O,StatusCheckFailed*рдЖрдгрд┐ burstable types рд╕рд╛рдареАCPUCreditBalance/CPUCreditUsage: рджрд░ 5 рдорд┐рдирд┐рдЯрд╛рдВрдиреА рдлреБрдХрдЯ (basic monitoring) рдХрд┐рдВрд╡рд╛ detailed monitoring (рд╕рд╢реБрд▓реНрдХ) рд╕рд╣ рджрд░ 1 рдорд┐рдирд┐рдЯрд╛рдиреЗ. - Hypervisor рд▓рд╛ рдХрд╛рдп рджрд┐рд╕рдд рдирд╛рд╣реА тАФ memory рд╡рд╛рдкрд░ рдЖрдгрд┐ рд╡рд╛рдкрд░рд▓реЗрд▓реА disk space рддреБрдордЪреНрдпрд╛ OS рдЪреНрдпрд╛ рдЖрдд рдЕрд╕рддрд╛рдд. CloudWatch agent install рдХрд░рд╛ (рддреЛ log files рд╕реБрджреНрдзрд╛ рдкрд╛рдард╡реВ рд╢рдХрддреЛ).
- Alarms тАФ рдПрдХ metric, рдПрдХ threshold, periods рдЪреА рд╕рдВрдЦреНрдпрд╛, рдЖрдгрд┐ рдПрдХ action (SNS notification, Auto Scaling policy, рдХрд┐рдВрд╡рд╛ recover/reboot рд╕рд╛рд░рдЦрд╛ EC2 action). рдЬреНрдпрд╛рд╡рд░ рдорд╛рдгрд╕рд╛рд▓рд╛ рдХреГрддреА рдХрд░рд╛рд╡реА рд▓рд╛рдЧрддреЗ рддреНрдпрд╛рд╡рд░рдЪ alarm рд▓рд╛рд╡рд╛, рдХреГрддреА рдХрд░рддрд╛ рдпреЗрдИрд▓ рдЗрддрдХреНрдпрд╛ рд▓рд╡рдХрд░.
- "рдкреЛрд╣реЛрдЪрддрд╛ рдпреЗрдд рдирд╛рд╣реА" рдирдХрд╛рд╢рд╛ тАФ timeout тЖТ SG, NACL, route table, public IP (рдзрдбрд╛ 05); connection refused тЖТ packet рдкреЛрд╣реЛрдЪрд▓рд╛, рдкрдг рдХреЛрдгреА рдРрдХрдд рдирд╛рд╣реА (service рдмрдВрдж рдЖрд╣реЗ рдХрд┐рдВрд╡рд╛ рджреБрд╕рд▒реНрдпрд╛ port рд╡рд░ рдЖрд╣реЗ); Permission denied (publickey) тЖТ рдЪреБрдХреАрдЪрд╛ user рдХрд┐рдВрд╡рд╛ key (рдзрдбрд╛ 06); status checks рдирд╛рдкрд╛рд╕ тЖТ рд╣рд╛ рдзрдбрд╛.
- Scheduled events тАФ AWS host retirement рдЖрдгрд┐ maintenance рдЪреА рдЖрдзреАрдЪ рдШреЛрд╖рдгрд╛
рдХрд░рддреЛ;
describe-instance-statusрддреНрдпрд╛рдВрдЪреА рдпрд╛рджреА рджреЗрддреЛ. рддреНрдпрд╛ рддрд╛рд░рдЦреЗрдЖрдзреА stop/start рдХреЗрд▓реНрдпрд╛рд╕ рддреБрдореНрд╣реА рддреБрдордЪреНрдпрд╛ рд╕реЛрдпреАрдЪреНрдпрд╛ рд╡реЗрд│реА рд╣рд▓рддрд╛.
ЁЯдФ рдХрд╛
рдХрд╛рд░рдг incident рдЪреЗ рдкрд╣рд┐рд▓реЗ рдорд┐рдирд┐рдЯ рд╕рдорд╕реНрдпрд╛ рдХреЛрдгрд╛рдЪреА рдЖрд╣реЗ рд╣реЗ рдард░рд╡рдгреНрдпрд╛рдд рдЬрд╛рддреЗ тАФ рдЖрдгрд┐ рддреБрдореНрд╣реА terminal рдЙрдШрдбрдгреНрдпрд╛рдЖрдзреАрдЪ рджреЛрди status checks рддреНрдпрд╛рдЪреЗ рдЙрддреНрддрд░ рджреЗрддрд╛рдд. рдЖрдгрд┐ рдХрд╛рд░рдг рдЬреЗ graphs рддреБрдореНрд╣реА рдЧреЛрд│рд╛ рдХреЗрд▓реЗ рдирд╛рд╣реАрдд рддреЗрдЪ рддреБрдореНрд╣рд╛рд▓рд╛ рд╣рд╡реЗ рдЕрд╕рддрд╛рдд: memory рдЖрдгрд┐ disk space рд╣реА рдЖрдЬрд╛рд░реА рдбреЗрд╕реНрдХрдЪреА рджреЛрди рд╕рд░реНрд╡рд╛рдд рд╕рд╛рдорд╛рдиреНрдп рдХрд╛рд░рдгреЗ рдЖрд╣реЗрдд, рдЖрдгрд┐ default рдиреЗ рдпрд╛рддрд▓реЗ рдХрд╛рд╣реАрдЪ рдЧреЛрд│рд╛ рд╣реЛрдд рдирд╛рд╣реА.
ЁЯФз рдХрд╕реЗ (рдпрд╛ repo рдордзреНрдпреЗ)
ec2/demo.py рдордзреАрд▓ monitoring() рджреЛрди checks рддреНрдпрд╛рдВрдЪреНрдпрд╛ рдЙрдкрд╛рдпрд╛рдВрд╕рд╣ рдЫрд╛рдкрддреЗ,
рдХрд╛рдп рдлреБрдХрдЯ рдЧреЛрд│рд╛ рд╣реЛрддреЗ рдЖрдгрд┐ рдХрд╛рдп рдирд╛рд╣реА рддреЗ рд╕рд╛рдВрдЧрддреЗ, рдЖрдгрд┐ рдордЧ рдзрдбрд╛ 02 рдордзрд▓рд╛ busy
t3.micro run (fleet.credits(3)) рдкреБрдиреНрд╣рд╛ рд╡рд╛рдкрд░реВрди CPUCreditBalance < 20 рд╡рд░рдЪрд╛ alarm
рдХреЛрдгрддреНрдпрд╛ рддрд╛рд╕рд╛рд▓рд╛ рд╡рд╛рдЬреЗрд▓ рддреЗ рд╢реЛрдзрддреЗ. рдЦрд╛рд▓рдЪрд╛ snippet threshold 50 рд╡рд░ рдиреЗрддреЛ
рдЖрдгрд┐ рдкреВрд░реНрдг рднрд░рд▓реЗрд▓реНрдпрд╛ рдЯрд╛рдХреАрдкрд╛рд╕реВрди рд╕реБрд░реВ рдХрд░рддреЛ, рдореНрд╣рдгрдЬреЗ throttle рдЖрдзреАрдЪ рдЗрд╢рд╛рд░рд╛ рджреЗрдгрд╛рд░рд╛
alarm рджрд┐рд╕рддреЛ.
ЁЯзк рдХрд░реВрди рдкрд╛рд╣рд╛
python3 ec2/demo.py monitoring
python3 - <<'EOF'
import sys; sys.path.insert(0, "ec2"); import fleet
# a t3.micro at 40% on both vCPUs, starting with a full tank (288). When does CPUCreditBalance < 50 fire?
for h, bal, got in fleet.credits(9, busy_pct=40, start_balance=288):
print(f"hour {h}: {bal:>5} credits ┬╖ CPU {got}%{' ЁЯФФ ALARM: CPUCreditBalance < 50' if bal < 50 else ''}")
EOF
рдЦрд▒реНрдпрд╛ account рд╡рд░ (AWS credentials рд▓рд╛рдЧрддрд╛рдд; alarms рд╕рд╛рдареА рджрд░ рдорд╣рд┐рдиреНрдпрд╛рд▓рд╛ рдереЛрдбрд╛ рдЦрд░реНрдЪ рдпреЗрддреЛ тАФ рддреБрдордЪрд╛ рд╕реНрд╡рддрдГрдЪрд╛ instance ID рдЖрдгрд┐ SNS topic рд╡рд╛рдкрд░рд╛):
aws ec2 describe-instance-status --instance-ids i-0123456789abcdef0 --include-all-instances
aws ec2 get-console-output --instance-id i-0123456789abcdef0 --latest --output text
aws cloudwatch put-metric-alarm --alarm-name web-a-credits-low \
--namespace AWS/EC2 --metric-name CPUCreditBalance \
--dimensions Name=InstanceId,Value=i-0123456789abcdef0 \
--statistic Average --period 300 --evaluation-periods 2 \
--threshold 50 --comparison-operator LessThanThreshold \
--alarm-actions arn:aws:sns:us-east-1:123456789012:school-oncall
aws cloudwatch put-metric-alarm --alarm-name web-a-system-check \
--namespace AWS/EC2 --metric-name StatusCheckFailed_System \
--dimensions Name=InstanceId,Value=i-0123456789abcdef0 \
--statistic Maximum --period 60 --evaluation-periods 2 \
--threshold 1 --comparison-operator GreaterThanOrEqualToThreshold \
--alarm-actions arn:aws:automate:us-east-1:ec2:recover
тЬЕ рддрдкрд╛рд╕рд╛ тАФ рддреБрдореНрд╣рд╛рд▓рд╛ рдХрд╛рдп рджрд┐рд╕рд╛рдпрд▓рд╛ рд╣рд╡реЗ
monitoring рдЫрд╛рдкрддреЗ тЭМ system status check тЖТ AWS's hardware or network under your desk тЖТ stop + start (moves to a new host),
тЭМ instance status check тЖТ YOUR operating system (full disk, bad config, kernel) тЖТ reboot, read the console log, fix,
memory рдЖрдгрд┐ disk-space-used рд╕рд╛рдареА CloudWatch agent рд▓рд╛рдЧрддреЛ рд╣реА рд╕реВрдЪрдирд╛, рдЖрдгрд┐
ЁЯФФ alarm idea: CPUCreditBalance < 20 тЖТ in the busy run above it fires from hour 2.
рддреБрдордЪрд╛ snippet рджрд░ рддрд╛рд╕рд╛рд▓рд╛ 36 credits рд╕рдВрдкрд╡рддреЛ тАФ 252.0, 216.0, тАж тАФ рддрд╛рд╕ 7 рд▓рд╛
ЁЯФФ ALARM рд╡рд╛рдЬрддреЛ (36.0 credits ┬╖ CPU 40%), рдЖрдгрд┐ рдлрдХреНрдд рддрд╛рд╕ 8 рд▓рд╛
CPU 10% рдкрд░реНрдпрдВрдд рдШрд╕рд░рддреЛ (0.6 credits). Alarm рдиреЗ рддреБрдореНрд╣рд╛рд▓рд╛ рдПрдХ рддрд╛рд╕ рдорд┐рд│рд╡реВрди рджрд┐рд▓рд╛.
ЁЯПБ рддреБрдореНрд╣реА рдЖрддреНрддрд╛рдЪ рдХрд╛рдп рд╕рд┐рджреНрдз рдХреЗрд▓реЗ
AWS рдЪреА рд╕рдорд╕реНрдпрд╛ рдЖрдгрд┐ рддреБрдордЪреА рд╕рдорд╕реНрдпрд╛ рддреБрдореНрд╣реА рдПрдХрд╛ рдирдЬрд░реЗрдд рдУрд│рдЦреВ рд╢рдХрддрд╛, рдХреЛрдгрддреЗ рдЖрдХрдбреЗ рдлреБрдХрдЯ рдорд┐рд│рддрд╛рдд рдЖрдгрд┐ рдХреЛрдгрддреНрдпрд╛рдВрд╕рд╛рдареА agent рд▓рд╛рдЧрддреЛ рд╣реЗ рддреБрдореНрд╣рд╛рд▓рд╛ рдорд╛рд╣реАрдд рдЖрд╣реЗ, рдЖрдгрд┐ рдХреГрддреА рдХрд░рд╛рдпрд▓рд╛ рдЕрдЬреВрди рд╡реЗрд│ рдЕрд╕рддрд╛рдирд╛рдЪ рд╡рд╛рдЬрдгрд╛рд░рд╛ alarm рддреБрдореНрд╣реА рд▓рд╛рд╡рд▓рд╛.
тЪая╕П рдиреЗрд╣рдореАрдЪреНрдпрд╛ рдЪреБрдХрд╛
- system check рдирд╛рдкрд╛рд╕ рдЭрд╛рд▓реНрдпрд╛рд╡рд░ reboot рдХрд░рдгреЗ тАФ reboot рддреНрдпрд╛рдЪ host рд╡рд░ рд░рд╛рд╣рддреЛ; рддреНрдпрд╛рдРрд╡рдЬреА stop рдЖрдгрд┐ start рдХрд░рд╛
- instance store рд╡рд░ data рдЕрд╕рд▓реЗрд▓рд╛ instance "рджреБрд░реБрд╕реНрдд" рдХрд░рдгреНрдпрд╛рд╕рд╛рдареА stop рдХрд░рдгреЗ тАФ рдЦрд░рдбрд╡рд╣реА рдкреБрд╕рд▓реА рдЬрд╛рддреЗ (рдзрдбрд╛ 04)
- disk рднрд░рдгреНрдпрд╛рдЪреНрдпрд╛ рджрд┐рд╡рд╕рд╛рдкрд░реНрдпрдВрдд memory рдХрд┐рдВрд╡рд╛ disk-space metrics рдирд╕рдгреЗ
- рдкреНрд░рддреНрдпреЗрдХ рдЧреЛрд╖реНрдЯреАрд╡рд░ alarms, рддреНрдпрд╛рдореБрд│реЗ рдХреЛрдгреАрдЪ рддреЗ рд╡рд╛рдЪрдд рдирд╛рд╣реА тАФ рдХрд┐рдВрд╡рд╛ рдХрд╢рд╛рд╡рд░рдЪ рдирд╛рд╣реА, рддреНрдпрд╛рдореБрд│реЗ outage users рдХрд│рд╡рддрд╛рдд
- instance рддреБрдордЪреНрдпрд╛рд╕рд╛рдареА stop рд╣реЛрдИрдкрд░реНрдпрдВрдд scheduled retirement events рдХрдбреЗ рджреБрд░реНрд▓рдХреНрд╖ рдХрд░рдгреЗ
ЁЯПн рдкреНрд░рддреНрдпрдХреНрд╖ рд╡рд╛рдкрд░рд╛рдд рд╣реЗ рдХрд╛ рдорд╣рддреНрддреНрд╡рд╛рдЪреЗ: рдПрдХрд╛ рд╕рд╛рдорд╛рдиреНрдп EC2 dashboard рд╡рд░ status checks, CPU, burstable types рд╕рд╛рдареА credit balance, agent рдХрдбреВрди memory рдЖрдгрд┐ disk, рдЖрдгрд┐ load balancer рдЪрд╛ healthy-host count рд╡ 5xx rate рдЕрд╕рддрд╛рдд тАФ рдЬреНрдпрд╛рд▓рд╛ рдорд╛рдгреВрд╕ рд▓рд╛рдЧрддреЛ рддреНрдпрд╛рд╡рд░ page рдХрд░рдгрд╛рд░реЗ рдЖрдгрд┐ рдЬреНрдпрд╛рд▓рд╛ рд▓рд╛рдЧрдд рдирд╛рд╣реА рддреЗ рдЖрдкреЛрдЖрдк recover рдХрд░рдгрд╛рд░реЗ alarms рд╕рд╣.
тПня╕П рдкреБрдвреЗ
рд╢реЗрд╡рдЯрдЪрд╛ рдзрдбрд╛: рд░рд╛рддреНрд░реАрдЪреА photocopy, рд╕реЛрдиреЗрд░реА рд╕рд╛рдЪрд╛, рдЖрдгрд┐ stop, hibernate рдЖрдгрд┐ terminate рдЦрд░реЛрдЦрд░ рдХрд╛рдп рдареЗрд╡рддрд╛рдд. Backup, patching рдЖрдгрд┐ lifecycle.
git checkout lesson-12-lifecycle