[HCM] System Administrator – Managed Service (L3)
CMC TS tuyển System Engineer L3 cho Trung tâm Managed Service. Bạn sẽ chịu trách nhiệm chính về Problem Management và RCA, thực hiện các thay đổi , và cung cấp dịch vụ Technical Support chuyên sâu (health check, assessment, tư vấn cải tiến). Bạn cũng sẽ đóng vai trò kỹ thuật dẫn dắt cho đội ngũ L1/L2.
MÔ TẢ CÔNG VIỆC:
1. Escalation & xử lý sự cố L3
- Tiếp nhận các Incident được escalate từ L1/L2 và Service Desk, đặc biệt là sự cố P1/P2, sự cố ảnh hưởng nhiều hệ thống hoặc chưa xác định được nguyên nhân.
- Chủ trì xử lý sự cố nghiêm trọng (Major Incident): khoanh vùng, điều phối các team liên quan đến System và đưa ra quyết định kỹ thuật để khôi phục dịch vụ trong SLA.
- Làm việc trực tiếp với vendor (Microsoft, VMware/Broadcom, Veeam…) khi cần mở case và theo dõi đến khi đóng.
2. Problem Management & RCA
- Chịu trách nhiệm chính (owner) về RCA cho sự cố nghiêm trọng hoặc lặp lại.
- Báo cáo RCA gửi khách hàng cần rõ nguyên nhân gốc, tác động và hành động khắc phục/phòng ngừa.
- Phân tích xu hướng Incident và cảnh báo trên nhiều khách hàng để phát hiện các vấn đề tiềm ẩn (Known Error), đề xuất và theo dõi các preventive action đến khi hoàn tất.
3. Change & quản trị hạ tầng nâng cao
- Lập kế hoạch, đánh giá rủi ro và thực hiện các Change có mức độ rủi ro cao: nâng cấp vSphere/vCenter, AD/DC migration, thay đổi GPO diện rộng, patching hạ tầng lõi… Mỗi Change cần có kế hoạch rollback và trình bày trước CAB.
- Quản trị chuyên sâu Windows Server, Linux, Active Directory, DNS, DHCP, GPO, PKI; M365/Entra ID là lợi thế.
- Vận hành, tối ưu và troubleshooting VMware vSphere/vCenter, Hyper-V (cluster, HA/DRS, storage, networking).
- Thiết kế và kiểm tra chính sách Backup & Recovery (ưu tiên Veeam), định kỳ thực hiện restore test và DR drill.
- Đánh giá hiệu năng và capacity, dự báo nhu cầu tài nguyên và đưa ra khuyến nghị cho khách hàng.
4. Technical Support chuyên sâu cho khách hàng
- Thực hiện các gói Technical Support: health check, assessment, security hardening, review cấu hình hạ tầng. Kết quả gồm báo cáo và khuyến nghị cải tiến.
- Tư vấn kỹ thuật cho khách hàng về tối ưu vận hành, nâng cấp, migration và các chuẩn best practice.
- Hỗ trợ đội Presales/Consulting: khảo sát hiện trạng, ước lượng effort và đóng góp phần kỹ thuật cho proposal/SOW.
- Tham gia các dự án migration, upgrade, implementation và service transition khi tiếp nhận khách hàng mới.
- Hỗ trợ kỹ thuật kiểm tra và xử lý sự cố hệ thống Khách hàng
5. Monitoring, tự động hóa & chuẩn hóa vận hành
- Thiết kế và tinh chỉnh monitoring Prometheus/Grafana : ngưỡng cảnh báo, giảm cảnh báo nhiễu, bổ sung giám sát chủ động.
- Tự động hóa các tác vụ lặp lại bằng PowerShell, Bash hoặc Python (báo cáo, kiểm tra định kỳ, remediation).
- Xây dựng và duy trì runbook, SOP và knowledge base để L1/L2 tự xử lý được nhiều hơn, giảm số ca escalate.
6. Dẫn dắt kỹ thuật
- Hướng dẫn và coaching cho L1/L2; review cách xử lý ticket và chất lượng tài liệu.
- Tổ chức chia sẻ kiến thức nội bộ, đề xuất lộ trình nâng cao năng lực cho team.
YÊU CẦU:
- Tốt nghiệp Đại học/Cao đẳng ngành CNTT, Khoa học máy tính, Điện tử viễn thông hoặc liên quan.
- Tối thiểu 5 năm kinh nghiệm System Administration/System Engineering, trong đó có ít nhất 2 năm xử lý sự cố ở mức L3 hoặc vai trò senior trong môi trường production enterprise.
- Thành thạo Windows Server và Linux ở mức troubleshooting chuyên sâu (phân tích log, hiệu năng, network stack, boot/OS issue).
- Kinh nghiệm thực tế về quản trị và nâng cấp VMware vSphere/vCenter và/hoặc Hyper-V cluster.
- Kinh nghiệm thiết kế và vận hành Backup & Recovery (ưu tiên Veeam), đã từng thực hiện restore/DR thực tế.
- Nắm vững Active Directory, DNS, GPO; đã từng xử lý sự cố replication, authentication, GPO conflict.
- Đã từng viết RCA, lập kế hoạch Change và làm việc theo ITIL (Incident/Problem/Change/Request).
- Có khả năng viết script PowerShell, Bash hoặc Python để tự động hóa.
- Giao tiếp tốt với khách hàng, có khả năng trình bày vấn đề kỹ thuật cho cả người không chuyên. Chịu được áp lực khi xử lý sự cố nghiêm trọng.
- Tiếng Anh đọc hiểu tốt tài liệu kỹ thuật, viết email và làm việc được với vendor.
- Ưu tiên
- Kinh nghiệm tại MSP, Data Center,vận hành đồng thời nhiều khách hàng (đặc biệt ngành Tài chính – Ngân hàng, Bảo hiểm, Sản xuất).
- Kinh nghiệm với Microsoft 365, Entra ID, LPI, Docker, K8S ,Azure/AWS/GCP.
- Kiến thức về network và security cơ bản: firewall, load balancer, hardening, PAM.
- Kinh nghiệm Prometheus/Grafana, ELK hoặc tương đương.
- Chứng chỉ VCP, MCSE/Azure Administrator, RHCE/LPIC-2, Veeam VMCE, ITIL Foundation, .
THU NHẬP
- Lương thỏa thuận theo năng lực và vị trí công việc;
- Thưởng KPIs dựa vào kết quả đánh giá công việc quý/ năm tùy theo vị trí công việc;
- Gói phúc lợi tiền mặt 9 triệu/năm vào các dịp Lễ, Tết, Sinh nhật Tập đoàn...
- Xét tăng lương theo năng lực và kết quả công việc định kỳ 1 lần/năm. Hoặc tăng lương đột xuất theo hiệu quả công việc.
CHẾ ĐỘ ĐÃI NGỘ
- Đóng BHXH đầy đủ và BH sức khỏe CMC Care ngay khi ký Hợp đồng chính thức;
- Nghỉ phép: 12 ngày/ năm + 1 ngày nghỉ hưởng lương vào dịp sinh nhật bản thân;
- Được tham gia các chương trình đào tạo chuyên môn, nghiệp vụ từ cơ bản đến nâng cao. Tài trợ 100% chi phí tham gia các khóa học, thi chứng chỉ CNTT Quốc tế;
- Được trang bị laptop/thiết bị công nghệ trong quá trình làm việc;
- Môi trường trẻ, năng động và chuyên nghiệp;
- Tham gia Team building và các hoạt động văn hóa đa dạng;
- Được vinh danh các giải thưởng năm của Tập đoàn CMC, CMC TS và khen thưởng trên các thành tích xuất sắc (dự án, kinh doanh, quản trị);
- Thời gian làm việc: Thứ 2 - Thứ 6 (8:30-17:30).