Mô tả công việc
DevOps - TA192

Yêu cầu công việc

1. Vận hành và quản lý hệ thống được phân công / Operate and manage assigned systems

  • Hệ thống vận hành ổn định, liên tục, đáp ứng SLA / Systems operate stably and continuously, meeting SLA
  • Các tác vụ vận hành được thực hiện đầy đủ, chính xác, đúng thời hạn / Operational tasks are completed accurately and on time 

2. Giám sát và đảm bảo ổn định hệ thống / Monitor and ensure system stability 

  • Các vấn đề tiềm ẩn được phát hiện và xử lý sớm / Potential issues are detected and resolved early
  • Giảm thiểu rủi ro gián đoạn dịch vụ / Service disruption risks are minimized 

3. Xử lý sự cố phức tạp trong phạm vi hệ thống / Handle complex incidents within scope 

  • Sự cố được xử lý hiệu quả, đảm bảo SLA / Incidents are resolved effectively within SLA
  • Xác định được nguyên nhân gốc rễ ở mức component hoặc integration / Root causes are identified at component or integration level
  • Giảm thiểu sự cố lặp lại / Recurring incidents are reduced 

4. Phối hợp xử lý sự cố và vận hành với các bên liên quan / Coordinate issue resolution with stakeholders 

  • Sự cố được xử lý triệt để thông qua phối hợp hiệu quả / Incidents are resolved thoroughly through effective coordination
  • Thời gian xử lý và downtime được giảm thiểu / Resolution time and downtime are minimized 

5. Tham gia triển khai change/release và sáng kiến / Participate in change/release and initiatives 

  • Các thay đổi được triển khai đúng quy trình, hạn chế lỗi sau golive / Changes are implemented properly with minimal post-release issues
  • Hệ thống vận hành ổn định sau khi triển khai / System stability is maintained post deployment 

6. Đánh giá và đóng góp cho giải pháp kỹ thuật / Contribute to technical solution evaluation 

  • Đưa ra góp ý về giải pháp kỹ thuật trong phạm vi hệ thống phụ trách / Provide input on technical solutions within assigned scope
  • Hỗ trợ đảm bảo tính khả thi và hiệu quả của giải pháp vận hành / Ensure feasibility and operability of solutions 

7. Đề xuất và triển khai cải tiến vận hành / Propose and implement operational improvements 

  • Các cải tiến (automation, monitoring, optimization) được triển khai hiệu quả / Improvements (automation, monitoring, optimization) are effectively implemented
  • Nâng cao hiệu suất và giảm thao tác thủ công / Improve efficiency and reduce manual effort  

Yêu cầu ứng viên

  • University graduate, majoring in Information Technology, Computer Science, Information Systems, Software Engineering, Telecommunications, or related fields.
  • AWS certifications (Cloud Practitioner, Solutions Architect – Associate, SysOps Administrator) are a plus but not mandatory.
  • Có 4+ kinh nghiệm vận hành ứng dụng/hệ thống trong môi trường Production
  • Có hiểu biết cơ bản về Linux/Unix, SQL, database và log hệ thống 
  • Có kinh nghiệm theo dõi monitoring, xử lý cảnh báo, kiểm tra batch/job/service/interface
  • Hiểu quy trình Incident, Change, Request trong môi trường IT vận hành
  • Có khả năng phối hợp với các bên liên quan, tuân thủ quy trình vận hành, checklist/runbook/SOP và chịu được áp lực công việc trực ca/on-call nếu có yêu cầu.
  • Có kinh nghiệm automation/script để hỗ trợ cải tiến vận hành
  • Có hiểu biết về CI/CD, release pipeline, cloud, container hoặc microservice
  • Có khả năng phân tích nguyên nhân gốc rễ ở mức component hoặc integration
  • Có chứng chỉ AWS hoặc kinh nghiệm vận hành hệ thống trên cloud là lợi thế
  • Có kinh nghiệm đề xuất cải tiến monitoring, alerting hoặc performance tuning 
  • Kỹ năng theo dõi vận hành Production, kiểm tra trạng thái hệ thống, service, interface, batch/job và xử lý cảnh báo theo quy trình
  • Kỹ năng phân tích log, đối chiếu checklist/runbook/SOP và thực hiện các bước xử lý ban đầu khi có sự cố
  • Kỹ năng điều phối và phối hợp với các bên liên quan như Dev, Infra, DBA, Security, Vendor để xử lý sự cố và hỗ trợ change/request
  • Khả năng làm việc độc lập, chịu trách nhiệm với hệ thống/module được phân công, đảm bảo ổn định dịch vụ và đáp ứng SLA
  • Kỹ năng giao tiếp, cập nhật thông tin rõ ràng trong quá trình vận hành, xử lý sự cố và bàn giao ca trực nếu có
  • Kỹ năng viết script hoặc automation đơn giản để giảm thao tác thủ công và tăng hiệu quả vận hành.
  • Khả năng hỗ trợ change/release trong môi trường Production và kiểm soát rủi ro vận hành sau golive
  • Khả năng đóng góp ý kiến cho giải pháp kỹ thuật ở góc độ vận hành, đảm bảo tính khả thi, khả năng giám sát và hỗ trợ sau triển khai
  • Kỹ năng phân tích sự cố nâng cao ở mức component hoặc integration để hỗ trợ xác định nguyên nhân gốc rễ
  • Khả năng đề xuất cải tiến monitoring, alerting hoặc performance tuning trong phạm vi hệ thống phụ trách 

Giá trị cốt lõi

1. KHÁT VỌNG
2. CHÍNH TRỰC
3. HIỆU QUẢ
4. KỶ CƯƠNG
5. SÁNG TẠO