messenger

Chat Mess

zalo

Chat Zalo

phone

Phone

Gọi ngay: 097.5151.777
messenger

Facebook

messenger

TikTok

Hỗ trợ tư vấn: 097.5151.777
VPBank

DevOps Engineer (Observability Platform) - TA192

Khối Công nghệ thông tin
NHÂN VIÊN

Mô tả công việc

Yêu cầu ứng viên

  • Đại học in Công nghệ thông tin or Khoa học máy tính
  • 3+ years of software engineering experience, focused on platform engineering, observability, or site reliability engineering (SRE)
  • Have experience building and operating infrastructure at scale.
  • Proficiency in programming languages such as Go, Python, Java, or similar.
  • Hands-on experience with observability / monitoring tools like OpenText, Solarwinds, Prometheus, Grafana, Loki, Jaeger, or OpenTelemetry.
  • Strong knowledge of distributed systems, microservices architecture, and cloud platforms (e.g., AWS, GCP, Azure).
  • Proficiency in CI/CD tools (Jenkins, GitLab, etc.)
  • Experience with administering Linux systems and writing scripts to facilitate operation.
  • Experience with Infrastructure-as-Code tools like Terraform, Helm, and orchestration languages like Ansible.
  • Experience with Data tools: Kafka, Clickhouse, SQL, Redis
  • Ability to debug complex systems and design solutions that scale with high traffic and data volumes.

Yêu cầu ứng viên

Yêu cầu công việc

  • Plan and execute infrastructure projects that improve observability tools and platforms, including metrics, logging, distributed tracing, dashboarding, alerting, application performance management
  • Build and enhance tools, frameworks, and pipelines for monitoring, logging and tracing across VPbank's systems.
  • Developing and maintaining systems to enable our engineering colleagues to confidently run their services with high quality, and quickly understand and mitigate any technical issues
  • Working with engineering colleagues to contribute to our observability strategy with a strong emphasis on open-source libraries, data formats and query languages
  • Work with other stakeholders to integrate observability best practices into the development lifecycle and improve overall system resilience.
  • Contribute to on-call rotations
  • Join with the team to define and implement observability standards (e.g., SLIs, SLOs, dashboards).
  • Partnering with our observability vendors.

Phân tích kỹ năng cần có

Phân tích kỹ năng cho vị trí DevOps Engineer (Observability Platform) tại VPBank

🎯 Tổng quan vị trí

Đây là vị trí thuộc nhóm Platform Engineering / SRE, tập trung vào Observability — khả năng quan sát, giám sát và debug hệ thống phân tán. VPBank là một trong những ngân hàng TMCP lớn nhất Việt Nam, hệ thống core banking chạy trên quy mô lớn (hàng triệu giao dịch/ngày), nên yêu cầu khá cao về kinh nghiệm thực chiến.

---

🔧 Hard Skills bắt buộc (Must-have)

Nhóm kỹ năng Công nghệ cụ thể Mức yêu cầu
Ngôn ngữ lập trình Go, Python, Java (ít nhất 1-2 cái thành thạo) 3+ năm
Observability Stack Prometheus, Grafana, Loki, Jaeger, OpenTelemetry Thành thạo
APM Tools OpenText, Solarwinds hoặc tương đương (Dynatrace, Datadog, New Relic…) Có kinh nghiệm
Cloud Platform AWS / GCP / Azure (ít nhất 1 cái sâu) 2+ năm
CI/CD Jenkins, GitLab CI Thành thạo
Linux & Scripting Bash, Shell scripting, system admin Thành thạo
IaC Terraform, Helm, Ansible Thành thạo
Data tools Kafka, ClickHouse, SQL, Redis Có kinh nghiệm
Kiến trúc Distributed systems, Microservices, High-traffic systems 3+ năm

💡 Soft Skills quan trọng

  • Tư duy hệ thống: Khả năng nhìn toàn cảnh hệ thống phức tạp, tìm root cause nhanh
  • Communication: Làm việc cross-team với nhiều engineering teams
  • Ownership & On-call readiness: Chấp nhận trực ca, xử lý sự cố ngoài giờ
  • Open-source mindset: VPBank nhấn mạnh open-source libraries, data formats, query languages
  • Vendor management: Làm việc với các nhà cung cấp APM/observability

📜 Chứng chỉ gợi ý (nếu muốn cộng điểm)

Chứng chỉ Tổ chức Ghi chú
AWS Solutions Architect / DevOps Professional AWS Cloud quan trọng nhất
CKA / CKAD Linux Foundation Kubernetes
Certified Kubernetes Administrator CNCF Nếu stack dùng K8s
Terraform Associate HashiCorp IaC bắt buộc
SRE Foundation DevOps Institute Nền tảng SRE
Prometheus Certified Associate CNCF Observability

🆚 So sánh mức độ quan trọng các kỹ năng

```
Quan trọng cao ████████████ Observability stack (Prometheus/Grafana stack)
Quan trọng cao ████████████ Distributed systems thinking
Quan trọng cao ███████████░ Terraform + Cloud
Quan trọng TB ████████░░░░ Programming (Go/Python)
Quan trọng TB ███████░░░░░ Kafka / ClickHouse
Quan trọng TB ███████░░░░░ CI/CD pipeline
Quan trọng TB ██████░░░░░░ Vendor management
```

⚠️ Điểm cần lưu ý

  • Tin không ghi rõ địa điểm & mức lương — VPBank thường tuyển cho Hà Nội hoặc HCM, có thể hỏi HR trước khi apply
  • "N/A" cho loại hình — đa số vị trí IT VPBank là full-time onsite/hybrid
  • Yêu cầu 3+ năm, không phù hợp fresher hoặc junior < 2 năm

---

Chuẩn bị phỏng vấn

Hướng dẫn phỏng vấn DevOps Engineer (Observability Platform) - VPBank

📋 Quy trình tuyển dụng dự kiến (3-4 vòng)

VPBank thường áp dụng quy trình tuyển dụng IT khá chặt chẽ:

Vòng Hình thức Thời lượng Nội dung
Vòng 1 HR Phone/Telephonic 20-30 phút Giới thiệu bản thân, lý do ứng tuyển, mức lương mong muốn, kinh nghiệm tổng quan
Vòng 2 Technical Interview #1 (Coding) 60-90 phút Live coding, problem solving, thường qua HackerRank/CodeSignal hoặc Google Docs
Vòng 3 Technical Interview #2 (System Design + SRE) 60-90 phút System design, observability architecture, scenario-based questions
Vòng 4 Managerial + Culture Fit 45-60 phút Head of IT, CTO office hoặc Senior Manager — đánh giá leadership, teamwork

(Có thể có thêm vòng cuối với Head of Department hoặc GitHub Portfolio review)

---

🎤 Câu hỏi phỏng vấn thường gặp theo từng vòng

🔹 Vòng HR
  • Giới thiệu ngắn gọn về bản thân và kinh nghiệm liên quan đến Observability/Platform Engineering
  • Tại sao bạn muốn làm việc tại VPBank? (Tip: nhấn mạnh VPBank đang digital transformation mạnh, fintech-first strategy)
  • Mức lương hiện tại và kỳ vọng?
  • Bạn sẵn sàng on-call và làm thêm ngoài giờ không?
  • Khi nào bạn có thể bắt đầu?
🔹 Vòng Technical #1 — Coding & Problem Solving
  • Viết một Python/Go script để parse log file và extract metrics
  • Implement một ci/CD pipeline sample bằng GitLab CI hoặc Jenkins
  • SQL query: tìm top 5 hosts có latency p99 cao nhất trong 1h
  • Debug một đoạn shell script bị lỗi
  • Viết Terraform code provision một EC2 instance + security group
🔹 Vòng Technical #2 — System Design & Observability (QUAN TRỌNG NHẤT)
  • Làm sao design observability stack cho 500 microservices?
  • Gợi ý: Prometheus + Thanos/Cortex cho metrics, Loki cho logs, Jaeger/Tempo cho tracing, Grafana cho visualization
  • SLI/SLO là gì? Ví dụ cho payment service?
  • SLI: số giao dịch thành công / tổng giao dịch, latency p99
  • SLO: 99.9% success rate, p99 < 500ms
  • High traffic đột biến, hệ thống chậm — bạn debug thế nào?
  • Check metrics → check logs → check traces → DB slow queries → network → vendor
  • So sánh pull vs push monitoring (Prometheus vs CloudWatch)?
  • OpenTelemetry vs Jaeger — khác nhau ở đâu?
  • Làm sao giảm chi phí observability khi scale?
  • Sampling, retention policy, aggregation, federation
  • Khi nào nên dùng Kafka vs Redis?
  • Terraform state lock là gì? Tại sao cần?
🔹 Vòng Managerial / Culture Fit
  • Bạn đã từng lead một observability project nào chưa? Outcome?
  • Conflict với team member về technical decision — xử lý thế nào?
  • Biggest outage bạn từng xử lý — lesson learned?
  • Bạn nghĩ gì về open-source vs commercial APM tools?
  • 5 năm tới bạn muốn gì? (gợi ý: Senior SRE, Platform Architect, Head of Platform)

---

👔 Dress Code & Tips chuẩn bị

Vòng Dress code
HR / Phone Casual, chỉ cần chuyên nghiệp về giọng nói
Technical Business casual (áo polo + quần tây, hoặc sơ mi) — VPBank khá formal nhưng IT thì thoáng hơn business
Managerial Smart casual đến business formal
Onsite final Business formal (sơ mi trắng + quần tây + giày)

💡 Tips "đắt giá"

1. Hiểu sâu OpenTelemetry — đây là trend, nhiều nơi migrate từ Jaeger/Zipkin sang OTel
2. Chuẩn bị GitHub portfolio — repo demo về observability stack, terraform modules, CI/CD templates
3. Đọc về VPBank's tech stack — khám phá VPBank Tech blog, hệ thống GO (VPBank neo), VPBank neoPay
4. Memorize các con số — 99.9% uptime = 8.7h downtime/năm, p99 vs p95 difference, v.v.
5. Câu hỏi ngược lại — luôn chuẩn bị 3-5 câu hỏi thông minh hỏi interviewer:

  • Hiện team đang dùng stack nào? Có plan migrate không?
  • On-call rotation như thế nào? Có compensation không?
  • Roadmap của observability platform trong 6-12 tháng tới?
  • Team size và cơ cấu hiện tại?

---

Lộ trình ôn thi

Lộ trình ôn thi & chuẩn bị trong 1-2 tuần

📚 Tuần 1: Nền tảng & Khái niệm

Ngày 1-2: Observability Fundamentals
  • Đọc: "Observability Engineering" (O'Reilly) — chương 1-5
  • Khái niệm cần nắm vững:
  • 3 pillars: Metrics, Logs, Traces
  • RED method (Rate, Errors, Duration) — cho microservices
  • USE method (Utilization, Saturation, Errors) — cho infrastructure
  • SLI vs SLO vs SLA
  • Error budget
  • Thực hành: Set up Prometheus + Grafana + Loki locally bằng Docker Compose
Ngày 3-4: Distributed Systems & Microservices
  • Đọc: "Designing Data-Intensive Applications" (Martin Kleppmann) — chương 1, 5, 6, 8
  • Concepts:
  • CAP theorem, eventual consistency
  • Circuit breaker, bulkhead, retry pattern
  • Service mesh (Istio/Linkerd) basics
  • Thực hành: Vẽ sơ đồ kiến trúc banking system (payment flow) kèm observability layer
Ngày 5-7: Cloud & Infrastructure
  • AWS focus (nếu chưa có kinh nghiệm):
  • EC2, S3, VPC, IAM, CloudWatch, RDS
  • AWS DevOps Pro: CodePipeline, ECS/EKS
  • Terraform:
  • State management, modules, workspaces
  • Provision multi-tier architecture
  • Kubernetes:
  • Pod, Service, Deployment, Ingress
  • Helm chart basics
  • kubectl commands
  • Thực hành: Deploy một sample microservice lên EKS hoặc minikube, install Prometheus stack via Helm

📚 Tuần 2: Deep Dive & Mock Interview

Ngày 8-9: Observability Stack Deep Dive
Tool Học gì Tài liệu
Prometheus PromQL, recording rules, alerting rules, federation prometheus.io docs
Grafana Dashboard, alerting, unified data source grafana.com/tutorials
Loki LogQL, label best practices, retention grafana.com/docs/loki
Jaeger Sampling, storage backends jaegertracing.io
OpenTelemetry SDK, collector, auto-instrumentation opentelemetry.io
Ngày 10-11: Data Tools & CI/CD
  • Kafka: Producer/Consumer, partitioning, replication
  • ClickHouse: Column-oriented DB, SQL dialect, use case for observability
  • Redis: Pub/Sub, Streams, caching
  • Jenkins vs GitLab CI: Pipeline as code, blue-green deployment
  • Thực hành: Build end-to-end pipeline: code → build → test → deploy → monitor
Ngày 12-14: Mock Interview & Review
  • Ngày 12: Làm 2-3 câu System Design (tự time 45 phút/câu, có bạn bè đóng vai interviewer)
  • Ngày 13: Live coding practice — leetcode medium (string, array, hashmap), Python/Go
  • Ngày 14: Review tất cả notes, đọc blog VPBank Tech, review GitHub, đi ngủ sớm

---

📖 Tài liệu tham khảo gợi ý

Sách (miễn phí/trả phí)
Tên sách Tác giả Mức độ ưu tiên
Observability Engineering Charity Majors et al. ⭐⭐⭐⭐⭐
Designing Data-Intensive Applications Martin Kleppmann ⭐⭐⭐⭐⭐
Site Reliability Engineering (Google) Betsy Beyer et al. ⭐⭐⭐⭐⭐
The DevOps Handbook Gene Kim et al. ⭐⭐⭐⭐
Kubernetes in Action Marko Luksa ⭐⭐⭐⭐
Terraform: Up & Running Yevgeniy Brikman ⭐⭐⭐⭐
Blog & Resources
  • Google SRE Book (miễn phí online): sre.google/sre-book
  • Prometheus Blog: prometheus.io/blog
  • Grafana Blog: grafana.com/blog
  • CNCF TAG Observability: github.com/cncf/tag-observability
  • Honeycomb.io blog (Charity Majors) — rất hay về observability culture
  • Brendan Gregg's blog — performance & observability guru
Khóa học online
  • A Cloud Guru / Linux Academy — AWS DevOps Pro
  • Udemy: "Prometheus | The Complete Guide" (Stéphane Maarek)
  • KodeKloud — DevOps và Kubernetes labs
  • Coursera — Google Cloud SRE specialization
YouTube channels
  • TechWorld with Nana — DevOps explained
  • Cloud native computing foundation — KubeCon talks
  • Grafana Labs — official tutorials
  • Hussein Nasser — backend & system design

---

🎯 Checklist trước ngày phỏng vấn

  • [ ] Đọc xong 1 cuốn sách về Observability/SRE
  • [ ] Setup được Prometheus + Grafana + Loki locally
  • [ ] Deploy được 1 microservice với OpenTelemetry instrumentation
  • [ ] Viết được Terraform code provision AWS resource
  • [ ] Có GitHub portfolio với demo projects
  • [ ] Chuẩn bị 5 câu hỏi ngược cho interviewer
  • [ ] Mock interview ít nhất 1 lần
  • [ ] Đọc về VPBank's recent tech news

---

Tư vấn nghề nghiệp

Lời khuyên sự nghiệp cho DevOps Engineer (Observability Platform)

🚀 Lộ trình thăng tiến trong ngân hàng

```
Level 1: DevOps Engineer / SRE Junior (3-5 năm exp)

Level 2: Senior DevOps Engineer / SRE (5-7 năm exp)

Level 3: Platform Engineer / Lead SRE (7-10 năm exp)

Level 4: Engineering Manager / Architect (10+ năm exp)

Level 5: Director of Platform / VP Eng (12+ năm exp)
```

Tại VPBank cụ thể, các cấp bậc IT thường là:

  • Chuyên viên (Executive) → Chuyên viên chính (Senior) → Trưởng phòng (Manager) → Phó giám đốc (Deputy Director) → Giám đốc (Director)

💰 Mức lương kỳ vọng theo cấp bậc (thị trường VN 2024-2025)

Cấp bậc Kinh nghiệm Lương VPBank / Big4 bank (gross) Note
Junior DevOps 1-3 năm 25-40 triệu Ít thấy junior ở VPBank quy mô này
DevOps Engineer 3-5 năm 40-65 triệu Phù hợp JD này
Senior DevOps 5-7 năm 65-100 triệu Có thể thương lượng cao hơn
Lead / Principal 7-10 năm 100-180 triệu Bao gồm bonus, stock
Manager / Architect 10+ năm 150-300 triệu++ Thường +ESOP, benefits

> ⚠️ Lưu ý: VPBank thuộc nhóm ngân hàng tư nhân trả lương cạnh tranh top đầu (cùng Techcombank, MBB, ACB). Lương ghi "Thỏa thuận" thường có nghĩa offer sẽ match theo năng lực.

📈 Kỹ năng cần phát triển thêm để thăng tiến

Ngắn hạn (3-6 tháng tới)
  • Master OpenTelemetry — đang là industry standard, nhiều nơi migrate
  • Học thêm eBPF cho observability ở kernel level (Pixie, Cilium Tetragon)
  • Tìm hiểu AIOps — ML-driven monitoring (PagerDuty, Moogsoft)
Trung hạn (6-18 tháng tới)
  • Multi-cloud experience — không chỉ AWS, mà GCP, Azure
  • FinOps — cost optimization cho cloud & observability
  • Platform engineering mindset — xây internal developer platform (IDP)
  • Security — DevSecOps, observability for security (audit, compliance)
Dài hạn (2-5 năm tới)
  • Architecture leadership — thiết kế hệ thống observability cho cloud-native banking
  • Team building — mentor juniors, build platform team từ đầu
  • Open-source contribution — tham gia CNCF projects, viết blog, nói tại hội nghị
  • Business acumen — hiểu banking domain (payment, lending, AML) để make better platform decisions

🎓 Nên học thêm gì?

Kỹ năng Tại sao cần Cách học
Go programming Rất nhiều CNCF tools viết bằng Go (Prometheus, Loki, Terraform) Tour of Go, build CLI tool
Rust Emerging cho observability (Vector, Bento) Rust Book online
Service Mesh Istio/Linkerd tích hợp tracing Katacoda, learnistio.io
Policy as Code OPA, Kyverno — security & compliance Open Policy Agent docs
AI-assisted ops Trend 2024-2026 (Grafana ML, Datadog AI) Andrew Ng courses

💼 Cơ hội ở VPBank cho vị trí này

Pros:

  • ✅ Làm việc với hệ thống scale lớn (hàng chục triệu users)
  • ✅ VPBank đang đầu tư mạnh vào digital transformation
  • ✅ Cơ hội làm greenfield project — build observability platform from scratch
  • ✅ Benefits tốt: ăn trưa, gym, healthcare, 13-14 tháng lương
  • ✅ Hybrid working model (nhiều team IT VPBank cho hybrid 2-3 ngày remote/tuần)

Cons / Cần cảnh báo:

  • ⚠️ Ngân hàng có nhiều legacy systems — sẽ phải integrate cả modern + legacy
  • ⚠️ Compliance & security rất strict — chậm rollout hơn startup
  • ⚠️ On-call duty — vì hệ thống core banking 24/7
  • ⚠️ Văn hóa công ty lớn có thể bureaucratic hơn

🌟 Lời khuyên cá nhân

1. Đừng chỉ là "DevOps guy" — Học thêm Software Engineering để viết platform code tốt hơn, không chỉ config
2. Build your brand — viết blog, talk tại meetups, contribute open-source sẽ tăng giá trị bản thân rất nhiều
3. Network trong cộng đồng — Vietnam DevOps Community, Cloud Native Vietnam, VNOSS
4. Đừng nhảy việc quá sớm — ở VPBank 2-3 năm để build credibility rồi mới move
5. Bank là môi trường học domain tốt — sau này có thể move sang fintech, e-commerce, hoặc consultant với mức lương cao hơn

---

Câu hỏi thường gặp

Em mới ra trường, có nên apply vị trí DevOps Engineer ở VPBank không?

Thật lòng mà nói thì khá khó em nhé. JD yêu cầu 3+ năm kinh nghiệm software engineering tập trung vào platform/observability/SRE. VPBank cũng thường ưu tiên ứng viên đã có kinh nghiệm thực chiến với hệ thống scale lớn. Gợi ý lộ trình cho em: (1) Làm 1-2 năm ở vị trí Junior DevOps/SRE ở công ty product hoặc outsourcing, (2) Tích lũy kinh nghiệm với Prometheus, Grafana, Terraform, AWS, (3) Build portfolio cá nhân trên GitHub, (4) Sau đó apply VPBank hoặc các ngân hàng lớn. Đừng nản nhé, ngành này đang rất hot và thiếu nhân lực giỏi!

Mức lương offer bao nhiêu cho vị trí này là hợp lý?

Với JD yêu cầu 3+ năm và stack công nghệ khá nặng (Prometheus, Grafana, OpenTelemetry, Terraform, Kubernetes), mình đề xuất mức deal như sau: Nếu có 3 năm exp → 40-55 triệu gross; 5 năm exp → 55-80 triệu; 7+ năm exp → 80-130 triệu. VPBank thuộc nhóm ngân hàng tư nhân trả lương cạnh tranh top đầu (cùng Techcombank, MBB). Mẹo: đừng nói mức lương hiện tại với HR ở vòng đầu, hãy để họ đưa ra range trước. Và nhớ negotiate cả bonus, review cycle, on-call compensation nhé.

Tôi đang là Backend Developer (Java) 4 năm, muốn chuyển sang DevOps/Platform thì cần học thêm gì?

Background Java của bạn là lợi thế lớn vì JD liệt kê Java là một trong các ngôn ngữ ưu tiên. Lộ trình 6 tháng suggested: (1) Tháng 1-2: Học Linux thật sâu (LPIC hoặc RHCE), bash scripting nâng cao, Networking; (2) Tháng 2-3: Học Docker, Kubernetes (CKA cert), Helm; (3) Tháng 3-4: Terraform (HashiCorp cert), một cloud platform (AWS hoặc GCP); (4) Tháng 4-5: Prometheus + Grafana + Loki stack, OpenTelemetry; (5) Tháng 5-6: Build 2-3 projects cá nhân trên GitHub demo observability platform. Trong CV, emphasize phần Java Spring Boot + đã optimize performance, monitor hệ thống — đó là transferrable skills. Khi phỏng vấn, hãy kể câu chuyện: 'Tôi từng optimize microservice latency từ 2s xuống 200ms nhờ distributed tracing' — chứng minh tư duy observability-based debugging.

Câu hỏi khó nhất trong phỏng vấn vị trí này thường là gì?

Theo kinh nghiệm nhiều người đi phỏng vấn VPBank Platform/DevOps team, câu khó nhất thường xoay quanh: 'Design một observability platform cho 500 microservices của ngân hàng, xử lý high traffic, đảm bảo tuân thủ security & compliance'. Câu này đánh giá nhiều thứ: trade-off giữa self-hosted (Prometheus/Thanos) vs SaaS (Datadog), chi phí, sampling strategy, alerting fatigue, data sovereignty (data phải ở VN), retention policy theo quy định NHNN. Tip: Khi trả lời, hãy structure rõ ràng: Requirements → High-level architecture → Trade-offs → Implementation details. Đừng cố nhồi hết tech buzzwords, hãy chứng minh bạn hiểu tại sao chọn cái A thay vì B.

So sánh làm Platform/Observability Engineer ở ngân hàng vs công ty product công nghệ (như VNG, Tiki, Shopee)?

Cả 2 đều có pros/cons. Ngân hàng (VPBank): Lương tốt, benefits ổn định, học được domain banking, làm việc với hệ thống scale lớn & có compliance. Nhưng tech có thể chậm hơn, nhiều legacy, văn hóa bureaucratic. Product tech (VNG/Shopee/Tiki): Tech stack modern hơn, văn hóa engineering tốt, work-life balance ổn hơn (ngân hàng hay OT cuối năm), được dive sâu vào một domain. Nhưng lương có thể không ngang ngân hàng lớn, và lộ trình thăng tiến phụ thuộc vào growth công ty. Nếu bạn thích stability + pay cao + scale lớn → VPBank. Nếu thích tech-forward + culture + flexibility → product tech. Cũng tùy giai đoạn sự nghiệp: 3-5 năm đầu nên ở nơi học được nhiều nhất, sau đó mới optimize theo lương.

Có cần học thêm chứng chỉ AWS/Azure để pass vòng phỏng vấn không?

Không bắt buộc có chứng chỉ, nhưng có thì cộng điểm rất nhiều vì JD yêu cầu cloud platform experience. Nếu bạn đã làm AWS thực tế 2-3 năm thì không cần cert làm gì. Nhưng nếu mới chuyển từ on-prem sang cloud, thì nên có ít nhất AWS Solutions Architect Associate hoặc AWS DevOps Professional. Cert giúp HR screen pass, và trong phỏng vấn bạn có thể tự tin nói về specific services. Với thời gian và budget hạn chế, mình khuyên ưu tiên: 1) AWS Solutions Architect Associate (3-6 tuần study), 2) CKA - Certified Kubernetes Administrator (4-8 tuần), 3) Terraform Associate (2-3 tuần). Đây là combo đủ sức nặng cho vị trí này.

Nếu chưa có kinh nghiệm OpenTelemetry trên CV, có nên apply không?

Nên apply nếu bạn đã có kinh nghiệm với bất kỳ observability tool nào khác (Prometheus, Datadog, New Relic, ELK). OpenTelemetry là open-source standard còn khá mới, nên không phải ai cũng có. Điều VPBank thực sự cần là tư duy observability: 'Bạn debug hệ thống phức tạp thế nào?', 'Bạn thiết kế alert/dashboard ra sao?', 'Bạn cân bằng cost vs visibility như thế nào?'. Trước khi phỏng vấn, dành 1-2 ngày làm quickstart OpenTelemetry, hiểu concept OTel Collector, SDK, instrumentation. Trong phỏng vấn, chân thành nói 'tôi chưa có kinh nghiệm production với OTel nhưng tôi đã research và đánh giá đây là xu hướng' — điều này cho thấy bạn có growth mindset và update kiến thức.

On-call rotation ở ngân hàng có khác gì startup/product tech không?

Khác biệt khá lớn: Ngân hàng: Core banking systems chạy 24/7, downtime ảnh hưởng đến hàng triệu users, có thể bị regulator phạt nặng. On-call shift thường 1 tuần/lần, response SLA 15-30 phút, kể cả lễ Tết. Nhiều khi vấn đề là vendor (Oracle, Temenos) chậm fix → rất frustrating. Product tech (Shopee/Lazada): Cũng 24/7 nhưng scale lớn, có automation tốt hơn, có thể có SRE team riêng. Compensation on-call: ngân hàng thường trả thêm 1-3 triệu/ca + comp days off, trong khi tech company trả theo giờ ($50-100/ca). Ngân hàng ít khi 'fire' vì sự cố (miễn không phải lỗi chủ quan), product tech thì strict hơn. Cân nhắc nếu bạn có gia đình nhỏ, cần work-life balance.

VPBank có team nào cụ thể làm Observability không, hay JD này là mới tạo?

VPBank đang chuyển đổi số mạnh mẽ trong 2-3 năm gần đây, họ có Platform Engineering team thuộc Khối CNTT. Gần đây họ liên tục tuyển các vị trí về SRE, Cloud, DevOps, Observability — đây là dấu hiệu họ đang build hoặc mature hóa platform team. JD này rất cụ thể về Prometheus/Grafana stack nên khả năng cao team đang expand hoặc mới hình thành. Bạn có thể hỏi HR khi apply để xác nhận: team size hiện tại, scope của platform, có greenfield project không. Cũng nên check LinkedIn các Senior Engineer VPBank để hiểu cấu trúc team trước khi phỏng vấn.

Tôi có 8 năm kinh nghiệm DevOps, muốn apply vị trí Senior/Lead, có nên apply JD này không?

Vẫn apply được, nhưng bạn nên nhắn HR clarifying level vì JD ghi chung chung. Với 8 năm exp, bạn có thể negotiate lên Senior hoặc Lead. Chuẩn bị highlight trong CV: (1) Đã lead team 3-5 người, (2) Đã thiết kế observability platform từ đầu, (3) Có kinh nghiệm scale hệ thống high-traffic, (4) Có contribution open-source hoặc blog/tech talk. Mức lương kỳ vọng 80-130 triệu là realistic. Trong phỏng vấn, đừng chỉ nói 'tôi configure Prometheus', hãy nói 'tôi đã thiết kế kiến trúc multi-region active-active với global Prometheus federation, giảm 40% chi phí observability, MTTR từ 30 phút xuống 5 phút'. Đó là câu chuyện Lead/Senior nên kể.