Memuat lowongan

Menyiapkan informasi terbaru...

System and Database Administrator

PT Anugerah Digital Indonesia Jakarta Selatan, DKI Jakarta

Deskripsi pekerjaan

Posisi System and Database Administrator bertanggung jawab penuh dalam mengelola infrastruktur cloud, penerapan DevOps, keamanan sistem, pengelolaan database, monitoring, pencadangan (backup), pemulihan bencana (disaster recovery), serta penanganan insiden TI secara menyeluruh di lingkungan production perusahaan.

Tanggung jawab: Cloud Infrastructure; Mengelola dan memelihara infrastruktur di Alibaba Cloud dan Huawei Cloud: provisioning, sizing, patching, dan decommissioning ECS; Merancang dan mengelola jaringan: VPC, subnet, security group, routing, dan NLB untuk distribusi trafik; Melakukan konfigurasi dan memelihara NGINX sebagai reverse proxy (SSL/TLS, rate limiting, header security, upstream health check); Mengelola kebijakan backup (jadwal, retensi, enkripsi) dan melakukan uji restore secara berkala; Mengelola Disaster Recovery Center (DRC) : menyusun dan memperbarui DRP, menjalankan DRC test minimal sesuai jadwal regulasi/kebijakan perusahaan, serta mendokumentasikan hasil RTO/RPO; Melakukan perencanaan kapasitas dan optimalisasi penggunaan cloud; Mendokumentasikan arsitektur, topologi jaringan, dan inventaris aset infrastruktur; DevOps; Mengelola Jenkins: instalasi, plugin, credentials, agent/node, dan pipeline CI/CD untuk deployment ke environment dev, UAT, dan production; Menjalankan dan mengontrol proses deployment sesuai change management (approval, rollback plan, release note); Mengelola RabbitMQ: exchange, queue, dead-letter queue, clustering, dan monitoring antrian; Mengelola Apache Kafka: topic, partition, replication factor, consumer group, retensi, dan penanganan consumer lag; Menyusun otomasi (script Bash/Python) untuk tugas operasional rutin; Mengelola Alibaba WAF: rule, whitelist/blacklist, proteksi bot dan serangan OWASP Top 10 , serta analisis log serangan; Mengelola JumpServer sebagai bastion host : akun, role, hak akses berbasis least privilege, rekaman sesi, dan review akses berkala; Mengelola audit trail (ActionTrail, log akses server, log akses database): retensi, integritas, dan penyediaan evidence saat audit; Mengimplementasikan dan memelihara kontrol ISO/IEC 27001 yang terkait infrastruktur, serta menyiapkan evidence untuk surveillance audit dan recertification; Membangun dan memelihara monitoring dengan Prometheus dan Grafana: exporter, dashboard, dan rule alerting untuk server, aplikasi, message broker, dan database; Mengelola saluran alerting (misalnya Telegram, email, atau PagerDuty) beserta tingkat severity dan eskalasinya; Melakukan vulnerability scanning dan patch management, serta menindaklanjuti temuan audit/pentest; Database Administrator; Mengelola MySQL 5.x dan 8.x : instalasi, konfigurasi, user & privilege, tuning parameter, dan upgrade versi; Mengelola MySQL replication (source–replica, GTID, semi-sync) , memantau replication lag, serta menangani replikasi yang putus; Mengelola pipeline CDC dengan Debezium (connector, binlog, snapshot, schema change) ke Kafka; Mengelola job Apache Flink : deployment job, checkpoint/savepoint, dan penanganan job yang gagal; Mengelola A libaba ApsaraDB for MongoDB dan ApsaraDB for Redis: sizing, backup, parameter, dan monitoring; Melakukan troubleshooting database: slow query, deadlock, lock wait, koneksi penuh, disk penuh, dan query optimization (EXPLAIN, index); Menjalankan dan meng uji restore database, termasuk point-in-time recovery; Mengontrol perubahan skema dan akses data produksi sesuai prosedur; On-call dan Respon Insiden; Bersedia on-call (termasuk diluar jam kerja, akhir pekan, dan hari libur) sesuai jadwal; Wajib segera merespons dan menindaklanjuti alert sesuai SLA yang berlaku.

Kualifikasi: Pendidikan minimal S1 Teknik Informatika, Sistem Informasi, Ilmu Komputer, atau bidang terkait; Pengalaman minimal 4 tahun sebagai S ystem Administrator, DevOps, atau DBA pada lingkungan production; Terbiasa bekerja di Linux (CentOS/Rocky/Ubuntu) dan mahir scripting Bash; Python menjadi nilai tambah; Bersedia on-call dan merespons alert di luar jam kerja sesuai SLA; Bersedia bekerja on-site di Jakarta; Dapat bergabung secepatnya (immediately available); Terbiasa bekerja dengan A libaba Cloud dan Huawei Cloud di lingkungan production; Memahami fitur Alibaba Cloud berikut:; ECS: provisioning, image/snapshot, instance type, dan scaling; NLB: listener, server group, health check; NGINX proxy : konfigurasi reverse proxy, SSL/TLS, load balancing, dan troubleshooting; VPC: vSwitch, route table, security group, NAT Gateway, dan koneksi antar-VPC; DRC: arsitektur disaster recovery, replikasi antar-region/zona, dan prosedur failover–failback; Backup: Cloud Backup/snapshot policy, retensi, dan restore; Wajib pernah melakukan DRC test (failover dan failback) secara langsung, dibuktikan dengan dapat menjelaskan skenario, langkah, hasil RTO/RPO, dan kendala yang dihadapi; Memahami dan mampu mengelola Jenkins: pipeline (Jenkinsfile), plugin, credentials, dan agent; Memahami dan mampu mengelola RabbitMQ: exchange, queue, DLQ, clustering, dan monitoring; Memahami dan mampu mengelola Apache Kafka: topic, partition, replication, consumer group, dan troubleshooting consumer lag; Memahami dan mampu mengelola Alibaba WAF; Memahami dan mampu mengelola JumpServer (bastion host, access control, session recording); Memahami audit trail management: pengumpulan, retensi, dan penyajian log sebagai evidence audit; Memahami seluruh kontrol ISO/IEC 27001 (Annex A) dan pernah terlibat dalam audit ISO 27001; Mampu membangun monitoring dengan Prometheus dan Grafana, termasuk dashboard dan exporter; Mampu merancang alerting (Alertmanager/Grafana Alerting ): threshold, severity, routing, dan eskalasi; Memahami dan mampu mengelola MySQL 5.x dan 8.x, termasuk perbedaan fitur dan proses upgrade 5.7 → 8.0; Memahami MySQL replication (binlog, GTID, source–replica) dan penanganan replication lag/error; Memahami Debezium untuk Change Data Capture dari MySQL ke Kafka; Memahami Apache Flink (job, checkpoint, savepoint, dan operasional job); Memahami Alibaba ApsaraDB for MongoDB dan ApsaraDB for Redis; Berpengalaman melakukan troubleshooting database di production: slow query, deadlock, locking, koneksi, dan query tuning; Nilai Tambah dan Soft Skill; Pengalaman di industri keuangan/fintech dan pemahaman regulasi OJK, DRP, TI, serta UU PDP; Memiliki sertifikasi Alibaba Cloud, Huawei Cloud, ISO 27001, atau MySQL DBA; Pengalaman dengan Docker/Kubernetes dan Infrastructure as Code (Terraform/Ansible); Kemampuan membaca dokumentasi teknis berbahasa Mandarin atau berkomunikasi dengan tim teknis di luar negeri; Tenang dan sistematis dalam menangani insiden; Disiplin dalam dokumentasi dan audit; Komunikatif dalam pelaporan dan eskalasi; Proaktif mencegah gangguan sistem.

Tanggung jawab

  • Cloud Infrastructure
  • Mengelola dan memelihara infrastruktur di Alibaba Cloud dan Huawei Cloud: provisioning, sizing, patching, dan decommissioning ECS
  • Merancang dan mengelola jaringan: VPC, subnet, security group, routing, dan NLB untuk distribusi trafik
  • Melakukan konfigurasi dan memelihara NGINX sebagai reverse proxy (SSL/TLS, rate limiting, header security, upstream health check)
  • Mengelola kebijakan backup (jadwal, retensi, enkripsi) dan melakukan uji restore secara berkala
  • Mengelola Disaster Recovery Center (DRC) : menyusun dan memperbarui DRP, menjalankan DRC test minimal sesuai jadwal regulasi/kebijakan perusahaan, serta mendokumentasikan hasil RTO/RPO
  • Melakukan perencanaan kapasitas dan optimalisasi penggunaan cloud
  • Mendokumentasikan arsitektur, topologi jaringan, dan inventaris aset infrastruktur
  • DevOps
  • Mengelola Jenkins: instalasi, plugin, credentials, agent/node, dan pipeline CI/CD untuk deployment ke environment dev, UAT, dan production
  • Menjalankan dan mengontrol proses deployment sesuai change management (approval, rollback plan, release note)
  • Mengelola RabbitMQ: exchange, queue, dead-letter queue, clustering, dan monitoring antrian
  • Mengelola Apache Kafka: topic, partition, replication factor, consumer group, retensi, dan penanganan consumer lag
  • Menyusun otomasi (script Bash/Python) untuk tugas operasional rutin
  • Mengelola Alibaba WAF: rule, whitelist/blacklist, proteksi bot dan serangan OWASP Top 10 , serta analisis log serangan
  • Mengelola JumpServer sebagai bastion host : akun, role, hak akses berbasis least privilege, rekaman sesi, dan review akses berkala
  • Mengelola audit trail (ActionTrail, log akses server, log akses database): retensi, integritas, dan penyediaan evidence saat audit
  • Mengimplementasikan dan memelihara kontrol ISO/IEC 27001 yang terkait infrastruktur, serta menyiapkan evidence untuk surveillance audit dan recertification
  • Membangun dan memelihara monitoring dengan Prometheus dan Grafana: exporter, dashboard, dan rule alerting untuk server, aplikasi, message broker, dan database
  • Mengelola saluran alerting (misalnya Telegram, email, atau PagerDuty) beserta tingkat severity dan eskalasinya
  • Melakukan vulnerability scanning dan patch management, serta menindaklanjuti temuan audit/pentest
  • Database Administrator
  • Mengelola MySQL 5.x dan 8.x : instalasi, konfigurasi, user & privilege, tuning parameter, dan upgrade versi
  • Mengelola MySQL replication (source–replica, GTID, semi-sync) , memantau replication lag, serta menangani replikasi yang putus
  • Mengelola pipeline CDC dengan Debezium (connector, binlog, snapshot, schema change) ke Kafka
  • Mengelola job Apache Flink : deployment job, checkpoint/savepoint, dan penanganan job yang gagal
  • Mengelola A libaba ApsaraDB for MongoDB dan ApsaraDB for Redis: sizing, backup, parameter, dan monitoring
  • Melakukan troubleshooting database: slow query, deadlock, lock wait, koneksi penuh, disk penuh, dan query optimization (EXPLAIN, index)
  • Menjalankan dan meng uji restore database, termasuk point-in-time recovery
  • Mengontrol perubahan skema dan akses data produksi sesuai prosedur
  • On-call dan Respon Insiden
  • Bersedia on-call (termasuk diluar jam kerja, akhir pekan, dan hari libur) sesuai jadwal
  • Wajib segera merespons dan menindaklanjuti alert sesuai SLA yang berlaku

Kualifikasi

  • Pendidikan minimal S1 Teknik Informatika, Sistem Informasi, Ilmu Komputer, atau bidang terkait
  • Pengalaman minimal 4 tahun sebagai S ystem Administrator, DevOps, atau DBA pada lingkungan production
  • Terbiasa bekerja di Linux (CentOS/Rocky/Ubuntu) dan mahir scripting Bash; Python menjadi nilai tambah
  • Bersedia on-call dan merespons alert di luar jam kerja sesuai SLA
  • Bersedia bekerja on-site di Jakarta
  • Dapat bergabung secepatnya (immediately available)
  • Terbiasa bekerja dengan A libaba Cloud dan Huawei Cloud di lingkungan production
  • Memahami fitur Alibaba Cloud berikut:
  • ECS: provisioning, image/snapshot, instance type, dan scaling
  • NLB: listener, server group, health check
  • NGINX proxy : konfigurasi reverse proxy, SSL/TLS, load balancing, dan troubleshooting
  • VPC: vSwitch, route table, security group, NAT Gateway, dan koneksi antar-VPC
  • DRC: arsitektur disaster recovery, replikasi antar-region/zona, dan prosedur failover–failback
  • Backup: Cloud Backup/snapshot policy, retensi, dan restore
  • Wajib pernah melakukan DRC test (failover dan failback) secara langsung, dibuktikan dengan dapat menjelaskan skenario, langkah, hasil RTO/RPO, dan kendala yang dihadapi
  • Memahami dan mampu mengelola Jenkins: pipeline (Jenkinsfile), plugin, credentials, dan agent
  • Memahami dan mampu mengelola RabbitMQ: exchange, queue, DLQ, clustering, dan monitoring
  • Memahami dan mampu mengelola Apache Kafka: topic, partition, replication, consumer group, dan troubleshooting consumer lag
  • Memahami dan mampu mengelola Alibaba WAF
  • Memahami dan mampu mengelola JumpServer (bastion host, access control, session recording)
  • Memahami audit trail management: pengumpulan, retensi, dan penyajian log sebagai evidence audit
  • Memahami seluruh kontrol ISO/IEC 27001 (Annex A) dan pernah terlibat dalam audit ISO 27001
  • Mampu membangun monitoring dengan Prometheus dan Grafana, termasuk dashboard dan exporter
  • Mampu merancang alerting (Alertmanager/Grafana Alerting ): threshold, severity, routing, dan eskalasi
  • Memahami dan mampu mengelola MySQL 5.x dan 8.x, termasuk perbedaan fitur dan proses upgrade 5.7 → 8.0
  • Memahami MySQL replication (binlog, GTID, source–replica) dan penanganan replication lag/error
  • Memahami Debezium untuk Change Data Capture dari MySQL ke Kafka
  • Memahami Apache Flink (job, checkpoint, savepoint, dan operasional job)
  • Memahami Alibaba ApsaraDB for MongoDB dan ApsaraDB for Redis
  • Berpengalaman melakukan troubleshooting database di production: slow query, deadlock, locking, koneksi, dan query tuning
  • Nilai Tambah dan Soft Skill
  • Pengalaman di industri keuangan/fintech dan pemahaman regulasi OJK, DRP, TI, serta UU PDP
  • Memiliki sertifikasi Alibaba Cloud, Huawei Cloud, ISO 27001, atau MySQL DBA
  • Pengalaman dengan Docker/Kubernetes dan Infrastructure as Code (Terraform/Ansible)
  • Kemampuan membaca dokumentasi teknis berbahasa Mandarin atau berkomunikasi dengan tim teknis di luar negeri
  • Tenang dan sistematis dalam menangani insiden
  • Disiplin dalam dokumentasi dan audit
  • Komunikatif dalam pelaporan dan eskalasi
  • Proaktif mencegah gangguan sistem

Informasi lowongan

Tipe pekerjaan
Full-time
Pendidikan
S1
Gaji
Rp 10.000.000 – Rp 12.000.000 per month

Cara melamar

Lowongan aktif terkait

Lihat lowongan kerja terbaru lainnya