Veri ve Yapay Zekâ

Büyük Veri Mühendisi CV Örneği

Tek sunucuya sığmayan veriyi dağıtık kümede işler; Spark işlerinin bölüm dengesi ve küme maliyeti günlük kararlarını belirler.

CV'de öne çıkarılacak görevler

  • Spark işleriyle terabayt ölçeğinde toplu veri dönüşümü geliştirmek
  • Veri bölümleme ve dosya biçimi seçimiyle okuma maliyetini düşürmek
  • Kafka tabanlı akış işleme hattı kurup gecikmeyi izlemek
  • Küme kaynak ayarlarını yaparak iş süresi ve maliyet dengesini kurmak
  • Veri gölü katman yapısını (ham, işlenmiş, sunum) tanımlamak

Yetkinlikler

  • Apache Spark
  • Scala veya Python
  • Apache Kafka
  • Delta Lake / Parquet
  • Hadoop ekosistemi
  • Databricks
  • Airflow ile iş akışı
  • Küme kaynak ayarlama

Ölçülebilir başarı örnekleri

X ve Y yerine kendi rakamlarınızı yazın.

  • Bölüm dengesizliğini gidererek günlük Spark işinin süresini X saatten Y saate çektim
  • Dosya biçimi ve sıkıştırma değişikliğiyle depolama alanını %X azalttım
  • Akış hattını devreye alıp veri gecikmesini X saatten Y dakikaya indirdim

Eğitim

  • Bilgisayar Mühendisliği lisans
  • Yazılım Mühendisliği lisans
  • İstatistik veya Matematik lisans

Sertifikalar

  • Databricks Certified Data Engineer Associate
  • Cloudera Certified Associate (CCA) Data Analyst