Site Reliability Engineer - HFT
Role Overview
Key Responsibilities
- Own and enhance end-to-end observability across production systems.
- Design actionable monitoring dashboards, alerts, and operational metrics.
- Investigate production incidents, diagnose root causes, and implement permanent fixes.
- Manage deployments through CI/CD pipelines and GitOps workflows.
- Operate and optimize Kubernetes-based workloads in cloud environments.
- Provision and maintain infrastructure using Infrastructure-as-Code practices.
- Build and support near real-time data pipelines and telemetry platforms.
- Design data quality controls and optimize analytical databases for large-scale querying.
- Develop and improve SQL-based analytics and reporting capabilities.
- Participate in a shared on-call rotation supporting critical production services.
Key Requirements
- Degree in Computer Science, Software Engineering, or equivalent practical experience.
- Experience building and maintaining observability and monitoring solutions within production environments.
- Strong understanding of incident management, troubleshooting, and root cause analysis.
- Hands-on experience with monitoring tools such as Prometheus, Grafana, ELK, Datadog, CloudWatch, or similar.
- Experience deploying software through CI/CD platforms such as GitLab CI, Jenkins, or GitHub Actions.
- Exposure to distributed stream processing technologies such as Flink, Spark Structured Streaming, or comparable frameworks.
- Experience working with OLAP or columnar databases such as ClickHouse, BigQuery, Druid, or Redshift.
- Practical Kubernetes experience, including deployments, resource management, and application configuration.
- Strong programming skills in Python, Java, Scala, Rust, or similar languages.
- Advanced SQL skills with experience building and optimising analytical workloads.
- Knowledge of messaging platforms and event-driven architectures such as Kafka or SQS
Nice to Have
- Experience with OpenTelemetry and distributed tracing.
- Knowledge of Airflow or workflow orchestration platforms.
- Advanced Terraform and Infrastructure-as-Code expertise.
- Familiarity with JVM build tooling or large-scale software delivery pipelines.
- Prior exposure to trading, market data, financial technology, or other low-latency environments.
FAQs
Herzlichen Glückwunsch – wir wissen, dass es ein großer Schritt ist, sich die Zeit für eine Bewerbung zu nehmen. Wenn Sie sich bewerben, werden Ihre Angaben direkt an den zuständigen Berater weitergeleitet, der aktiv nach passenden Talenten sucht. Aufgrund der hohen Nachfrage können wir uns möglicherweise nicht bei allen Bewerbern zurückmelden. Wir behalten Ihren Lebenslauf und Ihre Daten jedoch stets in unserer Datenbank und melden uns bei Ihnen, sobald wir ähnliche Positionen sehen oder Fähigkeiten identifizieren, die das Wachstum von Unternehmen vorantreiben können.
Ja. Auch wenn diese Position nicht perfekt zu Ihrem nächsten Karriereschritt passt, hilft uns Ihre Bewerbung dabei, Ihre Fachkenntnisse und Ziele besser zu verstehen. So stellen wir sicher, dass Sie bei der passenden Gelegenheit auf unserem Radar sind.
Wir arbeiten auf unterschiedliche Weise: Zum einen veröffentlichen wir die aktuell verfügbaren Positionen auf unserer Website. Häufig können wir jedoch aus Gründen der Vertraulichkeit nicht alle Vakanzen ausschreiben. Darüber hinaus arbeiten wir mit Kunden zusammen, die einen stärkeren Fokus auf Fähigkeiten legen und darauf, was erforderlich ist, um ihr Unternehmen zukunftssicher aufzustellen.
Aus diesem Grund empfehlen wir, Ihren Lebenslauf zu registrieren, damit Sie auch für Positionen berücksichtigt werden können, die noch nicht geschaffen wurden.
Ja, wir unterstützen Sie bei der Optimierung Ihres Lebenslaufs und der Vorbereitung auf Vorstellungsgespräche. Von individueller Beratung über die gezielte Vorbereitung auf Interviews bis hin zu Gehalts- und Vertragsverhandlungen stehen wir Ihnen während Ihres gesamten nächsten Karriereschritts zur Seite.
