Sovereign Engineering Platform SRE - T Cloud Public (REF5740Q)
Indexed description
Hauptaufgaben
- Aufbau und Betrieb von Kubernetes-Umgebungen, die KI-Engineering-Tools, interne Modell-Gateways, Retrieval-Komponenten, Workflow-Services, CI/CD-Runner und Dokumentationsservices hosten
- Implementierung von GitOps- und Infrastructure-as-Code-Mustern für reproduzierbare Bereitstellung, Konfiguration, Policy-Durchsetzung, Plattform-Upgrades und Disaster-Recovery-Bereitschaft
- Verwaltung von privaten Registries, Package-Mirrors, Secrets, Identity-Integration, Netzwerksegmentierung, Storage-Klassen, Backup-Routinen und kontrollierten Konnektivitätsmodellen
- Bereitstellung von Observability für Engineering-Workloads, einschließlich Metriken, Logs, Traces, GPU- und CPU-Auslastung, Service-Health, Kostensignalen und operativen Runbooks
- Zusammenarbeit mit Software-, Security- und Architektur-Teams, um sicherzustellen, dass die Plattform KI-gestützte SDLC-Workflows unterstützt, ohne unkontrollierte Datenexposition oder Audit-Lücken zu schaffen
- Arbeit mit Plattform-Tooling wie Kubernetes, Helm, Terraform, Ansible, ArgoCD, Crossplane, GitLab-Runnern, Jenkins-Agents, privaten Registries und internen Package-Mirrors
- Nutzung von KI-Plattformkomponenten wie vLLM, Ollama, OpenAI-kompatiblen Gateways, Qdrant oder ähnlichen Vector-Stores, Open WebUI, Continue-kompatiblen Endpunkten und Workflow-Services
- Implementierung von Observability- und Operations-Stacks wie Prometheus, Grafana, Loki, OpenTelemetry, ELK/OpenSearch, Alertmanager, SRE-Runbooks und Incident-Management-Tooling
- Deployment von Security- und Governance-Komponenten wie Vault, Keycloak, Network-Policies, RBAC, Admission-Controls, Image-Scanning, SBOM-Tooling und Audit-Logging
- Aufrechterhaltung von Infrastruktur-Awareness in Bezug auf GPU-gestützte Nodes, CPU-only-Fallback, Storage-Performance, Netzwerkisolation, Proxy-Muster, On-Premise-Umgebungen und dedizierte Landing-Zones
Muss-Kriterien
- Mindestens 5 Jahre Erfahrung in SRE-, Platform-Engineering-, DevOps-, Cloud-Infrastruktur- oder Operations-Rollen
- Ausgeprägte Kubernetes-Expertise
- Ausgeprägte Linux-Expertise
- Nachgewiesene Erfahrung im Aufbau und Betrieb von produktionsreifen Engineering-Plattformen
- Erfahrung mit GitOps-Praktiken und -Tools
- Erfahrung mit Infrastructure as Code
- Erfahrung mit der Implementierung von Observability
- Erfahrung mit operativen Runbooks
- Praktische Kenntnisse in Terraform
- Praktische Kenntnisse in Ansible
- Praktische Kenntnisse in Helm
- Praktische Kenntnisse in Python oder Shell-Scripting
- Erfahrung mit CI/CD-Runnern
- Erfahrung mit privaten Registries
- Erfahrung mit sicherem Konfigurationsmanagement
- Gutes Verständnis von Netzwerken
- Gutes Verständnis von Speichersystemen
- Gutes Verständnis von Secrets Management
- Gutes Verständnis von Zugriffskontrolle
- Gutes Verständnis von Monitoring
- Gutes Verständnis von Backup und Disaster Recovery
- Gutes Verständnis von operativer Härtung in Hochsicherheitsumgebungen
- Sicher in der Unterstützung von KI-gestützten Engineering-Workloads in souveränitätsorientierten Kontexten
- Erfahrung mit Isolations- und kontrollierten Datenverarbeitungsanforderungen
- Erfahrung in der Sicherstellung von Zuverlässigkeit und Nachvollziehbarkeit in sicheren Umgebungen
- Du musst aufgrund europäischer Steuervorschriften in der Lage sein, von Ungarn aus zu arbeiten
DT-ITS erhielt 2019 die Auszeichnung „Best in Educational Cooperation" von HIPA und wurde 2019 als ethischstes multinationales Unternehmen anerkannt. Das Unternehmen entwickelt seine vier Standorte in Budapest, Debrecen, Pécs und Szeged kontinuierlich weiter und sucht qualifizierte IT-Fachkräfte, die Teil des Teams werden möchten.
Weitere Details
Remote-Work-Richtlinie: Remote-Arbeit ist aufgrund europäischer Steuervorschriften nur aus Ungarn möglich.
Create a free Caio profile to unlock more results and save your role and location preferences.
Unlock free search