𝗛𝗲𝗮𝗱 𝗼𝗳 𝗖𝗹𝗼𝘂𝗱 𝗜𝗻𝗳𝗿𝗮𝘀𝘁𝗿𝘂𝗰𝘁𝘂𝗿𝗲 & 𝗣𝗿𝗼𝗱𝘂𝗰𝘁𝗶𝗼𝗻 (𝗜𝗻𝘀𝗶𝗱𝗲 𝗨𝗔𝗘 𝗖𝗮𝗻𝗱𝗶𝗱𝗮𝘁𝗲 𝗢𝗻𝗹𝘆)
Indexed description
𝗔𝗯𝗼𝘂𝘁 𝘁𝗵𝗲 𝗥𝗼𝗹𝗲
The 𝗛𝗲𝗮𝗱 𝗼𝗳 𝗖𝗹𝗼𝘂𝗱 𝗜𝗻𝗳𝗿𝗮𝘀𝘁𝗿𝘂𝗰𝘁𝘂𝗿𝗲 & 𝗣𝗿𝗼𝗱𝘂𝗰𝘁𝗶𝗼𝗻 is a critical technology leadership role responsible for transforming Suadeo Cloud from a reactive infrastructure/support function into a 𝗽𝗿𝗼𝗮𝗰𝘁𝗶𝘃𝗲, 𝘄𝗼𝗿𝗹𝗱-𝗰𝗹𝗮𝘀𝘀 𝗥𝗲𝗹𝗶𝗮𝗯𝗶𝗹𝗶𝘁𝘆 𝗘𝗻𝗴𝗶𝗻𝗲𝗲𝗿𝗶𝗻𝗴 𝗮𝗻𝗱 𝗣𝗿𝗼𝗱𝘂𝗰𝘁𝗶𝗼𝗻 𝗼𝗿𝗴𝗮𝗻𝗶𝘀𝗮𝘁𝗶𝗼𝗻.
Reporting directly to the CTO, you will bridge 𝘀𝘁𝗿𝗮𝘁𝗲𝗴𝗶𝗰 𝘁𝗲𝗰𝗵𝗻𝗼𝗹𝗼𝗴𝘆 𝗱𝗶𝗿𝗲𝗰𝘁𝗶𝗼𝗻 𝗮𝗻𝗱 𝗵𝗮𝗻𝗱𝘀-𝗼𝗻 𝗼𝗽𝗲𝗿𝗮𝘁𝗶𝗼𝗻𝗮𝗹 𝗲𝘅𝗲𝗰𝘂𝘁𝗶𝗼𝗻, with end-to-end accountability for the 𝗮𝘃𝗮𝗶𝗹𝗮𝗯𝗶𝗹𝗶𝘁𝘆, 𝗿𝗲𝗹𝗶𝗮𝗯𝗶𝗹𝗶𝘁𝘆, 𝗽𝗲𝗿𝗳𝗼𝗿𝗺𝗮𝗻𝗰𝗲, 𝘀𝗲𝗰𝘂𝗿𝗶𝘁𝘆, 𝗿𝗲𝘀𝗶𝗹𝗶𝗲𝗻𝗰𝗲 𝗮𝗻𝗱 𝗼𝗽𝗲𝗿𝗮𝘁𝗶𝗼𝗻𝗮𝗹 𝗾𝘂𝗮𝗹𝗶𝘁𝘆 of customer-facing production environments.
𝗞𝗲𝘆 𝗥𝗲𝘀𝗽𝗼𝗻𝘀𝗶𝗯𝗶𝗹𝗶𝘁𝗶𝗲𝘀
𝟭. 𝗖𝗹𝗼𝘂𝗱 & 𝗜𝗻𝗳𝗿𝗮𝘀𝘁𝗿𝘂𝗰𝘁𝘂𝗿𝗲 𝗦𝘁𝗿𝗮𝘁𝗲𝗴𝘆
- Define and execute a 𝘀𝗰𝗮𝗹𝗮𝗯𝗹𝗲, 𝘀𝗲𝗰𝘂𝗿𝗲 𝗮𝗻𝗱 𝗿𝗲𝘀𝗶𝗹𝗶𝗲𝗻𝘁 𝗺𝘂𝗹𝘁𝗶-𝗰𝗹𝗼𝘂𝗱 𝘀𝘁𝗿𝗮𝘁𝗲𝗴𝘆 𝗮𝗰𝗿𝗼𝘀𝘀 𝗔𝗪𝗦, 𝗔𝘇𝘂𝗿𝗲 𝗮𝗻𝗱/𝗼𝗿 𝗚𝗖𝗣.
- Assess and modernize compute, networking, storage, databases, containers and platform services; reduce 𝘁𝗲𝗰𝗵𝗻𝗶𝗰𝗮𝗹 𝗱𝗲𝗯𝘁, 𝗰𝗼𝗺𝗽𝗹𝗲𝘅𝗶𝘁𝘆 𝗮𝗻𝗱 𝗼𝗽𝗲𝗿𝗮𝘁𝗶𝗼𝗻𝗮𝗹 𝗳𝗿𝗮𝗴𝗶𝗹𝗶𝘁𝘆.
- Establish engineering standards, reference architectures and controlled environments across 𝗗𝗲𝘃𝗲𝗹𝗼𝗽𝗺𝗲𝗻𝘁, 𝗧𝗲𝘀𝘁𝗶𝗻𝗴, 𝗦𝘁𝗮𝗴𝗶𝗻𝗴, 𝗨𝗔𝗧 𝗮𝗻𝗱 𝗣𝗿𝗼𝗱𝘂𝗰𝘁𝗶𝗼𝗻.
- Standardise provisioning and configuration through Infrastructure-as-Code (IaC), version control and governance.
- Evaluate 𝗛𝗶𝗴𝗵 𝗔𝘃𝗮𝗶𝗹𝗮𝗯𝗶𝗹𝗶𝘁𝘆, 𝗺𝘂𝗹𝘁𝗶-𝗿𝗲𝗴𝗶𝗼𝗻 𝗮𝗻𝗱 𝗿𝗲𝘀𝗶𝗹𝗶𝗲𝗻𝗰𝗲 𝗮𝗿𝗰𝗵𝗶𝘁𝗲𝗰𝘁𝘂𝗿𝗲𝘀 where required.
𝟮. 𝗘𝗻𝗱-𝘁𝗼-𝗘𝗻𝗱 𝗣𝗿𝗼𝗱𝘂𝗰𝘁𝗶𝗼𝗻 𝗢𝘄𝗻𝗲𝗿𝘀𝗵𝗶𝗽 & 𝗥𝗲𝗹𝗶𝗮𝗯𝗶𝗹𝗶𝘁𝘆
· Own the operational health of Suadeo Cloud production environments.
- Maintain visibility of customer environments, deployed versions, infrastructure dependencies, cloud resources, 𝗞𝘂𝗯𝗲𝗿𝗻𝗲𝘁𝗲𝘀 𝗰𝗹𝘂𝘀𝘁𝗲𝗿𝘀, 𝗱𝗮𝘁𝗮𝗯𝗮𝘀𝗲𝘀, 𝘀𝘁𝗼𝗿𝗮𝗴𝗲, 𝗰𝗲𝗿𝘁𝗶𝗳𝗶𝗰𝗮𝘁𝗲𝘀, 𝗯𝗮𝗰𝗸𝘂𝗽𝘀, 𝗰𝗮𝗽𝗮𝗰𝗶𝘁𝘆, 𝗺𝗼𝗻𝗶𝘁𝗼𝗿𝗶𝗻𝗴, 𝗶𝗻𝗰𝗶𝗱𝗲𝗻𝘁𝘀, 𝗿𝗶𝘀𝗸𝘀 𝗮𝗻𝗱 𝗽𝗹𝗮𝗻𝗻𝗲𝗱 𝗰𝗵𝗮𝗻𝗴𝗲𝘀.
- Drive the transition from reactive support to 𝗽𝗿𝗼𝗮𝗰𝘁𝗶𝘃𝗲 𝗥𝗲𝗹𝗶𝗮𝗯𝗶𝗹𝗶𝘁𝘆 𝗘𝗻𝗴𝗶𝗻𝗲𝗲𝗿𝗶𝗻𝗴.
- Establish measurable 𝗦𝗟𝗔𝘀, 𝗦𝗟𝗢𝘀 𝗮𝗻𝗱 𝗦𝗟𝗜𝘀, operational readiness standards and production health reviews.
- Provide management with a clear, factual view of 𝗽𝗿𝗼𝗱𝘂𝗰𝘁𝗶𝗼𝗻 𝗵𝗲𝗮𝗹𝘁𝗵, 𝗮𝘃𝗮𝗶𝗹𝗮𝗯𝗶𝗹𝗶𝘁𝘆, 𝗰𝗮𝗽𝗮𝗰𝗶𝘁𝘆, 𝗿𝗶𝘀𝗸 𝗮𝗻𝗱 𝗶𝗺𝗽𝗿𝗼𝘃𝗲𝗺𝗲𝗻𝘁 𝗽𝗿𝗶𝗼𝗿𝗶𝘁𝗶𝗲𝘀.
3. 𝗜𝗻𝗰𝗶𝗱𝗲𝗻𝘁, 𝗣𝗿𝗼𝗯𝗹𝗲𝗺, 𝗖𝗵𝗮𝗻𝗴𝗲 & 𝗥𝗲𝗹𝗲𝗮𝘀𝗲 𝗠𝗮𝗻𝗮𝗴𝗲𝗺𝗲𝗻𝘁
- Define and continuously improve production processes based on recognised industry practices and 𝗜𝗧𝗜𝗟-𝗮𝗹𝗶𝗴𝗻𝗲𝗱 𝗴𝗼𝘃𝗲𝗿𝗻𝗮𝗻𝗰𝗲.
- Establish 𝗣𝟭/𝗣𝟮/𝗣𝟯/𝗣𝟰 𝘀𝗲𝘃𝗲𝗿𝗶𝘁𝘆 𝗹𝗲𝘃𝗲𝗹𝘀, 𝗲𝘀𝗰𝗮𝗹𝗮𝘁𝗶𝗼𝗻 𝗽𝗮𝘁𝗵𝘀, 𝗼𝗻-𝗰𝗮𝗹𝗹 𝗼𝗿𝗴𝗮𝗻𝗶𝘀𝗮𝘁𝗶𝗼𝗻, 𝗶𝗻𝗰𝗶𝗱𝗲𝗻𝘁 𝗼𝘄𝗻𝗲𝗿𝘀𝗵𝗶𝗽, 𝗰𝗼𝗺𝗺𝘂𝗻𝗶𝗰𝗮𝘁𝗶𝗼𝗻 𝘀𝘁𝗮𝗻𝗱𝗮𝗿𝗱𝘀 𝗮𝗻𝗱 𝗠𝗧𝗧𝗔/𝗠𝗧𝗧𝗥 𝗺𝗲𝗮𝘀𝘂𝗿𝗲𝗺𝗲𝗻𝘁.
- Act as 𝗠𝗮𝗷𝗼𝗿 𝗜𝗻𝗰𝗶𝗱𝗲𝗻𝘁 𝗠𝗮𝗻𝗮𝗴𝗲𝗿 for critical incidents, coordinating Infrastructure, Cloud, DevOps, Development and Security teams through service restoration.
- Establish war rooms when required, assess customer/business impact, manage escalation and maintain a clear incident timeline.
- Retain accountability until the service is 𝗳𝘂𝗹𝗹𝘆 𝗿𝗲𝘀𝘁𝗼𝗿𝗲𝗱 𝗮𝗻𝗱 𝘁𝗵𝗲 𝗶𝗻𝗰𝗶𝗱𝗲𝗻𝘁 𝗶𝘀 𝘂𝗻𝗱𝗲𝗿𝘀𝘁𝗼𝗼𝗱.
- Lead structured 𝗥𝗼𝗼𝘁 𝗖𝗮𝘂𝘀𝗲 𝗔𝗻𝗮𝗹𝘆𝘀𝗶𝘀 (𝗥𝗖𝗔), 𝗣𝗿𝗼𝗯𝗹𝗲𝗺 𝗠𝗮𝗻𝗮𝗴𝗲𝗺𝗲𝗻𝘁, 𝗣𝗼𝘀𝘁-𝗠𝗼𝗿𝘁𝗲𝗺𝘀 / 𝗥𝗘𝗧𝗘𝗫, corrective and preventive actions.
- Ensure recurring/systemic issues have accountable owners and are tracked to permanent resolution.
- Establish robust 𝗖𝗵𝗮𝗻𝗴𝗲 𝗠𝗮𝗻𝗮𝗴𝗲𝗺𝗲𝗻𝘁 covering risk assessment, technical validation, approvals, maintenance windows, rollback procedures, traceability and post-deployment validation.
4. 𝗢𝗯𝘀𝗲𝗿𝘃𝗮𝗯𝗶𝗹𝗶𝘁𝘆, 𝗠𝗼𝗻𝗶𝘁𝗼𝗿𝗶𝗻𝗴 & 𝗢𝗽𝗲𝗿𝗮𝘁𝗶𝗼𝗻𝗮𝗹 𝗜𝗻𝘁𝗲𝗹𝗹𝗶𝗴𝗲𝗻𝗰𝗲
- Define and implement the overall 𝗢𝗯𝘀𝗲𝗿𝘃𝗮𝗯𝗶𝗹𝗶𝘁𝘆 𝗦𝘁𝗿𝗮𝘁𝗲𝗴𝘆 for Suadeo Cloud.
- Establish monitoring, logging, metrics, tracing and alerting across 𝗮𝗽𝗽𝗹𝗶𝗰𝗮𝘁𝗶𝗼𝗻𝘀, 𝗶𝗻𝗳𝗿𝗮𝘀𝘁𝗿𝘂𝗰𝘁𝘂𝗿𝗲, 𝗖𝗣𝗨, 𝗺𝗲𝗺𝗼𝗿𝘆, 𝘀𝘁𝗼𝗿𝗮𝗴𝗲, 𝗻𝗲𝘁𝘄𝗼𝗿𝗸, 𝗞𝘂𝗯𝗲𝗿𝗻𝗲𝘁𝗲𝘀, 𝗱𝗮𝘁𝗮𝗯𝗮𝘀𝗲𝘀, 𝗔𝗣𝗜𝘀, 𝘀𝗲𝗿𝘃𝗶𝗰𝗲𝘀, 𝗺𝗲𝘀𝘀𝗮𝗴𝗲 𝗾𝘂𝗲𝘂𝗲𝘀, 𝗰𝗲𝗿𝘁𝗶𝗳𝗶𝗰𝗮𝘁𝗲𝘀, 𝗯𝗮𝗰𝗸𝘂𝗽𝘀, 𝗽𝗲𝗿𝗳𝗼𝗿𝗺𝗮𝗻𝗰𝗲 𝗮𝗻𝗱 𝗲𝘅𝘁𝗲𝗿𝗻𝗮𝗹 𝗱𝗲𝗽𝗲𝗻𝗱𝗲𝗻𝗰𝗶𝗲𝘀.
- Build consolidated production dashboards and operational KPIs covering 𝗮𝘃𝗮𝗶𝗹𝗮𝗯𝗶𝗹𝗶𝘁𝘆, 𝗦𝗟𝗔/𝗦𝗟𝗢/𝗦𝗟𝗜 𝗰𝗼𝗺𝗽𝗹𝗶𝗮𝗻𝗰𝗲, 𝗶𝗻𝗰𝗶𝗱𝗲𝗻𝘁 𝘁𝗿𝗲𝗻𝗱𝘀 𝗮𝗻𝗱 𝘀𝗲𝗿𝘃𝗶𝗰𝗲 𝗵𝗲𝗮𝗹𝘁𝗵.
- Drive proactive detection so degradation is identified 𝗯𝗲𝗳𝗼𝗿𝗲 𝗰𝘂𝘀𝘁𝗼𝗺𝗲𝗿𝘀 𝗿𝗲𝗽𝗼𝗿𝘁 𝗶𝘁 𝘄𝗵𝗲𝗻𝗲𝘃𝗲𝗿 𝘁𝗲𝗰𝗵𝗻𝗶𝗰𝗮𝗹𝗹𝘆 𝗽𝗼𝘀𝘀𝗶𝗯𝗹𝗲.
𝟱. 𝗗𝗲𝘃𝗢𝗽𝘀, 𝗖𝗜/𝗖𝗗, 𝗜𝗮𝗖 & 𝗔𝘂𝘁𝗼𝗺𝗮𝘁𝗶𝗼𝗻
· Establish modern 𝗗𝗲𝘃𝗢𝗽𝘀 practices and reliable, automated and traceable 𝗖𝗜/𝗖𝗗 pipelines.
- Standardise provisioning using 𝗧𝗲𝗿𝗿𝗮𝗳𝗼𝗿𝗺 𝗼𝗿 𝗲𝗾𝘂𝗶𝘃𝗮𝗹𝗲𝗻𝘁 𝗜𝗻𝗳𝗿𝗮𝘀𝘁𝗿𝘂𝗰𝘁𝘂𝗿𝗲-𝗮𝘀-𝗖𝗼𝗱𝗲 (𝗜𝗮𝗖) tools.
- Implement 𝗚𝗶𝘁𝗢𝗽𝘀 practices where appropriate.
- Implement safe release patterns including 𝘇𝗲𝗿𝗼-𝗱𝗼𝘄𝗻𝘁𝗶𝗺𝗲, 𝗕𝗹𝘂𝗲/𝗚𝗿𝗲𝗲𝗻 𝗮𝗻𝗱 𝗖𝗮𝗻𝗮𝗿𝘆 𝗱𝗲𝗽𝗹𝗼𝘆𝗺𝗲𝗻𝘁𝘀 where appropriate.
- Progressively automate repetitive, manual and error-prone activities to create 𝗿𝗲𝗽𝗿𝗼𝗱𝘂𝗰𝗶𝗯𝗹𝗲, 𝗮𝘂𝗱𝗶𝘁𝗮𝗯𝗹𝗲 𝗮𝗻𝗱 𝘀𝗰𝗮𝗹𝗮𝗯𝗹𝗲 𝗼𝗽𝗲𝗿𝗮𝘁𝗶𝗼𝗻𝘀.
𝟲. 𝗔𝘃𝗮𝗶𝗹𝗮𝗯𝗶𝗹𝗶𝘁𝘆, 𝗥𝗲𝘀𝗶𝗹𝗶𝗲𝗻𝗰𝗲, 𝗗𝗶𝘀𝗮𝘀𝘁𝗲𝗿 𝗥𝗲𝗰𝗼𝘃𝗲𝗿𝘆 & 𝗕𝘂𝘀𝗶𝗻𝗲𝘀𝘀 𝗖𝗼𝗻𝘁𝗶𝗻𝘂𝗶𝘁𝘆
· Own and continuously improve 𝗛𝗶𝗴𝗵 𝗔𝘃𝗮𝗶𝗹𝗮𝗯𝗶𝗹𝗶𝘁𝘆, 𝗿𝗲𝘀𝗶𝗹𝗶𝗲𝗻𝗰𝗲, 𝗯𝗮𝗰𝗸𝘂𝗽, 𝗿𝗲𝗽𝗹𝗶𝗰𝗮𝘁𝗶𝗼𝗻, 𝗗𝗶𝘀𝗮𝘀𝘁𝗲𝗿 𝗥𝗲𝗰𝗼𝘃𝗲𝗿𝘆 (𝗗𝗥) 𝗮𝗻𝗱 𝗕𝘂𝘀𝗶𝗻𝗲𝘀𝘀 𝗖𝗼𝗻𝘁𝗶𝗻𝘂𝗶𝘁𝘆 (𝗕𝗖) capabilities.
- Define and maintain appropriate 𝗥𝗧𝗢 𝗮𝗻𝗱 𝗥𝗣𝗢 targets for critical systems and customer environments.
- Establish failover mechanisms and validate backup integrity through regular 𝗿𝗲𝘀𝘁𝗼𝗿𝗲 𝘁𝗲𝘀𝘁𝗶𝗻𝗴.
- Conduct documented 𝗗𝗥, 𝗳𝗮𝗶𝗹𝗼𝘃𝗲𝗿 𝗮𝗻𝗱 𝗿𝗲𝗰𝗼𝘃𝗲𝗿𝘆 𝘀𝗶𝗺𝘂𝗹𝗮𝘁𝗶𝗼𝗻𝘀.
𝟳. 𝗜𝗻𝗳𝗿𝗮𝘀𝘁𝗿𝘂𝗰𝘁𝘂𝗿𝗲 𝗦𝗲𝗰𝘂𝗿𝗶𝘁𝘆, 𝗥𝗶𝘀𝗸 & 𝗖𝗼𝗺𝗽𝗹𝗶𝗮𝗻𝗰𝗲
· Design and enforce secure cloud architectures based on 𝗟𝗲𝗮𝘀𝘁 𝗣𝗿𝗶𝘃𝗶𝗹𝗲𝗴𝗲, 𝘀𝘁𝗿𝗼𝗻𝗴 𝗜𝗔𝗠 𝗰𝗼𝗻𝘁𝗿𝗼𝗹𝘀 𝗮𝗻𝗱 𝗡𝗲𝘁𝘄𝗼𝗿𝗸 𝗦𝗲𝗴𝗺𝗲𝗻𝘁𝗮𝘁𝗶𝗼𝗻.
- Partner with Security leadership/CISO on 𝘃𝘂𝗹𝗻𝗲𝗿𝗮𝗯𝗶𝗹𝗶𝘁𝘆 𝗺𝗮𝗻𝗮𝗴𝗲𝗺𝗲𝗻𝘁, 𝗽𝗮𝘁𝗰𝗵𝗶𝗻𝗴, 𝗽𝗿𝗶𝘃𝗶𝗹𝗲𝗴𝗲𝗱 𝗮𝗰𝗰𝗲𝘀𝘀, 𝗜𝗔𝗠, 𝘀𝗲𝗰𝗿𝗲𝘁𝘀 𝗺𝗮𝗻𝗮𝗴𝗲𝗺𝗲𝗻𝘁, 𝗰𝗲𝗿𝘁𝗶𝗳𝗶𝗰𝗮𝘁𝗲 𝗹𝗶𝗳𝗲𝗰𝘆𝗰𝗹𝗲, 𝗶𝗻𝗳𝗿𝗮𝘀𝘁𝗿𝘂𝗰𝘁𝘂𝗿𝗲 𝗵𝗮𝗿𝗱𝗲𝗻𝗶𝗻𝗴, 𝗹𝗼𝗴𝗴𝗶𝗻𝗴 𝗮𝗻𝗱 𝘀𝗲𝗰𝘂𝗿𝗶𝘁𝘆 𝗺𝗼𝗻𝗶𝘁𝗼𝗿𝗶𝗻𝗴.
- Drive 𝗗𝗲𝘃𝗦𝗲𝗰𝗢𝗽𝘀 and automated remediation practices where appropriate.
- Own infrastructure-related remediation arising from 𝘀𝗲𝗰𝘂𝗿𝗶𝘁𝘆 𝗮𝘂𝗱𝗶𝘁𝘀, 𝘃𝘂𝗹𝗻𝗲𝗿𝗮𝗯𝗶𝗹𝗶𝘁𝘆 𝗮𝘀𝘀𝗲𝘀𝘀𝗺𝗲𝗻𝘁𝘀, 𝗽𝗲𝗻𝗲𝘁𝗿𝗮𝘁𝗶𝗼𝗻 𝘁𝗲𝘀𝘁𝘀, 𝗰𝗼𝗺𝗽𝗹𝗶𝗮𝗻𝗰𝗲 𝗿𝗲𝘃𝗶𝗲𝘄𝘀 𝗮𝗻𝗱 𝗰𝘂𝘀𝘁𝗼𝗺𝗲𝗿 𝘀𝗲𝗰𝘂𝗿𝗶𝘁𝘆 𝗮𝘀𝘀𝗲𝘀𝘀𝗺𝗲𝗻𝘁𝘀.
- Conduct regular infrastructure health and risk reviews and ensure risks are prioritised, assigned and remediated.
𝟴. 𝗖𝗮𝗽𝗮𝗰𝗶𝘁𝘆, 𝗣𝗲𝗿𝗳𝗼𝗿𝗺𝗮𝗻𝗰𝗲 & 𝗖𝗹𝗼𝘂𝗱 𝗙𝗶𝗻𝗢𝗽𝘀
· Implement proactive capacity management across 𝗰𝗼𝗺𝗽𝘂𝘁𝗲, 𝗺𝗲𝗺𝗼𝗿𝘆, 𝘀𝘁𝗼𝗿𝗮𝗴𝗲, 𝗻𝗲𝘁𝘄𝗼𝗿𝗸𝗶𝗻𝗴, 𝗱𝗮𝘁𝗮𝗯𝗮𝘀𝗲𝘀, 𝗞𝘂𝗯𝗲𝗿𝗻𝗲𝘁𝗲𝘀 𝗰𝗹𝘂𝘀𝘁𝗲𝗿𝘀, 𝗰𝗹𝗼𝘂𝗱 𝗿𝗲𝘀𝗼𝘂𝗿𝗰𝗲𝘀 𝗮𝗻𝗱 𝗮𝗽𝗽𝗹𝗶𝗰𝗮𝘁𝗶𝗼𝗻 𝘄𝗼𝗿𝗸𝗹𝗼𝗮𝗱𝘀.
· Forecast requirements and identify capacity risks before they become production incidents.
- Contribute to Cloud FinOps and cost optimization while protecting performance, availability, security and resilience.
𝟵. 𝗧𝗲𝗮𝗺 𝗟𝗲𝗮𝗱𝗲𝗿𝘀𝗵𝗶𝗽 & 𝗢𝗿𝗴𝗮𝗻𝗶𝘇𝗮𝘁𝗶𝗼𝗻 𝗗𝗲𝘀𝗶𝗴𝗻
𝟭𝟬. 𝗖𝗿𝗼𝘀𝘀-𝗙𝘂𝗻𝗰𝘁𝗶𝗼𝗻𝗮𝗹 𝗘𝗻𝗴𝗶𝗻𝗲𝗲𝗿𝗶𝗻𝗴 𝗟𝗲𝗮𝗱𝗲𝗿𝘀𝗵𝗶𝗽
· Partner closely with 𝗥&𝗗, 𝗦𝗼𝗳𝘁𝘄𝗮𝗿𝗲 𝗘𝗻𝗴𝗶𝗻𝗲𝗲𝗿𝗶𝗻𝗴, 𝗦𝗲𝗰𝘂𝗿𝗶𝘁𝘆 𝗮𝗻𝗱 𝗼𝘁𝗵𝗲𝗿 𝘀𝘁𝗮𝗸𝗲𝗵𝗼𝗹𝗱𝗲𝗿𝘀 to ensure production readiness and operational quality.
- Ensure Production operates as an 𝗘𝗻𝗴𝗶𝗻𝗲𝗲𝗿𝗶𝗻𝗴 𝗮𝗻𝗱 𝗥𝗲𝗹𝗶𝗮𝗯𝗶𝗹𝗶𝘁𝘆 𝗳𝘂𝗻𝗰𝘁𝗶𝗼𝗻—𝗻𝗼𝘁 𝘀𝗶𝗺𝗽𝗹𝘆 𝗮 𝘁𝗶𝗰𝗸𝗲𝘁-𝗿𝗼𝘂𝘁𝗶𝗻𝗴 𝗼𝗿 𝘀𝘂𝗽𝗽𝗼𝗿𝘁 𝗳𝘂𝗻𝗰𝘁𝗶𝗼𝗻.
𝟭𝟮. 𝗞𝗣𝗜𝘀 & 𝗘𝘅𝗲𝗰𝘂𝘁𝗶𝘃𝗲 𝗥𝗲𝗽𝗼𝗿𝘁𝗶𝗻𝗴
Establish regular reporting covering 𝗔𝘃𝗮𝗶𝗹𝗮𝗯𝗶𝗹𝗶𝘁𝘆, 𝗦𝗟𝗔/𝗦𝗟𝗢 𝗰𝗼𝗺𝗽𝗹𝗶𝗮𝗻𝗰𝗲, 𝗜𝗻𝗰𝗶𝗱𝗲𝗻𝘁𝘀, 𝗖𝗿𝗶𝘁𝗶𝗰𝗮𝗹 𝗜𝗻𝗰𝗶𝗱𝗲𝗻𝘁𝘀, 𝗠𝗧𝗧𝗔, 𝗠𝗧𝗧𝗥, 𝗜𝗻𝗰𝗶𝗱𝗲𝗻𝘁 𝗥𝗲𝗰𝘂𝗿𝗿𝗲𝗻𝗰𝗲, 𝗖𝗵𝗮𝗻𝗴𝗲 𝗦𝘂𝗰𝗰𝗲𝘀𝘀/𝗙𝗮𝗶𝗹𝘂𝗿𝗲, 𝗗𝗲𝗽𝗹𝗼𝘆𝗺𝗲𝗻𝘁 𝗦𝘂𝗰𝗰𝗲𝘀𝘀, 𝗖𝗮𝗽𝗮𝗰𝗶𝘁𝘆 𝗧𝗿𝗲𝗻𝗱𝘀, 𝗕𝗮𝗰𝗸𝘂𝗽/𝗥𝗲𝘀𝘁𝗼𝗿𝗲 𝗧𝗲𝘀𝘁𝘀, 𝗗𝗥 𝗘𝘅𝗲𝗿𝗰𝗶𝘀𝗲𝘀, 𝗦𝗲𝗰𝘂𝗿𝗶𝘁𝘆 𝗩𝘂𝗹𝗻𝗲𝗿𝗮𝗯𝗶𝗹𝗶𝘁𝗶𝗲𝘀, 𝗣𝗼𝘀𝘁-𝗠𝗼𝗿𝘁𝗲𝗺 𝗔𝗰𝘁𝗶𝗼𝗻𝘀 𝗮𝗻𝗱 𝗢𝗽𝗲𝗿𝗮𝘁𝗶𝗼𝗻𝗮𝗹 𝗥𝗶𝘀𝗸𝘀.
𝗖𝗮𝗻𝗱𝗶𝗱𝗮𝘁𝗲 𝗣𝗿𝗼𝗳𝗶𝗹𝗲
𝗘𝘅𝗽𝗲𝗿𝗶𝗲𝗻𝗰𝗲: Minimum 𝟭𝟮 𝘆𝗲𝗮𝗿𝘀 in IT Infrastructure / Cloud / DevOps / SRE / Production Operations, including at least 𝟱 𝘆𝗲𝗮𝗿𝘀 𝗶𝗻 𝗮 𝘀𝗲𝗻𝗶𝗼𝗿 𝗹𝗲𝗮𝗱𝗲𝗿𝘀𝗵𝗶𝗽 𝗿𝗼𝗹𝗲 owning critical production cloud environments.
𝗘𝗱𝘂𝗰𝗮𝘁𝗶𝗼𝗻: Bachelor's or Master's degree (M.S. / M.Tech) in Computer Science or a related technical discipline, or an MBA with a Technology Management focus.
Create a free Caio profile to unlock more results and save your role and location preferences.
Unlock free search