Back to search
Suadeo Linkedin · Posted yesterday

𝗛𝗲𝗮𝗱 𝗼𝗳 𝗖𝗹𝗼𝘂𝗱 𝗜𝗻𝗳𝗿𝗮𝘀𝘁𝗿𝘂𝗰𝘁𝘂𝗿𝗲 & 𝗣𝗿𝗼𝗱𝘂𝗰𝘁𝗶𝗼𝗻 (𝗜𝗻𝘀𝗶𝗱𝗲 𝗨𝗔𝗘 𝗖𝗮𝗻𝗱𝗶𝗱𝗮𝘁𝗲 𝗢𝗻𝗹𝘆)

United Arab Emirates

Linkedin
Continue to application Add your email once, then Caio opens the original posting.

Indexed description

𝗔𝗯𝗼𝘂𝘁 𝘁𝗵𝗲 𝗥𝗼𝗹𝗲


The 𝗛𝗲𝗮𝗱 𝗼𝗳 𝗖𝗹𝗼𝘂𝗱 𝗜𝗻𝗳𝗿𝗮𝘀𝘁𝗿𝘂𝗰𝘁𝘂𝗿𝗲 & 𝗣𝗿𝗼𝗱𝘂𝗰𝘁𝗶𝗼𝗻 is a critical technology leadership role responsible for transforming Suadeo Cloud from a reactive infrastructure/support function into a 𝗽𝗿𝗼𝗮𝗰𝘁𝗶𝘃𝗲, 𝘄𝗼𝗿𝗹𝗱-𝗰𝗹𝗮𝘀𝘀 𝗥𝗲𝗹𝗶𝗮𝗯𝗶𝗹𝗶𝘁𝘆 𝗘𝗻𝗴𝗶𝗻𝗲𝗲𝗿𝗶𝗻𝗴 𝗮𝗻𝗱 𝗣𝗿𝗼𝗱𝘂𝗰𝘁𝗶𝗼𝗻 𝗼𝗿𝗴𝗮𝗻𝗶𝘀𝗮𝘁𝗶𝗼𝗻.

Reporting directly to the CTO, you will bridge 𝘀𝘁𝗿𝗮𝘁𝗲𝗴𝗶𝗰 𝘁𝗲𝗰𝗵𝗻𝗼𝗹𝗼𝗴𝘆 𝗱𝗶𝗿𝗲𝗰𝘁𝗶𝗼𝗻 𝗮𝗻𝗱 𝗵𝗮𝗻𝗱𝘀-𝗼𝗻 𝗼𝗽𝗲𝗿𝗮𝘁𝗶𝗼𝗻𝗮𝗹 𝗲𝘅𝗲𝗰𝘂𝘁𝗶𝗼𝗻, with end-to-end accountability for the 𝗮𝘃𝗮𝗶𝗹𝗮𝗯𝗶𝗹𝗶𝘁𝘆, 𝗿𝗲𝗹𝗶𝗮𝗯𝗶𝗹𝗶𝘁𝘆, 𝗽𝗲𝗿𝗳𝗼𝗿𝗺𝗮𝗻𝗰𝗲, 𝘀𝗲𝗰𝘂𝗿𝗶𝘁𝘆, 𝗿𝗲𝘀𝗶𝗹𝗶𝗲𝗻𝗰𝗲 𝗮𝗻𝗱 𝗼𝗽𝗲𝗿𝗮𝘁𝗶𝗼𝗻𝗮𝗹 𝗾𝘂𝗮𝗹𝗶𝘁𝘆 of customer-facing production environments.

𝗞𝗲𝘆 𝗥𝗲𝘀𝗽𝗼𝗻𝘀𝗶𝗯𝗶𝗹𝗶𝘁𝗶𝗲𝘀

𝟭. 𝗖𝗹𝗼𝘂𝗱 & 𝗜𝗻𝗳𝗿𝗮𝘀𝘁𝗿𝘂𝗰𝘁𝘂𝗿𝗲 𝗦𝘁𝗿𝗮𝘁𝗲𝗴𝘆

  • Define and execute a 𝘀𝗰𝗮𝗹𝗮𝗯𝗹𝗲, 𝘀𝗲𝗰𝘂𝗿𝗲 𝗮𝗻𝗱 𝗿𝗲𝘀𝗶𝗹𝗶𝗲𝗻𝘁 𝗺𝘂𝗹𝘁𝗶-𝗰𝗹𝗼𝘂𝗱 𝘀𝘁𝗿𝗮𝘁𝗲𝗴𝘆 𝗮𝗰𝗿𝗼𝘀𝘀 𝗔𝗪𝗦, 𝗔𝘇𝘂𝗿𝗲 𝗮𝗻𝗱/𝗼𝗿 𝗚𝗖𝗣.
  • Assess and modernize compute, networking, storage, databases, containers and platform services; reduce 𝘁𝗲𝗰𝗵𝗻𝗶𝗰𝗮𝗹 𝗱𝗲𝗯𝘁, 𝗰𝗼𝗺𝗽𝗹𝗲𝘅𝗶𝘁𝘆 𝗮𝗻𝗱 𝗼𝗽𝗲𝗿𝗮𝘁𝗶𝗼𝗻𝗮𝗹 𝗳𝗿𝗮𝗴𝗶𝗹𝗶𝘁𝘆.
  • Establish engineering standards, reference architectures and controlled environments across 𝗗𝗲𝘃𝗲𝗹𝗼𝗽𝗺𝗲𝗻𝘁, 𝗧𝗲𝘀𝘁𝗶𝗻𝗴, 𝗦𝘁𝗮𝗴𝗶𝗻𝗴, 𝗨𝗔𝗧 𝗮𝗻𝗱 𝗣𝗿𝗼𝗱𝘂𝗰𝘁𝗶𝗼𝗻.
  • Standardise provisioning and configuration through Infrastructure-as-Code (IaC), version control and governance.
  • Evaluate 𝗛𝗶𝗴𝗵 𝗔𝘃𝗮𝗶𝗹𝗮𝗯𝗶𝗹𝗶𝘁𝘆, 𝗺𝘂𝗹𝘁𝗶-𝗿𝗲𝗴𝗶𝗼𝗻 𝗮𝗻𝗱 𝗿𝗲𝘀𝗶𝗹𝗶𝗲𝗻𝗰𝗲 𝗮𝗿𝗰𝗵𝗶𝘁𝗲𝗰𝘁𝘂𝗿𝗲𝘀 where required.

𝟮. 𝗘𝗻𝗱-𝘁𝗼-𝗘𝗻𝗱 𝗣𝗿𝗼𝗱𝘂𝗰𝘁𝗶𝗼𝗻 𝗢𝘄𝗻𝗲𝗿𝘀𝗵𝗶𝗽 & 𝗥𝗲𝗹𝗶𝗮𝗯𝗶𝗹𝗶𝘁𝘆

· Own the operational health of Suadeo Cloud production environments.

  • Maintain visibility of customer environments, deployed versions, infrastructure dependencies, cloud resources, 𝗞𝘂𝗯𝗲𝗿𝗻𝗲𝘁𝗲𝘀 𝗰𝗹𝘂𝘀𝘁𝗲𝗿𝘀, 𝗱𝗮𝘁𝗮𝗯𝗮𝘀𝗲𝘀, 𝘀𝘁𝗼𝗿𝗮𝗴𝗲, 𝗰𝗲𝗿𝘁𝗶𝗳𝗶𝗰𝗮𝘁𝗲𝘀, 𝗯𝗮𝗰𝗸𝘂𝗽𝘀, 𝗰𝗮𝗽𝗮𝗰𝗶𝘁𝘆, 𝗺𝗼𝗻𝗶𝘁𝗼𝗿𝗶𝗻𝗴, 𝗶𝗻𝗰𝗶𝗱𝗲𝗻𝘁𝘀, 𝗿𝗶𝘀𝗸𝘀 𝗮𝗻𝗱 𝗽𝗹𝗮𝗻𝗻𝗲𝗱 𝗰𝗵𝗮𝗻𝗴𝗲𝘀.
  • Drive the transition from reactive support to 𝗽𝗿𝗼𝗮𝗰𝘁𝗶𝘃𝗲 𝗥𝗲𝗹𝗶𝗮𝗯𝗶𝗹𝗶𝘁𝘆 𝗘𝗻𝗴𝗶𝗻𝗲𝗲𝗿𝗶𝗻𝗴.
  • Establish measurable 𝗦𝗟𝗔𝘀, 𝗦𝗟𝗢𝘀 𝗮𝗻𝗱 𝗦𝗟𝗜𝘀, operational readiness standards and production health reviews.
  • Provide management with a clear, factual view of 𝗽𝗿𝗼𝗱𝘂𝗰𝘁𝗶𝗼𝗻 𝗵𝗲𝗮𝗹𝘁𝗵, 𝗮𝘃𝗮𝗶𝗹𝗮𝗯𝗶𝗹𝗶𝘁𝘆, 𝗰𝗮𝗽𝗮𝗰𝗶𝘁𝘆, 𝗿𝗶𝘀𝗸 𝗮𝗻𝗱 𝗶𝗺𝗽𝗿𝗼𝘃𝗲𝗺𝗲𝗻𝘁 𝗽𝗿𝗶𝗼𝗿𝗶𝘁𝗶𝗲𝘀.

3. 𝗜𝗻𝗰𝗶𝗱𝗲𝗻𝘁, 𝗣𝗿𝗼𝗯𝗹𝗲𝗺, 𝗖𝗵𝗮𝗻𝗴𝗲 & 𝗥𝗲𝗹𝗲𝗮𝘀𝗲 𝗠𝗮𝗻𝗮𝗴𝗲𝗺𝗲𝗻𝘁

  • Define and continuously improve production processes based on recognised industry practices and 𝗜𝗧𝗜𝗟-𝗮𝗹𝗶𝗴𝗻𝗲𝗱 𝗴𝗼𝘃𝗲𝗿𝗻𝗮𝗻𝗰𝗲.
  • Establish 𝗣𝟭/𝗣𝟮/𝗣𝟯/𝗣𝟰 𝘀𝗲𝘃𝗲𝗿𝗶𝘁𝘆 𝗹𝗲𝘃𝗲𝗹𝘀, 𝗲𝘀𝗰𝗮𝗹𝗮𝘁𝗶𝗼𝗻 𝗽𝗮𝘁𝗵𝘀, 𝗼𝗻-𝗰𝗮𝗹𝗹 𝗼𝗿𝗴𝗮𝗻𝗶𝘀𝗮𝘁𝗶𝗼𝗻, 𝗶𝗻𝗰𝗶𝗱𝗲𝗻𝘁 𝗼𝘄𝗻𝗲𝗿𝘀𝗵𝗶𝗽, 𝗰𝗼𝗺𝗺𝘂𝗻𝗶𝗰𝗮𝘁𝗶𝗼𝗻 𝘀𝘁𝗮𝗻𝗱𝗮𝗿𝗱𝘀 𝗮𝗻𝗱 𝗠𝗧𝗧𝗔/𝗠𝗧𝗧𝗥 𝗺𝗲𝗮𝘀𝘂𝗿𝗲𝗺𝗲𝗻𝘁.
  • Act as 𝗠𝗮𝗷𝗼𝗿 𝗜𝗻𝗰𝗶𝗱𝗲𝗻𝘁 𝗠𝗮𝗻𝗮𝗴𝗲𝗿 for critical incidents, coordinating Infrastructure, Cloud, DevOps, Development and Security teams through service restoration.
  • Establish war rooms when required, assess customer/business impact, manage escalation and maintain a clear incident timeline.
  • Retain accountability until the service is 𝗳𝘂𝗹𝗹𝘆 𝗿𝗲𝘀𝘁𝗼𝗿𝗲𝗱 𝗮𝗻𝗱 𝘁𝗵𝗲 𝗶𝗻𝗰𝗶𝗱𝗲𝗻𝘁 𝗶𝘀 𝘂𝗻𝗱𝗲𝗿𝘀𝘁𝗼𝗼𝗱.
  • Lead structured 𝗥𝗼𝗼𝘁 𝗖𝗮𝘂𝘀𝗲 𝗔𝗻𝗮𝗹𝘆𝘀𝗶𝘀 (𝗥𝗖𝗔), 𝗣𝗿𝗼𝗯𝗹𝗲𝗺 𝗠𝗮𝗻𝗮𝗴𝗲𝗺𝗲𝗻𝘁, 𝗣𝗼𝘀𝘁-𝗠𝗼𝗿𝘁𝗲𝗺𝘀 / 𝗥𝗘𝗧𝗘𝗫, corrective and preventive actions.
  • Ensure recurring/systemic issues have accountable owners and are tracked to permanent resolution.
  • Establish robust 𝗖𝗵𝗮𝗻𝗴𝗲 𝗠𝗮𝗻𝗮𝗴𝗲𝗺𝗲𝗻𝘁 covering risk assessment, technical validation, approvals, maintenance windows, rollback procedures, traceability and post-deployment validation.

4. 𝗢𝗯𝘀𝗲𝗿𝘃𝗮𝗯𝗶𝗹𝗶𝘁𝘆, 𝗠𝗼𝗻𝗶𝘁𝗼𝗿𝗶𝗻𝗴 & 𝗢𝗽𝗲𝗿𝗮𝘁𝗶𝗼𝗻𝗮𝗹 𝗜𝗻𝘁𝗲𝗹𝗹𝗶𝗴𝗲𝗻𝗰𝗲

  • Define and implement the overall 𝗢𝗯𝘀𝗲𝗿𝘃𝗮𝗯𝗶𝗹𝗶𝘁𝘆 𝗦𝘁𝗿𝗮𝘁𝗲𝗴𝘆 for Suadeo Cloud.
  • Establish monitoring, logging, metrics, tracing and alerting across 𝗮𝗽𝗽𝗹𝗶𝗰𝗮𝘁𝗶𝗼𝗻𝘀, 𝗶𝗻𝗳𝗿𝗮𝘀𝘁𝗿𝘂𝗰𝘁𝘂𝗿𝗲, 𝗖𝗣𝗨, 𝗺𝗲𝗺𝗼𝗿𝘆, 𝘀𝘁𝗼𝗿𝗮𝗴𝗲, 𝗻𝗲𝘁𝘄𝗼𝗿𝗸, 𝗞𝘂𝗯𝗲𝗿𝗻𝗲𝘁𝗲𝘀, 𝗱𝗮𝘁𝗮𝗯𝗮𝘀𝗲𝘀, 𝗔𝗣𝗜𝘀, 𝘀𝗲𝗿𝘃𝗶𝗰𝗲𝘀, 𝗺𝗲𝘀𝘀𝗮𝗴𝗲 𝗾𝘂𝗲𝘂𝗲𝘀, 𝗰𝗲𝗿𝘁𝗶𝗳𝗶𝗰𝗮𝘁𝗲𝘀, 𝗯𝗮𝗰𝗸𝘂𝗽𝘀, 𝗽𝗲𝗿𝗳𝗼𝗿𝗺𝗮𝗻𝗰𝗲 𝗮𝗻𝗱 𝗲𝘅𝘁𝗲𝗿𝗻𝗮𝗹 𝗱𝗲𝗽𝗲𝗻𝗱𝗲𝗻𝗰𝗶𝗲𝘀.
  • Build consolidated production dashboards and operational KPIs covering 𝗮𝘃𝗮𝗶𝗹𝗮𝗯𝗶𝗹𝗶𝘁𝘆, 𝗦𝗟𝗔/𝗦𝗟𝗢/𝗦𝗟𝗜 𝗰𝗼𝗺𝗽𝗹𝗶𝗮𝗻𝗰𝗲, 𝗶𝗻𝗰𝗶𝗱𝗲𝗻𝘁 𝘁𝗿𝗲𝗻𝗱𝘀 𝗮𝗻𝗱 𝘀𝗲𝗿𝘃𝗶𝗰𝗲 𝗵𝗲𝗮𝗹𝘁𝗵.
  • Drive proactive detection so degradation is identified 𝗯𝗲𝗳𝗼𝗿𝗲 𝗰𝘂𝘀𝘁𝗼𝗺𝗲𝗿𝘀 𝗿𝗲𝗽𝗼𝗿𝘁 𝗶𝘁 𝘄𝗵𝗲𝗻𝗲𝘃𝗲𝗿 𝘁𝗲𝗰𝗵𝗻𝗶𝗰𝗮𝗹𝗹𝘆 𝗽𝗼𝘀𝘀𝗶𝗯𝗹𝗲.


𝟱. 𝗗𝗲𝘃𝗢𝗽𝘀, 𝗖𝗜/𝗖𝗗, 𝗜𝗮𝗖 & 𝗔𝘂𝘁𝗼𝗺𝗮𝘁𝗶𝗼𝗻

· Establish modern 𝗗𝗲𝘃𝗢𝗽𝘀 practices and reliable, automated and traceable 𝗖𝗜/𝗖𝗗 pipelines.

  • Standardise provisioning using 𝗧𝗲𝗿𝗿𝗮𝗳𝗼𝗿𝗺 𝗼𝗿 𝗲𝗾𝘂𝗶𝘃𝗮𝗹𝗲𝗻𝘁 𝗜𝗻𝗳𝗿𝗮𝘀𝘁𝗿𝘂𝗰𝘁𝘂𝗿𝗲-𝗮𝘀-𝗖𝗼𝗱𝗲 (𝗜𝗮𝗖) tools.
  • Implement 𝗚𝗶𝘁𝗢𝗽𝘀 practices where appropriate.
  • Implement safe release patterns including 𝘇𝗲𝗿𝗼-𝗱𝗼𝘄𝗻𝘁𝗶𝗺𝗲, 𝗕𝗹𝘂𝗲/𝗚𝗿𝗲𝗲𝗻 𝗮𝗻𝗱 𝗖𝗮𝗻𝗮𝗿𝘆 𝗱𝗲𝗽𝗹𝗼𝘆𝗺𝗲𝗻𝘁𝘀 where appropriate.
  • Progressively automate repetitive, manual and error-prone activities to create 𝗿𝗲𝗽𝗿𝗼𝗱𝘂𝗰𝗶𝗯𝗹𝗲, 𝗮𝘂𝗱𝗶𝘁𝗮𝗯𝗹𝗲 𝗮𝗻𝗱 𝘀𝗰𝗮𝗹𝗮𝗯𝗹𝗲 𝗼𝗽𝗲𝗿𝗮𝘁𝗶𝗼𝗻𝘀.

𝟲. 𝗔𝘃𝗮𝗶𝗹𝗮𝗯𝗶𝗹𝗶𝘁𝘆, 𝗥𝗲𝘀𝗶𝗹𝗶𝗲𝗻𝗰𝗲, 𝗗𝗶𝘀𝗮𝘀𝘁𝗲𝗿 𝗥𝗲𝗰𝗼𝘃𝗲𝗿𝘆 & 𝗕𝘂𝘀𝗶𝗻𝗲𝘀𝘀 𝗖𝗼𝗻𝘁𝗶𝗻𝘂𝗶𝘁𝘆

· Own and continuously improve 𝗛𝗶𝗴𝗵 𝗔𝘃𝗮𝗶𝗹𝗮𝗯𝗶𝗹𝗶𝘁𝘆, 𝗿𝗲𝘀𝗶𝗹𝗶𝗲𝗻𝗰𝗲, 𝗯𝗮𝗰𝗸𝘂𝗽, 𝗿𝗲𝗽𝗹𝗶𝗰𝗮𝘁𝗶𝗼𝗻, 𝗗𝗶𝘀𝗮𝘀𝘁𝗲𝗿 𝗥𝗲𝗰𝗼𝘃𝗲𝗿𝘆 (𝗗𝗥) 𝗮𝗻𝗱 𝗕𝘂𝘀𝗶𝗻𝗲𝘀𝘀 𝗖𝗼𝗻𝘁𝗶𝗻𝘂𝗶𝘁𝘆 (𝗕𝗖) capabilities.

  • Define and maintain appropriate 𝗥𝗧𝗢 𝗮𝗻𝗱 𝗥𝗣𝗢 targets for critical systems and customer environments.
  • Establish failover mechanisms and validate backup integrity through regular 𝗿𝗲𝘀𝘁𝗼𝗿𝗲 𝘁𝗲𝘀𝘁𝗶𝗻𝗴.
  • Conduct documented 𝗗𝗥, 𝗳𝗮𝗶𝗹𝗼𝘃𝗲𝗿 𝗮𝗻𝗱 𝗿𝗲𝗰𝗼𝘃𝗲𝗿𝘆 𝘀𝗶𝗺𝘂𝗹𝗮𝘁𝗶𝗼𝗻𝘀.

𝟳. 𝗜𝗻𝗳𝗿𝗮𝘀𝘁𝗿𝘂𝗰𝘁𝘂𝗿𝗲 𝗦𝗲𝗰𝘂𝗿𝗶𝘁𝘆, 𝗥𝗶𝘀𝗸 & 𝗖𝗼𝗺𝗽𝗹𝗶𝗮𝗻𝗰𝗲

· Design and enforce secure cloud architectures based on 𝗟𝗲𝗮𝘀𝘁 𝗣𝗿𝗶𝘃𝗶𝗹𝗲𝗴𝗲, 𝘀𝘁𝗿𝗼𝗻𝗴 𝗜𝗔𝗠 𝗰𝗼𝗻𝘁𝗿𝗼𝗹𝘀 𝗮𝗻𝗱 𝗡𝗲𝘁𝘄𝗼𝗿𝗸 𝗦𝗲𝗴𝗺𝗲𝗻𝘁𝗮𝘁𝗶𝗼𝗻.

  • Partner with Security leadership/CISO on 𝘃𝘂𝗹𝗻𝗲𝗿𝗮𝗯𝗶𝗹𝗶𝘁𝘆 𝗺𝗮𝗻𝗮𝗴𝗲𝗺𝗲𝗻𝘁, 𝗽𝗮𝘁𝗰𝗵𝗶𝗻𝗴, 𝗽𝗿𝗶𝘃𝗶𝗹𝗲𝗴𝗲𝗱 𝗮𝗰𝗰𝗲𝘀𝘀, 𝗜𝗔𝗠, 𝘀𝗲𝗰𝗿𝗲𝘁𝘀 𝗺𝗮𝗻𝗮𝗴𝗲𝗺𝗲𝗻𝘁, 𝗰𝗲𝗿𝘁𝗶𝗳𝗶𝗰𝗮𝘁𝗲 𝗹𝗶𝗳𝗲𝗰𝘆𝗰𝗹𝗲, 𝗶𝗻𝗳𝗿𝗮𝘀𝘁𝗿𝘂𝗰𝘁𝘂𝗿𝗲 𝗵𝗮𝗿𝗱𝗲𝗻𝗶𝗻𝗴, 𝗹𝗼𝗴𝗴𝗶𝗻𝗴 𝗮𝗻𝗱 𝘀𝗲𝗰𝘂𝗿𝗶𝘁𝘆 𝗺𝗼𝗻𝗶𝘁𝗼𝗿𝗶𝗻𝗴.
  • Drive 𝗗𝗲𝘃𝗦𝗲𝗰𝗢𝗽𝘀 and automated remediation practices where appropriate.
  • Own infrastructure-related remediation arising from 𝘀𝗲𝗰𝘂𝗿𝗶𝘁𝘆 𝗮𝘂𝗱𝗶𝘁𝘀, 𝘃𝘂𝗹𝗻𝗲𝗿𝗮𝗯𝗶𝗹𝗶𝘁𝘆 𝗮𝘀𝘀𝗲𝘀𝘀𝗺𝗲𝗻𝘁𝘀, 𝗽𝗲𝗻𝗲𝘁𝗿𝗮𝘁𝗶𝗼𝗻 𝘁𝗲𝘀𝘁𝘀, 𝗰𝗼𝗺𝗽𝗹𝗶𝗮𝗻𝗰𝗲 𝗿𝗲𝘃𝗶𝗲𝘄𝘀 𝗮𝗻𝗱 𝗰𝘂𝘀𝘁𝗼𝗺𝗲𝗿 𝘀𝗲𝗰𝘂𝗿𝗶𝘁𝘆 𝗮𝘀𝘀𝗲𝘀𝘀𝗺𝗲𝗻𝘁𝘀.
  • Conduct regular infrastructure health and risk reviews and ensure risks are prioritised, assigned and remediated.

𝟴. 𝗖𝗮𝗽𝗮𝗰𝗶𝘁𝘆, 𝗣𝗲𝗿𝗳𝗼𝗿𝗺𝗮𝗻𝗰𝗲 & 𝗖𝗹𝗼𝘂𝗱 𝗙𝗶𝗻𝗢𝗽𝘀

· Implement proactive capacity management across 𝗰𝗼𝗺𝗽𝘂𝘁𝗲, 𝗺𝗲𝗺𝗼𝗿𝘆, 𝘀𝘁𝗼𝗿𝗮𝗴𝗲, 𝗻𝗲𝘁𝘄𝗼𝗿𝗸𝗶𝗻𝗴, 𝗱𝗮𝘁𝗮𝗯𝗮𝘀𝗲𝘀, 𝗞𝘂𝗯𝗲𝗿𝗻𝗲𝘁𝗲𝘀 𝗰𝗹𝘂𝘀𝘁𝗲𝗿𝘀, 𝗰𝗹𝗼𝘂𝗱 𝗿𝗲𝘀𝗼𝘂𝗿𝗰𝗲𝘀 𝗮𝗻𝗱 𝗮𝗽𝗽𝗹𝗶𝗰𝗮𝘁𝗶𝗼𝗻 𝘄𝗼𝗿𝗸𝗹𝗼𝗮𝗱𝘀.

· Forecast requirements and identify capacity risks before they become production incidents.

  • Contribute to Cloud FinOps and cost optimization while protecting performance, availability, security and resilience.

𝟵. 𝗧𝗲𝗮𝗺 𝗟𝗲𝗮𝗱𝗲𝗿𝘀𝗵𝗶𝗽 & 𝗢𝗿𝗴𝗮𝗻𝗶𝘇𝗮𝘁𝗶𝗼𝗻 𝗗𝗲𝘀𝗶𝗴𝗻

𝟭𝟬. 𝗖𝗿𝗼𝘀𝘀-𝗙𝘂𝗻𝗰𝘁𝗶𝗼𝗻𝗮𝗹 𝗘𝗻𝗴𝗶𝗻𝗲𝗲𝗿𝗶𝗻𝗴 𝗟𝗲𝗮𝗱𝗲𝗿𝘀𝗵𝗶𝗽

· Partner closely with 𝗥&𝗗, 𝗦𝗼𝗳𝘁𝘄𝗮𝗿𝗲 𝗘𝗻𝗴𝗶𝗻𝗲𝗲𝗿𝗶𝗻𝗴, 𝗦𝗲𝗰𝘂𝗿𝗶𝘁𝘆 𝗮𝗻𝗱 𝗼𝘁𝗵𝗲𝗿 𝘀𝘁𝗮𝗸𝗲𝗵𝗼𝗹𝗱𝗲𝗿𝘀 to ensure production readiness and operational quality.

  • Ensure Production operates as an 𝗘𝗻𝗴𝗶𝗻𝗲𝗲𝗿𝗶𝗻𝗴 𝗮𝗻𝗱 𝗥𝗲𝗹𝗶𝗮𝗯𝗶𝗹𝗶𝘁𝘆 𝗳𝘂𝗻𝗰𝘁𝗶𝗼𝗻—𝗻𝗼𝘁 𝘀𝗶𝗺𝗽𝗹𝘆 𝗮 𝘁𝗶𝗰𝗸𝗲𝘁-𝗿𝗼𝘂𝘁𝗶𝗻𝗴 𝗼𝗿 𝘀𝘂𝗽𝗽𝗼𝗿𝘁 𝗳𝘂𝗻𝗰𝘁𝗶𝗼𝗻.


𝟭𝟮. 𝗞𝗣𝗜𝘀 & 𝗘𝘅𝗲𝗰𝘂𝘁𝗶𝘃𝗲 𝗥𝗲𝗽𝗼𝗿𝘁𝗶𝗻𝗴

Establish regular reporting covering 𝗔𝘃𝗮𝗶𝗹𝗮𝗯𝗶𝗹𝗶𝘁𝘆, 𝗦𝗟𝗔/𝗦𝗟𝗢 𝗰𝗼𝗺𝗽𝗹𝗶𝗮𝗻𝗰𝗲, 𝗜𝗻𝗰𝗶𝗱𝗲𝗻𝘁𝘀, 𝗖𝗿𝗶𝘁𝗶𝗰𝗮𝗹 𝗜𝗻𝗰𝗶𝗱𝗲𝗻𝘁𝘀, 𝗠𝗧𝗧𝗔, 𝗠𝗧𝗧𝗥, 𝗜𝗻𝗰𝗶𝗱𝗲𝗻𝘁 𝗥𝗲𝗰𝘂𝗿𝗿𝗲𝗻𝗰𝗲, 𝗖𝗵𝗮𝗻𝗴𝗲 𝗦𝘂𝗰𝗰𝗲𝘀𝘀/𝗙𝗮𝗶𝗹𝘂𝗿𝗲, 𝗗𝗲𝗽𝗹𝗼𝘆𝗺𝗲𝗻𝘁 𝗦𝘂𝗰𝗰𝗲𝘀𝘀, 𝗖𝗮𝗽𝗮𝗰𝗶𝘁𝘆 𝗧𝗿𝗲𝗻𝗱𝘀, 𝗕𝗮𝗰𝗸𝘂𝗽/𝗥𝗲𝘀𝘁𝗼𝗿𝗲 𝗧𝗲𝘀𝘁𝘀, 𝗗𝗥 𝗘𝘅𝗲𝗿𝗰𝗶𝘀𝗲𝘀, 𝗦𝗲𝗰𝘂𝗿𝗶𝘁𝘆 𝗩𝘂𝗹𝗻𝗲𝗿𝗮𝗯𝗶𝗹𝗶𝘁𝗶𝗲𝘀, 𝗣𝗼𝘀𝘁-𝗠𝗼𝗿𝘁𝗲𝗺 𝗔𝗰𝘁𝗶𝗼𝗻𝘀 𝗮𝗻𝗱 𝗢𝗽𝗲𝗿𝗮𝘁𝗶𝗼𝗻𝗮𝗹 𝗥𝗶𝘀𝗸𝘀.


𝗖𝗮𝗻𝗱𝗶𝗱𝗮𝘁𝗲 𝗣𝗿𝗼𝗳𝗶𝗹𝗲

𝗘𝘅𝗽𝗲𝗿𝗶𝗲𝗻𝗰𝗲: Minimum 𝟭𝟮 𝘆𝗲𝗮𝗿𝘀 in IT Infrastructure / Cloud / DevOps / SRE / Production Operations, including at least 𝟱 𝘆𝗲𝗮𝗿𝘀 𝗶𝗻 𝗮 𝘀𝗲𝗻𝗶𝗼𝗿 𝗹𝗲𝗮𝗱𝗲𝗿𝘀𝗵𝗶𝗽 𝗿𝗼𝗹𝗲 owning critical production cloud environments.

𝗘𝗱𝘂𝗰𝗮𝘁𝗶𝗼𝗻: Bachelor's or Master's degree (M.S. / M.Tech) in Computer Science or a related technical discipline, or an MBA with a Technology Management focus.


Free. 20 seconds. No password. See every match in this search.

Create a free Caio profile to unlock more results and save your role and location preferences.

Unlock free search
Want help applying to roles like this? Search Caio for free. If repetitive applications get heavy, Managed Job Search adds supervised execution for $99/month.
View Managed Job Search