System Operations Engineer
Indexed description
Hi,勇者!在 Garena,我們崇尚開放的工作環境,鼓勵創新思維,提倡團隊而非孤單前行,討論最新的技術趨勢,並深信知識分享是成功的秘訣。現在就和我們一起勇闖遊戲前線,引領遊戲行業的潮流與未來吧!
#系統工程師 #維運工程師 #運維工程師 #Linux #Kubernetes #Grafana監控 #公有雲 #AIOps
◎ 你將負責 ......
- 導入及運維 Garena 的代理及自研遊戲,包含遊戲開發到上線的每個階段,參與遊戲架構設計評估,提供自動化維運、工具及資料庫設計等支援。
- 負責遊戲版本及內容更新、自動化維運導入,並探索以 AI 工具輔助運維流程的可能性,提升效率與可靠性。
- 在遊戲服務出現故障時,第一時間響應,對已知故障能按流程進行通報並按預案執行;未知故障組織相關人員聯合排除障礙,並善用 AI 輔助工具加速根因分析與問題定位。
- 對各遊戲的服務器資產進行管理,梳理服務器資源狀況、數據中心分佈情況、網絡專線及帶寬情況,能夠合理使用服務器資源,根據不同服務的需求分配不同配置的服務器,確保資源的充分利用。
- 參與 AIOps 工具或平台的評估、導入與落地,包含異常偵測、智能告警、容量預測等場景。
- 其餘例行性檢查及預案、緊急任務支援等。
- 工作環境:Linux,並以公有雲為主,地端為輔。
◎ 我們希望你具備 ......
技術能力
- Linux 操作經驗,熟練掌握系統管理、建置與日常維護任務。
- Kubernetes 基本概念與操作,具備容器化(Docker)應用部署、管理及優化經驗,理解微服務架構及其在 K8s 中的運行模式。
- Zabbix、Grafana 等監控工具的配置與使用,能設置服務監控、警報及視覺化儀表板。
- 能撰寫 Shell Script / Python,實現自動化操作、任務調度與日常運維管理。
- 有集群搭建、維護與運營經驗,能處理多節點部署、負載均衡等問題。
- 具備系統與應用層的故障排查能力,能快速定位問題並確保服務穩定性與高可用性。
- 扎實的網路與系統知識。
- 熟悉一種以上的公有雲平台。
- Vibe coding、n8n、dify 等 AI 或 workflow 應用。
AI 與自動化能力
- 有自動化運維流程導入經驗,能評估並落地提升維運效率的工具與流程。
- 有 AIOps 或 MCP 經驗者佳,包含異常偵測、AI 驅動告警降噪、n8n、dify、創造及複用skill 經驗...等
- 對 AI 工具抱持開放態度,願意主動探索並將其實際應用於日常維運工作中。
◎ 你知道嗎?Garena 的系統工程師與其他公司的機會差異在於,你將從這份職務獲得……
\ 探索多元產品架構 /
每款遊戲有獨立的架構,在 Garena 工作一年能抵外面三年,快進來累積豐富的運維經驗,快速提升產品架構設計與維護的專業技能吧!
\ 大規模分布式系統 /
工作將涉及跨機房架構的設計與維護,您將接觸到多種高效、可橫向擴展的解決方案,挑戰您在大規模分布式系統的運維能力!
\ 自動化 & 持續集成和部署 /
透過大規模部署及自動化更新的場景,您將學習如何運用自動化工具提升部署效率,並實現持續集成與部署的高效運維流程!
\ 高可用性與災難恢復的挑戰 /
您將參與規劃高可用性系統,並設計災難恢復方案,確保在任何情況下都能避免單點故障,保障遊戲服務的穩定運行!
Create a free Caio profile to unlock more results and save your role and location preferences.
Unlock free search