面議(經常性薪資達4萬元或以上) 台北市內湖區 工作經歷不拘 3天前更新
這是一個橫跨 Platform Engineering、SRE、DevOps 三種職能的綜合工程角色,是支撐 AIOps 對外承諾的技術基石。你將參與從專案需求訪談、系統開發整合、AI 工具打包部署,到計費監控與故障排除的完整生命週期,確保 GPU 叢集與雲端平台端到端穩定運行。
主要職責:
專案與平台整合:
進行開發專案的需求訪談與收斂
負責專案時程控管、交付物驗收、功能導入上線
持續開發管理與平台維運協調
AI 工具鏈建置與維運:
基於 K8s / Slurm 打包 AI 工具(如 Run:ai)
負責 AI 工具維運、監控、定期維護與故障排除
系統整合開發:
將需求轉化為開發規格、測試準則,評估整合架構
進行規格釐清、驗收標準確認與系統整合
系統整合維運、定期維護與故障排除
應用開發與部署:
執行前後端開發、部署上線、資料庫設計
撰寫並執行 test case,進行整合測試
平台維運監控與版本更新、資料庫維護、故障排除前測試
計費與成本監控(FinOps):
設計計費模型與資源優化規劃
部署計費工具與成本監控系統,串接 Cloud metering 數據
實作計費邏輯
執行成本監控、帳務異常排除與故障排除
展開