他顿了顿,补了一句:“到时候多条业务线各自占着各自服务器的局面就彻底结束了,全部整合到一个统一资源池里。哪条线流量上来了,资源自动调配,不用人工手动迁移。”
赵远点了点头。
这段时间他在学校和公司两头跑,但手上的事从来没停过。很多算法、方案、技术路径,都是他在课堂上想出来的。
有些写在笔记本上,有些直接画在草稿纸上,回公司就丢给研发去落地。基础设施部这些东西已经搞了几个月,进度比正常开发快了至少几倍。
“自动化运维系统呢?”赵远又问。
许晨光翻了一页:“这个差不多了,三月左右就能完成。服务器状态监控、故障自动切换、流量预警、日志分析....全部自动化。
运维团队以后不用人盯着屏幕看曲线了,靠系统报警,人只做判断和决策。核心功能已经跑通,剩下的都是细节优化。”
赵远想了想,说:“先保证核心功能稳定,细节后面慢慢补。做完之后仔细测试,不要急着上线。内部业务先迁移跑一段时间,稳了再说。”
“明白。”
许晨光在心里把这三块的作用默默捋了一遍。
资源池化解决的是效率问题。以前每条业务线各买各的服务器,游戏买一百台,社交网买一百台....,各用各的。
但业务有高峰有低谷,凌晨三点游戏在线人数少,那些服务器闲着也是闲着。资源池化之后,闲着的算力自动调给忙的业务用,不用再为“峰值”囤机器,光硬件采购成本就能砍掉一大截。
自动化运维解决的是人力问题。服务器越来越多,光靠人盯着屏幕看曲线,累死也盯不过来。自动化运维系统把监控、预警、故障切换...全部打包交给程序。
以前一个故障从发现到解决要半小时,以后三十秒。
负载均衡解决的是稳定问题。流量暴涨的时候,系统自动把请求分散到多台服务器,不会出现一台被挤爆、旁边闲着的情况。
用户感知到的就是“不卡了”,但对公司来说,这是用户体验的生命线。
这三样东西,单独拿出来每一样都能省几百万。合在一起,就是长远科技未来三年不需要在运维上操心的底气。
PS:感谢兄弟们礼物、好评、催更,
本章未完,请点击下一页继续阅读!