金融科技sre
大部分金融科技公司,其实都是小额贷款公司,最终赚钱都是通过贷款的利息差来进行。前段时间也了解了一下这块方向。
整体上核心业务就是:
- 注册
- 登陆
- 发卡
- 绑卡
- 消费
- 借款
- 还款
同时金融科技公司肯定最注重风险,一个是客户本身的风险,一个是资金的安全。因此在这些公司里风控是最最重要的。
因此很多时候就是强依赖,但是各种强依赖的业务流是否对呢?
比如消费这个场景,需要判断用户本身的账户可用余额,也需要判断用户这个消费场景是否有问题,以及用户这次花费是否超过账户的可用余额。
我查了下这个场景,大数据这边需要查询2个hologres库,一个oss bucket,7个MySQL数据库,1次QuickBI请求,2个外部API请求,还有决策引擎这边的查询。
我一直在想这个场景到底要多少秒。我用支付宝支付从发起支付到支付完成大概是6秒,其中2秒左右是等待指纹验证,其他就是各种后台等待了。
而且我看后台是有多个渠道去交易的,比如直接走visa卡的,有通过第三方交易平台的,也有自己的交易平台的。这里我们可以看到其实有有降级的。但是前面风控这一部分是完全不可能有降级的,没有我们之前做IM那种fallback的机制,因为产品,风控和内控部门认为这种是存在风险的。
但是我这里问的问题这个东西真的不能做fallback吗?比如微信被扫码的时候支付是没有网络的情况也可以的,那这个交易的时候微信是无法校验很多信息的,只有交易场所(扫码的机器)以及金额,还有登陆微信的设备信息。那这算不算是一种fallback的方法呢?
这种强依赖绑定的后果就是当时阿里云xxx地域一个az网络彻底挂了,但是这个地域只有那个az有hologres,于是所有相关的业务其实就停了。而作为后续方案除非阿里云在这个地域在另外一个az里上hologres,不然这个风险就会永远存在。而云厂商并不会赔偿你业务损失,顶多赔你一个月hologres的费用。话说就是因为这个前司因为阿里云新加坡挂了找阿里云赔偿上千万的损失,阿里云换了多少任销售都是把这个问题拖着。
从这个角度来看,sre在金融科技公司里同样也是需要梳理业务流程的,也要跟产品和风控部门协商好我们的fallback机制是什么,如果风控和老板们都认为这种情况就不可以有fallback,那也认了,但是前面是一定要提出来的。