Python银行授信响应模型实战

2024-02-18 11:04

本文主要是介绍Python银行授信响应模型实战,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

        

目录

一、数据介绍及预处理

1、数据介绍

数据说明

2、数据分析

二、模型构建及评估

1、模型训练

三、划重点

少走10年弯路


        在金融信贷领域中,授信、定价等产品信息会直接影响客户是否用信,此外客户自身的需求程度、竞品授信定价信息、自身经济能力、家庭环境等等因素都会影响用信行为。对于放贷机构而言,在授信额度/定价允许的范围内(如额度越高、风险也会越高),希望能提高整体用信率、从而增加业务规模,那么如果能提前预测出用户的用信概率,就可以用于指导运营活动、授信定价策略,促进业务增长。

一、数据介绍及预处理

1、数据介绍

        数据来源某比赛网站(下图仅为部分字段),数据相对简单,除了地址编码外均为数值型变量,包括年龄、收入水平、家庭地址、学历等个人基本信息,以及是否有信用卡、是否有网银、信用卡指支出额等银行信息,Y标签为是否接受金融机构提供的个人贷款 文末获取数据集

图片

数据说明
ID客户ID
Age客户年龄(以完成年份计)
Experience工作经验/年
Income客户年收入(000美元)
ZIPCode家庭地址邮政编码。
Family客户的家庭规模
CCAvg每月平均信用卡支出(/1000美元)
Education教育水平。1:本科生;2:高中;3:专科
Mortgage房屋抵押价值。(/1000美元)
Securities Account客户在银行是否有证券账户
CD Account客户在银行是否有存款证明(CD)账户
Online客户是否使用网上银行设施
CreditCard客户是否使用环球银行发行的信用卡
Personal Loan该客户是否接受了提供的个人贷款

2、数据分析

(1)Y变量分布统计

        统计是否接受贷款的标签分布如下,可以看到5000样本中仅有9.6%接受贷款,即用信率仅有9.6%

图片

(2)IV统计

        首先针对是否接受贷款的标签计算特征IV值如下图,收入、月度信用卡支出的IV值明显高于其他特征,因此可以查看一下变量分布情况。

图片


import toad
def iv_miss(df,var_list,y):df_tmp=df[df[y].notnull()].copy()iv_all=toad.quality(df_tmp[var_list+[y]], target=y, indicators = ['iv','unique'])[['unique','iv']]miss_per=pd.DataFrame(df[var_list].isnull().sum()/(df.shape[0]))miss_per.columns=['缺失率']result=pd.concat([miss_per,iv_all],axis=1)return result.sort_values('iv',ascending=False)df_iv=iv_miss(df,fea_list,'Personal Loan')
df_iv

(3)变量分布分析

        对收入、月度信用卡支出两个特征统计频数分布分别如下,可以看到在特征分布上的区分比较明显,尤其是接受/拒绝对应收入的分布很大。

图片

图片

二、模型构建及评估

1、模型训练

        使用lightGBM构建二分类模型,按照8:2的比例划分训练集、测试集,然后使用ks、auc进行效果评估,结果如下、auc轻松达到0.99

图片

def init_params():params_lgb={'boosting_type': 'gbdt','objective': 'binary','metric':'auc','n_jobs': 8,'n_estimators':1300,'learning_rate': 0.03,'max_depth':4,'num_leaves': 12,'max_bin':255, 'subsample_for_bin':100000, 'min_split_gain':3,'min_child_samples':300,'colsample_bytree': 0.8,'subsample': 0.8,'subsample_freq': 1,   'feature_fraction_seed':2,'bagging_seed': 1,'reg_alpha':2,'reg_lambda':2,'scale_pos_weight':1,'silent':True,'random_state':1,'verbose':-1, # 控制模型训练过程的输出信息,-1为不输出信息}return params_lgbdef ks_auc_value(y_true,df,model):y_pred=model.predict_proba(df)[:,1]fpr,tpr,thresholds= roc_curve(list(y_true),list(y_pred))ks=max(tpr-fpr)auc= roc_auc_score(list(y_true),list(y_pred))return ks,aucdef model_train_sklearn(train,y_name,fea_list):params=init_params()x_train,x_test, y_train, y_test =train_test_split(train[fea_list],train[y_name],test_size=0.2, random_state=123)model=lgb.LGBMClassifier(**params)model.fit(x_train,y_train,eval_set=[(x_train, y_train),(x_test, y_test)])train_ks,train_auc=ks_auc_value(y_train,x_train,model)test_ks,test_auc=ks_auc_value(y_test,x_test,model)dic={'train_good':(y_train.count()-y_train.sum()),'train_bad':y_train.sum(),'test_good':(y_test.count()-y_test.sum()),'test_bad':y_test.sum(),'train_ks':train_ks,'train_auc':train_auc,'test_ks':test_ks,'test_auc':test_auc,}return dic,modelmodel_result,model=model_train_sklearn(df,'Personal Loan',fea_list)
model_result

三、划重点

少走10年弯路

        关注威信公众号 Python风控模型与数据分析,回复 银行授信响应实战 获取本篇数据及代码

        还有更多理论、代码分享等你来拿

这篇关于Python银行授信响应模型实战的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/720951

相关文章

Python版本信息获取方法详解与实战

《Python版本信息获取方法详解与实战》在Python开发中,获取Python版本号是调试、兼容性检查和版本控制的重要基础操作,本文详细介绍了如何使用sys和platform模块获取Python的主... 目录1. python版本号获取基础2. 使用sys模块获取版本信息2.1 sys模块概述2.1.1

一文详解Python如何开发游戏

《一文详解Python如何开发游戏》Python是一种非常流行的编程语言,也可以用来开发游戏模组,:本文主要介绍Python如何开发游戏的相关资料,文中通过代码介绍的非常详细,需要的朋友可以参考下... 目录一、python简介二、Python 开发 2D 游戏的优劣势优势缺点三、Python 开发 3D

Python函数作用域与闭包举例深度解析

《Python函数作用域与闭包举例深度解析》Python函数的作用域规则和闭包是编程中的关键概念,它们决定了变量的访问和生命周期,:本文主要介绍Python函数作用域与闭包的相关资料,文中通过代码... 目录1. 基础作用域访问示例1:访问全局变量示例2:访问外层函数变量2. 闭包基础示例3:简单闭包示例4

Python实现字典转字符串的五种方法

《Python实现字典转字符串的五种方法》本文介绍了在Python中如何将字典数据结构转换为字符串格式的多种方法,首先可以通过内置的str()函数进行简单转换;其次利用ison.dumps()函数能够... 目录1、使用json模块的dumps方法:2、使用str方法:3、使用循环和字符串拼接:4、使用字符

Python版本与package版本兼容性检查方法总结

《Python版本与package版本兼容性检查方法总结》:本文主要介绍Python版本与package版本兼容性检查方法的相关资料,文中提供四种检查方法,分别是pip查询、conda管理、PyP... 目录引言为什么会出现兼容性问题方法一:用 pip 官方命令查询可用版本方法二:conda 管理包环境方法

基于Python开发Windows自动更新控制工具

《基于Python开发Windows自动更新控制工具》在当今数字化时代,操作系统更新已成为计算机维护的重要组成部分,本文介绍一款基于Python和PyQt5的Windows自动更新控制工具,有需要的可... 目录设计原理与技术实现系统架构概述数学建模工具界面完整代码实现技术深度分析多层级控制理论服务层控制注

pycharm跑python项目易出错的问题总结

《pycharm跑python项目易出错的问题总结》:本文主要介绍pycharm跑python项目易出错问题的相关资料,当你在PyCharm中运行Python程序时遇到报错,可以按照以下步骤进行排... 1. 一定不要在pycharm终端里面创建环境安装别人的项目子模块等,有可能出现的问题就是你不报错都安装

Python打包成exe常用的四种方法小结

《Python打包成exe常用的四种方法小结》本文主要介绍了Python打包成exe常用的四种方法,包括PyInstaller、cx_Freeze、Py2exe、Nuitka,文中通过示例代码介绍的非... 目录一.PyInstaller11.安装:2. PyInstaller常用参数下面是pyinstal

Python爬虫HTTPS使用requests,httpx,aiohttp实战中的证书异步等问题

《Python爬虫HTTPS使用requests,httpx,aiohttp实战中的证书异步等问题》在爬虫工程里,“HTTPS”是绕不开的话题,HTTPS为传输加密提供保护,同时也给爬虫带来证书校验、... 目录一、核心问题与优先级检查(先问三件事)二、基础示例:requests 与证书处理三、高并发选型:

Python中isinstance()函数原理解释及详细用法示例

《Python中isinstance()函数原理解释及详细用法示例》isinstance()是Python内置的一个非常有用的函数,用于检查一个对象是否属于指定的类型或类型元组中的某一个类型,它是Py... 目录python中isinstance()函数原理解释及详细用法指南一、isinstance()函数