Python银行授信响应模型实战

2024-02-18 11:04

本文主要是介绍Python银行授信响应模型实战,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

        

目录

一、数据介绍及预处理

1、数据介绍

数据说明

2、数据分析

二、模型构建及评估

1、模型训练

三、划重点

少走10年弯路


        在金融信贷领域中,授信、定价等产品信息会直接影响客户是否用信,此外客户自身的需求程度、竞品授信定价信息、自身经济能力、家庭环境等等因素都会影响用信行为。对于放贷机构而言,在授信额度/定价允许的范围内(如额度越高、风险也会越高),希望能提高整体用信率、从而增加业务规模,那么如果能提前预测出用户的用信概率,就可以用于指导运营活动、授信定价策略,促进业务增长。

一、数据介绍及预处理

1、数据介绍

        数据来源某比赛网站(下图仅为部分字段),数据相对简单,除了地址编码外均为数值型变量,包括年龄、收入水平、家庭地址、学历等个人基本信息,以及是否有信用卡、是否有网银、信用卡指支出额等银行信息,Y标签为是否接受金融机构提供的个人贷款 文末获取数据集

图片

数据说明
ID客户ID
Age客户年龄(以完成年份计)
Experience工作经验/年
Income客户年收入(000美元)
ZIPCode家庭地址邮政编码。
Family客户的家庭规模
CCAvg每月平均信用卡支出(/1000美元)
Education教育水平。1:本科生;2:高中;3:专科
Mortgage房屋抵押价值。(/1000美元)
Securities Account客户在银行是否有证券账户
CD Account客户在银行是否有存款证明(CD)账户
Online客户是否使用网上银行设施
CreditCard客户是否使用环球银行发行的信用卡
Personal Loan该客户是否接受了提供的个人贷款

2、数据分析

(1)Y变量分布统计

        统计是否接受贷款的标签分布如下,可以看到5000样本中仅有9.6%接受贷款,即用信率仅有9.6%

图片

(2)IV统计

        首先针对是否接受贷款的标签计算特征IV值如下图,收入、月度信用卡支出的IV值明显高于其他特征,因此可以查看一下变量分布情况。

图片


import toad
def iv_miss(df,var_list,y):df_tmp=df[df[y].notnull()].copy()iv_all=toad.quality(df_tmp[var_list+[y]], target=y, indicators = ['iv','unique'])[['unique','iv']]miss_per=pd.DataFrame(df[var_list].isnull().sum()/(df.shape[0]))miss_per.columns=['缺失率']result=pd.concat([miss_per,iv_all],axis=1)return result.sort_values('iv',ascending=False)df_iv=iv_miss(df,fea_list,'Personal Loan')
df_iv

(3)变量分布分析

        对收入、月度信用卡支出两个特征统计频数分布分别如下,可以看到在特征分布上的区分比较明显,尤其是接受/拒绝对应收入的分布很大。

图片

图片

二、模型构建及评估

1、模型训练

        使用lightGBM构建二分类模型,按照8:2的比例划分训练集、测试集,然后使用ks、auc进行效果评估,结果如下、auc轻松达到0.99

图片

def init_params():params_lgb={'boosting_type': 'gbdt','objective': 'binary','metric':'auc','n_jobs': 8,'n_estimators':1300,'learning_rate': 0.03,'max_depth':4,'num_leaves': 12,'max_bin':255, 'subsample_for_bin':100000, 'min_split_gain':3,'min_child_samples':300,'colsample_bytree': 0.8,'subsample': 0.8,'subsample_freq': 1,   'feature_fraction_seed':2,'bagging_seed': 1,'reg_alpha':2,'reg_lambda':2,'scale_pos_weight':1,'silent':True,'random_state':1,'verbose':-1, # 控制模型训练过程的输出信息,-1为不输出信息}return params_lgbdef ks_auc_value(y_true,df,model):y_pred=model.predict_proba(df)[:,1]fpr,tpr,thresholds= roc_curve(list(y_true),list(y_pred))ks=max(tpr-fpr)auc= roc_auc_score(list(y_true),list(y_pred))return ks,aucdef model_train_sklearn(train,y_name,fea_list):params=init_params()x_train,x_test, y_train, y_test =train_test_split(train[fea_list],train[y_name],test_size=0.2, random_state=123)model=lgb.LGBMClassifier(**params)model.fit(x_train,y_train,eval_set=[(x_train, y_train),(x_test, y_test)])train_ks,train_auc=ks_auc_value(y_train,x_train,model)test_ks,test_auc=ks_auc_value(y_test,x_test,model)dic={'train_good':(y_train.count()-y_train.sum()),'train_bad':y_train.sum(),'test_good':(y_test.count()-y_test.sum()),'test_bad':y_test.sum(),'train_ks':train_ks,'train_auc':train_auc,'test_ks':test_ks,'test_auc':test_auc,}return dic,modelmodel_result,model=model_train_sklearn(df,'Personal Loan',fea_list)
model_result

三、划重点

少走10年弯路

        关注威信公众号 Python风控模型与数据分析,回复 银行授信响应实战 获取本篇数据及代码

        还有更多理论、代码分享等你来拿

这篇关于Python银行授信响应模型实战的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/720951

相关文章

python logging模块详解及其日志定时清理方式

《pythonlogging模块详解及其日志定时清理方式》:本文主要介绍pythonlogging模块详解及其日志定时清理方式,具有很好的参考价值,希望对大家有所帮助,如有错误或未考虑完全的地... 目录python logging模块及日志定时清理1.创建logger对象2.logging.basicCo

Python如何自动生成环境依赖包requirements

《Python如何自动生成环境依赖包requirements》:本文主要介绍Python如何自动生成环境依赖包requirements问题,具有很好的参考价值,希望对大家有所帮助,如有错误或未考虑... 目录生成当前 python 环境 安装的所有依赖包1、命令2、常见问题只生成当前 项目 的所有依赖包1、

如何将Python彻底卸载的三种方法

《如何将Python彻底卸载的三种方法》通常我们在一些软件的使用上有碰壁,第一反应就是卸载重装,所以有小伙伴就问我Python怎么卸载才能彻底卸载干净,今天这篇文章,小编就来教大家如何彻底卸载Pyth... 目录软件卸载①方法:②方法:③方法:清理相关文件夹软件卸载①方法:首先,在安装python时,下

python uv包管理小结

《pythonuv包管理小结》uv是一个高性能的Python包管理工具,它不仅能够高效地处理包管理和依赖解析,还提供了对Python版本管理的支持,本文主要介绍了pythonuv包管理小结,具有一... 目录安装 uv使用 uv 管理 python 版本安装指定版本的 Python查看已安装的 Python

使用Python开发一个带EPUB转换功能的Markdown编辑器

《使用Python开发一个带EPUB转换功能的Markdown编辑器》Markdown因其简单易用和强大的格式支持,成为了写作者、开发者及内容创作者的首选格式,本文将通过Python开发一个Markd... 目录应用概览代码结构与核心组件1. 初始化与布局 (__init__)2. 工具栏 (setup_t

Python中局部变量和全局变量举例详解

《Python中局部变量和全局变量举例详解》:本文主要介绍如何通过一个简单的Python代码示例来解释命名空间和作用域的概念,它详细说明了内置名称、全局名称、局部名称以及它们之间的查找顺序,文中通... 目录引入例子拆解源码运行结果如下图代码解析 python3命名空间和作用域命名空间命名空间查找顺序命名空

Python如何将大TXT文件分割成4KB小文件

《Python如何将大TXT文件分割成4KB小文件》处理大文本文件是程序员经常遇到的挑战,特别是当我们需要把一个几百MB甚至几个GB的TXT文件分割成小块时,下面我们来聊聊如何用Python自动完成这... 目录为什么需要分割TXT文件基础版:按行分割进阶版:精确控制文件大小完美解决方案:支持UTF-8编码

基于Python打造一个全能文本处理工具

《基于Python打造一个全能文本处理工具》:本文主要介绍一个基于Python+Tkinter开发的全功能本地化文本处理工具,它不仅具备基础的格式转换功能,更集成了中文特色处理等实用功能,有需要的... 目录1. 概述:当文本处理遇上python图形界面2. 功能全景图:六大核心模块解析3.运行效果4. 相

Python中的魔术方法__new__详解

《Python中的魔术方法__new__详解》:本文主要介绍Python中的魔术方法__new__的使用,具有很好的参考价值,希望对大家有所帮助,如有错误或未考虑完全的地方,望不吝赐教... 目录一、核心意义与机制1.1 构造过程原理1.2 与 __init__ 对比二、核心功能解析2.1 核心能力2.2

Python虚拟环境终极(含PyCharm的使用教程)

《Python虚拟环境终极(含PyCharm的使用教程)》:本文主要介绍Python虚拟环境终极(含PyCharm的使用教程),具有很好的参考价值,希望对大家有所帮助,如有错误或未考虑完全的地方,... 目录一、为什么需要虚拟环境?二、虚拟环境创建方式对比三、命令行创建虚拟环境(venv)3.1 基础命令3