Python银行授信响应模型实战

2024-02-18 11:04

本文主要是介绍Python银行授信响应模型实战,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

        

目录

一、数据介绍及预处理

1、数据介绍

数据说明

2、数据分析

二、模型构建及评估

1、模型训练

三、划重点

少走10年弯路


        在金融信贷领域中,授信、定价等产品信息会直接影响客户是否用信,此外客户自身的需求程度、竞品授信定价信息、自身经济能力、家庭环境等等因素都会影响用信行为。对于放贷机构而言,在授信额度/定价允许的范围内(如额度越高、风险也会越高),希望能提高整体用信率、从而增加业务规模,那么如果能提前预测出用户的用信概率,就可以用于指导运营活动、授信定价策略,促进业务增长。

一、数据介绍及预处理

1、数据介绍

        数据来源某比赛网站(下图仅为部分字段),数据相对简单,除了地址编码外均为数值型变量,包括年龄、收入水平、家庭地址、学历等个人基本信息,以及是否有信用卡、是否有网银、信用卡指支出额等银行信息,Y标签为是否接受金融机构提供的个人贷款 文末获取数据集

图片

数据说明
ID客户ID
Age客户年龄(以完成年份计)
Experience工作经验/年
Income客户年收入(000美元)
ZIPCode家庭地址邮政编码。
Family客户的家庭规模
CCAvg每月平均信用卡支出(/1000美元)
Education教育水平。1:本科生;2:高中;3:专科
Mortgage房屋抵押价值。(/1000美元)
Securities Account客户在银行是否有证券账户
CD Account客户在银行是否有存款证明(CD)账户
Online客户是否使用网上银行设施
CreditCard客户是否使用环球银行发行的信用卡
Personal Loan该客户是否接受了提供的个人贷款

2、数据分析

(1)Y变量分布统计

        统计是否接受贷款的标签分布如下,可以看到5000样本中仅有9.6%接受贷款,即用信率仅有9.6%

图片

(2)IV统计

        首先针对是否接受贷款的标签计算特征IV值如下图,收入、月度信用卡支出的IV值明显高于其他特征,因此可以查看一下变量分布情况。

图片


import toad
def iv_miss(df,var_list,y):df_tmp=df[df[y].notnull()].copy()iv_all=toad.quality(df_tmp[var_list+[y]], target=y, indicators = ['iv','unique'])[['unique','iv']]miss_per=pd.DataFrame(df[var_list].isnull().sum()/(df.shape[0]))miss_per.columns=['缺失率']result=pd.concat([miss_per,iv_all],axis=1)return result.sort_values('iv',ascending=False)df_iv=iv_miss(df,fea_list,'Personal Loan')
df_iv

(3)变量分布分析

        对收入、月度信用卡支出两个特征统计频数分布分别如下,可以看到在特征分布上的区分比较明显,尤其是接受/拒绝对应收入的分布很大。

图片

图片

二、模型构建及评估

1、模型训练

        使用lightGBM构建二分类模型,按照8:2的比例划分训练集、测试集,然后使用ks、auc进行效果评估,结果如下、auc轻松达到0.99

图片

def init_params():params_lgb={'boosting_type': 'gbdt','objective': 'binary','metric':'auc','n_jobs': 8,'n_estimators':1300,'learning_rate': 0.03,'max_depth':4,'num_leaves': 12,'max_bin':255, 'subsample_for_bin':100000, 'min_split_gain':3,'min_child_samples':300,'colsample_bytree': 0.8,'subsample': 0.8,'subsample_freq': 1,   'feature_fraction_seed':2,'bagging_seed': 1,'reg_alpha':2,'reg_lambda':2,'scale_pos_weight':1,'silent':True,'random_state':1,'verbose':-1, # 控制模型训练过程的输出信息,-1为不输出信息}return params_lgbdef ks_auc_value(y_true,df,model):y_pred=model.predict_proba(df)[:,1]fpr,tpr,thresholds= roc_curve(list(y_true),list(y_pred))ks=max(tpr-fpr)auc= roc_auc_score(list(y_true),list(y_pred))return ks,aucdef model_train_sklearn(train,y_name,fea_list):params=init_params()x_train,x_test, y_train, y_test =train_test_split(train[fea_list],train[y_name],test_size=0.2, random_state=123)model=lgb.LGBMClassifier(**params)model.fit(x_train,y_train,eval_set=[(x_train, y_train),(x_test, y_test)])train_ks,train_auc=ks_auc_value(y_train,x_train,model)test_ks,test_auc=ks_auc_value(y_test,x_test,model)dic={'train_good':(y_train.count()-y_train.sum()),'train_bad':y_train.sum(),'test_good':(y_test.count()-y_test.sum()),'test_bad':y_test.sum(),'train_ks':train_ks,'train_auc':train_auc,'test_ks':test_ks,'test_auc':test_auc,}return dic,modelmodel_result,model=model_train_sklearn(df,'Personal Loan',fea_list)
model_result

三、划重点

少走10年弯路

        关注威信公众号 Python风控模型与数据分析,回复 银行授信响应实战 获取本篇数据及代码

        还有更多理论、代码分享等你来拿

这篇关于Python银行授信响应模型实战的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/720951

相关文章

Python安装时常见报错以及解决方案

《Python安装时常见报错以及解决方案》:本文主要介绍在安装Python、配置环境变量、使用pip以及运行Python脚本时常见的错误及其解决方案,文中介绍的非常详细,需要的朋友可以参考下... 目录一、安装 python 时常见报错及解决方案(一)安装包下载失败(二)权限不足二、配置环境变量时常见报错及

Python中顺序结构和循环结构示例代码

《Python中顺序结构和循环结构示例代码》:本文主要介绍Python中的条件语句和循环语句,条件语句用于根据条件执行不同的代码块,循环语句用于重复执行一段代码,文章还详细说明了range函数的使... 目录一、条件语句(1)条件语句的定义(2)条件语句的语法(a)单分支 if(b)双分支 if-else(

Python itertools中accumulate函数用法及使用运用详细讲解

《Pythonitertools中accumulate函数用法及使用运用详细讲解》:本文主要介绍Python的itertools库中的accumulate函数,该函数可以计算累积和或通过指定函数... 目录1.1前言:1.2定义:1.3衍生用法:1.3Leetcode的实际运用:总结 1.1前言:本文将详

Deepseek R1模型本地化部署+API接口调用详细教程(释放AI生产力)

《DeepseekR1模型本地化部署+API接口调用详细教程(释放AI生产力)》本文介绍了本地部署DeepSeekR1模型和通过API调用将其集成到VSCode中的过程,作者详细步骤展示了如何下载和... 目录前言一、deepseek R1模型与chatGPT o1系列模型对比二、本地部署步骤1.安装oll

Java深度学习库DJL实现Python的NumPy方式

《Java深度学习库DJL实现Python的NumPy方式》本文介绍了DJL库的背景和基本功能,包括NDArray的创建、数学运算、数据获取和设置等,同时,还展示了如何使用NDArray进行数据预处理... 目录1 NDArray 的背景介绍1.1 架构2 JavaDJL使用2.1 安装DJL2.2 基本操

在不同系统间迁移Python程序的方法与教程

《在不同系统间迁移Python程序的方法与教程》本文介绍了几种将Windows上编写的Python程序迁移到Linux服务器上的方法,包括使用虚拟环境和依赖冻结、容器化技术(如Docker)、使用An... 目录使用虚拟环境和依赖冻结1. 创建虚拟环境2. 冻结依赖使用容器化技术(如 docker)1. 创

Spring AI Alibaba接入大模型时的依赖问题小结

《SpringAIAlibaba接入大模型时的依赖问题小结》文章介绍了如何在pom.xml文件中配置SpringAIAlibaba依赖,并提供了一个示例pom.xml文件,同时,建议将Maven仓... 目录(一)pom.XML文件:(二)application.yml配置文件(一)pom.xml文件:首

Python创建Excel的4种方式小结

《Python创建Excel的4种方式小结》这篇文章主要为大家详细介绍了Python中创建Excel的4种常见方式,文中的示例代码简洁易懂,具有一定的参考价值,感兴趣的小伙伴可以学习一下... 目录库的安装代码1——pandas代码2——openpyxl代码3——xlsxwriterwww.cppcns.c

Python中Markdown库的使用示例详解

《Python中Markdown库的使用示例详解》Markdown库是一个用于处理Markdown文本的Python工具,这篇文章主要为大家详细介绍了Markdown库的具体使用,感兴趣的... 目录一、背景二、什么是 Markdown 库三、如何安装这个库四、库函数使用方法1. markdown.mark

一分钟带你上手Python调用DeepSeek的API

《一分钟带你上手Python调用DeepSeek的API》最近DeepSeek非常火,作为一枚对前言技术非常关注的程序员来说,自然都想对接DeepSeek的API来体验一把,下面小编就来为大家介绍一下... 目录前言免费体验API-Key申请首次调用API基本概念最小单元推理模型智能体自定义界面总结前言最