【课堂笔记】阿里云基于机器学习的客户流失预警分析

2024-04-12 16:32

本文主要是介绍【课堂笔记】阿里云基于机器学习的客户流失预警分析,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

图片会抽空传的。
学习的东西:
1.客户流失预警的分析方法
2.流失预警分析中的关键技术
3.使用机器学习pai进行分析
4.任务:通信公司客户流失预警分析

客户流失:由于企业各种营销手段的实施,而导致客户和企业终止合作的现象
哪些客户易流失呢:以前是用经验模型的方法来分析,找一些对行业有理解的人自己归纳流失用户的特性。
现在是从数据中提取。从已有数据中找出客户的共性。

分析流程

应用:成熟的行业,更关注减少流失而不是拉新
通信:商业:金融:

机器学习及决策树
机器学习:对于某类任务T和性能度量P,如果一个计算机程序在T上以P衡量的性能随着经验E而自我完善,那么我们称这个计算机程序在从经验E学习。
通过大量做站,找到seo的方向,其实也是一种低效的机器学习手段。或者说当以计算机的速度来处理seo,就是机器学习的应用了。

常见类型:监督学习和无监督学习
一个有样本,一个没样本,但随着时间推移会得出一些大概率的结果。
分类模型:决策树

如何构建决策树

1、准备工作:
观察数据,明确自变量和因变量
自变量:客户的属性
因变量:最终结果

明确信息度量方式:信息增益
熵:

案例:

从这里就可以知道按照什么方式来判断更好了
基尼系数:

明确分支终止条件
纯度:
记录条数:
循环次数:

构建决策树:
流程:

案例:







决策树算法系列:
一、ID3系列 迭代树3代
核心是信息熵,根据信息增益决定树的节点

拥有的问题:
信息度量不合理:倾向于选择取值多的字段
输入类型单一:离散型
不做剪枝,容易过拟合
c4.5:
用信息增益率代替信息增益
能对连续属性进行离散化,对不完整数据进行处理
进行剪枝

c50:
使用了boosting
前修剪、后修剪

二、CART

集成学习:针对同一数据集,训练多种学习器,来解决同一问题
bagging:
有放回抽样构建多个子集
训练多个分类器
最终结果由各分类器结果投票得出
实现非常简单


要注意分类器之间也是有共通点的,这里的计算是指的所有分类器之间没有任何联系的情况下。
boosting:
重复使用一类学习器来修改训练集
每次训练后根据结果调整样本的权重
每个学习器加权后的线性组合即为最终结果

adaboost

图中变大的代表加了权
stacking:
由两极组成,第一级为初级学习期,第二级为高级学习器
第一级学习器的输出作为第二级学习器的输入。

随机森林 randomforest
由许多决策树组成,树生成的时候采用了随机的方法
smart bagging:不单按行取值,还会按列取值
生成步骤:
随机采样,生成多个样本集

对每个样本集构建决策树
优点:
可以处理多分类
不会过拟合
容易实现并行
对数据集容错能力强

重要概念:
特征工程:最大限度地从原始数据中提取特征以供算法和模型使用
数据预处理:标准化、缩放、缺失值、变换、编码等
特征产生:结合业务数据,派生新的特征
特征选择:通过各种统计量、模型评分等,筛选合适的特征
降维:PCA、LDA等减少特征个数
能用更少的模型得出好的结果,就尽量不要用太多的模型。模型越多,受影响越多。

模型评估:解释&泛华
解释:模型能够很好的解释数据集叫做解释型模型
泛化:把一个模型使用在新的数据集上,如果表现非常糟糕,说明泛化能力差(顾名思义。使用广泛化)
过拟合:在原来的数据集表现的非常好,在另一个数据集上又太差了。这就是泛化能力差,也即是过拟合

客户流失预警的实现流程:

特征选择主要特征,次要特征尽量减少。

使用pai

这篇关于【课堂笔记】阿里云基于机器学习的客户流失预警分析的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!


原文地址:
本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若转载,请注明出处:http://www.chinasem.cn/article/897653

相关文章

Go标准库常见错误分析和解决办法

《Go标准库常见错误分析和解决办法》Go语言的标准库为开发者提供了丰富且高效的工具,涵盖了从网络编程到文件操作等各个方面,然而,标准库虽好,使用不当却可能适得其反,正所谓工欲善其事,必先利其器,本文将... 目录1. 使用了错误的time.Duration2. time.After导致的内存泄漏3. jsO

Spring事务中@Transactional注解不生效的原因分析与解决

《Spring事务中@Transactional注解不生效的原因分析与解决》在Spring框架中,@Transactional注解是管理数据库事务的核心方式,本文将深入分析事务自调用的底层原理,解释为... 目录1. 引言2. 事务自调用问题重现2.1 示例代码2.2 问题现象3. 为什么事务自调用会失效3

找不到Anaconda prompt终端的原因分析及解决方案

《找不到Anacondaprompt终端的原因分析及解决方案》因为anaconda还没有初始化,在安装anaconda的过程中,有一行是否要添加anaconda到菜单目录中,由于没有勾选,导致没有菜... 目录问题原因问http://www.chinasem.cn题解决安装了 Anaconda 却找不到 An

Spring定时任务只执行一次的原因分析与解决方案

《Spring定时任务只执行一次的原因分析与解决方案》在使用Spring的@Scheduled定时任务时,你是否遇到过任务只执行一次,后续不再触发的情况?这种情况可能由多种原因导致,如未启用调度、线程... 目录1. 问题背景2. Spring定时任务的基本用法3. 为什么定时任务只执行一次?3.1 未启用

C++ 各种map特点对比分析

《C++各种map特点对比分析》文章比较了C++中不同类型的map(如std::map,std::unordered_map,std::multimap,std::unordered_multima... 目录特点比较C++ 示例代码 ​​​​​​代码解释特点比较1. std::map底层实现:基于红黑

Spring、Spring Boot、Spring Cloud 的区别与联系分析

《Spring、SpringBoot、SpringCloud的区别与联系分析》Spring、SpringBoot和SpringCloud是Java开发中常用的框架,分别针对企业级应用开发、快速开... 目录1. Spring 框架2. Spring Boot3. Spring Cloud总结1. Sprin

Spring 中 BeanFactoryPostProcessor 的作用和示例源码分析

《Spring中BeanFactoryPostProcessor的作用和示例源码分析》Spring的BeanFactoryPostProcessor是容器初始化的扩展接口,允许在Bean实例化前... 目录一、概览1. 核心定位2. 核心功能详解3. 关键特性二、Spring 内置的 BeanFactory

Java进阶学习之如何开启远程调式

《Java进阶学习之如何开启远程调式》Java开发中的远程调试是一项至关重要的技能,特别是在处理生产环境的问题或者协作开发时,:本文主要介绍Java进阶学习之如何开启远程调式的相关资料,需要的朋友... 目录概述Java远程调试的开启与底层原理开启Java远程调试底层原理JVM参数总结&nbsMbKKXJx

MyBatis-Plus中Service接口的lambdaUpdate用法及实例分析

《MyBatis-Plus中Service接口的lambdaUpdate用法及实例分析》本文将详细讲解MyBatis-Plus中的lambdaUpdate用法,并提供丰富的案例来帮助读者更好地理解和应... 目录深入探索MyBATis-Plus中Service接口的lambdaUpdate用法及示例案例背景

MyBatis-Plus中静态工具Db的多种用法及实例分析

《MyBatis-Plus中静态工具Db的多种用法及实例分析》本文将详细讲解MyBatis-Plus中静态工具Db的各种用法,并结合具体案例进行演示和说明,具有很好的参考价值,希望对大家有所帮助,如有... 目录MyBATis-Plus中静态工具Db的多种用法及实例案例背景使用静态工具Db进行数据库操作插入