【课堂笔记】阿里云基于机器学习的客户流失预警分析

2024-04-12 16:32

本文主要是介绍【课堂笔记】阿里云基于机器学习的客户流失预警分析,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

图片会抽空传的。
学习的东西:
1.客户流失预警的分析方法
2.流失预警分析中的关键技术
3.使用机器学习pai进行分析
4.任务:通信公司客户流失预警分析

客户流失:由于企业各种营销手段的实施,而导致客户和企业终止合作的现象
哪些客户易流失呢:以前是用经验模型的方法来分析,找一些对行业有理解的人自己归纳流失用户的特性。
现在是从数据中提取。从已有数据中找出客户的共性。

分析流程

应用:成熟的行业,更关注减少流失而不是拉新
通信:商业:金融:

机器学习及决策树
机器学习:对于某类任务T和性能度量P,如果一个计算机程序在T上以P衡量的性能随着经验E而自我完善,那么我们称这个计算机程序在从经验E学习。
通过大量做站,找到seo的方向,其实也是一种低效的机器学习手段。或者说当以计算机的速度来处理seo,就是机器学习的应用了。

常见类型:监督学习和无监督学习
一个有样本,一个没样本,但随着时间推移会得出一些大概率的结果。
分类模型:决策树

如何构建决策树

1、准备工作:
观察数据,明确自变量和因变量
自变量:客户的属性
因变量:最终结果

明确信息度量方式:信息增益
熵:

案例:

从这里就可以知道按照什么方式来判断更好了
基尼系数:

明确分支终止条件
纯度:
记录条数:
循环次数:

构建决策树:
流程:

案例:







决策树算法系列:
一、ID3系列 迭代树3代
核心是信息熵,根据信息增益决定树的节点

拥有的问题:
信息度量不合理:倾向于选择取值多的字段
输入类型单一:离散型
不做剪枝,容易过拟合
c4.5:
用信息增益率代替信息增益
能对连续属性进行离散化,对不完整数据进行处理
进行剪枝

c50:
使用了boosting
前修剪、后修剪

二、CART

集成学习:针对同一数据集,训练多种学习器,来解决同一问题
bagging:
有放回抽样构建多个子集
训练多个分类器
最终结果由各分类器结果投票得出
实现非常简单


要注意分类器之间也是有共通点的,这里的计算是指的所有分类器之间没有任何联系的情况下。
boosting:
重复使用一类学习器来修改训练集
每次训练后根据结果调整样本的权重
每个学习器加权后的线性组合即为最终结果

adaboost

图中变大的代表加了权
stacking:
由两极组成,第一级为初级学习期,第二级为高级学习器
第一级学习器的输出作为第二级学习器的输入。

随机森林 randomforest
由许多决策树组成,树生成的时候采用了随机的方法
smart bagging:不单按行取值,还会按列取值
生成步骤:
随机采样,生成多个样本集

对每个样本集构建决策树
优点:
可以处理多分类
不会过拟合
容易实现并行
对数据集容错能力强

重要概念:
特征工程:最大限度地从原始数据中提取特征以供算法和模型使用
数据预处理:标准化、缩放、缺失值、变换、编码等
特征产生:结合业务数据,派生新的特征
特征选择:通过各种统计量、模型评分等,筛选合适的特征
降维:PCA、LDA等减少特征个数
能用更少的模型得出好的结果,就尽量不要用太多的模型。模型越多,受影响越多。

模型评估:解释&泛华
解释:模型能够很好的解释数据集叫做解释型模型
泛化:把一个模型使用在新的数据集上,如果表现非常糟糕,说明泛化能力差(顾名思义。使用广泛化)
过拟合:在原来的数据集表现的非常好,在另一个数据集上又太差了。这就是泛化能力差,也即是过拟合

客户流失预警的实现流程:

特征选择主要特征,次要特征尽量减少。

使用pai

这篇关于【课堂笔记】阿里云基于机器学习的客户流失预警分析的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/897653

相关文章

Python中的Walrus运算符分析示例详解

《Python中的Walrus运算符分析示例详解》Python中的Walrus运算符(:=)是Python3.8引入的一个新特性,允许在表达式中同时赋值和返回值,它的核心作用是减少重复计算,提升代码简... 目录1. 在循环中避免重复计算2. 在条件判断中同时赋值变量3. 在列表推导式或字典推导式中简化逻辑

Java学习手册之Filter和Listener使用方法

《Java学习手册之Filter和Listener使用方法》:本文主要介绍Java学习手册之Filter和Listener使用方法的相关资料,Filter是一种拦截器,可以在请求到达Servl... 目录一、Filter(过滤器)1. Filter 的工作原理2. Filter 的配置与使用二、Listen

Java程序进程起来了但是不打印日志的原因分析

《Java程序进程起来了但是不打印日志的原因分析》:本文主要介绍Java程序进程起来了但是不打印日志的原因分析,具有很好的参考价值,希望对大家有所帮助,如有错误或未考虑完全的地方,望不吝赐教... 目录Java程序进程起来了但是不打印日志的原因1、日志配置问题2、日志文件权限问题3、日志文件路径问题4、程序

Java字符串操作技巧之语法、示例与应用场景分析

《Java字符串操作技巧之语法、示例与应用场景分析》在Java算法题和日常开发中,字符串处理是必备的核心技能,本文全面梳理Java中字符串的常用操作语法,结合代码示例、应用场景和避坑指南,可快速掌握字... 目录引言1. 基础操作1.1 创建字符串1.2 获取长度1.3 访问字符2. 字符串处理2.1 子字

springboot整合阿里云百炼DeepSeek实现sse流式打印的操作方法

《springboot整合阿里云百炼DeepSeek实现sse流式打印的操作方法》:本文主要介绍springboot整合阿里云百炼DeepSeek实现sse流式打印,本文给大家介绍的非常详细,对大... 目录1.开通阿里云百炼,获取到key2.新建SpringBoot项目3.工具类4.启动类5.测试类6.测

Python 迭代器和生成器概念及场景分析

《Python迭代器和生成器概念及场景分析》yield是Python中实现惰性计算和协程的核心工具,结合send()、throw()、close()等方法,能够构建高效、灵活的数据流和控制流模型,这... 目录迭代器的介绍自定义迭代器省略的迭代器生产器的介绍yield的普通用法yield的高级用法yidle

利用Python快速搭建Markdown笔记发布系统

《利用Python快速搭建Markdown笔记发布系统》这篇文章主要为大家详细介绍了使用Python生态的成熟工具,在30分钟内搭建一个支持Markdown渲染、分类标签、全文搜索的私有化知识发布系统... 目录引言:为什么要自建知识博客一、技术选型:极简主义开发栈二、系统架构设计三、核心代码实现(分步解析

C++ Sort函数使用场景分析

《C++Sort函数使用场景分析》sort函数是algorithm库下的一个函数,sort函数是不稳定的,即大小相同的元素在排序后相对顺序可能发生改变,如果某些场景需要保持相同元素间的相对顺序,可使... 目录C++ Sort函数详解一、sort函数调用的两种方式二、sort函数使用场景三、sort函数排序

kotlin中const 和val的区别及使用场景分析

《kotlin中const和val的区别及使用场景分析》在Kotlin中,const和val都是用来声明常量的,但它们的使用场景和功能有所不同,下面给大家介绍kotlin中const和val的区别,... 目录kotlin中const 和val的区别1. val:2. const:二 代码示例1 Java

Go标准库常见错误分析和解决办法

《Go标准库常见错误分析和解决办法》Go语言的标准库为开发者提供了丰富且高效的工具,涵盖了从网络编程到文件操作等各个方面,然而,标准库虽好,使用不当却可能适得其反,正所谓工欲善其事,必先利其器,本文将... 目录1. 使用了错误的time.Duration2. time.After导致的内存泄漏3. jsO