每周一书《大数据时代的算法:机器学习、人工智能及其典型实例 》分享!

本文主要是介绍每周一书《大数据时代的算法:机器学习、人工智能及其典型实例 》分享!,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

《大数据时代的算法:机器学习、人工智能及其典型实例》介绍在互联网行业中经常涉及的算法,包括排序算法、查找算法、资源分配算法、路径分析算法、相似度分析算法,以及与机器学习相关的算法,包括数据分类算法、聚类算法、预测与估算算法、决策算法、关联规则分析算法及推荐算法。《大数据时代的算法:机器学习、人工智能及其典型实例》涉及的相关算法均为解决实际问题中的主流算法,对于工作和学习都有实际参考意义。《大数据时代的算法:机器学习、人工智能及其典型实例》是一本算法领域内的技术参考书籍,涵盖数十种算法,通过由浅入深的介绍基础算法和机器学习算法相关理论和应用,阐述了各个算法的应用场景及算法复杂度,使读者对算法的理解不只是停留在表面,还从应用的角度提供了大量实例,使读者能够快速、高效进阶各类算法,并能够熟练应用到将来的工作实践中。

目录:

第1章算法基础...................................1

I.I 基础算法分析类型………..…………. I

1.1.l 分治法................................. I

1.1.2 动态规划法......................... 2

1.1.3 回溯法................................. 3

1.1.4 分支限界法…...……………….4

l.1.5 贪心法................................. 4

1.2 算法性能分析….......……………….5

1.3 概率论与数理统计基础………..….6

1.4 距离计算......................................... 8

1.4.1 欧氏距离............................. 8

1.4.2 马氏距离............................. 9

1.4.3 曼哈顿距离......................... 9

1.4.4 切比雪夫距离....…………….. 9

1.4.5 闵氏距离............................. 9

1.4.6 海明距离........................... 10

1.5 排序算法....................................... 10

1.5.1 快速排序........................... 11

1.5.2 归并排序........................... 11

1.5.3 堆排序............................... 13

l.5.4 基数排序........................... 15

1.5.5 外排序............................... 16

1.6 字符压缩编码............................... 17

1.6.1 哈夫曼编码....................... 17

1.6.2 香农-范诺编码…...…….21

1.7 本章小结....................................... 24

第2章数据查找与资源分配算法…....25

2.1 数值查找算法.....…..…..…......... 25

2.1.1 二分搜索算法···········25

2.1.2 分块查找算法…………….. 27

2.1.3 哈希查找算法...………...… 28

2.2 字符串查找算法…...…...……....….. 30

2.2.1 Knuth-Morris-Pratt 算法... 31

2.2.2 Boyer-Moore 算法…….34

2.2.3 Sunday 算法······················37

2.3 海址数据中的查找………...…….... 39

2.3.1 基于布隆过滤器查找…... 39

2.3.2 倒排索弓I查找..............….. 41

2.4 银行家算法................................... 43

2.5 背包问题······································· 44

2.5.1 0-1背包问题.................... 45

2.5.2 部分背包问题………………. 46

2.6 本章小结....................................... 47

第3章路径分析算法......……....…...... 49

3.1 基千Dijkstra算法的路径分析............49

3.1.1 应用示例:极地探险....... 49

3.1.2 基于Dijkstra的最短路径规划............... 50

3.2 基千Floyd算法的路径分析…..... 53

3.2. 1 应用示例:任意两个城

市之间的最短路径............……... 53

3.2.2 Floyd原理........................ 54

3.2.3 基于Floyd算法计算两

个城市最短距离……....….. 56

3.3 基于A*算法的路径搜索……...... 58

3.3.1 应用实例:绕过障碍区

到达目的地....................... 58

3.3.2 A*算法与最短距离计算… 59

3.4 基于维特比算法的概率路径...... 61

3.4.1 应用实例:推断天气状态... 61

3.4.2 维特比算法思想……… 62

3.4.3 计算天气状态..... 62

3.5 最长公共子序列问题…………….. 64

3.5.1 概要................................... 64

3.5.2 最长公共子串………...…… 64

3.5.3 最长公共子序列原理…... 66

3.5.4 实例:求两宇符串的最

长公共子序列……..…...….. 66

3.6 本章小结·······································68

第4章相似度分析算法…..........69

4.1 应用实例:海量网页相似度分析............ 69

4.2 基千Jaccard相似系数的相似

度计算........................................... 70

4.2.1 计算流程........................... 70

4.2.2 狭义Jaccard相似系数..... 71

4.2.3 广义Jaccard相似系数..... 71

4.3 基于MinHash的相似性符法….. 71

4.3.l 与Jaccard相似性关系..... 71

4.3.2 计算网页文本相似性过程............ 72

4.4 向撮空间模型............................... 73

4.4. l 词袋模型....................73

4.4.2 TF-IDF算法…..…...…....….74

4.5 基千余弦相似性算法的相似度

分析············································76

4.5.1 原理基础........................... 76

4.5.2 公式解析························… 77

4.5.3 计算网页文本相似性过程... 77

4.6 基千语义主题模型的相似度

算法............................................... 78

4.7 基于SimHash算法的指纹码....... 80

4.7.1 SimHash弓l入..............….. 81

4.7.2 SimH ash的计算流程…….81

4.7.3 计算重复信息…….....….. 83

4.8 相似度算法的差异性………..….84

4.9 本章小结........................ 85

第5章数据分类算法………………..….86

5.1 基于朴素贝叶斯分类器………..... 86

5.1.1 有监督分类与无监督

分类................................... 87

5.1.2 应用实例:识别车厘子

与樱桃............................... 88

5.1.3 分类流程归纳................... 91

5.1.4 应用扩展:垃圾邮件

识别···································92

5.1.5 常用评价指标................... 96

5.2 基千AdaBoost分类器…………... 100

5.2.1 AdaBoost概述………….. 100

5.2.2 AdaBoost算法具体流程...........101

5.2.3 AdaBoost算法的应用

实例................................. 102

5 .2.4 AdaBoost算法的优点…. 105

5.3 基千支持向扯机的分类器……… 105

5.3.1 线性可分与线性不可分.. 106

5.3.2 感知器·····························107

5.3.3 支持向量机………......…... 108

5.4 基于K邻近算法的分类器…..... 109

5.4.1 应用实例:电影观众

兴趣发现·························109

5.4.2 核心思想......................... 109

5.4.3 电影观众兴趣发现…….. 110

5.5 本章小结..................................... 1 I 3

第6章数据聚类算法…………....…. 115

6.1 基于系统聚类法…...………………. 115

6.1.1 概述................................. 116

6.1.2 最短距离法..................... 117

6.1.3 重心聚类法..................... 119

6.1.4 动态聚类法.................... 120

6.2 基千K-Means聚类算法…..….. 122

6.2.l 应用实例:新闻聚类...............…. 122

6.2.2 逻辑流程......................... 123

6.2.3 实现新闻聚类分析.....…124

6.2.4 K-Means++ ·················]28

6.2.5 K-中心点聚类算法....................…129

6.2.6 ISODATA聚类算法……. 130

6.3 基于密度的DBSCAN算法....... 131

6.4 基于BIRCH算法的聚类分析... 133

6.4.1 聚类特征......................... 133

6.4.2 聚类特征树…...………... 134

6.5 聚类与分类差异……....……….. 135

6.6 本章小结..................................... 136

第7章数据预测与估算算法……….... 137

7.1 产生式模型与判别式模型…..... 137

7.2 基于最大似然估计的预测……... 138

7.3 基千线性回归的估算……………. 140

7.3.1 概要................................. 140

7.3.2 最4、二乘法..................... 141

7.4 基千最大期望算法分析....…..… 143

7.5 基于隐马尔科夫模型预测.....… 144

7.5.J 应用实例:高温天气与

行为概率......................... 144

7.5.2 原理分析......................... 145

7.5.3 高温天气与行为概率….. 147

7.6 基于条件随机场的序列预测….. 151

7.6.1 应用实例......................... 151

7.6.2 原理分析…................ 15 I

7.6.3 条件随机场的优缺点….. 153

7.7 本章小结·····································154

第8章数据决策分析算法……..…….. 155

8.1 基千ID3算法的决策分析....….. 156

8.1.1 信息量............................. 156

8.1.2 信息嫡............................. 156

8.1.3 信息增益......................... 157

8.1.4 ID3算法流程…....…........ 157

8.1.5 ID3算法的应用………….. 157

8.2 基千C4.5算法的分类决策树.. 159

8.2.1 概要................................. 159

8.2.2 应用实例......................... 159

8.3 基于分类回归树的决策划分… 161

8.3.l 概要................................. 162

8.3.2 应用实例: 决策划分..... 163

8.3.3 剪枝................................. 164

8.4 基于随机森林的决策分类.…... 168

8.4.1 随机森林的特点……..….. 169

8.4.2 随机森林的构造方法.…. 169

8.4.3 应用实例: 决定车厘子

的售价层次………………… 170

8.5 本章小结..................................... 172

第9章数据关联规则分析算法…...... 174

9.1 基千Apriori算法的关联项

分析............................................. 174

9.1.1 应用实例:超市的货架

摆放问题......................... 175

9.1.2 基本概要......................... 175

9.1.3 算法原理·························176

9.1.4 有效摆放货架……………. 176

9.2 基于FP-Growth算法的关联性

分析............................................. 179

9.2.1 构建FP树....................... 179

9.2.2 频繁项分析......………….. 181

9.2.3 与Apripri算法比较…. 184

9.3 基于Eclat算法的频繁项集

挖掘............................................. 184

9.4 本章小结..................................... 185

第10章数据推荐算法……………..….. 187

10.1 概要........................................... 187

10.1.1 推荐算法发展…………... 188

10.1.2 协同过泥推荐…...… ·…. 189

10.2 基于Item-Based协同过滤推荐········190

I 0.2.1 Item-Based基本思想.… 190

I 0.2.2 Slope One实例:基于评分推荐······190

10.3 基千User-Based协同过滤推荐........ 193

10.3.1 应用实例:根据人群的推荐............. 194

10.3.2 User-Based与Item-Based对比..... 197

10.4 基于潜在因子算法的推荐... 198

I 0.4. l 应用实例:新闻推荐... 198

10.4.2 流行度与推荐….....…… 200

10.5 推荐算法与效果评价…..……….201

10.6 本章小结···································203

如果想得到下载地址,请访问中科院计算所培训中心官网 http://www.tcict.cn/ 添加官网上的客服微信索取!

这篇关于每周一书《大数据时代的算法:机器学习、人工智能及其典型实例 》分享!的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/439277

相关文章

Java中的雪花算法Snowflake解析与实践技巧

《Java中的雪花算法Snowflake解析与实践技巧》本文解析了雪花算法的原理、Java实现及生产实践,涵盖ID结构、位运算技巧、时钟回拨处理、WorkerId分配等关键点,并探讨了百度UidGen... 目录一、雪花算法核心原理1.1 算法起源1.2 ID结构详解1.3 核心特性二、Java实现解析2.

MyBatisPlus如何优化千万级数据的CRUD

《MyBatisPlus如何优化千万级数据的CRUD》最近负责的一个项目,数据库表量级破千万,每次执行CRUD都像走钢丝,稍有不慎就引起数据库报警,本文就结合这个项目的实战经验,聊聊MyBatisPl... 目录背景一、MyBATis Plus 简介二、千万级数据的挑战三、优化 CRUD 的关键策略1. 查

python实现对数据公钥加密与私钥解密

《python实现对数据公钥加密与私钥解密》这篇文章主要为大家详细介绍了如何使用python实现对数据公钥加密与私钥解密,文中的示例代码讲解详细,感兴趣的小伙伴可以跟随小编一起学习一下... 目录公钥私钥的生成使用公钥加密使用私钥解密公钥私钥的生成这一部分,使用python生成公钥与私钥,然后保存在两个文

mysql中的数据目录用法及说明

《mysql中的数据目录用法及说明》:本文主要介绍mysql中的数据目录用法及说明,具有很好的参考价值,希望对大家有所帮助,如有错误或未考虑完全的地方,望不吝赐教... 目录1、背景2、版本3、数据目录4、总结1、背景安装mysql之后,在安装目录下会有一个data目录,我们创建的数据库、创建的表、插入的

java向微信服务号发送消息的完整步骤实例

《java向微信服务号发送消息的完整步骤实例》:本文主要介绍java向微信服务号发送消息的相关资料,包括申请测试号获取appID/appsecret、关注公众号获取openID、配置消息模板及代码... 目录步骤1. 申请测试系统2. 公众号账号信息3. 关注测试号二维码4. 消息模板接口5. Java测试

MySQL数据库的内嵌函数和联合查询实例代码

《MySQL数据库的内嵌函数和联合查询实例代码》联合查询是一种将多个查询结果组合在一起的方法,通常使用UNION、UNIONALL、INTERSECT和EXCEPT关键字,下面:本文主要介绍MyS... 目录一.数据库的内嵌函数1.1聚合函数COUNT([DISTINCT] expr)SUM([DISTIN

Navicat数据表的数据添加,删除及使用sql完成数据的添加过程

《Navicat数据表的数据添加,删除及使用sql完成数据的添加过程》:本文主要介绍Navicat数据表的数据添加,删除及使用sql完成数据的添加过程,具有很好的参考价值,希望对大家有所帮助,如有... 目录Navicat数据表数据添加,删除及使用sql完成数据添加选中操作的表则出现如下界面,查看左下角从左

SpringBoot中4种数据水平分片策略

《SpringBoot中4种数据水平分片策略》数据水平分片作为一种水平扩展策略,通过将数据分散到多个物理节点上,有效解决了存储容量和性能瓶颈问题,下面小编就来和大家分享4种数据分片策略吧... 目录一、前言二、哈希分片2.1 原理2.2 SpringBoot实现2.3 优缺点分析2.4 适用场景三、范围分片

Go语言代码格式化的技巧分享

《Go语言代码格式化的技巧分享》在Go语言的开发过程中,代码格式化是一个看似细微却至关重要的环节,良好的代码格式化不仅能提升代码的可读性,还能促进团队协作,减少因代码风格差异引发的问题,Go在代码格式... 目录一、Go 语言代码格式化的重要性二、Go 语言代码格式化工具:gofmt 与 go fmt(一)

Redis分片集群、数据读写规则问题小结

《Redis分片集群、数据读写规则问题小结》本文介绍了Redis分片集群的原理,通过数据分片和哈希槽机制解决单机内存限制与写瓶颈问题,实现分布式存储和高并发处理,但存在通信开销大、维护复杂及对事务支持... 目录一、分片集群解android决的问题二、分片集群图解 分片集群特征如何解决的上述问题?(与哨兵模