• 欢迎访问古丽pdf电子书资源网

《大数据:互联网大规模数据挖掘与分布式处理(第2版)》 [美] 莱斯科夫 _扫描版_pdf电子书下载

计算机 古丽电子书资源网小编 3周前 (09-10) 11次浏览 0个评论

《大数据:互联网大规模数据挖掘与分布式处理(第2版)》 [美] 莱斯科夫 _扫描版_pdf电子书下载

内容介绍:

本书由斯坦福大学“Web挖掘”课程的内容总结而成,主要关注极大规模数据的挖掘。主要内容包括分布式文件系统、相似性搜索、搜索引擎技术、频繁项集挖掘、聚类算法、广告管理及推荐系统。其中相关章节有对应的习题,以巩固所讲解的内容。读者更可以从网上获取相关拓展材料。

目录介绍:

第1 章 数据挖掘基本概念 11.1 数据挖掘的定义 11.1.1 统计建模 11.1.2 机器学习 11.1.3 建模的计算方法 21.1.4 数据汇总 21.1.5 特征抽取 31.2 数据挖掘的统计限制 41.2.1 整体情报预警 41.2.2 邦弗朗尼原理 41.2.3 邦弗朗尼原理的一个例子 51.2.4 习题 61.3 相关知识 61.3.1 词语在文档中的重要性 61.3.2 哈希函数 71.3.3 索引 81.3.4 二级存储器 91.3.5 自然对数的底e 101.3.6 幂定律 111.3.7 习题 121.4 本书概要 131.5 小结 141.6 参考文献 15第2 章 MapReduce及新软件栈 162.1 分布式文件系统 172.1.1 计算节点的物理结构 172.1.2 大规模文件系统的结构 182.2 MapReduce 192.2.1 Map 任务 202.2.2 按键分组 202.2.3 Reduce 任务 212.2.4 组合器 212.2.5 MapReduce 的执行细节 222.2.6 节点失效的处理 232.2.7 习题 232.3 使用MapReduce 的算法 232.3.1 基于MapReduce 的矩阵—向量乘法实现 242.3.2 向量v 法放入内存时的处理 242.3.3 关系代数运算 252.3.4 基于MapReduce 的选择运算 272.3.5 基于MapReduce 的投影运算 272.3.6 基于MapReduce 的并、交和差运算 282.3.7 基于MapReduce 的自然连接运算 282.3.8 基于MapReduce 的分组和聚合运算 292.3.9 矩阵乘法 292.3.10 基于单步MapReduce 的矩阵乘法 302.3.11 习题 312.4 MapReduce 的扩展 312.4.1 工作流系统 322.4.2 MapReduce 的递归扩展版本 33……


古丽pdf电子书资源网 , 版权所有丨如未注明 , 均为原创
转载请注明原文链接:《大数据:互联网大规模数据挖掘与分布式处理(第2版)》 [美] 莱斯科夫 _扫描版_pdf电子书下载
下载信息
下载地址
喜欢 (0)
发表我的评论
取消评论
表情 贴图 加粗 删除线 居中 斜体 签到

Hi,您需要填写昵称和邮箱!

  • 昵称 (必填)
  • 邮箱 (必填)
  • 网址