本书以处理数据的逻辑顺序为核心,从数据抽样、预处理到探索性分析,系统阐述了大数据处理的完整流程。书中不仅深入探讨了传统统计抽样理论在大数据环境下的适用性,还详细介绍了数据清洗、变换及异常值处理等预处理技术,确保了数据分析的准确性和可靠性。本书通过多维度数据可视化、投影寻踪分析等先进统计方法,结合具体案例,使读者能够直观
本书介绍智能控制的基本理论、方法和应用。全书共14章,主要内容为:专家控制的基本原理和应用;模糊控制的基本原理和应用;神经网络控制的基本原理和应用;智能优化算法及其应用;迭代学习控制原理及应用;多智能体系统设计及分析。
本书以多源离群数据检测为研究对象,对基于影响空间的离群数据检测、基于约束概念格的离群数据检测、基于核密度估计的离群数据检测、基于k近邻连接的多源可信离群数据检测、基于影响空间的多源关联离群数据检测等算法进行了研究,设计实现了多源离群数据的并行检测算法,可有效应用于智能制造中,为机械产品加工质量分析提供技术支持,也可应用
本书共9个项目,分别是Linux操作系统配置、Hadoop集群搭建、Hadoop分布式文件系统操作、MapReduce分布式计算编程实战、ZooKeeper分布式协调服务操作、Hadoop高可用集群搭建、HBase数据库操作、Hive数据仓库操作、Sqoop数据迁移操作。
本书共计8章,内容包括:初步认识数据空间、数据空间的发展背景、数据场:数据空间的基础理论、数据空间的架构、数据空间的关键技术等。
本书作为CDA三级认证教材,打破了传统的学院派知识整合模式,从业务应用场景出发来组织内容,旨在更加贴近业务需求,而非单纯罗列算法。经过多年的打磨,本书精选了在行业应用中价值最大的九类场景,并提供不同场景下构建数据应用的最佳实践。本书涉及的算法不仅涵盖传统的统计学习,还结合企业实际需求,解构了机器学习、深度学习的前沿方法
Spark是业界主流的大数据计算框架,拥有强大的分布式计算能力,能够充分利用大量的廉价机器进行大数据的处理工作,同时又具备较高的性能,这使得它在各大互联网企业中有着广泛的应用。本书通过一系列通俗易懂的数据处理实例展开,详细阐述Spark大数据平台与环境搭建、SparkRDD离线数据计算、SparkSQL离线数据处理、S
本书为了符合学生学习知识的一般规律,以一张控制流程图为切入点,首先介绍了识图方法,之后阐述了自动检测、自动控制、自动联锁报警等过程控制系统,然后分三章介绍了变量检测及仪表、过程控制仪表及计算机控制系统等过程控制工具,最后是控制系统的应用——典型过程单元的控制方案及控制系统的操作。将实验与实践内容单独列为一章,在这一章不
本书共7章,首先介绍数据科学历史、概念与内涵,统计和机器学习基础知识;然后从数据科学的流程角度,展开讨论数据准备、数据建模与管理、数据计算与处理、数据分析等;最后从数据安全的视角切入数据科学进行相关内容的讲解。附录介绍了Python、MATLAB、R语言等面向数据科学的编程语言,常用的数据分析工具,常用的数据可视化工具
本书从工程应用的角度出发,注重基础性、系统性和实用性,较深入地介绍计算机控制系统的基本知识及分析和设计方法。全书共十章,包括绪论、计算机控制系统设计的硬件基础、计算机控制系统的数学基础、计算机控制系统特性分析、计算机控制系统的间接设计方法、计算机控制系统的直接设计方法、数字控制器的状态空间设计方法、计算机控制系统的工程
平台介绍|荣誉资质|联系我们|出版社登陆