
会员
Data Science Projects with Python
更新时间:2021-06-11 13:29:22 最新章节:Chapter 6: Imputation of Missing Data Financial Analysis and Delivery to Client
书籍简介
DataScienceProjectswithPythonisdesignedtogiveyoupracticalguidanceonindustry-standarddataanalysisandmachinelearningtoolsinPython,withthehelpofrealisticdata.ThebookwillhelpyouunderstandhowyoucanusepandasandMatplotlibtocriticallyexamineadatasetwithsummarystatisticsandgraphs,andextracttheinsightsyouseektoderive.Youwillcontinuetobuildonyourknowledgeasyoulearnhowtopreparedataandfeedittomachinelearningalgorithms,suchasregularizedlogisticregressionandrandomforest,usingthescikit-learnpackage.You’lldiscoverhowtotunethealgorithmstoprovidethebestpredictionsonnewand,unseendata.Asyoudelveintolaterchapters,you’llbeabletounderstandtheworkingandoutputofthesealgorithmsandgaininsightintonotonlythepredictivecapabilitiesofthemodelsbutalsotheirreasonsformakingthesepredictions.Bytheendofthisbook,youwillhavetheskillsyouneedtoconfidentlyusevariousmachinelearningalgorithmstoperformdetaileddataanalysisandextractmeaningfulinsightsfromunstructureddata.
品牌:中图公司
上架时间:2019-04-30 00:00:00
出版社:Packt Publishing
本书数字版权由中图公司提供,并由其授权上海阅文信息技术有限公司制作发行
最新章节
Stephen Klosterman
同类热门书
最新上架
- 会员本书是《数据库原理——GaussDB技术及应用》一书配套的辅助教材。全书共分3部分:第一部分为实验指导,共有13个综合实验,每一个实验都是根据教学目标而设计,详细讲述了每一个实验的实验目的、实验任务及实验步骤,从而培养学生掌握关系数据库管理软件技术与应用的技能;第二部分为习题集,是根据主教材各章节内容编写的习题及习题答案,内容广泛,有填空、选择、简答、设计及实验题等多种形式,利求通过对这些习题的训计算机6.9万字
- 会员数据科学的关键技术包括数据存储计算、数据治理、结构化数据分析、语音分析、视觉分析、文本分析和知识图谱等方面。本书的重点是详细介绍文本分析和知识图谱方面的技术。文本分析技术主要包括文本预训练模型、多语种文本分析、文本情感分析、文本机器翻译、文本智能纠错、NL2SQL问答以及ChatGPT大语言模型等。知识图谱技术主要包括知识图谱构建和知识图谱问答等。本书将理论介绍和实践相结合,详细阐述各个技术主题的计算机21.6万字
- 会员《MySQL从入门到精通(第3版)》从初学者角度出发,通过通俗易懂的语言和丰富多彩的实例,详细介绍了MySQL开发需要掌握的各方面技术。全书共分为4篇22章,包括数据库基础,初识MySQL,使用MySQL图形化管理工具,数据库操作,存储引擎及数据类型,数据表操作,MySQL基础,表数据的增、删、改操作,数据查询,常用函数,索引,视图,数据完整性约束,存储过程与存储函数,触发器,事务,事件,备份与恢计算机14万字
- 会员MySQL数据库是目前全球流行的数据库之一。《MySQL8.0从入门到实战》从入门到实战,系统全面、由浅入深地介绍MySQL数据库应用的各个方面。全书分为8个部分,共18章。第1部分(第1~3章)介绍MySQL的基础知识,包括初识MySQL、数据库设计和数据类型;第2部分(第4~6章)介绍MySQL的基本操作,包括SQL基础操作、MySQL连接查询和数据复制、MySQL基础函数;第3部分(第7、8计算机9.7万字
- 会员《企业级大数据项目实战:用户搜索行为分析系统从0到1》基于真实业务场景,以项目导向为主线,从0到1全面介绍企业级大数据用户搜索行为分析系统的搭建过程。全书共6章,第1章讲解项目需求与架构设计,详细阐述项目数据流与系统架构;第2章介绍大数据项目开发环境配置,手把手带领读者配置操作系统、Hadoop集群与相关工具,为后续项目实施打下基础;第3~5章逐步实现项目需求,第3章讲解用户行为数据采集模块的开发计算机9万字
- 会员高质量的数据关乎企业运营、合规、决策和业绩的关键,哈佛商业评论的一项研究发现,企业中只有3%的数据符合质量标准,绝大多数公司都在寻求切实可行的指导来提高数据质量。本书作者基于多年在数据、数据分析和人工智能方面的实践经验,阐述了4步构建高质量数据体系。他提出了高质量数据的四阶段DARS方法(定义、评估、实现、持续)和10个数据质量最佳实践案例,以此来提高业务中的数据质量水平,为业务提供数据价值,保证计算机11.7万字
- 会员《数据分析师手记:数据分析72个核心问题精解》从底层认知、思维方法、工具技术、项目落地及展望出发,使用问答的形式对数据分析中的72个核心知识点进行讲解,构建了数据分析的知识框架,带领读者认识数据分析背后的奥妙。读者可以用本书作为学习地图,针对具体的方法、技术进行延伸学习。计算机16.8万字
- 会员本书旨在向广大有志于投身芯片设计行业的人士及正在从事芯片设计的工程师普及芯片设计知识和工作方法,使其更加了解芯片行业的分工与动向。本书共分9个章节,从多角度透视芯片设计,特别是数字芯片设计的流程、工具、设计方法、仿真方法等环节。凭借作者多年业内经验,针对IC新人关心的诸多问题,为其提供了提升个人能力,选择职业方向的具体指导。本书第1章是对IC设计行业的整体概述,并解答了IC新人普遍关心的若干问题。计算机29.9万字
- 会员本书以Python作为开发语言,系统介绍PySpark开发环境搭建流程及基于PySpark进行大数据分析的相关知识。本书条理清晰、重点突出,理论叙述循序渐进、由浅入深。本书共7章,第1?5章包括PySpark大数据分析概述、PySpark安装配置、基于PySpark的DataFrame操作、基于PySpark的流式数据处理、基于PySpark的机器学习库,内容介绍注重理论与实践相结合,通过典型示例计算机10.4万字
同类书籍最近更新
- 会员本书由浅入深地介绍了SQLServer2012数据库的基本知识、数据库系统的设计与实现。内容包括系统认识数据库、初识SQLServer2012、数据库的创建和管理、表的创建和管理、索引的创建和管理、表中数据的查询、Transact-SQL编程、视图的创建和管理、存储过程的创建和管理、触发器的创建和管理、数据库的安全性管理以及数据库的恢复与传输。本书以成绩管理数据库AMDB为实例贯穿全书,在最后一章数据库9.4万字
- 会员本书从数据仓库的方法论入手,为读者系统而又全面地介绍敏捷数据分析的相关工具:ADW、OAC,内容涵盖OracleADW的技术特征、数据加载及应用开发等部分;在OAC方面,深入地介绍了OAC的技术与强大的功能,同时也加入了诸多的高级主题。另外,本书的第4部分介绍了其他相关知识。本书内容在保证深度的基础上兼顾了技术的广度,并结合了大量实战性操作和案例,使读者可以在较短的时间内全面了解敏捷数据分析的相关数据库8.2万字
- 会员全书共11章,分为理论篇、技术篇和实战篇三个部分。本书将虚拟化技术与应用融为一体,较为系统地介绍了虚拟化技术发展史、虚拟化技术的分类、虚拟化架构特性、主流虚拟化技术、服务器虚拟化应用、桌面虚拟化应用、网络虚拟化应用、虚拟化架构软/硬件方案等内容,基本涵盖了目前主流的虚拟化技术及其应用。数据库8.6万字
- 会员本书以项目为载体,采用任务驱动方式,按照学生的学习规律和数据库实际操作顺序由易到难组织教学内容。本书共有三个项目,项目一主要介绍数据库的应用,项目二突出数据库的设计与应用,这两个项目都是以微软的SQLServer2014作为软件基础的;项目三是以MySQL作为软件基础,通过三个模块让读者初步学会环境搭建、数据库的基本操作以及数据库编程等高级操作。在项目一中穿插了项目演练的内容,以供教学中给学生进行数据库6.3万字