2025 年版

广西高等教育自学考试课程考试大纲
课程名称:人工智能与大数据
课程代码:13011
第一部分 课程性质与课程目标
一、课程性质和特点
“人工智能与大数据 ”是高等教育自学考试计算机科学与技术 (专升本)专业的一门课程。本课程是计算机科学与技术学科的一个 分支方向,是研究人工智能和大数据的基本原理及二者综合应用的知 识体系,是人工智能与大数据技术的理论概括,是计算机科学的重要 组成部分。
二、课程目标
课程设置的目标是使得考生能够:
(一)掌握大数据和人工智能的基本概念、基本理论;
(二)理解大数据和人工智能的基本方法;
(三)运用大数据与人工智能的理论,能够对一般的人工智能应 用问题提出自己的见解。
三、课程重点
本课程的重点内容包括:大数据处理架构 Hadoop ,分布式文件 系统 HDFS ,MapReduce 与 Spark ,NoSQL 数据库、分布式数据库 HBase ,人工智能基本概念,特征提取方法,机器学习基本概念, 自 然语言理解基本概念,云计算、物联网、大数据与人工智能的融合方 法。
第二部分 考核目标
本课程在考核目标中,按照识记、领会两个层次规定其应达到的 能力层次要求。两个能力层次是递进关系,各能力层次的含义如下:
识记:要求考生能够识别和记忆人工智能与大数据的基本概念和 基本原理,并能作出正确的表述、选择和判断。
领会:要求考生能够领悟和理解人工智能与大数据的基本理论、 基本方法的内涵和外延,并能作出正确的判断、解释和说明。
第三部分 课程内容与考核要求
注:教材的第 2.4 节、第 3.6 节、第 3.7 节、第 4.5 节、第 5.7 节、第 6 章、第 10.4 节、第 10.7 节、第 13.2 节、第 14 章、第 15 章不作考核。
第一章 大数据的来源、采集与基本概念
一、学习目的与要求
通过本章的学习,了解大数据的来源与发展、特点、分类与采集 方法、基本概念等内容,认识学习大数据技术的意义。
二、课程内容
第一节 大数据的来源与发展
大数据概念的起源;Hadoop 圈;MapReduce 论战。
第二节 何为大数据
大数据定义;数据巨浪的背景;与大数据相关的三个重大思维转 变;大数据价值的生成。
第三节 大数据的特点
大数据的 4V 特征。
第四节 大数据的分类和采集方法
大数据的分类、大数据的主要来源、数据采集的步骤与方法。
第五节 大数据的基本概念
大数据技术的内容框架、大数据的处理过程、大数据的关键问题 与技术。
三、考核知识点及考核要求
(一) 大数据的来源与发展
识记:大数据概念的起源。
领会:Hadoop 圈的发展过程。
(二) 何为大数据
识记:大数据的定义。
领会:与大数据相关的三个重大思维转变的含义。
(三)大数据的特点
识记:大数据的 4V 特征。
领会:大数据的 4V 特征的含义。
(四)大数据的分类和采集方法
识记:大数据的采集方法。
领会:大数据的分类;大数据的主要来源。
(五)大数据的基本概念
识记:大数据技术的内容框架、大数据的处理过程。
领会:大数据的关键问题与关键技术。
四、本章重点
大数据的定义;大数据的 4V 特征;大数据的采集方法;大数据 的处理过程。
第二章 大数据处理构架 Hadoop
一、学习目的与要求
通过本章的学习, 了解 Hadoop 的生态圈与应用场景、Hadoop
资源管理与调度,掌握数据仓库工具 Hive、大数据仓库 HBase、协管 员 ZooKeeper 的基本概念等内容,认识大数据处理构架 Hadoop 的发 展意义。
二、课程内容
第一节 Hadoop 概述
Hadoop 的诞生与发展;Hadoop 生态圈;Hadoop 的应用场景。
第二节 数据仓库工具 Hive
Hive 的起源;Hive 与数据库的区别;Hive 的执行流程。
第三节 大数据仓库 HBase
HBase 的起源;HBase 数据的逻辑存储模型;HBase 的系统架构。
第四节 协管员 ZooKeeper
ZooKeeper 的背景;ZooKeeper 的设计目标;ZooKeeper 集群的 角色与读写机制。
第五节 Hadoop 资源管理与调度
Hadoop 内置的调度机制;常见的三种调度器:FIFO 调度器、计 算能力调度器、公平调度器。
三、考核知识点及考核要求
(一)Hadoop 概述
识记:Hadoop 生态圈。
领会:Hadoop 的应用场景。
(二)数据仓库工具 Hive
识记:Hive 的执行流程。
领会:Hive 与数据库的区别。
(三)大数据仓库 HBase
识记:HBase 数据的逻辑存储模型。
领会:HBase 的系统架构。
(四)协管员 ZooKeeper
识记:ZooKeeper 的概述、设计目标、集群角色和读写机制。
领会:ZooKeeper 的背景。
(五)Hadoop 资源管理与调度
识记:Hadoop 内置的调度机制。
领会:常见的三种调度器。
四、本章重点
Hadoop 生态圈;HBase 数据的逻辑存储模型;Hive 的执行流程、 ZooKeeper 的集群角色与读写机制;Hadoop 的调度机制。
第三章 Hadoop 分布式文件系统 HDFS
一、学习目的与要求
通过本章的学习,掌握分布式文件系统 HDFS 的理论基础,认识 大数据技术使用 HDFS 的必要性。
二、课程内容
第一节 HDFS 的由来
流行的分布式文件系统;DFS 的选择;DFS 的发展。
第二节 HDFS 的设计思想
分块存储;备份机制;文件块大小。
第三节 HDFS 的主要特性
HDFS 的设计目标;HDFS 不适合的场景;HDFS 的特性介绍。
第四节 HDFS 的架构
数据块;名字节点和第二名字节点;数据节点;客户端。
第五节 HDFS 的主要流程
客户端到名字节点的文件与目录操作;客户端读文件;客户端写 文件;数据节点的启动和心跳。
三、考核知识点及考核要求
(一) HDFS 的由来
识记:DFS 的选择。
领会:DFS 的发展。
(二)HDFS 的设计思想
识记:HDFS 的设计思想。
(三)HDFS 的主要特性
识记:HDFS 的设计目标、特性。
领会:HDFS 不适合场景。
(四)HDFS 的架构
识记:HDFS 的整体架构、数据块、名字节点与第二名字节点、 数据节点。
领会:HDFS 的客户端。
(五)HDFS 的主要流程
识记:客户端到名字节点的文件与目录操作的流程、客户端读/ 写文件的流程。
领会:数据节点的启动和心跳。
四、本章重点
HDFS 的设计思想;HDFS 的整体架构及数据块、名字节点与第 二名字节点、数据节点的基本概念;HDFS 文件与目录操作的主要流 程。
第四章 MapReduce 与 Spark
一、学习目的与要求
通过本章的学习,掌握 MapReduce 与 Spark 的基本概念与原理, 认识大数据技术中并行计算的意义。
二、课程内容
第一节 MapReduce 的设计思想
MapReduce 的主要思想。
第二节 MapReduce 的组成
MapReduce 的组成部分;Master/Slave 结构。
第三节 MapReduce 的工作流程
MapReduce 的处理过程;作业提交流程和步骤。
第四节 MapReduce 的计算过程详解
MapReduce 任务的计算过程;执行细节和节点失效处理。
第五节 任务网络的通信开销
MapReduce 任务的通信开销的产生。
第六节 Spark 概述
Spark 的由来;使用 Spark 的原因;Spark 的优势与架构。
第七节 RDD 概述
RDD 的基本概念;基本操作;应用场景。
三、考核知识点及考核要求
(一)MapReduce 的设计思想
识记:MapReduce 主要思想的要点。
领会:MapReduce 主要思想的具体细节。 (二)MapReduce 的组成
识记:MapReduce 的组成部分。
领会:MapReduce 的 Master/Slave 结构。
(三)MapReduce 的工作流程
识记:MapReduce 的处理过程;作业提交流程要点。
领会:MapReduce 的作业提交的具体流程。 (四)MapReduce 的计算过程详解
识记:MapReduce 任务的计算过程和执行细节。
领会:节点失效处理。
(五)任务网络的通信开销
领会:MapReduce 任务的通信开销的产生。
(六)Spark 基本概念
识记:Spark 的优势与架构。
领会:Spark 的由来;使用原因。
(七)RDD 基本概念
识记:RDD 基本概念;基本操作。
领会:RDD 的应用场景。
四、本章重点
MapReduce 主要思想;MapReduce 的组成;MapReduce 的作业 提交流程;MapReduce 的计算过程;RDD 的基本概念与基本操作。
第五章 NoSQL 数据库、分布式数据库 HBase 、云数据库
一、学习目的与要求
通过本章的学习,掌握 NoSQL 数据库的基本理论,尤其是分布 式数据库 HBase 的理论基础,认识 NoSQL 数据库的应用意义。
二、课程内容
第一节 数据库
数据库的基本概念。
第二节 非关系型数据库(NoSQL)
NoSQL 数据库与关系数据库的区别与联系。
第三节 NoSQL 数据库的体系框架
NoSQL 数据库的四层体系框架
第四节 NoSQL 数据库的分类
四种 NoSQL 数据库;常用NoSQL 数据库简介。
第五节 分布式数据库 HBase
分布式数据库的定义与特点;HBase 数据库概述。
第六节 HBase 具体介绍
HBase 的基本概念:数据模型、数据坐标、区域。
三、考核知识点及考核要求
(一)数据库
领会:数据库的基本概念;关系数据库的优点。
(二)非关系数据库(NoSQL)
识记:NoSQL 数据库与关系数据库的区别与关系。
领会:NoSQL 数据库与关系数据库的关系。
(三)NoSQL 数据库的体系框架
识记:NoSQL 数据库的四层体系框架。
(四)NoSQL 数据库的分类
识记:四种 NoSQL 数据库。
领会:常用的 NoSQL 数据库简介。
(五)分布式数据库 HBase
识记:分布式数据库的定义与特点。
领会:HBase 数据库概述。
(六)HBase 具体介绍
识记:HBase 的数据模型、行键、列族、数据坐标与区域。
领会:HBase 数据模型。
四、本章重点
NoSQL 数据库与关系数据库区别;NoSQL 数据库的四层体系框 架;四种 NoSQL 数据库;HBase 的基本概念。
第七章 人工智能的基本概念
一、学习目的与要求
通过本章的学习,掌握人工智能的基本概念,认识学习人工智能 的意义。
二、课程内容
第一节 什么是人工智能
人工智能背景;人工智能应用实例——语音识别系统的关键问 题。
第二节 人工智能的历史
人工智能的发展历程。
第三节 图灵测试
图灵测试。
第四节 中文屋理论
中文屋实验。
第五节 人工智能的未来
人工智能的应用领域。
三、考核知识点及考核要求
(一)什么是人工智能
领会:人工智能的背景;人工智能应用实例。
(二)人工智能的历史
识记:人工智能的发展历程。
(三)图灵测试
识记:图灵测试。
(四) 中文屋理论
领会: 中文屋实验。
(五)人工智能的未来
领会:人工智能的应用领域。
四、本章重点
人工智能的发展历程,图灵测试。
第八章 特征提取
一、学习目的与要求
通过本章的学习,掌握特征提取的基本概念,认识学习特征提取 的必要性。
二、课程内容
第一节 特征提取基础
预测建模;特征构建;特征选择的动机及方法。
第二节 数学方法入门
单独相关性排名;单独不相关的相关特征;冗余特征。
第三节 特征选择方法的开放性问题
相关特性;足够的特征子集;特征子集选择方差。
第四节 图像特征
形状特征;纹理特征;颜色特征;空间关系特征;姿态估计方法; 特征提取概述;神经网络的特征提取实例。
三、考核知识点及考核要求
(一)特征提取基础
识记:特征构建的预处理转换;特征选择方法。
领会:预测建模;特征选择的动机。
(二)人工智能数学方法
识记:单独相关性排名;冗余特征;常用的特征选择方法。
领会:单独不相关的相关特征;前向、后向特征选择方法。
(三)特征选择方法的开放性问题
领会:特征、特征子集的相关概念;特征子集选择方差。
(四)图像特征
识记:形状特征;纹理特征;颜色特征;空间关系特征;特征提 取目的;代数特征提取方法。
领会:姿态估计方法;神经网络的特征提取实例。
四、本章重点
特征选择的预处理转换内容;常用的特征选择方法;图像特征提 取的基本概念。
第九章 机器学习
一、学习目的与要求
通过本章的学习,掌握机器学习的基本概念,认识机器学习方法 的重要价值。
二、课程内容
第一节 机器学习的基本概念
什么是学习;机器学习的应用场景与类型;机器学习与其他领域 的关系。
第二节 强化学习
强化学习的基本原理。
第三节 推荐系统
推荐系统的应用简介。
第四节 神经网络
人工神经元;神经网络优化过程;神经网络的局限性。
第五节 深度学习
深度学习概述;人工神经网络模型;常见的深度学习网络;深度 学习的应用案例;深度学习硬件;深度学习的缺点。
三、考核知识点及考核要求
(一)机器学习的基本概念
识记:机器学习的应用场景与类型。
领会:什么是机器学习;机器学习与其他领域的关系。
(二)强化学习
领会:强化学习的基本原理。
(三)推荐系统
领会:推荐系统的应用简介。
(四)神经网络
识记:人工神经元;神经网络优化算法:梯度下降法、反向传播 法。
领会:神经网络的局限性。
(五)深度学习
识记:人工神经网络模型。
领会:常见的深度学习网络;深度学习的应用案例。
四、本章重点
机器学习的应用场景;人工神经元;神经网络优化算法;深度学 习的基本概念;人工神经网络模型。
第十章 自然语言理解
一、学习目的与要求
通过本章的学习,掌握自然语言理解的基本概念,认识自然语言 理解方法的重要意义。
二、课程内容
第一节 概述
自然语言理解的目标;立足点; 自然语言理解的观点。
第二节 语言认知模型
人类语言的进化;自然语言的功能模型;言语链模型;认知模型。
第三节 自然语言理解模型
任务模型; 自然语言理解的层次模型。
第四节 思维及思维规律的特点
思维的概念;思维的规律:推理规则。
第五节 什么是自然语言理解
自然语言理解的基本概念; 自然语言理解的难点。
三、考核知识点及考核要求
(一)概述
识记: 自然语言理解的目标、立足点。
领会: 自然语言理解的观点。
(二)语言认知模型
识记: 自然语言的功能模型;言语链模型;认知模型。
领会:人类语言的进化。
(三) 自然语言理解模型
识记: 自然语言理解的层次模型。
领会:任务模型。
(四)思维及思维规律的特点
识记:思维的概念;推理规则。
领会:思维的特点。
(五)什么是自然语言理解
识记: 自然语言理解的基本概念。
领会:理解的概述; 自然语言理解的难点。
四、本章重点
自然语言理解的目标;自然语言的功能模型;认知模型;自然语 言的层次模型;推理规则; 自然语言理解的基本概念。
第十一章 人工智能方法在目标检测中的应用
一、学习目的与要求
通过本章的学习,掌握使用人工智能方法进行目标检测的基本思 路与方法,认识人工智能方法在目标检测中的重要意义。
二、课程内容
第一节 智能视频监控系统
视频监控系统框架;多视角目标识别及消失/重现目标识别问题; 异常行为检测与识别。
第二节 人脸识别系统
多视角人脸检测和验证;基于视频的多视角人脸跟踪;人脸识别; 多任务决策融合编程架构。
三、考核知识点及考核要求
(一)智能视频监控系统
识记:视频监控系统框架。
领会:多视角目标识别及消失/重现目标识别问题的基本思路; 异常行为检测与识别的思路与方法。
(二)人脸识别系统
识记:人脸识别系统流程。
领会:多视角人脸检测和验证的基本流程和算法;基于视频的多 视角人脸跟踪的基本方法;人脸识别的基本方法;多任务决策融合编 程架构。
四、本章重点
视频监控系统框架;人脸识别系统流程与基本方法。
第十二章 云计算、大数据与人工智能
一、学习目的与要求
通过本章的学习,掌握云计算的基本概念,认识云计算、大数据 与人工智能融合的重要意义。
二、课程内容
第一节 云计算的概念
云计算的基本概念。
第二节 云计算、物联网、大数据与人工智能的融合
云计算、物联网、大数据与人工智能融合的基本思想。
三、考核知识点及考核要求
(一)云计算的概念
识记:云计算的定义;云计算的优势。
领会:云计算的下一个趋势。
(二)云计算、物联网、大数据与人工智能的融合
识记:云计算、物联网、大数据与人工智能融合的基本思想。
领会:物联网与人工智能融合的内容。
四、本章重点
云计算的定义;云计算的优势;云计算、物联网、大数据与人工 智能融合的基本思想。
第十三章 基于大数据的人工智能应用
一、学习目的与要求
通过本章的学习,了解基于大数据的人工智能在生活中的实际应 用及相关技术。
二、课程内容
第一节 自动编码器
自动编码器的基本原理。
第二节 手写文字中的“信息量 ”
获取手写文字的特征表示的基本方法。
第三节 多层架构深层挖掘
使用深度网络学习图像特征的过程。
第四节 Google 的猫脸识别
使用深度网络实现 Google 的猫脸识别的基本方法。
第五节 飞速发展的关键——鲁棒性
获取特征表示的鲁棒性的基本方法。
第六节 有趣的对抗生成网络
对抗网络生成的基本原理。
第七节 大数据与人工智能的融合带给生活的改变
大数据与人工智能的融合带给生活的改变。
第八节 发展趋势
大数据与人工智能的发展趋势。
三、考核知识点及考核要求
(一) 自动编码器
领会: 自动编码器的基本原理。
(二)手写文字中的“信息量 ”
领会:使用自动编码器获取手写文字的特征表示。
(三)多层架构深层挖掘
领会:使用深度网络学习图像特征的过程。
(四)Google 的猫脸识别
领会:使用深度网络实现 Google 的猫脸识别的基本方法。
(五)飞速发展的关键——鲁棒性
领会:获取特征表示的鲁棒性的基本方法。
(六)对抗生成网络
领会:对抗生成网络的基本原理。
(七)大数据与人工智能的融合带给生活的改变
领会:人工智能实现飞跃的原因;大数据与人工智能的融合带给 生活的改变。
(八)发展趋势
领会:大数据与人工智能的发展趋势。
四、本章重点
使用深度网络学习图像特征的过程;获取特征表示的鲁棒性的基 本方法;对抗生成网络基本原理。
第四部分 关于大纲的说明与考核实施要求
一、课程自学考试大纲的目的和作用
课程自学考试大纲是根据专业自学考试计划的要求,结合自学考 试的特点而确定。其目的是对个人自学、社会助学和课程考试命题进 行指导和规定。
本课程自学考试大纲明确了课程学习的内容以及深度和广度,规 定了课程自学考试的范围和标准。因此,它是自学者学习教材、掌握 课程内容知识范围和程度的依据,也是自学考试命题的依据。
二、本课程的自学教材
《大数据与人工智能》,郏东耀主编,清华大学出版社,2022 年版。
三、关于自学要求和自学方法的指导
本大纲的课程基本要求是依据专业基本规范和专业培养目标而 确定的。课程基本要求还明确了课程的基本内容,以及对基本内容掌 握的程度。基本要求中的知识点构成了课程内容的主体部分。因此, 课程基本内容掌握程度、课程考核知识点是高等教育自学考试考核的 主要内容。为有效地指导个人自学和社会助学,本大纲已指明了课程 的重点,在章节的基本要求中一般也指明了章节内容的重点。
根据课程内容和自学考试的特点,建议考生可采用以下学习方 法:
1.科学制定并严格执行学习计划。考生应根据自身学习能力、可 支配时间、章节内容难度等因素,制定一套行之有效的学习计划,并 时刻监督和激励自己,保持良好学习习惯,严格按照学习计划进行自 学,增强学习的主动性和自觉性。
2.认真研读并及时总结反思。学习本课程时,建议先通读一遍教 材,大致了解课程的知识结构,在此基础上循序渐进地按章节次序精 读教材,精读时一定要参考大纲的要求,力求掌握各知识点的内容和 要求。
3.注重练习。针对课程考试题型的特点和要求,考生应在夯实知 识基础上,参考大数据、人工智能的相关参考书,独立认真地完成部 分与本课程考核要求相关的习题作业,以加深理解。
4.加强大数据、人工智能的技术文献学习。考生应根据课程学习 目标,在认真学习教材的基础上密切关注互联网上的大数据、人工智 能技术的发展动态介绍,了解最新的大数据、人工智能技术及其二者 的融合应用。
四、对考核内容的说明
1.考试大纲与教材所体现的内容基本一致。教材中各章由若干个 知识点组成,而大纲将考试内容分解成若干个知识点。因此,大纲列 出的知识点属于考核范围内的重点内容,需要考生重点掌握;大纲明 确不考核的章节(知识点)不作考核要求,考生可根据自身情况学习; 大纲未列出的章节(知识点)属于一般内容,也在考核范围之内,考 生仍需掌握。
2.在考试之日起6 个月前,涉及本课程中的由全国人大及其常委 会制定或修订的法律,国务院制定或修订的行政法规,行业主管部门 制定或修订的规章,国家标准化管理委员会发布的新标准都将列入考 试范围。
五、关于考试方式和试卷结构的说明
1.本课程的考试方式为闭卷,笔试,满分 100 分,60 分及格。 考试时间为 150 分钟。
2.本课程在试卷中对不同能力层次要求的分数比例大致为:识记 占 40%,领会占 60%。
3.要合理安排试题的难易程度,试题的难度可分为:易、较易、 较难和难四级。
4.课程考试命题的主要题型一般有单项选择题、判断题、填空题、 名词解释题、简答题、论述题等题型。命题可根据考核需要,对试卷 内容结构、题型结构及分值比例作适当调整。
附录
题型举例
一、单项选择题。在每小题列出的备选项中只有一项是最符合题目要求的,请将其选出。
1 .下面哪项不是大数据的采集方法
A .数据库或系统日志采集 B .网络数据采集
C .感知设备数据采集 D .现场调查问卷
2 .下面哪项不是 MapReduce 的组成部分
A .Client B .JobTracker
C .TaskTracker D .ZooKeeper
二、判断题。判断下列各题正误,正确的在答题卡相应位置涂“A”,错误的涂“B”。
3 .大数据不再探求事物间难以捉摸的因果关系,而是转而关注事物间的相关关系。
三、填空题
4.NoSQL 数据库的分类有键值存储数据库,列存储数据库, ,图型存储数据库。
四、名词解释题
5 .大数据
五、简答题
6 .Spark 的 RDDS 是什么?
六、论述题
7 .请举例论述大数据技术与人工智能技术如何结合?
全专业电子资料、题库、学位、网课
最高直省2344元
上千+科次精品网课
买网课即送全真模考题库
五千+科次教材资料
电子资料满三件9折
五千+科次在线题库
全真呈现历年考试试题
自考生题库
专业智能,巩固提分
历年真题
真题全景再现
进入做题
模拟考场
海量题随机做
进入做题
考前点题
部分科目押题
进入做题
章节练习
章节专项突破
进入做题
错题收纳
试题收藏复习
进入做题
易错题
高频易错习题
进入做题
微信公众号
网课试听
教材大全
做题闯关

扫描二维码 关注公众号
微信小程序
资料大全
免费题库
无需下载

扫描小程序码 领免费题库