题目详情

阅读以下说明和流程图,填补流程空中的空缺(1)~(5)将解答填入答题纸的对应栏内。

【说明】

两个包含有限个元素的非空集合 A、B 的相似度定义为 |A∩B|/|A∪B|,即它们的交集大小(元素个数)与并集大小之比。

以下的流程图计算两个非空整数集合(以数组表示)的交集和井集,并计算其相似度。己知整数组 A[1:m]和 B[1:n]分别存储了集合 A 和 B 的元素(每个集合中包含的元素各不相同),其交集存放于数组C[1:s],并集存放于数组D[1:t] ,集合A 和 B 的相似度存放于 SIM。

例如,假设 A={ 1, 2 ,3,4} ,B={ 1, 4 ,5,6},则C={1, 4} ,D={1, 2 ,3 ,4 ,5, 6},A 与 B 的相似度 SIM=1/3。

【流程图】

初级程序员,章节练习,基础复习,案例分析

正确答案及解析

正确答案
解析

(1)s (2)t (3)c[s] (4)D[t] (5)s/t

本题考查程序处理流程图的设计能力。

首先我们来理解两个有限集合的相似度自含义。两个包含有限个元素的非空集合 A、B 的相似度定义为它们的交集大小(元素个数)与并集大小之比。如果两集合完全相等,则相似度必然为 1 (100%); 如果两集合完全X同(没有公共元素),则相似度必然为0; 如果集合A 中有一半元素就是集合B 的全部元素,而另一半元素不属于集合 B,则这两 个集合的相似度为 0.5(50%)。因此,这个定义符合人们的常理性认识。

在大数据应用中,经常要将很多有限集边行分类。例如,每天都有大量的新闻稿。

为了方便用户检索,需要将新闻稿分类。用付么标准来分类呢?每一篇新闻稿可以用其 中所有的关键词来表征。这些关键词的集合勒为这篇新闻稿的特征向量。两篇新闻稿是 否属于同一类,依赖于它们的关键词集合是否具有较高的相似度(公共关键词个数除以 总关键词个数)。搜索引擎可以将相似度超过一定水平的新闻稿作为同一类。从而,可以 将每天的新闻稿进行分类,就可以按用户的需要将某些类的新闻稿推送给相关的用户。

本题中的集合用整数组表示,因此,需要规定同一数组中的元素各不相同(集合中的元素是各不相同的)。题中,整数组 A[1:m] 阳 B[l:n]分别存储了集合 A 和 B 的元素。流程图的目标是将 A 、B 中相同的元素存放入数组C[ 1:s] (共s 个元素),并将 A 、B 中 的所有元素(相同元素只取一次)存放入数组 D[1:t] (共t 个元素),最后再计算集合 A 和 B 相似度的。

流程图中的第一步显然是将数组 A 中的全部元素放入数组 D 中。随后,只需要对数 组 B 中的每个元素进行判断,凡与数组 A 中某个元素相同时,就将其存入数组 C; 否则就续存入数组 D (注意,数组 D 中已有 m 个元素)。这需要对 j (遍历数组 B) 与 i (遍历数组 A) 进行两重循环。判断框 B[j]=A[i]f lG立时, B[j]应存入数组 C; 否则应继续 i 循环,直到循环结束仍没有相等情况出现时, j 先应将 B[j]存入数组 D。存入数组 C 之前, 需要将其下标 s 增 1; 存入数组 D 之前,需要将其下标 t 增 1。因此,初始时,应当给j 赋 0,使数组C 的存数从C[1]开始。从而,()处应填 s,(3)处应填c[s]。而数组D 是在已有 m 个元素后续存,所以,初始时,数 fi D 的下标 t 应当是 m ,续存是从D[m+1] 开始的。因此, (2) 处应填 t ,(的处应填D[]。

两重循环结束后,就要计算相似度的,将其赋予 SIM,因此(5) 处应填的。

你可能感兴趣的试题

单选题

一台主机的IP地址为202.123.25.36,掩码为255.255.254.0。如果该主机需要在该网络进行直接广播,那么它应该使用的目的地址为( )

  • A.202.123.25.0
  • B.202.123.25.255
  • C.202.123.24.0
  • D.202.123.24.255
查看答案
单选题

在计算机系统的日常维护工作中,应当注意硬盘工作时不能__(2)__。另外,需要防范病毒,而__(3)__是不会被病毒感觉的。

  • A.电子邮件
  • B.硬盘
  • C.U盘
  • D.ROM
查看答案
单选题

有 4 个 IP 地址:201.117.15.254、201.117.17.01、201.117.24.5 和 201.117.29.3,如果子网掩码为 255.255.248.0,则这 4 个地址分别属于3个子网;其中属于同一个子网的是()

  • A.201.117.15.254 和 201.117.17.01
  • B.201.117.17.01 和 201.117.24.5
  • C.201.117.15.254 和 201.117.29.3
  • D.201.117.24.5 和 201.117.29.3
查看答案
单选题

在异步通信中,每个字符包含1位起始位、7位数据位、1位奇偶位和1位终止位,每秒钟传送200个字符,采用4相位调制,则码元速率为()。

  • A.50波特
  • B.500波特
  • C.550波特
  • D.1000波特
查看答案
单选题

在 Windows 中,运行( )命令得到下图所示结果。以下关于该结果的叙述中,错误的是( )。

Pinging 59.74.111.8 with 32 bytes of data:

Reply from 59.74.111.8: bytes=32 time=3ms TTL=60

Reply from 59.74.111.8: bytes=32 time=5ms TTL=60

Reply from 59.74.111.8: bytes=32 time=3ms TTL=60

Reply from 59.74.111.8: bytes=32 time=5ms TTL=60

Ping statistics for 59.74.111.8:

Packets: Sent = 4, Received = 4, Lost = 0 (0% loss),

Approximate round trip times in milli-seconds:

Minimum = 3ms, Maximum = 5ms, Average = 4ms

  • A.该命令使得本地主机向目标主机发送了 4 个数据包
  • B.本地主机成功收到了目标主机返回的 4 个数据包
  • C.本地主机与目标主机连接正常
  • D.该命令用于查看目标主机的 IP 地址
查看答案

相关题库更多 +