Advanced Search
Search Results
672 total results found
模型评估
评估 节点用途:分析评估模型质量 节点配置: 配置选项卡: 说明:两种方式输出模型评估结果 案例:建立一下工作流: 配置节点为默认设置,执行后,结果如下图: 信息熵 **节点用途:**根据给定的参考类为聚类结果评分。 该节点有两个输入端口,第一个输入端口连接参考类的表,第二个输入端口连接包含聚类结果的表,且这两个表均需要包含类ID。 从对话框中选择两个表中相应的列。成功执行之后,视图中会显示熵值和质量值,其中熵值越小越好,质量值属于[0,1],越趋于1越好。 节点配置: 配置选项卡: 说明: 参考字段:选...
文本挖掘
概述
(此页面暂无内容)
噪声词过滤
节点用途: 噪声词过滤节点的功能是将分词字段中的无关词汇或者不重要的词过滤掉,进而筛选出重要的词汇,可过滤中文或者英文。 过滤的方法有多种,分别是过滤与内置的噪声词库匹配的词汇、过滤与自定义噪声词库匹配的词汇、过滤所有的标点符号、过滤所有的数字、区分大小写和过滤所有字节长度小于N的词。这些方法可以只选择一个进行过滤,也可以选择全部进行过滤。过滤后输出表中的列数保持不变,只会过滤掉匹配条件的记录。 节点配置: 配置选项卡 说明: 选择过滤字段:选择文档中所需过滤字段 **使用内置噪声词库:**如果勾选此项,将会过...
字符串匹配
**节点用途:**字符串匹配节点的功能是对两个字符串字段进行比较,计算两个字段中字符串之间的距离,并在输出表中列出最相似的字符串。 该节点需要两个输入表,一个表包含用于比较的字符串字段,一个表包含一个词典字段。字符串匹配节点会寻找词典字段中与指定的字符串字段中最相似的元素。 节点配置: 配置选项卡 说明: **选择字符串字段:**选择数据表中所需要的字符串字段。该列来自于第一个输入表 **选择匹配字段:**选择一个与字符串列对比的词匹配字段。该匹配字段来自于第二个输入表(词典表)。程序将会从这个词典列中找出与目...
语句提取
**节点用途:**语句提取节点的功能是提取文档中的语句并返回一个包含文档字段、语句字段和表示语句中包含的词量字段的表。 节点配置: 配置选项卡 **选择文档字段:**选择数据表中所需要的字符串字段
分词
节点用途: 分词节点的功能是用于对中文,英文文本进行分词,进而从非结构化数据中提取结构信息。 分词的对象都是每列字段。分词后将在输出表中追加分词、计数和词性三个字段。分词字段表示从文本字段中提取出词;计数字段表示按照每个文本对得到每个分词出现次数的统计,注意,统计的只是每次词所在文本中出现的次数,并不是所有文本中出现的次数;词性字段显示的每个分词的词性。 节点配置: 配置选项卡 说明: **选择词库:**选择适合分词的词库,中文或者是英文 **选择分词的字段:**请在这里选择要分词的文本字段。分词程序将对该字段...
情感分析
**节点用途:**这个节点根据情感分析节点的功能是定义文本的情感强度和情感分类。文本情感分析又称意见挖掘。简单而言,是对带有情感色彩的主观性文本进行分析、处理、归纳和推理的过程。例如,由于基于产品评论的情感分析可以帮助用户了解某一产品在大众心目中的口碑,因此受到很多消费者和商业网站的青睐。而基于新闻评论的情感分析多用于舆情监控和信息预测中,是国内外评测中重要的评测任务。 情感信息抽取是情感分析的最底层的任务,它旨在抽取情感评论文本中有意义的信息单元。其目的在于将无结构化的情感文本转化为计算机容易识别和处理的结构化文...
社会网络
概述
(此页面暂无内容)
网络生成
**节点用途:**网络生成节点的功能是自定义网络。根据界面的信息配置生成新的随机数据。 节点配置: 配置选项卡 说明: **节点数:**网络生成的节点数目 **连线的概率:**用于确定网络中节点之间的连线概率,取值范围为0~1,如果为0 ,则网络中的节点没有连线,如果为1,那么网络中任意两个节点都存在连线。
对象插入
**节点用途:**对象插入节点的功能是从输入表中选择表示节点、边及节点和边特征的字段来创建网络,即将表转换为网络。 输入表中的每一行包含每条边的节点。该算法可以支持以下三种格式的输入表: 第一节点id 第二节点id 节点1 节点2 节点2 节点4 节点3 节点4 这种格式的输入表,需要在配置窗口中选择第一节点id字段和第二节点id字段(第一节点id和第二节点id不能选择同一字段),还需要选择一个边id字段,缺一不可。另外,也可以使用行ID作为边ID。 节点配置: 配置选项卡 说明: **第一节点ID:**选...
特征表
节点用途: 特征表节点的功能是将网络的特征写入到数据表中,将网络信息转化为表。另外,可以只选择部分特征输出,也可以指定一部分对象(节点id或者边id)输出。另外,输出的特征表有两种输出格式:特征独立显示、特征写入一个字段,分别如下: 如果您在输出表类型中选择特征独立显示,则输出表的格式如下所示: 特征目标 边id 节点id 描述 标签 权重 目标 节点 ? 节点1 ? 标签1 ? ? 边 边1 ? ? ? 1.0 ? 终端 边1 节点2 ? ? ? 目标 如果您在输出表类型中选择特征写入...
特征添加
节点用途: 特征添加节点的功能是从一个输入表中向网络添加特征。每一个特征都是通过可用边ID或者节点ID向边或者节点添加。字段的名称将被用作特征的名称,字段的类型将被作为特征的类型。 节点配置: 配置选项卡 说明: ID设置: 节点ID: 如果要添加节点的特征,则选择节点id,指定要添加特征的节点。 边ID: 如果要添加边的特征,则选择边id,指定要添加特征的边。 特征字段选择: 即将左侧框中想要添加到节点或边上的特征,添加到右侧框中。
特征过滤
节点用途: 特征添加节点的功能是从一个输入表中向网络添加特征。每一个特征都是通过可用边ID或者节点ID向边或者节点添加。字段的名称将被用作特征的名称,字段的类型将被作为特征的类型。 节点配置: 配置选项卡 说明: 指定对象: 节点: 边: 特征字段选择:
参考特征过滤
**节点用途:**参考特征过滤节点的功能是根据输入表中提供的参考特征对现有的网络元素进行过滤。需要从输入网络中选择一个网络特征字段,从输入表中选择一个参考字段,它会检查输入表中参考字段的值在网络特征中是否存在。 节点配置: 配置选项卡 说明: **指定对象:**用于确定过滤的对象是边,还是节点 **特征:**选择一个网络特征字段,程序将根据这个特征字段的取值判断是保留还是删除该取值对应的网络元素 **参考字段:**从输入表中选择一个与已选的网络特征匹配的字段。程序将使用该字段与网络特征做比较,根据比较的结果判定...
参考对象过滤
**节点用途:**指定对象过滤节点的功能是从输入表中指定一个包含对象id的字段,与网络数据中的对象id进行匹配,对匹配的对象做排除或者保留操作。这里的对象指网络中的节点或者边。 节点配置: 配置选项卡 说明: **指定对象:**用于确定过滤的对象是边,还是节点 **包含/排除:**如果选择了排除对象,那么所有id匹配的对象都会被过滤掉,不匹配结果会被保留下来。如果选择了包含对象,那么所有id匹配的对象都会被保留,不匹配的对象会被过滤掉 **对象ID:**选择参考对象ID
特征值过滤
**节点用途:**特征值过滤节点的功能是基于给定的值过滤相应的网络元素,可以在配置中指定一批特征值,对选中的特征进行过滤。 节点配置: 配置选项卡 说明: **指定对象:**用于确定过滤的对象是边,还是节点 **特征:**在下拉框中选择一个要进行特征值过滤的特征。这里的特征相当于数据表中的一个字段 特征值: 指定进行操作的特征值。这里的特征值即为特征字段中的取值。数值特征可以使用>,>=,<,<=、=等过滤。非数值特征会按照给定的正则表达式过滤,比如*smart*,表示包含所有smart的值。有些使用布尔特征,...