数据源

概述

(此页面暂无内容)

数据库

节点用途:数据库节点用于读取关系数据库中的数据

说明

前提条件:

操作步骤:

1.选择配置选项卡,如下图所示:

配置选项卡:

说明

过滤选项卡

过滤选项卡的功能如同过滤节点,用于精简数据表字段,方便过滤字段并配置字段的属性信息。

类型选项卡

类型选项卡的功能如同类型节点,用于指定字段的测量类型、角色以及计算元数据。

  1. 确定界面配置**,预览**数据

HDFS

**节点用途:**HDFS(Hadoop分布式文件系统)读取节点,用于连接HDFS文件系统,读取HDFS文件系统中的数据。

配置选项卡

说明

操作示例:

工作流中的第一个节点,数据读取,节点配置:

  1. 右键点击节点,在配置选项卡键入文件地址,勾选对应的分隔符,点击确定
  2. 右键点击节点,选择执行
  3. 右键单击节点,选择预览,可以查看数据表

Hive

**节点用途:**连接Hive数据仓库,并读取Hive中的数据表。

操作步骤:

选择配置选项卡,如下图所示:

配置选项卡

说明

操作示例:

  1. 节点配置,如上图:
  2. 确定后,并执行。

将系统自动生成的数据库URL中的分别替换为主机名或IP地址、端口和数据库名称,点击加载数据表选择表名称,点击确定即可完成配置。右键单击Hive节点选择预览可以查看数据表

HBase

**节点用途:**连接HBase数据库,并读取HBase中的数据表。

操作步骤:

1.选择配置选项卡,如下图:

配置选项卡

说明

2.选择字段选项卡,如下图:

**字段选项卡:**对从HBase中读取的字段信息进行配置。

说明

  1. 勾选此项,则按照String类型从HBase中读取,然后转成指定的字段类型,
  2. 不勾选此项,则根据下面配置框中用户指定的类型读取。
  1. 通过右侧的按钮:添加, 删除,进行添加或移除字段。
  2. 列族:用于选择列族字段,下拉列表为从HBase中加载的列族列表,默认选择第一个;
  3. 列名:用于输入HBase中的列名;
  4. 字段类型:指定所选字段的输出类型,可选String、Int、Long、Double,默认为String;
  5. 输出字段名:指定所选字段在输出表中的字段名,默认为列族_列名,可在文本框中进行编辑修改。

SmartDI

**节点用途:**SmartDI节点用于读取数据管理模块配置的数据源或者大数据工具下创建的数据集中的数据,可以实现对数据权限更全面的控制。

前提条件: 需要先在数据管理模块连接好数据源或者在大数据工具下创建好数据集查询

操作步骤:

1.选择配置选项卡,如下图:

配置选项卡

说明

操作示例:

案例需求:读取数据管理模块下数据源demo中credit数据表,配置如下:

  1. 选择数据源方式
  2. 在数据源资源树中找到demo数据库中的credit数据表,选中数据
  3. 点击右上角预览按钮可以预览数据表,结果如下

  1. 点击确定关闭配置界面
  2. 查看数据
  3. 右键点击预览也可以预览数据结果
  4. 右键启用缓存然后点击执行,执行成功之后,可以在右键的SmartDI表中查看所有读取的数据信息。

用户输入

节点用途: 用户输入节点用于手动创建一个数据表。

操作方法:

配置选项卡

说明

**列属性窗口:**编辑修改字段名称、选择字段的存储类型,定义该字段的缺失值。

操作示例:

**案例需求:**用户手动创建一个成绩单数据表,登记每个学生的语文、数学、英文成绩。过程如下:

  1. 字段属性窗口定义各个字段名称和类型,学生姓名的字段类型为String,各科目成绩的类型为Double;如下图:

  1. 配置完成后,点击“确定”按钮,表的字段信息就配置完成了。双击单元格可以直接键入数据,如下图:

  1. 输入完成后点击“确定”按钮,右键启用缓存执行,便可以在右键菜单中通过用户输入表查看该表结果,如下图:

PMML

**节点用途:**读取已有的PMML格式的模型,通常用于模型的部署应用,比如将训练好的模型导出成PMML格式的文件

说明

操作步骤:

选择配置选项卡,如下图:

配置选项卡

说明

操作示例:

读取已有的PMML格式的决策树模型。节点配置如下:

点击浏览按钮,找到pmml文件,点击确定。右键启用缓存并执行后,在右键单击PMML模型,可以查看模型内容。