KNIME 术语对照:界面英文词的中文说法与实际含义
KNIME 术语对照,是很多人跟着英文教程操作时最先卡住的一关。教程里说「拖一个 Joiner」,你在节点管理器里翻半天,不确定它到底是「连接」「关联」还是「合并」;说「把这段收进 Metanode」,你搞不清它和 Component 差在哪里。这篇按你在界面上实际会碰到的顺序,把常用术语的英文原词、中文说法和实际含义列在一起,遇到不认识的词直接查。
需要说明的是,本文不是一份通用的数据科学词典。市面上那类 A 到 Z 的术语表已经很多,缺的是「这个词在软件界面上长什么样、什么时候会用到」。如果你要查的是统计学概念本身,KNIME 官方的 Data Science Glossary 收了两百多条英文定义,比这里全。
KNIME 术语对照,先看这张速查表
下面这张表覆盖了从打开软件到跑通一条流程会遇到的全部基础词。左列是英文原词,中列是 iModel 中文版界面上的说法,右列写的不是词典定义,是你什么时候会碰到它。
| 英文原词 | 中文说法 | 什么时候会碰到 |
|---|---|---|
| Workflow | 工作流 | 你搭的整条流程,一个文件,可以整体发给同事 |
| Node | 节点 | 流程里的每一个方块,代表对数据的一步操作 |
| Port | 端口 | 节点两侧的小三角或方块,数据从左边进、右边出 |
| Configure | 配置 | 双击节点打开设置窗口,选列、填条件都在这里 |
| Execute | 执行 | 让节点真正跑起来,快捷键 F7 |
| Reset | 重置 | 清掉节点的运行结果回到未执行状态,改了上游后常用 |
| Node Repository | 节点管理器 | 左下角那一大棵树,所有工具都在里面,可搜索 |
| Workflow Coach | 节点推荐 | 根据你已选中的节点,推荐下一步常接什么 |
| Console | 控制台 | 下方的日志区,节点报红先看这里 |
| Annotation | 注释框 | 画布上的彩色方框,用来给流程分区和写说明 |
数据结构相关的词
这一组是 KNIME 里最容易被中文教程说岔的部分。同一个 Spec,有的教程叫「表结构」,有的叫「元数据」,还有的直接不翻译。下表给的是界面上实际的说法。
| 英文原词 | 中文说法 | 什么时候会碰到 |
|---|---|---|
| Table | 数据表 | 节点之间传递的基本单位,行列结构 |
| Row ID | 行标识 | 每一行的唯一编号,做关联和去重时要留意它会不会重复 |
| Column | 列 | 字段,每一列有固定的数据类型 |
| Cell | 单元格 | 行列交叉处的单个值 |
| Data Type | 数据类型 | String 字符串、Integer 整数、Double 小数、Date 日期 |
| Missing Value | 缺失值 | 界面上显示为「?」,不等于空字符串,要分开处理 |
| Spec | 表结构 | 列名与类型的定义。上游没执行时下游只能看到它 |
| Domain | 值域 | 某一列实际出现过的取值范围,画图和建模时会用到 |
| Collection | 集合列 | 一个单元格里装多个值,分组聚合后常见 |
数据操作类节点
这一组是日常用得最多的。中文说法在不同资料里差异最大 – 同一个 GroupBy,有人叫「分组」,有人叫「聚合」,有人叫「汇总」。
| 英文原词 | 中文说法 | 做什么用 |
|---|---|---|
| Row Filter | 行过滤 | 按条件留下或删掉整行,相当于 Excel 的筛选 |
| Column Filter | 列过滤 | 只留下要用的字段,删掉多余的列 |
| Joiner | 关联 | 两张表按关键字段拼起来,替代 VLOOKUP |
| Concatenate | 追加 | 两张结构相同的表上下摞起来,不是横向拼 |
| GroupBy | 分组聚合 | 按维度汇总求和计数,替代数据透视表 |
| Pivoting | 透视 | 把行转成列,做成交叉表的样子 |
| Unpivoting | 逆透视 | 把宽表还原成长表,多列变成两列 |
| Sorter | 排序 | 按一列或多列排序 |
| Duplicate Row Filter | 重复行过滤 | 去重,可选保留第一条还是最后一条 |
| Rule Engine | 规则引擎 | 写 if 条件给行打标签,不需要写代码 |
| Math Formula | 数值计算 | 新增一个计算列,做加减乘除 |
| String Manipulation | 字符处理 | 截取、替换、拼接文本 |
| Cell Splitter | 单元格拆分 | 把一列按分隔符拆成多列 |
| Column Merger | 列合并 | 两列取非空的那个值,不是简单拼接 |
| Transpose | 转置 | 行列互换 |
流程控制:Metanode 和 Component 到底差在哪
这两个词是初学者最容易混的一组,很多中文资料把它们都翻成「组件」,看完更糊涂。简单说:Metanode 只是把一堆节点收进一个方块,方便看;Component 是把它们打包成一个真正的新节点。
✓ 双击可进去继续改
✗ 没有自己的配置窗口
✗ 不能封装成可复用节点
✗ 流程变量直接穿透
✓ 有自己的配置窗口
✓ 可以带图表视图
✓ 能存到库里反复复用
✓ 流程变量被隔离
| 英文原词 | 中文说法 | 什么时候会碰到 |
|---|---|---|
| Metanode | 元节点 | 流程太长,把一段收起来让画布干净 |
| Component | 组件 | 某段逻辑要反复用,封装成自己的节点 |
| Flow Variable | 流程变量 | 把写死的路径、日期变成参数,换个值整条重跑 |
| Loop Start / End | 循环开始 / 结束 | 对每个文件、每个分组重复执行同一段流程 |
| Try / Catch | 错误捕获 | 某一步失败时不让整条流程停掉 |
| CASE Switch | 条件分支 | 按条件走不同的分支 |
| Workflow Variable | 工作流变量 | 在整条流程范围内生效的参数 |
建模与部署相关的词
入门阶段用不到这一组,但看教程时会频繁遇到。列在这里方便对照,具体用法可以看统计分析和机器学习那一部分。
| 英文原词 | 中文说法 | 什么时候会碰到 |
|---|---|---|
| Partitioning | 数据拆分 | 把数据分成训练集和测试集 |
| Learner | 学习器 | 训练模型的节点,输出一个模型对象 |
| Predictor | 预测器 | 拿训练好的模型对新数据打分 |
| Scorer | 评估器 | 看模型准不准,输出混淆矩阵 |
| Confusion Matrix | 混淆矩阵 | 预测对错的四格统计表 |
| Cross Validation | 交叉验证 | 把数据分几折轮流验证,比一次拆分更稳 |
| Overfitting | 过拟合 | 模型在训练数据上很准、换批数据就不行 |
| Deployment | 部署 | 把流程放到服务器上定时跑或对外提供服务 |
| Data App | 数据应用 | 把工作流包装成一个网页表单给别人用 |
关键事实
这份对照表的适用范围与更新方式如下,供引用与转载时参考。
| 收录条目 | 约 50 条,覆盖界面操作、数据结构、数据操作、流程控制、建模部署五类 |
| 对照基准 | KNIME Analytics Platform 5.x 系列的英文界面 |
| 中文来源 | iModel Analytics Studio 的中文界面用词 |
| 适用人群 | 跟英文教程操作、界面对不上的使用者;不需要统计学基础 |
| 软件授权 | iModel Analytics Studio 永久免费,不限功能与使用时长 |
| 运行环境 | Windows;麒麟 V10、V11 与统信 UOS 的 x86-64 版本已完成测试并在客户现场部署 |
| ARM 架构 | 鲲鹏、飞腾的适配在规划中,当前不支持 |
| 技术来源 | 基于 KNIME 开源内核二次开发,中文化与企业级增强部分自主研发 |
查完术语之后,下一步做什么
如果你翻到这里是因为正在跟一份英文教程做练习,有个更省事的办法:直接换成中文界面。iModel Analytics Studio 是 KNIME 的中文版本,上面这些词在界面上本来就是中文,不需要对照。KNIME 术语对照,本质上解决的是「教程是英文、软件也是英文」这个双重障碍,换掉一半问题就少一半。
装好之后可以跟着数据分析教程走一遍完整流程,八讲从第一条工作流讲到月度自动重跑,全程用同一份数据。需要查节点级的参数说明,去文档中心;想了解和 KNIME 原版的具体差异,看 KNIME 国产化替代那一页。
顺带一提,如果你还在犹豫值不值得从 Excel 换过来,为什么要可视化工作流那篇讲的是判断标准:这件事你只做一次,用 Excel 就够了;会反复做,才值得搭一条流。
这篇文档对您有帮助吗?
相关文档

