极奇策RPA技术教程:统计子串出现次数 (NodeCountSubstring) - 自动化开发与配置详细指南

统计子串出现次数
📖 节点概述
统计指定子串在原文中出现的总次数(非重叠匹配)。支持可选的忽略大小写模式。该节点为纯数据节点,无执行端口。
💡 使用场景:
- 关键词频次统计:分析一篇文章中某个词语出现的次数。
- 日志分析:统计日志文件中错误代码或特定事件的发生次数。
- 数据质量检查:统计字符串中特定分隔符(如逗号)的出现次数,推断字段数量。
- 文本简化:结合替换节点,统计后再决定是否压缩冗余内容。
- 输入验证:检查字符串中是否包含多个连续空格等异常模式(如连续空格的次数)。
🎮 实战连线指南:如何正确使用它?
节点有两个输入端口:原文本(被搜索的字符串)和 目标子串(要统计的子字符串),以及一个高级选项“忽略大小写”。输出端口 出现次数 为整数。
场景案例:统计一段文字中“and”出现的次数
- 获取文本:从【变量获取】节点读取
text = "apple and banana, and orange"。 - 设置目标子串:在“目标子串”框中输入
"and"。 - 获取结果:
出现次数输出2。 - 后续使用:将结果用于频次分析或条件判断。
忽略大小写示例:
- 原文本:
"Hello hello HELLO" - 目标子串:
"hello" - 勾选“忽略大小写” → 出现次数为
3。
⚙️ 引脚与参数说明
📥 输入引脚
| 引脚名称 | 数据类型 | 说明 |
|---|---|---|
| 原文本 | STRING | 待统计的原始字符串。可通过多行文本框填写或连线传入。 |
| 目标子串 | STRING | 需要统计出现次数的子字符串。 |
⚙️ 控件参数
| 控件名称 | 类型 | 说明 |
|---|---|---|
| 原文本 | 多行文本框 | 手动输入被搜索的文本。连线时优先使用连线值。 |
| 目标子串 | 多行文本框 | 手动输入要统计的子串。 |
| 忽略大小写 | 复选框(高级) | 勾选后统计时不区分大小写。 |
📤 输出引脚
| 引脚名称 | 数据类型 | 说明 |
|---|---|---|
| 出现次数 | INT | 非重叠子串的匹配次数。 |
🔧 统计规则
- 非重叠匹配:子串匹配不会重叠。例如在
"aaaa"中统计"aa",结果为 2(匹配位置 [0,1] 和 [2,3]),而不是 3。 - 区分大小写:默认情况下大小写敏感。如需忽略大小写,可勾选“忽略大小写”选项。
- 空子串:如果目标子串为空字符串(
""),返回值为 0。 - 空原文:如果原文本为空字符串,返回值为 0。
⚠️ 注意事项
- 性能:对于长文本和频繁调用,
count()方法效率较高(O(n) 时间复杂度)。 - 重叠匹配:该节点不支持重叠计数。如需统计重叠模式(如
"aaa"中"aa"出现 2 次?实际非重叠为 1 次),请使用【正则提取】配合自定义逻辑。 - 正则场景:如果需要更复杂的模式统计(如
\d+出现次数),请使用【正则提取】节点并返回列表后取长度。 - 特殊字符:目标子串中的字符(包括
.、*等)均被视为普通字符,不具备正则含义。若需要正则表达式统计,请改用【正则提取】。
💎 小贴士:
- 统计逗号出现次数可用于估算 CSV 字段数量:
字段数 = 逗号次数 + 1。- 结合【字符串长度】和【子串长度】可计算总字符占比。
- 若需要统计多个不同子串的总次数,可以多次调用本节点并累加。
- 忽略大小写模式在处理用户输入或英文文本时非常实用。
这篇文档对您有帮助吗?
您的反馈将帮助我们持续优化文档内容

