当前位置:首页 > 文章列表 > Golang > Go教程 > Go strings.FieldsFunc 如何按连续分隔符切词

Go strings.FieldsFunc 如何按连续分隔符切词

来源:17golang原创 2026-09-15 02:53:08 0浏览 收藏

处理日志标签、路径片段或用户输入时,如果分隔符可能连续出现,直接用 strings.Split 往往会得到一串空字段。strings.FieldsFunc 更适合这个场景:回调函数判断当前 rune 是否属于分隔符,连续满足条件的字符会被当成一个分隔区间,结果中的字段始终非空。

官方文档:https://pkg.go.dev/strings#FieldsFunc

要点速览
  • 回调返回 true 的字符会参与分隔,函数按 Unicode 字符处理。
  • 连续分隔符、首尾分隔符都不会生成空字符串元素。
  • 空串或全是分隔符时返回空切片;回调对同一个字符应保持确定。

先确认 FieldsFunc 的返回契约

函数签名是 strings.FieldsFunc(s string, f func(rune) bool) []string。它不是接收一个固定字符串分隔符,而是逐个判断字符:回调返回 true 的连续字符组成分隔区间,其余字符组成字段。首尾分隔区间会被丢弃,字段不会为空。

输入分隔符判定结果
foo,,bar逗号为 true["foo", "bar"]
|foo|竖线为 true["foo"]
,,,全部为 true[]
Go|教程竖线为 true["Go", "教程"]
Go strings.FieldsFunc 的 rune 判定、连续分隔区间和非空字段结果关系框图
图1:strings.FieldsFunc 返回契约示意图;连续满足 f 的字符组成一个分隔区间,结果字段保持非空。

把多种分隔符统一交给 rune 判断函数

如果输入同时可能出现空格、逗号、分号和竖线,可以把规则集中在一个谓词里。这样切词行为清楚,也不会因为连续分隔符产生额外空字段:

package main

import (
	"fmt"
	"strings"
	"unicode"
)

func main() {
	text := "  Go,,教程|FieldsFunc;;示例  "
	fields := strings.FieldsFunc(text, func(r rune) bool {
		// 空白和常见标点都视为分隔符,连续字符会合并处理。
		return unicode.IsSpace(r) || strings.ContainsRune(",;|", r)
	})
	fmt.Printf("%q\n", fields)
}
["Go" "教程" "FieldsFunc" "示例"]

这里的回调只依赖当前字符,所以同一个 rune 每次都会得到相同结果。不要在回调里累加计数、读取会变化的外部状态或根据调用顺序切换返回值;官方文档明确说明,FieldsFunc 不保证调用回调的顺序。

用边界输入确认连续分隔符不会制造空字段

排查“切出来的数量不对”时,优先用四组输入确认规则,而不是只测试一个正常字符串。尤其要注意:FieldsFunc 的设计目标就是返回非空字段,它和保留空元素的 Split 不是同一种语义。

func splitTags(text string) []string {
	// 只按竖线和逗号分隔,前后以及中间重复分隔符都会被折叠。
	return strings.FieldsFunc(text, func(r rune) bool {
		return r == '|' || r == ','
	})
}

// 预期结果:foo,,bar -> [foo bar];|foo| -> [foo];,,, -> []。
var cases = []string{"foo,,bar", "|foo|", ",,,", "Go|教程"}
Go strings.FieldsFunc 四组边界输入与非空字段结果示意图
图2:边界输入结果示意图;多个连续分隔符合并为分隔区间,前后分隔符也不会产生空字段。
边界返回值排查结论
前置或尾部分隔符字段被保留,分隔区间被丢弃不要手动 Trim 后再补空字段
连续分隔符只形成一个分隔区间不会得到 ""
全部是分隔符或空串空切片先判断数量,再访问下标
中文字段按 Unicode 字符遍历谓词参数使用 rune

封装切词逻辑,再决定业务校验

FieldsFunc 只负责切分,不负责判断字段数量、标签是否重复或内容是否合规。可以把分隔规则封装起来,再由调用方决定空结果是否报错:

func splitColumns(line string) ([]string, error) {
	// 切分层只定义分隔符;列数约束放在业务层,便于复用。
	fields := strings.FieldsFunc(line, func(r rune) bool {
		return unicode.IsSpace(r) || r == ',' || r == ';'
	})
	if len(fields) == 0 {
		// 空行或全分隔符不能直接取 fields[0]。
		return nil, fmt.Errorf("没有可用字段")
	}
	return fields, nil
}

如果业务协议必须保留连续分隔符代表的空列,例如 CSV 的空列占位,就不要用 FieldsFunc 代替专用解析器;此时应选择 strings.Split 或按协议实现扫描。关键是先确定“分隔符是边界”还是“分隔符本身携带空值信息”。

常见问题:FieldsFunc 和 Split 怎么选

为什么返回结果里没有空字符串?

因为 FieldsFunc 按连续分隔区间切分,并且官方契约保证每个返回元素非空。需要保留空字段时,应改用能表达空元素的切分方案。

回调能不能根据字符出现次数改变结果?

不建议这样做。回调应该是稳定的字符谓词;如果规则依赖位置或状态,先写一个明确的扫描器,避免依赖 FieldsFunc 未保证的调用顺序。

为什么中文不会被截成乱码?

回调接收的是 rune,FieldsFunc 按 Unicode code point 判断。只要分隔规则使用正确的字符谓词,中文字段会作为完整字符串返回。

版本声明
本文转载于:17golang原创 如有侵犯,请联系study_golang@163.com删除
PHP 8.4 属性钩子读取和写入校验如何分工PHP 8.4 属性钩子读取和写入校验如何分工
上一篇
PHP 8.4 属性钩子读取和写入校验如何分工
Java record pattern 解构嵌套 record 时如何处理 null
下一篇
Java record pattern 解构嵌套 record 时如何处理 null
查看更多
最新文章
查看更多
课程推荐
  • 前端进阶之JavaScript设计模式
    前端进阶之JavaScript设计模式
    设计模式是开发人员在软件开发过程中面临一般问题时的解决方案,代表了最佳的实践。本课程的主打内容包括JS常见设计模式以及具体应用场景,打造一站式知识长龙服务,适合有JS基础的同学学习。
    543次学习
  • GO语言核心编程课程
    GO语言核心编程课程
    本课程采用真实案例,全面具体可落地,从理论到实践,一步一步将GO核心编程技术、编程思想、底层实现融会贯通,使学习者贴近时代脉搏,做IT互联网时代的弄潮儿。
    516次学习
  • 简单聊聊mysql8与网络通信
    简单聊聊mysql8与网络通信
    如有问题加微信:Le-studyg;在课程中,我们将首先介绍MySQL8的新特性,包括性能优化、安全增强、新数据类型等,帮助学生快速熟悉MySQL8的最新功能。接着,我们将深入解析MySQL的网络通信机制,包括协议、连接管理、数据传输等,让
    500次学习
  • JavaScript正则表达式基础与实战
    JavaScript正则表达式基础与实战
    在任何一门编程语言中,正则表达式,都是一项重要的知识,它提供了高效的字符串匹配与捕获机制,可以极大的简化程序设计。
    487次学习
  • 从零制作响应式网站—Grid布局
    从零制作响应式网站—Grid布局
    本系列教程将展示从零制作一个假想的网络科技公司官网,分为导航,轮播,关于我们,成功案例,服务流程,团队介绍,数据部分,公司动态,底部信息等内容区块。网站整体采用CSSGrid布局,支持响应式,有流畅过渡和展现动画。
    485次学习
查看更多
AI推荐
  • PubMedQA数据集详解:生物医学问答基准、功能与应用指南
    PubMedQA
    深入了解PubMedQA生物医学问答数据集,涵盖其核心功能、使用方法及在临床决策、药物研发等场景的应用,助力提升NLP模型性能。
    27次使用
  • H2O EvalGPT:开源LLM大模型评估与排行榜工具
    H2O EvalGPT
    H2O EvalGPT是H2O.ai推出的开源LLM评估平台,提供详细的大模型性能排行榜、行业特定基准测试及A/B测试功能,助您快速选择最适合项目的高性能大语言模型。
    131次使用
  • LMArena是什么?伯克利AI模型评估平台使用指南与功能解析
    LMArena
    LMArena是加州大学伯克利分校推出的AI模型匿名评测平台。通过盲测投票机制,用户可对比不同大模型回答并生成实时排行榜,助力开发者优化模型及用户选择最佳AI工具。
    63次使用
  • 斯坦福HELM:大语言模型Holistic Evaluation整体评估框架详解
    HELM
    深入了解斯坦福推出的HELM(Holistic Evaluation of Language Models)大模型评测体系。本文解析其核心功能、安装配置步骤及应用场景,涵盖准确性、公平性、鲁棒性等多维度指标,助力开发者全面优化语言模型性能。
    23次使用
  • CMMLU中文大模型评估基准:功能、使用教程与应用场景解析
    CMMLU
    深入了解CMMLU中文评估基准,涵盖67个学科主题,提供数据集下载、Zero-shot/Five-shot评估方法及排行榜,助力优化中文语言模型性能。
    7次使用