Go rune 转 string 后出现数字文本是什么原因
来源:17golang原创
时间:2026-09-08 18:26:19 395浏览 收藏
在 Go 里把一个 rune 传给 string,得到的应当是这个 Unicode 码点对应的字符;如果结果变成了 20013、65 这样的数字文本,通常不是转换失败,而是代码走了数值格式化路径。最容易混淆的两组写法是 string(r) 与 fmt.Sprint(r):前者按码点编码字符,后者把 rune 当作整数打印。
想要字符就写string(r);想要码点的十进制文本才写strconv.Itoa(int(r))或fmt.Sprintf("%d", r)。先看变量的类型和目标,再决定转换函数。
rune是int32的别名,保存的是 Unicode 码点数值。string(r)把码点编码为 UTF-8 字符串;fmt.Sprint(r)把它格式化成数字文本。- 处理多个字符时,先判断数据是
[]rune、UTF-8 字节,还是需要展示的码点列表。
为什么 fmt.Sprint(rune) 会输出数字
Go 语言把 rune 定义为 int32 的别名,用它表示一个 Unicode code point。例如字符 '中' 的码点是十进制 20013。它在内存里首先是一个数值,只有经过字符转换或按字符格式输出,才会呈现为“中”。
下面几种写法的目标不同,结果也不同:
| 写法 | 目标 | 示例结果 |
|---|---|---|
string(r) | 码点转字符文本 | 中 |
fmt.Sprint(r) | 默认格式化数值 | 20013 |
fmt.Sprintf("%c", r) | 按字符格式输出 | 中 |
strconv.Itoa(int(r)) | 整数转十进制文本 | 20013 |
因此,问题常出在把“把数字显示出来”误写成“把数字代表的字符取出来”。fmt.Sprint 不会猜测你的业务意图,它只会按照默认规则格式化参数。

用 string(rune) 把码点变成字符
如果输入代表一个有效 Unicode 码点,直接使用 string(r)。这个转换产生的是包含该字符 UTF-8 编码的字符串,而不是把码点的十进制写进去。
package main
import "fmt"
func main() {
var r rune = '中'
// string 转换按 Unicode 码点生成字符文本。
charText := string(r)
// %d 明确要求把同一个 rune 按十进制数值展示。
codePointText := fmt.Sprintf("%d", r)
fmt.Printf("字符=%s,码点=%s\n", charText, codePointText)
}
这里的 charText 是“中”,codePointText 是“20013”。两者都属于字符串,但来源不同:一个来自 Unicode 码点到 UTF-8 的编码,一个来自整数到十进制字符的格式化。
如果数据本来是多个字符组成的 []rune,可以整体转换:
package main
import "fmt"
func main() {
words := []rune{'G', 'o', '中', '文'}
// []rune 保存多个码点,转成 string 后按 UTF-8 组成一段文本。
text := string(words)
fmt.Println(text)
}
不要把 []rune 中的每个元素先用 strconv.Itoa 再拼接,那会得到码点编号串,而不是原来的字符。
![Go rune 到文本的选择图中区分 string(r)、[]rune 转 string 与 strconv.Itoa 的静态关系](/uploads/20260908/1788863178-4ab5bd8b25-45bd4df887-rune-to-text-choice.webp)
需要数字文本时,显式选择数值格式化
有些场景确实要输出码点数字,例如调试 Unicode 数据、记录协议字段或生成诊断日志。这时不要用 string(r) 再猜结果,直接表达“我要十进制数字”。
package main
import (
"fmt"
"strconv"
)
func main() {
var r rune = '中'
// Itoa 接收 int,转换前显式说明这里需要的是数值文本。
decimal := strconv.Itoa(int(r))
// %U 适合诊断,能同时显示 U+ 码点和字符。
diagnostic := fmt.Sprintf("%#U", r)
fmt.Println(decimal)
fmt.Println(diagnostic)
}
strconv.Itoa 是最直白的十进制写法;%U 更适合排查字符问题,输出中会带有类似 U+4E2D '中' 的信息。日志里如果同时写出值、类型和格式化方式,往往比只打印一个结果更容易定位。
四个检查点可以快速定位异常
- 看静态类型:确认变量是
rune、int、byte还是[]rune。byte只代表一个字节,不等于完整 Unicode 字符。 - 看格式化动词:
%d、%v和fmt.Sprint偏向显示数值;%c、string(r)才是字符方向。 - 看输入边界:如果输入是 UTF-8 字节串,应先按字符串或
[]rune解码,不要把每个字节当作一个字符。 - 看码点是否合法:越过 Unicode 有效范围或落入代理区时,不能期待得到正常字符;遇到异常码点应保留原始值并在边界处处理。
Go 官方对字符串的定义是只读字节序列,range 字符串时才会按 UTF-8 解码出 rune。因此“字符数量”“字节长度”和“码点数值”本来就是三个不同概念,排查时不要只看变量名。
常见问题
为什么 string(65) 得到的是 A,而不是 65?
因为这是整数到字符串的字符转换,65 被当作 Unicode 码点 U+0041。需要文本“65”时使用 strconv.Itoa(65)。
fmt.Sprint(r) 和 fmt.Sprintf("%d", r) 有什么区别?
在这个场景下都倾向得到十进制数值文本;后者更明确,也方便统一格式。需要字符时改用 %c 或 string(r)。
把字符串转成 []rune 再转回去会丢数据吗?
对合法 UTF-8 文本,string([]rune(s)) 通常能还原字符序列;但它不是原始字节的无损备份,非法 UTF-8 会在解码时按 Unicode 替换规则处理。
记住一个判断顺序就够了:先问“我要字符还是数字文本”,再看输入是码点还是字节,最后选择 string、fmt 或 strconv。这样就不会再把 Unicode 的编号误当成最终显示内容。
-
502 收藏
-
502 收藏
-
501 收藏
-
501 收藏
-
501 收藏
-
- 前端进阶之JavaScript设计模式
- 设计模式是开发人员在软件开发过程中面临一般问题时的解决方案,代表了最佳的实践。本课程的主打内容包括JS常见设计模式以及具体应用场景,打造一站式知识长龙服务,适合有JS基础的同学学习。
- 立即学习 543次学习
-
- GO语言核心编程课程
- 本课程采用真实案例,全面具体可落地,从理论到实践,一步一步将GO核心编程技术、编程思想、底层实现融会贯通,使学习者贴近时代脉搏,做IT互联网时代的弄潮儿。
- 立即学习 516次学习
-
- 简单聊聊mysql8与网络通信
- 如有问题加微信:Le-studyg;在课程中,我们将首先介绍MySQL8的新特性,包括性能优化、安全增强、新数据类型等,帮助学生快速熟悉MySQL8的最新功能。接着,我们将深入解析MySQL的网络通信机制,包括协议、连接管理、数据传输等,让
- 立即学习 500次学习
-
- JavaScript正则表达式基础与实战
- 在任何一门编程语言中,正则表达式,都是一项重要的知识,它提供了高效的字符串匹配与捕获机制,可以极大的简化程序设计。
- 立即学习 487次学习
-
- 从零制作响应式网站—Grid布局
- 本系列教程将展示从零制作一个假想的网络科技公司官网,分为导航,轮播,关于我们,成功案例,服务流程,团队介绍,数据部分,公司动态,底部信息等内容区块。网站整体采用CSSGrid布局,支持响应式,有流畅过渡和展现动画。
- 立即学习 485次学习