跳到主内容
UniKit

文本拆分

按字符数、词数、行数、分隔符或正则拆分文本,可在标点处断开、保留分隔符、去掉空白并给每段编号,同时给出段数与长度统计。

浏览器本地运行所有计算都在你的浏览器里完成,数据不会离开本机。

待拆分的文本
选项

统计

段数3
总字符数86
总词数6
最长段40
最短段6

拆分结果

3 段
#1 · 40 字符 · 3 词
UniKit 是一个即开即用的在线工具箱,所有计算都在浏览器里完成。

你可以按
#2 · 40 字符 · 2 词
字符数、词数、行数、分隔符或正则拆分文本。

结果会以列表形式展示,方便逐段复制
#3 · 6 字符 · 1 词
或整体复制。

这个工具能做什么

  • 把长文切成合适的大小再喂给翻译、AI 或字幕工具:按字符数、词数、行数、分隔符或正则切分,一次贴一段。
  • 按字符数拆分时勾选「在标点或空格处断开」,断点会落在逗号、句号附近,读起来不会在半句话中间断开。
  • 按正则拆分特别适合处理空行分段:用 \n\s*\n 一次把整篇按段落切开。
  • 每段都能单独复制,也能整体复制(段与段之间空一行),还能给每段加序号方便引用。

示例

输入

UniKit 是一个即开即用的在线工具箱,所有计算都在浏览器里完成。

输出

1. UniKit 是一个即开即用的在线工具箱,
2. 所有计算都在浏览器里完成。

这是「按 20 字符 + 在标点处断开 + 去掉首尾空白 + 每段编号」的结果:第一段在逗号后断开(19 个字符),因为那是 20 字符附近最近的断点。

常见问题

按字符数拆分会把 Emoji 切成两半吗?

不会。字符模式按 Unicode 码点计数(用 Array.from 遍历),代理对形式的 Emoji 记作一个字符,不会被拆成两个乱码。

「在标点或空格处断开」是怎么找断点的?

先算出目标位置,然后从目标位置往前回退,最多退到一半长度处,遇到逗号、句号、问号、空格或右引号就断在那里。所以每一段可能略短于你填的字符数,但断点更自然。

保留分隔符和不保留有什么区别?

不保留时分隔符被丢弃;保留时它会被拼到下一段开头。想拼回原文就勾选保留,想得到干净的片段就关掉它。注意正则模式会自动给没有捕获组的表达式加一层括号来实现这个效果。

段数是 0 或只有 1 段是什么情况?

输入为空时没有可拆分的内容;只有 1 段说明总长度还没超过你设置的每段长度。检查一下「每段包含」的数值,或者换一个拆分方式。

关键词:split texttext splitterchunkdelimiterregex文本拆分分段按字符拆分按分隔符正则拆分

同类工具