工具说明
TXT 合并按文件顺序连接纯文本内容,适合整理日志、章节草稿和导出的数据片段。纯文本没有标题层级或分页结构,文件之间是否加入换行直接决定末行与下一文件首行会不会粘连。
字符编码是最常见风险。来源若混用 UTF-8、GBK 或其它编码,读取后可能出现乱码;合并前还应统一换行符、末尾空行和是否需要插入文件名作为分隔。
使用步骤
确认编码和内容
分别打开每个文件,确保中文、符号和换行显示正确。
按顺序排列
决定文件边界是否需要空行或标题,再调整列表。
检查连接位置
生成后搜索每个原文件的末尾与开头,确认没有粘行或遗漏。
支持范围与限制
- 输入 / 输出
- 多个纯文本文件,输出单个 TXT
- 拼接方式
- 按列表顺序首尾相接,文件之间插入换行分隔
- 编码
- 按 UTF-8 读取与输出。源文件若是 GBK 等其它编码,可能出现乱码,需先转码
- 换行符
- Windows 的 CRLF 与 Unix 的 LF 混用时,合并结果会同时存在两种换行
- 不做处理
- 不去重、不排序、不裁剪空行:内容原样保留
- 适合的场景
- 分章节的草稿、按天切分的日志、分批导出的纯文本记录
典型使用场景
汇总分段日志
把按日期或大小滚动生成的日志按时间顺序连接。
组合纯文本章节
将多个无格式草稿合并为一个可搜索文件。
合并按日期切分的日志
把一批按天导出的纯文本日志接成一份,再交给文本工具做统计或检索。
使用前需要知道的事
- 合并不会按时间戳自动排序,实际顺序由列表决定。
- 不同编码的乱码不能通过简单连接修复,应先单独转为 UTF-8。
- 大文件合并可能占用较多浏览器内存,应保留来源并核对输出大小。
相关概念
- UTF-8
- 兼容 ASCII 并能表示完整 Unicode 的常用文本编码。
- line ending
- 表示换行的字符序列,常见为 LF 或 CRLF。