文本处理工具箱

字数统计、按行整理、敏感信息脱敏、随机分组。文本不上传,全部在本地算。

本地处理

选择工具

切换后保留各自的输入
字数统计 字数、词频与阅读时长

统计报告

可直接选中复制
等待输入…
输入长度0 字符
输出长度0 字符
结果状态待输入

常见问题

我粘贴的文本会被上传吗?

不会。四个工具都在浏览器本地计算,本站是纯静态页面,没有后端可以接收这些内容。关掉页面后文本即消失。

中文词频是怎么算的?

中文没有空格可以切词,这里用的是两字滑动窗口近似统计,不是真正的分词。所以结果里会出现“微视”“视印”这类相邻两字的组合,结果中也写明了这一点。英文按单词统计,不受影响。

脱敏能识别出姓名和地址吗?

不能。姓名、地址、订单号这类信息没有统一的格式,任何正则都无法可靠识别。本工具只处理有明确格式的目标:手机号、身份证、银行卡与邮箱。脱敏后的文本仍需人工检查。

随机分组是公平的吗?

用 Fisher-Yates 洗牌算法打乱后再分组,各组人数差不超过 1。随机性来自浏览器的加密级随机源,不依赖可预测的种子。

处理人写的文本

写完一段东西想知道多少字、拿到一份名单要去掉重复的、导出日志要发给同事得先把手机号打码、活动要抽签分组 —— 这些事每次都临时找个网站做,往往还要把内容传上去。微视印把它们收在一页里,全程本地完成。

字数算得准

字符、中文字、单词、数字、标点、行段分开统计,emoji 按 1 个字符算。

词频不装分词

中文用两字滑动窗口近似,并在结果里写明"不是真正的分词",不假装做了。

阅读时长估算

中文按 300 字/分钟、英文按 200 词/分钟,给出发言或朗读需要多久。

按行整理

去重、排序、反转、去空行、全角半角与大小写转换,顺序明确写在面板里。

脱敏有边界

只处理手机号、身份证、银行卡、邮箱这四类有明确格式的目标,并写明姓名地址识别不了。

保留位数可调

前几位与后几位各保留多少由你定,中间用星号替代。

分组真的均匀

Fisher-Yates 洗牌后分组,各组人数差不超过 1,结果里直接给出最大差值。

抽签可重来

点「再来一次」换一批结果,不用改输入。

三个容易做错的地方

  1. 全角空格不在 ±0xFEE0 的规律里。U+3000 要单独映射成 U+0020,否则转换完会残留一个看不见的全角空格,后续匹配全部失效。
  2. 脱敏顺序不能乱。18 位身份证里含连续数字,若先跑银行卡规则会被切走一部分。本工具按"身份证 → 银行卡 → 手机号 → 邮箱"的顺序匹配。
  3. 字符数不是 length。emoji 等代理对的 length 是 2,用 [...text].length 才对得上人眼看到的个数。