HTML 转纯文本
本地运行,数据不上传服务器
使用说明
从网页源码或邮件 HTML 里想复制出纯文字,直接复制会带上一堆标签和样式代码;爬虫抓到页面后需要提取正文,脚本和样式要去掉;富文本编辑器保存的内容带标签,做搜索索引前要先转成纯文本;做内容摘要时想快速拿到干净的文本。这些场景都需要一个可靠的 HTML 转纯文本工具。 这个工具解析 HTML 并提取纯文本,段落、列表、表格单元、br 等结构的换行效果会保留,让提取结果仍然可读。脚本、样式、noscript 和模板内容会被自动移除,避免无关内容混进正文。 输出会清理多余空白和连续空行,得到整洁的文本。结果可以一键复制。适合爬虫开发、内容运营、写搜索索引和整理文案的人。
核心功能
- ✓从 HTML 提取纯文本,去除所有标签
- ✓保留段落、列表、表格单元的换行效果
- ✓自动移除脚本、样式、noscript 和模板内容
- ✓清理多余空白和连续空行
- ✓输出整洁的纯文本结果
- ✓一键复制提取结果
- ✓在浏览器本地处理,不上传内容
使用教程
从网页源码提取正文:查看页面源码,复制整段 HTML 粘进来,得到干净的正文文本。 处理邮件 HTML:邮件正文 HTML 贴进来,提取可读的纯文字用于归档或回复。 生成搜索索引:富文本内容去标签后再建索引,避免标签干扰搜索。 清理复制内容:从后台编辑器复制的内容常带格式,转成纯文本再使用。 准备内容摘要:长 HTML 文章转纯文本后,便于生成摘要或做字数统计。
常见问题
Q:会执行 HTML 里的脚本吗?
A:不会,脚本内容会被直接移除,不会执行。
Q:表格会保留列对齐吗?
A:不会,表格单元之间会用换行分隔,但不保留列布局。
Q:隐藏元素的内容会被去掉吗?
A:不会专门处理隐藏元素,只按标签类型决定是否保留。
Q:图片说明会保留吗?
A:不会,图片的 alt 文本不会出现在结果里,只保留可见文本。
Q:连续空行会被保留吗?
A:不会,连续空行会被压缩为单个空行,让文本更整洁。
Q:可以用于 HTML 安全审查吗?
A:不适合,这个工具目标是提取文本,不做安全清洗或 XSS 检测。
Q:数据会上传服务器吗?
A:不会,解析在浏览器本地完成。