介绍
站内其它工具之前的那一步。把从电子表格、聊天记录或导出文件里来的一列粘进来,拿回一份没有重复、没有空行、没有多余空格的名单。
使用方法
粘贴文本后点击要用的操作:去重、去空行、排序、倒序、大小写、提取邮箱或数字。操作可以叠加,按顺序连着点。
操作的顺序
先去空行,因为空行会让后面每一步都失真。名单来自多个来源时,接着统一大小写。第三步去重,这时相同的条目才真的看起来相同。最后排序,它让结果可读,也让漏掉的重复变得显眼。换个顺序不算错,只是要多跑几趟。
从噪音里抽出结构
提取用在有用数据埋在你没得选的文本里的时候:一段日志、一封粘过来的邮件往来、一张工单。与其手工编辑,不如把地址或数字抽出来,再拿抽出来的东西干活。用之前先看一眼结果,因为在杂乱文本上做模式匹配,偶尔会抓到一个只是长得像地址的东西。
为什么它排在第一步
站内的查活类工具按小时计额度,重复的名单会为同一个账号花两次预算。空行和把整条 URL 粘在该填用户名的位置,都会产生看起来像账号已死的失败行。先洗这一列,一次混乱的运行就变成一次干净的运行,而且不花钱,因为它从没离开你的浏览器。
常见问题
去重区分大小写吗?
只在大小写上不同的两行有可能被当成两条。想让它们算作一条,先统一大小写再去重。
名单会上传吗?
不会。每一个操作都在页面里完成,所以粘一份真实的客户地址名单也是安全的。
提取邮箱能抓全吗?
普通写法抓得很稳。像 name at example dot com 这种混淆写法是文本而不是地址,它不会去还原。
能处理多大的名单?
几万行没问题。再大标签页会变慢,因为整份内容都在浏览器内存里。