用过这个工具吗?给它评分
StealthWriter 是一款在浏览器中使用的写作工具,做两件互相关联的事:把文本改写得更接近自然的人类行文,以及扫描文本、估算它被检测器判定为机器生成的可能性有多大。这两半是设计来配合使用的——先扫描草稿,再改写,然后重新扫描结果,看看到底改变了什么。
产品对自身核心动作的描述很直白:它把 AI 生成的内容重写成读起来自然、经过打磨、可以直接使用的样子。实际操作中,你把一段来自通用大模型(比如 ChatGPT、Claude 或 Gemini)的草稿粘贴进去,选择希望它被重写的力度,然后拿回一份措辞、节奏与句式都不同的版本。
有必要先说清楚这属于哪一类产品,因为这个品类存在明显的命名混乱。同类工具至少被冠以三种不同标签——人性化改写器、检测规避器、同义改写器——而选用哪个标签,往往更多地反映营销者的意图,而不是软件本身的行为。StealthWriter 自己的法律条款用的是三者中最保守的那一个:其服务条款把产品定义为一款由人工智能驱动的同义改写与内容重写工具,目的是帮助用户高效地创作独特且高质量的内容。
该服务由在美国怀俄明州注册的 AiVantage LLC 运营,而且「关于我们」页面具名公布了个人所有者,没有躲在品牌背后。同一页面还公布了法定名称、联系邮箱、电话号码,以及位于怀俄明州谢里登市的通信地址。
这一点比表面看起来更重要。在 AI 人性化改写这个品类里,相当大一部分产品是匿名运营的:没有具名的法人主体,没有地址,一旦出现扣款纠纷或数据处理问题,也找不到可追责的对象。StealthWriter 三样都公布了。这并不能证明它的产品宣称为真,但确实意味着服务背后存在一个可追责的主体——而这道基础门槛,数量惊人的同类竞品并没有跨过。
如果你以前接触过这款产品,你记忆中的它可能是另一副样子。较早的导航站条目和第三方页面至今仍主要把它描述成绕过 Turnitin、GPTZero 与 Originality AI 的手段,并承诺拿到百分之百的人类评分。而现在的官网不再这样说话。首页、关于页与常见问题现在一致使用「人性化」「清晰」「自然表达」这类措辞,而不是「规避」;服务条款走得更远——它明确否认了旧营销所暗示的那种用途。
读者应当把旧的表述视为已经过时。本页描述的是产品当前呈现出的样子,并且会另行考察这两种版本的宣称各自是否站得住脚。
重写引擎一次处理一个句子,并把强度控制暴露给用户:可以在轻度、中度与激进三档之间选择。较轻的档位保留更多原有措辞,适合草稿整体尚可、只想让个别段落更顺畅的情况;激进档位则重构幅度更大,与你原本写下的内容偏离更远。
一份第三方实测指出了这套引擎的一个结构性特征,在依赖它之前值得了解:该工具只做句子级别的重写,也就是说,它不增加也不删除任何句子。这是一条实实在在的约束,带来的后果是双向的。因为句子数量与顺序都被保留,输出结果与你的原始结构保持对齐,很容易逐句对照审阅。但也正因为引擎从不合并、拆分、调序或删除任何内容,它无法修复位于句子层级之上的问题——一个绕圈子论证的段落、一个位置放错的章节、一个无法从既有论据推出的结论。而这些恰恰是长篇 AI 草稿最常见的弱点,无论在句子层面改写多少遍都补不回来。
产品没有把你打发到别处去验证结果,而是内置了自己的扫描器,并把它定位为围绕改写动作的验证环节。扫描器以单句为粒度呈现结论:逐句分析,用彩色高亮准确标出哪些句子被判定为可疑。实际使用中,你会得到一个段落级视图,能看清究竟是哪几个具体句子在拉高分数,这比给整篇文档一个笼统的百分比要有用得多。
检测器也可以在不做任何承诺的前提下先试用。首页嵌入了一个即时扫描器,并明确邀请访客把任意文本粘贴进去,立刻查看它被判定为 AI 生成的可能性,无需注册账号。如果你想判断这款产品值不值得注册,这是最快的测试路径——你可以先拿它的判定结果与你本来就信任的检测器作对比,然后再决定要不要注册。
关于这个检测器能告诉你什么、不能告诉你什么,有一条重要的保留意见,下文的「限制与注意事项」会详细展开。简单说:一个同时在向你出售改写服务的工具所给出的有利评分,不构成独立证据;而且没有任何检测器的评分——包括这一个——能确定另一个检测器会如何判定。
你不必被动接受模型给出的任何结果,而是可以逐句介入:点击任意一个句子,从多个候选表述中挑选,把输出调整到贴合你自己的语感。这项功能最能区分「谨慎使用」与「草率使用」。机器改写经常产出语法正确但略微失准的句子——重心发生偏移、习语与语域不匹配、专业术语被换成了含义其实不同的近义词。能够逐句否决一个候选并另选一个,正是保住原意的关键所在。
重写引擎是有版本的,而且旧版本仍然可选。根据产品更新日志,模型选择器现在包含 Ghost 5.2 这一代,同时把上一代的 Ghost 5.1 与 Ghost 4.6 保留在「旧版」选项之下。Ghost 5.2 Mini 被描述为默认的轻量选项,为快速改写而构建;Ghost 5.2 Pro 则针对结构连贯性、行文流畅度与可读性做了调优,在这几方面优于 Mini。
保留旧代际可选,是一个务实的决定,它承认了营销话术不会提的一件事:不同版本之间的输出特征会变,新模型并不自动地对每一种文本都更好。已经围绕某一代模型的语感调好工作流的用户,可以继续留在那一代上。
非英语文本是原生处理的,不需要经过「翻译—改写—再翻译」的绕路。更新日志说明,5.1 版改写引擎已支持主要的世界语言,其中包括德语、西班牙语、葡萄牙语、法语、意大利语、荷兰语、中文与日语等。至于这些语言的输出质量是否与英语相当,厂商并未提供文档,本次调查也没有检索到针对其非英语输出的独立测试,因此多语言支持应当被理解为「可用但未经量化」。
更新日志中有一条功能值得明说而不是一笔带过:该产品现在可以移除 Claude 生成文本中的水印,改写后的输出不再携带模型厂商植入的不可见 AI 水印。
这与上面列出的其他功能属于不同性质。其他功能关乎文本读起来如何,而这一条关乎模型提供方自身的溯源信号能否在处理后存活。模型厂商添加这类信号,恰恰是为了让机器生成的文本保持可追溯,而这项功能的设计目的就是让该机制失效。此处记录它,是因为它是一项有文档记载的产品能力,用户应当知道它的存在。至于剥除溯源标记是否恰当,完全取决于你拿这段文本去做什么,而这个判断本页无法代你作出。
最站得住脚的用法,也是最平淡无奇的那一种。如果你用语言模型突破了空白页的困境,而结果读起来就像出自语言模型——平均、扁平、处处留有余地、节奏单调——那么一遍改写可以让它松动一些。配合逐句候选功能,这是一种正当的编辑辅助:作者依然是你,每一个决定依然由你作出,工具只是在提供选项。
扫描器有一种独立于改写器的用途,而对不少人来说,这才是更有价值的那一半。AI 检测器的误报是有据可查的严重问题,行文平实、结构工整的人,或者以英语作为附加语言写作的人,被误标的比例明显偏高。在提交之前把自己确实原创的作品跑一遍扫描器,能让你知道自己是否可能面临这类指控——哪怕你最终一个字都不改,这也是有用的信息。
批量产出常规文案的团队——产品描述、类目页、邮件变体——会用这类工具在大量高度相似的条目之间制造措辞差异。按每日次数计费的定价结构,正是围绕这种使用模式设计的,公开套餐中最大的一档允许每天改写两千次。
学术提交是必须给出明确答案的一种情况,而厂商自己就提供了答案。其服务条款声明该产品不是作弊工具,不得用于学术不诚信或任何形式的学术不端行为。把机器生成的内容当作自己的作品提交,违反的是几乎所有院校的诚信政策,无论是否有检测器发现;而工具的运营方本身就否认这种用途。这一点在「限制与注意事项」中还有进一步展开,因为周边证据已经发生了实质变化,用户有权看到完整图景。
以较短的段落为单位处理,而不是整篇文档一次性丢进去。要认真审阅一份改写,就得把每一句都与原文对照着读,而面对五千字一次性铺开时这并不现实——你会开始略读,而略读正是语义错误最终流入正式发布内容的途径。
保留原文。因为改写造成的损耗未必在第一遍阅读时就显现出来,你需要让源文本随时可供比对。
对数字、人名与引文格外留意。改写引擎优化的目标是「文本读起来如何」,而不是「事实是否存活」。任何必须精确无误的内容,都应当在改写之后逐字符复核一遍。
不要把一个有利的评分当成终点线。评分只是某一个模型的估计值。下文给出的证据会显示,面对完全相同的一段文字,不同检测器之间的分歧可以有多大。
对自己的目的保持诚实。如果目标是让行文读起来更好,那么这就是一款编辑工具,上述技巧全部适用。如果目标是隐藏来源,那么「限制与注意事项」一节会解释为什么这个目标如今远比该品类的营销所暗示的更难达成——以及为什么工具自身的条款正在否认这种用途。
内容营销人员与文案:批量产出,需要措辞变化,且处理的材料即使出现语义偏移也只是带来不便,而非造成危险。
博主与独立出版者:借助 AI 辅助起草,希望最终发布出来的东西听起来像个人写的。
以英语为附加语言的写作者:这一群体受检测器误报影响最深。扫描器在这里具有真实的诊断价值——尽管其背后的不公平源于检测机制本身,并不是一份改写订阅能够解决的问题。
研究者与专业人士:用于打磨内部文档,但有一条强保留意见——任何改写之后都必须复核技术准确性。
学生:这一群体需要的是最明确的警示,而不是推荐。厂商自己的条款禁止违反学术诚信,院校政策独立地禁止此类行为,而检测格局也已转向不利于隐藏来源的方向。扫描器在防御意义上或许仍然有用——用来检查你自己的原创作品是否存在被误标的风险。
StealthWriter 是一款在浏览器中使用的网页应用;没有关于桌面端或移动端应用的文档,也没有公开宣传的 API。账号管理在仪表盘中完成,根据更新日志,仪表盘现在已包含账单页面,可以查看套餐、下载发票并管理订阅,全程无需离开产品。客服通过 Intercom 实时聊天接入,另有联系页面处理账号、账单与产品方面的问题。
定价公布在首页而非独立的定价页——常规的定价页路径均返回错误。套餐按「每天改写次数」计量,而不是按「每月字数」,这在同类产品中并不常见;如果你的工作量呈突发式分布,这一点值得注意。
| 套餐 | 月付 | 年付 | 每日改写 | 每日扫描 | 单次输入字数 |
|---|---|---|---|---|---|
| 免费版 | 0 美元 | — | 10 次 | 10 次 | 1,000 词 |
| Starter | 20 美元 | 200 美元 | 50 次 | 50 次 | 5,000 词 |
| Plus | 50 美元 | 500 美元 | 150 次 | 150 次 | 5,000 词 |
| Pro | 100 美元 | 1,000 美元 | 350 次 | 350 次 | 5,000 词 |
| Scale | 400 美元 | 4,000 美元 | 2,000 次 | 2,000 次 | 5,000 词 |
免费档确实足以用来评估产品:每天十次改写,单次输入上限一千词,并且包含第二代检测器与深度扫描功能。请留意输入长度上限——免费档单次提交封顶一千词,付费档提升到五千词,因此无论买哪一档,长文档都必须分段处理。
订阅之前有两个计费细节值得注意,因为它们正是绝大多数用户投诉的来源。其一,支付由第三方服务商处理,官方声明不存储你完整的支付信息。其二,续费是自动的:你可以随时取消订阅,但如果没有在续订日之前取消,订阅就会自动续期并按下一个计费周期扣款。服务条款中提到了一份专门的退款政策文件,但该链接无法解析为可读页面,因此具体退款条款未能核实。请在首个续订日到来之前就在仪表盘里找到取消入口,而不是等扣款之后再找。
这个品类相当拥挤,而各家竞品的公开满意度数据差异极大。调查时点上,相邻产品在同一评价平台的评分包括:Phrasly.AI 为 4.7 分,样本约三千条;Undetectable AI 为 3.5 分,样本 961 条;WriteHuman 为 3.9 分,样本 291 条;walterwrites.ai 则为 2.0 分,样本 50 条。这个跨度之大,足以说明品类平均分对判断任何一款具体产品都没有参考价值。
关于在此处进行比价,有一条严肃的警告:这个细分领域的评测生态被污染得异常严重。搜索该领域任何一款工具的评测,返回的结果大多是竞品自建的页面,以及靠注册返佣获利的联盟站点。这类页面的结论几乎总是:被评测的产品尚可,但另一款产品——发布者自家的,或者返佣最高的那一款——更好。来自这类来源的排名与结论应当被完全折价看待。能力宣称优先参考厂商自己的文档,使用体验参考通用评价平台,而质量则以你自己在自己的文本上实测为准。
最重要的替代方案其实根本不是一款竞品。如果目标是让行文读起来好,那么普通的编辑——你自己动手,或者请一位人类编辑——依然是那个不承担检测风险、不需要订阅、也不会让作者身份变得含糊的选项。
这一节比通常更长,因为此处的证据确实是混杂的,而且在某些地方与该品类的自我营销直接矛盾。
目前可获得的最有价值的一份独立证据,是这样一次测试:同一段 AI 生成的文字,经该工具改写后,被提交给四个不同的检测器。结果彼此之间连大致一致都谈不上。
面对其中一个检测器,改写彻底失败:该检测器依然能判断出这段文字不是人写的。面对另一个,改写则轻松过关:改写后的版本以相当安全的余量通过了 Originality AI,取得了 88% 的人类置信度。另外两个检测器 Copyleaks 与 QuillBot,对改写后的文本均给出了 0% 的 AI 判定。
同一段文字,四个检测器,判定从「完全识破」一直铺到「完全未察觉」。仅这一个事实,就比任何营销话术都更能说清这个品类的实质:不存在「普遍意义上无法被检测」的文本,只存在某一个特定模型在某一天以某种方式打出的某个分数。因此,任何关于「百分之百人类评分」的承诺在原理上就是无法验证的,因为它预设了一个并不存在的统一标准。
关于那次测试,有一项重要的利益披露:它由 GPTZero 发布,而这家公司自己就在销售一款竞争性的检测器——恰恰是抓住了这次改写的那一个。这构成直接的利益冲突,而「我们的检测器有效、别家的无效」这个结论,正是这样一个发布方最有动机得出的结论。这份测试之所以仍然有用,是因为「分歧本身」才是那个发现,而这个发现并不需要你信任任何一方的准确率宣称。无论哪一个检测器是对的,它们不可能全都对。
「改写能可靠地掩盖机器来源」这一假设,如今已经大为削弱。2025 年 8 月,Turnitin 宣布其既有的 AI 写作检测能力现已包含针对检测规避的识别功能,专门用于帮助教育工作者发现那些可能被 AI 人性化改写工具刻意修改过的文本。
有两条限定必须与之并列。第一,Turnitin 出售的就是检测服务,它夸大自身能力的动机,与改写厂商夸大自身能力的动机完全对等;其准确率宣称同样未经审计。第二,行业媒体在报道这项功能上线时,记录了一条新闻稿并未强调的适用范围限制:该规避检测目前仅限于英语场景。这是该功能一条有文档记载的边界,而不是「其他语言就安全」的保证。
不过大方向是清楚的。改写工具与检测工具处在一个持续的对抗循环之中,任何关于「什么能规避什么」的具体断言都会过期——包括本页上的每一条断言。
有必要明确指出:这个领域里没有任何一个数字——无论出自改写厂商还是检测厂商——经过中立第三方的验证。检测方的准确性已经受到没有商业利益牵扯的机构的公开质疑。范德堡大学曾在可预见的将来停用 Turnitin 的 AI 检测功能,并公开了它的算式:以该校 2022 年提交的七万五千篇论文,按厂商自己声明的百分之一误报率计算,大约有七百五十篇学生论文可能被错误地标记为含有 AI 撰写的成分。
这个推论是双向的。检测器的可靠程度不足以被当作学术不端的证据——而依照同样的逻辑,一个检测器判定为「人类」,同样不能证明任何事情。指望从评分中获得确定性的用户,在这个市场的任何一侧都不会如愿。
最清晰的限制来自运营方自己:条款声明该产品不是作弊工具,不得用于学术不诚信或任何形式的学术不端行为,并且把遵守院校规定的责任完全归于用户一方。
这一条款与一个以「隐匿」为名的品牌之间存在未被化解的张力,读者完全有理由注意到这一点。但有一件事并不含糊:如果你把改写过的机器生成文本当作原创的学术作品提交,你既违反了所在院校的政策,也超出了你已同意的服务条款范围,而无论是厂商还是任何一个评分,都不会替你挡下随之而来的后果。
如前所述,引擎在句子层面改写,不增加也不删除句子。论证薄弱、组织混乱、结论缺乏支撑,这些问题会原封不动地穿过整个流程。
公开的满意度数据有限,但呈现出一个很有特点的形状。该产品在 Trustpilot 的档案显示平均分 3.1,样本 54 条,分布为五星 35%、四星 2%、三星 0%、二星 4%、一星 59%。
这个分布比平均分本身更有信息量。一个中间几乎为空、两端各占大头的评分,通常意味着体验是由某个二元事件决定的,而不是由质量的渐进差异决定的——评论正文也支持这种读法。负面评价集中在订阅与扣款问题上,其中一条有代表性的投诉称找不到退订或移除银行卡信息的入口,邮件与聊天都无人回应,并且套餐结束之后仍在继续扣款。正面评价则压倒性地称赞客服响应速度,而且频繁提到同一位客服人员的名字。
关于这份数据还有两条背景说明。样本量是 54 条——足以观察到某种模式,但不足以支撑有把握的推广结论。另外平台记录显示,该公司近期没有主动邀请客户评价,因此这些评价未必具有代表性。这一点排除了「主动邀评导致正面选择偏差」的可能,但引入了方向相反的偏斜:未经邀请的自发评价,会过度代表那些有动机前来投诉的人。因此,应当把这个分布读作「风险集中在哪里」的信号——集中在计费与取消环节——而不是读作一个精确的满意度度量。
其隐私承诺就字面而言是有利的:提交用于人性化改写或检测的内容,在处理完成之后不予留存。政策同时声明该服务不面向十三岁以下的用户,并宣称遵守通用数据保护条例与加州消费者隐私法案。但没有任何第三方审计、认证或鉴证支持上述任何一条,站点上也没有引用任何一份。这些是运营方给出的保证,就应当按保证来掂量——尤其是当你打算把尚未发表的、涉密的或属于客户的材料粘贴进去时。
有,而且不需要绑卡。免费档提供每天十次改写与十次扫描,单次提交上限一千词,并包含第二代检测器与深度扫描。扫描器还可以直接在首页使用,完全不需要账号。
不能,任何工具都不能。针对同一段文字在四个检测器上的独立测试给出了互相矛盾的判定——被 GPTZero 识破,却未被 Originality AI、Copyleaks 与 QuillBot 察觉。既然不同检测器对完全相同的文本都无法取得一致,那么所谓统一的「人类评分」在概念上就不成立。
厂商的回答是不可以。其条款声明该产品不是作弊工具,不得用于学术不诚信,并把合规责任归于你本人。另外,Turnitin 已经上线了专门针对被改写工具修改过的文本的检测能力。不过,用它来检查你自己的原创作品是否存在被误标的风险,则属于另一回事,并不引发同样的问题。
隐私政策声明,提交用于改写或检测的内容在处理完成后不予留存,也不会用于模型训练。这是厂商的单方声明,并未附带第三方审计,因此涉及敏感材料时请据此校准预期。
免费档零元,Starter 每月二十美元,Plus 每月五十美元,Pro 每月一百美元,Scale 每月四百美元;年付价格为月付的十倍。套餐按每天改写次数计量,分别为十次、五十次、一百五十次、三百五十次与两千次,而不是按每月字数计量。
订阅会自动续期,除非在续订日之前取消。支付通过第三方渠道处理,仪表盘内设有账单页面,可查看套餐、下载发票并管理订阅。取消困难是公开评价中最常见的抱怨,因此请及早找到取消入口,而不是等到续订时才去找。
更新日志说明 5.1 模型支持主要的世界语言,其中包括德语、西班牙语、葡萄牙语、法语、意大利语、荷兰语、中文与日语。这些语言的输出质量厂商没有提供文档,本次调查中也未获得独立验证。
Ghost 5.2 Mini 是默认的轻量模型,为快速改写而构建;Ghost 5.2 Pro 则针对连贯性与可读性做了调优。更早的 Ghost 5.1 与 Ghost 4.6 仍然保留在「旧版」选项之下可供选择。
不能。引擎逐句改写,不增加、不删除、也不调整顺序,因此组织结构上的问题会原封不动地穿过整个流程。结构性编辑必须由人手工完成。
StealthWriter 由在怀俄明州注册的 AiVantage LLC 运营,具名所有者为 Maher Mansour。关于页面公布了法定名称、邮箱、电话与通信地址——这种披露程度是该品类中许多产品都没有做到的。