用過這個工具嗎?為它評分
StealthWriter 是一款在瀏覽器裡使用的寫作工具,做兩件互相關聯的事:把文本改寫得更接近自然的人類行文,以及掃描文本、估算它被偵測器判定為機器生成的可能性有多高。這兩半是設計來搭配使用的——先掃描草稿,再改寫,然後重新掃描結果,看看究竟改變了什麼。
產品對自身核心動作的描述相當直白:把 AI 生成的內容重寫成讀起來自然、經過打磨、可以直接拿來使用的樣子。實際操作上,你把一段出自通用大型語言模型的草稿貼進去,選擇希望它被重寫的力度,然後拿回一份措辭、節奏與句構都不同的版本。
有必要先釐清這屬於哪一類產品,因為這個品類存在明顯的命名混亂。同類工具至少被冠上三種標籤——人性化改寫器、偵測規避器、同義改寫器——而選用哪個標籤,往往更多反映行銷者的意圖,而非軟體本身的行為。該產品自己的法律條款採用了三者中最保守的一個:其服務條款把它定義為一款由人工智慧驅動的同義改寫與內容重寫工具,用途是協助使用者高效產出獨特且高品質的內容。
這項服務由在美國懷俄明州註冊的 AiVantage LLC 營運,而且「關於我們」頁面具名公布了個人所有者,沒有躲在品牌後面。同一個頁面還公布了法定名稱、聯絡信箱、電話號碼,以及位於懷俄明州謝里登市的通訊地址。
這一點比表面上看起來更重要。在這個品類裡,相當高比例的產品採匿名營運:沒有具名的法人主體,沒有地址,一旦發生扣款糾紛或資料處理爭議,也找不到可究責的對象。這款產品三樣都公布了。這並不能證明它的產品宣稱屬實,但確實代表服務背後存在一個可究責的主體——而這道基礎門檻,數量驚人的同類競品並沒有跨過。
如果你以前接觸過這款產品,你記憶中的它可能是另一副樣貌。較早的導航站條目與第三方頁面至今仍主要把它描述成繞過各家偵測器的手段,並承諾拿到百分之百的人類評分。但現在的官網不再那樣說話。首頁、關於頁與常見問題如今一致使用「人性化」「清晰」「自然表達」這類措辭,而不是「規避」;服務條款走得更遠——它明確否認了舊行銷所暗示的那種用途。
讀者應當把舊的說法視為已經過時。本頁描述的是產品當前呈現的樣貌,並且會另行檢視這兩種版本的宣稱各自是否站得住腳。
重寫引擎一次處理一個句子,並把強度控制交給使用者:可以在輕度、中度與激進三檔之間選擇。較輕的檔位保留更多原有措辭,適合草稿整體還可以、只想讓個別段落更順的情況;激進檔位重構幅度較大,也離你原本寫下的內容更遠。
一份第三方實測指出了這套引擎的一項結構性特徵,在依賴它之前值得先知道:該工具只做句子層級的重寫,換句話說,它不增加也不刪除任何句子。這是一條實質的限制,帶來的後果是雙向的。因為句數與順序都被保留,輸出會與你的原始結構保持對齊,很容易逐句對照審閱。但也正因為引擎從不合併、拆分、調序或刪除任何內容,它無法修復位於句子層級之上的問題——一個繞圈子論證的段落、一個位置擺錯的章節、一個無法從既有論據推出的結論。而這些恰好是長篇 AI 草稿最常見的弱點,無論在句子層面改寫幾遍都補不回來。
產品沒有把你打發到別處驗證結果,而是內建自己的掃描器,並把它定位成環繞改寫動作的驗證環節。掃描器以單句為粒度呈現結論:逐句分析,用彩色標示準確指出哪些句子被判定為可疑。實際使用時,你會得到一個段落層級的檢視,能看清究竟是哪幾個具體句子在拉高分數,這比給整份文件一個籠統的百分比要有用得多。
偵測器也可以在不做任何承諾的前提下先試用。首頁嵌入了一個即時掃描器,並明確邀請訪客把任意文本貼進去,立刻查看它被判定為 AI 生成的可能性,不需要註冊帳號。如果你想判斷這款產品值不值得註冊,這是最快的測試途徑——你可以先拿它的判定結果與你原本就信任的偵測器做比對,再決定要不要註冊。
關於這個偵測器能告訴你什麼、不能告訴你什麼,有一項重要的保留意見,下文的「限制與注意事項」會詳細展開。簡單說:一個同時在向你銷售改寫服務的工具所給出的有利評分,不構成獨立證據;而且沒有任何偵測器的評分——包括這一個——能夠確定另一個偵測器會如何判定。
你不必被動接受模型給出的任何結果,而是可以逐句介入:點擊任一個句子,從多個候選表述中挑選,把輸出調整到貼合你自己的語感。這項功能最能區分「謹慎使用」與「草率使用」。機器改寫經常產出文法正確但略微失準的句子——重心發生偏移、慣用語與語域不搭、專業術語被換成了意思其實不同的近義詞。能夠逐句否決一個候選並另選一個,正是保住原意的關鍵。
重寫引擎有版本之分,而且舊版本仍然可選。根據產品更新日誌,模型選擇器現在納入 Ghost 5.2 這一代,同時把上一代的 Ghost 5.1 與 Ghost 4.6 保留在「舊版」選項底下。Ghost 5.2 Mini 被描述為預設的輕量選項,為快速改寫而打造;Ghost 5.2 Pro 則針對結構連貫性、行文流暢度與可讀性做了調校,在這幾方面優於 Mini。
保留舊世代可選是一個務實的決定,它承認了行銷話術不會提的一件事:不同版本之間的輸出特徵會變,新模型並不會自動地對每一種文本都更好。已經圍繞某一代模型的語感調好工作流程的使用者,可以繼續留在那一代。
非英語文本是原生處理的,不需要經過「翻譯—改寫—再翻譯」的繞路。更新日誌說明,5.1 版改寫引擎已支援主要的世界語言,其中包括德語、西班牙語、葡萄牙語、法語、義大利語、荷蘭語、中文與日語等。至於這些語言的輸出品質是否與英語相當,廠商並未提供文件,本次調查也沒有檢索到針對其非英語輸出的獨立測試,因此多語言支援應理解為「可用但未經量化」。
更新日誌中有一條功能值得明講而不是輕輕帶過:該產品現在可以移除 Claude 生成文本中的浮水印,改寫後的輸出不再帶有模型廠商植入的隱形 AI 浮水印。
這與上面列出的其他功能性質不同。其他功能關乎文本讀起來如何,而這一條關乎模型提供方自身的溯源訊號能否在處理後存活。模型廠商加入這類訊號,正是為了讓機器生成的文本保持可追溯,而這項功能的設計目的就是讓該機制失效。此處記錄它,是因為它是一項有文件記載的產品能力,使用者應當知道它存在。至於剝除溯源標記是否恰當,完全取決於你拿這段文本去做什麼,而這個判斷本頁無法代你作出。
最站得住腳的用法,也是最平淡無奇的那一種。如果你用語言模型突破了空白頁的困境,而結果讀起來就像出自語言模型——平均、扁平、處處保留、節奏單調——那麼一遍改寫可以讓它鬆動一些。搭配逐句候選功能,這是一種正當的編輯輔助:作者仍然是你,每一個決定仍然由你作出,工具只是在提供選項。
掃描器有一種獨立於改寫器的用途,而對不少人來說,這才是更有價值的那一半。AI 偵測器的誤判是有據可查的嚴重問題,行文平實、結構工整的人,或者以英語作為附加語言寫作的人,被誤標的比例明顯偏高。在提交之前把自己確實原創的作品跑一遍掃描器,能讓你知道自己是否可能面臨這類指控——就算最終一個字都不改,這也是有用的資訊。
大量產出常規文案的團隊——產品描述、分類頁、郵件變體——會用這類工具在大量高度相似的條目之間製造措辭差異。按每日次數計費的定價結構,正是圍繞這種使用模式設計的,公開方案中最大的一檔允許每天改寫兩千次。
學術繳交是必須給出明確答案的一種情況,而廠商自己就提供了答案。其服務條款聲明該產品不是作弊工具,不得用於學術不誠信或任何形式的學術不端行為。把機器生成的內容當成自己的作品繳交,違反的是幾乎所有院校的誠信規範,無論是否有偵測器發現;而工具的營運方本身就否認這種用途。這一點在「限制與注意事項」中還有進一步展開,因為周邊證據已經發生實質變化,使用者有權看到完整的圖景。
以較短的段落為單位處理,而不是整份文件一次丟進去。要認真審閱一份改寫,就得把每一句都與原文對照著讀,而面對五千字一次攤開時這並不現實——你會開始略讀,而略讀正是語意錯誤最終流入正式發布內容的途徑。
保留原文。因為改寫造成的耗損未必在第一遍閱讀時就顯現,你需要讓原始文本隨時可供比對。
對數字、人名與引文格外留意。改寫引擎最佳化的目標是「文本讀起來如何」,而不是「事實是否存活」。任何必須精確無誤的內容,都應該在改寫之後逐字元複核一遍。
不要把一個有利的評分當成終點線。評分只是某一個模型的估計值。下文給出的證據會顯示,面對完全相同的一段文字,不同偵測器之間的分歧可以有多大。
對自己的目的保持誠實。如果目標是讓行文讀起來更好,那麼這就是一款編輯工具,上述技巧全部適用。如果目標是隱藏來源,那麼「限制與注意事項」一節會解釋為什麼這個目標如今遠比該品類的行銷所暗示的更難達成——以及為什麼工具自身的條款正在否認這種用途。
內容行銷人員與文案:大量產出,需要措辭變化,且處理的素材即使出現語意偏移也只是造成不便,而非帶來危險。
部落客與獨立出版者:藉助 AI 輔助起草,希望最終發布出來的東西聽起來像個人寫的。
以英語為附加語言的寫作者:這個族群受偵測器誤判影響最深。掃描器在這裡具有真實的診斷價值——儘管背後的不公源自偵測機制本身,並不是一份改寫訂閱能夠解決的問題。
研究者與專業人士:用於打磨內部文件,但有一條強烈的保留意見——任何改寫之後都必須複核技術準確性。
學生:這個族群需要的是最明確的警示,而不是推薦。廠商自己的條款禁止違反學術誠信,院校規範獨立地禁止此類行為,而偵測格局也已轉向不利於隱藏來源的方向。掃描器在防禦意義上或許仍然有用——用來檢查你自己的原創作品是否有被誤標的風險。
這是一款在瀏覽器中使用的網頁應用;沒有關於桌面端或行動端應用的文件,也沒有公開宣傳的應用程式介面。帳號管理在儀表板中完成,根據更新日誌,儀表板現在已包含帳單頁面,可以查看方案、下載發票並管理訂閱,全程不需要離開產品。客服透過即時聊天接入,另有聯絡頁面處理帳號、帳單與產品方面的問題。
定價公布在首頁而非獨立的定價頁——常規的定價頁路徑都會回傳錯誤。方案按「每天改寫次數」計量,而不是按「每月字數」,這在同類產品中並不常見;如果你的工作量呈爆發式分布,這一點值得注意。
| 方案 | 月付 | 年付 | 每日改寫 | 每日掃描 | 單次輸入字數 |
|---|---|---|---|---|---|
| 免費版 | 0 美元 | — | 10 次 | 10 次 | 1,000 詞 |
| Starter | 20 美元 | 200 美元 | 50 次 | 50 次 | 5,000 詞 |
| Plus | 50 美元 | 500 美元 | 150 次 | 150 次 | 5,000 詞 |
| Pro | 100 美元 | 1,000 美元 | 350 次 | 350 次 | 5,000 詞 |
| Scale | 400 美元 | 4,000 美元 | 2,000 次 | 2,000 次 | 5,000 詞 |
免費檔確實足以用來評估產品:每天十次改寫,單次輸入上限一千詞,並且包含第二代偵測器與深度掃描功能。請留意輸入長度上限——免費檔單次提交封頂一千詞,付費檔提升到五千詞,因此無論買哪一檔,長文件都必須分段處理。
訂閱之前有兩個計費細節值得注意,因為它們正是絕大多數使用者投訴的來源。其一,付款由第三方服務商處理,官方聲明不會儲存你完整的付款資訊。其二,續費是自動的:你可以隨時取消訂閱,但如果沒有在續訂日之前取消,訂閱就會自動續期並按下一個計費週期扣款。服務條款中提到了一份專門的退款政策文件,但該連結無法解析為可讀頁面,因此具體的退款條款未能核實。請在首個續訂日到來之前就在儀表板裡找到取消入口,而不是等扣款之後再找。
這個品類相當擁擠,而各家競品的公開滿意度資料差異極大。調查時點上,相鄰產品在同一評價平台的評分包括:Phrasly.AI 為 4.7 分,樣本約三千則;Undetectable AI 為 3.5 分,樣本 961 則;WriteHuman 為 3.9 分,樣本 291 則;walterwrites.ai 則為 2.0 分,樣本 50 則。這個跨度之大,足以說明品類平均分對判斷任何一款具體產品都沒有參考價值。
關於在此處比價,有一條嚴肅的警告:這個細分領域的評測生態被污染得異常嚴重。搜尋該領域任何一款工具的評測,回傳的結果大多是競品自建的頁面,以及靠註冊分潤獲利的聯盟網站。這類頁面的結論幾乎總是:被評測的產品尚可,但另一款產品——發布者自家的,或者分潤最高的那一款——更好。來自這類來源的排名與結論應當完全折價看待。能力宣稱優先參考廠商自己的文件,使用體驗參考通用評價平台,而品質則以你自己在自己的文本上實測為準。
最重要的替代方案其實根本不是一款競品。如果目標是讓行文讀起來好,那麼一般的編輯——你自己動手,或者請一位人類編輯——依然是那個不承擔偵測風險、不需要訂閱、也不會讓作者身分變得含糊的選項。
這一節比一般更長,因為此處的證據確實是混雜的,而且在某些地方與該品類的自我行銷直接矛盾。
目前可取得的最有價值的一份獨立證據,是這樣一次測試:同一段 AI 生成的文字,經該工具改寫後,被提交給四個不同的偵測器。結果彼此之間連大致一致都談不上。
面對其中一個偵測器,改寫徹底失敗:該偵測器依然能判斷出這段文字不是人寫的。面對另一個,改寫則輕鬆過關:改寫後的版本以相當安全的餘裕通過了 Originality AI,取得 88% 的人類信心值。另外兩個偵測器 Copyleaks 與 QuillBot,對改寫後的文本都給出了 0% 的 AI 判定。
同一段文字,四個偵測器,判定從「完全識破」一路鋪到「完全未察覺」。光是這一個事實,就比任何行銷話術都更能說清這個品類的實質:不存在「普遍意義上無法被偵測」的文本,只存在某一個特定模型在某一天以某種方式打出的某個分數。因此,任何關於「百分之百人類評分」的承諾在原理上就無法驗證,因為它預設了一個並不存在的統一標準。
關於那次測試,有一項重要的利益揭露:它由 GPTZero 發布,而這家公司自己就在銷售一款競爭性的偵測器——恰好就是抓住了這次改寫的那一個。這構成直接的利益衝突,而「我們的偵測器有效、別家的無效」這個結論,正是這樣一個發布方最有動機得出的結論。這份測試之所以仍然有用,是因為「分歧本身」才是那個發現,而這個發現並不需要你信任任何一方的準確率宣稱。無論哪一個偵測器是對的,它們不可能全都對。
「改寫能可靠地掩蓋機器來源」這個假設,如今已經大幅削弱。2025 年 8 月,Turnitin 宣布其既有的 AI 寫作偵測能力現已包含針對偵測規避的辨識功能,專門用於協助教育工作者發現那些可能被 AI 人性化改寫工具刻意修改過的文本。
有兩條限定必須與之並列。第一,Turnitin 販售的就是偵測服務,它誇大自身能力的動機,與改寫廠商誇大自身能力的動機完全對等;其準確率宣稱同樣未經稽核。第二,產業媒體在報導這項功能上線時,記錄了一條新聞稿並未強調的適用範圍限制:該規避偵測目前僅限於英語情境。這是該功能一條有文件記載的邊界,而不是「其他語言就安全」的保證。
不過大方向是清楚的。改寫工具與偵測工具處在一個持續的對抗循環中,任何關於「什麼能規避什麼」的具體斷言都會過期——包括本頁上的每一條斷言。
有必要明確指出:這個領域裡沒有任何一個數字——無論出自改寫廠商還是偵測廠商——經過中立第三方的驗證。偵測方的準確性已經受到沒有商業利益牽扯的機構公開質疑。范德堡大學曾在可預見的將來停用 Turnitin 的 AI 偵測功能,並公開了它的算式:以該校 2022 年繳交的七萬五千篇論文,按廠商自己聲明的百分之一誤判率計算,大約有七百五十篇學生論文可能被錯誤地標記為含有 AI 撰寫的成分。
這個推論是雙向的。偵測器的可靠程度不足以被當作學術不端的證據——而依照同樣的邏輯,一個偵測器判定為「人類」,同樣不能證明任何事情。指望從評分中獲得確定性的使用者,在這個市場的任何一側都不會如願。
最清晰的限制來自營運方自己:條款聲明該產品不是作弊工具,不得用於學術不誠信或任何形式的學術不端行為,並且把遵守院校規範的責任完全歸於使用者一方。
這一條款與一個以「隱匿」為名的品牌之間存在未被化解的張力,讀者完全有理由注意到這一點。但有一件事並不含糊:如果你把改寫過的機器生成文本當成原創的學術作品繳交,你既違反了所屬院校的規範,也超出了你已同意的服務條款範圍,而無論是廠商還是任何一個評分,都不會替你擋下隨之而來的後果。
如前所述,引擎在句子層面改寫,不增加也不刪除句子。論證薄弱、組織混亂、結論缺乏支撐,這些問題會原封不動地穿過整個流程。
公開的滿意度資料有限,但呈現出一個很有特色的形狀。該產品在 Trustpilot 的檔案顯示平均分 3.1,樣本 54 則,分布為五星 35%、四星 2%、三星 0%、二星 4%、一星 59%。
這個分布比平均分本身更有資訊量。一個中間幾乎為空、兩端各占大宗的評分,通常意味著體驗是由某個二元事件決定的,而不是由品質的漸進差異決定的——評論正文也支持這種讀法。負面評價集中在訂閱與扣款問題上,其中一則有代表性的投訴稱找不到退訂或移除信用卡資訊的入口,郵件與聊天都無人回應,並且方案結束之後仍在繼續扣款。正面評價則壓倒性地稱讚客服回應速度,而且頻繁提到同一位客服人員的名字。
關於這份資料還有兩條背景說明。樣本量是 54 則——足以觀察到某種模式,但不足以支撐有把握的推廣結論。另外平台記錄顯示,該公司近期沒有主動邀請客戶評價,因此這些評價未必具有代表性。這一點排除了「主動邀評導致正面選擇偏差」的可能,但引入了方向相反的偏斜:未經邀請的自發評價,會過度代表那些有動機前來投訴的人。因此,應當把這個分布讀作「風險集中在哪裡」的訊號——集中在計費與取消環節——而不是讀作一個精確的滿意度量度。
其隱私承諾就字面而言是有利的:提交用於人性化改寫或偵測的內容,在處理完成之後不予保留。政策同時聲明該服務不面向十三歲以下的使用者,並宣稱遵守通用資料保護規則與加州消費者隱私法案。但沒有任何第三方稽核、認證或鑑證支持上述任何一條,網站上也沒有引用任何一份。這些是營運方給出的保證,就應當按保證來掂量——尤其當你打算把尚未發表的、涉密的或屬於客戶的素材貼進去時。
有,而且不需要綁卡。免費檔提供每天十次改寫與十次掃描,單次提交上限一千詞,並包含第二代偵測器與深度掃描。掃描器還可以直接在首頁使用,完全不需要帳號。
不能,任何工具都不能。針對同一段文字在四個偵測器上的獨立測試給出了互相矛盾的判定——被 GPTZero 識破,卻未被 Originality AI、Copyleaks 與 QuillBot 察覺。既然不同偵測器對完全相同的文本都無法取得一致,那麼所謂統一的「人類評分」在概念上就不成立。
廠商的回答是不可以。其條款聲明該產品不是作弊工具,不得用於學術不誠信,並把合規責任歸於你本人。此外,Turnitin 已經上線了專門針對被改寫工具修改過的文本的偵測能力。不過,用它來檢查你自己的原創作品是否有被誤標的風險,則屬於另一回事,並不引發同樣的問題。
隱私政策聲明,提交用於改寫或偵測的內容在處理完成後不予保留,也不會用於模型訓練。這是廠商的單方聲明,並未附帶第三方稽核,因此涉及敏感素材時請據此校準預期。
免費檔零元,Starter 每月二十美元,Plus 每月五十美元,Pro 每月一百美元,Scale 每月四百美元;年付價格為月付的十倍。方案按每天改寫次數計量,分別為十次、五十次、一百五十次、三百五十次與兩千次,而不是按每月字數計量。
訂閱會自動續期,除非在續訂日之前取消。付款透過第三方管道處理,儀表板內設有帳單頁面,可查看方案、下載發票並管理訂閱。取消困難是公開評價中最常見的抱怨,因此請及早找到取消入口,而不是等到續訂時才去找。
更新日誌說明 5.1 模型支援主要的世界語言,其中包括德語、西班牙語、葡萄牙語、法語、義大利語、荷蘭語、中文與日語。這些語言的輸出品質廠商沒有提供文件,本次調查中也未取得獨立驗證。
Ghost 5.2 Mini 是預設的輕量模型,為快速改寫而打造;Ghost 5.2 Pro 則針對連貫性與可讀性做了調校。更早的 Ghost 5.1 與 Ghost 4.6 仍然保留在「舊版」選項底下可供選擇。
不能。引擎逐句改寫,不增加、不刪除、也不調整順序,因此組織結構上的問題會原封不動地穿過整個流程。結構性編輯必須由人手工完成。
它由在懷俄明州註冊的 AiVantage LLC 營運,具名所有者為 Maher Mansour。關於頁面公布了法定名稱、信箱、電話與通訊地址——這種揭露程度是該品類中許多產品都沒有做到的。