ScreenApp 是一套 AI 录屏工具与内容分析平台。它对屏幕录像、会议录音和语音备忘的处理逻辑与传统录屏工具相反:录制文件不是最终成果,而是一条文本流水线的原料。你录制或上传之后,平台会返回文字稿、按章节切分的摘要、说话人标注、抽取出来的行动项,以及一份可以随后提问检索的索引。官网首页把这个目标浓缩成一句话,中文意思是「通往你录制内容的窗口」,紧接着补了一句更直白的:别再重看,开始真正理解。产品的运营主体是在澳大利亚新南威尔士州悉尼注册的 ScreenApp Pty Ltd 公司,站点界面目前提供十四种语言。
支撑这个定位的转型过程,在厂商自己的营销材料之外也有记载。推理服务商 Groq 发布的客户案例写明,这家公司最初只是一个简单的屏幕录制工具,创始团队后来发现用户要的不是「录下来」,而是「用得上录下来的东西」,于是产品方向随之调整。澳大利亚科技媒体 Startup Daily 刊登的 Antler 投资备忘录则记录了另一组信息:公司成立于 2022 年,创始人为安德烈·史密斯与布迪卡·贾亚瓦尔达纳,在种子前轮阶段月活跃用户已超过一万七千五百人,单月处理视频超过十三万条。
在拥挤的 AI 会议记录赛道里,这款产品的差异更多来自覆盖面而非某一项独门功能:十八个功能入口共用同一套「采集加转写」内核,从会议录制、笔记生成,一直延伸到片段剪辑、文件压缩、字幕生成和语音合成。这种铺得很开的做法究竟是优势还是分散,取决于你的具体需求。本文的目标是给出足够多经过核实的细节,让你自己判断。
录制并不局限于单一场景。ScreenApp 提供网页应用、Chrome 浏览器扩展、macOS 与 Windows 桌面客户端,以及 iOS 和安卓移动应用。桌面版之所以重要,是因为系统内录音频、较大文件上传和后台持续录制这几件事,浏览器标签页很难稳定完成。除现场录制外,你也可以上传已有文件或通过链接导入,但这两条路径都需要付费方案才能使用。
官网 accuracy 页是整个站点技术透明度最高的一页,它说明这套语音转文字体系「不押注单一供应商」。系统会根据素材来源、时长、声道结构和语种,把任务分发给三家主力服务商:跑在 Groq 推理基础设施上的 Whisper Large-v3 负责语言广度,也是长音频的最快路径;Google 的 Gemini 3.1 Flash Lite 专攻五分钟以内的短音频;xAI 的 Grok 语音识别则针对电话录音和多声道素材。它们背后还有若干备用通道,用于在某家供应商限流或宕机时接管,避免单点故障导致任务失败。
同一页对转写之上的那一层同样直白:摘要、对话和内容分析端到端由 Google Gemini 承担,页面明确写出该产品并非由 GPT-4、ChatGPT 或 Claude 驱动。对于在意「究竟是哪个模型在读我的会议」的用户来说,这种披露程度相当少见,也相当有用。
平台宣称转写支持九十九种语言,但其中只有二十五种能获得词级别的说话人分离能力。其余语言只有纯文字稿,没有逐句到人的归属标注。如果你的工作恰好依赖「谁说了哪句话」,比如庭审笔录、圆桌讨论或多方访谈,可选语言范围会大幅收窄,建议在投入使用前先确认自己的工作语言是否在那二十五种之内。
平台没有用一个笼统的准确率数字打发用户,而是按三种录音条件公布了分语言矩阵。英语在录音棚条件下词错误率为百分之四点二,会议室条件为百分之七点八,手持手机麦克风的户外条件则升至百分之十二点四。日语、韩语和简体中文在户外条件下分别为百分之十九点八、百分之十九点二和百分之二十点四。测试方法也一并公开:每种语言取十八小时公共领域音频,使用 jiwer 库对齐评分,每季度重测一次,标点与大小写不计入错误。数字给到这个精度是可以被检验的,这正是公开它们的意义。
在原始文本之外,流水线会把一段录制切成若干带有独立摘要的章节,识别说话人,抽取行动项与决策,并按可复用的模板整理输出。Groq 案例中对产出形态的描述与此完全一致:会议纪要、访谈文字稿、成型报告。这也是它与「丢给你一整面墙文字」的普通转写服务之间最实际的区别。
分析器处理的素材不限于语音内容。它可以逐帧检查视频,识别场景、物体和关键时刻;在音频中定位音质问题并区分说话人;对图像执行物体检测和文字识别;从 PDF 与文档中抽取表格和要点。定价页上单列的「视频分析」配额对应的正是这块能力,它与普通转写分开计量。
素材完成索引之后就可以被追问。单文件内的对话功能针对一份录制展开,而跨文件的提问功能会检索你的整个素材库,后者在免费档不可用。检索本身则被列为始终免费且不限量,语音听写、文档润色和分享也同属这一类。
有一处实现细节值得单独说明,因为它直接改变了准确率数字的适用范围。当一段视频本身已经带有字幕轨时,平台会直接读取那条字幕,而不对音频做语音识别,整个识别环节根本不会运行。这条路径确实快,中位耗时从四十一点一秒降到十四点七秒,但拿到的文本出自视频平台而非本产品,因此页面上公布的任何词错误率都不适用于它。厂商自己说明了这一点,同时还主动标注对照窗口样本仅六十一条,真实提速倍数落在一点九倍到三点七倍之间。
笔记功能页把整套卖点建立在一个「没有」之上:不会有机器人加入你的通话。录制发生在你自己的设备上,与会者看不到任何第三方参会者跳出来宣告自己在录音。官网直接点名 Otter、Fireflies 和 Fathom 三款工具会以可见身份加入会议,并把顾问、心理咨询师、律师和销售团队列为目标用户,因为这些人的谈话场合确实不适合出现可见的录音机器人。这是架构层面的真实差异,而非表面包装,但它同时把告知义务完全推给了你,这一点在限制章节还会详谈。
内部会议的价值账更简单:现在总有一个人在记录,而这个人并没有真正参与讨论。自动章节配合每章摘要和抽取出的待办清单,可以取代会后整理这道工序,这也是 AI 会议笔记在这款产品里的实际形态。Growth 及以上档位还额外包含会议机器人,用于按日程加入通话,它与设备端录制是并列关系而非替代关系。
学生录下的讲座会变成一份可检索的学期档案,而不是一堆从未再打开的音频。在这个场景里章节比文字稿更关键:一段两小时的讲座配上章节标记是可以导航的,而两小时的纯文字稿并不可读。移动端应用是线下教室里唯一实际可用的采集手段。
做会议转录的记者和质性研究者,对归属准确度的需求高于对速度的需求。此时二十五种语言的说话人分离清单就变得关键,户外条件的词错误率同样关键:嘈杂房间里的一部手机对应的是百分之十二点四那一档,而不是录音棚的百分之四点二。据此预留复核时间是稳妥做法。
录下的通话会沉淀成一个可查询的语料库。分析器的说话人识别配合跨文件提问,让管理者可以对多通电话一次性发问,而不必逐条重听。厂商也明确说明,针对电话与多声道音频,系统会走专门优化过的识别通道。
对于需要处理大量视频素材的人,无论是竞品调研、课程回顾还是内容二次加工,链接导入配合摘要生成把它变成一个视频摘要工具,能把数小时素材转成可读笔记。只要记住走的是哪条路径:有字幕的走字幕直读,没字幕的才走完整转写。
把一套操作流程录下来,经过转写和章节切分,就成了文档初稿。对于最终仍要以视频形态分发的素材,片段剪辑和字幕生成可以把这项工作收尾。
如果只是录一个浏览器标签页或做一次快速屏幕采集,网页应用就够用;如果你习惯从浏览器录制,装 Chrome 扩展更顺手;如果需要系统内录音频、后台录制或上传大文件,就该安装 macOS 或 Windows 桌面版。面对面的线下对话,移动端应用是唯一合理的选择。
现场录制在所有档位都覆盖屏幕、摄像头和线下音频。上传本地文件和通过链接导入这两项都需要付费方案,免费档对这两个选项标注为不可用。如果你的用途是给已有视频做摘要而不是产出新录制,这条限制的影响相当直接。
转写路由是自动的,用户不需要也无法指定供应商。厂商称一场六十分钟的会议端到端约需三分钟完成,其中已包含摘要与章节生成。这个数字来自厂商且未经独立审计,不过底层的速度变化在 Groq 案例中有第三方佐证:原先需要二十分钟的一次转写,现在约十五秒完成。
这款工具期望的工作流与直觉相反。先打开章节摘要和行动清单,只在某个章节让你觉得需要核对时,再跳进对应的文字稿段落。从头通读全文等于放弃了使用这类工具的意义。
单个文件用文件内对话功能即可。付费用户还可以用跨文件提问检索整个素材库,这在「记得有人说过但想不起是哪场会」时特别有用。
视频与音频下载、导出为 PDF 以及通用导出,全部属于付费能力。这一点需要提前规划:在免费档产出的内容留在产品内部,是拿不出来的。
这款产品定价上最常被误读的地方就是时间单位。Growth 档的六百次 AI 额度和六百次转写是按年计算,不是按月,而视频分析每年只有三十六次。在断定某个档位「够用」之前,先把单位看清楚。
让麦克风匹配你需要的准确度。 英语从百分之四点二到百分之十二点四的差距,完全来自录音条件而非模型差异。安静房间里的领夹麦产出的文本,明显干净于咖啡馆里的手持手机,任何模型选择都无法弥补这个差距。
在依赖说话人标注之前,先核对你的语言。 转写覆盖九十九种语言,词级说话人归属只覆盖二十五种。录完一场四人圆桌之后才发现这个区别,代价相当高。
搞清楚视频导入走的是哪条路径。 如果原视频带字幕,你拿到的是视频平台的文本,其质量完全不在本产品掌控之内,也与它公布的基准无关。凡是要引用的内容,请对照音频核实。
把免费档当作评估手段而非工作流。 总共三个录制文件、每月三次 AI 生成、每月一次转写,且不能上传、不能链接导入、不能导出——这套配置足以判断产出质量,也仅止于此。
一旦开始试用,请自己设好提醒。 七天的 Growth 试用会转为年度扣费。这是该产品在独立评价平台上被投诉最集中的一点,而只要在第一天就设个提醒,这个坑完全可以绕开。
内容敏感时优先本地录制。 帮助中心记载了关闭云同步、仅保存在本地的选项。对于绝不该离开设备的素材,这个开关是存在的,值得在第一次敏感录制之前就找到它,而不是事后补救。
告知对方你正在录音。 因为没有任何机器人会宣告自己的存在,告知义务完全落在你身上。在许多司法辖区,取得同意是法定要求而非礼节问题——让这款产品显得好用的隐形特性,恰恰正是这份责任的来源。
把章节当作导航层来用。 任何超过三十分钟的录制,你日常真正会反复用到的就是那份章节列表。先扫章节,只在标题让你产生疑问时才展开对应文字稿。
受保密要求约束的客户对接岗位,包括顾问、律师、心理咨询师和销售团队,是笔记功能页明确面向的人群,无机器人架构对他们的顾虑是一个实打实的回应。
学生与授课教师能以较低成本获得可检索的学习档案,不过免费档每月仅一次转写,真要养成贯穿整个学期的习惯就必须付费。
需要会议纪要但没有专职记录员的小团队适合 Growth 档,前提是用量能装进每年六百次转写之内,折算下来大约每个工作日两次。
研究者与记者能从公开的分语言错误率中获益,据此诚实估算复核工作量,而不是依赖一个笼统的准确率宣传数字。
有单点登录、接口调用与合规要求的企业采购方对应 Enterprise 档,起价每月一百九十九美元,也是唯一提供 SAML 单点登录、定制集成与专属支持的档位。
不建议选择的情形: 需要明确退款保障的用户,因为条款写明费用不予退还;主要需求是大量视频分析的用户,因为即便 Business 档该项仍限每年一百二十次;以及工作语言不在二十五种说话人分离清单内、却又依赖说话人归属的用户。
产品以网页为基础,另外提供六个客户端。以下数据均于二〇二六年八月二十四日一手核实,商店数据每日变动。
iOS 端:应用名为 ScreenApp: AI Voice Recorder,发行方为 ScreenApp Pty Ltd,评分四点零分,评分数一百一十一条。当前版本一点四点四七,发布于二〇二六年八月十七日,首次上架于二〇二五年三月十八日,要求系统 iOS 15.0 及以上,分级 4+,免费下载。
安卓端:商店页显示评分三点八八分,评分数七百六十一条,下载量超过十万次,分类为效率工具,内容分级为「所有人」。这是本次核实的四个渠道中样本量最大的一个。
Chrome 扩展:评分四点一分,评分数七十一条,用户数约两万,带有精选标记,平台注明该发布者没有违规记录。需要注意的是,官网某个功能页内嵌的扩展展示卡标注为四点七分、两千一百条评分,与商店实际数据不符,应以商店页为准。
macOS 端:通过官网直接下载安装包,未在 Mac App Store 上架。构建为同时支持 Apple 芯片与 Intel 的通用二进制,采用滚动发布且安装包文件名固定,因此没有可供对照的版本号。
Windows 端:提供原生桌面应用,从官网下载。
界面语言:站点提供十四种语言的本地化页面,包括西班牙语、法语、德语、意大利语、葡萄牙语、日语、韩语、俄语、印尼语、中文、土耳其语、荷兰语和越南语。这与转写支持的九十九种语言是两回事,范围要窄得多。
官网列出四个档位。以下数据读取自二〇二六年八月二十四日的官方定价页,定价页会变动,购买前请以实时页面为准。
免费档,每月零美元。 总共三个录制文件(不是每月三个),每月三次 AI 生成,每月一次转写,包含完整文字稿,无视频分析,不能上传文件,不能链接导入,不能下载导出。足够用来评估产出质量。
Growth 档,年付合每月十九美元。 录制不限量,每年六百次 AI 额度与六百次转写,每年三十六次视频分析,包含会议机器人,开放下载与导出。配七天免费试用,页面下方写得很明确:七天免费,其后每年二百二十八美元。
Business 档,年付合每月三十四美元。 录制、AI 额度与转写均不限量,开放接口调用、白标定制、自定义词表和批量上传。但视频分析仍然封顶在每年一百二十次,与该档其他地方的「不限量」表述并不一致。
Enterprise 档,起价每月一百九十九美元,按团队规模定价。各项均不限量,含 SAML 单点登录、定制集成与专属支持,单点登录在其他任何档位都不提供。
有两处需要仔细读。 其一,页面顶部写着「无需信用卡,随时取消」,而同一页面的常见问题却说明七天试用确实需要提供信用卡且到期自动转为收费。两句话同在一页:前者描述的是免费档,后者描述的是试用。其二,服务条款写明服务费用一律不予退款,这才是意外扣费发生时真正适用的规则。
Otter.ai、Fireflies.ai 与 Fathom 是官网自己点名的三个竞品,差异轴只有一条:这三款会以可见参与者身份加入通话,而本产品从你的设备录制。如果可见的机器人是可接受的,甚至可以充当一种隐含的录音提示,那么这三款都是成熟的替代选项,日程集成也更深。
Loom 在官方常见问题里被直接对比,官方的说法是对方每月十八美元、免费版限时五分钟且 AI 功能另行收费,而自家年付档位每月十九美元且已含 AI 能力。就异步视频沟通的成品质感而言,Loom 依然更强;本产品的目标是从录制中提取文本,而不是把视频做成演示作品。
专业转写服务,包括直接基于开源模型自建的方案,以及本产品自己在基准对比中点名的几家语音识别厂商,更适合那些只要原始转写、需要接口控制、不想要外围产品的用户。
通用型对话助手被分析器页面明确排除在外,该页论证的核心是:纯文本聊天界面根本无法处理、观看或收听音视频文件。这句话公允地说明了媒体处理类工具为何必须作为一个独立品类存在。
系统自带的录制工具,比如 macOS 的屏幕录制、Windows 的录制功能和手机自带的语音备忘录,在你只需要文件本身、不需要由它衍生出的文本时,依然免费且够用。
独立评价平台的画面很差,而且投诉模式高度集中。 在 Trustpilot 上,该公司评分为一点三分,共五十二条评价,其中百分之九十四为一星。企业档案已于二〇二二年八月被官方认领,但平台同时标注该公司近期没有邀请客户评价的记录,也未回复负面评价。高频提及词紧密聚集在取消、订阅、退款、付款和客服沟通这几项。具名评价具体描述七天试用在没有明确提醒的情况下转为二百二十八美元年费,申请退款时被援引取消政策拒绝。这套说法与厂商自己公布的条款相互吻合——条款写明费用不予退还,定价页也自己写明了试用转费的金额,所以它读起来更像是政策的正常执行,而不是孤立的操作失误。要么设好提醒,要么干脆别开试用。
商店评分与 Trustpilot 严重背离,而两个样本都是真实的。 iOS 端四点零分、一百一十一条评分,安卓端三点八八分、七百六十一条评分,属于中等偏上而非糟糕。这两组数字无法也不应该被调和成一个数:应用商店的样本来自普通用户对产品体验的打分,而 Trustpilot 在这里的样本是围绕计费争议自发聚集起来的。它们回答的是不同的问题,应当分开读。Capterra 上的五点零分只来自四条评价,样本量太小,不足以支撑任何质量结论。
配额的时间单位极易误读。 Growth 档的六百次 AI 额度和六百次转写是年度数字,却与一个月度价格并排展示。Business 档号称不限量,视频分析却仍封顶在每年一百二十次。
多处官方陈述互相矛盾。 帮助中心的安全说明文章称公司成立于二〇二〇年;站点结构化数据写的是二〇二三年;Startup Daily 刊登的 Antler 投资备忘录写的是二〇二二年。同一家公司的自有材料加上一份投资文件,给出了三个不同的成立年份。同一篇安全文章还声称「全部数据存储在自有服务器而非第三方平台」,这与安全页承认基础设施运行在亚马逊云上、隐私政策明确列出五家第三方供应商的事实直接冲突。服务条款里描述的套餐名称至今仍是旧的三档命名,其限制条件也与现行四档定价页对不上。这些单看都不致命,合起来则说明文档更新明显落后于产品迭代。
自报用户数彼此对不上。 首页写着八百一十万人,同一页另一处写作八百一十五万九千三百零一以上,而评价页写的是三百万以上活跃用户。两组数字都由厂商自报且未经审计。评价页同时给出四点九分平均分、七十二的净推荐值和百分之九十四的满意度,这些数据均无法独立验证,且与 Trustpilot 的评分分布形成明显张力。
部分公开的准确率数字是推算值。 词错误率表格中 iPhone 麦克风那一列,按厂商自己的说法是「推算而非实测」,由户外条件数值乘以一点二得出。厂商主动说明这一点值得肯定,但把它当作实测数据使用就不合适了。
一条被引用的来源已经消失。 accuracy 页把速度数据的出处指向一份 Groq 客户案例,但该链接现在会跳转到 Groq 的博客列表页,原文已不在原地址发布,内容只能通过网页存档找回。那些数字本身——速度提升二十倍、成本降低十五倍、转化提升百分之三十、流失减半、年度经常性收入增长百分之四百零五——是供应商营销材料中引用的厂商说法,从未经过独立审计,应当据此看待。
没有主流独立媒体的深度报道。 检索主要科技媒体后,未发现针对该产品的独立评测或采编报道。目前可用的第三方证据是一份供应商案例、一份以合作内容形式刊登在澳洲创业媒体上的投资备忘录,以及应用商店数据。这比一个成熟品类领导者应有的证据要薄,此处如实说明,而不用联盟营销博客充数。
录制行为附带的义务,产品有意不替你承担。 因为没有机器人宣告存在,整个流程中不会有任何环节通知其他参与者。是否需要取得同意因司法辖区而异,且往往是强制要求。产品给你的是隐形能力,随之而来的法律风险由你自己承担。
不会。隐私政策明确写明,平台不会使用你的录制内容或素材训练 AI 模型,并声明其第三方 AI 供应商仅为交付所请求的服务而处理数据,无权将其用于模型训练。政策还说明所用模型在部署前均已完成预训练,上传的数据仅用于提供服务。对于一款录制类产品而言,这是异常清晰的一条表述,也是那份文档中最重要的一句话。
隐私政策逐条列出五家,并说明各自接收的数据类型:谷歌接收转写文本与音频,用于摘要、章节生成、标题、说话人分离与翻译;Groq 接收转写文本与音频,用于对话问答与转写;Mistral 接收转写文本,用于对话问答;Fireworks AI 与 Cloudflare 接收音频,作为转写的备用通道。把分包供应商列到这个颗粒度的做法相当少见,值得肯定。
全部个人数据存储在美国境内,考虑到这是一家澳大利亚公司,这一点值得留意。数据仅在政策所述目的所需或法律要求的期限内保留。如果你通过设置申请注销账号,全部个人数据将在三十天内永久删除,法律要求保留的部分除外。你也可以向客服索取被保留数据的明细。
总共三个录制文件,每月三次 AI 生成,每月一次转写,包含完整文字稿。视频分析、文件上传、链接导入、下载与导出全部不可用。它足以让你拿自己的素材测试产出质量,但不足以支撑一条持续的工作流。
试用绑定的是 Growth 年付方案。按定价页的常见问题所述,试用需要提供信用卡,七天结束后自动转为每年二百二十八美元。退款方面条款毫不含糊:服务费用一律不予退还。这两条叠加正是大多数负面独立评价的来源。如果你决定开始试用,请在第六天设好提醒。
安全页声明公司已取得 SOC 2 Type II 认证,并由第三方审计机构独立验证,页面链接到一个托管在外部平台上的信任中心。该信任中心页面确认了合规状态,并列出一个合规框架与三十五项控制项,但既未公布审计所覆盖的时间窗口,也未公布审计机构名称。也就是说,认证声明得到了第三方信任平台的印证,而报告本身的细节并未公开。企业采购方应直接索取审计报告。
走设备录制这条路径不会,这也是该产品的核心差异点:录制发生在你自己的机器上,其他与会者看不到多出来的参会方。此外还有一个可选的会议机器人,从 Growth 档起包含,用于按日程加入通话。正因为默认路径是静默的,告知与会者你正在录音完全是你的责任,而且在许多司法辖区这是法律要求。
答案几乎完全取决于录音条件。公布的英语数据是:录音棚条件百分之四点二,会议室条件百分之七点八,手持手机的户外条件百分之十二点四。日语、韩语和简体中文在户外条件下接近百分之二十。测试使用每种语言十八小时的公共领域音频,以 jiwer 库评分,每季度重测。需要注意 iPhone 麦克风那一列是估算值而非实测值。
转写通过 Whisper Large-v3 覆盖九十九种语言。词级说话人分离只覆盖其中二十五种,通过 xAI 的语音识别实现。其余语言只产出文本,没有逐人归属。另外,网站界面本身本地化为十四种语言,这是一份完全不同且小得多的清单。
只能算部分属实。Business 档在录制、AI 额度和转写上确实不限量,但视频分析仍封顶在每年一百二十次。Growth 档在 AI 侧则根本谈不上不限量:六百次额度和六百次转写都是年度配额,却与月度价格并排展示,另有每年三十六次视频分析。请读时间单位,而不是读那个形容词。