Harpa AI 评测:总结视频搞定邮件,按兆 token 计费
浏览器 AI 插件写过几款之后,能明显看出两条路线:一类把重点放在「问得快」,另一类开始往「替你动手」走。Harpa AI 属于后者。它的首页标题直接写着「面向网页浏览的 AI 智能体」,副标题用「一个应用装下所有 AI」概括模型聚合,旁边挂着 2025 年度扩展榜单的徽章,下面一行小字写着 4.7 分与 50 万专业人士在用。

一个快捷键,多家模型
它的入口就是一个组合键:按 Alt + A,任意网页上都能叫出 GPT-5.4、Claude 4.6、DeepSeek、Gemini 3.1、Llama 4 与 Perplexity。官方把自己的引擎描述成「浏览器自动化与 AI 的混合体」,兼容 OpenAI、Anthropic、Google、DeepSeek、Perplexity 与 Meta 这几家的模型。换句话说,模型是可以换的零件,真正的产品是那套能把模型接到网页上的引擎。
接入方式也留了好几层:可以用对话类账号登录,可以用接口密钥,也可以直接连官方提供的云模型。这种设计对成本敏感的人比较友好——你可以只买订阅、走官方通道,也可以自备密钥按量计费。
它到底能做什么
首页列的能力密度很高,挑几项有代表性的看。YouTube 总结可以提炼要点、跳到时间戳,还支持和视频对话;答案引擎在搜索结果旁给出带来源引用的回答,并能接着追问;Gmail 助手会给来信分类、总结长线程、按你的语气起草回复;写手这一项强调「模仿你的语气」,覆盖邮件、私信、推文、文章到求职信;网页更新监控则定期检查站点变化并通知你。
再往下列的还有一串:100 多个现成且感知页面的自动化命令、按 25 种写作框架生成可到 2.5 万词的长文、用 // 前缀调出命令(F 完成草稿、G 查语法、P 改写、T 翻译、S 搜索、E 解释)、SEO 审计与长尾词提取、价格与补货提醒、把任意网站的数据抓取出来并触发自动化链条、在浏览器里用自定义智能体,另外还有 Midjourney 提示词向导与语言学习向导。快捷键那一组把常用动作压成单个字母,这种设计说明它在键盘操作上花了心思。
名字也值得一提。常见问题里写明 HARPA 是 High Availability Robotic Process Automation 的缩写,中文大致是「高可用机器人流程自动化」,定位是把 AI 与自动化接起来的虚拟助手,官方甚至把它描述成企业的数字劳动力。价格提醒覆盖的范围也不小,亚马逊、速卖通、沃尔玛与 eBay 都在列。
隐私:本地模型与不记录
隐私这块官方写得比较具体:支持 Meta Llama 之类的本地模型,不记录对话与操作,符合 GDPR,也可以搭配任意自选模型;常见问题里补充说它在本机运行、不把网站数据发送或存放在远端服务器、不投广告也不售卖数据,用户输入的提示词只透明转发给模型提供方处理。本地模型在这里是可选方案,而非替代云模型的唯一路径——隐私强度可以按自己的需要调。

定价:三档,按兆 token 计量
它的定价页只有三档,摊在同一张表里对比。S1 面向所有人,按年付是每月 12 美元,含每年 75 兆 token;S2 面向进阶用户并被标为热门,按年付每月 19 美元,含每年 225 兆 token,多人席位另有九折;X 档是一次性 240 美元的终身授权,限单人使用,含 30 兆 token。切到年付时,另外再加 25% 的 AI token。
兆 token 这个单位需要解释一下。按官方口径,在高效模型上 1 兆 token 等于 100 万输入 token,大约相当于 75 万英文单词的输入文本;输出 token 按输入的 3 倍计费,而 ChatGPT、Claude Sonnet、Gemini Pro 这类高级模型每次请求会吃掉更多。官方给的换算参考很实用:1 兆 token 大约等于 100 次命令运行或视频总结或页面感知提问,换成聊天消息则是高级模型 300 条、高效模型 3000 条。它用 token 而非次数计价的理由也写在常见问题里——单次查询的体量差异太大,按 token 计量更透明,用户也能看到每次查询消耗了多少。
三档之间的功能差异其实很窄:「定时命令」与「高级自动化」这两项从 S2 档起提供。网页会话连接与接口连接三档都有,AI 视觉、PDF 与文件总结、跨设备聊天记录、自建可复用命令、价格与页面监控这些也都齐;只有云模型那一栏分成两种玩法——订阅档直接给出一整排云端模型,终身档更倾向于自备密钥,或者用不限量的网页会话连接。也就是说,钱主要花在 token 额度和「能否定时跑自动化」上。
免费档与售后
免费档是演示额度:可以用网页会话连接访问 ChatGPT、Claude 与 Gemini,每天限 10 条消息,上限 100 次 AI 命令运行,预置与自定义命令以及网页监控都能用。这个额度足够把主要流程完整跑一遍。
账单方面,官方由 FastSpring 处理支付,支持主流信用卡与借记卡、PayPal、Amazon Payments、ACH 直存与 Payoneer 预付卡;随时可以在账户设置的账单页取消订阅、切换付款方式或索取发票。有两条要提前知道:官方明确表示不提供折扣也不提供退款,理由是对每项订阅能力都提供了演示期,先试再买;但如果你先买了终身档又想转年付订阅,终身档的钱会在账单里自动抵扣,这条升级路径留了口子。

自动化库与对外接口
现成命令集中在自动化库里。库里既有官方发布的命令,比如深度研究机器人、一键按你的语气回邮件、社交平台消息摘要、领英自动搜索与连接,也有社区成员自己写并公开分享的命令,每条都带安装数与点赞数,按热度排序。不想自己琢磨提示词的人,可以直接挑一条装上去用。
团队场景则换了另一套说法:它的「空间」是存放命令的工作区,S 档可以接入多个成员共享命令,按空间购买并按成员数量计费——共享的是命令本身,而非账号。对外还有 GRID 浏览器编排接口,可以通过 Zapier、Make、n8n、Microsoft Power Automate、Workato 与 UiPath 这类平台对接,也能直接用 REST 接口调用;引擎以「节点」为单位运行,一个浏览器配置文件对应一个节点,节点数量不限。对已经有自动化流程的团队来说,这条路比手动点浏览器实用得多。
适合谁用,以及要留意的地方
它适合三类人。一类是每天要在网页上读大量长内容的人,视频总结、页面感知提问与答案引擎能省下不少时间。一类是内容与营销岗位,写作风格模仿、SEO 审计、长文生成这几项对口。还有一类是手上有重复网页操作的团队,自动化库加上 GRID 接口能把抓数据、填表、监控这些活挂到既有流程里跑。
要留意的地方有两处。一是 token 消耗会随任务类型剧烈变化:聊天消息很省,但页面感知提问、视频总结与自动化任务的消耗是另一个量级,长期跑自动化的话,先按官方给的换算估一下月用量再选档位更稳。二是它强调在本机运行与不记录数据,但提示词仍会转发给模型提供方处理,涉及敏感内容时,自己得先想清楚数据会经过谁。
浏览器插件的早期那一代解决「问得快」,后来的一代开始解决「替你动手」;而决定它能否长期留在工作流里的,往往是那些看不见的部分——数据往哪走、账怎么算。