今天想跟您聊一个话题。自媒体上最近又在推一个叫 Open Claw 的开源项目,火了一阵子。我想从一个过来人的角度,给您普及点常识。

1. 先问您几个问题

您以前玩过单机或网络游戏吗?用过“外挂”或自动脚本吗?自己写过自动化脚本吗?

如果您经历过这些,那您脑袋里就有东西,不是“傻”的。如果您没玩过游戏,也没接触过外挂、脚本,那您可能会觉得,现在AI能按语音指令自动操作电脑,是件很牛的事。

我想让您了解技术的本质,免得“上当受骗”(加个引号),花些冤枉钱。这往往是因为无知——因为没经历过,见识面窄。

我建议,家里有喜欢折腾的小孩,可以让他们多接触这些,没坏处。我96年接触电脑,从玩《仙剑奇侠传》、《星际争霸》开始,后来才进入IT行业。喜欢玩是起源,玩多了就想研究怎么自动化、怎么挂机。

2. 自动化的“老底”是什么?

几十年来,无论是软件开发还是工厂管理,都在追求自动化。以前的自动化,是通过编写程序,进行规则判断,模拟人的键盘和鼠标操作。

主要有两种模式:

一种是“侵入式”,直接改程序代码,通常不被允许。

另一种是“外置式”,完全模拟操作。程序会接管您的键盘鼠标,运行时您就不能动电脑了。或者用后台模式,不影响您正常使用。

包括我现在开发AI伴侣,接入微信自动输入功能时,用的也是前置模拟的方式,如果您移动了窗口位置,输入就可能不准。这就是核心:一切自动化,无外乎是用程序代替手动输入和点击。

3. Open Claw 到底新在哪?

现在这个项目,技术原理没变。它只是把软件接入了AI功能。

真正的技术飞跃是AI大模型本身。而像Open Claw或我的AI伴侣,都只是大模型之上的应用。它并非“划时代”产品,只是换了一种实现自动化的技术路线。

现在借助AI,一个程序员就能做出类似应用,因为开发门槛降低了。但这在传统软件领域,其实属于“外挂”性质的灰色地带。

4. 为啥一天能花好几十?

要实现自动化,软件需要读取您的屏幕内容,转换成图片,送给AI模型识别。

识别有两种方式:本地部署大模型(硬件成本高),或者调用线上AI服务商的接口(比如阿里通义千问等)。

线上处理必然产生费用。很多人用了Open Claw后,发现一天几十块很快就用完了。为什么?因为它内部有定时器,可能每隔几秒就截屏、识别、操作一次。

用线上高精度模型,费用自然就高了。如果您了解这个本质,就知道它必然要截取屏幕、传输数据、解析返回、再执行操作,循环往复。

5. “智能体”只是商业包装

所谓的“智能体”,在我看来就是商业炒作出来的概念。如果软件不标榜自己是“智能体”,可能很多人看都不看一眼。这是很恐怖的现象,我们做技术的很厌恶,但为了推广有时又被迫随波逐流。

它鼓吹的自动回邮件、自动找资料,技术原理也不新鲜:

回邮件:要么截屏识别,要么直接配置邮箱账号密码去定时读取。

找资料:底层就是“爬虫”技术,定时抓取网页内容,再让AI总结。我的AI伴侣内置浏览器,也能实现类似功能。

所以,关键还是AI大模型的认知能力,它才是质变。上面的应用只是调用接口,把以前需要复杂规则判断的部分,换成让AI识别,降低了实现难度。

6. 安全与风险不可忽视

这类软件需要极高的系统权限。只要安装,就等于允许软件进入您的“家门”。安全风险完全取决于开发者是否心存恶意。开源项目由于代码公开,受到监督,风险相对较低,但并非没有。

我想普及这个常识,就是希望大家不要盲目跟风。当今AI火热,牛的是底层大模型,而不是上面这些应用。所有传统软件都会加入大模型能力,替换掉原有的部分实现方式。

未来,甚至数据库都可能被训练好的大模型替代,因为它本身就是一个更智能的数据库。

#OpenClaw #AI自动化 #技术本质 #防忽悠指南 #数字人 #凤希AI伴侣

本文内容由作者口述,AI 仅整理提炼润色,未进行任何过度创作。

Logo

北京人形旗下天工造物具身智能开源社区,聚焦具身天工与慧思开物两大平台

更多推荐