最近OpenClaw火爆了,都需要排队去装,是不是有点夸张了啊,火得离谱——不是新芯片,不是新框架,是一只“小龙虾”。

没错,就是那种你深夜刷GitHub时,会被25万+星标闪瞎眼的OpenClaw。因为logo是只红色龙虾,核心功能叫“钳子”(claw),迭代逻辑像龙虾蜕壳生长,所以大家都亲切地叫它:小龙虾

4个月,25万星标,增速超过Linux。这哪是开源项目,这是开源界的顶流。

今天咱们就来聊聊,这只“小龙虾”到底是个什么玩意儿。

一、它不是大模型,但大模型都听它的

先纠正一个误区:OpenClaw不是又一个ChatGPT,也不是什么更牛的大模型。

它的slogan很有意思:“the AI that actually does things”——真正能干活的AI。

现在的AI大模型,说白了就是个“嘴强王者”。你问它怎么把Excel数据录入CRM,它能给你写一篇800字的操作指南,然后让你自己动手。

OpenClaw不一样。它给大模型装上了“眼睛、大脑、手和记忆”——能听懂人话,能自己规划步骤,能操控你的电脑,能执行多步骤任务,还能在出错时自己纠错。

简单说:以前AI是军师,只出主意;现在AI是打工人,亲自干活。

二、四层架构,各司其职

OpenClaw能稳定干活,靠的是四层架构设计,每层各司其职又配合默契:

接入层(Gateway)——永远在线的指挥官

它统一对接Telegram、飞书、企业微信、Discord等聊天工具。你不需要安装额外APP,在日常聊天窗口就能发指令。它还负责任务队列管理,默认串行执行,避免多个任务打架。

大脑层(模型调度)——思考决策中枢

它本身不生产智能,而是灵活接入Claude、GPT、DeepSeek、通义千问甚至本地开源模型。按任务类型匹配最优模型:数据核对用逻辑强的Claude,邮件文案用创作强的GPT。核心负责理解自然语言、拆解任务、逻辑推理、决策动作。

执行层(Skills)——动手干活的“钳子”

这是可扩展的功能插件体系,支持官方、社区贡献和用户自定义。通过操作系统底层API,实现文件管理、浏览器操控、办公自动化、代码编写等具象操作。每个命令都在独立沙箱运行,保障安全。

记忆层(Memory)——可自主生长的记忆

本地存储对话历史、任务执行记录、用户偏好、技能参数等数据,完全保存在用户本地设备/服务器,不上传第三方。短期记忆上下文,长期习惯沉淀,越用越贴合你的需求。

三、干活流程:See-Think-Act-Feedback

OpenClaw完成任务的核心逻辑,是经典的感知-决策-执行-反馈循环。全程基本无需用户干预,可自主完成多步骤复杂任务——当然,bug菌觉得目前这也只是目标和口号。

举个真实例子:你给它下指令「帮我把Excel里的客户信息录入公司CRM后台,再给每个客户发通知邮件」

来看看它是怎么干的:

Step 1:感知(See)
网关收到指令后转发给智能体核心。它先对电脑桌面截图,通过多模态大模型解析屏幕内容,识别Excel文件位置、CRM网页入口、邮箱图标,同时读取Excel内的客户数据,明确任务边界。

Step 2:决策(Think)
大模型将复杂指令拆解为可落地的分步动作:

  • 打开Excel,提取所有客户信息

  • 打开浏览器,进入CRM后台并登录

  • 逐行录入客户信息,核对关键字段

  • 打开邮箱,按模板发通知邮件

  • 生成执行报告反馈用户

同时设置校验规则和异常预案,并根据任务环节自动切换适配模型。

Step 3:执行(Act)
智能体通过操作系统底层API,模拟人类鼠标键盘操作,严格按步骤执行:双击Excel图标、复制单元格内容、点击浏览器输入框粘贴网址、点击表单字段录入信息、点击发送按钮发邮件。每个操作都在隔离沙箱运行,避免误伤系统核心。

Step 4:反馈与纠错(Feedback)
每完成一个单步动作,智能体都会重新截图、读取系统状态,和预期结果比对:

  • 执行符合预期,进入下一步

  • 遇到弹窗广告、登录验证码、字段不匹配,自动识别问题,重新规划动作(关闭广告、请求验证码、调整字段映射),重试直到完成

全部任务结束后,它会整理执行结果、成功/失败条目、异常情况,通过聊天窗口反馈给你。

这个循环持续迭代,直到任务完全达成目标。哪怕中途出现意外,也能自主纠错,无需用户全程盯守。

四、为什么大家都爱“养虾”?

OpenClaw火爆,靠的是几个硬核特性:

1. 本地部署,隐私可控

所有数据和执行都在你自己的电脑/服务器上完成,不上传第三方服务器。权限完全由你掌控,极大降低数据泄露风险。对于动不动就被“上传分析”的AI工具来说,这简直是清流。

2. 低门槛+高扩展

零基础用户最快10分钟完成部署,无需编程技能,用自然语言就能指挥。同时支持社区技能扩展,可以直接复用别人开发的成熟技能包,也能自定义编写新技能。能力边界可以无限拓展。

3. 递归式技能进化

遇到未知任务时,它能自主编写代码、在本地沙箱调试、自我修正,最终把成功的执行流程封装成标准化的技能文件。相当于自主学会新能力,越用越强大。这已经不是“学习”了,这是“进化”。

4. 默认安全的设计

默认串行执行任务,避免异步编程带来的竞态混乱。每个操作都在独立沙箱运行,限制权限范围,最大程度降低误操作和系统安全风险。

五、我的观点:从“操作员”到“管理者”的跃迁

OpenClaw当然还不完美。偶尔会抽风,偶尔会误解指令,偶尔会在简单任务上翻车。但它的出现,让我意识到一个更深层的变化:

我们正在从“操作员”向“管理者”跃迁。

以前,我们的时间被无数琐碎操作占据:复制粘贴、录入数据、发送邮件、整理文件。这些活不复杂,但极其消耗精力。

现在,OpenClaw这样的工具,正在把这些脏活累活承包下来。我们需要做的,不再是“怎么操作”,而是“要什么结果”。

就像工业革命把人从体力劳动中解放出来,AI革命正在把人从重复脑力劳动中解放出来。未来的核心竞争力,不再是“你会不会操作”,而是“你会不会提要求”、“你会不会规划”、“你会不会决策”。

从执行者到指挥者,从干活的人到用人的人。

这才是“小龙虾”最值得期待的地方。它不只是一个好用的工具,更是一个隐喻:未来的工作,不是人干活,而是人指挥机器干活。

当然,路还很长。OpenClaw还在“虾苗”阶段,时不时会闹点小脾气。但只要方向对了,技术迭代的速度,从来不会让人失望。

最后问一句:你养虾了吗?

‧‧‧‧‧‧‧‧‧‧‧‧‧‧‧‧  END  ‧‧‧‧‧‧‧‧‧‧‧‧‧‧‧

关注我的微信公众号,回复“星球”加入知识星球,有问必答。
点击“阅读原文”查看知识星球详情,欢迎点分享、收藏、点赞、在看。
Logo

DAMO开发者矩阵,由阿里巴巴达摩院和中国互联网协会联合发起,致力于探讨最前沿的技术趋势与应用成果,搭建高质量的交流与分享平台,推动技术创新与产业应用链接,围绕“人工智能与新型计算”构建开放共享的开发者生态。

更多推荐