积木智能体(Jimu)Linux 版实测:12 类系统原生工具拆解
实测版本:积木智能体 Jimu 0.5.5 Linux 版。本文所有截图均为真实运行截图。
写在前面:验证一个问题
桌面原生智能体和网页版智能体,差距到底在哪一层?为了回答这个问题,我把积木智能体(Jimu)的 Linux 版装起来,逐页打开设置看了一遍。结论很直接:网页版智能体住在浏览器沙箱里,积木智能体直接住在操作系统里——这不是比喻,是架构差异。
一、实测环境
- 版本:Jimu 0.5.5 Linux amd64
- 安装时缺了 libnotify4、libxtst6、libsecret-1-0 三个系统库,apt-get install --fix-broken 一把梭解决
- X11 图形环境下启动,主界面一次点亮

二、主界面:Ideas, Realized
打开客户端,第一句话是 “Ideas, Realized”(想法,即刻实现)。顶部四种工作模式:Execute(执行)、Plan(规划)、Team(团队)、Design(设计);输入框支持 @ 引用 skills 和子代理(sub-agents);底部有 Workspace 和 Select Model。
这个 @ 引用值得 Linux 用户注意:skills 和子代理是一等公民,不是藏在三级菜单里的插件。
三、Marketplace:扩展生态
Marketplace 下拉菜单里是官方扩展:Skills、Agents、Teams、MCP Services,下方还有创意库:PPT Components、Image Prompts、Video Prompts、Voice Library。
对开发者最有含金量的是 MCP Services:网页版智能体接本地 MCP 服务要绕一大圈,桌面原生的积木智能体直接支持。这是"住在系统里"带来的红利。

四、Tools:12 大类系统原生能力
设置页 Tools 一栏展开后有 12 个大类,是整篇实测信息量最大的部分:
-
Runtime Installer:Node.js / Python 一键检测安装,自动配置环境变量
-
Document Intelligence:从 88+ 种格式(含 PDF、Office、图片)提取文本,扫描件可选 OCR
-
Speech Models:本地 STT / TTS 语音模型管理
-
Local Translation Service:下载 Hy-MT 本地翻译模型 + llama.cpp 运行时,离线翻译,装完自动起服务
-
Local Vision Service:本地视觉能力
-
Screenshot:系统级截图
-
Code Intelligence (LSP):语言服务器协议,代码理解不是靠正则猜的
-
Image / Video Generation:图像与视频生成
-
Tool Approval Mode:工具审批——对应官方白皮书里的策略审批网关,敏感操作先弹窗确认再执行
-
Browser Tool:浏览器工具
单拎 Local Translation Service 说一句:模型和运行时都下载到本地,断网可译,装完自动起服务。这种"下载即部署"的体验,只有桌面原生才给得起。

五、Memory:四级长期记忆是真的
Memory 页的结构完整得不像 v0.5:
- Global Memory:对应 ~/.jimu/JIMU.md,每次对话开始自动加载,改动同步到所有活跃会话
- Memory Recall:关键词检索已存储的记忆
- Journals:从对话中自动提取的事实
- Knowledge Bank:从 Journals 蒸馏出的稳定长期知识,再细分为 World / Experience / Opinions / Entities 四个维度

六、设置体系:三层架构
整个设置页分三层,信息架构很干净:
- AI & MODELS:Jimu(渠道与认证)、Agent、Team、Skills、MCP
- FEATURES:Tools、Office、Schedule、Tickets、Memory、Search
- SYSTEM:Selection、Pets、Connection、System、About

七、总结:它适合谁
网页版智能体能"说",积木智能体能"做":读写本地文件、跑终端命令、解析 88+ 种文档、离线翻译、四级长期记忆、MCP 本地服务——这些是网页版够不着的天花板,是桌面原生的基本功。
按官方白皮书定位,积木智能体面向个人专业工作者、独立开发者和超级个体:Windows / Mac 桌面客户端 + 手机随行中继,另有 Linux 版。官网:jimu.chat。
更多推荐




所有评论(0)