面向中小团队与个人用户:智能体替你干活,知识库替你记,模型网关替你管额度,监控替你看家。单二进制发布,无外部依赖,数据与模型调用全部留在你自己的主机与内网。
对话即干活:自动拆任务、调工具、读写文件、执行命令,办公与开发的 AI 工作流中枢。
独立知识库服务:入库、自动分类、摘要、语义检索与知识图谱,一行配置接入智能体。
统一模型入口:多上游路由、按人计量、额度控制,团队共用模型不失控。
极轻主机监控:CPU / 内存 / 磁盘 / 延迟一页全览,为整套体系看家护航。
手机浏览器直达移动版,添加到主屏幕即成独立应用,随时随地使唤智能体。
当前版本:dist-20260907 · 全部产物为免安装压缩包 · 按需单用,或整套组装
本地 AI 工作流助手:对话框输入任务,Agent 自动思考、拆分步骤、调用工具(读写文件 / 执行命令 / 搜索)并给出结果。内置 Web 界面与移动端、知识库检索、MCP 工具扩展、任务管理与审批控制。
独立知识库服务:把散落的文档变成可检索、可问答的知识资产。多格式入库(txt/md/code/docx/xlsx/pptx/pdf),自动分类 + 自动摘要 + 语义检索 + 知识图谱,REST API 一行配置接入问答智能体(如 MyClaw)。
OpenAI 兼容的模型调用网关:给团队一个统一入口,多上游智能路由,谁用了多少、响应快慢,一目了然。
极轻主机指标监控:客户端每分钟采集 CPU / 内存 / 磁盘与内网连通延迟,服务端 ECharts 仪表盘一页全览,支持时间范围查询与 SSE 实时刷新。
所有产品都是「解压 → 配置 → 运行」,3 步可用
start.bat;macOS/Linux 执行 ./start.sh(默认端口 7878)http://localhost:7878http://192.168.1.3:11434)或任意 OpenAI 兼容 api_base + api_key + 模型名config.example.toml → 复制为 config.toml)http://主机IP:7878/mobile。config.example.toml 为 config.tomlbind_addr(默认 0.0.0.0:8081)与 admin_token(务必改强随机值)[[upstreams]] 填真实模型服务地址与模型前缀(如 Ollama http://192.168.1.3:11434/v1)llm-router;客户端 API 地址指向 http://主机:8081/v1 并携带用户 keyhttp://主机:8081/metrics 查看用量看板(Header:X-Admin-Token)config.example.toml 为 config.toml,填写 Embedding / LLM 地址(Ollama 如 http://127.0.0.1:11434,模型如 bge-m3 / qwen3.5:4b)kshare --config config.toml(默认端口 8900)http://主机IP:8900 进入管理页面:上传文件 / 索引目录 / 粘贴文本,可选自动分类 + 摘要[knowledge_service] base_url = "http://主机IP:8900",对话前自动预检索POST /api/v1/search {"query":"...","top_k":5} 返回 hits + context,context 可直接注入问答提示词。./perfs-server --port 8080 --db perfs.db(Linux 建议 systemd/ 内的 unit 常驻)http://主机:8080 查看仪表盘perfs.toml.example 为 perfs.toml,填服务端地址与上报间隔perfs-client(建议 systemd / 计划任务常驻),每分钟自动上报