ARTICLE DETAIL

资讯详情

深耕网站视觉设计与运营推广的一线实战洞察。

WeKnora离线部署教程:内网3步跑起文档问答

WeKnora离线部署教程:内网3步跑起文档问答 WeKnora离线部署教程内网3步跑起文档问答【免费下载链接】WeKnoraOpen-source LLM knowledge platform: turn raw documents into a queryable RAG, an autonomous reasoning agent, and a self-maintaining Wiki.项目地址: https://gitcode.com/GitHub_Trending/we/WeKnora如果你的服务器连不上外网又想把手里的 PDF、Word 文档变成能直接问答的知识库WeKnora 的离线部署方案值得试。下面按你亲手操作的顺序走一遍拉代码、改配置、起服务、传文档、提问题全程不碰外部网络。项目速览WeKnora 是一个开源的 LLM 知识平台把原始文档变成可检索、可问答的 RAG 知识库还能自动维护 Wiki。三个特点容器化部署解析器、数据库、后端、前端全部打包成 Docker 服务一条命令拉起来模型可换对话和向量模型都走 Ollama离线环境里跑什么模型你说了算数据不出机器文档解析、向量化、问答全在本地完成下面是文档从上传到变成可检索内容的整体流程动手清单开工前把这张表过一遍缺哪项先补哪项项目要求说明CPU8 核起16 核更好解析和推理都要吃核数内存32GB 起跑 7B 级模型至少要留 20GB 给推理磁盘200GB 可用SSD 优先模型权重 文档存储都要地方DockerEngine 20.10Compose v2脚本会自动探测docker compose或docker-composeOllama宿主机已装好并能在 11434 端口访问离线环境提前装好别指望启动脚本联网Git任意近期版本用来拉代码提示离线机拿不到外部镜像的话提前在有网的机器上docker pull后导出镜像包docker save再在离线机上docker load导入。实操主线第1步把代码弄进内网做什么在有网的机器上把仓库拉下来通过 U 盘或内网文件服务传到目标机器。git clone https://gitcode.com/GitHub_Trending/we/WeKnora cd WeKnora成功标志目录里有docker-compose.yml、.env.example和scripts/start_all.sh。第2步改出一份离线环境配置做什么先复制模板再只改关键几项。完整的变量说明都在 .env.example 里不用一次看完。cp .env.example .env需要动的主要是这四项其余保持默认即可变量建议值作用STORAGE_TYPElocal文档存在本机目录不依赖对象存储OLLAMA_BASE_URLhttp://host.docker.internal:11434容器里访问宿主机的 OllamaDB_DRIVERpostgres用 compose 自带的 PostgreSQLSYSTEM_AES_KEY自行生成 32 字节数据库里 API Key 等敏感字段的加密主密钥成功标志vi .env确认四项已填且SYSTEM_AES_KEY不是模板原值。第3步在宿主机准备本地模型做什么先在离线机上确认 Ollama 本身能启动再导入模型。模型文件从有网环境提前下载好。ollama serve # 另开一个终端 ollama pull bge-m3 ollama pull qwen2.5:7bbge-m3做向量化qwen2.5:7b做对话内存吃紧可以换更小的对话模型。成功标志ollama list能看到这两个模型。第4步一键启动全部服务做什么用仓库自带的启动脚本把 Ollama 检查和容器编排一起跑掉。--no-pull告诉脚本别去拉镜像——离线机上没有外网拉也白拉。./scripts/start_all.sh --no-pull脚本会依次拉起后端 app、文档解析器 docreader、PostgreSQL、Redis 和前端并自动从 .env.example 补齐缺失的 .env。脚本的每个开关都可以用./scripts/start_all.sh --help查看。成功标志终端打印出前端和 API 的访问地址容器日志持续滚动。第5步3步验证离线部署成功做什么先看容器状态再探后端健康检查最后开浏览器。docker compose ps curl http://localhost:8080/health然后访问http://localhost前端默认 80 端口。成功标志docker compose ps里 app、docreader、postgres、redis、frontend 均为 Up健康检查返回正常浏览器能看到登录/注册页。跑通体验服务起来后跟着这个顺序走一遍十分钟能体会到完整链路注册账号在http://localhost的注册页建一个账号第一个注册的用户可以直接创建知识库。初始化模型首次进入会引导你配置模型把对话和向量模型都指向 Ollama 里刚拉下来的那两个填好http://host.docker.internal:11434即可保存。传文档新建知识库把 PDF、Word、TXT 拖进上传区。解析、切分、向量化全自动列表里能看到每个文档的处理状态。提问等文档状态变为完成直接在问答框输入问题回答会基于你上传的文档内容生成答案旁边附引用出处。避坑速查现象可能原因处理动作容器反复重启镜像没导全或端口被占docker compose logs app看报错docker images核对镜像是否齐全界面能开但问答没反应Ollama 没起来或OLLAMA_BASE_URL写错宿主机执行ollama ps确认服务核对.env里的地址模型加载慢、首答超时模型在 CPU 上冷加载首次推理慢首次请求等 1~2 分钟内存不足就换更小模型文档卡在处理中docreader 资源不足或文件过大看docker compose logs docreader确认文件在大小限制内向量库报连接错误RETRIEVE_DRIVER指到了没启动的组件默认用 postgres 即可别改RETRIEVE_DRIVER或按需启用对应 profile数据库加密字段读不出来SYSTEM_AES_KEY与建库时不一致启动前就要定好并固定丢了会导致已存密钥无法解密更细的排查思路可以看 docs/QA.md。进阶方向换向量库Qdrant、Milvus 等都内置在 compose 里按 profile 启用即可参考 docs/使用其他向量数据库.md开知识图谱加 Neo4j 后打开NEO4J_ENABLE文档间关系会以图谱呈现参考 docs/开启知识图谱功能.md接 MCP把知识库能力暴露给外部 Agent 调用参考 docs/MCP功能使用说明.md声明式内置模型不想每次在界面配模型可用config/builtin_models.yaml.example固化配置参考 docs/BUILTIN_MODELS.md收口日常维护很简单停服务用./scripts/start_all.sh --stop定期备份数据库docker compose exec postgres pg_dump -U DB_USER DB_NAME backup_$(date %F).sql配置文件、脚本和更多文档都在仓库里config/config.yaml、docker-compose.yml、scripts/start_all.sh。按本文走下来你的离线文档问答平台就跑起来了。【免费下载链接】WeKnoraOpen-source LLM knowledge platform: turn raw documents into a queryable RAG, an autonomous reasoning agent, and a self-maintaining Wiki.项目地址: https://gitcode.com/GitHub_Trending/we/WeKnora创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表