ARTICLE DETAIL

资讯详情

深耕网站视觉设计与运营推广的一线实战洞察。

Hindsight 部署指南:如何 3 分钟跑通智能体记忆系统

Hindsight 部署指南:如何 3 分钟跑通智能体记忆系统 Hindsight 部署指南如何 3 分钟跑通智能体记忆系统【免费下载链接】hindsightHindsight: Agent Memory That Learns项目地址: https://gitcode.com/GitHub_Trending/hindsight2/hindsightHindsight 是一套智能体记忆系统负责把智能体见过、做过的事存下来再按需取回和反思。完成 Hindsight 部署后你的代码可以通过 retain存储、recall检索、reflect反思三个操作给自己的智能体装上一份会更新的长期记忆。第一步选对你的 Hindsight 部署路径这一节解决第一个问题部署方式不止一种你该选哪条答案不取决于技术而取决于你的使用场景。使用场景推荐方式一句话说明新手尝鲜Docker 容器内置数据库一条命令跑起完整服务不用安装数据库开发测试Python 内嵌Hindsight 本地安装不需要起独立进程在脚本里直接调用生产环境Docker Compose 外部 PostgreSQL数据落在你自己的库里方便备份和迁移企业级Helm 部署到 Kubernetes多副本 API 共享一个数据库一个 Pod 故障时其余 Pod 自动接管请求如果你不想自己维护服务器也可以直接接入官方 Hindsight Cloud 托管服务代码指向它的 API 地址即可跳过全部部署步骤。最短路径3 分钟跑通 Hindsight Docker 部署这一节解决现在就跑起来的问题选 Docker 路线用三条命令完成一次完整的记忆写入和读回。前提只有一样一个 LLM API 密钥Hindsight 在运行时要靠 LLM 从文本里提取事实和实体。export OPENAI_API_KEYsk-xxx docker run -it --pull always --name hindsight --restart unless-stopped \ -p 8888:8888 -p 9999:9999 -e HINDSIGHT_API_LLM_API_KEY$OPENAI_API_KEY \ -v hindsight-data:/home/hindsight/.pg0 \ ghcr.io/vectorize-io/hindsight:latest启动后 API 服务监听 8888 端口网页管理界面在 9999 端口打开浏览器就能看到记忆库管理页面。先确认服务活着curl http://localhost:8888/health返回 200 即就绪。接着安装客户端pip install hindsight-client -U执行第一次 retain / recallfrom hindsight_client import Hindsight client Hindsight(base_urlhttp://localhost:8888) client.retain(bank_idmy-bank, contentAlice works at Google) results client.recall(bank_idmy-bank, queryWhere does Alice work?) print(results)如果 recall 能取回你刚存的那句话闭环就成了存储、索引、检索全部由服务端自动完成。两点补充如果你的 LLM 不是 OpenAI启动前额外设置HINDSIGHT_API_LLM_PROVIDER与HINDSIGHT_API_LLM_MODEL官方支持 25 种以上提供商如果不想用 Dockerpip install hindsight-api后直接运行hindsight-api也能得到同样的 8888 服务。走向生产Hindsight 云端部署的三阶升级这一节解决第一个版本跑起来之后什么时候该往生产走、每一步改什么。不要一上来就跳 Kubernetes按台阶升每级只看实际变化的东西。第一阶把数据从内置库搬到外部 PostgreSQL升级信号当你要备份数据、迁移服务或者打算跑多个实例时。内置的 pg0嵌入式 PostgreSQL尝鲜够用但数据锁在容器卷里迁移和恢复都不方便。换成外部 PostgreSQL 14需启用 pgvector 等向量扩展仓库里附带了现成的 compose 文件export HINDSIGHT_API_LLM_API_KEYsk-xxx export HINDSIGHT_DB_PASSWORDyour-password cd docker/docker-compose/external-pg docker compose up -d启动后 API 的读写全部指向你自己的数据库数据卷里只剩缓存性质的内容。第二阶调好关键配置变量升级信号当持续负载下出现 LLM 调用失败、内存吃紧或 recall 变慢时。核心变量集中在下面这张表生产部署前逐项核对变量名作用示例值HINDSIGHT_API_LLM_PROVIDERLLM 提供商25 种以上含本地推理openaiHINDSIGHT_API_LLM_MODEL事实提取与回答生成用的模型gpt-4o-miniHINDSIGHT_API_DATABASE_URL外部 PostgreSQL 连接串postgresql://user:passdb:5432/hindsightHINDSIGHT_API_WORKER_ID稳定的 worker 身份不设则重启后在途任务无人接管hindsight-prodHINDSIGHT_API_EMBEDDINGS_PROVIDER嵌入模型来源配合 slim 镜像外置openai内存预算也有具体数字完整版镜像约需 2 GB 内存内置嵌入与重排模型换成 slim 镜像并把嵌入、重排交给外部服务后512 MB 即可运行。第三阶上 Kubernetes升级信号当你需要多副本、横向扩容或跨多台机器部署时。官方提供了 Helm Chart一条命令安装helm install hindsight oci://ghcr.io/vectorize-io/charts/hindsight \ --set api.llm.provideropenai \ --set api.llm.apiKeysk-xxx \ --set worker.enabledtrue \ --set worker.replicaCount3部署后 API 与后台 worker 独立扩缩某个 Pod 故障时其余副本自动接管请求worker 以 StatefulSet 运行、身份稳定重启后已认领的后台任务不会丢失。全部选项见 helm/hindsight/values.yaml。接入你的代码Hindsight Python 与 Node.js 客户端这一节解决业务代码怎么调两个最小示例各只演示 retain 和 recall 两个核心操作。先装对应客户端——Python 是pip install hindsight-client -UNode.js 是npm install vectorize-io/hindsight-client——然后任选其一from hindsight_client import Hindsight client Hindsight(base_urlhttp://localhost:8888) client.retain(bank_idmy-bank, contentAlice works at Google) results client.recall(bank_idmy-bank, queryWhere does Alice work?) print(results)const { HindsightClient } require(vectorize-io/hindsight-client); const client new HindsightClient({ baseUrl: http://localhost:8888 }); await client.retain(my-bank, Alice loves hiking in Yosemite); const results await client.recall(my-bank, What does Alice like?); console.log(results);服务不在本机时把base_url换成部署地址即可。需要第三个操作 reflect基于已有记忆做深度分析并给出回答时调用方式与上面相同。部署后常见问题4 个高频故障的排查步骤这一节把新手最容易撞上的四个真实问题整理成看到现象、找对应原因的对照。现象一容器起不来内置数据库报Permission denied这是用了宿主机目录挂载导致的容器以 UID 1000 运行目录不归它所有。改回命名卷-v hindsight-data:...或对挂载目录执行sudo chown -R 1000:1000归属修正。现象二retain 报错错误信息指向 LLM API按顺序排查① 密钥本身是否有效②HINDSIGHT_API_LLM_PROVIDER与_MODEL是否和密钥所属提供商一致③ 公司网络是否需要代理。走本地模型的话用HINDSIGHT_API_LLM_BASE_URL指向 Ollama 或 LM Studio 等本地推理服务。现象三recall 返回空或结果答非所问先在 9999 端口的网页界面确认该 bank 里确实存进了事实再核对两次调用传的bank_id是否一致——记忆严格按 bank 隔离不会跨库泄漏。recall 会并行跑语义、关键词、图谱、时间四条检索路再融合排序查询措辞与原文差异过大时命中率会明显下降换个说法再试一次。现象四容器重启后进行中的后台任务卡住worker 默认用容器主机名当身份重启后主机名变了旧容器认领的任务成了孤儿。设置一个稳定的HINDSIGHT_API_WORKER_ID如hindsight-prod即可避免单容器部署也建议设置。尝鲜直接走最短路径的 Docker 容器开发脚本换成 pip 内嵌模式最省事生产环境记住两件事——外部 PostgreSQL 加上稳定的 worker ID要上多机规模再启用 Helm。完整安装细节与存储方案见 hindsight-docs/docs/developer/installation.md本地 LLM、S3 文件存储等场景的 compose 模板都在 docker/docker-compose/ 目录下。【免费下载链接】hindsightHindsight: Agent Memory That Learns项目地址: https://gitcode.com/GitHub_Trending/hindsight2/hindsight创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表