ARTICLE DETAIL

资讯详情

深耕网站视觉设计与运营推广的一线实战洞察。

OGX 0.7 版本升级指南:OpenAI 一致性转型、可观测性指标与破坏性变更迁移手册

OGX 0.7 版本升级指南:OpenAI 一致性转型、可观测性指标与破坏性变更迁移手册 OGX 0.7 版本升级指南OpenAI 一致性转型、可观测性指标与破坏性变更迁移手册【免费下载链接】ogxOpen GenAI Stack项目地址: https://gitcode.com/GitHub_Trending/ll/ogx本文基于 RELEASE_NOTES_0.7.md 编写深入解析 OGX 0.7 这一转型大版本的全部变更点fine-tuning API 移除、meta-reference/knowledge_search/rag-runtime/builtin概念重命名、Agents 到 Responses API 的迁移、FastAPI Router 迁移收官、structlog 结构化日志以及推理输出、全链路可观测性指标、Inline 神经 Rerank、Docling PDF 解析等新能力。文中以仓库源码为佐证给出可直接执行的迁移命令、配置示例和验证路径帮助你评估影响面并安全完成 0.6 → 0.7 升级。版本定位一次完成转型的重大发布OGX 0.7发布于 2026 年 4 月是一次面向 API 一致性、可观测性和架构清理的重大发布其主线可以概括为完成 OpenAI API 一致性转型将 Agent 时代的概念全面对齐 OpenAI 命名agents→responses、knowledge_search→file_search并新增 OpenAI schema 转换与stream_options等一致性字段架构清理收官移除 legacy 的webmethod装饰器、全部 API 迁入 FastAPI Router删除meta-reference/starter-gpu/TGI/HuggingFace 等旧时代产物全链路可观测性在 API、Inference、Vector IO、Responses 四个层面引入 OpenTelemetry 指标新能力落地推理reasoning输出、Inline 神经 Rerank、Docling PDF 解析、Infinispan 向量库、背景响应取消、Connector API 升级到 v1beta 等。升级到 0.7 之前必须完成若干硬破坏性变更hard breaking changes的迁移否则服务无法正常启动。一、硬破坏性变更升级前的强制动作1. Fine-Tuning API 整体移除PR #51040.7 删除了整个 fine-tuning/post-training API包括所有/post-training端点及对应的 provider 实现注意 0.5 中/post-training/jobs/{job_uuid}/...路径在此版本已不复存在。官方迁移建议是全部移除 fine-tuning API 调用改由外部微调服务直接完成。grep -r post-training\|fine.tuning\|fine_tuning your-project/2.meta-referenceProvider 重命名为builtinPR #5131所有内建inlineprovider 从历史名称meta-reference更名为builtin配置中需全局替换# Before provider_type: inline::meta-reference # After provider_type: inline::builtingrep -r meta-reference your-config-directory/这一点已在仓库中得到印证在 provider 注册表 中内建 provider 统一使用inline::builtin前缀例如 tool_runtime 注册表中的 file-search provider 即声明为provider_typeinline::file-search、toolgroup_idbuiltin::file_search。多个发行版配置如 starter/config.yaml也均以inline::builtin形态引用内建 provider。3.knowledge_search重命名为file_searchPR #5186工具名由knowledge_search统一更名为file_search影响所有引用该工具名的 API 调用与工具列表# Before tools[{type: knowledge_search, ...}] # After tools[{type: file_search, ...}]grep -r knowledge_search your-project/仓库当前实现已全面使用新名称内建实现位于 src/ogx/providers/inline/tool_runtime/file_search注册表中描述为File search tool runtime for document ingestion, chunking, and semantic search文档摄取、分块与语义搜索。4. Agents API 更名为 Responses APIPR #5195为对齐 OpenAI 命名惯例所有/agents端点迁移至/responsesgrep -r /agents your-project/升级动作将 API 路径从/agents/*替换为/responses/*。在仓库中Responses API 的 FastAPI 路由、模型定义与 API 封装分别位于 src/ogx_api/responses/fastapi_routes.py、models.py 与 api.py内建 responses 实现位于 src/ogx/providers/inline/responses/builtin。5.tool_groups从公开 API 移除PR #49970.7 起工具组tool groups由 provider spec 自动注册不再提供公开的注册/注销接口。迁移删除所有tool_groups注册调用并确保 provider spec 中声明了所需的toolgroup_id。grep -r tool_groups\|register_tool your-project/在源码中可看到这种自动注册形态file-search等 provider 直接在 InlineProviderSpec 中声明toolgroup_idbuiltin::file_search工具路由表在 src/ogx/core/routing_tables/toolgroups.py 中按 provider 自动聚合。6. TGI 与 HuggingFace 推理 Provider 移除PR #5333remote::tgi与remote::huggingface已从仓库中删除。迁移切换为remote::vllm、remote::ollama或其他受支持的推理 provider。grep -r remote::tgi\|remote::huggingface your-config-directory/7. 废弃的模型register/unregister端点移除PR #5341grep -r register_model\|unregister_model your-project/迁移改用标准的模型管理 CRUD 端点。8.webmethod装饰器移除 —— FastAPI Router 迁移收官PR #52480.7 完成了自 0.5 启动的 API 重构工作所有 API 现已完全使用 FastAPI Routerlegacy 的webmethod装饰器被删除。影响自定义 provider 作者若仍使用webmethod需改用 FastAPI router 装饰器。仓库中每个 API 模块均可见fastapi_routes.py如 inference、vector_io、responses正是本次迁移的落地产物。9.rag-runtimeProvider 重命名为file-searchPR #5187# Before provider_type: inline::rag-runtime toolgroup_id: builtin::rag # After provider_type: inline::file-search toolgroup_id: builtin::file-search10. Append-Rows 中重复的dataset_id移除PR #4849DatasetIO 的 append-rows 端点此前允许同时在 URL path 与请求体中携带dataset_id。0.7 起dataset_id仅取自 URL path 参数请求体中的重复字段必须删除否则报校验错误。11./files/{file_id}GET 响应格式统一PR #5154该端点不再返回 provider 特有的响应结构所有 provider 统一为一致的文件元数据格式。需要更新依赖旧格式解析的客户端。12. OpenAI API Schema 转换PR #5166为提升 OpenAI 一致性0.7 新增了 schema 转换与新的响应类型字段。依赖精确响应 schema 的客户端需要审查并适配新字段例如新增的reasoning输出类型、stream_options等见下文新特性。13.starter-gpu发行版移除PR #5279starter-gpu发行版已删除改用starter发行版 远程推理 provider。仓库中 starter 发行版配置 展示了这一形态推理层完全由remote::cerebras、remote::ollama、remote::vllm、remote::fireworks、remote::together、remote::bedrock等远程 provider 承担。二、行为变更无需改代码但需知晓变更说明sentence_transformers的trust_remote_code默认改为FalsePR #4602若使用需要远程代码执行的自定义模型需在 provider 配置中显式设置trust_remote_code: trueInline 神经 RerankPR #4877RAG 重排序成为内建能力无需外部服务详见新特性日志迁移到 structlogPR #5215日志输出变为结构化 key-value 格式依赖旧格式的日志解析工具需更新三、新特性详解1. 推理Reasoning输出支持0.7 为 Responses API 补齐了推理链路推理输出模型可返回 reasoning/thinking 轨迹作为 response output 的一部分PR #5206推理作为合法会话项reasoning 轨迹可进入会话历史参与多轮上下文PR #5392OpenAI spec 新增reasoning输出类型PR #5357。结合 0.5 引入的reasoning.effort参数开发者现在可以这样使用response client.responses.create( modelopenai/gpt-5, reasoning{effort: high}, input[{role: user, content: Complex problem...}], ) # response.output 中可包含 reasoning 类型的条目2. 全面可观测性指标0.7 在四个层面建立了 OpenTelemetry 指标体系均由 gyliu513 贡献API 层请求指标PR #5201请求计数、延迟、错误率推理指标PR #5320token 吞吐、时延、模型级指标Vector IO 指标PR #5096向量存储操作的性能指标Responses API 参数使用指标PR #5255跟踪参数使用模式。仓库的 telemetry/constants.py 中固化了这套指标命名体系例如ogx.request.requests_total / ogx.request_duration_seconds / ogx.concurrent_requests ogx.inference.duration_seconds / ogx.inference.time_to_first_token_seconds / ogx.inference.tokens_per_second ogx.vector_io.inserts_total / ogx.vector_io.queries_total / ogx.vector_io.retrieval_duration_seconds ogx.tool_runtime.invocations_total / ogx.tool_runtime.duration_seconds对应实现分布在 src/ogx/telemetry 下的inference_metrics.py、tool_runtime_metrics.py、vector_io_metrics.py配合 scripts/telemetry 目录中的 Prometheus 配置与 Grafana 仪表盘 JSON如ogx-request-metrics.json、ogx-inference-metrics.json即可快速搭建监控面板。3. Inline 神经 RerankPR #4877r3v5RAG 管线现在可以直接使用内建的神经重排序能力借助 cross-encoder 模型在本地完成重排序无需外部 rerank 服务即可提升检索质量。这与 0.5 引入的reranker_type混合检索能力如reciprocal_rank_fusion形成互补。4. Inline Docling Provider结构感知 PDF 解析PR #5049alinaryan新增inline::docling文件处理器用于高质量文档摄取结构感知分块基于语义边界标题、章节切分而非粗暴按字数截断布局保留表格、列表、嵌套结构转换为 Markdown多格式支持PDF、DOCX、PPTX、HTML 与图片更好的 RAG 质量带标题元数据的结构化 chunk 提升检索相关度。在 file_processors 注册表 中可见其完整定义依赖docling包、以 worker 模式运行、依赖 files API、可选依赖 inference API。启动示例OLLAMA_URLhttp://localhost:11434/v1 ogx stack run \ --providers file_processorsinline::docling,filesinline::localfs,vector_ioinline::faiss,inferenceinline::sentence-transformers,inferenceremote::ollama \ --port 8321或在自定义run.yaml中声明file_processors: - provider_id: docling provider_type: inline::docling config: {}注意VLM 文档处理目前不可用。该 provider 以 worker 模式运行而 auto-routed 推理暂无法在 worker 进程中重建因此配置了vlm_model会直接启动失败而非静默降级。保持vlm_model不设置即可使用标准非 VLM 管线。5. 背景响应取消PR #5268cdoern新增取消端点允许客户端中止长时间运行的背景响应生成同时修复了取消流程中的竞态条件PR #5363。6. Connector API 升至 v1betaPR #5129用于 MCP 服务器管理的 Connector API 从v1alpha提升到v1betaAPI 稳定性信号增强。相关路由位于 src/ogx_api/connectors。7.stream_options参数支持PR #4815gyliu513Chat Completions 流式响应支持stream_options其中include_usage可在流式输出末尾附带用量信息进一步对齐 OpenAI 一致性。8. 推理透传的请求头转发PR #5134skamenan7推理透传 provider 现支持将自定义请求头转发至上游后端便于传递鉴权、租户等上下文信息。9. Responses API 支持表单编码PR #5193r3v5Responses API 除 JSON 外新增接受application/x-www-form-urlencoded内容类型。10. PGVector 能力增强元数据过滤器PR #5111franciscojavierarceo向量检索支持 metadata filters同时表名中的 f-string 用法被替换以消除注入风险可配置 asyncpg 连接池PR #5160iamemilioPostgreSQL 连接池的最小/最大连接数、超时均可通过 provider 配置。11. Provider 兼容性矩阵PR #5113、#5115新增 Responses API 的 provider 兼容性矩阵与 provider 版本跟踪帮助用户判断每个 provider 支持哪些特性。仓库中的 provider_compat_matrix.py 即用于生成该矩阵。12. Responses API 测试覆盖分析器PR #5101新增一致性标注conformance annotations与测试覆盖分析器跟踪 OpenAI 规范覆盖度。仓库对应脚本为 responses_test_coverage.py。四、新 ProviderInfinispan Vector-IOPR #4839rigazilla新增基于 Infinispan 的分布式高性能向量存储 providerremote::infinispan一类。结合 0.5 引入的 Elasticsearch、OCI 26aiOGX 的向量存储生态进一步扩大。五、重构、性能与安全重构WatsonX 去除 LiteLLM 依赖PR #5133改用 OpenAI mixin更简洁可维护file_search与 legacyknowledge_searchtool_groups 解耦PR #5175大文件拆分为聚焦模块PR #5281、#5299Tools API 迁入 FastAPI RouterPR #5246移除未使用的LiteLLMOpenAIMixinPR #5159。性能改进启动内存优化vector_ioprovider 懒加载 numpy、faiss、sqlite_vecPR #5118prompt_guard懒加载 torch、transformersPR #5117embedding_mixin懒加载 torchPR #5116懒加载 braintrust autoevals减少约 63MB 空闲内存PR #5078。安全修复路径穿越与 header 注入防护PR #5086CVE-2026-33236nltk 升至 3.9.4PR #5259CVE-2026-30922pyasn1 升至 0.6.3PR #5207CVE-2026-32597pyjwt 升至 2.12.0PR #5127。值得关注的 Bug 修复修复 provider_data_var 上下文泄漏PR #5227阻止 fire-and-forget 后台任务中的 OTel 上下文泄漏PR #5168禁用 asyncpg OTel 自动埋点以避免重复 DB spanPR #5158修复 vLLMhealth()/rerank()的 TLS 与鉴权凭据问题PR #5340、#5374storefalse时关闭会话同步防止数据泄漏PR #5305多 worker 服务器的双栈 IPv6 支持PR #5284ogx stack run --providers自动展开 provider 依赖PR #4654tiktokencl100k_base编码在镜像构建期预缓存PR #5391。六、文档与 CI/CD文档方面README 与文档全面改为以 OpenAI API 兼容性为主线PR #5323新增面向 AI 编码 Agent 的 AGENTS.mdPR #5211新增架构文档与模块级 READMEPR #5213Docling 使用文档PR #5329多租户隔离示例PR #5176公开类与函数补全 docstringPR #5267。CI/CD 方面PR 自动录制集成测试并支持多 providerPR #5123新增 Bedrock、WatsonX、Azure AI Foundry 的 Responses API 集成测试录制PR #5254、#5120、#5107Vertex AI 录制工作流接入 GCP Workload Identity FederationPR #5276引入 conventional-pre-commit、markdownlint、actionlint、mypy 等钩子PR #5251、#5271、#5285、#5269以 GitHub merge queue 替换 MergifyPR #5383定时 CI 覆盖最近 3 个发布分支PR #5277。七、0.7 升级清单Before / After升级前硬破坏性变更必须完成# 1. 检查 fine-tuning API 使用 grep -r post-training\|fine.tuning\|fine_tuning your-project/ # 2. 检查 provider 名称 grep -r meta-reference your-config-directory/ grep -r rag-runtime your-config-directory/ grep -r starter-gpu your-config-directory/ # 3. 检查工具名 grep -r knowledge_search your-project/ # 4. 检查 API 端点 grep -r /agents your-project/ # 5. 检查 tool_groups 注册 grep -r tool_groups\|register_tool your-project/ # 6. 检查已移除的 provider grep -r remote::tgi\|remote::huggingface your-config-directory/ # 7. 检查废弃的模型端点 grep -r register_model\|unregister_model your-project/对应替换规则速查旧值新值inline::meta-referenceinline::builtininline::rag-runtimeinline::file-searchbuiltin::ragbuiltin::file-searchstarter-gpustarterknowledge_search工具名file_search/agents/*端点/responses/*remote::tgi/remote::huggingfaceremote::vllm/remote::ollama等register_model/unregister_model标准模型 CRUD 端点升级后若依赖旧日志格式解析请适配 structlog 的结构化 key-value 输出若使用 sentence_transformers 自定义模型且需要远程代码执行请在 provider 配置中添加trust_remote_code: true若使用 OpenAPI 生成客户端请基于新 schema 重新生成schema 已包含reasoning等一致性字段需要 Prometheus/Grafana 监控时参考 scripts/telemetry 下的采集与仪表盘配置。延伸阅读OGX 0.5 Release Notes上一版本的 FastAPI Router 迁移起点与 Agents→Responses 过渡Responses API 文档 与 API 概览0.7 之后的标准用法file_search 内建实现RAG 文件搜索的当前形态telemetry 指标常量 与 可观测性博客指标命名与采集方式starter 发行版配置以远程推理 provider 组织发行版的参考模板【免费下载链接】ogxOpen GenAI Stack项目地址: https://gitcode.com/GitHub_Trending/ll/ogx创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表