arize-phoenix: v20.17.0
Arize Phoenix 发布 v20.17.0 与 v20.18.0(均为 2026-09-30)。v20.17.0 包含 agents、graphql、rest 功能更新,以及 agents、cost、db、ingest、otel 等多项修复,并回滚了 list_experiments 的 sequence_number、sort_dir、sequence_numbers 变更;文档新增 Qdrant 混合检索追踪说明。v20.18.0 新增在 trace tree 中展示 eval 结果。
发展脉络
- 首次出现arize-phoenix: v20.17.0Arize Phoenix Releases
- 行业反馈arize-phoenix: v20.18.0Arize Phoenix Releases
- 当前判断该发布反映 LLM 可观测性工具链的竞争焦点正从「能否采集」转向「采集数据是否一致、可排序、可导出」。同一天内先加后回滚 list_experiments 的排序字段,说明实验列表的排序语义尚未稳定;而修复导出 500 与 ingest 合并问题,指向真实用户已在生产中使用这些路径。可验证下一信号:该排序字段是否在后续版本以稳定形式重新引入。Agent Pulse · 分析
Arize Phoenix 在同一天连续发布 v20.17.0 与 v20.18.0。v20.17.0 的功能项包括:agents 在 bash 工具 span 非零退出码时标记为错误;graphql 为 Dataset.experiments 增加 sort 与 sequenceNumbers;rest 为 list_experiments 增加 sequence_number、sort_dir、sequence_numbers。修复项覆盖 agents 未登录时的内部 GraphQL scope、graphql-core 版本上限、cost 模式匹配、SQLite 上的 SQLAlchemy 2.1 支持、实验 JSON/CSV 导出 500、ingest 双发 gen_ai 消息合并、otel 与 opentelemetry-exporter-otlp-proto-http 1.45 的 register() 崩溃,并回滚了前述 list_experiments 变更。文档侧重命名 run-experiments 页面并新增 Qdrant 混合检索追踪。v20.18.0 的功能是在 trace tree 中展示 eval 结果。
从变更内容看,Phoenix 正在把可观测性数据与评测结果更紧密地绑定:v20.18.0 将 eval 结果直接放进 trace tree,v20.17.0 则修正 ingest 层双发 gen_ai 消息的合并逻辑、otel 导出器兼容性与 SQLite 上的 SQLAlchemy 2.1 支持。这些属于工程稳定性与数据一致性层面的修补,而非能力跃迁。可验证下一信号:后续版本是否把 eval 结果与 trace 的关联扩展到 API 或导出格式,而不仅是 UI 展示。
该发布反映 LLM 可观测性工具链的竞争焦点正从「能否采集」转向「采集数据是否一致、可排序、可导出」。同一天内先加后回滚 list_experiments 的排序字段,说明实验列表的排序语义尚未稳定;而修复导出 500 与 ingest 合并问题,指向真实用户已在生产中使用这些路径。可验证下一信号:该排序字段是否在后续版本以稳定形式重新引入。
对使用 Phoenix 做 LLM 应用观测的团队,本次升级主要降低运维摩擦:修复导出 500、otel 导出器崩溃与 SQLite 兼容问题,可减少自建部署中的故障排查成本;trace tree 内展示 eval 结果可缩短人工比对评测与链路的步骤。但排序字段被回滚意味着依赖该字段的集成需暂缓。可验证下一信号:官方是否发布迁移说明或该字段的替代方案。
若 eval 结果与 trace 的整合继续推进,Phoenix 可能从追踪工具向「追踪+评测」一体化平台演进。可验证下一信号:后续 release notes 中是否出现 eval 结果相关的 API、导出或过滤能力,以及 list_experiments 排序字段是否回归。