AGENT PULSESJCPal Special EditionAI Industry Evidence & Trends
Sep 19, 2026 · Pydantic AI

v2.46.0 (2026-09-18)

What Happened

Pydantic AI 发布 v2.46.0(2026-09-18)。该版本新增多项功能:TypeSafeModel 可在 Jev 能表达时填充工具参数、支持按类型选择填充输出类型联合;新增 RealtimeSession.wait_for_playback();为 ModelProfile 增加 supports_text_output,并让 LLMJudge 与 GEval 可在不支持该能力的模型上运行;新增 typesafe_boolean_threshold;为 TemporalDurability 增加 event_stream_topic 以通过 Workflow Streams 流式传输 agent 事件;新增 Choices 辅助类与 Enum 成员 docstring 描述。修复项包括:TypeSafeModel 拒绝超出 Jev 可选范围的选项、实时工具抛错时记录失败的 ToolReturnPart、在 CombinedToolset 与 FunctionToolset 中按实时 ToolDefinition 派发工具调用。

EVENT STORY

Development

  1. First Reportv2.46.0 (2026-09-18)Pydantic AI
  2. Current Assessment该发布显示 agent 框架的竞争点正从「能否调用工具」转向「输出是否可被类型系统与评测管线约束」。把评测器(LLMJudge、GEval)与模型能力标志解耦,降低了跨模型评测的接入成本;把 agent 事件接入 Workflow Streams,则指向与持久化工作流引擎的绑定。可验证下一信号:其他 agent 框架是否跟进类似的模型能力标志与类型安全工具参数机制。Agent Pulse · analysis
What Changed

Pydantic AI 发布 v2.46.0(2026-09-18),改动集中在类型安全的结构化输出与实时会话两条线上。功能侧:TypeSafeModel 支持在 Jev 可表达时填充工具参数、支持先选类型再填充输出类型联合;新增 typesafe_boolean_threshold 控制 yes/no 判定阈值;ModelProfile 新增 supports_text_output,使 LLMJudge 与 GEval 可在不具备该能力的模型上运行;RealtimeSession 新增 wait_for_playback();TemporalDurability 新增 event_stream_topic,可通过 Workflow Streams 流式传输 agent 事件;新增 Choices 辅助类与基于 Enum 成员 docstring 的选项描述。修复侧:TypeSafeModel 拒绝超出 Jev 可选范围的选项;实时工具抛错时记录失败的 ToolReturnPart,并将工具调用与其语音保留在同一 ModelResponse;CombinedToolset 与 FunctionToolset 按实时 ToolDefinition 派发工具调用。

How the Capability Boundary Shifted

从条目看,该版本在把「模型输出」收敛为可校验类型:TypeSafeModel 负责参数与输出联合的填充,typesafe_boolean_threshold 把二值判定显式参数化,supports_text_output 则把模型能力差异从评测逻辑中解耦。实时侧把工具调用与语音绑定在同一 ModelResponse,并新增播放等待接口,说明实时 agent 的生命周期管理正在被显式建模。可验证下一信号:后续版本是否把 event_stream_topic 与 wait_for_playback 写入稳定 API 文档,以及 TypeSafeModel 是否扩展到更多 Jev 表达形式。

Why It Matters

该发布显示 agent 框架的竞争点正从「能否调用工具」转向「输出是否可被类型系统与评测管线约束」。把评测器(LLMJudge、GEval)与模型能力标志解耦,降低了跨模型评测的接入成本;把 agent 事件接入 Workflow Streams,则指向与持久化工作流引擎的绑定。可验证下一信号:其他 agent 框架是否跟进类似的模型能力标志与类型安全工具参数机制。

Who It Affects

对使用 Pydantic AI 构建 agent 的团队,该版本降低了跨模型评测与实时会话的接入成本:supports_text_output 让评测器不必绑定特定模型能力,wait_for_playback 与工具调用/语音同响应减少了实时交互的状态管理代码。可验证下一信号:升级后评测管线是否能在不支持文本输出的模型上直接复用,以及实时工具报错路径是否产生可观测的失败记录。

What to Watch Next

若类型安全填充与能力标志成为惯例,agent 框架的差异将更多体现在与工作流引擎、评测管线的集成深度,而非单次工具调用成功率。可验证下一信号:观察后续版本是否出现围绕 event_stream_topic 的持久化与重放文档,以及是否有第三方模型适配层声明 supports_text_output。