v2.21.0 (2026-07-29)
Pydantic AI 发布 v2.21.0,新增 per_request_input_tokens_limit 到 UsageLimits,并修复了 KnownModelName 刷新和 Google 图片 ID 问题。
Development
- First Reportv2.21.0 (2026-07-29)Pydantic AI
- Current AssessmentAI API 提供商正逐步提供更细粒度的使用限制,以平衡成本控制和用户体验。per_request_input_tokens_limit 可能成为行业标准功能,推动其他平台跟进。Agent Pulse · analysis
Pydantic AI 于 2026-07-30 发布 v2.21.0 版本,主要新增功能:在 UsageLimits 中增加 per_request_input_tokens_limit 字段,允许用户限制单次请求的输入 token 数。同时修复了从 Gateway 探针刷新 KnownModelName 以及稳定 Google 图片 ID 的问题。
per_request_input_tokens_limit 的引入意味着开发者可以更精细地控制每个请求的 token 消耗,有助于防止意外超支或滥用。这暗示 Pydantic AI 的 UsageLimits 正在向更细粒度的配额管理演进。
AI API 提供商正逐步提供更细粒度的使用限制,以平衡成本控制和用户体验。per_request_input_tokens_limit 可能成为行业标准功能,推动其他平台跟进。
对于使用 Pydantic AI 的企业,该功能可降低因单个请求消耗过多 token 导致的成本风险,提升预算可预测性。
预计更多 AI 平台将引入类似的 per-request 限制,并可能扩展到输出 token 或总 token 限制。开发者需关注 API 配额管理的最佳实践。