AGENT PULSESJCPal Special EditionAI Industry Evidence & Trends
Aug 9, 2026 · Vercel AI SDK

@ai-sdk/openai-compatible@3.0.28

What Happened

Vercel AI SDK 发布 @ai-sdk/openai-compatible@3.0.28,修复当 provider 报告的 reasoning_tokens 大于 completion_tokens 时(如 Baseten 服务推理模型在长度停止时),将 outputTokens.text 钳制为 0,确保文本 token 数不为负。

EVENT STORY

Development

  1. First Report@ai-sdk/cerebras@3.0.28Vercel AI SDK
  2. Industry Response@ai-sdk/deepinfra@3.0.28Vercel AI SDK
  3. Industry Response@ai-sdk/huggingface@2.0.28Vercel AI SDK
  4. Industry Response@ai-sdk/openai-compatible@3.0.28Vercel AI SDK
  5. Current Assessment此补丁反映了推理模型在真实部署中的 token 统计问题,尤其是 reasoning 模型。随着推理模型普及,provider 的 token 报告可能不准确,SDK 需要防御性处理。这提示行业需要更标准化的 token 统计协议。Agent Pulse · analysis
What Changed

Vercel AI SDK 于 2026-08-09 发布 @ai-sdk/openai-compatible@3.0.28,修复了 provider 报告 completion_tokens_details.reasoning_tokens 大于 completion_tokens 时 outputTokens.text 可能为负的问题。该问题在 Baseten 服务推理模型因长度停止时出现。修复将 text 钳制为 0,total 和 reasoning 保持 provider 报告值。此补丁同时更新了 @ai-sdk/deepinfra、@ai-sdk/huggingface 和 @ai-sdk/cerebras 的依赖。

How the Capability Boundary Shifted

该修复表明推理模型在长度停止时可能产生不一致的 token 统计,导致文本 token 数为负。钳制操作确保下游使用 outputTokens.text 的代码不会收到负值,但 total 和 reasoning 仍可能不准确。开发者应关注 provider 的 token 统计准确性,并考虑在应用层进行额外校验。

Why It Matters

此补丁反映了推理模型在真实部署中的 token 统计问题,尤其是 reasoning 模型。随着推理模型普及,provider 的 token 报告可能不准确,SDK 需要防御性处理。这提示行业需要更标准化的 token 统计协议。

Who It Affects

该修复提高了使用推理模型的开发者体验,避免因负 token 数导致的错误,增强了 SDK 的可靠性,对依赖 token 计费或监控的应用有直接价值。

What to Watch Next

未来 SDK 可能进一步处理 token 统计不一致,或提供配置选项。开发者应关注 provider 的更新,并测试推理模型的 token 统计。