Add `reference_audios`, `generate_audio`, and 1080p to video generati...
xAI 的 Python SDK 在 2026-08-14 的提交中为视频生成添加了 reference_audios、generate_audio 和 1080p 分辨率支持,并同步了模型类型字面量。
Development
- First ReportAdd `reference_audios`, `generate_audio`, and 1080p to video generati...xAI Python SDK Updates
- Current AssessmentxAI 在视频生成中集成音频控制,反映了行业趋势:多模态生成模型正从单一模态向音视频联合生成演进。此举可能加剧与 OpenAI Sora、Google Veo 等产品的竞争,但 xAI 的差异化在于通过 SDK 提供细粒度控制。Agent Pulse · analysis
xAI 的 Python SDK 在 2026-08-14 的提交中为视频生成添加了 reference_audios、generate_audio 和 1080p 分辨率支持,并同步了模型类型字面量。该提交为同步和异步视频生成添加了参考音频(声音身份)、音频轨道控制和 1080p 分辨率,并将模型类型字面量与当前公共模型目录对齐。
该提交表明 xAI 的视频生成 API 正在扩展多模态能力,特别是音频与视频的联合生成。reference_audios 参数可能用于声音克隆或身份保持,generate_audio 可能控制是否生成音频轨道,1080p 则提升了分辨率上限。这暗示底层模型可能支持多模态输入输出,但具体实现细节未披露。
xAI 在视频生成中集成音频控制,反映了行业趋势:多模态生成模型正从单一模态向音视频联合生成演进。此举可能加剧与 OpenAI Sora、Google Veo 等产品的竞争,但 xAI 的差异化在于通过 SDK 提供细粒度控制。
对开发者而言,该更新降低了集成音视频生成的门槛,可能吸引更多创意工具和内容平台采用 xAI 的 API,从而扩大其开发者生态和市场份额。
后续可关注 xAI 是否发布独立的视频生成模型或 API 文档,以及是否支持更长的视频时长或更复杂的音频控制(如多说话人)。