CPU3D3D、视频与音频的 AI 工具

Pydantic AI 2.51.0:支持 GPT-Live,两周内发布六个版本

2026 年 9 月 25 日,Pydantic AI 平台发布了 2.51.0 版本——这是一个用于构建 AI 智能体的 Python 框架,具有类型化的智能体循环。自上次解析以来共积累了六个版本:2.46.0、2.47.0、2.48.0、2.49.0、2.50.0 和 2.51.0。

新功能

  • 支持 OpenAI GPT-Live——2.51.0 中新增了用于 realtime 会话的 OpenAILiveModel 模型,同时提供了 context_window_used 参数,可根据提供商数据显示上下文窗口的占用情况。
  • 用于路由的 DecisionModel——2.50.0 中出现了基类 DecisionModel,它允许智能体按名称选择路由,并带有可选的 decision_route_threshold 阈值,取代了此前的 tool-call lean 机制。
  • TypeSafeModel 改进——2.47.0—2.49.0 扩展了对类型的处理:支持将 None 作为路由、通过 BoolCriteria 描述 bool 字段的取值、将整数作为选项,以及对嵌套模型应用默认值。
  • Realtime 会话更可靠——2.49.0 中新增了 RealtimeSession.wait_for_reply() 方法,修复了流式音频的传输以及接收端的错误处理,而 2.51.0 中则修复了播放已完成回复时文本增量的缓冲问题。
  • 性能优化——2.51.0 中智能体图现在会被缓存,而不是在每次 Agent.run() 时重新构建;当 toolset 或 capability fan-out 中只有一个子元素时,不再创建 task group。
  • 新模型和提供商——2.48.0—2.50.0 中新增了对 OpenAI gpt-6-sol 和 gpt-6-luna、Claude Opus 5.5 以及 realtime 模型 Gemini 3.8 Live 的支持;2.49.0 中出现了用于设备授权的 GitHubCopilotOAuthFlow。

平台功能

Pydantic AI 是一个带有类型化智能体循环的 Python SDK,其中模型可通过一行字符串替换,同一个智能体可以运行在 Web 前端、终端、语音通话、后台队列或 Git 中。该平台支持多个智能体协同、自定义工具和函数、MCP、智能体记忆、人工确认、图与状态保存、智能体质量评估、语音与讲话,以及处理图片和文档。

用自己的模型替代云服务

自己的模型通过 Ollama 接入——这是文档中提到的唯一方式。平台通过命令 uv add pydantic-ai pydantic-ai-harness 或 uv add pydantic-ai 安装。许可证——MIT。

与同类产品的区别

在可比较的框架中——CrewAI、Agno 和 AgentScope——只有 Pydantic AI 在文档中声明了通过 Pydantic Evals 进行智能体质量评估。同时,大多数同类产品都具备的 A2A 协议和知识库(RAG),在 Pydantic AI 的文档中并未提及。自定义工具、MCP 支持和智能体记忆这四个平台均有声明。

Pydantic AICrewAIAgnoAgentScope
类型框架框架框架框架
语言PythonPythonPythonPython
许可证MITMITApache-2.0Apache-2.0
GitHub 星标20 18258 72842 23331 923
90 天内发布次数6523296
多个智能体协同有有—有
自定义工具和函数有有有有
MCP 支持有有有有
A2A 协议—有有有
智能体记忆有有有有
知识库(RAG)—有有有
沙箱中执行代码———有
人工确认有有有—
图与状态保存有有——
追踪与调试——有—
智能体质量评估有———
语音与讲话有——有
自有服务器与 Docker——有—
图片与文档有——有
自有模型:Ollama有有有有
自有模型:LM Studio—有——
自有模型:OpenAI 兼容 API——有—

依据各项目 README 和文档于 26.09.2026 核对:「有」表示其中声明了该功能,破折号表示未提及(这并不意味着没有该功能)。星标和发布次数——依据 GitHub 数据。

值得升级的是那些从事 realtime 语音工作并期待 GPT-Live 或更可靠会话的人,而值得关注的是那些需要在智能体全流程中实现类型化以及内置质量评估的人。可以在 CPU3D 动态中跟踪自己智能体平台的新版本发布。

相关阅读