pydantic进阶用法示例详解

 更新时间:2023年03月15日 14:24:24   作者:it_miclon  
这篇文章主要为大家介绍了pydantic进阶用法示例详解,有需要的朋友可以借鉴参考下,希望能够有所帮助,祝大家多多进步,早日升职加薪
(福利推荐:【腾讯云】服务器最新限时优惠活动,云服务器1核2G仅99元/年、2核4G仅768元/3年,立即抢购>>>:9i0i.cn/qcloud

(福利推荐:你还在原价购买阿里云服务器?现在阿里云0.8折限时抢购活动来啦!4核8G企业云服务器仅2998元/3年,立即抢购>>>:9i0i.cn/aliyun

正文

pydantic是一个Python的数据验证和转换库,它的特点是轻量、快速、可扩展、可配置。笔者常用的用于数据接口schema定义与检查。

具体的基本用法本文不再做过多的介绍,可以参考pydantic官方文档。本文主要是结合实际项目开发中遇到的问题和解题思路,介绍一些pydantic的高阶玩法。

当前现状

在项目中,pydantic的定义是在数据的出口进行规范化,从而使得下游接受方能更快地去解析和清洗这些数据。

from pydantic import BaseModel, Field

# 定义数据模型
class Project(BaseModel):
    url: str = Field(...)
    title: str = Field(...)
    content: str = Field(...)
    company: List[Dict] = Field(default=[])
    industry: str = Field(...)

以上是简单的一个数据模型定义,代码仅为示例,隐去了一些字段和配置。也就是我们必须传输给Project模型对应的数据才可以通过它的数据校验,否则就无法继续向下(可能是发往下游)

这么做一直以来没什么问题,直到本次项目中的接口返回出现了大更新,使得之前的所有代码层做的数据字段映射必须重新对应匹配。

比如之前title字段对应的是title,现在变成了detail-article-title

这使得我们必须在代码层做诸如:

# project_data均为接口返回的数据,加数据演示

# 之前的代码
project_data = {
    "url": "https://www.baidu.com",
    "title": "百度一下,你就知道",
}
project = Project(
    **project_data
)

# 现在的代码
project_data = {
  "detail": {
      "url": "xxx"
      "article": {
          "title": "项目标题",
      }
  }
}
project = Project(
    url=project_data["detail"]["url"],
    title=project_data["detail"]["article"]["title"],
)

以上代码取值变得复杂,这还没考虑到数据可能存在出错的问题,比如detail字段不存在,这样就会导致KeyError异常。

而且这并不是夸张的举例(因为事实情况更复杂)。

我怎么能容忍这种情况呢?

解决方案

我当然不是想摒弃掉pydantic,而是想找到一种结合它更优雅的方式来解决这个问题。

于是我第一时间想到了jmespath模块,因为它是一个JSON查询语言,可以用来在JSON数据中查找和提取数据。

from jmespath import search
project_data = {
    "detail": {
        "article": {
            "title": "项目标题",
        }
    }
}

title = search("detail.article.title", project_data)
assert title == "项目标题"  # True

# 即使是path不存在,也不会异常,而是返回None
assert search("detail.article.title1", project_data) is None  # True

所以我打算做一个结合pydanticjmespath的方式来解决这个问题。

class Project(BaseModel):
    url: str = Field(...)
    title: str = Field(...)
    content: str = Field(...)
    company: List[Dict] = Field(default=[])
    industry: str = Field(...)

    @root_validator(pre=True, skip_on_failure=True)
    def data_converter(cls, v):
        return {
            "url": search("detail.id", v),
            "title": search("detail.article.title", v),
            "content": search("detail.article.content", v),
            "company": search("company[*].name", v),
            "industry": search("industry", v)
        }
    
    @validator("url")
    def url_validator(cls, v):
        # 由于这里的v是拿到的ID,需要组合成url
        return f"https://xxxxx/{v}"

从代码中可以知道,我是在root_validator中提前做了数据的转换,将jmespath的查询结果赋值给对应的字段。

但是做完之后我越看越变扭,我为了做这个事情,先要申明所有字段,还要对这些字段一一映射。

于是,我想到了pydanticConfig类,它可以用来配置pydantic的一些行为。而且通过查看源码,我认为我可以通过Field类中输入一个path变量,告诉未来的处理器,这个path是用来做数据提取的。

class Project(BaseModel):
    url: str = Field(..., path="temporaryLibrary.id")
    company_names: str = Field(..., path="company[0].enterprise.name")
    versions: List[str] = Field(..., path="versionList[*].id")

当然现在代码是没有任何意义的,因为path是我们自定义的,pydantic并不知道如何处理它。

所以下一步我们要做的是,如何更好的让pydantic知道如何处理path

在多次翻阅它源代码,并结合官方文档中对Model类的介绍,我找到了一个可行的方案。

Pydantic models can be created from arbitrary class instances to support models that map to ORM objects.

也就是说,我可以将原始数据通过from_orm传递给pydantic的模型,然后通过Data binding的方式,将数据绑定到模型中。Data binding允许我们自定义数据的取值来源。

class ProjectGetter(GetterDict):

    def get(self, key: str, default: Any) -> Any:  # noqa
        # 由于getter_dict所能拿到的“数据权限”相对较低,
        # 也就是它的权限仅仅是处理数据,而不是处理模型,
        # 所以我们需要自己去拿到模型,然后再去拿到path
        model, data = self._obj['model'], self._obj['data']
        for name, field in model.__fields__.items():
            path = field.field_info.extra.get('path')
            if path and name == key:
                return search(path, data)
        return default


class Project(BaseModel):
    url: str = Field(..., path="detail.id")
    company_names: str = Field(..., path="company[0].enterprise.name")
    versions: List[str] = Field(..., path="versionList[*].id")

    @validator("url")
    def url_validator(cls, v):
        return f"https://www.baidu.com/{v}"

    class Config:
        # 通过orm_mode指定数据的来源
        orm_mode = True
        # 通过getter_dict指定数据的获取方式
        getter_dict = ProjectGetter

project_data = {
    "detail": {
        "id": 1,
        "article": {
            "title": "项目标题",
        }
    },
    "company": [
      {
        "enterprise": {
          "name": "企业名称1"
        }
      },
      {
        "enterprise": {
          "name": "企业名称2"
        }
      }
    ],
    "versionList": [{"id": "1.0"}, {"id": "2.0"}]
}
project = Project.from_orm({"model": Project, "data": project_data})
print(project)
# url='https://www.baidu.com/1' company_names='企业名称1' versions=['1.0', '2.0']

这样我们在业务端,只需要对Field指定其对应数据提取的path,而不需要再去写一堆的validator或者是在数据进入前做一堆的数据转换。

总结

通过这个小例子,我们可以看到,pydantic的灵活性是非常强的,它可以通过Config类来配置一些行为,而且它的Field类也可以通过extra参数来传递一些额外的信息。这大大的提高了我们的对数据的处理能力。笔者也会在后续的文章中,继续分享pydantic的一些使用技巧。

以上就是pydantic进阶用法示例详解的详细内容,更多关于pydantic进阶用法的资料请关注程序员之家其它相关文章!

相关文章

  • 利用nohup来开启python文件的方法

    利用nohup来开启python文件的方法

    今天小编就为大家分享一篇利用nohup来开启python文件的方法,具有很好的参考价值,希望对大家有所帮助。一起跟随小编过来看看吧
    2019-01-01
  • Pandas?DataFrame数据修改值的方法

    Pandas?DataFrame数据修改值的方法

    本文主要介绍了Pandas?DataFrame修改值,文中通过示例代码介绍的非常详细,具有一定的参考价值,感兴趣的小伙伴们可以参考一下
    2022-03-03
  • python编写弹球游戏的实现代码

    python编写弹球游戏的实现代码

    这篇文章主要介绍了python编写弹球游戏的实现代码,需要的朋友可以参考下
    2018-03-03
  • python操作redis数据库的三种方法

    python操作redis数据库的三种方法

    这篇文章主要介绍了python操作redis数据库的三种方法,帮助大家更好的理解和使用python,感兴趣的朋友可以了解下
    2020-09-09
  • python 字符串和整数的转换方法

    python 字符串和整数的转换方法

    今天小编就为大家分享一篇python 字符串和整数的转换方法,具有很好的参考价值,希望对大家有所帮助。一起跟随小编过来看看吧
    2018-06-06
  • python list的index()和find()的实现

    python list的index()和find()的实现

    这篇文章主要介绍了python list的index()和find()的实现,文中通过示例代码介绍的非常详细,对大家的学习或者工作具有一定的参考学习价值,需要的朋友们下面随着小编来一起学习学习吧
    2020-11-11
  • Python爬虫获取基金变动信息

    Python爬虫获取基金变动信息

    这篇文章主要介绍了Python爬虫获取基金变动信息,问基于上一篇文章得内容介绍围绕python的相关资料展开全文,需要的小伙伴可以参考一下
    2022-05-05
  • pandas多层索引的创建和取值以及排序的实现

    pandas多层索引的创建和取值以及排序的实现

    这篇文章主要介绍了pandas多层索引的创建和取值以及排序的实现,文中通过示例代码介绍的非常详细,对大家的学习或者工作具有一定的参考学习价值,需要的朋友们下面随着小编来一起学习学习吧
    2021-03-03
  • Python学习之字符串格式化

    Python学习之字符串格式化

    这篇文章主要介绍了Python实现字符串格式化输出的方法,结合具体实例形式总结分析了Python字符串格式化输出的各种常用操作技巧,需要的朋友可以参考下
    2021-10-10
  • Python?flask框架post接口调用示例

    Python?flask框架post接口调用示例

    这篇文章主要介绍了Python?flask框架post接口调用,结合实例形式分析了基于flask框架的post、get请求响应及接口调用相关操作技巧,需要的朋友可以参考下
    2019-07-07

最新评论

?


http://www.vxiaotou.com