pydantic的高阶玩法

开发者福利!热门AI工具限时免费用 购周边即赠Coding Plan Lite,Claude Code、Cursor等20+工具畅享,效率翻倍! 阅读详情

pydantic是一个Python的数据验证和转换库,它的特点是轻量、快速、可扩展、可配置。笔者常用的用于数据接口schema定义与检查。

具体的基本用法本文不再做过多的介绍,可以参考pydantic官方文档。本文主要是结合实际项目开发中遇到的问题和解题思路,介绍一些pydantic的高阶玩法。

当前现状

在项目中,pydantic的定义是在数据的出口进行规范化,从而使得下游接受方能更快地去解析和清洗这些数据。

from pydantic import BaseModel, Field

# 定义数据模型
class Project(BaseModel):
    url: str = Field(...)
    title: str = Field(...)
    content: str = Field(...)
    company: List[Dict] = Field(default=[])
    industry: str = Field(...)

以上是简单的一个数据模型定义,代码仅为示例,隐去了一些字段和配置。也就是我们必须传输给Project模型对应的数据才可以通过它的数据校验,否则就无法继续向下(可能是发往下游)

这么做一直以来没什么问题,直到本次项目中的接口返回出现了大更新,使得之前的所有代码层做的数据字段映射必须重新对应匹配。

比如之前title字段对应的是title,现在变成了detail-article-title

这使得我们必须在代码层做诸如:

# project_data均为接口返回的数据,加数据演示

# 之前的代码
project_data = {
    "url": "https://www.baidu.com",
    "title": "百度一下,你就知道",
}
project = Project(
    **project_data
)

# 现在的代码
project_data = {
  "detail": {
      "url": "xxx"
      "article": {
          "title": "项目标题",
      }
  }
}
project = Project(
    url=project_data["detail"]["url"],
    title=project_data["detail"]["article"]["title"],
)


以上代码取值变得复杂,这还没考虑到数据可能存在出错的问题,比如detail字段不存在,这样就会导致KeyError异常。

而且这并不是夸张的举例(因为事实情况更复杂)。

我怎么能容忍这种情况呢?

解决方案

我当然不是想摒弃掉pydantic,而是想找到一种结合它更优雅的方式来解决这个问题。

于是我第一时间想到了jmespath模块,因为它是一个JSON查询语言,可以用来在JSON数据中查找和提取数据。

from jmespath import search
project_data = {
    "detail": {
        "article": {
            "title": "项目标题",
        }
    }
}

title = search("detail.article.title", project_data)
assert title == "项目标题"  # True

# 即使是path不存在,也不会异常,而是返回None
assert search("detail.article.title1", project_data) is None  # True


所以我打算做一个结合pydanticjmespath的方式来解决这个问题。


class Project(BaseModel):
    url: str = Field(...)
    title: str = Field(...)
    content: str = Field(...)
    company: List[Dict] = Field(default=[])
    industry: str = Field(...)

    @root_validator(pre=True, skip_on_failure=True)
    def data_converter(cls, v):
        return {
            "url": search("detail.id", v),
            "title": search("detail.article.title", v),
            "content": search("detail.article.content", v),
            "company": search("company[*].name", v),
            "industry": search("industry", v)
        }
    
    @validator("url")
    def url_validator(cls, v):
        # 由于这里的v是拿到的ID,需要组合成url
        return f"https://xxxxx/{v}"

从代码中可以知道,我是在root_validator中提前做了数据的转换,将jmespath的查询结果赋值给对应的字段。

但是做完之后我越看越变扭,我为了做这个事情,先要申明所有字段,还要对这些字段一一映射。

于是,我想到了pydanticConfig类,它可以用来配置pydantic的一些行为。而且通过查看源码,我认为我可以通过Field类中输入一个path变量,告诉未来的处理器,这个path是用来做数据提取的。

class Project(BaseModel):
    url: str = Field(..., path="temporaryLibrary.id")
    company_names: str = Field(..., path="company[0].enterprise.name")
    versions: List[str] = Field(..., path="versionList[*].id")

当然现在代码是没有任何意义的,因为path是我们自定义的,pydantic并不知道如何处理它。

所以下一步我们要做的是,如何更好的让pydantic知道如何处理path

在多次翻阅它源代码,并结合官方文档中对Model类的介绍,我找到了一个可行的方案。

Pydantic models can be created from arbitrary class instances to support models that map to ORM objects.

也就是说,我可以将原始数据通过from_orm传递给pydantic的模型,然后通过Data binding的方式,将数据绑定到模型中。Data binding允许我们自定义数据的取值来源。

class ProjectGetter(GetterDict):

    def get(self, key: str, default: Any) -> Any:  # noqa
        # 由于getter_dict所能拿到的“数据权限”相对较低,
        # 也就是它的权限仅仅是处理数据,而不是处理模型,
        # 所以我们需要自己去拿到模型,然后再去拿到path
        model, data = self._obj['model'], self._obj['data']
        for name, field in model.__fields__.items():
            path = field.field_info.extra.get('path')
            if path and name == key:
                return search(path, data)
        return default

class Project(BaseModel):
    url: str = Field(..., path="detail.id")
    company_names: str = Field(..., path="company[0].enterprise.name")
    versions: List[str] = Field(..., path="versionList[*].id")

    @validator("url")
    def url_validator(cls, v):
        return f"https://www.baidu.com/{v}"

    class Config:
        # 通过orm_mode指定数据的来源
        orm_mode = True
        # 通过getter_dict指定数据的获取方式
        getter_dict = ProjectGetter

project_data = {
    "detail": {
        "id": 1,
        "article": {
            "title": "项目标题",
        }
    },
    "company": [
      {
        "enterprise": {
          "name": "企业名称1"
        }
      },
      {
        "enterprise": {
          "name": "企业名称2"
        }
      }
    ],
    "versionList": [{"id": "1.0"}, {"id": "2.0"}]
}
project = Project.from_orm({"model": Project, "data": project_data})
print(project)
# url='https://www.baidu.com/1' company_names='企业名称1' versions=['1.0', '2.0']

这样我们在业务端,只需要对Field指定其对应数据提取的path,而不需要再去写一堆的validator或者是在数据进入前做一堆的数据转换。

总结

通过这个小例子,我们可以看到,pydantic的灵活性是非常强的,它可以通过Config类来配置一些行为,而且它的Field类也可以通过extra参数来传递一些额外的信息。这大大的提高了我们的对数据的处理能力。笔者也会在后续的文章中,继续分享pydantic的一些使用技巧。

---------------------------END---------------------------

题外话

当下这个大数据时代不掌握一门编程语言怎么跟的上脚本呢?当下最火的编程语言Python前景一片光明!如果你也想跟上时代提升自己那么请看一下.

在这里插入图片描述

感兴趣的小伙伴,赠送全套Python学习资料,包含面试题、简历资料等具体看下方。


👉CSDN大礼包🎁:全网最全《Python学习资料》免费赠送🆓!(安全链接,放心点击)

一、Python所有方向的学习路线

Python所有方向的技术点做的整理,形成各个领域的知识点汇总,它的用处就在于,你可以按照下面的知识点去找对应的学习资源,保证自己学得较为全面。

img
img

二、Python必备开发工具

工具都帮大家整理好了,安装就可直接上手!img

三、最新Python学习笔记

当我学到一定基础,有自己的理解能力的时候,会去阅读一些前辈整理的书籍或者手写的笔记资料,这些笔记详细记载了他们对一些技术点的理解,这些理解是比较独到,可以学到不一样的思路。

img

四、Python视频合集

观看全面零基础学习视频,看视频学习是最快捷也是最有效果的方式,跟着视频中老师的思路,从基础到深入,还是很容易入门的。

img

五、实战案例

纸上得来终觉浅,要学会跟着视频一起敲,要动手实操,才能将自己的所学运用到实际当中去,这时候可以搞点实战案例来学习。

img

六、面试宝典

在这里插入图片描述

在这里插入图片描述

简历模板在这里插入图片描述
👉 CSDN大礼包:gift::[全网最全《Python学习资料》免费赠送:free:!](https://blog.csdn.net/weixin_68789096/article/details/132275547?spm=1001.2014.3001.5502) (安全链接,放心点击)

若有侵权,请联系删除

Python学习之-Pydantic详解 Pydantic 是一个 Python 库,用于数据解析和验证。它主要基于 Python 类型提示来实现数据的校验和设定限制条件。在 Pydantic 中,BaseModel 是一个核心基类,用于创建数据模型。Pydantic 的主要优势在于其结合了灵活性和强大的数据处理能力,同时简化了常规的数据校验任务,让开发人员更专注于业务逻辑的实现。它通常用于快速开发中,特别是在构建API、数据交互和设置管理场景中发挥重要作用。 阅读详情

相关推荐

FastAPI 开发中数据校验利器 Pydantic 介绍与集成使用

前言当我们在处理一些数据来自系统外部的时候,可能来自 API、终端用户输入或者其他途径,Web 开发中有句话叫做:永远不要相信用户的输入。所以,我们可能需要检查、校验这些数据,将这些数据格式化、标准化,以至于这些数据满足我们真实程序的数据输入,保证项目的正确执行。Pydantic 介绍Pydantic 是一个 Python...

宇宙之一粟的技术漂泊之旅 2073

Pydantic:目前最流行的Python数据验证库

在处理来自系统外部的数据,如API、终端用户输入或其他来源时,我们必须牢记开发中的一条基本原则:“永远不要相信用户的输入因此,我们必须对这些数据进行严格的检查和验证,确保它们被适当地格式化和标准化。这样做的目的是为了确保这些数据符合我们的程序所需的输入规范,从而保障项目能够正确且高效地运行。

海哥python的博客 9195

【Python】 Pydantic

Pydantic 是一个基于 Python 类型提示 (Type Hints) 进行数据验证、序列化和反序列化、以及设置管理的库。它利用 Python 3.6+ 引入的类型注解,使得开发者能够以声明式的方式定义数据模型,并自动获得强大的数据校验能力和清晰的数据结构。简单来说,你通过编写 Python 类来定义你的数据应该是什么样子(字段、类型、约束等),Pydantic 则负责确保任何输入数据都符合这些定义。如果数据有效,Pydantic 会创建一个包含该数据的模型实例;如果数据无效,它会返回一个易于理解的

宅男很神经 2764

python库pydantic简易教程

pydantic 库是 python 中用于数据接口定义检查与设置管理的库。pydantic 在运行时强制执行类型提示,并在数据无效时提供友好的错误。1.与 IDE/linter 完美搭配,不需要学习新的模式,只是使用类型注解定义类的实例2.多用途,BaseSettings 既可以验证请求数据,也可以从环境变量中读取系统设置快速3.可以验证复杂结构4.可扩展,可以使用validator装饰器装饰的模型上的方法来扩展验证。

weixin_43936332的博客 9445

【超详细】Python——pydantic高阶玩法

通过这个小例子,我们可以看到,pydantic的灵活性是非常强的,它可以通过Config类来配置一些行为,而且它的Field类也可以通过extra参数来传递一些额外的信息。这大大的提高了我们的对数据的处理能力。笔者也会在后续的文章中,继续分享pydantic的一些使用技巧。

aobulaien001的博客 3884

一文带你玩转pydantic高阶玩法

通过这个小例子,我们可以看到,pydantic的灵活性是非常强的,它可以通过Config类来配置一些行为,而且它的Field类也可以通过extra参数来传递一些额外的信息。这大大的提高了我们的对数据的处理能力。笔者也会在后续的文章中,继续分享pydantic的一些使用技巧。

Saki_Python的博客 1183

Python笔记:Pydantic库简介

pydantic库简介 1. pydantic库是什么 2. pydantic库用法考察 1. 基本使用方法 1. schema基本定义方法 2. 基本的schema实例化方法 3. pydantic基本数据类型 2. 高级数据结构考察 1. enum数据类型 2. 可选数据类型 3. 数据默认值的设置 4. 允许多种数据类型 5. 异名数据传递方法 3. 多级schema定义样例 4. 数据检查方法考察 1. validator用法考察 2. Config方法考察 3. 参考..

codename_cys的博客 4万+

Awesome Pydantic项目贡献指南:如何添加你的Pydantic工具

Awesome Pydantic是一个精心策划的资源列表,收集了与Pydantic相关的各种优秀工具和库。无论你是Pydantic新手还是资深用户,都可以通过贡献自己的项目来丰富这个生态系统。本指南将详细介绍如何为Awesome Pydantic项目添加你的Pydantic工具,帮助更多开发者发现和使用你的作品。 ## 为什么贡献到Awesome Pydantic? 贡献到Awesome Py

gitblog_00803的博客 736

python中pydantic

不知道大家是否非常羡慕C语言等在进行函数传参时,可以指定数据类型来传参呢?我之前有一篇讲过使用typing来指定数据类型,但是其仅仅是能指定数据类型,只能做一个提醒的作用,那么我们如何来结合typing模块,来写一个可以像Java等语言的指定参数类型呢?这里我推荐pydantic库。首先,在学这个库之前,我们需要去回顾一下typing然后,我们来解释一下我们即将要学的库:其使用 Python 类型注释的数据验证和设置管理。pydantic在运行时强制执行类型提示,并在数据无效时提供用户友好的错误。

一个专注于机器学习基础与实战的技术博客,内容涵盖算法推导、模型实现、数学原理与代码实践。用通俗的语言解析复杂概念,记录学习过程中的思考与总结,适合机器学习爱好者和从业者参考。 3122

Pydantic模块学习

本文讲解了pydantic库的使用方法: 1. 如何安装 2. 如何验证数据(字段数据和函数形参) 3. 如何序列化和反序列化 4. 如何验证配置数据

Ethan's Blog 957

Pydantic 全面指南:从入门到高级应用

Pydantic 是一个用于数据验证和设置管理的 Python 库。它通过 Python 类型注解来定义数据模型,并提供了强大的数据验证功能。Pydantic 的主要目标是确保数据在输入和输出时的一致性和有效性。它广泛应用于各种 Python 项目中,特别是在需要处理复杂数据结构和确保数据完整性的场景中。数据验证:确保输入数据符合预定义的类型和结构。序列化:将复杂的数据结构转换为 Python 数据类型,便于处理和传输。错误处理:提供详细的错误信息,帮助开发者快速定位和修复问题。配置管理。

全世界的博客 1万+

Pydantic官方文档

简介 Pydantic 是一个使用Python类型提示来进行数据验证和设置管理的库。Pydantic定义数据应该如何使用纯Python规范用并进行验证。PEP 484 从Python3.5开始引入了类型提示的功能,PEP 526 使用Python3.6中的变量注释语法对其进行了拓展。Pydantic使用这些注释来验证不受信任的数据是否采用了您想要的形式。 示例: from datetime imp...

Bossen的学习历程 6万+

Pydantic】如何在 Pydantic 中实现严格模式校验

Pydantic 支持自定义数据类型,并允许为其定义自己的校验逻辑。自定义数据类型非常适合那些特定领域的严格数据规则。# 正确的用例# 错误的用例model = MyModel(color="123456") # 抛出 ValidationError通过自定义类型,我们可以为HexColor添加非常具体的规则,并确保这些规则在模型校验时生效。Pydantic 是一个强大且灵活的工具,能够帮助开发者快速构建数据模型并进行高效的数据校验。

h1773655323的博客 1495

【Python系列】pydantic版本问题

💝💝💝欢迎来到我的博客,很高兴能够在这里和您见面!希望您在这里可以感受到一份轻松愉快的氛围,不仅可以获得有趣的内容和知识,也可以畅所欲言、分享您的想法和见解。非常期待和您一起在这个小小的网络世界里共同探索、学习和成长。💝💝💝 ✨✨ 欢迎订阅本专栏 ✨✨。

CSDN站内信: https://i.csdn.net/#/msg/chat/qyj19920704 1万+

Python Pydantic 教程

Pydantic 是一个用于数据验证和设置管理的 Python 库,它通过 Python 类型注解来定义数据模型,提供强大的数据验证功能。id: intname: strname: strage: intraise ValueError('必须包含空格')date: date# 控制dict输出print("JSON输出:", record.json(indent=2))print("字典输出:", record.dict())

weixin_45878348的博客 1971

Python——pydantic

Pydantic 是一个用于 Python 的数据验证库,特别适用于构建 RESTful API 服务,尤其是结合 FastAPI 和 Starlette 框架时。它利用 Python 的类型注解系统,可以高效且准确地验证和清理传入应用程序的数据。Pydantic 提供了强类型模式验证,能够确保数据结构一致性和安全性。

pumpkin84514的博客 1360

django-pydantic-field:让Django与Pydantic完美融合

django-pydantic-field:让Django与Pydantic完美融合 项目介绍 在现代化的Web开发中,数据验证和序列化是至关重要的环节。Django作为一款流行的Python Web框架,提供了强大的ORM和表单系统。而Pydantic则以其数据验证和设置管理能力著称。django-pydantic-field正是这样一个开源项目,它将Django的JSONField与Pydan...

gitblog_00446的博客 1137

Pydantic的BaseConfig

Pydantic是一个用于数据验证和设置管理的Python库。它可以通过类型注解来自动生成验证和解析逻辑。BaseConfig是Pydantic模型配置的基类,允许用户定制模型的行为和验证规则。可以在配置类中定义自定义验证器来增加验证逻辑。name: strage: int# 创建模型实例# 赋值时验证user.age = 30 # 成功user.age = -5 # 抛出 ValueError: Age must be a positive number。

jixiaoyu0209的博客 2027
上一篇: 深入了解 Pytest Markers:提升测试用例的组织和控制能力
下一篇: Python内置库:pathlib模块详解
Python_P叔
博客等级 码龄3年 5376粉丝 827原创
评论
成就一亿技术人!
拼手气红包6.0元
还能输入1000个字符
 
 条评论被折叠 查看
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值