0

0

使用 SQL ON CONFLICT 避免重复记录并报告操作结果

碧海醫心

碧海醫心

发布时间:2025-11-18 11:49:50

|

614人浏览过

|

来源于php中文网

原创

使用 sql on conflict 避免重复记录并报告操作结果

本文介绍如何使用 SQL 的 `ON CONFLICT` 子句来避免在数据库中插入重复记录,并提供一种方法来报告记录是新创建的还是已存在的。通过在 `name` 列上添加唯一索引,我们可以利用 `INSERT ... ON CONFLICT DO NOTHING` 语句,结合后续查询,实现高效的重复记录检查和创建逻辑,并返回操作结果。

在处理数据库操作时,经常需要检查要插入的数据是否已存在。如果存在,则不执行插入操作;如果不存在,则创建新记录。同时,还需要向用户报告操作结果,即记录是新创建的还是已存在的。本文将介绍如何使用 SQL 的 ON CONFLICT 子句,结合唯一索引,来实现这一需求,并提供 Python 代码示例。

前提条件

  • 熟悉 SQL 语法,特别是 INSERT 语句和 ON CONFLICT 子句。
  • 了解数据库唯一索引的概念和作用。
  • 使用支持 ON CONFLICT 子句的数据库,如 PostgreSQL。

解决方案

核心思想是利用 INSERT ... ON CONFLICT DO NOTHING 语句尝试插入新记录。如果记录已存在(违反唯一约束),则不执行任何操作。然后,通过查询数据库来确定记录是否存在,从而判断是新创建的还是已存在的。

1. 创建唯一索引

首先,需要在 name 列上创建唯一索引。这将确保 name 列的值在表中是唯一的。

CREATE UNIQUE INDEX ux_product_categories_name ON product_categories (name);

2. 实现 get_or_create 方法

以下是一个 Python 代码示例,使用 SQLAlchemy 和 PostgreSQL 实现 get_or_create 方法:

MiniMax Agent
MiniMax Agent

MiniMax平台推出的Agent智能体助手

下载
from sqlalchemy import create_engine, Column, Integer, String, text, inspect, select
from sqlalchemy.orm import Session, Mapped, mapped_column
from sqlalchemy.ext.declarative import declarative_base

Base = declarative_base()

class ProductCategory(Base):
    __tablename__ = "product_category"
    id: Mapped[int] = mapped_column(primary_key=True)
    name: Mapped[str] = mapped_column(String(100), unique=True)

    @staticmethod
    def get_or_create(name: str, session: Session) -> "ProductCategory":
        with session.bind.begin() as conn:
            result = conn.execute(
                text(
                    "INSERT INTO product_category (name) "
                    "VALUES (:name) ON CONFLICT (name) DO NOTHING"
                ),
                dict(name=name),
            )
            print(
                f">>> INFO: {'returning existing category' if result.rowcount == 0 else 'category created'}"
            )
        return session.scalars(
            select(ProductCategory).where(ProductCategory.name == name)
        ).one()

    def __repr__(self):
        return f"ProductCategory(id={self.id!r}, name={self.name!r})"

# 示例用法
engine = create_engine("postgresql://user:password@host:port/database") # 替换为你的数据库连接字符串
Base.metadata.create_all(engine)

with Session(engine) as sess:
    pc = ProductCategory.get_or_create("shoes", sess)
    # >>> INFO: category created
    insp = inspect(pc)
    print(f"{pc}, persistent={insp.persistent}")
    # ProductCategory(id=1, name='shoes'), persistent=True
    another_pc = ProductCategory.get_or_create("shoes", sess)
    # >>> INFO: returning existing category
    print(another_pc)
    # ProductCategory(id=1, name='shoes')
    print(pc == another_pc)
    # True

代码解释:

  1. CREATE TABLE 和 CREATE UNIQUE INDEX: 首先,确保你的数据库表已经创建,并且在 name 列上有一个唯一索引。
  2. INSERT ... ON CONFLICT DO NOTHING: 这个 SQL 语句尝试插入一个新的 ProductCategory。 ON CONFLICT (name) 指定了当 name 列发生冲突(即已存在相同的值)时,执行 DO NOTHING,即什么也不做。
  3. result.rowcount: conn.execute() 返回一个结果对象,其 rowcount 属性表示受影响的行数。如果 rowcount 为 0,说明插入操作没有执行,即记录已存在。
  4. session.scalars(select(...)).one(): 这个 SQLAlchemy 代码用于查询数据库,获取具有给定 name 的 ProductCategory 对象。 one() 方法确保返回一个且仅返回一个结果。

3. 使用示例

在上面的代码示例中,首先创建了一个名为 "shoes" 的 ProductCategory。然后,再次尝试创建名为 "shoes" 的 ProductCategory。由于 name 列上存在唯一索引,第二次插入操作会因为冲突而失败,但 get_or_create 方法会返回已存在的 ProductCategory 对象。

注意事项

  • 唯一索引是关键: 此方法依赖于 name 列上的唯一索引。如果没有唯一索引,ON CONFLICT 子句将不起作用,可能导致插入重复记录。
  • 并发问题: 在高并发环境下,可能会出现竞态条件。虽然唯一索引可以防止插入重复记录,但在两个线程同时检查记录是否存在时,可能会都认为记录不存在,从而都尝试插入新记录。可以使用更高级的并发控制机制来解决这个问题,例如悲观锁或乐观锁。
  • 数据库支持: ON CONFLICT 子句是 PostgreSQL 特有的。其他数据库可能使用不同的语法来实现类似的功能。例如,MySQL 可以使用 INSERT IGNORE 或 INSERT ... ON DUPLICATE KEY UPDATE。

总结

通过使用 SQL 的 ON CONFLICT 子句和唯一索引,我们可以有效地避免在数据库中插入重复记录,并报告操作结果。这种方法简洁高效,适用于大多数场景。但需要注意并发问题,并根据实际情况选择合适的并发控制机制。

相关专题

更多
python开发工具
python开发工具

php中文网为大家提供各种python开发工具,好的开发工具,可帮助开发者攻克编程学习中的基础障碍,理解每一行源代码在程序执行时在计算机中的过程。php中文网还为大家带来python相关课程以及相关文章等内容,供大家免费下载使用。

751

2023.06.15

python打包成可执行文件
python打包成可执行文件

本专题为大家带来python打包成可执行文件相关的文章,大家可以免费的下载体验。

636

2023.07.20

python能做什么
python能做什么

python能做的有:可用于开发基于控制台的应用程序、多媒体部分开发、用于开发基于Web的应用程序、使用python处理数据、系统编程等等。本专题为大家提供python相关的各种文章、以及下载和课程。

758

2023.07.25

format在python中的用法
format在python中的用法

Python中的format是一种字符串格式化方法,用于将变量或值插入到字符串中的占位符位置。通过format方法,我们可以动态地构建字符串,使其包含不同值。php中文网给大家带来了相关的教程以及文章,欢迎大家前来阅读学习。

618

2023.07.31

python教程
python教程

Python已成为一门网红语言,即使是在非编程开发者当中,也掀起了一股学习的热潮。本专题为大家带来python教程的相关文章,大家可以免费体验学习。

1262

2023.08.03

python环境变量的配置
python环境变量的配置

Python是一种流行的编程语言,被广泛用于软件开发、数据分析和科学计算等领域。在安装Python之后,我们需要配置环境变量,以便在任何位置都能够访问Python的可执行文件。php中文网给大家带来了相关的教程以及文章,欢迎大家前来学习阅读。

547

2023.08.04

python eval
python eval

eval函数是Python中一个非常强大的函数,它可以将字符串作为Python代码进行执行,实现动态编程的效果。然而,由于其潜在的安全风险和性能问题,需要谨慎使用。php中文网给大家带来了相关的教程以及文章,欢迎大家前来学习阅读。

577

2023.08.04

scratch和python区别
scratch和python区别

scratch和python的区别:1、scratch是一种专为初学者设计的图形化编程语言,python是一种文本编程语言;2、scratch使用的是基于积木的编程语法,python采用更加传统的文本编程语法等等。本专题为大家提供scratch和python相关的文章、下载、课程内容,供大家免费下载体验。

706

2023.08.11

Java 桌面应用开发(JavaFX 实战)
Java 桌面应用开发(JavaFX 实战)

本专题系统讲解 Java 在桌面应用开发领域的实战应用,重点围绕 JavaFX 框架,涵盖界面布局、控件使用、事件处理、FXML、样式美化(CSS)、多线程与UI响应优化,以及桌面应用的打包与发布。通过完整示例项目,帮助学习者掌握 使用 Java 构建现代化、跨平台桌面应用程序的核心能力。

36

2026.01.14

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
相关推荐
/
热门推荐
/
最新课程
MySQL 教程
MySQL 教程

共48课时 | 1.8万人学习

MySQL 初学入门(mosh老师)
MySQL 初学入门(mosh老师)

共3课时 | 0.3万人学习

简单聊聊mysql8与网络通信
简单聊聊mysql8与网络通信

共1课时 | 792人学习

关于我们 免责申明 举报中心 意见反馈 讲师合作 广告合作 最新更新
php中文网:公益在线php培训,帮助PHP学习者快速成长!
关注服务号 技术交流群
PHP中文网订阅号
每天精选资源文章推送

Copyright 2014-2026 https://www.php.cn/ All Rights Reserved | php.cn | 湘ICP备2023035733号