如何使用正则表达式提取以编号开头、后跟多个注解的完整代码块

花韻仙語

发布时间：2026-01-01 14:50:04

291人浏览过

来源于php中文网

原创

如何使用正则表达式提取以编号开头、后跟多个注解的完整代码块

本文讲解如何用 python 正则表达式精准匹配并分组提取形如“1. @xxx”开头、后续紧接多行 `@annotation` 的逻辑块，解决单行匹配导致内容截断的问题。

在处理结构化注解文本（如 Spring 注解示例、JavaDoc 标签等）时，常需按语义块而非单行进行提取。原始代码 re.findall("(?:[0-9][.][ ]).+", txt) 仅捕获编号行本身，忽略了其后属于同一逻辑单元的 @Autowired、@Override 等注解——因为这些注解位于独立行，且不以数字编号开头。

关键在于：将整个逻辑块视为一个“主项+附属项”结构，其中：

主项：以数字. 开头的行（如 1. @aut1.or）；
附属项：后续连续的、以 @ 开头的行（如 @Autowired），直到遇到下一个编号或文本结束。

以下为健壮、可复用的解决方案：

import re

txt = '''1. @aut1.or
@Autowired
2. @Override
@param
@SuppressWarnings'''

# 第一步：先提取所有可能的“起始行”（编号行）及其位置
start_matches = list(re.finditer(r'^\d+\.\s+@[\w.]+', txt, re.MULTILINE))
if not start_matches:
    result = []
else:
    result = []
    for i, match in enumerate(start_matches):
        start_pos = match.start()
        # 取当前起始行到下一个起始行（或文本末尾）之间的内容
        end_pos = start_matches[i + 1].start() if i + 1 < len(start_matches) else len(txt)
        block = txt[start_pos:end_pos].strip()
        # 清理块内多余空行，保留换行符分隔注解
        cleaned_block = re.sub(r'\n\s*\n', '\n', block)  # 合并空行
        result.append(cleaned_block)

print(result)
# 输出：
# ['1. @aut1.or\n@Autowired',
#  '2. @Override\n@param\n@SuppressWarnings']

✅ 优势说明：

Artflow.ai

可以使用AI生成的原始角色、场景、对话，创建动画故事。

下载

使用 re.MULTILINE 配合 ^ 确保精确匹配行首编号；
基于位置切片（start_pos/end_pos）天然支持跨行归属，避免正则贪婪匹配风险；
兼容注解中含点号（如 @aut1.or）、下划线或大小写混合（如 @SuppressWarnings）；
自动过滤空行，保持结果整洁。

⚠️ 注意事项：

若文本中存在无编号的孤立注解（如开头直接写 @Deprecated），该方案会忽略它们——这符合“仅提取编号逻辑块”的需求；
如需支持中文编号（如“一.”、“二.”）或括号编号（如“(1)”），需扩展正则模式；
生产环境建议添加异常处理，并对 txt 做非空和类型校验。

此方法超越简单 findall，体现“定位锚点 → 划分区间 → 提取子串”的典型文本结构化解析思路，适用于日志分段、测试用例提取、文档标记解析等多种场景。

如何使用正则表达式提取以编号开头、后接多个注解的完整段落

Python文件操作异常场景_权限问题解析【教程】

Python基础知识体系搭建_学习顺序解析【教程】

如何在 Python 中解析 ISO 8601 时间戳并计算日期差值

Python日志管理实践_分级与追踪说明【指导】

相关标签:

python java 正则表达式 app red Python spring 正则表达式切片

本站声明：本文内容由网友自发贡献，版权归原作者所有，本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容，请联系admin@php.cn

上一篇：如何使用正则表达式提取以编号开头、后接多个注解的逻辑分组块下一篇：暂无

作者最新文章

1599元起！闪极发布首款多合一移动硬盘闪盘Pro：最高1000MB/s、自带拓展坞

2025-12-30 13:39

Angular 中使用条件类绑定实现多状态样式控制（在线/离线/故障）

2025-12-30 13:39

如何根据下拉选项动态显示或隐藏城市标签

2025-12-30 13:41

如何在 Django 模板中正确处理空列表并避免渲染异常？

2025-12-30 13:47

《寂静岭》制作人：目标是每年都发售一部《寂静岭》游戏

2025-12-30 13:50

明年发售？《刺客信条：代号女巫》创意总监称26年将公布大量内容

2025-12-30 13:55

Go 中自定义结构体的可读性格式化：实现 Stringer 接口实现优雅输出

2025-12-30 14:00

PHP 中 else 后误用条件表达式导致的语法错误解析与修复

2025-12-30 14:04

如何在 Bootstrap 折叠组件中单次点击即加载 NGL 3D 分子可视化

2025-12-30 14:04

R星前总监力挺拉瑞安：不做《博德之门4》值得尊重！

2025-12-30 14:07

热门AI工具

DeepSeek

幻方量化公司旗下的开源大模型平台

AI大模型

开放平台

豆包大模型

字节跳动自主研发的一系列大型语言模型

AI大模型

通义千问

阿里巴巴推出的全能AI助手

AI大模型

腾讯元宝

腾讯混元平台推出的AI助手

文档处理

Excel 表格

文心一言

文心一言是百度开发的AI聊天机器人，通过对话可以生成各种形式的内容。

AI大模型

中文写作

讯飞写作

基于讯飞星火大模型的AI写作工具，可以快速生成新闻稿件、品宣文案、工作总结、心得体会等各种文文稿

中文写作

写作工具

即梦AI

一站式AI创作平台，免费AI图片和视频生成。

图片拼接

图画生成

ChatGPT

最最强大的AI聊天机器人程序，ChatGPT不单是聊天机器人，还能进行撰写邮件、视频脚本、文案、翻译、代码等任务。

AI大模型

中文写作

智谱清言 - 免费全能的AI助手

AI大模型

PDF 文档

相关专题

python开发工具

php中文网为大家提供各种python开发工具，好的开发工具，可帮助开发者攻克编程学习中的基础障碍，理解每一行源代码在程序执行时在计算机中的过程。php中文网还为大家带来python相关课程以及相关文章等内容，供大家免费下载使用。

716

2023.06.15

python打包成可执行文件

本专题为大家带来python打包成可执行文件相关的文章，大家可以免费的下载体验。

626

2023.07.20

python能做什么

python能做的有：可用于开发基于控制台的应用程序、多媒体部分开发、用于开发基于Web的应用程序、使用python处理数据、系统编程等等。本专题为大家提供python相关的各种文章、以及下载和课程。

739

2023.07.25

format在python中的用法

Python中的format是一种字符串格式化方法，用于将变量或值插入到字符串中的占位符位置。通过format方法，我们可以动态地构建字符串，使其包含不同值。php中文网给大家带来了相关的教程以及文章，欢迎大家前来阅读学习。

617

2023.07.31

python教程

Python已成为一门网红语言，即使是在非编程开发者当中，也掀起了一股学习的热潮。本专题为大家带来python教程的相关文章，大家可以免费体验学习。

1236

2023.08.03

python环境变量的配置

Python是一种流行的编程语言，被广泛用于软件开发、数据分析和科学计算等领域。在安装Python之后，我们需要配置环境变量，以便在任何位置都能够访问Python的可执行文件。php中文网给大家带来了相关的教程以及文章，欢迎大家前来学习阅读。

547

2023.08.04

python eval

eval函数是Python中一个非常强大的函数，它可以将字符串作为Python代码进行执行，实现动态编程的效果。然而，由于其潜在的安全风险和性能问题，需要谨慎使用。php中文网给大家带来了相关的教程以及文章，欢迎大家前来学习阅读。

575

2023.08.04

scratch和python区别

scratch和python的区别：1、scratch是一种专为初学者设计的图形化编程语言，python是一种文本编程语言；2、scratch使用的是基于积木的编程语法，python采用更加传统的文本编程语法等等。本专题为大家提供scratch和python相关的文章、下载、课程内容，供大家免费下载体验。

699

2023.08.11