Python生成式AI教程_使用transformer模型生成文本

冷漠man

发布时间：2025-12-31 13:42:08

239人浏览过

来源于php中文网

原创

用Python和Transformer生成文本的核心是加载预训练模型、准备输入、调用generate接口；借助Hugging Face的transformers库，可快速通过pipeline或手动tokenizer+model实现生成，并支持temperature、top_k等参数调控及bad_words_ids等进阶控制。

python生成式ai教程_使用transformer模型生成文本

用 Python 和 Transformer 模型生成文本，核心是加载预训练模型、准备输入、调用生成接口——不需从头训练，Hugging Face 的 transformers 库让这件事变得非常直接。

安装依赖与加载基础模型

先确保安装了关键库：

pip install transformers torch（PyTorch 是默认后端）
推荐加装 accelerate 以支持显存优化和多卡推理

选一个轻量又实用的开源模型，比如 distilgpt2（GPT-2 的精简版，速度快、显存友好）：

from transformers import pipeline

generator = pipeline("text-generation", model="distilgpt2")

简单生成：给提示词，得续写结果

只需一行代码就能生成文本：

立即学习“Python免费学习笔记（深入）”；

培训招生教育类网站模板(响应式)1.4.2

培训招生教育类网站模板(响应式)安装即用，自带人人站CMS内核，支持响应式，前端banner轮播图文本均已进行可视化配置，伪静态页面生成，支持内容模型、多语言、自定义表单、筛选、多条件搜索等功能，支持多种URL模式及模型。模板特点：1、安装即用，自带人人站CMS内核及企业站展示功能（产品，新闻，案例展示等），并可根据需要增加表单搜索等功能（自带模板） 2、支持响应式 3、前端banner轮播图文

下载

output = generator("今天天气不错，我想去", max_length=50, num_return_sequences=1)
print(output[0]["generated_text"])

max_length 控制总长度（含输入），不是只生成多少字
num_return_sequences=3 可一次返回多个不同版本，便于对比选择
若想控制“创造性”，可调整 temperature=0.7（越低越保守，越高越随机）或启用 top_k=50 / top_p=0.9 进行采样过滤

进阶控制：手动 tokenizer + model 调用

当需要更精细干预（如禁止某些词、添加前缀、控制停止符），建议绕过 pipeline，直接操作模型：

from transformers import AutoTokenizer, AutoModelForCausalLM
import torch

tokenizer = AutoTokenizer.from_pretrained("distilgpt2")
model = AutoModelForCausalLM.from_pretrained("distilgpt2")

input_text = "Python 中列表推导式的语法是"
input_ids = tokenizer.encode(input_text, return_tensors="pt")

output_ids = model.generate(
    input_ids,
    max_new_tokens=64,
    do_sample=True,
    temperature=0.85,
    pad_token_id=tokenizer.eos_token_id
)
generated_text = tokenizer.decode(output_ids[0], skip_special_tokens=True)

max_new_tokens 更直观：只限制新生成的 token 数量
pad_token_id 设为 eos_token_id 可避免警告，尤其在 batch 推理时必要
如需禁止生成特定词（如“错误”、“bug”），可用 bad_words_ids 参数传入 token ID 列表

本地部署小贴士

在消费级显卡（如 RTX 3060 12G）上跑 distilgpt2 完全没问题；若换更大模型（如 facebook/opt-1.3b 或 google/gemma-2b）：

加 device_map="auto" 让 accelerate 自动分配显存
用 load_in_4bit=True 加载量化模型，显存占用直降 60%+
中文任务优先选专为中文微调的模型，如 uer/roberta-base-finetuned-jd-binary-chinese（分类）或 IDEA-CCNL/Ziya-LLaMA-13B-v1（生成），别硬套英文模型

不复杂但容易忽略：生成质量高度依赖提示词（prompt）设计。一个清晰、带语境、有风格指示的开头，比调参更能提升结果可用性。

Python自动化生成项目日志汇总报告的脚本设计方法【指导】

Python开发：修复Hangman游戏中的显示逻辑与常见陷阱

Python-docx 深度解析：正确加载与修改现有 .docx 文件

使用Python高效删除Word宏并转换DOCM为DOCX格式

python中的win32com库是什么？

本站声明：本文内容由网友自发贡献，版权归原作者所有，本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容，请联系admin@php.cn

上一篇：Python内存管理进阶教程_对象引用与垃圾回收实战下一篇：如何将 API 返回的字节字符串快速转换为 Pandas DataFrame

作者最新文章

电视怎么登录腾讯视频会员_电视怎么登录腾讯视频会员最靠谱扫码教程免费步骤

2025-12-30 12:36

刚铎之城降临！乐高×魔戒新作惊传破8千片积木预计2026年现身

2025-12-30 12:47

OPPO Find X9s曝光：6.3英寸小直屏+2亿像素主摄

2025-12-30 13:18

Linux稳定性工程实践教程_系统可靠性建设

2025-12-30 13:20

Linux进程状态详解_running与sleep说明【指导】

2025-12-30 13:39

9899元！红魔11 Pro+ GOLDEN SAGA即将上市

2025-12-30 13:45

ao3镜像链接稳定入口地址_AO3最新稳定镜像站点快速访问入口汇总

2025-12-30 13:46

yandexgmes游戏入口怎么进_Yandex Games免费在线游戏平台入口地址

2025-12-30 14:01

ao3手机版登录入口地址_AO3手机版网页版或镜像登录入口

2025-12-30 14:02

ao3镜像网址链接点击进入_AO3镜像网址点击即进入口地址

2025-12-30 14:04

热门AI工具

DeepSeek

幻方量化公司旗下的开源大模型平台

AI大模型

开放平台

豆包大模型

字节跳动自主研发的一系列大型语言模型

AI大模型

通义千问

阿里巴巴推出的全能AI助手

AI大模型

腾讯元宝

腾讯混元平台推出的AI助手

文档处理

Excel 表格

文心一言

文心一言是百度开发的AI聊天机器人，通过对话可以生成各种形式的内容。

AI大模型

中文写作

讯飞写作

基于讯飞星火大模型的AI写作工具，可以快速生成新闻稿件、品宣文案、工作总结、心得体会等各种文文稿

中文写作

写作工具

即梦AI

一站式AI创作平台，免费AI图片和视频生成。

图片拼接

图画生成

ChatGPT

最最强大的AI聊天机器人程序，ChatGPT不单是聊天机器人，还能进行撰写邮件、视频脚本、文案、翻译、代码等任务。

AI大模型

中文写作

智谱清言 - 免费全能的AI助手

AI大模型

PDF 文档

相关专题

python开发工具

php中文网为大家提供各种python开发工具，好的开发工具，可帮助开发者攻克编程学习中的基础障碍，理解每一行源代码在程序执行时在计算机中的过程。php中文网还为大家带来python相关课程以及相关文章等内容，供大家免费下载使用。

715

2023.06.15

python打包成可执行文件

本专题为大家带来python打包成可执行文件相关的文章，大家可以免费的下载体验。

625

2023.07.20

python能做什么

python能做的有：可用于开发基于控制台的应用程序、多媒体部分开发、用于开发基于Web的应用程序、使用python处理数据、系统编程等等。本专题为大家提供python相关的各种文章、以及下载和课程。

739

2023.07.25

format在python中的用法

Python中的format是一种字符串格式化方法，用于将变量或值插入到字符串中的占位符位置。通过format方法，我们可以动态地构建字符串，使其包含不同值。php中文网给大家带来了相关的教程以及文章，欢迎大家前来阅读学习。

617

2023.07.31

python教程

Python已成为一门网红语言，即使是在非编程开发者当中，也掀起了一股学习的热潮。本专题为大家带来python教程的相关文章，大家可以免费体验学习。

1235

2023.08.03

python环境变量的配置

Python是一种流行的编程语言，被广泛用于软件开发、数据分析和科学计算等领域。在安装Python之后，我们需要配置环境变量，以便在任何位置都能够访问Python的可执行文件。php中文网给大家带来了相关的教程以及文章，欢迎大家前来学习阅读。

547

2023.08.04

python eval

eval函数是Python中一个非常强大的函数，它可以将字符串作为Python代码进行执行，实现动态编程的效果。然而，由于其潜在的安全风险和性能问题，需要谨慎使用。php中文网给大家带来了相关的教程以及文章，欢迎大家前来学习阅读。

575

2023.08.04

scratch和python区别

scratch和python的区别：1、scratch是一种专为初学者设计的图形化编程语言，python是一种文本编程语言；2、scratch使用的是基于积木的编程语法，python采用更加传统的文本编程语法等等。本专题为大家提供scratch和python相关的文章、下载、课程内容，供大家免费下载体验。

698

2023.08.11

小游戏4399大全

4399小游戏免费秒玩大全来了！无需下载、即点即玩，涵盖动作、冒险、益智、射击、体育、双人等全品类热门小游戏。经典如《黄金矿工》《森林冰火人》《狂扁小朋友》一应俱全，每日更新最新H5游戏，支持电脑与手机跨端畅玩。访问4399小游戏中心，重温童年回忆，畅享轻松娱乐时光！官方入口安全绿色，无插件、无广告干扰，打开即玩，快乐秒达！

2025.12.31

热门下载

网站特效

网站源码

网站素材

前端模板