Python迭代器生成器进阶教程_节省内存与懒加载实战
技术百科
冰川箭仙
发布时间:2026-01-01
浏览: 次 Python中迭代器和生成器实现懒加载以节省内存,迭代器需实现__iter__和__next__方法,生成器函数用yield简化编写并自动支持状态暂停与恢复。
Python 中的迭代器和生成器是实现懒加载、节省内存的关键工具,尤其在处理大数据流、无限序列或资源受限场景时优势明显。它们不一次性把所有数据装入内存,而是按需产出,让程序更轻量、更可控。
理解迭代器:可被 next() 驱动的对象
迭代器是实现了 __iter__() 和 __next__() 方法的对象。调用 iter() 得到迭代器,反复调用 next() 获取下一个值,直到抛出 StopIteration 异常为止。
自定义迭代器适合封装有明确状态和逻辑的数据遍历过程。例如,读取大文件时逐行迭代,避免一次性读入全部内容:
class LineReader:
def __init__(self, filepath):
self.filepath = filepath
def __iter__(self):
return self
def __next__(self):
try:
if not hasattr(self, 'file'):
self.file = open(self.filepath, 'r', encoding='utf-8')
line = self.file.readline()
if not line:
raise StopIteration
return line.rstrip('\n')
except StopIteration:
self.file.close()
del self.file
raise
- 每次只打开一次文件,每次只读一行,内存占用恒定
- 使用
for line in LineReader('huge.log'):即可安全遍历 - 注意手动关闭文件,或改用上下文管理器(推荐)提升健壮性
掌握生成器:用 yield 简化迭代器编写
生成器函数使用 yield 关键字返回值,Python 自动将其编译为迭代器对象。它比手写迭代器更简洁、不易出错,且天然支持暂停/恢复执行状态。
典型场景:生成斐波那契数列、过滤日志、解析流式 JSON:
def fibonacci(max_count):
a, b, count = 0, 1, 0
while count < max_count:
yield a
a, b = b, a + b
count += 1
使用方式完全一致
for n in fibonacci(1000000): # 不会创建百万元素列表
if n > 1000:
break
print(n)
-
yield让函数变成生成器工厂,调用时不执行,只返回生成器对象 - 每次
next()触发时,从上次yield暂停处继续运行 - 生成器对象不可重用,用完即弃;需重复遍历时应重新调用生成器函数
实战技巧:组合与转换生成器链
生成器可以像 Unix 管道一样串联,形成清晰、低耦合的数据处理
链。每一步都保持懒加载,整条链仍只占用常量内存。
def read_lines(filepath):
with open(filepath) as f:
for line in f:
yield line.strip()
def filter_nonempty(lines):
for line in lines:
if line:
yield line
def parse_json_lines(lines):
import json
for line in lines:
try:
yield json.loads(line)
except json.JSONDecodeError:
continue
组合使用(无中间列表)
for obj in parse_json_lines(filter_nonempty(read_lines('data.jsonl'))):
process(obj) # 每次只处理一个解析后的对象
- 每个函数职责单一,易于测试和复用
- 整个流程不会因文件过大而 OOM,哪怕文件是 GB 级别
- 可配合
itertools(如islice,chain,filterfalse)进一步增强表达力
进阶提醒:生成器的边界与注意事项
生成器强大但不是万能解药。实际使用中需注意几个关键点:
- 生成器只能遍历一次,多次使用需重新构造(可包装成类或工厂函数)
- 调试困难:无法直接索引、切片或查看长度,可用
itertools.islice(gen, 5)查看前几项 - 异常传播:若生成器内部抛出异常,会原样传递给调用方,建议在 yield 前加 try/except
- 协程扩展:Python 3.5+ 中
yield from支持委托子生成器,async def+await是异步生成器演进方向
# ai
# 大数据
# python
# 工具
# js
# json
# 内存占用
# 懒加载
# unix
相关栏目:
<?muma
$count = M('archives')->where(['typeid'=>$field['id']])->count();
?>
【
AI推广<?muma echo $count; ?>
】
<?muma
$count = M('archives')->where(['typeid'=>$field['id']])->count();
?>
【
SEO优化<?muma echo $count; ?>
】
<?muma
$count = M('archives')->where(['typeid'=>$field['id']])->count();
?>
【
技术百科<?muma echo $count; ?>
】
<?muma
$count = M('archives')->where(['typeid'=>$field['id']])->count();
?>
【
谷歌推广<?muma echo $count; ?>
】
<?muma
$count = M('archives')->where(['typeid'=>$field['id']])->count();
?>
【
百度推广<?muma echo $count; ?>
】
<?muma
$count = M('archives')->where(['typeid'=>$field['id']])->count();
?>
【
网络营销<?muma echo $count; ?>
】
<?muma
$count = M('archives')->where(['typeid'=>$field['id']])->count();
?>
【
案例网站<?muma echo $count; ?>
】
<?muma
$count = M('archives')->where(['typeid'=>$field['id']])->count();
?>
【
精选文章<?muma echo $count; ?>
】
相关推荐
- Windows10怎么查看系统激活状态_Windo
- Python抽象类与接口设计_规范说明【指导】
- WindowsUSB驱动安装异常怎么办_USB驱动
- 如何正确访问 Laravel 模型或对象的属性而非
- 如何使用Golang实现聊天室消息存档_存储聊天记
- Win11怎么更改鼠标指针方案_Windows11
- Win11怎么设置声音输出设备_Windows11
- 如何使用Golang实现负载均衡_分发请求到多个服
- Win10怎样卸载iTunes_Win10卸载iT
- 如何高效获取循环末次生成的 NumPy 数组最后一
- Win11如何关闭游戏模式 Win11禁用Xbox
- mac怎么安装字体_MAC添加第三方字体与字体册管
- Windows电脑键盘突然失灵怎么办?(驱动与硬件
- Mac的访达(Finder)怎么用_Mac文件管理
- c++中如何计算坐标系中两点间距离_c++勾股定理
- XSLT怎么生成动态的HTML属性名和标签名
- Win11怎么设置应用分屏_Windows11贴靠
- Win11怎么查看wifi信号强度_检测Windo
- 本地php环境打开php文件直接下载_浏览器解析p
- 如何在 Go 后端安全获取并验证前端存储的 JWT
- php嵌入式多设备通信怎么实现_php同时管理多个
- Mac系统更新下载慢或失败怎么办_解决macOS升
- Win10怎么更改用户名 Win10修改账户名称操
- PythonPandas数据分析项目教程_时间序列
- php485读数据时阻塞怎么办_php485非阻塞
- php串口通信波特率怎么选_根据硬件手册设置正确波
- Python对象生命周期管理_创建销毁解析【教程】
- Win10怎样安装Word样式库_Win10安装W
- Win11怎么关闭防火墙通知_屏蔽Win11安全中
- c++如何判断文件是否存在_c++ filesys
- Win11怎么关闭系统声音_Win11系统提示音静
- PHP的Workerman对架构扩展有啥帮助_应用
- C++ static_cast和dynamic_c
- Win11怎么设置任务栏大小_Windows11注
- Win11怎么设置环境变量_Win11配置Path
- win11 OneDrive怎么彻底关闭 Win1
- Win11此电脑不在桌面上_Windows 11桌
- Win11怎么设置右键刷新选项_Windows11
- Win11开机Logo怎么换_Win11自定义启动
- c++如何利用doxygen生成开发文档_c++
- php怎么下载安装后无法解析php文件_服务器配置
- Win11怎么设置默认浏览器Chrome_Wind
- Drupal 中 HTML 链接被重复转义导致渲染
- Mac如何与安卓手机传文件_Mac和Android
- php8.4匿名类怎么用_php8.4匿名类创建与
- 如何减少Golang内存碎片化_Golang内存分
- Windows蓝屏错误0x00000018怎么处理
- Win11怎么设置默认终端应用_Windows11
- Mac如何彻底清理浏览器缓存?(Safari与Ch
- 如何在 Go 中判断变量是否为函数类型

QQ客服