首页 星云 工具 资源 星选 资讯 热门工具
:

PDF转图片 完全免费 小红书视频下载 无水印 抖音视频下载 无水印 数字星空

Python 代码中的 yield 到底是什么?

编程知识
2024年07月28日 18:37

在Python编程中,有一个强大而神秘的关键字,那就是yield。初学者常常被它搞得晕头转向,而高级开发者则借助它实现高效的代码。到底yield是什么?它又是如何在Python代码中发挥作用的呢?让我们一起来揭开它的面纱。

Python里的一个非常重要但也颇具迷惑性的关键词——yield

什么是yield?为什么我们需要在Python中使用它?

 

 

来,让我们一起来拆解一下,看看yield到底是个啥。

 

 

迭代与可迭代对象

 


要搞明白yield,咱们先得弄清楚什么是可迭代对象(iterables)。

所谓可迭代对象,简单来说,就是你可以逐个读取其元素的对象,比如列表、字符串、文件等等。举个例子,当你创建一个列表时,你可以用for循环一个个地读取它的元素:

mylist = [1, 2, 3]
for i in mylist:
print(i)

 

输出会是:

1
2
3

 

这里的mylist就是一个可迭代对象。你还可以用列表推导式(list comprehension)来创建一个列表,它同样也是可迭代的:​​​​​​​

mylist = [x*x for x in range(3)]
for i in mylist:
print(i)

 

输出是:​​​​​​​

0
1
4

 

凡是你可以用for... in...来操作的东西,都是可迭代对象,包括列表、字符串、文件等等。

可迭代对象非常方便,因为你可以任意多次地读取它们的值,但前提是你得把所有值都存储在内存里。这就带来了一个问题:当数据量很大时,这种方式显然不太合适。

 

生成器

 


生成器(generators)是迭代器的一种,你只能遍历它们一次。生成器不像列表那样把所有的值都存储在内存里,而是即用即生成。来看看生成器的例子:​​​​​​​

mygenerator = (x*x for x in range(3))
for i in mygenerator:
print(i)

 

输出和列表推导式一样:​​​​​​​

0
1
4

 

但注意了,生成器只能使用一次,因为它们会“边用边忘”:计算0后忘记0,计算1后忘记1,最后计算4后结束。再用同一个生成器对象做for循环就没有结果了。

 

 

 

 

yield关键词

 


说到yield,这是个类似于return的关键词,但它返回的不是一个值,而是一个生成器。看看这个例子:​​​​​​​

def create_generator():
mylist = range(3)
for i in mylist:
yield i*i

mygenerator = create_generator() # 创建一个生成器
print(mygenerator) # mygenerator 是一个生成器对象!

 

输出是:

<generator object create_generator at 0xb7555c34>

 

通过for循环遍历这个生成器:​​​​​​​

for i in mygenerator:
print(i)

 

输出:​​​​​​​

0
1
4

 

这个例子看起来简单,但它在处理大量数据时特别有用,因为生成器只在需要时生成值,而不是一次性生成所有值然后存储在内存中。

 

 

深入理解yield

 


为了彻底掌握yield,我们需要理解当调用生成器函数时,函数体内的代码并不会立即执行。函数返回的是一个生成器对象,然后你的代码会在每次调用for循环时从上次中断的地方继续执行,直到遇到下一个yield。

 

第一次调用for循环时,生成器对象会从头开始运行函数中的代码,直到遇到yield,然后返回循环中的第一个值。随后的每次调用都会执行函数中循环的下一次迭代,直到生成器不再有值返回。这可能是因为循环结束了,或者条件不再满足。

 

来看看一个实际的例子:​

1 def _get_child_candidates(self, distance, min_dist, max_dist):
2     if self._leftchild and distance - max_dist < self._median:
3         yield self._leftchild
4     if self._rightchild and distance + max_dist >= self._median:
5         yield self._rightchild

 

这里的代码在每次使用生成器对象时都会被调用:

 

如果节点对象还有左子节点并且距离合适,返回下一个子节点。

如果节点对象还有右子节点并且距离合适,返回下一个子节点。

如果没有更多子节点,生成器会被认为是空的。

 

调用这个生成器的方法如下:​​​​​​​

 

1 result, candidates = list(), [self]
2 while candidates:
3     node = candidates.pop()
4     distance = node._get_dist(obj)
5     if distance <= max_dist and distance >= min_dist:
6         result.extend(node._values)
7     candidates.extend(node._get_child_candidates(distance, min_dist, max_dist))
8 
9 return result

 

这里的代码有几个巧妙之处:

 

  • 循环遍历一个列表,而列表在循环过程中会扩展。这样可以方便地遍历所有嵌套的数据,虽然有些危险,因为可能会陷入无限循环。在这个例子中,candidates.extend(node._get_child_candidates(distance, min_dist, max_dist))用尽生成器的所有值,但while循环不断创建新的生成器对象,因为它们作用在不同的节点上会产生不同的值。
  • extend()方法是列表对象的方法,它期望一个可迭代对象,并将其值添加到列表中。通常我们传递一个列表给它,但在代码中,它接收一个生成器,这是个好主意,因为:
  • 你不需要读取值两次。
  • 你可能有很多子节点,不想全部存储在内存中。

 

这段代码展示了Python为何如此酷:它不在乎方法的参数是列表还是其他可迭代对象。这种特性叫鸭子类型(duck typing),也是Python灵活性的一个体现。

 

高级用法

 


再来看一个更高级的用法——控制生成器的耗尽:​​​​​​​

 

 1 class Bank():
 2     crisis = False
 3     def create_atm(self):
 4         while not self.crisis:
 5             yield "$100"
 6 
 7 hsbc = Bank()
 8 corner_street_atm = hsbc.create_atm()
 9 print(next(corner_street_atm)) # 输出 $100
10 print(next(corner_street_atm)) # 输出 $100
11 print([next(corner_street_atm) for _ in range(5)]) # 输出 ['$100', '$100', '$100', '$100', '$100']
12 
13 hsbc.crisis = True
14 print(next(corner_street_atm)) # 输出 StopIteration

 

这里我们模拟了一个ATM机,在银行没有危机时,你可以不断取钱,但一旦危机来了,ATM机就会停止工作,即使是新的ATM机也不能再取钱了。

 

itertools模块

 


最后,给大家介绍一个非常有用的模块——itertools。这个模块包含了很多操作可迭代对象的特殊函数。如果你曾经希望复制一个生成器、连接两个生成器、用一行代码将值分组到嵌套列表中,或者在不创建另一个列表的情况下使用map和zip,那么就应该导入itertools。

举个例子,我们看看四匹马比赛的可能到达顺序:​​​​​​​

import itertools

horses = [1, 2, 3, 4]
races = itertools.permutations(horses)
print(list(itertools.permutations(horses)))

 

输出:

[(1, 2, 3, 4), (1, 2, 4, 3), (1, 3, 2, 4), (1, 3, 4, 2), (1, 4, 2, 3), (1, 4, 3, 2), (2, 1, 3, 4), (2, 1, 4, 3), (2, 3, 1, 4), (2, 3, 4, 1), (2, 4, 1, 3), (2, 4, 3, 1), (3, 1, 2, 4), (3, 1, 4, 2), (3, 2, 1, 4), (3, 2, 4, 1), (3, 4, 1, 2), (3, 4, 2, 1), (4, 1, 2, 3), (4, 1, 3, 2), (4, 2, 1, 3), (4, 2, 3, 1), (4, 3, 1, 2), (4, 3, 2, 1)]

 

itertools模块简直是Python程序员的好伙伴,可以让你在处理迭代对象时如虎添翼。

 

总结

 


yield是Python中一个强大的工具,它可以帮助你以一种高效的方式处理大量数据。理解yield的工作原理对于掌握Python编程至关重要。

在大数据时代,处理海量数据已成为常态。生成器作为一种高效的数据处理方式,因其优越的内存管理能力,受到了越来越多开发者的青睐。无论是日志处理、数据流分析,还是实时数据处理,生成器都展现了不可替代的价值。

通过对yield的详解,我们不仅理解了它的基本概念和用法,还认识到它在高效数据处理中的重要性。掌握yield,将为你的Python编程之旅增添一把利器。

 

From:https://www.cnblogs.com/zhuuque23/p/18328757
本文地址: http://www.shuzixingkong.net/article/528
0评论
提交 加载更多评论
其他文章 智能家居如何把老款定频空调变成智能“变频”空调#米家#智能家居#HA
背景 最近长沙的天气暴热,室内达到了34-35度,天气预报最高温度上了40度,这么酷热的天气,离开了空调,基本上就是一身汗,全身湿透,特别难受,然后不得不开启家里的一台将近10年的老式定频空调,输入功率970W,OMG,一小时将近一度电,假设一天吹10小时,就是10度电,一个月三十天,10*30=3
智能家居如何把老款定频空调变成智能“变频”空调#米家#智能家居#HA 智能家居如何把老款定频空调变成智能“变频”空调#米家#智能家居#HA 智能家居如何把老款定频空调变成智能“变频”空调#米家#智能家居#HA
Linux Kernel CFI机制简介及测试禁用
PS:要转载请注明出处,本人版权所有。 PS: 这个只是基于《我自己》的理解, 如果和你的原则及想法相冲突,请谅解,勿喷。 环境说明 无 前言 当我们为android移植linux的驱动程序的时候,总会遇到一些错误,这些错误有一部分就是android 内核开启的安全的机制导致的。本文就会介绍一种内核
Linux Kernel CFI机制简介及测试禁用 Linux Kernel CFI机制简介及测试禁用 Linux Kernel CFI机制简介及测试禁用
设计模式:代理、装饰和适配器模式的区别
结构对比 讲实话,博主当初学习完整设计模式时,这三种设计模式单独摘哪一种都是十分清晰和明确的,但是随着模式种类的增加,在实际使用的时候竟然会出现恍惚,例如读开源代码时,遇到不以模式命名规范的代码时,一时难以说清具体是使用的这三种里的哪一种。 之所以会出现混淆的原因是,三种模式的实现都是基于面向接口这
设计模式:代理、装饰和适配器模式的区别 设计模式:代理、装饰和适配器模式的区别 设计模式:代理、装饰和适配器模式的区别
Nuxt.js 路由管理:useRouter 方法与路由中间件应用
title: Nuxt.js 路由管理:useRouter 方法与路由中间件应用 date: 2024/7/28 updated: 2024/7/28 author: cmdragon excerpt: 摘要:本文介绍了Nuxt 3中useRouter方法及其在路由管理和中间件应用中的功能。内容包括
Nuxt.js  路由管理:useRouter 方法与路由中间件应用 Nuxt.js  路由管理:useRouter 方法与路由中间件应用
408数据结构树算法
第四章 树 4.1 二叉树的顺序存储 #define MAXSIZE 16 typedef int ElemType; typedef struct { ElemType data[MAXSIZE]; int size; }Tree; //初始化二叉树 void initTree(Tree&amp;
408数据结构树算法 408数据结构树算法
萌新的装机体验(持续更新)
萌新的装机体验 起因 作为一名 OIer,平日划水的方式无非就是看看 edge 首页和知乎(当然如果教练不在就上 B 站了)。有一天在 edge 主页上忽然看到了一个 5000 元主机的装机体验,看完之后就想换台电脑了。 家里的那台电脑是我小学毕业的时候和我爸自己装的。当时什么都不懂(但以为自己很懂
C语言中的断言函数assert
简介 assert 是 C 语言中的一个宏,用于在程序运行时进行条件检查,主要用于调试目的。它在 &lt;assert.h&gt; 头文件中定义,用于验证程序中的假设条件是否成立,如果不成立,程序将打印错误信息并终止执行。 特点 调试用途:主要用于捕获程序中的逻辑错误或不期望的条件。 可移除:通过定
LeetCode654. 最大二叉树
题目链接:https://leetcode.cn/problems/maximum-binary-tree/description/ 题目叙述 给定一个不重复的整数数组 nums 。 最大二叉树 可以用下面的算法从 nums 递归地构建: 创建一个根节点,其值为 nums 中的最大值。 递归地在最大
LeetCode654. 最大二叉树 LeetCode654. 最大二叉树