Numpy Tricks


这篇文章不定期更新,主要是记录在使用numpy过程中一些有效的tricks(或者重要的API)

import numpy as np

numpy.where()


numpy.where(condition, [,x,y])

参数:

- condition: 一个 bool array 或者 在源数组(original array)基础上由条件运算产生的 bool array

- x,y(optional, 或者两者都被传入函数,或者都不被传入): 两个和condition 产生的 bool array 具有相同的shape 的 array

因此numpy.where中或者有一个参数,或者有三个参数,而不会只有两个参数

返回值

- 如果x 与 y 均被传入, 那么它基于bool array 从 x 和 y 中选取元素 组成一个新的数组。原理: 遍历bool array, 如果bool array 某一位置的元素为True,那么从 x(array1) 中选取对应位置的元素作为新数组对应位置的元素, 如果为 False,从 y(array2) 中选择, 最终由 x的元素和 y 的元素组成一个新的数组

- 如果 x  与 y 均不被传入,那么它返回一个元组,每一个元组元素对应 original 数组 的某一维度 满足 condition元素的索引

因此numpy.where主要有两个用途

  1. 返回源数组满足条件(single condition or multi-condition) 的元素的对应索引

  2. 由两个指定数组 按照指定条件 产生一个新数组 (也即是一个三元运算符, x if condition else y, 只不过这里的 x y condition 拓展到了数组版本)

接下来是两个简单的例子(直接展示二维的情况,更高维或者一维与此类似)

# 创建源数组
o_array = np.arange(0, 9).reshape((3, 3)) # 创建 x ,y
x = np.array(['high value']*9).reshape((3, 3))
y = np.array(['low value']*9).reshape((3, 3)) print(f'x=: \n{x}')
print(f'y=: \n{y}')
print(f'original=: \n{o_array}')
x=:
[['high value' 'high value' 'high value']
['high value' 'high value' 'high value']
['high value' 'high value' 'high value']]
y=:
[['low value' 'low value' 'low value']
['low value' 'low value' 'low value']
['low value' 'low value' 'low value']]
original=:
[[0 1 2]
[3 4 5]
[6 7 8]]
# 单个条件或者许多条件, 当然也可以直接使用bool array
single_condition = o_array >= 4
multi_condition = (o_array>=4) & (o_array<=6)
# 用法一  返回满足条件的元素的索引
idx_1 = np.where(single_condition)
idx_2 = np.where(multi_condition) print(f'单个条件返回的索引元祖为: {idx_1}') # 分别对应满足条件元素二维索引的横竖index
print(f'多个条件返回的索引元祖为: {idx_2}')
# 返回的元祖可以用于 索引相应满足条件的元素 elements = o_array[idx_1]
print(f"满足条件的元素: {elements}") # 也可以对于返回tuple元素进行合并 得到相应的二维索引
index = list(zip(idx_1[0], idx_1[1]))
print(index)
单个条件返回的索引元祖为:      (array([1, 1, 2, 2, 2]), array([1, 2, 0, 1, 2]))
多个条件返回的索引元祖为: (array([1, 1, 2]), array([1, 2, 0]))
满足条件的元素: [4 5 6 7 8]
[(1, 1), (1, 2), (2, 0), (2, 1), (2, 2)]
# 用法二:作为三元表达式的一种创建一个新数组
new_array = np.where(single_condition, x, y)
print(f'新数组为: \n{new_array}')
新数组为:
[['low value' 'low value' 'low value']
['low value' 'high value' 'high value']
['high value' 'high value' 'high value']]

numpy.any()、ndarray.any() (numpy.all(), ndarray.all())


关于详细的背景知识和使用,这里有一个不错的英文教程

np.any(input_array, axis, output, keepdims, where)

参数:

input_array: 输入数组或者 array-like (如python list)

axis: 指定的运算轴, default = None, 维度可以为负数,即反向索引

output: 可以指定输出的数组,这个参数很少使用

keepdims: 决定输出是否要保留和输入一样的维度数

where: array of bol optional, 用于指定函数运算的位置

返回:

bool 值 或者一个bool array(在指定维度运算时)

功能:

检查 input_array 中在指定的位置(或者指定的维数)上是否存在 True。

一种典型的应用场景是 np.any(condition)

np.all() 的用法和np.any() 完全相同,区别在于字面意思 any vs all

input_array = np.arange(0, 9).reshape((3, 3))
condition = input_array >=4
print(f"默认缺省: {np.any(condition)}")
print(f"指定维度: {np.any(condition, axis=1)}")
print(f"指定维度的输出shape: {np.any(condition, axis=1).shape}")
print(f"keepdims 时的shape: {np.any(condition, axis=1, keepdims=True).shape}")
默认缺省:  True
指定维度: [False True True]
指定维度的输出shape: (3,)
keepdims 时的shape: (3, 1)

随机推荐

  1. redis.conf 7.0 配置和原理全解,生产王者必备

    5.5 redis.conf 配置详解 我是 Redis, 当程序员用指令 ./redis-server /path/to/redis.conf 把我启动的时候,第一个参数必须是redis.conf ...

  2. 如何在 Linux 中查看目录大小?

    这是一篇关于如何通过一些常用的命令,显示 CentOS 或 RedHat 中的 Linux 目录大小,以及哪些文件夹占用的空间最大的教程. 搜索当前的 CentOS 或 RedHat 文件夹 您可以使 ...

  3. python selenium自动化火狐浏览器开代理IP服务器

    前言 Selenium是一款用于自动化测试Web应用程序的工具,它可以模拟用户在浏览器中的各种行为.而代理IP服务器则是一种可以帮助用户隐藏自己真实IP地址的服务器,使得用户可以在互联网上更加匿名地进 ...

  4. 2023-06-14:我们从二叉树的根节点 root 开始进行深度优先搜索。 在遍历中的每个节点处,我们输出 D 条短划线(其中 D 是该节点的深度) 然后输出该节点的值。(如果节点的深度为 D,则其

    2023-06-14:我们从二叉树的根节点 root 开始进行深度优先搜索. 在遍历中的每个节点处,我们输出 D 条短划线(其中 D 是该节点的深度) 然后输出该节点的值.(如果节点的深度为 D,则其 ...

  5. 区块链的Token机制如何理解?

    区块链的Token机制如何理解? 为了更好的理解区块链和Token的关系,今天专门基于互联网中的内容,做了下筛选过滤,从而可以让大家更好的理解,对于Token,如果是从事过开发的同学来说,比如容易理解 ...

  6. 洛谷 P8026 [ONTAK2015] Bajtocja

    简要题意 有 \(d\) 张初始为空的无向图,每张中都有 \(n\) 个点,标号从 \(1\) 到 \(n\),\(m\) 次操作,每次往一张图加一条边,并询问有多少有序数对 \((a, b)\) 使 ...

  7. 记一次字符串末尾空白丢失的排查 → MySQL 是会玩的!

    开心一刻 今天答应准时回家和老婆一起吃晚饭,但临时有事加了会班,回家晚了点 回到家,本以为老婆会很生气,但老婆却立即从厨房端出了热着的饭菜 老婆:还没吃饭吧,去洗下,来吃饭吧 我洗好,坐下吃饭,内心感 ...

  8. 1 opencv-python图像读写模块

    这个分类记录自己学习opencv的随笔文档,方便以后查询和复习.python-opencv环境配置网上教程很多,此处就不做赘述了,该文档记录opencv最基础的图像读写和显示,工具是jupyter n ...

  9. H5 WebGL实现水波特效

    前言 零几年刚开始玩电脑的时候,经常在安装程序上看到一种水波特效,鼠标划过去的时候,就像用手在水面划过一样,感觉特别有意思.但是后来,就慢慢很少见过这种特效了.最近突然又想起了这种特效,于是开始折磨怎 ...

  10. Llama2开源大模型的新篇章以及在阿里云的实践

    Llama一直被誉为AI社区中最强大的开源大模型.然而,由于开源协议的限制,它一直不能被免费用于商业用途.然而,这一切在7月19日发生了改变,当Meta终于发布了大家期待已久的免费商用版本Llama2 ...