vaex报错TypeError: blake3.__new__() got an unexpected keyword argument ‘multithreading‘解决方法

本文主要是介绍vaex报错TypeError: blake3.__new__() got an unexpected keyword argument ‘multithreading‘解决方法,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

vaex报错TypeError: blake3.new() got an unexpected keyword argument 'multithreading’解决方法

文章目录

  • vaex报错TypeError: blake3.__new__() got an unexpected keyword argument 'multithreading'解决方法
    • 引言
    • 本篇目的
    • 解决过程
    • 总结

引言

近来有数据量较大的处理任务,在pandas出现处理瓶颈下希望寻求到一个得力助手进行处理数据。vaex也早有耳闻,得知能够较快速地处理较大的数据量,而在安装近期最新版后进行使用产生了一个读取数据的报错信息。

本篇目的

给予同样在使用vaex过程中产生TypeError错误的小伙伴提供一种解决方法,不代表唯一的解决方式,首先说明我在使用vaex产生该报错信息的原因,在导入vaex包后运行open或from_csv方法。

系统平台及软件版本:

  • window 10

  • python 3.8

  • vaex 4.7.0

  • blake3 0.3.1

解决过程

vaex.from_csv读取csv文件,我的csv文件编码于vaex默认编码不一致会报UnicodeDecodeError,设定encoding=’文件编码‘即可。

数据文件正常,编码正常的情况下运行程序发生错误,想必会第一时间使用搜索引擎查看是否有相应的解决方法。直接复制整段内容,首页搜索结果部分关键词检索到,虽然模块不一样,有可能解决方式相同,卸载重装报错提到的blake3模块及vaex,问题已然存在。

仅保留blake3及multithreading再次搜索,无相关结果。且没有一定条件访问谷歌,周围同好也没有遇到相关问题,则只能通过报错信息翻看源码内容核定错误产生位置并进行解决。(手动水印:原创CSDN宿者朽命,https://blog.csdn.net/weixin_46281427?spm=1011.2124.3001.5343,公众号A11Dot派)

整体报错信息如下:

最终是锚定在vaex模块下dataset.py的hash_array函数里,错误代码在第190行。有条件的可以使用编辑器进行跳转,如我使用的是pycharm,使用ctrl+鼠标左键,点击变量名就可以跳转至变量定义处。通过点击跳转blake3后至该处:

vaex是通过optional_import方法导入blake3方法,继续查找blake3文件,打开其模块下__init__.py,再次点击blake3,跳转至模块内部,在报错信息里也可以看到vaex调用的是blake3.blake3

查看此处注释,可以注意到max_threads参数与报错中出现的multithreading略有几分相似,从参数命名来看是多线程处理方式。也能够通过jupyter-notebook来查看该类的参数设定。

max_threads默认值为1,仔细阅读释义,blake3是一个hash类模块,接收字节数据进行hash,max_threads默认值是单线程模型,可以设定一个整数指定线程,其中有提到线程数可能会小于计算机的cpu数量。

明白该类的参数输入,就能对vaex模块进行修正,原blake(0.3.1)已经没有multithreading参数,返回至报错信息锚定页面(…/vaex/dataset.py),将所有涉及到blake3.blake3处的代码进行修改,可以直接删除multithreading参数,以默认值1(单线程)进行运作,而现在也算是大概知道max_threads带来的效益,则可以直接设定为cpu数量,我在此处使用multiprocessing.cpu_count()获取计算机cpu数量,将所有的multithreading改为max_threads=multiprocessing.cpu_count()。

ps: 在pycharm中修改模块源码需要进行确认。

在pycharm中运行vaex.from_csv(),顺利读取csv数据文件。如果用jupyter-notebook需要点击重启服务重载模块进行读取数据。

总结

此类问题在运行代码常有出现,但有可能在翻尽网上所有答案后无果可能放弃了解决,通篇看下感觉这个问题也不过如此,可能还会发现我在多个过程中循环进行,可问题不就是如此,你想去解决,就会有希望,不想去解决,就有可能一直摆在这。最后希望这个解决方法能给你带来帮助,若有帮助欢迎回头点赞支持。

故人已逝难辞岁,露水沾衣浸心头。

于二零二二年元月二十日作

这篇关于vaex报错TypeError: blake3.__new__() got an unexpected keyword argument ‘multithreading‘解决方法的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/210307

相关文章

PHP轻松处理千万行数据的方法详解

《PHP轻松处理千万行数据的方法详解》说到处理大数据集,PHP通常不是第一个想到的语言,但如果你曾经需要处理数百万行数据而不让服务器崩溃或内存耗尽,你就会知道PHP用对了工具有多强大,下面小编就... 目录问题的本质php 中的数据流处理:为什么必不可少生成器:内存高效的迭代方式流量控制:避免系统过载一次性

C++右移运算符的一个小坑及解决

《C++右移运算符的一个小坑及解决》文章指出右移运算符处理负数时左侧补1导致死循环,与除法行为不同,强调需注意补码机制以正确统计二进制1的个数... 目录我遇到了这么一个www.chinasem.cn函数由此可以看到也很好理解总结我遇到了这么一个函数template<typename T>unsigned

python获取指定名字的程序的文件路径的两种方法

《python获取指定名字的程序的文件路径的两种方法》本文主要介绍了python获取指定名字的程序的文件路径的两种方法,文中通过示例代码介绍的非常详细,对大家的学习或者工作具有一定的参考学习价值,需要... 最近在做项目,需要用到给定一个程序名字就可以自动获取到这个程序在Windows系统下的绝对路径,以下

JavaScript中的高级调试方法全攻略指南

《JavaScript中的高级调试方法全攻略指南》什么是高级JavaScript调试技巧,它比console.log有何优势,如何使用断点调试定位问题,通过本文,我们将深入解答这些问题,带您从理论到实... 目录观点与案例结合观点1观点2观点3观点4观点5高级调试技巧详解实战案例断点调试:定位变量错误性能分

Python中 try / except / else / finally 异常处理方法详解

《Python中try/except/else/finally异常处理方法详解》:本文主要介绍Python中try/except/else/finally异常处理方法的相关资料,涵... 目录1. 基本结构2. 各部分的作用tryexceptelsefinally3. 执行流程总结4. 常见用法(1)多个e

JavaScript中比较两个数组是否有相同元素(交集)的三种常用方法

《JavaScript中比较两个数组是否有相同元素(交集)的三种常用方法》:本文主要介绍JavaScript中比较两个数组是否有相同元素(交集)的三种常用方法,每种方法结合实例代码给大家介绍的非常... 目录引言:为什么"相等"判断如此重要?方法1:使用some()+includes()(适合小数组)方法2

504 Gateway Timeout网关超时的根源及完美解决方法

《504GatewayTimeout网关超时的根源及完美解决方法》在日常开发和运维过程中,504GatewayTimeout错误是常见的网络问题之一,尤其是在使用反向代理(如Nginx)或... 目录引言为什么会出现 504 错误?1. 探索 504 Gateway Timeout 错误的根源 1.1 后端

解决升级JDK报错:module java.base does not“opens java.lang.reflect“to unnamed module问题

《解决升级JDK报错:modulejava.basedoesnot“opensjava.lang.reflect“tounnamedmodule问题》SpringBoot启动错误源于Jav... 目录问题描述原因分析解决方案总结问题描述启动sprintboot时报以下错误原因分析编程异js常是由Ja

深度剖析SpringBoot日志性能提升的原因与解决

《深度剖析SpringBoot日志性能提升的原因与解决》日志记录本该是辅助工具,却为何成了性能瓶颈,SpringBoot如何用代码彻底破解日志导致的高延迟问题,感兴趣的小伙伴可以跟随小编一起学习一下... 目录前言第一章:日志性能陷阱的底层原理1.1 日志级别的“双刃剑”效应1.2 同步日志的“吞吐量杀手”

MySQL 表空却 ibd 文件过大的问题及解决方法

《MySQL表空却ibd文件过大的问题及解决方法》本文给大家介绍MySQL表空却ibd文件过大的问题及解决方法,本文给大家介绍的非常详细,对大家的学习或工作具有一定的参考借鉴价值,需要的朋友参考... 目录一、问题背景:表空却 “吃满” 磁盘的怪事二、问题复现:一步步编程还原异常场景1. 准备测试源表与数据