张鸿轩:大数据让无形之风尽在掌握 | 优秀毕业生专访

2024-04-13 23:32

本文主要是介绍张鸿轩:大数据让无形之风尽在掌握 | 优秀毕业生专访,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

640?wx_fmt=png


[ 导读 ]清华-青岛数据科学研究院(以下简称“数据院”)自2014年4月成立以来,秉承“学校统筹,问题引导,社科突破,商科优势,工科整合,业界联盟”的指导原则,搭建跨学科交叉融合平台,创新跨学科交叉培养模式,培养具有大数据思维和创新能力的“π”型人才。

 

大数据能力提升项目由清华大学研究生院,数据院及相关院系共同组织,面向在校研究生(包括硕士和博士)。项目形成大数据思维与技能、跨界学习、实操应用相结合的大数据课程体系和线上线下混合式教学模式,旨在提升学生数据分析和管理数据的能力,让学生在本专业的学习和实践中扩宽思维,并锻炼在本专业领域的数据研究能力。

 

截至2019年6月,已有来自31个院系的271名同学获得“大数据能力提升项目”证书,其中信息类同学160人,非信息类同学111人。

 

大数据提升项目究竟为同学们带来了什么改变?下面,就让我们聆听优秀毕业生们与大数据结缘的故事,一起发现大数据对他们学习、科研和创业的启发与帮助吧!

                  

640?wx_fmt=png


张鸿轩是清华大学电气工程专业硕士3字班的同学,师从胡伟副教授,即将入职中国南方电网电力调度控制中心。目前,主要研究方向是多能互补电力系统的优化运行和电力大数据的应用,参与并承担了相关研究领域的一项国家重点研发计划子课题和多项国家电网科技项目,发表了2篇SCI期刊论文和2篇EI会议。

 

志趣所向

“大数据项目让我找到了自己真正的兴趣”

 

 

大学阶段有个很大的优势就是“试错”成本低,在清华这样一个平台上,有着接触各类新鲜事物的机会,我们可以通过不断尝试从而找准自己真正感兴趣的研究方向。

张鸿轩向我们分享,自己与大数据的结缘是一个不断尝试的过程,并在这个过程中逐渐感受到了对大数据相关技术的浓厚兴趣。“最初学习大数据系统基础课时,我还只能算是一个小白,在老师的教导和小组成员的帮助下,我才逐渐成长,最终能在一个比较成功的课程项目中尽自己的一份力,这也是很有收获感的一件事;后来,人工智能课程则让我在基础理论上有了更全面的认识,也第一次让我觉得自己真的对于大数据相关技术有着浓厚的兴趣;而后随着不断地学习和进步,我在大数据分析课程中已经能够快速、高质量地完成作业,也对大数据技术和交叉学科的研究愈发热爱。他表示,大数据技术有着广泛的应用前景,对它的交叉研究既有趣也很有意义的事情。


 

大数据的学习让张鸿轩明确了自己真正的兴趣方向,也让他在团队合作的过程中感受到了自己专业能力的成长。“在课程组队参加的2018腾讯广告算法大赛和暑期实践中,我作为主干力量取得不错的成绩。在学习过程中,小组成员间的相互帮助、相互理解和相互包容也让我感受颇深。在大数据项目的课程学习和实践中,我能真切地感受到自己的不断成长,这段经历是我在大学阶段很宝贵的回忆。”

 

尝试是一个有趣的过程,但同时也势必面临着许多阻碍和困难,对此,张鸿轩认为,面对进入新领域的一些基本困难,只要愿意为其时间和精力,并且认真地坚持一段时间,就可能迎来一片新的天地。“虽然研究初期面临了各种阻碍,比如理论推导太过复杂、知识点记不住或者编程效率太低等,但只要愿意花时间,这些困难其实都是可以克服的,而且感受着自己的不断进步和成长也是很有自豪感的一件事!”

 

专业突破

“大数据让我抓到了风”

 

“我的主要研究方向是多能互补电力系统优化运行,也就是使用生成模型(generative model)对风光有功出力的多时空不确定性进行研究。通俗地讲,就是运用大数据模型更准确地抓到风。”涉及到自身专业的问题,张鸿轩兴致勃勃地向我们讲述了“如何运用大数据模型抓到风”。


“风电和光伏的有功出力会在很大程度上受到气候条件的影响,因此,风光出力不确定性的准确描述对于促进新能源消纳具有重要意义。但是,传统方法难以对考虑时空特性的大范围风电场和光伏电站有功出力的联合分布进行准确建模,我尝试使用生成模型(generative model)对风光有功出力的多时空不确定性进行了研究。目前最常用的生成模型包括了变分自编码器(VAE)和生成式对抗网络(GAN)两大类。在真实数据样本采集成本较高且难以大量获取的研究领域,GAN可以在少量数据样本中高效学习到各类特征,进而生成得到高质量的数据集;通过GAN网络也可以通过从历史数据中拟合得到的分布对当前数据进行修复,可以进一步提升采集系统的可靠性;GAN对于随机变量不确定性准确描述的能力更是使得其在大多数工科领域都有一定的应用潜力。”


640?wx_fmt=png

Fig. 1. 不同方法对风光有功出力概率密度函数的拟合情况



640?wx_fmt=png

Fig. 2. 真实样本和基于改进GAN生成样本结果的对比

 

在没有利用大数据前,“传统方法难以对考虑时空特性的大范围风电场和光伏电站有功出力的联合分布进行准确建模”,数据拟合性不够,导致风电场的出电效率不高。但是,通过利用大数据和人工智能相结合的方式进行数据建模,张鸿轩在“风光有功出力”问题上做出了创新性的科研突破,他真正在数据的形式上“抓住了”风。他表示:“利用大数据方法对于风光有功出力的拟合能力明显优于传统方法,且能够通过生成高质量的场景来准确描述风光出力的时空不确定性,这会是未来比较热门的研究方向。”

 

目前,大数据技术正蓬勃发展,在众多工程领域有着广泛的应用前景,对交叉学科的研究也有着非常重要的技术性和创新性意义。而清华大学大数据能力提升项目,而已经迎来了第三批毕业生,对此,张鸿轩向正在参与和未来可能参与大数据提升项目同学们送上祝福和寄语:


 

非常感谢清华大学研究生院、数据科学研究院和大数据协会给我们提供了这么好的平台和这么多的学习机会,让众多对数据科学感兴趣的同学能够互相交流、互相学习、共同进步,也希望同学们都能在大数据交叉领域的学习和研究中找到自己的志趣所向,发现大数据的魅力,利用大数据技术在专业领域内做出自己的创新和突破。


往期毕业生专访:

付睿:对新事物的追寻之旅 | 优秀毕业生专访

刘念宏:道与术,怎样才能真正学好大数据?

聂聪:数据科学让我为城市规划注入创新价值

姚振宇:数据科学培养下 我成为了那个不安分的"细菌"

张玉萍:数据科学的“融”是学术中的“锦上添花”

王斐:大数据学习助我完成行业撑杆跳

金语泽:大数据交叉思维让我更具创新力

王瑞琰:大数据引领我发现法学“新大陆”

龚亚丽:大数据助我打开传统行业发展新思路

张甜甜:在实践中迈进数据科学领域

640?wx_fmt=jpeg

这篇关于张鸿轩:大数据让无形之风尽在掌握 | 优秀毕业生专访的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/901515

相关文章

SQL Server修改数据库名及物理数据文件名操作步骤

《SQLServer修改数据库名及物理数据文件名操作步骤》在SQLServer中重命名数据库是一个常见的操作,但需要确保用户具有足够的权限来执行此操作,:本文主要介绍SQLServer修改数据... 目录一、背景介绍二、操作步骤2.1 设置为单用户模式(断开连接)2.2 修改数据库名称2.3 查找逻辑文件名

canal实现mysql数据同步的详细过程

《canal实现mysql数据同步的详细过程》:本文主要介绍canal实现mysql数据同步的详细过程,本文通过实例图文相结合给大家介绍的非常详细,对大家的学习或工作具有一定的参考借鉴价值,需要的... 目录1、canal下载2、mysql同步用户创建和授权3、canal admin安装和启动4、canal

使用SpringBoot整合Sharding Sphere实现数据脱敏的示例

《使用SpringBoot整合ShardingSphere实现数据脱敏的示例》ApacheShardingSphere数据脱敏模块,通过SQL拦截与改写实现敏感信息加密存储,解决手动处理繁琐及系统改... 目录痛点一:痛点二:脱敏配置Quick Start——Spring 显示配置:1.引入依赖2.创建脱敏

详解如何使用Python构建从数据到文档的自动化工作流

《详解如何使用Python构建从数据到文档的自动化工作流》这篇文章将通过真实工作场景拆解,为大家展示如何用Python构建自动化工作流,让工具代替人力完成这些数字苦力活,感兴趣的小伙伴可以跟随小编一起... 目录一、Excel处理:从数据搬运工到智能分析师二、PDF处理:文档工厂的智能生产线三、邮件自动化:

Python数据分析与可视化的全面指南(从数据清洗到图表呈现)

《Python数据分析与可视化的全面指南(从数据清洗到图表呈现)》Python是数据分析与可视化领域中最受欢迎的编程语言之一,凭借其丰富的库和工具,Python能够帮助我们快速处理、分析数据并生成高质... 目录一、数据采集与初步探索二、数据清洗的七种武器1. 缺失值处理策略2. 异常值检测与修正3. 数据

pandas实现数据concat拼接的示例代码

《pandas实现数据concat拼接的示例代码》pandas.concat用于合并DataFrame或Series,本文主要介绍了pandas实现数据concat拼接的示例代码,具有一定的参考价值,... 目录语法示例:使用pandas.concat合并数据默认的concat:参数axis=0,join=

C#代码实现解析WTGPS和BD数据

《C#代码实现解析WTGPS和BD数据》在现代的导航与定位应用中,准确解析GPS和北斗(BD)等卫星定位数据至关重要,本文将使用C#语言实现解析WTGPS和BD数据,需要的可以了解下... 目录一、代码结构概览1. 核心解析方法2. 位置信息解析3. 经纬度转换方法4. 日期和时间戳解析5. 辅助方法二、L

使用Python和Matplotlib实现可视化字体轮廓(从路径数据到矢量图形)

《使用Python和Matplotlib实现可视化字体轮廓(从路径数据到矢量图形)》字体设计和矢量图形处理是编程中一个有趣且实用的领域,通过Python的matplotlib库,我们可以轻松将字体轮廓... 目录背景知识字体轮廓的表示实现步骤1. 安装依赖库2. 准备数据3. 解析路径指令4. 绘制图形关键

解决mysql插入数据锁等待超时报错:Lock wait timeout exceeded;try restarting transaction

《解决mysql插入数据锁等待超时报错:Lockwaittimeoutexceeded;tryrestartingtransaction》:本文主要介绍解决mysql插入数据锁等待超时报... 目录报错信息解决办法1、数据库中执行如下sql2、再到 INNODB_TRX 事务表中查看总结报错信息Lock

使用C#删除Excel表格中的重复行数据的代码详解

《使用C#删除Excel表格中的重复行数据的代码详解》重复行是指在Excel表格中完全相同的多行数据,删除这些重复行至关重要,因为它们不仅会干扰数据分析,还可能导致错误的决策和结论,所以本文给大家介绍... 目录简介使用工具C# 删除Excel工作表中的重复行语法工作原理实现代码C# 删除指定Excel单元