DSP_TMS320F28377D_算法加速方法3_使用TMU库加速

2023-11-21 00:20

本文主要是介绍DSP_TMS320F28377D_算法加速方法3_使用TMU库加速,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

继上两篇方法

DSP_TMS320F28377D_算法加速方法1_拷贝程序到RAM运行_江湖上都叫我秋博的博客-CSDN博客

DSP_TMS320F28377D_算法加速方法2_添加浮点运算快速补充库rts2800_fpu32_fast_supplement.lib_江湖上都叫我秋博的博客-CSDN博客

之后,本文继续讨论第三种DSP算法加速的方法——TMU库

TMU库在28377D的项目中,一般是自动配置上的,用户是无需任何操作的。

另外,本人实测,在28335项目中,TMU库是无效的,我怀疑28335就不支持TMU加速。如果有知道怎么操作的朋友,可评论区、私信告知。

该方法的加速能力比方法2还强。不过同样也有一个范围的:

 方法2我们简称为FPU加速,本文的方法(方法3)我们简称为TMU加速  FPU加速和TMU加速是两种互斥的方法,就是你用了某一种,就不能用另一种了。 所以你必须有所取舍

1 速度对比

下面我们从速度和精度两方面做一个对比,首先来看速度。(代码贴到最后吧)

TMU相比于FPU在速度上有非常明显的优势,TMU相比于FPU能够加速两倍以上。 (最后10 11 12,都是测试的小数的除法,12的结果是我直接用常数运算,而没有用变量的方式)。 

2 精度对比

精度方面,我用sin(1.9)来做一个对比测试吧。

可以看到精度都要损失,但是FPU和TMU两种方法的精度是一样的。

结论:对于相同的函数,最优的选择就是TMU

3 代码

代码的整体框架本文不赘述,看:DSP_基于TMS320F28377D双核芯片和CCS7.40的编程入门_ccs双核芯片下载_江湖上都叫我秋博的博客-CSDN博客

如何获取代码块的运行时间,本文也不赘述,看: DSP_TMS320F28377D_使用定时器实现<获取代码块运算时间>的功能_江湖上都叫我秋博的博客-CSDN博客

代码我就只贴一下main.c 和 main.h

// main.c
#include <main.h>float64 rt[13];
double s1;
double s2;
void main(void)
{int i;InitSysCtrl();DINT;InitPieCtrl();InitGpio();IER     = 0x0000;IFR     = 0x0000;InitPieVectTable();InitCpuTimers();s1 = sin(1.9);s2 = __sin(1.9);asm ("  ESTOP0");runtime_init();while(1){for(i = 0; i < 13; i++){runtime_start();testfunction(i+1);runtime_stop();rt[i] = runtime;}}}void testfunction(int sel){int i = 0;double s,a,b;a = 1.023;b = 2.312;switch(sel){case 1:for(i = 0; i < 1000; i++){s = sin(a);}break;case 2:for(i = 0; i < 1000; i++){s = __sin(a);}break;case 3:for(i = 0; i < 1000; i++){s = cos(a);}break;case 4:for(i = 0; i < 1000; i++){s = __cos(a);}break;case 5:for(i = 0; i < 1000; i++){s = atan(a);}break;case 6:for(i = 0; i < 1000; i++){s = __atan(a);}break;case 7:for(i = 0; i < 1000; i++){s = atan2(a,b);}break;case 8:for(i = 0; i < 1000; i++){s = __atan2(a,b);}break;case 9:for(i = 0; i < 1000; i++){s = sqrt(a);}break;case 10:for(i = 0; i < 1000; i++){s = __sqrt(a);}break;case 11:for(i = 0; i < 1000; i++){s = a/b;}break;case 12:for(i = 0; i < 1000; i++){s = __divf32(a,b);}break;case 13:for(i = 0; i < 1000; i++){s = 1.023 / 2.312;}break;default :break;}}// main.h
#include <F28x_Project.h>
#include <runtime.h>
#include <math.h>interrupt void CpuTimer0ISR(void);
#pragma CODE_SECTION(testfunction,".TI.ramfunc");void testfunction(int sel);

 算了,还是runtime的也贴上吧

// runtime.c#include <runtime.h>float64 runtime = 0;    // 单位usvoid runtime_init(void){ConfigCpuTimer(&CpuTimer1, 200, 10000000);   // 支持代码块最长运行时常10s
}void runtime_start(void){CpuTimer1Regs.TCR.bit.TRB = 1;  // 周期计时器重装载CpuTimer1Regs.TCR.bit.TSS = 0;  // 开始计数
}void runtime_stop(void){runtime = (float64)(CpuTimer1Regs.PRD.all -  CpuTimer1Regs.TIM.all) * 0.005;    // 等价于 / 200, 单位usCpuTimer1Regs.TCR.bit.TSS = 1;  // 停止计数
}// runtime.h
#ifndef PROGRAM_RUNTIME_RUNTIME_H_
#define PROGRAM_RUNTIME_RUNTIME_H_#include <main.h>extern float64 runtime;
void runtime_init(void);
void runtime_start(void);
void runtime_stop(void);#endif /* PROGRAM_RUNTIME_RUNTIME_H_ */

4 关于是否与方法1叠加加速

答:可以! 亲测可叠加!  

5 中断中是否可用

答:肯定可以!我猜的,我没测😄。 

后续会再推出DSP算法加速的方法与大家探讨。感谢您的阅读,如果您有什么优化方法,欢迎留言分享、收藏点赞

这篇关于DSP_TMS320F28377D_算法加速方法3_使用TMU库加速的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/398477

相关文章

python获取指定名字的程序的文件路径的两种方法

《python获取指定名字的程序的文件路径的两种方法》本文主要介绍了python获取指定名字的程序的文件路径的两种方法,文中通过示例代码介绍的非常详细,对大家的学习或者工作具有一定的参考学习价值,需要... 最近在做项目,需要用到给定一个程序名字就可以自动获取到这个程序在Windows系统下的绝对路径,以下

Java使用Javassist动态生成HelloWorld类

《Java使用Javassist动态生成HelloWorld类》Javassist是一个非常强大的字节码操作和定义库,它允许开发者在运行时创建新的类或者修改现有的类,本文将简单介绍如何使用Javass... 目录1. Javassist简介2. 环境准备3. 动态生成HelloWorld类3.1 创建CtC

JavaScript中的高级调试方法全攻略指南

《JavaScript中的高级调试方法全攻略指南》什么是高级JavaScript调试技巧,它比console.log有何优势,如何使用断点调试定位问题,通过本文,我们将深入解答这些问题,带您从理论到实... 目录观点与案例结合观点1观点2观点3观点4观点5高级调试技巧详解实战案例断点调试:定位变量错误性能分

使用Python批量将.ncm格式的音频文件转换为.mp3格式的实战详解

《使用Python批量将.ncm格式的音频文件转换为.mp3格式的实战详解》本文详细介绍了如何使用Python通过ncmdump工具批量将.ncm音频转换为.mp3的步骤,包括安装、配置ffmpeg环... 目录1. 前言2. 安装 ncmdump3. 实现 .ncm 转 .mp34. 执行过程5. 执行结

Python中 try / except / else / finally 异常处理方法详解

《Python中try/except/else/finally异常处理方法详解》:本文主要介绍Python中try/except/else/finally异常处理方法的相关资料,涵... 目录1. 基本结构2. 各部分的作用tryexceptelsefinally3. 执行流程总结4. 常见用法(1)多个e

Java使用jar命令配置服务器端口的完整指南

《Java使用jar命令配置服务器端口的完整指南》本文将详细介绍如何使用java-jar命令启动应用,并重点讲解如何配置服务器端口,同时提供一个实用的Web工具来简化这一过程,希望对大家有所帮助... 目录1. Java Jar文件简介1.1 什么是Jar文件1.2 创建可执行Jar文件2. 使用java

C#使用Spire.Doc for .NET实现HTML转Word的高效方案

《C#使用Spire.Docfor.NET实现HTML转Word的高效方案》在Web开发中,HTML内容的生成与处理是高频需求,然而,当用户需要将HTML页面或动态生成的HTML字符串转换为Wor... 目录引言一、html转Word的典型场景与挑战二、用 Spire.Doc 实现 HTML 转 Word1

Java中的抽象类与abstract 关键字使用详解

《Java中的抽象类与abstract关键字使用详解》:本文主要介绍Java中的抽象类与abstract关键字使用详解,本文通过实例代码给大家介绍的非常详细,感兴趣的朋友跟随小编一起看看吧... 目录一、抽象类的概念二、使用 abstract2.1 修饰类 => 抽象类2.2 修饰方法 => 抽象方法,没有

MyBatis ParameterHandler的具体使用

《MyBatisParameterHandler的具体使用》本文主要介绍了MyBatisParameterHandler的具体使用,文中通过示例代码介绍的非常详细,对大家的学习或者工作具有一定的参... 目录一、概述二、源码1 关键属性2.setParameters3.TypeHandler1.TypeHa

Spring 中的切面与事务结合使用完整示例

《Spring中的切面与事务结合使用完整示例》本文给大家介绍Spring中的切面与事务结合使用完整示例,本文通过实例代码给大家介绍的非常详细,对大家的学习或工作具有一定的参考借鉴价值,需要的朋友参考... 目录 一、前置知识:Spring AOP 与 事务的关系 事务本质上就是一个“切面”二、核心组件三、完