NVIDIA GPU的快速傅立叶变换

NVIDIA GPU的快速傅立叶变换

cuFFT库提供GPU加速的FFT实现，其执行速度比仅CPU的替代方案快10倍。cuFFT用于构建跨学科的商业和研究应用程序，例如深度学习，计算机视觉，计算物理，分子动力学，量子化学以及地震和医学成像。使用cuFFT，应用程序会自动受益于常规性能的改进和新的GPU架构。cuFFT库包含在NVIDIA HPC SDK和CUDA Toolkit中。

cuFFT设备扩展

cuFFT设备扩展（cuFFTDx）允许应用程序将FFT内联到用户内核中。与cuFFT主机API相比，这极大地提高了性能，并允许与应用程序操作融合。cuFFTDx当前是CUDA数学库早期访问计划的一部分。

cuFFT性能

cuFFT库针对NVIDIA GPU的性能进行了高度优化。请注意，第二张图表将16个Volta GV100 GPU的性能与8个新的GA100 Ampere Architecture GPU的性能进行了比较。

cuFFT的主要功能

复杂和真实数据类型的1D，2D，3D转换
支持多达16个GPU系统
多GPU C2C，R2C和C2R支持
类似于FFTW高级接口的熟悉的API
灵活的数据布局允许在单个元素和数组维度之间任意跨越
流式异步执行
半精度，单精度和双精度转换
批量执行
In-place and out-of-place transforms转换
线程安全且可从多个主机线程调用

人工智能芯片与自动驾驶

相关阅读:
公有云、私有云与混合云到底有什么区别？
分享两个“整人”的脚本语言代码
最强搜书工具集合
关于云服务器恢复快照时后服务器变得卡顿等问题的解决方法
Centos8.0编译安装稳定最新版的nginx
彻底禁止Win10自动更新工具Windows Update Blocker v1.5 汉化版
阿里云轻量应用服务器回滚快照后造成卡顿问题的解决方法
IaaS、PaaS和SaaS的区别
Everything文件搜索工具
Windows10自带软件一款性能监控工具

原文地址：https://www.cnblogs.com/wujianming-110117/p/14418985.html