频道导航

forceinline对CUDA C device函数的影响

2019-11-04 C&C++ 前端之家

前端之家收集整理的这篇文章主要介绍了__forceinline__对CUDA C __device__函数的影响，前端之家小编觉得挺不错的，现在分享给大家，也给大家做个参考。

关于何时使用内联函数以及何时在常规C编码中避免它,有很多建议. __forceinline__对CUDA C __device__函数有什么影响？应该在哪里使用以及在哪里避免？

解决方法

通常,nvcc设备代码编译器会自行决定何时内联特定的__device__函数,一般来说,您可能不需要担心使用__forceinline__ decorator /指令覆盖它.

cc 1.x设备没有与新设备相同的硬件功能,因此编译器通常会自动为这些设备内联函数.

我认为指定__forceinline__的原因与您对主机C代码的了解相同.当编译器可能无法内联函数时(例如,在cc 2.x或更新的设备上),它通常用于优化.如果你正在调用函数一次,那么这个优化(即函数调用开销)可能是微不足道的,但是如果你在循环中调用函数,那么确保它被内联可能会在代码执行方面给出明显的改进.

作为反例,内联和递归通常具有禁忌症.对于调用自身的递归函数,我认为不可能处理任意递归和严格内联.因此,如果您打算递归使用函数(在cc 2.x及更高版本中支持),您可能不希望指定__forceinline__.

一般来说,我认为您应该让编译器为您管理.它将智能地决定是否内联函数.

上一篇：c – 使用fstream编写的文件有哪些下一篇：c – 如何在OpenCV中对齐Kinect的R

猜你在找的C&C++相关文章

C++11新特性的一些用法举例②

/** C+⬑ * 默认成员函数原来C++类中，有6个默认成员函数：构造函数析...

作者：HJfjfK 时间：2024-09-28

C++特殊类的设计与单例模式

#pragma once // 1. 设计一个不能被拷贝的类/* 解析:拷贝只会放生在两个场景中：拷贝构造函...

作者：HJfjfK 时间：2024-09-28

C++11的类型转换

C类型转换 C语言:显式和隐式类型转换隐式类型转化：编译器在编译阶段自动进行，能转就转，...

作者：HJfjfK 时间：2024-09-28

C++异常的基本概念与用法

//异常的概念/*抛出异常后必须要捕获,否则终止程序(到最外层后会交给main管理,main的行为就...

作者：HJfjfK 时间：2024-09-28

C++的智能指针

#pragma once /*Smart pointer 智能指针;灵巧指针智能指针三大件//1.RAII//2.像指针一样使...

作者：HJfjfK 时间：2024-09-28

C++11标准库原子变量 <atomic> 梳理

目录<atomic>原子操作的概念CAS实现原理CAS操作的伪代码：使用CAS完成变量的...

作者：HJfjfK 时间：2024-09-28

C++11新特性的一些用法举例①

//字符串字面量/*常用:1.原始字符串字面量括号内保持原样输出没有转义字符,如n不再是换行...

作者：HJfjfK 时间：2024-09-28

C++11标准库条件变量 <condition_variable> 梳理

目录<condition_variable>condition_variable类类方法生产者消费者模型 -- ...

作者：HJfjfK 时间：2024-09-28

C++11智能指针 unique_ptr、shared_ptr/weak_ptr、make_shared、循环引用、定制删除器 (万字长文)

目录智能指针场景引入 - 为什么需要智能指针？内存泄漏什么是内存泄漏内存泄漏的危害内存泄...

作者：HJfjfK 时间：2024-09-28

/** 多态/动态调用 * * * 1.虚函数/虚拟函数 * 语法:在函数前面加上virtual * * 1.1虚函数...

作者：HJfjfK 时间：2024-09-28

编程分类

PHP Java Java SE Python C#C&C++Ruby VB asp.Net Go Perl netty Django Delphi Jsp .NET Core Spring Flask Springboot SpringMVC Lua Laravel Mybatis Asp Groovy ThinkPHP Yii swoole

最新文章