|
GPU sort WIP (GPU 1000x faster than CPU? I must be doing something wrong)
|
|
12
|
2364
|
January 31, 2019
|
|
Most efficient way of _waiting_ for GPU results?
|
|
20
|
3366
|
January 31, 2019
|
|
CuArray/CUDAnative argmin paradoxical performance
|
|
2
|
892
|
January 31, 2019
|
|
Generic CPU and GPU loops with tiled iteration
|
|
3
|
938
|
January 31, 2019
|
|
Writing fast stencil computation kernels that work on both CPUs and GPUs
|
|
3
|
2310
|
January 29, 2019
|
|
`sync_threads()` doesn't seem to work within a loop
|
|
8
|
1548
|
January 27, 2019
|
|
MNIST GPU CuArrays error
|
|
23
|
3339
|
January 22, 2019
|
|
Casting, annotations and numeric types for CUDAnative
|
|
5
|
1544
|
January 21, 2019
|
|
Error of view on CuArrays with discrete indices
|
|
0
|
803
|
January 17, 2019
|
|
CuArray dot fuction error
|
|
2
|
681
|
January 16, 2019
|
|
Efficiency when handling jobs larger than VRAM
|
|
3
|
1129
|
January 15, 2019
|
|
Help wanted: CUDA error: an illegal memory access was encountered
|
|
1
|
4595
|
January 11, 2019
|
|
Is it possible to index a CuArray with a CuArray?
|
|
1
|
887
|
January 11, 2019
|
|
Presentation on effective use of CUDAnative/CuArrays
|
|
7
|
2470
|
January 3, 2019
|
|
GitLab CI for Julia GPU packages
|
|
9
|
2442
|
December 21, 2018
|
|
GPU kernel optimization (GPU vs CPU)
|
|
3
|
1591
|
December 14, 2018
|
|
Timing square function in CUDA
|
|
4
|
1768
|
December 11, 2018
|
|
CUDAnative is awesome!
|
|
12
|
6128
|
December 3, 2018
|
|
Multiprecision arithmetic in CUDA
|
|
1
|
1775
|
November 28, 2018
|
|
How much faster is GPU compare to CPU
|
|
16
|
27713
|
November 24, 2018
|
|
Strange behavior of `mapreduce`
|
|
2
|
739
|
November 16, 2018
|
|
CUDAnative support for Float16
|
|
5
|
1446
|
November 15, 2018
|
|
How to time CUDA Event
|
|
3
|
1119
|
November 15, 2018
|
|
cuArrays vs CUDANative
|
|
3
|
1429
|
November 14, 2018
|
|
Freeing memory in the GPU with CUDAdrv / CUDAnative / CuArrays
|
|
8
|
3174
|
November 13, 2018
|
|
How to set the diagonal part of a GPU Array
|
|
6
|
1509
|
November 12, 2018
|
|
Performance of view with cuArrays
|
|
11
|
2804
|
November 11, 2018
|
|
Is is possible to merge multiple kernels in CUDAnative to minimize launch overhead and execution overhead?
|
|
12
|
1720
|
November 11, 2018
|
|
Is there any plan for GPU linear algebra?
|
|
3
|
2083
|
October 25, 2018
|
|
Support for Complex-valued CuArray
|
|
2
|
776
|
October 12, 2018
|