Squareroot Consulting Pvt Ltd.
Senior Engineer - AI Inference & Kernel Optimization
- Hybrid
- On-site
7090 / year
... high-performance compute kernels for GPUs and/or custom AI accelerators- Develop low-level software in C/C++ and CUDA, targeting inference workloads for deep learning models- Apply advanced code optimization techniques, including : a. Vectorization (SIMD)b. Memory hierarchy optimization (registers, shared memory, caches)c. ...
Bengaluru, भारत