"cuda" Jobs

130 open tech roles matching “cuda”, taken straight from company career pages — not reposted from other job boards. Every listing is re-checked daily and closed roles are removed.

No "cuda" jobs in In London right now — showing "cuda" jobs in all locations.

Showing 20 of 130 results

baseten

Join Baseten as a GPU Kernel Engineer to optimize high-performance GPU kernels for cutting-edge AI applications.

baseten San Francisco Published 1 year ago
Flexible on stack 70% coding
Genmo

Join Genmo as a GPU Performance Engineer to optimize video generation models and achieve significant performance improvements.

Genmo San Francisco HQ Published 1 year ago
Flexible on stack
Coreweave

Join CoreWeave as a Senior Engineer to optimize GPU kernels for high-performance AI applications in a rapidly growing environment.

Coreweave Sunnyvale, CA / Bellevue, WA $182k–$242k/yr Published 2 months ago
70% coding
baseten

Join Baseten as a Software Engineer focusing on Model APIs to enhance AI model performance and developer experience.

baseten San Francisco Published 11 months ago
Etched

Join Etched as a Performance Modeling Engineer to develop performance models for cutting-edge AI hardware in a fully in-person team.

Etched San Jose Published 5 months ago
Flexible on stack
Together AI

Join Together AI as a Systems Research Engineer Intern to optimize GPU-accelerated algorithms for ML/AI applications.

Together AI San Francisco $58–$70/hr Published 1 week ago
Flexible on stack
Fal

Join fal as a Software Engineer to build and maintain systems for managing a large fleet of GPU servers in a growing AI platform.

Fal San Francisco $180k–$250k/yr Published 3 days ago
Flexible on stack 70% coding
Together AI

Join Together AI as a Systems Research Engineer Intern to optimize GPU programming for ML/AI applications in a collaborative environment.

Together AI San Francisco $58–$70/hr Published 1 week ago
Flexible on stack
Fireworks AI

Join Fireworks AI as a Software Engineer focused on Performance Optimization to enhance AI infrastructure efficiency and speed.

Fireworks AI San Mateo Published 1 year ago
Flexible on stack
Sarvam AI

Join Sarvam AI as a Senior Performance Engineer to optimize GPU kernels for high-performance ML systems.

Sarvam AI Bengaluru Published 1 month ago
Perplexity AI

Join Perplexity AI as a Technical Staff member to enhance our AI inference engine with cutting-edge technologies.

Perplexity AI San Francisco Published 5 months ago
Flexible on stack
Perplexity AI

Join Perplexity AI as an AI Inference Engineer to optimize and develop our inference engine for various model architectures.

Perplexity AI London Published 5 months ago
Flexible on stack
Fundamental

Join Fundamental as a Senior Applied Research Engineer to tackle technical challenges in AI model development for enterprise decision-making.

Fundamental Barcelona Published 6 months ago
Flexible on stack
Inferact

Join Inferact as a performance engineer to optimize vLLM, the fastest AI inference engine, working directly with hardware vendors.

Inferact Singapore S$200k–S$400k/yr Published 3 months ago
Flexible on stack
Inferact

Join Inferact as a performance engineer to optimize vLLM, the fastest AI inference engine, working with cutting-edge hardware.

Inferact San Francisco $200k–$400k/yr Published 8 months ago
Flexible on stack
Pika

Join Pika as a Senior/Staff ML Engineer to enhance AI-driven products through advanced inference acceleration and GPU optimization.

Pika Palo Alto HQ Published 3 months ago
Flexible on stack
Fireworks AI

Join Fireworks AI as a Member of Technical Staff to design and build systems infrastructure for AI workloads at scale.

Fireworks AI San Mateo Published 2 weeks ago
Flexible on stack
Together AI

Join Together AI as a Staff Software Engineer to architect and build the next generation AI cloud platform.

Together AI San Francisco $260k–$300k/yr Published 2 days ago
Flexible on stack