vLLM Jobs in United States

Browse 49 vLLM jobs in United States on Inference Jobs.

21-40 of 49 jobs
6d agoNVIDIA logoNV

AI Inference Performance Engineer

NVIDIA

Santa Clara, California, United States (On-site)$152K – $241.5K Yearly
4d agoTogether AI logoTA

AI Researcher, Core ML

Together AI

San Francisco, California, United States (On-site)$200K – $280K Yearly
4d agoCrusoe logoCR

Applied AI Inference Engineer

Crusoe

San Francisco, California, United States (On-site)$250K – $300K Yearly
4w agoModal logoMO
4w agoCartesia logoCA

Inference Engineer

Cartesia

San Francisco, California, United States (On-site)$180K – $250K Yearly
2w agoNVIDIA logoNV

Senior AI Software Engineer, Kernel Libraries

NVIDIA

Santa Clara, California, United States (On-site)$184K – $287.5K Yearly
3w agoTogether AI logoTA

Senior Machine Learning Engineer, Voice AI

Together AI

San Francisco, California, United States (On-site)$200K – $260K Yearly
4d agoCrusoe logoCR

Senior Staff Software Engineer, Model LifeCycle

Crusoe

San Francisco, California, United States (On-site)$237.6K – $318.2K Yearly
4w agoOpenAI logoOP
1w agoCrusoe logoCR

Staff Software Engineer, Model LifeCycle

Crusoe

San Francisco, California, United States (On-site)$208.7K – $279.6K Yearly
2d agoNebius logoNE

Senior Applied Scientist, Efficient LLM Inference & Model Optimization

Nebius

Palo Alto, California, United States (On-site)$195.2K – $262.2K Yearly
1d agod-Matrix logoD-

Senior Staff ML Researcher - LLM Algorithmic Optimization

d-Matrix

Santa Clara, California, United States (Hybrid)$155K – $235K Yearly
4w agoBaseten logoBA

Engineering Manager - Forward Deployed Engineering (LLM)

Baseten

San Francisco, California, US or Remote (Worldwide)$260K – $380K Yearly
4w agoBaseten logoBA

Software Engineer - Model Performance

Baseten

San Francisco, California, US or Remote (Worldwide)$180K – $360K Yearly
Subscribe to this search

Get email updates when new jobs match this search.