Browse tech roles

Basic role filtering by workplace, salary floor, and post age. For full AI matching and advanced filtering upload your resume using AI Match.

6 of up to 20 (filtered)

Engineering Manager, LLM Inference & Deployment at Scale

Nvidia

Santa Clara, CA 14 days ago $224,000$356,500
Actively hiring Confirmed live yesterday High trust Above market
LLMs VLMs TensorRT TensorRT-LLM vLLM SGLang Quantization Speculative Decoding Continuous Batching Prefix Caching KV-cache Optimization Distributed Computing GPU Cluster Orchestration Model Serving Inference Optimization Deep Learning
8+ yrs exp Hybrid

Senior Principal Software Engineer, LLM Engineering

JPMorgan Chase

Palo Alto, CA 18 days ago
Actively hiring Confirmed live 2 days ago Trusted
LLMs GNNs MLOps LLMOps Python PyTorch TensorFlow Hugging Face AWS SageMaker Bedrock EKS Triton Inference Server vLLM Kubernetes Docker Terraform CI/CD infrastructure‑as‑code Java
10+ yrs exp

AI LLMOps Engineering Technical Leader

Cisco

Remote (San Jose, CA) 22 days ago $216,300$280,800
Actively hiring Confirmed live 2 days ago High trust Above market
MLOps LLM Python Java J2EE FastAPI Flask Spring Boot Docker Kubernetes LangChain LangSmith OpenAI Anthropic Llama ClearML MLflow Apache APISIX LiteLLM CI/CD
8+ yrs exp Remote

Engineering Manager, LLM Performance

Nvidia

Santa Clara, CA 37 days ago $224,000$356,500
Actively hiring Confirmed live yesterday High trust Above market
LLM VLM TensorRT-LLM vLLM SGLang CUDA C++ Python GPU Architecture Software Design Dynamo
7+ yrs exp Hybrid

Data Engineer, Agentic AI, LLM Training

Apple Inc

Austin, TX 148 days ago
Actively hiring Confirmed live 2 days ago High trust
Agentic AI LLM Training RAG LangChain LlamaIndex AutoGen Java Spring/Boot AWS Oracle MongoDB Vector * Databases Knowledge Graphs PEFT LoRA Transformer Architecture Microservices Distributed Systems Data Pipelines Machine Learning

Senior Staff LLM Serving Engineer, Cloud AI Engineering

Qualcomm

San Diego, CA +1 155 days ago $158,400$237,600
Actively hiring Confirmed live yesterday High trust Competitive pay
LLM PyTorch Python Triton-Inference Server vLLM SGLang CUDA Triton torch.compile torchDynamo Distributed Systems Kernel Design Deep Learning KV-Cache Management Model Optimization
4+ yrs exp