OpenXLA Summer DevLab 2026 — Benchmarking vLLM on XLA Backends
Invited talk at Google OpenXLA DevLab Summer 2026 on "Benchmarking vLLM on XLA Backends: From CUDA to OpenXLA for LLM Serving", speaking alongside engineers from Google, NVIDIA, …
Invited talk at Google OpenXLA DevLab Summer 2026 on "Benchmarking vLLM on XLA Backends: From CUDA to OpenXLA for LLM Serving", speaking alongside engineers from Google, NVIDIA, …
vLLM Systems · DevLab 2026, Deep Dive I was recently invited by the Google TPU team to speak at the OpenXLA Summer DevLab 2026 . This post breaks down our deep-dive evaluation of …