Skip to content

Pull requests: vllm-project/vllm

Author
Filter by author
Loading
Label
Filter by label
Loading
Use alt + click/return to exclude labels
or + click/return for logical OR
Projects
Filter by project
Loading
Milestones
Filter by milestone
Loading
Reviews
Assignee
Filter by who’s assigned
Sort

Pull requests list

[DSv4 Perf] Remove redundant full kernel for dsv4, 1.88x kernel performance improvement ready ONLY add when PR is ready to merge/full CI is needed
#50298 opened Jul 29, 2026 by yewentao256 Member Review required
[BugFix] Fix P/D preemption race condition bug Something isn't working kv-connector ready ONLY add when PR is ready to merge/full CI is needed v1
#50297 opened Jul 29, 2026 by njhill Member Review required
[Model Runner V2] Enable encoder token classification ready ONLY add when PR is ready to merge/full CI is needed v1
#50293 opened Jul 29, 2026 by taneem-ibrahim Contributor Approved
[Rust Frontend] Add standalone Rust renderer rust
#50289 opened Jul 29, 2026 by sagearc Contributor Draft
[Bugfix][Model Runner V2] Preserve Mamba block table capacity under DCP bug Something isn't working v1
#50287 opened Jul 29, 2026 by jongukc Contributor Review required
3 of 4 tasks
[Refactor] Remove multiple dead codes frontend quantization ready ONLY add when PR is ready to merge/full CI is needed v1
#50285 opened Jul 29, 2026 by yewentao256 Member Review required
[CI] Stabilize speculator memory teardown ready ONLY add when PR is ready to merge/full CI is needed v1
#50284 opened Jul 29, 2026 by AndreasKaratzas Member Review required
[Bugfix][LoRA] Make Punica shrink deterministic with split_k=1 bug Something isn't working
#50278 opened Jul 29, 2026 by fooSynaptic Review required
3 of 4 tasks
[Bugfix] Fix packed KV block zeroing stride bug Something isn't working v1 verified Run pre-commit for new contributors without triggering other tests
#50276 opened Jul 29, 2026 by wangxian001 Review required
Fix Qwen Omni timing for presampled videos multi-modality Related to multi-modality (#4194) qwen Related to Qwen models
#50274 opened Jul 29, 2026 by ccyyy1023 Review required
[Quantization] Honor --linear-backend for ModelOpt W4A16 quantization ready ONLY add when PR is ready to merge/full CI is needed
#50273 opened Jul 29, 2026 by netanel-haber Contributor Approved
ProTip! What’s not been updated in a month: updated:<2026-06-29.