V

vLLM

V
vLLM AI v0.31.0rc4

v0.31.0rc4

[Bugfix][HiSparse] MTP受容の崩壊を FULL グラフで修正する。..

V
vLLM AI v0.31.0rc2

v0.31.0rc2

[Bugfix][Mamba] チェックポイントを 薄い。..

V
vLLM AI v0.30.0

v0.30.0

このリリースには315人の貢献者から762件のコミットメント (104件の新規) が含まれています!新しいモデル: DeepSeek-V4.1-Flash (#56214, #56228, #56208) で、FlashMLA V4.1レコードを介してSM100 (#56893), DeepGEMM Mega-mHC (#56962) でMXFP8にKV全体を格納し、Engram DPシェードリング (#56512) でアシンクエングラムプレフェッチ;DepSeek-V4-Flash-Vision-Exp (#54566),またROCm (#55107) でLoRA (#55897) で。..

V
vLLM AI v0.30.0rc2

v0.30.0rc2

[Bugfix][NIXL] 通知のみのリクエストの報告を受信するのを避ける (...

V
vLLM AI v0.29.1rc0

v0.29.1rc0

[ウォーターマーク] 二重鍵のガムベル・マックスウォーターマーク 憶測的な解読。..

V
vLLM AI v0.29.0

v0.29.0

このリリースには、277人の貢献者 (91人の新規) から594件のコミットメントがあります!Model Runner V2は、すべてのモデル (#53183) のデフォルトで、モデル (#48290) のプールで始まった展開を完了しました。MRV2はまた、KVキャッシュの自動サイズ化 (#53306),ステップごとにログットのメモリを1/TP (#50465),プロンプト埋め込み (#42963),extract_hidde...でカットするバッチ分割サンプリングのためのCUDAグラフメモリプロファイリングも獲得した。

V
vLLM AI v0.29.0rc6

v0.29.0rc6

[Bugfix][Core] ハイブリッドモデル (#55...

V
vLLM AI v0.29.0rc5

v0.29.0rc5

[Core] Mamba + E のデフォルトプレフィックス_キャッシュ_レテンション_インターバル

V
vLLM AI v0.29.0rc3

v0.29.0rc3

[CI] 削除されたnvidia/Nemotron-3-Nano-Omni-30B-A3B-Reasoning-BF1...

V
vLLM AI v0.29.0rc2

v0.29.0rc2

[Bugfix][Multimodal] SHMワーカーキャッシュで前項でカバーされた項目を扱う。..

V
vLLM AI v0.28.1rc0

v0.28.1rc0

[ツール] [レシピ] スイープの推奨や 短偽の解析を向上させる。..

V
vLLM AI v0.28.0

v0.28.0

このリリースには、 270人の貢献者 (76人の新規) から 584 のコミットメントがあります!Kimi-K3のパフォーマンス推進:キミ-K3のスタック全体での主要な最適化努力 ディコードコンテキストパラレル (DCP) サポート (#50484),融合FlashKDAデコードとプリフィールカーネル (#50654, #51311, #52458), MegaMoE (#50510) のSiTUアクティベーションサポート、シーケンスパラレリズム (#52079) のGEMM-RS,すべての収集者を組み合わせた。..

V
vLLM AI v0.28.0rc1

v0.28.0rc1

[バグ修正][セキュリティ] _load_ov2_プロセッサを _resolve_trust_remotで保護する。..

V
vLLM AI v0.27.2rc0

v0.27.2rc0: [スペック・デコード] DSpark信頼度確認プログラム (#47808)

署名: Lucas Wilkinson lwilkins@redhat.com 署名: Lucas Wilkinson LucasWilkinson@users.noreply.github.com 署名: Benjamin Chislett chislett.ben@gmail.com 署名: Lucas Wilkinson wilkinson.lucas@gmail.com 署名: Nick Hill nickhill123@gmail.com 共著者: OpenAI コデックス codex@openai.com 共著者: Claude Opus 5 (1M文脈) noreply@anthropic.com 共著者。..

V
vLLM AI v0.27.1

v0.27.1

これはv0.27.0の上のパッチリリースですサポート量子化DSpark マルコフヘッド (#50424)

V
vLLM AI v0.27.0

v0.27.0

vLLM v0.27.0 リリースノート ハイライト このリリースには、242人の貢献者から561件のコミットメント (64件の新規) が含まれています!Kimi K3 サポートは1つのリリースで完全なスタック着陸:コアモデルファイルとカーネル (#50089, #50000),Python (#50093) とRust (#50104) フロントエンド、AttnResカーネル (#50090),DeepGEMMサポート (#50458),圧縮テンサー量子化チェックポイント (#50500),DSpark AR 融合 (#50242),およびオプションt ...