AI Pulse

vLLM

9 条信号 · 持续更新

📡

vLLM 首日支持 DeepSeek-V4.1-Flash

𝕏2026 年 9 月 10 日
📡

讨论AMD GPU上vLLM的推测解码实现

𝕏2026 年 9 月 7 日
📡

vLLM 公开了高吞吐量推理系统的技术解剖

𝕏2026 年 8 月 7 日
📡

推理框架vLLM加入开源安全AI联盟

𝕏2026 年 7 月 29 日
📡

vLLM现已为开源强化学习基础设施提供支持

𝕏2026 年 7 月 13 日
📡

华为给vLLM加了原生量化支持

𝕏2026 年 6 月 5 日
📡

12B模型只用2.5B参数就跑起来了

𝕏2026 年 6 月 2 日
📡

198B参数的AI模型,每token只用11B

𝕏2026 年 5 月 30 日
📡

Mac跑大模型不用Python了

𝕏2026 年 4 月 25 日

订阅 AI Pulse

每天 08:00 · 12:30 · 18:30 · 23:50 更新