AI Pulse

大模型部署

1 篇文章 · 21 条信号 · 持续更新

📡

Qwen3.5-4B可本地部署替代Semif做jev

𝕏2026 年 9 月 20 日
📡

Baseten, Base Labs发布AI安全基础设施托管服务

𝕏2026 年 9 月 17 日
📡

框架对AI性能影响竟和模型本身一样大

𝕏2026 年 9 月 13 日
📡

MiaAI_lab发布可本地跑的DeepSeek v4视觉项目

𝕏2026 年 8 月 31 日
📡

博主和LMCache团队连讲6期大模型推理KVCache直播

𝕏2026 年 8 月 31 日
📡

开发者使用Qwen 3.8 27B报错 问题出在vLLM默认参数

𝕏2026 年 8 月 29 日
📡

NVIDIA AI发布新工具,两步部署Hugging Face模型推理

𝕏2026 年 8 月 19 日
📡

单24GB GPU跑Qwen3.8 27B达50TPS

𝕏2026 年 8 月 18 日
📡

Qwen3.8-27B本地部署开启MTP实现吞吐翻倍

𝕏2026 年 8 月 16 日
📡

@gosrum 实测通义千问 搭配 Claude Code 的运行表现

𝕏2026 年 8 月 15 日
📡

Qwen3.8-27B 能在17GB内存本地运行了

𝕏2026 年 8 月 15 日
📡

ggerganov发布不同硬件环境通义千问3 27B部署命令

𝕏2026 年 8 月 15 日
📡

DeepSeek V4 Flash 能在单块AMD芯片上运行

𝕏2026 年 8 月 5 日
📡

大模型Kimi和GLM 能更紧凑高效地规模化运行

𝕏2026 年 8 月 4 日
📡

跑2.8T大模型,一群人连肝五天终于搞定

𝕏2026 年 7 月 28 日
📖

用AI编程写文档?现在可以按分钟租容量,成本低至Claude的一成

AI2026 年 7 月 18 日
📡

9750亿参数大模型,现在280G显存就能跑

𝕏2026 年 7 月 16 日
📡

这个开源模型从不拒答任务,比Deepseek V4 Flash好用

𝕏2026 年 7 月 13 日
📡

桌面端跑出30tok/s,也能用上顶级AI

𝕏2026 年 7 月 5 日
📡

4GB显存就能跑70B大模型,不用砍模型

𝕏2026 年 6 月 26 日
📡

GLM-5.2能给DGX Spark生成专属CUDA核了

𝕏2026 年 6 月 22 日
📡

月之暗面Kimi代码模型,现在可以直接在这里用了

𝕏2026 年 6 月 15 日

订阅 AI Pulse

每天 08:00 · 12:30 · 18:30 · 23:50 更新