📡
Qwen3.5-4B可本地部署替代Semif做jev
𝕏2026 年 9 月 20 日
📡
Baseten, Base Labs发布AI安全基础设施托管服务
𝕏2026 年 9 月 17 日
📡
框架对AI性能影响竟和模型本身一样大
𝕏2026 年 9 月 13 日
📡
MiaAI_lab发布可本地跑的DeepSeek v4视觉项目
𝕏2026 年 8 月 31 日
📡
博主和LMCache团队连讲6期大模型推理KVCache直播
𝕏2026 年 8 月 31 日
📡
开发者使用Qwen 3.8 27B报错 问题出在vLLM默认参数
𝕏2026 年 8 月 29 日
📡
NVIDIA AI发布新工具,两步部署Hugging Face模型推理
𝕏2026 年 8 月 19 日
📡
单24GB GPU跑Qwen3.8 27B达50TPS
𝕏2026 年 8 月 18 日
📡
Qwen3.8-27B本地部署开启MTP实现吞吐翻倍
𝕏2026 年 8 月 16 日
📡
@gosrum 实测通义千问 搭配 Claude Code 的运行表现
𝕏2026 年 8 月 15 日
📡
Qwen3.8-27B 能在17GB内存本地运行了
𝕏2026 年 8 月 15 日
📡
ggerganov发布不同硬件环境通义千问3 27B部署命令
𝕏2026 年 8 月 15 日
📡
DeepSeek V4 Flash 能在单块AMD芯片上运行
𝕏2026 年 8 月 5 日
📡
大模型Kimi和GLM 能更紧凑高效地规模化运行
𝕏2026 年 8 月 4 日
📡
跑2.8T大模型,一群人连肝五天终于搞定
𝕏2026 年 7 月 28 日
📖
用AI编程写文档?现在可以按分钟租容量,成本低至Claude的一成
AI2026 年 7 月 18 日
📡
9750亿参数大模型,现在280G显存就能跑
𝕏2026 年 7 月 16 日
📡
这个开源模型从不拒答任务,比Deepseek V4 Flash好用
𝕏2026 年 7 月 13 日
📡
桌面端跑出30tok/s,也能用上顶级AI
𝕏2026 年 7 月 5 日
📡
4GB显存就能跑70B大模型,不用砍模型
𝕏2026 年 6 月 26 日
📡
GLM-5.2能给DGX Spark生成专属CUDA核了
𝕏2026 年 6 月 22 日
📡
月之暗面Kimi代码模型,现在可以直接在这里用了
𝕏2026 年 6 月 15 日