AI Pulse

AI部署

2 篇文章 · 20 条信号 · 持续更新

📡

分享迁移35kb预提示到自托管Ollama的注意事项

𝕏2026 年 9 月 14 日
📡

开源GLM-5.3-Flash排第五,持平GPT-5.6-Sol

𝕏2026 年 9 月 3 日
📡

用户 speckx 实测 Mac Studio 本地跑 Qwen3.8 27B

𝕏2026 年 8 月 29 日
📡

@kwindla推出PhoneLLM,解决语音智能体延迟痛点

𝕏2026 年 8 月 28 日
📡

开发者分享本地H3部署AI生成25秒视频方法

𝕏2026 年 8 月 28 日
📡

drowzeys发布双DGX-Sparks训练的GLM 5.3-Flash模型

𝕏2026 年 8 月 27 日
📡

vllm_project 首日适配 Qwen3.8-Flash-Next 双平台

𝕏2026 年 8 月 26 日
📡

MiniMax_AI发布Awesome MiniMax H3 Integrations 索引仓库(24GB)

𝕏2026 年 8 月 25 日
📡

KubeAI 简化Kubernetes上AI模型部署

𝕏2026 年 8 月 24 日
📖

跑大模型单次成本高得离谱,但用户一多就划算

大语言模型AI推理2026 年 8 月 23 日
📖

RTX 5090能一口气读完一本书,但速度有点慢

本地大模型大语言模型2026 年 8 月 23 日
📡

Acurast 可部署闭浏览器后仍持续运行的自主AI代理

𝕏2026 年 8 月 12 日
📡

Cloudflare Agents周首日更新,支持Kimi大模型部署

𝕏2026 年 8 月 3 日
📡

Kimi K3 跑在 MI355X 上,性价比比 B300 更高

𝕏2026 年 8 月 2 日
📡

周一Kimi K3上线,先做这两步再上线

𝕏2026 年 7 月 26 日
📡

295B大模型现在单块GPU就能跑了

𝕏2026 年 7 月 14 日
📡

一条命令就能自建深度智能代理,数据全留在自己这

𝕏2026 年 7 月 14 日
📡

有人摸出了Mac连DGX Spark跑推理的方法

𝕏2026 年 7 月 5 日
📡

红帽推出AI平台,让企业自己做AI提供者

𝕏2026 年 7 月 2 日
📡

智谱GLM-5.2模型上线,推理效率又提了

𝕏2026 年 6 月 21 日
📡

Codex支持远程本地切换,需要的基础设施变少了

𝕏2026 年 6 月 20 日
📡

8GB显卡跑9B大模型,还调出了智能体

𝕏2026 年 4 月 7 日

订阅 AI Pulse

每天 08:00 · 12:30 · 18:30 · 23:50 更新