📡
分享迁移35kb预提示到自托管Ollama的注意事项
𝕏2026 年 9 月 14 日
📡
开源GLM-5.3-Flash排第五,持平GPT-5.6-Sol
𝕏2026 年 9 月 3 日
📡
用户 speckx 实测 Mac Studio 本地跑 Qwen3.8 27B
𝕏2026 年 8 月 29 日
📡
@kwindla推出PhoneLLM,解决语音智能体延迟痛点
𝕏2026 年 8 月 28 日
📡
开发者分享本地H3部署AI生成25秒视频方法
𝕏2026 年 8 月 28 日
📡
drowzeys发布双DGX-Sparks训练的GLM 5.3-Flash模型
𝕏2026 年 8 月 27 日
📡
vllm_project 首日适配 Qwen3.8-Flash-Next 双平台
𝕏2026 年 8 月 26 日
📡
MiniMax_AI发布Awesome MiniMax H3 Integrations 索引仓库(24GB)
𝕏2026 年 8 月 25 日
📡
KubeAI 简化Kubernetes上AI模型部署
𝕏2026 年 8 月 24 日
📖
跑大模型单次成本高得离谱,但用户一多就划算
大语言模型AI推理2026 年 8 月 23 日
📖
RTX 5090能一口气读完一本书,但速度有点慢
本地大模型大语言模型2026 年 8 月 23 日
📡
Acurast 可部署闭浏览器后仍持续运行的自主AI代理
𝕏2026 年 8 月 12 日
📡
Cloudflare Agents周首日更新,支持Kimi大模型部署
𝕏2026 年 8 月 3 日
📡
Kimi K3 跑在 MI355X 上,性价比比 B300 更高
𝕏2026 年 8 月 2 日
📡
周一Kimi K3上线,先做这两步再上线
𝕏2026 年 7 月 26 日
📡
295B大模型现在单块GPU就能跑了
𝕏2026 年 7 月 14 日
📡
一条命令就能自建深度智能代理,数据全留在自己这
𝕏2026 年 7 月 14 日
📡
有人摸出了Mac连DGX Spark跑推理的方法
𝕏2026 年 7 月 5 日
📡
红帽推出AI平台,让企业自己做AI提供者
𝕏2026 年 7 月 2 日
📡
智谱GLM-5.2模型上线,推理效率又提了
𝕏2026 年 6 月 21 日
📡
Codex支持远程本地切换,需要的基础设施变少了
𝕏2026 年 6 月 20 日
📡
8GB显卡跑9B大模型,还调出了智能体
𝕏2026 年 4 月 7 日