AI Pulse

推理优化

2 篇文章 · 7 条信号 · 持续更新

📡

@jackyk02发布Contrastive Language Model (CLM)(CLM-8B)

𝕏2026 年 9 月 24 日
📡

Zai_org 分享GLM-5.3-Flash推理基建优化经验

𝕏2026 年 9 月 17 日
📡

@Madisonkanna, @lily_gpupoor开源NeurIPS Education Track 交互式教程、网站、LosslessBench 测试工具

𝕏2026 年 9 月 7 日
📖

DFlash 2基准测试:真实编码提速2.26倍,叠加n-gram达4.68倍

AI大语言模型2026 年 8 月 23 日
📖

开源工具包让AMD显卡跑AI提速59%,AI服务更便宜、响应更快

AI开源2026 年 8 月 21 日
📡

业界重新讨论 LLM 推理中CPU和GPU的分工

𝕏2026 年 8 月 8 日
📡

研究者指出这些新架构能大幅降低大模型推理内存消耗

𝕏2026 年 8 月 6 日
📡

不是所有任务都要堆最贵最强的大模型

𝕏2026 年 6 月 28 日
📡

让大模型自己组队打辩论,越打越会推理

𝕏2026 年 5 月 21 日

订阅 AI Pulse

每天 08:00 · 12:30 · 18:30 · 23:50 更新