AI Pulse

AI推理

5 篇文章 · 34 条信号 · 持续更新

📡

Google发布Stellar Colosseum,解决数学证明难题

𝕏2026 年 9 月 16 日
📖

分块矩阵乘法真正的功课不在乘法,在数据复用

性能分析矩阵计算2026 年 9 月 10 日
📡

1小时入门AI推理:分享入门Day0学习路径

𝕏2026 年 9 月 10 日
📡

MazeBench测试:GPT-6正确率仅14%

𝕏2026 年 9 月 8 日
📖

NInfer比llama.cpp快1.4-4.9倍,质量持平

大语言模型本地部署2026 年 9 月 5 日
📡

Mostik提出跨模型互联,成本仅1/20

𝕏2026 年 9 月 3 日
📡

Google发布3.8 Flash模型,六周出第三个

𝕏2026 年 9 月 3 日
📡

mostik_ai发布大模型潜空间推理协作方案(12)

𝕏2026 年 9 月 3 日
📡

Superlinked开源SIE,自托管成本降4倍

𝕏2026 年 9 月 1 日
📡

UC Berkeley开源FreeToken,单GPU跑753B大模型

𝕏2026 年 8 月 31 日
📖

七百行C代码让普通CPU跑现代AI模型

大语言模型开源2026 年 8 月 28 日
📖

跑大模型单次成本高得离谱,但用户一多就划算

大语言模型AI部署2026 年 8 月 23 日
📡

多校研究者开源FreeToken 4060能跑35B大模型

𝕏2026 年 8 月 22 日
📡

研究发现现有LLM智能体进化有巨大盲区

𝕏2026 年 8 月 19 日
📡

DeepSeek V4 Flash 自验证胜过Claude Fable 5

𝕏2026 年 8 月 18 日
📡

Qwen3.8-27B单张RTX 5090跑出百 tokens 每秒

𝕏2026 年 8 月 16 日
📡

通义千问发布大模型,单GPU每秒能生成四千多词

𝕏2026 年 8 月 13 日
📡

BTTInferGrid 推出去中心化AI推理网络安全框架

𝕏2026 年 8 月 12 日
📡

蚂蚁集团发布灵3.0 Flash,开源大模型参数效率登顶

𝕏2026 年 8 月 8 日
📡

英国主权AI基金押注Olix,要重构全球AI推理基建

𝕏2026 年 8 月 3 日
📡

OpenAI 内部模型Astra解开了10个未解难题

𝕏2026 年 8 月 3 日
📡

只用1905年前知识,AI能自己悟出相对论吗

𝕏2026 年 8 月 1 日
📡

同价位AI模型打擂台,结果居然一边倒

𝕏2026 年 7 月 31 日
📡

AI解决复杂问题的路子,其实和三千年前古希腊人一样

𝕏2026 年 7 月 29 日
📡

大语言模型可以自己控制推理算力开销了

𝕏2026 年 7 月 21 日
📡

估值72亿美元AI公司CEO预言,未来两年开源AI会垄断推理

𝕏2026 年 7 月 20 日
📖

99.9%可用率对AI推理意味着什么:故障域与架构要求解析

可靠性云计算2026 年 7 月 18 日
📡

Meta AI模型参加亚洲物理奥赛,拿了满分

𝕏2026 年 7 月 15 日
📡

GLM 5.2在推理速度榜拿了双料第一

𝕏2026 年 7 月 8 日
📡

开源大模型变强了,现在战场换到这边来了

𝕏2026 年 6 月 30 日
📡

DeepSeek推出新框架,AI推理速度最高提85%

𝕏2026 年 6 月 29 日
📡

常规推理速度性价比比快推理方案还高?

𝕏2026 年 6 月 26 日
📡

实时语音AI能跑稳,全靠这套GPU基础设施

𝕏2026 年 6 月 23 日
📡

下一代AI推理要用专门定制的基础设施了

𝕏2026 年 6 月 22 日
📡

混合AI推理和无头应用,现在就是未来

𝕏2026 年 6 月 21 日
📡

为啥快硅推理厂商还没跑上新GLM模型?

𝕏2026 年 6 月 19 日
📡

开发者Fabio开源定制ASIC低成本推理相关代码

𝕏2026 年 6 月 15 日
📡

AI现在会开‘头脑风暴会议’了

𝕏2026 年 5 月 13 日
📡

跑模型?真正在干活的是这些内核

𝕏2026 年 4 月 26 日

订阅 AI Pulse

每天 08:00 · 12:30 · 18:30 · 23:50 更新