AI Pulse

性能优化

2 篇文章 · 22 条信号 · 持续更新

📡

@thsottiaux 发布更快响应的GPT-6.1 Sol ultrafast

𝕏2026 年 10 月 9 日
📡

AI代理可协助分析生产追踪数据 定位性能瓶颈优化代码

𝕏2026 年 10 月 7 日
📡

KCoral让内核开发GPU吞吐量提升2.58倍

𝕏2026 年 10 月 6 日
📡

研究者发布ScienceBuddy交互式科研智能体(42.2%)

𝕏2026 年 10 月 2 日
📡

pptadversary 讨论 llama.cpp 提示词查找提速优化

𝕏2026 年 9 月 28 日
📡

PrunaAI开源Pruna-Qwen-Image-2.1 少步数LoRA适配器集合(6.3×)

𝕏2026 年 9 月 25 日
📖

模型输出里自己声明要哪几段上下文,引擎只让token看那些块

大语言模型开源2026 年 9 月 21 日
📡

Laya移植MLX框架后比Jev快50倍

𝕏2026 年 9 月 20 日
📡

本地设备跑的laya-mlx比Jev快50倍,占1G内存

𝕏2026 年 9 月 20 日
📡

Jev 优化 LLM JSON模式,成本降100倍速度提100倍

𝕏2026 年 9 月 17 日
📡

只用免费的Gemini 3.7 Flash 就能获得5000倍代码性能提升

𝕏2026 年 8 月 29 日
📡

vLLM 在AgentX 1.0测试中跑出亮眼 token 吞吐

𝕏2026 年 8 月 25 日
📡

uv作者加入OpenAI,优化Codex CLI提速25倍

𝕏2026 年 8 月 22 日
📖

Qwen3.8-27B 262K上下文提速16倍,超越双3090

本地大模型AI2026 年 8 月 21 日
📡

纯C实现的MicroGPT-C 在M5跑出10M TPS

𝕏2026 年 8 月 20 日
📡

SGLang Omni项目CI CPU瓶颈分析与优化成果回顾

𝕏2026 年 8 月 20 日
📡

Qwen3.8-27B本地部署开启MTP实现吞吐翻倍

𝕏2026 年 8 月 16 日
📡

开发者tosh用Codex自动研究把内核提速232倍

𝕏2026 年 8 月 15 日
📡

pr337h4m 加速了 GPT-5.6 Sol 的运行速度

𝕏2026 年 8 月 14 日
📡

forkd 让AI沙箱启动速度快7倍,成本还大降

𝕏2026 年 8 月 13 日
📡

魔搭Ling-3.0-flash大模型用小参数打赢前代

𝕏2026 年 8 月 5 日
📡

本地AI跑起来,原来还要做这些脏活

𝕏2026 年 7 月 26 日
📡

想让慢AI变快?得先给它“减智”

𝕏2026 年 7 月 13 日
📡

DeepSeek开源推理优化,生成提速最高85%

𝕏2026 年 6 月 27 日

订阅 AI Pulse

每天 08:00 · 12:30 · 18:30 · 23:50 更新