DFlash 2基准测试:真实编码提速2.26倍,叠加n-gram达4.68倍
三天测试:DFlash 2在Qwen 3.8 27B上编码提速2.26倍,加n-gram草稿达4.68倍。
2026 年 8 月 23 日
Reddit r/LocalLLaMA
AI大语言模型推理优化
RTX 5090能一口气读完一本书,但速度有点慢
实测262K上下文预填充需166秒,解码速度从77 tok/s降至65 tok/s,调优不当还会爆显存。
2026 年 8 月 23 日
Reddit r/LocalLLaMA
本地大模型AI部署大语言模型
AI队友能独立复现科学论文,模型比主流AI小得多
它用270亿参数模型胜过Claude和GPT-5.5,让科学验证更自主。
2026 年 8 月 23 日
TechCrunch
AI创业科学研究
你选“高努力”,算力可能只剩一周前的四分之一
新旧版本对比发现,同一选项对应的数字映射从40降到了10,但界面显示一模一样。
2026 年 8 月 23 日
Reddit r/ClaudeAI
AI大模型
AI借钱建算力,十周翻三倍,抵押品是贬值飞快的芯片
贷款给AI公司Anthropic建算力设施,分高级和次级两层发放,玩法像房贷证券化。没人说清最终谁还债。
2026 年 8 月 22 日
Reddit r/artificial
AI融资芯片
数据中心疯狂:需十万亿美元年收入才能证明投入合理
巨额数据中心投资需天量收入支持,当前收益差距悬殊。
2026 年 8 月 22 日
Marcus on AI
AI数据中心商业
60MB的AI跑在CPU上,还能从硬盘翻1亿条历史
不用GPU,普通笔记本就能跑,回答问题时能从磁盘检索1亿token。
2026 年 8 月 22 日
Reddit r/MachineLearning
AI大语言模型开源
AI 不再只是对手,DeepMind 要让它在游戏里当你的伙伴
基于EVE宇宙,SIMA 2能理解自然语言指令,像真人一样陪你合作和做任务。
2026 年 8 月 22 日
Google DeepMind
AI游戏研究
ChatGPT插件可操作iMessage,但需完全磁盘访问权限
本地处理不存云端,但权限极高,风险需用户自行权衡。
2026 年 8 月 22 日
TechCrunch
AI产品发布大语言模型
实测9个模型:LLM简洁输出省钱保准,压缩输入不行
让LLM简洁输出能省钱保准,压缩输入提示则适得其反。
2026 年 8 月 22 日
Reddit r/MachineLearning
AI大模型研究
自校正循环为何会降低LLM管道的可靠性(从85%降至62%)
在结构化数据提取中,自校正循环反而降低一致性,从85%降至62%或更低。
2026 年 8 月 22 日
Reddit r/artificial
AI大语言模型研究
英伟达研究:真正的英雄是AI框架,而非模型
英伟达研究显示,AI长程任务的成败更多取决于框架而非模型本身。
2026 年 8 月 22 日
TechCrunch
AI研究智能体