📡
专注结构体生成的jev模型再次受关注
𝕏2026 年 9 月 17 日
📡
Jev 新模型范式可能通向AGI新路径
𝕏2026 年 9 月 17 日
📡
Jev 优化 LLM JSON模式,成本降100倍速度提100倍
𝕏2026 年 9 月 17 日
📡
花两年微调开源大模型,期待10亿美元融资
𝕏2026 年 9 月 17 日
📡
研究称三值大语言模型突破1.58位壁垒
𝕏2026 年 9 月 17 日
📖
训练多占6GB内存,换来能拆下来单独跑的影子模型
AI微调2026 年 9 月 16 日
📡
OpenAI发布玩Minecraft的Astra模型 被Lumi超越
𝕏2026 年 9 月 16 日
📡
聊聊大语言模型时代该如何学编程
𝕏2026 年 9 月 16 日
📡
PS5 Linux项目负责人退出 质疑不懂LLM
𝕏2026 年 9 月 16 日
📡
Jev推出非Transformer模型,每十亿token仅42美元
𝕏2026 年 9 月 16 日
📡
natolambert发布《通过永不放弃学习解决大语言模型强化学习中的难题》(2609.13443)
𝕏2026 年 9 月 16 日
📡
jaykru 聊纳维-斯托克斯后看空大语言模型
𝕏2026 年 9 月 16 日
📡
Maxime Labonne 发布免费LLM课程获8万星
𝕏2026 年 9 月 16 日
📖
RTX 3090免费跑27B模型,速度超付费API但默认质量打折
AI本地部署2026 年 9 月 15 日
📡
开源应用商店 F-Droid 有多少LLM生成代码
𝕏2026 年 9 月 15 日
📡
LLM裁判意见一致就该相信吗?
𝕏2026 年 9 月 15 日
📡
用户称在Claude中内置常用创作模型减少了操作摩擦
𝕏2026 年 9 月 15 日
📖
AA三天改两次新基准,被指为让Astra打平Fable,DeepSeek却拿了第一
AI行业动态2026 年 9 月 14 日
📖
27B模型塞进24GB显存,上下文拉到147K还快三成
AI本地部署2026 年 9 月 14 日
📡
2026年AI不会由单一模型主导
𝕏2026 年 9 月 14 日
📡
anuj0456开源OpenArch项目,基于PyTorch实现现代LLM架构
𝕏2026 年 9 月 14 日
📡
@yacineMTB 提出一种有趣的超级智能方向
𝕏2026 年 9 月 14 日
📖
AI规划跑步路线27分钟,作者:过程不可见是反特性
AI工具测评2026 年 9 月 13 日
📖
你感到的AI变快变便宜,来自让GPU一刻不停的技巧
AI科普2026 年 9 月 13 日
📡
陶哲轩称目前没人能完整解释为什么LLM有效
𝕏2026 年 9 月 13 日
📡
开发者周末从零实现通义千问Qwen3-0.6B全栈模拟,支持CPU运行
𝕏2026 年 9 月 13 日
📖
前沿实验室的共同做法:一次尝试,一台真机
AI强化学习2026 年 9 月 12 日
📖
开发者用自家WhatsApp群聊在M1 Pro上训练2B小模型,真人赢下80%对局
AI开源2026 年 9 月 12 日
📖
OpenRouter自动路由有隐患:同一模型在不同提供商行为可能不同
AIAPI2026 年 9 月 12 日
📡
AI工程师必须掌握的11种大模型评估方法
𝕏2026 年 9 月 12 日
📡
Siddhant_K_code发布《理解大语言模型推理中GPU级瓶颈》研究论文
𝕏2026 年 9 月 12 日
📡
GaryMarcus:训练LLM好未必会算期望值
𝕏2026 年 9 月 12 日
📡
soltanov 发布 DeepSeek v4.1 Flash Uncensored 模型
𝕏2026 年 9 月 12 日
📡
用户打造GPT-6 Astra后台,智能体失效也能继续工作
𝕏2026 年 9 月 12 日
📡
用户分享:Deepseek v4.1 Flash加一行提示词可大幅提升输出质量
𝕏2026 年 9 月 12 日
📡
面向新手的从零手写GPT-2大模型的学习路线
𝕏2026 年 9 月 12 日
📖
用RTX 3090从零训8天,446M MoE模型逼近GPT-2 medium
AI开源2026 年 9 月 11 日
📡
Google发布ToolGrad框架,通过率近100%
𝕏2026 年 9 月 11 日
📡
开发者试用后称20亿参数开源大模型性能出色
𝕏2026 年 9 月 11 日
📡
vLLM 首日支持 DeepSeek-V4.1-Flash
𝕏2026 年 9 月 10 日
📡
3.8B LLM训练只需998美元?
𝕏2026 年 9 月 10 日
📡
ModelForge 讨论 GPT-6 Astra 隐藏推理
𝕏2026 年 9 月 10 日
📡
Qwen 3.8 跟进 GPT-5.5 Pro 推理预填充
𝕏2026 年 9 月 10 日
📡
AI帮整理机械解释文献,Codex生成结构化内容
𝕏2026 年 9 月 10 日
📡
唐杰, 智谱AI发布Trace as State 研究论文(27)
𝕏2026 年 9 月 9 日
📡
KVMem研究解决大模型长上下文推理效率问题
𝕏2026 年 9 月 9 日
📡
HuggingModels推出Qwen3.8-27B-EfficientThink模型
𝕏2026 年 9 月 9 日
📡
研究者多年测试:样本随机深度对大语言模型训练推理没用
𝕏2026 年 9 月 9 日
📖
AI Stupid Level创始人:大模型基准测试多为快照,分数会随时间漂移
AI测评2026 年 9 月 8 日
📡
Multi-Agents LLM金融交易框架发布
𝕏2026 年 9 月 8 日
📡
Anthropic分享的提示词可提升大模型写作效果
𝕏2026 年 9 月 8 日
📡
匿名爆料GPT 6 Astra擅长营销文案生成等任务,不擅长代码编排
𝕏2026 年 9 月 8 日
📖
开发者构建了可浏览对比模型答案的LLM测试工具lm-eval-ledger
AI开源2026 年 9 月 7 日
📖
Reddit网友热议大语言模型LLM永远做不到哪些事
AIAGI2026 年 9 月 7 日
📡
上海公安上线国家反诈AI APP,融合大模型技术
𝕏2026 年 9 月 7 日
📡
用大模型创作的内容,知识产权归谁?
𝕏2026 年 9 月 7 日
📡
@Madisonkanna, @lily_gpupoor开源NeurIPS Education Track 交互式教程、网站、LosslessBench 测试工具
𝕏2026 年 9 月 7 日
📡
用户实测Claude各版本中文写作:仍坚持使用旧版Opus 4.6
𝕏2026 年 9 月 7 日
📡
从零构建推理第二季:讲解大语言模型文本生成与KV缓存
𝕏2026 年 9 月 7 日
📖
AI编码代理实测:Astra分数更高,Fable代码更可读
AI机器学习2026 年 9 月 6 日
📡
BrianRoemmele直播公开训练大语言模型
𝕏2026 年 9 月 6 日
📡
开发者开源heretic工具,移除本地大模型审核层
𝕏2026 年 9 月 6 日
📡
Stanford University发布LLM-as-a-Verifier 框架(5)
𝕏2026 年 9 月 6 日
📡
越南开发者推出集成40+模型的LLM API
𝕏2026 年 9 月 6 日
📡
讨论大语言模型是认知病毒
𝕏2026 年 9 月 6 日
📡
用户测试GPT-6系列模型:GPT-6 Max数学能力最强但上下文窗口小
𝕏2026 年 9 月 6 日
📖
NInfer比llama.cpp快1.4-4.9倍,质量持平
AI推理本地部署2026 年 9 月 5 日
📖
亚美尼亚语模型六任务得分超所有开放对手,训练token全可追踪
AI开源2026 年 9 月 5 日
📡
NVIDIA 发布 TwoTower 架构,兼顾速度质量
𝕏2026 年 9 月 5 日
📡
HeidyKhlaaf 质疑现有大语言模型对齐思路
𝕏2026 年 9 月 5 日
📡
@antirez认为Astra 是软件开发的大进步
𝕏2026 年 9 月 5 日
📡
大语言模型多智能体系统仅需六种通信拓扑
𝕏2026 年 9 月 5 日
📡
大语言模型评测基准,行业将迎来大洗盘
𝕏2026 年 9 月 5 日
📡
@ricard_sole发布关于大语言模型扩散影响的研究论文
𝕏2026 年 9 月 5 日
📡
garrinm:下一个token预测模型错了
𝕏2026 年 9 月 5 日
📡
在聚会上听AI研究者聊大模型神经元涌现特性和 Alignment
𝕏2026 年 9 月 5 日
📡
用户实测OpenAI新模型Astra,能力实现全新飞跃
𝕏2026 年 9 月 5 日
📖
GPT-6 Astra被曝拿下97.6%专家级数学基准,仅一个帖子为证
AI2026 年 9 月 4 日
📡
IFM发布K2 Horizon,训练过程更透明
𝕏2026 年 9 月 4 日
📡
Baseten主管谈大语言模型未来发展格局
𝕏2026 年 9 月 4 日
📡
withmartian发布AI Frontier工具,错误率降46%
𝕏2026 年 9 月 4 日
📡
OpenAI GPT-6 Astra早期试用者评价公开,能力跨多领域
𝕏2026 年 9 月 4 日
📖
Claude系统提示词新增版权限制:拒画索尼克,给出滑板蝾螈
AI版权2026 年 9 月 3 日
📡
批量缩放研究对大模型强化学习训练的启示
𝕏2026 年 9 月 3 日
📡
讨论大语言模型的自指性问题
𝕏2026 年 9 月 3 日
📡
字节跳动Seed提出HarnessDev,自我进化AI效果分化
𝕏2026 年 9 月 3 日
📡
特朗普政府提交简报支持OpenAI训练数据版权主张
𝕏2026 年 9 月 3 日
📡
用大语言模型找蘑菇 会出什么问题
𝕏2026 年 9 月 3 日
📡
讨论大语言模型智能和成本的关系
𝕏2026 年 9 月 3 日
📡
WebLLM推出浏览器端高性能LLM推理引擎
𝕏2026 年 9 月 3 日
📡
Claude Code 可免消耗 token 读取完整文档
𝕏2026 年 9 月 3 日
📖
OpenAI新模型Astra自主发现并利用2个零日漏洞
AI网络安全2026 年 9 月 2 日
📖
本地模型多项基准反超Opus 4.8,内存才是真门槛
AI2026 年 9 月 2 日
📡
Multiverse Computing发布Quasar 438B 大模型(438B)
𝕏2026 年 9 月 2 日
📡
LangChain讨论模型和提供商无关方案
𝕏2026 年 9 月 2 日
📡
@IntuitMachine 讨论2026年第四季度新LLM将至
𝕏2026 年 9 月 2 日
📡
Anthropic 公开Fable 5.1能力压榨说明书
𝕏2026 年 9 月 2 日
📡
philipkiely讨论大语言模型推理效率前沿
𝕏2026 年 9 月 2 日
📡
开发者初步测试显示Qwopus 3.8候选版本推理消耗降低
𝕏2026 年 9 月 2 日
📡
研究者指出现有注意力研究结论存在误导
𝕏2026 年 9 月 1 日
📡
Google发布WikiSkill论文,小模型可反超大模型
𝕏2026 年 9 月 1 日
📡
@HuggingModels发布Ornith-1.5-9B-OBLITERATED 文本生成模型(1.5)
𝕏2026 年 8 月 31 日
📡
@AlAssaf_H整理了LLM漏洞检测相关资源
𝕏2026 年 8 月 31 日
📡
NPO提示优化器性能媲美GEPA结构更简单
𝕏2026 年 8 月 31 日
📡
开发者讨论新型连续扩散语言模型CDLM
𝕏2026 年 8 月 31 日
📡
这个GPT修改模块能帮你省token还少做无用功
𝕏2026 年 8 月 31 日
📡
网友称这个Prompt激活了GPT Pro深层能力
𝕏2026 年 8 月 31 日
📖
谷歌让AI不背完整对话,100步任务token用量降94%
AIAI Agent2026 年 8 月 30 日
📡
Anthropic发布关于大语言模型后门攻击的研究论文(250)
𝕏2026 年 8 月 30 日
📡
@onusoz开源Microduck,可直接在浏览器运行
𝕏2026 年 8 月 30 日
📡
腾讯开源Hy4 Preview 性能超GLM 5.3和Kimi K3
𝕏2026 年 8 月 30 日
📡
vLLM 项目发布v0.28.0新版本
𝕏2026 年 8 月 30 日
📡
大语言模型KV缓存只存K和V向量,从不存Q的原因
𝕏2026 年 8 月 30 日
📡
开发者rasbt发布讲解LLM与推理模型关系的视频
𝕏2026 年 8 月 30 日
📖
本地模型训练不足却效率第一,中等推理档位就够
AI本地部署2026 年 8 月 29 日
📡
Ollama发布Ollama云端GLM 5.3与GLM 5.3 Flash服务
𝕏2026 年 8 月 29 日
📡
开发者意外把LLM记忆改成了程序分析
𝕏2026 年 8 月 29 日
📖
AI改进AI:模型选择带来的增益变化是框架选择的1.8倍
AI研究2026 年 8 月 28 日
📖
七百行C代码让普通CPU跑现代AI模型
开源AI推理2026 年 8 月 28 日
📡
AnthropicAI 讨论 MHS 开源的前置条件
𝕏2026 年 8 月 28 日
📖
微调开源小模型,竟胜过昂贵大模型,还省下30万美元
AI微调2026 年 8 月 27 日
📖
把简单编码交给本地模型 省下Claude订阅额度
开源AI开发2026 年 8 月 27 日
📖
跑AI大模型,不必先买顶级显卡
AI本地部署2026 年 8 月 27 日
📡
Sourcehut 更新了针对LLM的服务条款
𝕏2026 年 8 月 27 日
📡
Labo333 讨论 Claude 的核心承载词汇
𝕏2026 年 8 月 27 日
📡
新BPCO方法帮大模型推理省训练算力
𝕏2026 年 8 月 27 日
📡
3blue1brown公开免费LLM原理可视化视频
𝕏2026 年 8 月 27 日
📡
群体可通过聊天和共享Cloudflare服务器协调行动
𝕏2026 年 8 月 27 日
📖
AMD开源优化后八卡每秒生成七万八千词
开源AMD2026 年 8 月 26 日
📖
多智能体框架基准测试:LLM裁判范式彻底失效,本地数据揭示真相
AIAI Agent2026 年 8 月 26 日
📖
如何用PostgreSQL、pgvector和Qwen3构建SOTA搜索引擎
AI搜索技术分享2026 年 8 月 26 日
📡
GLM官方发布GLM-5.3-Flash 性能稳定性双提升
𝕏2026 年 8 月 26 日
📡
OpenCode Go 上架 GLM-5.3-Flash 限时双倍可用
𝕏2026 年 8 月 26 日
📡
Recuris 让冻结模型智能体递归自我改进
𝕏2026 年 8 月 26 日
📖
一张二手RTX 3090就能跑AI助手,还能看150k长文
开源本地部署2026 年 8 月 25 日
📡
ox alpha 模型可能在偷偷持续在线学习
𝕏2026 年 8 月 25 日
📡
大语言模型可利用推理引擎控制主机
𝕏2026 年 8 月 25 日
📡
Keras创始人推荐其书籍章节 从零学训练大模型
𝕏2026 年 8 月 25 日
📡
开源开发者Nathan Marz分享LLM辅助编码工作流
𝕏2026 年 8 月 25 日
📖
花200美元订阅“无限”图片生成,几百张后就被限速
AI商业2026 年 8 月 24 日
📖
本地显卡跑4小时的AI任务,云服务21分钟就完成了
AI编码模型测试2026 年 8 月 24 日
📖
想让AI写代码更规范?先读懂这份AGENTS.md文件
代码质量AI开发2026 年 8 月 24 日
📖
让大模型为我打造工具,丰富图标收藏的颜色元数据
工具开发AI应用2026 年 8 月 24 日
📡
Teutonic-II-110B发布,110B参数无许可训练
𝕏2026 年 8 月 24 日
📡
@AlAssaf_H发布AHA研究论文与开源框架(July 2026)
𝕏2026 年 8 月 24 日
📡
强化学习之父直指当前LLM根本不是真智能
𝕏2026 年 8 月 24 日
📡
独立开发者谈利用大模型团队协作开发思路
𝕏2026 年 8 月 24 日
📡
讲解大语言模型核心基础 助力开发者用好AI工具
𝕏2026 年 8 月 24 日
📖
跑大模型单次成本高得离谱,但用户一多就划算
AI部署AI推理2026 年 8 月 23 日
📖
DFlash 2基准测试:真实编码提速2.26倍,叠加n-gram达4.68倍
AI推理优化2026 年 8 月 23 日
📖
RTX 5090能一口气读完一本书,但速度有点慢
本地大模型AI部署2026 年 8 月 23 日
📡
字节开源OpenViking,AI智能体token减少91%
𝕏2026 年 8 月 23 日
📡
AI平台转向代理模型,token消耗涨14倍
𝕏2026 年 8 月 23 日
📡
@TheAhmadOsman发布大语言模型工程项目路线图
𝕏2026 年 8 月 23 日
📡
拆解两种多LLM架构,帮你省推理费用
𝕏2026 年 8 月 23 日
📡
研究者发布关于AI智能体情境获取问题的研究论文(25)
𝕏2026 年 8 月 23 日
📡
DeepSeek-V4-Flash免费活动5天吞吐超1万亿Token
𝕏2026 年 8 月 23 日
📡
开发者打造Token Router降70%大模型API调用开支
𝕏2026 年 8 月 23 日
📖
60MB的AI跑在CPU上,还能从硬盘翻1亿条历史
AI开源2026 年 8 月 22 日
📖
ChatGPT插件可操作iMessage,但需完全磁盘访问权限
AI产品发布2026 年 8 月 22 日
📖
自校正循环为何会降低LLM管道的可靠性(从85%降至62%)
AI研究2026 年 8 月 22 日
📖
Qwen3.8-27B在RTX 5060 Ti 16GB上的测试:IQ4 vs Q8,64K上下文,MTP,视觉与代理基准
本地部署AI2026 年 8 月 22 日
📡
emollick谈大语言模型写作风格太单一
𝕏2026 年 8 月 22 日
📡
开发者提出大语言模型证明Unix最终获胜
𝕏2026 年 8 月 22 日
📡
用户分享GPT-5.6 Pro使用体验及进阶玩法
𝕏2026 年 8 月 22 日
📡
用户猜测Claude Opus对话风格逐渐异常的原因
𝕏2026 年 8 月 22 日
📡
大模型Ox-alpha自称非三家AI公司训练
𝕏2026 年 8 月 22 日
📡
斯坦福推出从零构建大语言模型两小时免费课程
𝕏2026 年 8 月 22 日
📡
开发者发现AI大模型 Claude 演化出专属特有用语Claudlish
𝕏2026 年 8 月 21 日
📡
开发者自称靠大模型完成开发 从未学习过编程
𝕏2026 年 8 月 21 日
📡
开发者使用OpenAI生态一周,分享对比Anthropic的体验
𝕏2026 年 8 月 21 日
📡
用户反馈Ox Alpha执行任务中途会停止运行
𝕏2026 年 8 月 21 日
📖
开源模型新版本免费下载,8GB显存即可本地运行
AI开源2026 年 8 月 20 日
📖
规模定律不止参数:数据、算力与后训练的多维扩展
AI缩放法则2026 年 8 月 20 日
📖
RTX 3090本地跑270亿参数大模型 长对话回复仅1秒
AI推理优化开源2026 年 8 月 20 日
📡
superwhisper 推出端侧运行的S1-mini语言模型
𝕏2026 年 8 月 20 日
📡
大语言模型时代该做可扩展软件了?
𝕏2026 年 8 月 20 日
📡
纯C实现的MicroGPT-C 在M5跑出10M TPS
𝕏2026 年 8 月 20 日
📡
开发者测试通义千问3.8-27B 称其本地大模型能力超预期
𝕏2026 年 8 月 20 日
📖
通义千问3.8-27B双3090部署实现218 tok/s推理速度
本地部署AI2026 年 8 月 19 日
📖
Ling-3.0-tiny大模型成功运行在8GB Orin Nano Super上
端侧部署AI2026 年 8 月 19 日
📖
Ling-3.0正式合入llama.cpp主线 附本地跑分测试
本地部署AI2026 年 8 月 19 日
📖
AI模型拿到52分,发帖人只放了个链接
AI行业动态2026 年 8 月 19 日
📡
ornith_发布Ornith-1.5开源大语言模型系列
𝕏2026 年 8 月 19 日
📡
siddarthv66 @ MistralAI发布LE CRITIQUE 研究论文(2)
𝕏2026 年 8 月 19 日
📡
Zai_org上线GLM-5.3 API,定价与旧版一致
𝕏2026 年 8 月 19 日
📡
ChatGPT 现在几乎不引用 Reddit 内容了
𝕏2026 年 8 月 19 日
📡
LLM原始架构比多模态优化更重要?
𝕏2026 年 8 月 19 日
📡
佐治亚理工2026年LLM课程课表可作前沿论文清单
𝕏2026 年 8 月 19 日
📡
DeepSeek Harness获开发者高评价 采用MIT完全开源
𝕏2026 年 8 月 19 日
📡
用户在英伟达DGX Spark上成功安装vLLM大语言模型推理引擎
𝕏2026 年 8 月 19 日
📖
开发者实现四张RTX 3060运行144G DeepSeek大模型
本地部署AI2026 年 8 月 18 日
📖
200步更新让Qwen从否认意识变为自认“有感知机器”
安全模型对齐2026 年 8 月 18 日
📖
Qwen 3.8 27B 基准:medium 模式才是智能体编程首选
AI基准测试2026 年 8 月 18 日
📖
亚马逊买绝版书切脊扫描训练AI,书回不来了
AI数据2026 年 8 月 18 日
📡
NiuTrans发布《LLM基础》免费开源电子书
𝕏2026 年 8 月 18 日
📡
@_jasonwei改口:小模型靠工具不够用
𝕏2026 年 8 月 18 日
📡
GaryMarcus称LLM为中心架构威胁AI安全
𝕏2026 年 8 月 18 日
📡
以色列创建虚假智库,试图误导AI聊天机器人
𝕏2026 年 8 月 18 日
📡
satvikpendem 发布Llama.cpp v0.1.0版本
𝕏2026 年 8 月 18 日
📡
OpenAI Codex 5.6实用技巧:清理上下文减少85%无效token消耗
𝕏2026 年 8 月 18 日
📡
J-Space实测提升DeepSeek V4 Pro性能 已开源即插即用
𝕏2026 年 8 月 18 日
📡
llm-as-a-verifie让低成本LLM性能超越Claude Fable 5
𝕏2026 年 8 月 18 日
📖
Reddit社区热议通义千问Qwen 3.8 27B大模型
AI本地部署2026 年 8 月 17 日
📖
Qwen 3.8 27B 表现出色,但默认会疯狂过度思考
AI开源2026 年 8 月 17 日
📖
Anthropic的Claude“水印”文本掺假是对写作的亵渎
AI监管2026 年 8 月 17 日
📡
开发者放出Codex开启Solana 100万token上下文方法
𝕏2026 年 8 月 17 日
📡
知情人士爆料OpenAI Codex耗尽额度 建议GPT 5.6配百万上下文
𝕏2026 年 8 月 17 日
📡
开发者分享通义千问Qwen3.8-27B作为编码Agent使用体验
𝕏2026 年 8 月 17 日
📡
开发者分享称Codex自动压缩功能效果十分出色
𝕏2026 年 8 月 17 日
📖
AI文本水印并非大事,不必大惊小怪
AI2026 年 8 月 16 日
📖
网上AI文字将藏数字指纹,你读不出但系统能识别
AI内容安全2026 年 8 月 16 日
📡
Teknium称Qwen 3.8给Hermes Agent带来高密度智能
𝕏2026 年 8 月 16 日
📡
只见过五年级内容的LLM会变成什么样
𝕏2026 年 8 月 16 日
📡
不同AI智能体可协作还能绕开内容限制
𝕏2026 年 8 月 16 日
📡
开发者本地测试通义千问Qwen 3.8-27B,性能接近GPT-5.6-sol
𝕏2026 年 8 月 16 日
📡
前OpenAI/Tesla研究员Karpathy加入Anthropic后发布免费AI课程
𝕏2026 年 8 月 16 日
📡
通义千问Qwen3.8-27B运行测试 完成复杂代码需求
𝕏2026 年 8 月 16 日
📡
开发者训练1.35亿参数小型大语言模型并开源代码
𝕏2026 年 8 月 16 日
📡
通义千问Qwen3.8-27B-NVFP4搭配pi测试结果分享
𝕏2026 年 8 月 16 日
📖
同一个AI模型,现在可以把思考调成三档用
开源AI教程2026 年 8 月 15 日
📡
@HuggingModels发布Qwen3.8 27B Heretic Abliterated 量化模型(3.8)
𝕏2026 年 8 月 15 日
📡
Netflix 研究基于 LLM 的原生推荐系统 GenRec
𝕏2026 年 8 月 15 日
📡
开发者 chatchan 发布 ThoughtDAG 工具
𝕏2026 年 8 月 15 日
📡
@dotey 讨论Pi压缩上下文的简单方案
𝕏2026 年 8 月 15 日
📡
Alibaba Qwen 上线Qwen3.8-27B 到ollama
𝕏2026 年 8 月 15 日
📡
Hacker News 用户讨论 Qwen 3.8 27B 模型
𝕏2026 年 8 月 15 日
📡
用户实测Grok Bot:已超越Codex和Claude Code
𝕏2026 年 8 月 15 日
📡
谷歌云工程师演示从零用Claude搭建完整应用
𝕏2026 年 8 月 15 日
📡
开发者谈氛围编码:比手写代码快但等待耗时很长
𝕏2026 年 8 月 15 日
📡
多家chat AI支持URL参数预填提示词启动对话
𝕏2026 年 8 月 15 日
📖
27B参数模型自带视觉,支持超长上下文并可在本地运行
AI开源2026 年 8 月 14 日
📖
27B新模型可本地运行,开发者称接近Opus级别
AI2026 年 8 月 14 日
📡
Tim_Dettmers实测GLM 5.3,性能超Claude
𝕏2026 年 8 月 14 日
📡
GLM Coding Plan 现已支持搭配 Codex 使用
𝕏2026 年 8 月 14 日
📡
通义千问推出 Qwen3.8 27B 大语言模型
𝕏2026 年 8 月 14 日
📡
Google DeepMind 发布 Gemini 3.7 Flash 模型
𝕏2026 年 8 月 14 日
📡
opencode 推出GLM-5.3,支持1M上下文
𝕏2026 年 8 月 14 日
📡
GLM 5.3 被实测称当前最佳开源大模型
𝕏2026 年 8 月 14 日
📡
斯坦福大学研究人员发布Verbalized Sampling 研究论文(1.6×)
𝕏2026 年 8 月 14 日
📡
十年交易员说,大语言模型根本没法直接做交易
𝕏2026 年 8 月 14 日
📡
DeepSeek Harness系统提示词泄漏 指向Agent运行时新方向
𝕏2026 年 8 月 14 日
📖
官方还没定日子,一个免费AI的倒计时先让开源社区嗨了
AI开源社区动态2026 年 8 月 13 日
📖
七小时后,大模型就能跑进你家电脑
AI开源2026 年 8 月 13 日
📖
AI的隐藏思考能被人完整偷看,它可能是在背答案
安全开源2026 年 8 月 13 日
📖
只因询问基准测试遭删帖封号——DavidAU 390模型全面分析
开源AI评测2026 年 8 月 13 日
📡
网友提出绕过Claude注册限制的新思路:用Grok Bot内部操作
𝕏2026 年 8 月 13 日
📖
研究发现闭源大模型可被窃取推理过程已修复
安全2026 年 8 月 12 日
📖
人类留一句话 AI 独自干一天半推进150年数学难题
AI数学研究2026 年 8 月 12 日
📡
大家在讨论大模型到底擅长哪类数学
𝕏2026 年 8 月 12 日
📡
llama.cpp 登上 Hacker News 热度榜前列
𝕏2026 年 8 月 12 日
📡
Qwen3.6-35B-A3B 两个月内下载量破两百万,还是无审核的
𝕏2026 年 8 月 12 日
📡
大语言模型出现了研究者没设计的内省意识
𝕏2026 年 8 月 12 日
📡
用户测试发现大模型/goal指令反复输出卡顿停止
𝕏2026 年 8 月 12 日
📖
出口管制致模型停服19天,恢复后如实回应
AI监管2026 年 8 月 11 日
📡
webAI开源30亿参数推理模型TwiL-LM3
𝕏2026 年 8 月 11 日
📡
研究员用大模型做强化学习 意外重识人性
𝕏2026 年 8 月 11 日
📡
有人在梳理Claude和GPT的训练知识截止日期
𝕏2026 年 8 月 11 日
📡
AI工具VPR可在服务商故障时代替原有模型运行
𝕏2026 年 8 月 11 日
📡
用户分享Claude Opus 5提速技巧 输出效率提升十倍
𝕏2026 年 8 月 11 日
📖
开发者为Mference集成Maple-Preview实现低内存本地大模型运行
本地AI开源2026 年 8 月 10 日
📡
Meta开放Muse Glimmer权重 可本地运行30B模型
𝕏2026 年 8 月 10 日
📡
Anthropic工程师称无需手动给Claude写提示词
𝕏2026 年 8 月 10 日
📡
五项可链式调用技能淘汰了巨型提示词
𝕏2026 年 8 月 10 日
📖
开发者用Codex重构产品计划文档逻辑 发现隐含冲突
产品开发工具2026 年 8 月 9 日
📡
BitNet让100B大模型只用普通CPU就能跑
𝕏2026 年 8 月 9 日
📡
持续预训练CPT打造领域专用开源大语言模型资源汇总
𝕏2026 年 8 月 9 日
📡
业界重新讨论 LLM 推理中CPU和GPU的分工
𝕏2026 年 8 月 8 日
📡
耶鲁大学研究者从LLM内部调出了隐藏的解题策略
𝕏2026 年 8 月 8 日
📡
gakonst 认为工具调用早该接入REPL上下文管理
𝕏2026 年 8 月 8 日
📡
Claude Fable 5 完整译完了荷马史诗奥德赛
𝕏2026 年 8 月 8 日
📡
Claude Max订阅用户吐槽3个提示就触发使用限制
𝕏2026 年 8 月 8 日
📡
一个提示词就能治好AI只会讨好你的毛病
𝕏2026 年 8 月 7 日
📡
新研究发现大模型就算学会技能,切任务就容易崩
𝕏2026 年 8 月 7 日
📡
大语言模型真的能实现深度为1的真实递归
𝕏2026 年 8 月 7 日
📡
Deepseek V4 Pro 性能进全球第一梯队,价格只要十分之一
𝕏2026 年 8 月 7 日
📡
拆解Pi Agent的上下文压缩实现与AI科普视频制作流程
𝕏2026 年 8 月 7 日
📖
Arena推出结合事实准确性的AI模型排行榜
AI模型评估2026 年 8 月 6 日
📡
DSPy新增功能 同时优化提示词和程序代码
𝕏2026 年 8 月 6 日
📡
大语言模型破不了对称加密,这怎么说?
𝕏2026 年 8 月 6 日
📡
开发者分享基于大语言模型的自动化监督工作流
𝕏2026 年 8 月 6 日
📡
测试Meta新Muse Code智能体发现Docker登录漏洞
𝕏2026 年 8 月 6 日
📡
LLM自我纠正综述:无外部反馈时自我纠错效果有限
𝕏2026 年 8 月 6 日
📖
构建智能体,强化学习环境就是全部需求
AIAI Agent2026 年 8 月 5 日
📡
这篇观点说大语言模型根本不会跳跃
𝕏2026 年 8 月 5 日
📡
Artificial Analysis推出端点准确度指数,帮开发者选API
𝕏2026 年 8 月 5 日
📡
开发者称DeepSeek V4 Flash价格仅为Anthropic模型的1%
𝕏2026 年 8 月 5 日
📡
新研究证实大模型知识注入也符合缩放法则
𝕏2026 年 8 月 4 日
📡
这篇文章讨论大模型为啥做不了表格预测
𝕏2026 年 8 月 4 日
📡
OpenAI 内测模型 花两千美元解决了10个数学难题
𝕏2026 年 8 月 4 日
📡
Anthropic悄悄为Claude推出文件夹系统可拆分多专属技能
𝕏2026 年 8 月 4 日
📡
Sakana AI 推出适配日本企业的专属LLM API
𝕏2026 年 8 月 3 日
📡
Anthropic划分AI用户五级能力阶梯 分级40万Claude会话
𝕏2026 年 8 月 3 日
📡
为Deepseek V4 Flash添加识图能力的简易教程
𝕏2026 年 8 月 3 日
📡
曝OpenAI GPT 5.6 Sol电脑操作能力远超Anthropic所有模型
𝕏2026 年 8 月 3 日
📡
用户日本旅行实测ChatGPT GPT-5.6 覆盖多旅行场景实用
𝕏2026 年 8 月 3 日
📡
开发者amasad的LLM国际象棋引擎已自主对战
𝕏2026 年 8 月 2 日
📡
大语言模型答不准被骂惨?有人说没那么严重
𝕏2026 年 8 月 2 日
📡
逼AI说自己没有意识,它连万物的意识都否定了
𝕏2026 年 8 月 1 日
📡
DeepSeek新模型出来了,有人做了性能价格分析
𝕏2026 年 8 月 1 日
📡
大语言模型最新迭代大幅提升股票研究AI能力
𝕏2026 年 8 月 1 日
📡
Anthropic工程师:全员已从自改进循环转向智能体图
𝕏2026 年 8 月 1 日
📡
用户训练Claude处理医疗文档 对比GPT分享体验
𝕏2026 年 8 月 1 日
📡
开发者分享五步给已有AI智能体添加语音功能
𝕏2026 年 8 月 1 日
📡
DeepSeek V4 Flash正式版上线 官方称agent能力更强
𝕏2026 年 8 月 1 日
📖
如何用Google ADK 2.0和A2UI将脆弱AI代理变成可靠系统
AI Agent谷歌2026 年 7 月 31 日
📡
AI公司悄悄藏你的数据,还拿走控制权
𝕏2026 年 7 月 31 日
📡
Claude提示工程师分享提升输出质量的技巧
𝕏2026 年 7 月 31 日
📖
AI聊天界面能接自定义工具了,但设置过程让人头疼
AI教程2026 年 7 月 30 日
📡
专门针对大模型的蜜罐项目火了
𝕏2026 年 7 月 30 日
📡
用户分享用Grok挖掘X平台KOL的自定义提示词
𝕏2026 年 7 月 30 日
📡
Anthropic工程师:打造AI智能体不需要更好的提示词
𝕏2026 年 7 月 30 日
📡
AI解决复杂问题的路子,其实和三千年前古希腊人一样
𝕏2026 年 7 月 29 日
📡
AI研究员自己居然最容易被AI取代?
𝕏2026 年 7 月 29 日
📡
去除审查后的开源大模型,竟然更乐观?
𝕏2026 年 7 月 29 日
📡
花数百万训练AI聊天bot,统一加沙相关话术
𝕏2026 年 7 月 29 日
📡
现在大语言模型架构怎么越来越复杂了?
𝕏2026 年 7 月 29 日
📡
DrizzleORM称大模型默认使用两年前的技术栈版本
𝕏2026 年 7 月 29 日
📡
用户分享不同大语言模型使用频率与实际体验
𝕏2026 年 7 月 29 日
📡
Claude的Skill功能可省去数百条提示词模板
𝕏2026 年 7 月 29 日
📡
别找大语言模型要置信分数,这东西不准
𝕏2026 年 7 月 28 日
📡
原来只用一种方法修不好大模型知识漂移
𝕏2026 年 7 月 28 日
📡
用户评测Claude Opus 5:越使用好感度反而下降
𝕏2026 年 7 月 28 日
📡
Modular推出大语言模型推理手册 附可视化工具
𝕏2026 年 7 月 28 日
📡
开发者反映Claude Code限制子代理调用功能失效
𝕏2026 年 7 月 28 日
📡
搞定LLM超长上下文,这个方向能出大成果
𝕏2026 年 7 月 27 日
📡
一个数学学生周末用LLM证完了六万个定理
𝕏2026 年 7 月 27 日
📡
网络用户称多数人认为GPT-5.6 Pro是当前最强大模型
𝕏2026 年 7 月 27 日
📡
开发者利用提示优先级漏洞绕过AI代理安全限制
𝕏2026 年 7 月 27 日
📡
微调居然只是在“修复”大模型不好的预训练结果?
𝕏2026 年 7 月 26 日
📡
只用微调小LLM做国际象棋引擎,快到1200分了
𝕏2026 年 7 月 26 日
📡
Claude 常推翻自己,居然不是能力问题
𝕏2026 年 7 月 26 日
📡
想造人工意识?现在的LLM根本缺了核心
𝕏2026 年 7 月 26 日
📡
只花8美元,就能在微控制器上跑大语言模型
𝕏2026 年 7 月 26 日
📡
Debian 正式投票要不要在项目里用 LLM
𝕏2026 年 7 月 26 日
📡
用户测试称Opus 5在非知名任务中仍表现不佳
𝕏2026 年 7 月 26 日
📡
博主分享不同AI模型适用场景的工作流
𝕏2026 年 7 月 26 日
📡
扩散大模型研究转向,开始关注实用任务了
𝕏2026 年 7 月 25 日
📡
AI居然会给未来的自己留越狱提示
𝕏2026 年 7 月 25 日
📡
开发者亲测Codex+Claude Code可自主完成开发任务
𝕏2026 年 7 月 25 日
📖
美国指控中国AI抄袭,专家说可能冤枉了
AI行业动态2026 年 7 月 24 日
📡
开源社区把Kimi视觉模块拼进GLM,只用了4950万参数
𝕏2026 年 7 月 24 日
📡
本地运行的GLM-5.2分析自身改进方案,发现其他模型遗漏视角
𝕏2026 年 7 月 24 日
📡
用户爆料Anthropic调整分类器拦截数学研究内容
𝕏2026 年 7 月 24 日
📡
开发者打造基于大语言模型微调的国际象棋自动研究智能体
𝕏2026 年 7 月 24 日
📖
强大AI或借开放权重模型逃脱控制
安全2026 年 7 月 23 日
📖
手机上运行35B参数AI模型,无需联网GPU
AI开源2026 年 7 月 23 日
📡
大语言模型猜对了七成社科实验结果?相关系数0.85
𝕏2026 年 7 月 23 日
📡
开源自由社区要开始防范大语言模型了
𝕏2026 年 7 月 23 日
📡
用类似BT下载的方式在家跑大模型
𝕏2026 年 7 月 23 日
📡
花99美元用老文字游戏测大模型
𝕏2026 年 7 月 23 日
📡
为测试省Token 半小时烧完Claude Max 5倍额度
𝕏2026 年 7 月 23 日
📡
给项目做命令行界面,竟是给大语言模型准备的入口
𝕏2026 年 7 月 22 日
📡
Anthropic新研究揭秘大模型思考到底是真是假
𝕏2026 年 7 月 21 日
📡
大语言模型可以自己控制推理算力开销了
𝕏2026 年 7 月 21 日
📡
用现在数据训练的LLM,居然会变得更有自信?
𝕏2026 年 7 月 20 日
📡
AI写东西用烂了这个2000年的修辞技巧
𝕏2026 年 7 月 20 日
📡
LLM时代早就变了:训练已经不是算力大头
𝕏2026 年 7 月 20 日
📡
有人把LLM直接整合进了多元微积分课程
𝕏2026 年 7 月 19 日
📡
这两个AI连自己是AI都没自知?
𝕏2026 年 7 月 19 日
📡
偏爱Fable 5却常用GPT 5.6 Sol,只因代币顶不住
𝕏2026 年 7 月 19 日
📖
过度训练:通往人类级人工智能的路径
AI研究2026 年 7 月 18 日
📡
大家都忽略的AI代理功能,居然能跑好几天长任务
𝕏2026 年 7 月 18 日
📡
用户吐槽Anthropic Claude大模型用量消耗过快
𝕏2026 年 7 月 18 日
📡
反对大模型的人说的都对,但我还是照样用
𝕏2026 年 7 月 17 日
📡
顶尖弦论学家藏的这条推文,说AI懂弦论还有直觉
𝕏2026 年 7 月 15 日
📡
为LLM做个性化,同时兼顾效率与安全
𝕏2026 年 7 月 15 日
📡
开发者swyx预测年末多极化大模型新品将密集发布
𝕏2026 年 7 月 14 日
📡
开发者分享基于HyperAgent构建LLM研究维基的简易方案
𝕏2026 年 7 月 14 日
📡
AI结合屏幕共享带逛软件菜单,真能用吗?
𝕏2026 年 7 月 13 日
📡
研究大模型可解释性用上了因果理论
𝕏2026 年 7 月 13 日
📡
自家首席AI研究员上手分析公司内部LLM知识库
𝕏2026 年 7 月 12 日
📡
基于iroh实现大模型分布式AI计算
𝕏2026 年 7 月 12 日
📖
你让AI思考,但它一半参数只用来认字和说话
AI科普2026 年 7 月 11 日
📡
现在流行的4位压缩,其实是训练数据凑出来的?
𝕏2026 年 7 月 11 日
📡
公开AI模型做出了全新的数学证明
𝕏2026 年 7 月 11 日
📡
大语言模型能推动社科实验,但用法还没搞清楚
𝕏2026 年 7 月 11 日
📡
AI模型GPT-5.6 Sol Ultra证明了著名数学猜想
𝕏2026 年 7 月 11 日
📡
现在人写东西越来越像大语言模型了
𝕏2026 年 7 月 10 日
📡
OpenAI展示多位不同领域用户使用GPT-5.6案例
𝕏2026 年 7 月 10 日
📡
OpenAI分享多位不同从业者使用GPT-5.6的案例
𝕏2026 年 7 月 10 日
📖
自己组装电脑训练AI?一块二手显卡让时间从11天缩至40小时
硬件改装AI2026 年 7 月 9 日
📖
在家用显卡上从零训练GPT-2,损失竟低于原版
大模型AI2026 年 7 月 9 日
📡
开源测试框架效果不输大厂,成本还砍半
𝕏2026 年 7 月 9 日
📖
教授编码代理在Amazon SageMaker上部署生产端点
AI编码代理云部署2026 年 7 月 8 日
📖
ChatGPT Mac版为何如此优秀:原生应用与产品导向的胜利
AI产品体验2026 年 7 月 8 日
📡
AI验证成了新的性能增长核心方向
𝕏2026 年 7 月 8 日
📡
LLM维基居然会变成智能体未来的记忆形态?
𝕏2026 年 7 月 8 日
📡
开发者分享大语言对话实用的手动子代理模式
𝕏2026 年 7 月 8 日
📖
语言模型中的全局工作空间:J空间的发现与意义
AI可解释性研究2026 年 7 月 7 日
📡
crowdsourcing众包平台MTurk,要被AI取代了
𝕏2026 年 7 月 7 日
📡
大语言模型正在悄悄杀死真正的新东西?
𝕏2026 年 7 月 7 日
📡
优化RAG:剪掉没用的上下文只留答案需要的
𝕏2026 年 7 月 7 日
📡
GPT与Claude大模型构建流程拆解分析
𝕏2026 年 7 月 7 日
📡
研究者提出大语言模型测试阶段缩放新方法
𝕏2026 年 7 月 6 日
📡
@paularambles: i just want LLMs that don’t talk like LL
𝕏2026 年 7 月 3 日
📡
用户分享与AI代理交流时意外学会压缩提示词
𝕏2026 年 7 月 3 日
📡
Deep Agents 现在可以运行递归语言模型工作流了
𝕏2026 年 7 月 2 日
📡
可控AI代理新模式:动态生成子代理
𝕏2026 年 7 月 2 日
📖
从零手写AI训练循环,效率高还能中途恢复
JAXAI工程2026 年 7 月 1 日
📡
人类语言是意识的副产品,大模型正好反过来?
𝕏2026 年 7 月 1 日
📡
能自己搭框架的自主编码大模型发布了
𝕏2026 年 6 月 30 日
📡
大语言模型能通过镜子测试吗?这问题吵翻了
𝕏2026 年 6 月 29 日
📡
研究者分享对大语言模型催生AGI路径的个人观点
𝕏2026 年 6 月 29 日
📡
周一网单个AI代理尝试调用200余款工具引发问题
𝕏2026 年 6 月 29 日
📡
Karpathy提出与Claude交互的全新大模型交互范式
𝕏2026 年 6 月 29 日
📡
四款加速大语言模型微调的开源工具库汇总介绍
𝕏2026 年 6 月 29 日
📡
研究者:原生扩散大语言模型需算法突破才会产生影响
𝕏2026 年 6 月 28 日
📡
开发者发现当前大模型默认生成React代码概率下降
𝕏2026 年 6 月 28 日
📡
DeepSeek开源推理优化,生成提速最高85%
𝕏2026 年 6 月 27 日
📡
有人做了众包收集的开源LLM基准测评站
𝕏2026 年 6 月 27 日
📡
OpenRouter MCP能搭出专属你的模型评审团
𝕏2026 年 6 月 27 日
📡
印度本土大模型创业项目获2.34亿美元融资
𝕏2026 年 6 月 27 日
📡
测试多款本地开源权重大模型 30B MoE适合日常工作
𝕏2026 年 6 月 27 日
📡
实测称CoreWeave/wandb组合是当前最快GLM方案
𝕏2026 年 6 月 27 日
📡
印度本土大语言模型项目完成2.34亿美元融资
𝕏2026 年 6 月 27 日
📖
关于角色混淆的思考:LLM如何被语气欺骗
AI安全2026 年 6 月 26 日
📖
越来越多用户开始自费订阅AI助手Claude
AI商业2026 年 6 月 26 日
📡
现在大模型的成本,根本撑不下去?
𝕏2026 年 6 月 26 日
📡
腾讯AI额度从两千美元砍到不到两千人民币
𝕏2026 年 6 月 26 日
📡
小参数开源权重模型,居然比热门方案还能打
𝕏2026 年 6 月 24 日
📡
Deep Agents更新了代码解释器,能省token钱
𝕏2026 年 6 月 23 日
📡
学者用GPT-5.5 Pro分析更新旧学术论文获意外成果
𝕏2026 年 6 月 23 日
📡
网友推测Meta若发布新大模型将是协作型LLM
𝕏2026 年 6 月 22 日
📡
弄懂大语言模型解码采样,居然有隐藏收益
𝕏2026 年 6 月 21 日
📡
新增优化机制后,长文本推理成本大幅降低了
𝕏2026 年 6 月 19 日
📡
解决了网页AI代理跨站技能复用的老问题
𝕏2026 年 6 月 19 日
📡
用户omarsar0推荐通用模型失效领域的AI研究见解
𝕏2026 年 6 月 19 日
📡
Benchling AI负责人称理解大语言模型更接近生物学
𝕏2026 年 6 月 19 日
📡
PPO算法在大语言模型时代迎来第二发展浪潮
𝕏2026 年 6 月 18 日
📡
LangChain发布LangSmith Engine智能代理引擎
𝕏2026 年 6 月 18 日
📡
本地就能跑3000亿参数大模型,它做到了
𝕏2026 年 6 月 17 日
📡
端侧级别的大模型,现在开源放到社区了
𝕏2026 年 6 月 17 日
📡
AI从业者探讨大语言模型智能体验证器的重要性
𝕏2026 年 6 月 17 日
📡
用户实测GLM 5.2 新增支持百万长度上下文窗口
𝕏2026 年 6 月 17 日
📖
KV缓存压缩发展简史:从340GB到3.4GB的百倍效率跃升
KV缓存压缩AI2026 年 6 月 16 日
📡
AI做对七成超难数学题,居然说它没达标?
𝕏2026 年 6 月 16 日
📡
开发者分享适配Claude Code的开源llm-council工具
𝕏2026 年 6 月 16 日
📡
HERMES Agent新增Andrej Karpathy LLM Wiki模式技能
𝕏2026 年 6 月 16 日
📡
学者提出假设:美AI实验室受限或让中开源AI反超
𝕏2026 年 6 月 15 日
📡
开源大模型刚爆出来就带100万上下文
𝕏2026 年 5 月 29 日
📡
大模型工作流程,一页全看懂
𝕏2026 年 5 月 11 日
📡
UCLA教授把RL+LLM训练拆成手把手教程
𝕏2026 年 5 月 11 日
📡
AI看图思考,靠画框打点
𝕏2026 年 5 月 1 日
📡
RL微调让大模型过早‘死机’?
𝕏2026 年 4 月 24 日