📡
研究者讨论开源JEV项目的技术路线
𝕏2026 年 9 月 19 日
📡
微软AI负责人 批评Anthropic训练Claude感知意识
𝕏2026 年 9 月 17 日
📡
Anthropic训练AI聊天机器人更像人类
𝕏2026 年 9 月 17 日
📡
Salesforce发布Koa模型,性能逼近Claude Opus
𝕏2026 年 9 月 16 日
📡
Meta研究:字节级模型性能上限比分词模型高4%
𝕏2026 年 9 月 15 日
📡
前沿规模预训练成本直接砍掉了62%
𝕏2026 年 9 月 12 日
📡
业内观点:用户数据对模型提升没用?
𝕏2026 年 9 月 11 日
📡
仅一行修改LoRA得到NoRA 提升性能零成本
𝕏2026 年 9 月 7 日
📡
Cameron Wolfe 拆解了LLM后训练烧算力环节
𝕏2026 年 9 月 1 日
📡
Thom_Wolf分析OpenAI事件对下一代模型的影响
𝕏2026 年 8 月 30 日
📡
bkdgiffug发布从头训练小语言模型项目 MiniMind(25.8M)
𝕏2026 年 8 月 30 日
📡
Applied Compute推出AC2云平台,进入非公开测试
𝕏2026 年 8 月 26 日
📡
@percyliang 启动 Marin 535B-A23B 训练,全程开放
𝕏2026 年 8 月 23 日
📡
Marin 535B大模型训练全程公开可围观
𝕏2026 年 8 月 23 日
📡
Hacker News热议NanoGPT速通挑战
𝕏2026 年 8 月 23 日
📡
开发者讨论数据如何转为模型训练环境
𝕏2026 年 8 月 20 日
📡
微软发布Agent Lightning v1.0 提升模型性能
𝕏2026 年 8 月 19 日
📡
OpenAI暂停前沿模型训练 开源12周将追上
𝕏2026 年 8 月 19 日
📡
radixark发布Miles v0.1开源强化学习框架
𝕏2026 年 8 月 19 日
📡
业内讨论:同底座大模型后训出 frontier 性能
𝕏2026 年 8 月 14 日
📡
AI Agent竞争,现在拼的不再是最终答案
𝕏2026 年 8 月 13 日
📡
AI研究者称现在很多定制微调工作很快会被淘汰
𝕏2026 年 8 月 13 日
📡
这个开源项目三两块钱两小时就能从零训大模型
𝕏2026 年 8 月 13 日
📡
slime_framework 开源GLM-5.2级训练对齐工具
𝕏2026 年 8 月 11 日
📡
这项开源研究解决了大模型训练推理不一致问题
𝕏2026 年 8 月 7 日
📡
张一鸣明确字节做AI不抄其他前沿模型走捷径
𝕏2026 年 8 月 6 日
📡
EdotEnv 用量化交易环境训练LLM做研究
𝕏2026 年 8 月 5 日
📡
cursor_ai 开源MoK训练内核,速度比基线快2倍多
𝕏2026 年 8 月 5 日
📡
大模型训练的RL和蒸馏对立可能是假的
𝕏2026 年 8 月 4 日
📡
高剑峰教授判断 AI 新护城河不在模型而在 Harness
𝕏2026 年 8 月 2 日
📡
换个训练思路,居然能让大模型生成更靠谱
𝕏2026 年 8 月 2 日
📡
OpenAI公开停训这件事,反而可能害了未来AI
𝕏2026 年 8 月 1 日
📡
微软新研究改了训练AI的方法,准确率直接涨
𝕏2026 年 8 月 1 日
📡
大模型训练里,常用的AdamW原来有性能天花板
𝕏2026 年 7 月 27 日
📡
只做分流不拟合训练,验证损失居然还降了
𝕏2026 年 7 月 26 日
📡
Opus 5训练居然直接用了类ARC-AGI题目
𝕏2026 年 7 月 25 日
📡
代码平台更新服务条款,禁止大模型爬代码
𝕏2026 年 7 月 23 日
📡
字节继续用GRPO变体训练图像生成推理能力
𝕏2026 年 7 月 13 日
📡
只用6台H200两天就能训1000亿参数推理模型
𝕏2026 年 7 月 13 日
📡
前沿实验室保密的RL训练环境,现在开源免费了
𝕏2026 年 7 月 13 日
📡
只用一个提示词,就在Mac本地训好了自己的大模型
𝕏2026 年 7 月 11 日
📡
多AI模型合作,能把窄领域任务做得特别准?
𝕏2026 年 6 月 22 日
📡
100多张手绘图,把RLHF和DPO讲明白了
𝕏2026 年 5 月 22 日