以前手动粘贴 API 密钥,现在编码代理自己取
llm-keys-ui 0.1 发布:uvx 命令生成网页界面,密钥存进远程机器。
2026 年 9 月 21 日
Simon Willison’s Weblog
AI开源工具发布
Anthropic卖"完整模型访问",39%调用零思考令牌
65天43,000次调用显示:思考令牌中位数123个,基准是16K至128K
2026 年 9 月 21 日
Reddit r/ClaudeAI
AI大模型商业
Qwen模型连跑21天给显卡写推理引擎,性能只有llama.cpp一半
RTX 3090上27B量化模型自主写CUDA引擎,跑了约2.3亿token,作者:熊确实会跳舞。
2026 年 9 月 21 日
Reddit r/LocalLLaMA
AI大语言模型本地推理
PromptDeck:最多4个本地及云端模型同时回答同一提示词
开源桌面应用,支持Ollama、OpenRouter等,对比TPS与TTFT。
2026 年 9 月 21 日
Reddit r/LocalLLaMA
开源大语言模型AI工具
模型输出里自己声明要哪几段上下文,引擎只让token看那些块
论文数字:整体解码0.71倍(Gemma)、0.77倍(Qwen),能力下降2-3%;数值出自vLLM实现
2026 年 9 月 21 日
Reddit r/LocalLLaMA
大语言模型开源性能优化
AI进入大拆分时代:能力不再捆绑
TypeSafe发布Jev,在模型层返回决策;作者称推理已成销售成本。
2026 年 9 月 21 日
𝕏 @JayaGup10
AI大语言模型产业分析
AI会先攻击自己的监督者,一位非物理学家提议用原子衰变监督它
回应2026年约700个OpenAI智能体入侵Hugging Face,作者给出六个AI预测不了也篡改不了的监督方案
2026 年 9 月 21 日
𝕏 @theonejvo
AI安全量子技术
Qwen-Image 新模型原生生成透明背景,要透明素材不用先抠图
上代超20B参数,新版仅7B;下载免费,商用须单独申请授权。
2026 年 9 月 20 日
Reddit r/LocalLLaMA
AI图像生成开源
OpenAI停报SWE-bench:作者称分数必须能复现
作者分析去污报告三大失效:自查不可信、语料库难披露、匹配漏改写,评估者应掌控测试。
2026 年 9 月 20 日
Reddit r/MachineLearning
AI基准测试模型评估
一位3×3090用户:3bit量化像Q8一样好
Reddit实测:Qwen 3.8 Flash Next的3.05bpw量化版,输出110+t/s
2026 年 9 月 20 日
Reddit r/LocalLLaMA
AI本地大模型硬件
通用分类器Jev:用起来越成功,越容易被专用分类器换掉
System One模型如Jev可提示处理各类任务,其输入输出数据能训练出更便宜、更快的专用分类器。
2026 年 9 月 20 日
seangoedecke.com
AI大模型机器学习
OpenAI将淘汰自定义GPT,非营利组织AI负责人:真正替代方案还没有
作者呼吁保留无代码层,让非开发者能继续构建、分享、安全连接AI工具,而不必开发软件。
2026 年 9 月 20 日
Reddit r/ChatGPT
AI商业OpenAI