Z.ai 开源编程工作台 ZCode,桌面、浏览器、终端共用一套源码
zai-org/ZCode 仓库已公开,含客户端、后端、共享 UI、Agent CLI 与运行时源码。
2026 年 9 月 21 日
GitHub
AI开源编程
AI巨头纷纷支持“给前沿定步调”,TechCrunch:缺乏细节
Anthropic CEO提出该计划,英伟达CEO黄仁勋称AI反弹是骗局。
2026 年 9 月 21 日
TechCrunch
AI行业观点科技媒体
教授:工作越“混乱”,越难被AI替代
Garicano的两个标准:任务难拆分、牵涉复杂人际网络;翻译、标准合同、簿记最危险。
2026 年 9 月 21 日
Reddit r/artificial
AI职场
27B开源模型写作盲测超过测试过的前沿模型,数学代码未动
Hemmingway-1,专攻故事对话邮件,EQ-Bench 4得1330分。
2026 年 9 月 21 日
Reddit r/MachineLearning
AI开源大语言模型
8小时、9模型、同一提示词:RTX 3060上谁最接近前沿智能?
本地前二是Qwen 3.8 27B系列:GSQ版最均衡,Q4版第一但更慢。
2026 年 9 月 21 日
Reddit r/LocalLLaMA
AI大语言模型本地部署
13个大模型答案验证系统,一个只看格式的基线超过8个
ZTC与JEV的AUC仅差0.0014,区间含零,并列第一。
2026 年 9 月 21 日
Hugging Face
AI大语言模型测评
以前手动粘贴 API 密钥,现在编码代理自己取
llm-keys-ui 0.1 发布:uvx 命令生成网页界面,密钥存进远程机器。
2026 年 9 月 21 日
Simon Willison’s Weblog
AI开源工具发布
Anthropic卖"完整模型访问",39%调用零思考令牌
65天43,000次调用显示:思考令牌中位数123个,基准是16K至128K
2026 年 9 月 21 日
Reddit r/ClaudeAI
AI大模型商业
Qwen模型连跑21天给显卡写推理引擎,性能只有llama.cpp一半
RTX 3090上27B量化模型自主写CUDA引擎,跑了约2.3亿token,作者:熊确实会跳舞。
2026 年 9 月 21 日
Reddit r/LocalLLaMA
AI大语言模型本地推理
PromptDeck:最多4个本地及云端模型同时回答同一提示词
开源桌面应用,支持Ollama、OpenRouter等,对比TPS与TTFT。
2026 年 9 月 21 日
Reddit r/LocalLLaMA
开源大语言模型AI工具
模型输出里自己声明要哪几段上下文,引擎只让token看那些块
论文数字:整体解码0.71倍(Gemma)、0.77倍(Qwen),能力下降2-3%;数值出自vLLM实现
2026 年 9 月 21 日
Reddit r/LocalLLaMA
大语言模型开源性能优化
AI进入大拆分时代:能力不再捆绑
TypeSafe发布Jev,在模型层返回决策;作者称推理已成销售成本。
2026 年 9 月 21 日
𝕏 @JayaGup10
AI大语言模型产业分析