📡
OpenRouter免费的Nex-N2.5 Pro实测支持Computer Use能力
𝕏2026 年 9 月 14 日
📖
GPT-6 Astra:视频通关48关CAPTCHA,真实注册7个只过2个
AI安全2026 年 9 月 11 日
📖
他用RTX 5080实测21个Qwen3.8量化版:最佳与最差相差16倍
AI大模型2026 年 9 月 5 日
📡
有人测了四款开源本地模型的联网搜索工具
𝕏2026 年 9 月 1 日
📡
两款开源大模型在单DGX Spark上开发游戏对决 结果双双宕机
𝕏2026 年 9 月 1 日
📡
三款AI模型被要求参考锦鲤池图片生成动画
𝕏2026 年 8 月 30 日
📡
Ox Alpha在Pi与DeepSeek Harness完成同项测试差距超预期
𝕏2026 年 8 月 25 日
📡
Gemini 3.7 Flash coding测试排名超过所有模型
𝕏2026 年 8 月 23 日
📡
开发者在DeepSWE测试中发现一款未知大模型得分超80%
𝕏2026 年 8 月 21 日
📡
不加额外框架,Claude Code就能跑满Arc-AGI-3满分
𝕏2026 年 8 月 20 日
📡
通义千问3.8 27B本地模型生成动画效果优于Grok 4.6
𝕏2026 年 8 月 16 日
📡
测试对比了Claude Code和Codex写代码的实际表现
𝕏2026 年 8 月 2 日
📡
测新大模型测到烦,管理成本越来越高了
𝕏2026 年 7 月 21 日
📡
社交平台用户分享测试内容称其有趣优质
𝕏2026 年 7 月 19 日
📡
用户@paranoidream在𝕏发布功能测试推文
𝕏2026 年 7 月 15 日
📖
本地同时跑18个AI任务不排队?新模型用“偷跑”技术实现
AI大模型2026 年 7 月 6 日
📡
用ffmpeg指令就能测试AI注意力机制靠谱性
𝕏2026 年 6 月 21 日
📖
软件测试的新纪元:AI如何提升QA质量
AI工程2026 年 6 月 7 日
📡
Rhys Sullivan 用 Claude 构建自托管执行器的真实测试套件
𝕏2026 年 6 月 4 日
📖
用AI写代码?现在还能自动测分布式系统,发现隐藏故障
AI分布式系统2026 年 5 月 21 日