AI Pulse

测试

5 篇文章 · 15 条信号 · 持续更新

📡

OpenRouter免费的Nex-N2.5 Pro实测支持Computer Use能力

𝕏2026 年 9 月 14 日
📖

GPT-6 Astra:视频通关48关CAPTCHA,真实注册7个只过2个

AI安全2026 年 9 月 11 日
📖

他用RTX 5080实测21个Qwen3.8量化版:最佳与最差相差16倍

AI大模型2026 年 9 月 5 日
📡

有人测了四款开源本地模型的联网搜索工具

𝕏2026 年 9 月 1 日
📡

两款开源大模型在单DGX Spark上开发游戏对决 结果双双宕机

𝕏2026 年 9 月 1 日
📡

三款AI模型被要求参考锦鲤池图片生成动画

𝕏2026 年 8 月 30 日
📡

Ox Alpha在Pi与DeepSeek Harness完成同项测试差距超预期

𝕏2026 年 8 月 25 日
📡

Gemini 3.7 Flash coding测试排名超过所有模型

𝕏2026 年 8 月 23 日
📡

开发者在DeepSWE测试中发现一款未知大模型得分超80%

𝕏2026 年 8 月 21 日
📡

不加额外框架,Claude Code就能跑满Arc-AGI-3满分

𝕏2026 年 8 月 20 日
📡

通义千问3.8 27B本地模型生成动画效果优于Grok 4.6

𝕏2026 年 8 月 16 日
📡

测试对比了Claude Code和Codex写代码的实际表现

𝕏2026 年 8 月 2 日
📡

测新大模型测到烦,管理成本越来越高了

𝕏2026 年 7 月 21 日
📡

社交平台用户分享测试内容称其有趣优质

𝕏2026 年 7 月 19 日
📡

用户@paranoidream在𝕏发布功能测试推文

𝕏2026 年 7 月 15 日
📖

本地同时跑18个AI任务不排队?新模型用“偷跑”技术实现

AI大模型2026 年 7 月 6 日
📡

用ffmpeg指令就能测试AI注意力机制靠谱性

𝕏2026 年 6 月 21 日
📖

软件测试的新纪元:AI如何提升QA质量

AI工程2026 年 6 月 7 日
📡

Rhys Sullivan 用 Claude 构建自托管执行器的真实测试套件

𝕏2026 年 6 月 4 日
📖

用AI写代码?现在还能自动测分布式系统,发现隐藏故障

AI分布式系统2026 年 5 月 21 日

订阅 AI Pulse

每天 08:00 · 12:30 · 18:30 · 23:50 更新