AI Pulse

AI评测

1 篇文章 · 18 条信号 · 持续更新

📡

开发者实测Prime Agent 24小时分享使用体验评价

𝕏2026 年 8 月 7 日
📡

Multi-Agent Arena 开放免费对战大模型

𝕏2026 年 8 月 6 日
📡

EdotEnv 用量化交易环境训练LLM做研究

𝕏2026 年 8 月 5 日
📡

Homebench 能帮你测试本地大模型的性能

𝕏2026 年 8 月 4 日
📡

GPT-4.1返回的概率值居然位数不够用

𝕏2026 年 8 月 1 日
📡

DeepSeek新模型出来了,有人做了性能价格分析

𝕏2026 年 8 月 1 日
📡

AI编码助手要考试了,题目是用Supabase干活

𝕏2026 年 8 月 1 日
📡

测试榜第一的大模型,成本居然才对手一半

𝕏2026 年 7 月 26 日
📡

腾讯办AI编码榜,自家模型居然没拿一个第一

𝕏2026 年 7 月 25 日
📡

这个AI团队居然公开了全套测试数据集

𝕏2026 年 7 月 24 日
📡

开源工具能提前测出AI agent靠不靠谱了

𝕏2026 年 7 月 19 日
📡

大模型搜索能力比推理能力更强?这太反常识了

𝕏2026 年 7 月 19 日
📡

这个开源模型从不拒答任务,比Deepseek V4 Flash好用

𝕏2026 年 7 月 13 日
📖

新AI模型本地跑长文档更省内存,但推理可能打折

大模型NVIDIA2026 年 7 月 7 日
📡

人类专家要做二三十小时的题,AI抢先一步了

𝕏2026 年 7 月 2 日
📡

国内开源大模型GLM 5.2跑分超过了Claude

𝕏2026 年 6 月 29 日
📡

很多AI跑分,其实测的只是记忆力而已

𝕏2026 年 6 月 27 日
📡

本地跑国产大模型,速度对比GPT和Claude

𝕏2026 年 6 月 24 日
📡

Kimi K2.7没比Claude聪明,但胜在更快免费

𝕏2026 年 6 月 16 日

订阅 AI Pulse

每天 08:00 · 12:30 · 18:30 · 23:50 更新