AI Pulse
📡 X 信号

悄无声息上线的大模型,只花一半钱搞定一半活

别再等更聪明的模型了。智能体时代从执行成本跌至谷底那天正式启动。

Ling-3.0-flash已经悄悄上线OpenRouter了。总参数量124B,激活参数量5.1B。没有发布活动,没有营销推广,它就这么直接出现了。

它的输出质量能和部分旗舰模型比肩,token成本大约是Claude的一半,而且你一按回车,带完整注释的代码块就生成好了。

我花了三天,把所有我不想做的任务都扔给它试了:
▫️把30页产品文档整理成结构化表格。字段错误比我手工整理还少。
▫️修复横跨5个文件的bug。它连测试用例都写好了。
▫️一口气生成了一个963行单文件的SaaS着陆页。玻璃拟态、粒子场、交互式工作流,全有了。

我逐行读过了这个着陆页。说句实在话:我写在提示词里的所有约束,它都做到了。粒子数量、devicePixelRatio上限、 reduced-motion降级方案,一个都没漏。

但凡是需要有人实际看渲染结果的事,它完全没概念。五个工作流节点,中心间距要求70px,圆圈宽度要求72px,最后三对重叠了。最后还是我手动挪的。

它不是那种能交给你做战略决策的模型。它是一匹不知疲倦的干活牛马。你的指令越清晰,越多内容能靠机器校验,它表现就越好。

智能体已经被炒了两年,一直没落地。阻碍从来都不是智能水平。之前跑一次的成本比雇个人还贵。

我现在的配置是:用旗舰模型做规划,让它来执行,中间我留一步验证。2026年,分层选用不同模型才是真正的优势。

它现在还是免费的。256K上下文,支持工具调用。把那些重复、结构化、可验证的工作从你桌上拿走,交给它试两天吧。把预算和注意力留给真正需要思考的事。别拿大锤砸坚果。

#AI #Agents #LLM

本文由 AI 翻译自英文原帖,技术名词保留英文。

查看 X 原帖

📬 订阅 AI Pulse

每天三次更新,不错过重要信号

▲ 回到顶部