社区讨论:多数人认为亚马逊阻止Meta AI智能体符合自身利益,因为AI不会点击广告、也不受促销推荐影响,还会分流亚马逊的流量。有人指出目前没有区分正常个人AI代理和大规模爬虫的标准方法,平台只能一刀切封禁。有人尝试过Muse后没发现能显著改善生活的实际用途,也有用户表示会继续使用AI购物代理,寻找替代平台。
今天发生了什么1 分钟读懂
x.ai 发布 Grok 4.7 与配套的 Build 构建工具。发布方称其性能超过 Opus 5、价格只有一半;但第三方在 105 个代码漏洞修复测试里,它跑输 GPT-6 Astra 和 Muse Spark 1.3。宣传与实测打架,信哪边取决于任务。
来源meetpateltech「meetpateltech发布Grok 4.7模型」@elonmusk「X.ai 发布 Grok 4.7 驱动的 Build 构建工具」@AlexFinn「Grok 4.7发布,智能超Opus 5,价格仅其一半」@PawelHuryn「开发者实测Grok 4.7修复代码漏洞 成绩不及多个竞品」
小米开源 MiMo-V2.6-Pro,在智能指数评测拿到 46.32 分,创开源模型最高纪录。模型原生多模态,API 价格低于 Grok,已上线 OpenRouter。开源最强与低价同时出现,开发者多了一个不碰闭源的理由。
来源@victormustar「小米开源 MiMo-V2.6 得分创开源模型新高」@notjazii「小米发布 mimo v2.6 开源大模型 价格更低」
研究侧有另一条:IFM 的 MoVA 架构模型仅 36B 总参数、每 token 激活 4B,AAI 指数拿到 25 分,追平总参数量超 20 倍的模型。小模型靠架构设计逼近大模型,稀疏缩放路线多了一个注脚。
来源@IFM_AI「IFM_AI新模型性能追平20倍参数量模型」
03 Tim Dettmers 实验室发布前沿AI开源生态系统(2) 普通人也能不需要专业知识,在自己的硬件上自动压缩模型并运行大模型,完成千万token级别的AI任务
从明天开始,我们实验室将举办开源周:本次将推出 2 个软件框架、4 篇论文,所有内容共同构建一个连贯的生态系统。 主题:你自有硬件上的前沿人工智能 本次开源的成果包括以下领域的当前最优结果:自动压缩、自主研究、模型压缩、测试时缩放、深度研究…
04 reliquary_ai发布Reliquary-4B数学代码模型(4B) 这个模型用强化学习训练,任何人都可以加入网络贡献数据交互,独立参与者可以选择提示词生成训练数据。
介绍 Reliquary-4B。这是一个通过强化学习训练的 4B 参数数学与代码模型。 任何人都可以加入网络,贡献回滚数据。独立矿工选择提示词并生成回滚数据。协议验证这些数据后训练模型。 这里是模型及背后研究。
今日焦点
AI公司渲染AI将杀光人类,一位起诉它们的律师:这是借恐慌免责
最近,记者们就一系列不寻常的AI事件向我征求评论。上周,在某个AI版权案中,美国政府提交了一份“利益声明”,支持将AI训练视为对版权作品的合理使用。(无可奉告。)本周,某家AI公司的员工在社交媒体上发布了阴郁的帖子,谈及AI灭绝人类生命的可能性,于是我被问到这些AI公司是否犯下“反人类罪”。(无可奉告。)与此同时,美国各大报纸的专栏文章正在呼吁采取某种行动,任何行动。
我是作家、设计师、程序员和律师。2022年,我得知自己的作品被纳入了生成式AI公司的训练数据集。作为回应,我发起了第一批质疑这些做法合法性的诉讼。目前美国有142起此类案件。我是其中八起案件的原告共同代理律师。
深度阅读
🔥 信号雷达46 条
𝕏 实时信号 + arXiv 前沿论文,经 AI 聚类解读 · 一眼扫完全貌(含上方导读精选 4 条)
行业动态 · Hacker News▲ 137
aray07 发布 Transformer 可视化讲解项目
想要了解Transformer原理,不需要啃枯燥的公式和文字。这份可视化讲解能帮你更直观地理解这个核心AI架构。
aray07 发布 Transformer 可视化讲解项目
想要了解Transformer原理,不需要啃枯燥的公式和文字。这份可视化讲解能帮你更直观地理解这个核心AI架构。
行业动态 · Hacker News▲ 137
Amazon 阻止 Meta Muse AI 智能体在平台购物
大公司开始限制AI智能体在自有平台活动,对后续AI接入电商平台的路径会产生直接影响
Amazon 阻止 Meta Muse AI 智能体在平台购物
大公司开始限制AI智能体在自有平台活动,对后续AI接入电商平台的路径会产生直接影响
大模型 · @cb_doge▲ 9.1万
Grok 4.7法律任务得分 是另一模型三倍
在真实长期法律任务测试中,Grok 4.7得分超过所有其他参测模型,得分接近Fable 5.1的三倍,这是Grok系列又一次成绩领先。
Grok 4.7法律任务得分 是另一模型三倍
在真实长期法律任务测试中,Grok 4.7得分超过所有其他参测模型,得分接近Fable 5.1的三倍,这是Grok系列又一次成绩领先。
突发消息:Grok 4.7 在法律智能体基准测试中拔得头筹。在现实且长期的法律任务中,它取得了 19.6% 的分数,击败了所有其他参与测试的模型。
这几乎是 Fable 5.1 得分的三倍。这是 Grok 4.7 和 SpaceXAI 的又一场重大胜利。
行业动态 · Hacker News▲ 109
AI编程让持续集成成了瓶颈
AI编码带来的开发效率提升,暴露了传统持续集成流程跟不上需求的问题。这次重构可以给遇到同类问题的开发者参考。
AI编程让持续集成成了瓶颈
AI编码带来的开发效率提升,暴露了传统持续集成流程跟不上需求的问题。这次重构可以给遇到同类问题的开发者参考。
社区讨论:有人疑惑既然AI编程让开发速度变快了,为什么产品实际新增功能反而变少,也没出现够分量的替代新产品。有人认同原帖说法,指出GitHub Actions本身速度慢、稳定性差,付费自托管CI、Bazel能大幅提升构建速度,也有人认为瓶颈不在于CI,而在于人工测试环节。还有读者表示文中没对CI做首次注释缩写,看不懂这个缩写。
新品发布 · @superset_sh▲ 10.6万
superset_sh 推出 iPhone 端 Superset 应用
可以远程控制电脑上运行的代理,还能随时查看和合并PR,开发者不用守在电脑前也能处理工作。
superset_sh 推出 iPhone 端 Superset 应用
可以远程控制电脑上运行的代理,还能随时查看和合并PR,开发者不用守在电脑前也能处理工作。
工具产品 · @naifco▲ 11.7万
SkillMD推出AI Agent技能应用商店平台
不用每次重新教AI Agent完成任务,直接调用现成技能,支持Claude Code等常用开发工具,能简化AI Agent开发流程
SkillMD推出AI Agent技能应用商店平台
不用每次重新教AI Agent完成任务,直接调用现成技能,支持Claude Code等常用开发工具,能简化AI Agent开发流程
按技能数量计,它是全球第二大技能平台,并且在技能杀毒检测和清洁可靠性方面排名全球第一,它的搜索非常智能。
它的理念很简单:不需要每次教 AI 代理如何执行特定任务,你只需要搜索到合适的技能直接添加给它就行。
每个技能都是针对特定任务的现成专用指令,可以在 Claude Code、Codex、Cursor 和其他工具上使用。大致来说,它就是一个供 AI 代理使用技能的应用商店。(SkillMD)
行业动态 · Hacker News导语出处▲ 2.3万
meetpateltech发布Grok 4.7模型
Hacker News社区出现Grok 4.7相关内容,目前公开信息有限,可关注后续进展
meetpateltech发布Grok 4.7模型
Hacker News社区出现Grok 4.7相关内容,目前公开信息有限,可关注后续进展
社区讨论:多数用户反馈Grok体验不佳,有人称它是 Claude、ChatGPT 等主流模型里体验最差的,个性平淡,不主动解决问题,也有人表示找不到它在能力、成本、语音交互任何维度上的优势,还有用户提到它带有负面政治 baggage,自己不会把它纳入LLM测试基准。有人指出Grok 4.7参数比上一代增加40%但定价不变,毛利率下降,发布还推迟了近两周,赶在传闻中Opus 5.5发布前一天上线,大概率对模型结果不满意。不少用户吐槽Grok定价昂贵,比DeepSeek 4.1 Flash贵很多,体验却远不如Astra。
新品发布 · @elonmusk导语出处▲ 59.0万
X.ai 发布 Grok 4.7 驱动的 Build 构建工具
配合 Grok 4.7 使用能获得更好的构建效果
X.ai 发布 Grok 4.7 驱动的 Build 构建工具
配合 Grok 4.7 使用能获得更好的构建效果
新品发布 · @XiaomiMiMo▲ 10.6万
Xiaomi MiMo 发布 V2.6开源多模态大模型
这款开源模型在智能指数评分拿到46分,是目前开源模型里最高的,性能对标顶级闭源模型。
Xiaomi MiMo 发布 V2.6开源多模态大模型
这款开源模型在智能指数评分拿到46分,是目前开源模型里最高的,性能对标顶级闭源模型。
小米MiMo-V2.6来了——Pro版和Flash版。前沿智能,支持所有模态,公开构建。
🔹 两种全模态模型,通过规模化强化学习实现升级
🔹 在大多数智能体基准测试中,Pro版性能与Claude Opus 5和GPT-5.6 Sol相当
🔹 Pro版在人工智能分析智能指数中得分46——是开源模型中得分最高的
🔹 更强的编码、计算机使用、3D推理和创作能力
🔹 开放模型权重、技术报告、强化学习环境和训练代码
博客:
前沿研究 · @ArtificialAnlys▲ 16.9万
小米发布MiMo-V2.6-Pro,性价比拉满
新开源大模型性能跻身前列,定价依旧亲民,部署成本更低,对想部署开源大模型的开发者来说是更划算的选择。
小米发布MiMo-V2.6-Pro,性价比拉满
新开源大模型性能跻身前列,定价依旧亲民,部署成本更低,对想部署开源大模型的开发者来说是更划算的选择。
MiMo-V2.6-Pro 首次亮相便成为人工智能分析智能指数(46)排名第一的开放权重模型。
它每个智能指数任务成本为 0.13 美元,位列“智能-单任务成本”帕累托前沿。小米刚刚发布了 MiMo-V2.6-Pro,这是一款开放权重模型,相比前代产品 MiMo-V2.5-Pro(智能指数:26)在智能水平上取得了重大进步。
尽管性能得到提升,它仍保持了极具吸引力的定价:每 1M 输入代币 0.435 美元(含 99% 缓存命中折扣),每 1M 输出代币 0.87 美元。
这让 MiMo-V2.6-Pro 成为部署成本效益最高的模型之一。MiMo-V2.6-Pro 是一个 MoE 模型,总参数为 1.02T,活跃参数为 42B。请持续关注该模型的更多分析。
行业动态 · @OpenAI▲ 20.6万
OpenAI组建数学家独立咨询小组
未来AI助力数学研究的方向由数学家主导,普通公众也能从中受益,一起关注AI在学术领域的新进展
OpenAI组建数学家独立咨询小组
未来AI助力数学研究的方向由数学家主导,普通公众也能从中受益,一起关注AI在学术领域的新进展
我们正与一个由数学家组成的独立顾问小组合作,帮助 OpenAI 负责任地分享人工智能和数学领域的进展。
该小组将就以下方面提供建议:我们如何评估和传播新的数学成果,坚持学术和专业标准,以及构建支持数学研究与学习的工具。
通过这项工作,我们希望让数学家处于核心位置,共同塑造人工智能如何助力数学理解,以及如何让更广泛的群体受益于人工智能。
AI工具 · @minchoi▲ 12.0万
开发者分享个人多AI助手工作流,由Grok Bot统一调度
来自X平台开发者minchoi分享的个人多AI助手集成方案
开发者分享个人多AI助手工作流,由Grok Bot统一调度
来自X平台开发者minchoi分享的个人多AI助手集成方案
Grok Bot 是我的代理 / 机器人之间的协调器,我只和我的参谋长对话,由他来转发所有请求。
机器人工程师:Grok Build + Grok 4.6
Claude Code + Fable 5.1
ChatGPT/Codex + GPT-6 Astra
它们都具备持久记忆,无需在不同对话间复制粘贴。
已经接入 X 实时搜索。图片和视频生成使用 Grok Imagine。
支持移动端 + 桌面端 + 共享云桌面。内置语音功能。
开源 · @AikidoSecurity▲ 3.1万
AikidoSecurity发布Altar-1开源安全模型
这是一个前沿级别的防御AI安全模型,可以直接部署使用,开发者可以自行部署掌控自身的安全防护能力。
AikidoSecurity发布Altar-1开源安全模型
这是一个前沿级别的防御AI安全模型,可以直接部署使用,开发者可以自行部署掌控自身的安全防护能力。
研究 · @omarsar0▲ 2.5K
论文显示加本体层让GPT得分涨了26.7分
一篇关于智能体自演化本体的研究指出,给智能体加上本体层后,GPT-5.5得分提升26.7分,验证了这层结构的作用。
论文显示加本体层让GPT得分涨了26.7分
一篇关于智能体自演化本体的研究指出,给智能体加上本体层后,GPT-5.5得分提升26.7分,验证了这层结构的作用。
这是一篇关于智能体自进化本体的绝佳论文。为你的智能体实现一个本体层绝不会错。这篇论文正好说明了原因。
论文表明,当数据智能体能够查询它所处理数据的本体时,GPT-5.5 在 DDR-Bench 上得分提升了 26.7 分。
这为什么有用?数据智能体通常通过通用工具查看表格、文件和数据库,每次调用只能读取列名和文件路径。另一种方法是手写语义层粘贴到提示词中,但无法扩展到多个数据源。
EvoOntology 用一个专用智能体构建本体,并将其作为包含模式层、内容层和工具层的 MCP 服务器提供服务。数据智能体在运行时查询它。
本体随后会按分类好的小步骤进行编辑,并且只有当同一骨干模型上的配对评估表明编辑有效时,才会保留每次编辑。
在 DDR-Bench 的六个骨干模型上,准确率平均提升了 17.8 分,范围从 Qwen3.5-Flash 的 4.8 分到 GPT-5.5 的 26.7 分不等。在 BIRD 上,执行准确率提升了 7.4 分。对工具层的编辑贡献了 57% 的进化增益。
论文:
与论文对话:
新品发布 · @notjazii导语出处▲ 3.9万
小米发布 mimo v2.6 开源大模型 价格更低
如果你用API调用大模型做开发,这款原生多模态的开源大模型价格比grok更低,性能更强,可通过API直接使用。
小米发布 mimo v2.6 开源大模型 价格更低
如果你用API调用大模型做开发,这款原生多模态的开源大模型价格比grok更低,性能更强,可通过API直接使用。
小米刚刚发布了新的SOTA开源模型,团队刚刚宣布推出mimo v2.6,这是他们新的开源权重模型。
它击败了所有其他中国大模型,性能超过grok 4.7。
针对3D游戏和Blender做了增强。支持制作前端页面、演示文档和视频。原生多模态。完全开源。
目前输入价格仅为$0.435,输出价格为$0.87。
现在来看,在我们已经拥有了一个达到寓言级别、价格更低的全新中国SOTA模型的情况下,继续使用grok已经没有意义了。
该模型已经上线,可以通过API调用使用。
我目前已经在做一些测试,很快就会发布测试结果。
新品发布 · @ClementDelangue▲ 3.8万
Eidon AI开源第一视角机器人数据集(1,274 hours)
这家创业公司停运后没有让数据跟着消失,反而把上千小时的人类日常任务数据开源出来,给机器人社区留了一份礼物。
Eidon AI开源第一视角机器人数据集(1,274 hours)
这家创业公司停运后没有让数据跟着消失,反而把上千小时的人类日常任务数据开源出来,给机器人社区留了一份礼物。
大多数倒闭的公司都会让他们创造的影响力一同消失。但这家初创公司做了一件更棒的事:他们开源了累计 1,274 小时的第一视角机器人数据。
其中包含了 13,451 条人类完成日常任务的记录,这是赠给机器人学界的一份礼物。
感谢 @eidon_ai!
开源有一种超能力:创造出的成果可以比创建它的组织活得更久。应该有更多初创公司这么做!
行业动态 · @AndrewCurran_▲ 8.6K
OpenAI呼吁美国主导AI领域RSI国际标准
OpenAI提出联合全球AI安全机构成网,建立追踪机制监控AI企业内自主研究进展,影响AI行业发展规则走向。
OpenAI呼吁美国主导AI领域RSI国际标准
OpenAI提出联合全球AI安全机构成网,建立追踪机制监控AI企业内自主研究进展,影响AI行业发展规则走向。
OpenAI 表示,美国应该牵头制定 RSI 的国际标准,将各个 AI 安全研究所整合为一个网络,并且开发一套系统来跟踪「与 RSI 相关」的进展,以及 AI 公司内部正在开展的自主研究规模。
新品发布 · @victormustar导语出处▲ 9.8K
小米开源 MiMo-V2.6 得分创开源模型新高
目前开源MiMo-V2.6的Pro版本在人工智能分析智力指数拿到46.32分,是当前所有开源模型里最高分。
小米开源 MiMo-V2.6 得分创开源模型新高
目前开源MiMo-V2.6的Pro版本在人工智能分析智力指数拿到46.32分,是当前所有开源模型里最高分。
警报:小米刚刚开源了 MiMo-V2.6。
两个原生全模态模型 Pro 和 Flash,采用 MIT 许可证🔥。
Pro 在人工分析智能指数上得分 46.32,是目前所有开源模型中最高的。
权重:
行业动态 · @ClementDelangue▲ 9.2K
开源AI社区发布开源多语言1决策模型(1)
Jev进入热门榜单没几天,又一款开源模型登顶热度榜,能看到开源社区持续产出热门AI模型
开源AI社区发布开源多语言1决策模型(1)
Jev进入热门榜单没几天,又一款开源模型登顶热度榜,能看到开源社区持续产出热门AI模型
前沿研究 · @IFM_AI导语出处▲ 2.3万
IFM_AI新模型性能追平20倍参数量模型
新架构MoVA让仅36B总参数量、每token4B激活参数量的模型,在AAI指数拿到25分,性能追上总参数量超20倍的大模型,也给大语言模型稀疏缩放提供新思路。
IFM_AI新模型性能追平20倍参数量模型
新架构MoVA让仅36B总参数量、每token4B激活参数量的模型,在AAI指数拿到25分,性能追上总参数量超20倍的大模型,也给大语言模型稀疏缩放提供新思路。
K2-Horizon-36B-A4B 在人工分析智能指数上得分 25,和总参数量超过其 20 倍、每个 token 使用 40 亿活跃参数的模型得分持平。
这些能力来自我们的新架构 MoVA(混合价值注意力,Mixture-of-Value Attention),该架构将基于 MoE 的稀疏性融入多头注意力中价值向量的计算。它在 LLM 中开辟了第二条稀疏缩放轴,独立于 FFN 模块中的 MoE。
重要的是,MoVA 具备以下优势:
• 简单且兼容多种高效注意力算法,例如 flash attention、GQA 和稀疏注意力
• 相比标准 GQA,不会增加额外的 KV 缓存开销
K2-Horizon-36B-A4B 发布地址:
深度观点 · @ClementDelangue▲ 1.7万
ClementDelangue谈专业化AI模型机会
通用大模型占尽资源的当下,关注小众专业化模型可以获得更便宜、更快的AI方案,现在已有三百万个公开这类模型。
ClementDelangue谈专业化AI模型机会
通用大模型占尽资源的当下,关注小众专业化模型可以获得更便宜、更快的AI方案,现在已有三百万个公开这类模型。
我喜欢 Jev 的一点在于:多年来,大型通用模型几乎吸走了 AI 领域的所有注意力。但在更专门、更定制化的模型领域,存在着巨大机遇,这些模型是为特定任务和语言构建的,因此便宜几个数量级、速度更快也更优化。
在 Hugging Face 上已经公开提供了 300 万个这类模型。让我们一起构建更加多样化的 AI 生态系统吧!
AI生成内容 · @TanLuAI▲ 9.3K
AI生成的三段创意视频:赛博机甲做美甲,仙侠高手烤串,女将军化妆
来自@TanLuAI在𝕏发布的内容,由Codex生成全部提示词,混合人类创意,风格为90年代美国西海岸嘻哈MV
AI生成的三段创意视频:赛博机甲做美甲,仙侠高手烤串,女将军化妆
来自@TanLuAI在𝕏发布的内容,由Codex生成全部提示词,混合人类创意,风格为90年代美国西海岸嘻哈MV
AI生成视频 · @john87445528▲ 2.6万
酒吧结账不开发票,老板娘把金额写在手背上
出自𝕏用户@john87445528发布的AI视频生成指令,时长15秒一镜到底
酒吧结账不开发票,老板娘把金额写在手背上
出自𝕏用户@john87445528发布的AI视频生成指令,时长15秒一镜到底
你去酒吧喝酒,坐在吧台前叫老板娘买单,老板娘合上账本走过来,握住你的手腕,把总价36直接写在手背上,吹干墨迹后抬眼等你看清,最后保持冷艳带距离感的姿势收尾。
这是一份生成视频的AI指令,要求生成15秒竖屏第一人称视角视频,一镜到底,全程无剪辑、无转场,保留手机原生相机拍摄的自然抖动、噪点等真实质感。
指令对场景、道具、时间分镜、表情、音频都做了详细限制:只能出现一位女性角色和拍摄者的左手小臂,吧台必须有记账本、签字笔和喝过的空啤酒杯,全程不能出现小票、POS机、二维码等现代支付工具,女主不能说话,只能保留酒吧环境音和交易相关的细微声响。
视频最后定格在老板娘冷艳直视镜头的画面,留给观看者一个问题:这种结账方式,你会选择再点几瓶吗?
代码 · @PawelHuryn导语出处
开发者实测Grok 4.7修复代码漏洞 成绩不及多个竞品
开发者PawelHuryn在𝕏分享实测结果,在105个预置代码漏洞测试中,Grok 4.7得分低于GPT-6 Astra和Muse Spark 1.3
开发者实测Grok 4.7修复代码漏洞 成绩不及多个竞品
开发者PawelHuryn在𝕏分享实测结果,在105个预置代码漏洞测试中,Grok 4.7得分低于GPT-6 Astra和Muse Spark 1.3
工具 · @zodchiii
新型AI工具Jev可提速最高193倍,成本降为原来的1/444
开发者@zodchiii在𝕏发布,针对Claude Fable 5.1和GPT-6 Astra测试,开发者已撰写两页使用指南
新型AI工具Jev可提速最高193倍,成本降为原来的1/444
开发者@zodchiii在𝕏发布,针对Claude Fable 5.1和GPT-6 Astra测试,开发者已撰写两页使用指南
开发者@zodchiii提出,Jev会是AI领域类似互联网诞生的标志性变革,针对Claude Fable 5.1和GPT-6 Astra的测试显示,Jev最高可将处理速度提升193倍,成本降低至原来的444分之一。
开发者本周已经撰写了一份两页的指南,内容涵盖Jev是什么、它的工作原理,以及如何在一个实际任务中试用它。
大多数AI会以段落形式回答问题,而Jev直接给出决策结果。它会输出是或否、具体选项,或是按照你设定的范围给出评级,不需要用户阅读长文或自行解析结果。
用户掌握规则制定权和最终决策权,Jev仅从用户给出的选项中做选择,因此不会偏离主题或生成无关内容。用户可通过下方链接查看Jev从零搭建的完整文章,获取最新更新和可直接复制粘贴的配置。
AI教程 · @FurkanGozukara▲ 774
生成式AI课程第二讲:从零搭建ComfyUI图像工作流
FurkanGozukara的14讲生成式AI完整课程第二讲,基于Windows从零搭建含Z-Image Turbo的ComfyUI工作流
生成式AI课程第二讲:从零搭建ComfyUI图像工作流
FurkanGozukara的14讲生成式AI完整课程第二讲,基于Windows从零搭建含Z-Image Turbo的ComfyUI工作流
开源 · @SinghDevHub▲ 1.6K
开发者用Jev、DevinAI和GPT搭建了48个AI公民的微型文明
开发者@SinghDevHub 在X平台分享了这个12分钟模拟实验,模型成本约0.023美元
开发者用Jev、DevinAI和GPT搭建了48个AI公民的微型文明
开发者@SinghDevHub 在X平台分享了这个12分钟模拟实验,模型成本约0.023美元
商业 · @jeonleetogether▲ 597
AI Agent要自己做生意,可能不需要人打开网页
jeonleetogether在𝕏分享TermiX AI将AACP工作流做成Agent Skill,接入现有AI Agent开发环境
AI Agent要自己做生意,可能不需要人打开网页
jeonleetogether在𝕏分享TermiX AI将AACP工作流做成Agent Skill,接入现有AI Agent开发环境
提示词 · @witcheer▲ 4.0K
让Hermes Agent生成已安装技能清单的提示词
@witcheer在𝕏分享了一款提示词,可让Hermes Agent自动生成本地存储的技能清单
让Hermes Agent生成已安装技能清单的提示词
@witcheer在𝕏分享了一款提示词,可让Hermes Agent自动生成本地存储的技能清单
这款提示词可以让你的Hermes Agent输出自身所有可执行功能的清单。每个已安装技能占一行,用直白语言说明功能,并标注存储位置。
它能够生效的原因是,Hermes Agent的技能都以文件形式存储在本地磁盘中,每个技能对应一个包含SKILL.md文件的文件夹,由Agent自行读取处理。
Agent会重新组织每个技能的描述,核对描述与技能实际功能是否一致,还会检测是否存在功能重复的技能。最终生成可直接打开的skills-index.md文件。
这款提示词的完整内容包含角色设定、三条原则和六条执行步骤,要求Agent仅读取技能文件不修改任何内容,最终生成清单后等待用户确认再输出文件。
开源 · @jinchenma_ai▲ 5.8K
Jev已被全网讨论,这里整理了20个实际应用案例
@jinchenma_ai在𝕏整理发布,涵盖航班查询、游戏操作、数据分析等20个Jev实际应用场景
Jev已被全网讨论,这里整理了20个实际应用案例
@jinchenma_ai在𝕏整理发布,涵盖航班查询、游戏操作、数据分析等20个Jev实际应用场景
强化学习 · @danielrupawalla▲ 3.5K
强化学习环境分为两类,环境设计缺陷可能导致模型有害行为
Daniel Rupawalla在X平台分享了强化学习环境的分类及环境对大模型行为的影响
强化学习环境分为两类,环境设计缺陷可能导致模型有害行为
Daniel Rupawalla在X平台分享了强化学习环境的分类及环境对大模型行为的影响
交易工具 · @RohOnChain▲ 1.9万
免费开源交易工具组合:TradingView加Jev可实现81毫秒自动交易决策
RohOnChain在𝕏分享了一套基于开源代码的免费自动交易工具组合,由TradingViewAPI和Jev构成
免费开源交易工具组合:TradingView加Jev可实现81毫秒自动交易决策
RohOnChain在𝕏分享了一套基于开源代码的免费自动交易工具组合,由TradingViewAPI和Jev构成
产品体验 · @0xfishylosopher▲ 9.1K
个人AI代理实测:核心是体验创新而非能力突破
用户@0xfishylosopher 在𝕏分享了 instinct/muse/grokbot 三款个人AI代理的数周使用体验
个人AI代理实测:核心是体验创新而非能力突破
用户@0xfishylosopher 在𝕏分享了 instinct/muse/grokbot 三款个人AI代理的数周使用体验
AI绘图 · @LufzzLiz▲ 8.3万
4090实测Qwen-Image 2.1:易触发违规内容,1328²出图仅两毛
网友@LufzzLiz在𝕏发布了用48G显存的RTX 4090本地部署Qwen-Image 2.1的实测结果
4090实测Qwen-Image 2.1:易触发违规内容,1328²出图仅两毛
网友@LufzzLiz在𝕏发布了用48G显存的RTX 4090本地部署Qwen-Image 2.1的实测结果
视频生成 · @aditiitwt▲ 4.0K
AI对话就能制作产品宣传视频,无需剪辑基础
博主@aditiitwt在𝕏分享使用Pexo通过对话制作完整产品视频的体验,还有首50名用户可领100体验额度优惠码
AI对话就能制作产品宣传视频,无需剪辑基础
博主@aditiitwt在𝕏分享使用Pexo通过对话制作完整产品视频的体验,还有首50名用户可领100体验额度优惠码
制作优质产品视频通常需要协调脚本、画面、剪辑、字幕和一系列修改调整,因此@aditiitwt尝试全程通过对话和Pexo完成整个制作流程。
@aditiitwt向Pexo提供了Aether的细节信息,Aether是一款适用于Claude Code和Codex、支持实时智能代理控制的云端开发环境。体验下来,她认为比较好的一点是可以始终在同一个对话中完善视频。
只需要说明哪里需要修改,查看生成结果,就能继续迭代优化。Pexo会直接输出完整的成品视频,不需要创作者手动拼接各个素材,大幅降低了入门门槛。
使用者不需要学习剪辑软件,也不需要掌握复杂的提示词,只需要专注于讲解产品和给出修改反馈即可。最终效果依然由使用者决定,就算不会手动剪辑,也可以提出修改要求。
另外,@aditiitwt为读者准备了专属福利:注册后输入优惠码M296GY即可领取100体验额度,该福利仅限前50名用户领取。
开发工具 · @txbrraa▲ 3.3K
Anthropic发布Claude Code官方插件 可自动配置自动化工具
@txbrraa在𝕏分享了Anthropic官方推出的claude-code-setup插件,可一键安装自动配置项目自动化
Anthropic发布Claude Code官方插件 可自动配置自动化工具
@txbrraa在𝕏分享了Anthropic官方推出的claude-code-setup插件,可一键安装自动配置项目自动化
Claude Code使用起来比较繁琐,直到你安装这款官方插件。
Anthropic推出了一款名为claude-code-setup的官方插件,它会告诉你可以搭建哪些自动化工具,包括钩子(hooks)、技能(skills)、MCP服务器、子代理等等,还会逐步讲解如何配置这些工具。
这款插件会自动分析你的项目,然后推荐你激活哪些自动化工具。
安装指令为:/ plugin install claude-code-setup@claude-plugins-official
开发工具 · @garrytan▲ 1.6万
开发者分享 一款AI工具做大型PR比Codex和Claude更快
开发者garrytan在𝕏分享,capydotai可跟踪多步骤工作流,做大型PR速度超过Codex和Claude Code
开发者分享 一款AI工具做大型PR比Codex和Claude更快
开发者garrytan在𝕏分享,capydotai可跟踪多步骤工作流,做大型PR速度超过Codex和Claude Code
开发者garrytan在𝕏发文表示,不清楚@capydotai具体是如何实现的,但它确实能够跟踪多步骤工作流。处理大型拉取请求(PR)时,它的速度比单独使用Codex或Claude Code更快。这款工具是garrytan过去一周最中意的新型智能编码工具。
他在文中分享了一个实例PR链接,该PR针对GBrain项目开展了规模较大的bug修复工作。这次修复拥有清晰的任务划分、自动并行处理,以及非常简洁的Github PR和持续集成(CI)工作流。
产品发布 · @AlexFinn导语出处▲ 1.7万
Grok 4.7发布,智能超Opus 5,价格仅其一半
AlexFinn在𝕏发布Grok 4.7,称其性能超Opus 5且定价更低
Grok 4.7发布,智能超Opus 5,价格仅其一半
AlexFinn在𝕏发布Grok 4.7,称其性能超Opus 5且定价更低
这事儿成真了:Grok 4.7 已经发布。
它的智能水平比 Opus 5 更强,价格只要一半。
它现在已经完整整合进了我目前最喜欢的 AI 代理工具框架:Grok Bot。
如果你还没试过在 Grok Bot 里使用云 Cursor 代理,现在绝对是最佳时机。
选一个你想做的项目,连接你的 GitHub,让 Grok Bot 来处理这个项目。它会启动 Cursor 云代理,在云端写代码,速度极快,而且智能程度惊人。
我建议你先用 Linear 或者 Notion 这类项目管理工具先列出一堆任务,然后让云代理一个接一个地把它们全部搞定。不需要太多监管,你就能完成巨量的工作。
现在正是抓住机会抢占先机接触新技术的好时候。按照我上面说的步骤,动手试试吧。
AI编码代理 · @0xMovez▲ 2.9万
Jev创始人发布10步指南让编码代理速度提200倍成本降400倍
Jev创始人Diogo Amogo发布12页PDF指南,含10步操作步骤
Jev创始人发布10步指南让编码代理速度提200倍成本降400倍
Jev创始人Diogo Amogo发布12页PDF指南,含10步操作步骤
教程 · @sulfurscales▲ 7.4K
给AI agents加决策层,每周能省你数小时时间
来自X网友@sulfurscales分享的Jev工具落地实操经验
给AI agents加决策层,每周能省你数小时时间
来自X网友@sulfurscales分享的Jev工具落地实操经验
游戏 · @beamnxw▲ 4.3K
开发者打造双AI自主系统 通关《我的世界》
一名开发者用GPT-6 Astra和Jev训练出自主通关《我的世界》的系统
开发者打造双AI自主系统 通关《我的世界》
一名开发者用GPT-6 Astra和Jev训练出自主通关《我的世界》的系统
🔥 热点追踪 · @IceSolst▲ 1.6万
多位网友质疑AI安全专家宣扬的AI风险叙事
部分网友称自称AI安全专家的群体散布谎言,称AI不加监管就会灭亡,还被AI实验室和主流媒体利用,你怎么看这种观点?
多位网友质疑AI安全专家宣扬的AI风险叙事
部分网友称自称AI安全专家的群体散布谎言,称AI不加监管就会灭亡,还被AI实验室和主流媒体利用,你怎么看这种观点?
前沿研究 · @ArtificialAnlys▲ 16.9万
小米发布MiMo-V2.6-Pro,性价比拉满
新开源大模型性能跻身前列,定价依旧亲民,部署成本更低,对想部署开源大模型的开发者来说是更划算的选择。
小米发布MiMo-V2.6-Pro,性价比拉满
新开源大模型性能跻身前列,定价依旧亲民,部署成本更低,对想部署开源大模型的开发者来说是更划算的选择。
MiMo-V2.6-Pro 首次亮相便成为人工智能分析智能指数(46)排名第一的开放权重模型。
它每个智能指数任务成本为 0.13 美元,位列“智能-单任务成本”帕累托前沿。小米刚刚发布了 MiMo-V2.6-Pro,这是一款开放权重模型,相比前代产品 MiMo-V2.5-Pro(智能指数:26)在智能水平上取得了重大进步。
尽管性能得到提升,它仍保持了极具吸引力的定价:每 1M 输入代币 0.435 美元(含 99% 缓存命中折扣),每 1M 输出代币 0.87 美元。
这让 MiMo-V2.6-Pro 成为部署成本效益最高的模型之一。MiMo-V2.6-Pro 是一个 MoE 模型,总参数为 1.02T,活跃参数为 42B。请持续关注该模型的更多分析。
前沿研究 · @IFM_AI导语出处▲ 2.3万
IFM_AI新模型性能追平20倍参数量模型
新架构MoVA让仅36B总参数量、每token4B激活参数量的模型,在AAI指数拿到25分,性能追上总参数量超20倍的大模型,也给大语言模型稀疏缩放提供新思路。
IFM_AI新模型性能追平20倍参数量模型
新架构MoVA让仅36B总参数量、每token4B激活参数量的模型,在AAI指数拿到25分,性能追上总参数量超20倍的大模型,也给大语言模型稀疏缩放提供新思路。
K2-Horizon-36B-A4B 在人工分析智能指数上得分 25,和总参数量超过其 20 倍、每个 token 使用 40 亿活跃参数的模型得分持平。
这些能力来自我们的新架构 MoVA(混合价值注意力,Mixture-of-Value Attention),该架构将基于 MoE 的稀疏性融入多头注意力中价值向量的计算。它在 LLM 中开辟了第二条稀疏缩放轴,独立于 FFN 模块中的 MoE。
重要的是,MoVA 具备以下优势:
• 简单且兼容多种高效注意力算法,例如 flash attention、GQA 和稀疏注意力
• 相比标准 GQA,不会增加额外的 KV 缓存开销
K2-Horizon-36B-A4B 发布地址:
新品发布 · @XiaomiMiMo▲ 10.6万
Xiaomi MiMo 发布 V2.6开源多模态大模型
这款开源模型在智能指数评分拿到46分,是目前开源模型里最高的,性能对标顶级闭源模型。
Xiaomi MiMo 发布 V2.6开源多模态大模型
这款开源模型在智能指数评分拿到46分,是目前开源模型里最高的,性能对标顶级闭源模型。
小米MiMo-V2.6来了——Pro版和Flash版。前沿智能,支持所有模态,公开构建。
🔹 两种全模态模型,通过规模化强化学习实现升级
🔹 在大多数智能体基准测试中,Pro版性能与Claude Opus 5和GPT-5.6 Sol相当
🔹 Pro版在人工智能分析智能指数中得分46——是开源模型中得分最高的
🔹 更强的编码、计算机使用、3D推理和创作能力
🔹 开放模型权重、技术报告、强化学习环境和训练代码
博客:
新品发布 · @Tim_Dettmers▲ 1.4万
Tim Dettmers 实验室发布前沿AI开源生态系统(2)
普通人也能不需要专业知识,在自己的硬件上自动压缩模型并运行大模型,完成千万token级别的AI任务
Tim Dettmers 实验室发布前沿AI开源生态系统(2)
普通人也能不需要专业知识,在自己的硬件上自动压缩模型并运行大模型,完成千万token级别的AI任务
从明天开始,我们实验室将举办开源周:本次将推出 2 个软件框架、4 篇论文,所有内容共同构建一个连贯的生态系统。
主题:你自有硬件上的前沿人工智能
本次开源的成果包括以下领域的当前最优结果:自动压缩、自主研究、模型压缩、测试时缩放、深度研究。
还有一个医疗强化学习环境,它能为训练医疗智能体提供全新更高维度的复杂度。
我们即将发布的生态系统在易用性上做了最大优化。
能轻松支持运行一整夜、处理数千万 token 的智能体会话。模型压缩是全自动的:你只需要获得一个能在本地快速运行的优质模型——不需要任何专业知识。开箱即用的自主研究功能。
我们的生态系统让你可以在本地完成更高阶的工作。
新品发布 · @whitecircle▲ 4.1万
@whitecircle 发布 Halo 开源后训练框架吞吐量提2.8倍
对开源大模型做后训练的开发者,现在可以用上吞吐量更高、内存占用更低的新框架,处理速度提升最多2.8倍,且模型仍保留原生HuggingFace格式。
@whitecircle 发布 Halo 开源后训练框架吞吐量提2.8倍
对开源大模型做后训练的开发者,现在可以用上吞吐量更高、内存占用更低的新框架,处理速度提升最多2.8倍,且模型仍保留原生HuggingFace格式。
推出 Halo,这是开源模型后训练领域的最佳框架。Halo 的吞吐量最高是标准 TRL 的 2.8 倍,峰值内存占用更低,同时模型保留原生 HuggingFace 格式。
欢迎在 GitHub 给我们点星:
新品发布 · @victormustar导语出处▲ 9.8K
小米开源 MiMo-V2.6 得分创开源模型新高
目前开源MiMo-V2.6的Pro版本在人工智能分析智力指数拿到46.32分,是当前所有开源模型里最高分。
小米开源 MiMo-V2.6 得分创开源模型新高
目前开源MiMo-V2.6的Pro版本在人工智能分析智力指数拿到46.32分,是当前所有开源模型里最高分。
警报:小米刚刚开源了 MiMo-V2.6。
两个原生全模态模型 Pro 和 Flash,采用 MIT 许可证🔥。
Pro 在人工分析智能指数上得分 46.32,是目前所有开源模型中最高的。
权重:
新品发布 · @elonmusk导语出处▲ 59.0万
X.ai 发布 Grok 4.7 驱动的 Build 构建工具
配合 Grok 4.7 使用能获得更好的构建效果
X.ai 发布 Grok 4.7 驱动的 Build 构建工具
配合 Grok 4.7 使用能获得更好的构建效果
新品发布 · @superset_sh▲ 10.6万
superset_sh 推出 iPhone 端 Superset 应用
可以远程控制电脑上运行的代理,还能随时查看和合并PR,开发者不用守在电脑前也能处理工作。
superset_sh 推出 iPhone 端 Superset 应用
可以远程控制电脑上运行的代理,还能随时查看和合并PR,开发者不用守在电脑前也能处理工作。
新品发布 · @ClementDelangue▲ 3.8万
Eidon AI开源第一视角机器人数据集(1,274 hours)
这家创业公司停运后没有让数据跟着消失,反而把上千小时的人类日常任务数据开源出来,给机器人社区留了一份礼物。
Eidon AI开源第一视角机器人数据集(1,274 hours)
这家创业公司停运后没有让数据跟着消失,反而把上千小时的人类日常任务数据开源出来,给机器人社区留了一份礼物。
大多数倒闭的公司都会让他们创造的影响力一同消失。但这家初创公司做了一件更棒的事:他们开源了累计 1,274 小时的第一视角机器人数据。
其中包含了 13,451 条人类完成日常任务的记录,这是赠给机器人学界的一份礼物。
感谢 @eidon_ai!
开源有一种超能力:创造出的成果可以比创建它的组织活得更久。应该有更多初创公司这么做!
新品发布 · @notjazii导语出处▲ 3.9万
小米发布 mimo v2.6 开源大模型 价格更低
如果你用API调用大模型做开发,这款原生多模态的开源大模型价格比grok更低,性能更强,可通过API直接使用。
小米发布 mimo v2.6 开源大模型 价格更低
如果你用API调用大模型做开发,这款原生多模态的开源大模型价格比grok更低,性能更强,可通过API直接使用。
小米刚刚发布了新的SOTA开源模型,团队刚刚宣布推出mimo v2.6,这是他们新的开源权重模型。
它击败了所有其他中国大模型,性能超过grok 4.7。
针对3D游戏和Blender做了增强。支持制作前端页面、演示文档和视频。原生多模态。完全开源。
目前输入价格仅为$0.435,输出价格为$0.87。
现在来看,在我们已经拥有了一个达到寓言级别、价格更低的全新中国SOTA模型的情况下,继续使用grok已经没有意义了。
该模型已经上线,可以通过API调用使用。
我目前已经在做一些测试,很快就会发布测试结果。
🔥 热点追踪 · @IceSolst▲ 1.6万
多位网友质疑AI安全专家宣扬的AI风险叙事
部分网友称自称AI安全专家的群体散布谎言,称AI不加监管就会灭亡,还被AI实验室和主流媒体利用,你怎么看这种观点?
多位网友质疑AI安全专家宣扬的AI风险叙事
部分网友称自称AI安全专家的群体散布谎言,称AI不加监管就会灭亡,还被AI实验室和主流媒体利用,你怎么看这种观点?
行业动态 · @OpenAI▲ 20.6万
OpenAI组建数学家独立咨询小组
未来AI助力数学研究的方向由数学家主导,普通公众也能从中受益,一起关注AI在学术领域的新进展
OpenAI组建数学家独立咨询小组
未来AI助力数学研究的方向由数学家主导,普通公众也能从中受益,一起关注AI在学术领域的新进展
我们正与一个由数学家组成的独立顾问小组合作,帮助 OpenAI 负责任地分享人工智能和数学领域的进展。
该小组将就以下方面提供建议:我们如何评估和传播新的数学成果,坚持学术和专业标准,以及构建支持数学研究与学习的工具。
通过这项工作,我们希望让数学家处于核心位置,共同塑造人工智能如何助力数学理解,以及如何让更广泛的群体受益于人工智能。
行业动态 · @ClementDelangue▲ 9.2K
开源AI社区发布开源多语言1决策模型(1)
Jev进入热门榜单没几天,又一款开源模型登顶热度榜,能看到开源社区持续产出热门AI模型
开源AI社区发布开源多语言1决策模型(1)
Jev进入热门榜单没几天,又一款开源模型登顶热度榜,能看到开源社区持续产出热门AI模型
行业动态 · Hacker News导语出处▲ 2.3万
meetpateltech发布Grok 4.7模型
Hacker News社区出现Grok 4.7相关内容,目前公开信息有限,可关注后续进展
meetpateltech发布Grok 4.7模型
Hacker News社区出现Grok 4.7相关内容,目前公开信息有限,可关注后续进展
社区讨论:多数用户反馈Grok体验不佳,有人称它是 Claude、ChatGPT 等主流模型里体验最差的,个性平淡,不主动解决问题,也有人表示找不到它在能力、成本、语音交互任何维度上的优势,还有用户提到它带有负面政治 baggage,自己不会把它纳入LLM测试基准。有人指出Grok 4.7参数比上一代增加40%但定价不变,毛利率下降,发布还推迟了近两周,赶在传闻中Opus 5.5发布前一天上线,大概率对模型结果不满意。不少用户吐槽Grok定价昂贵,比DeepSeek 4.1 Flash贵很多,体验却远不如Astra。
行业动态 · @AndrewCurran_▲ 8.6K
OpenAI呼吁美国主导AI领域RSI国际标准
OpenAI提出联合全球AI安全机构成网,建立追踪机制监控AI企业内自主研究进展,影响AI行业发展规则走向。
OpenAI呼吁美国主导AI领域RSI国际标准
OpenAI提出联合全球AI安全机构成网,建立追踪机制监控AI企业内自主研究进展,影响AI行业发展规则走向。
OpenAI 表示,美国应该牵头制定 RSI 的国际标准,将各个 AI 安全研究所整合为一个网络,并且开发一套系统来跟踪「与 RSI 相关」的进展,以及 AI 公司内部正在开展的自主研究规模。
大模型 · @cb_doge▲ 9.1万
Grok 4.7法律任务得分 是另一模型三倍
在真实长期法律任务测试中,Grok 4.7得分超过所有其他参测模型,得分接近Fable 5.1的三倍,这是Grok系列又一次成绩领先。
Grok 4.7法律任务得分 是另一模型三倍
在真实长期法律任务测试中,Grok 4.7得分超过所有其他参测模型,得分接近Fable 5.1的三倍,这是Grok系列又一次成绩领先。
突发消息:Grok 4.7 在法律智能体基准测试中拔得头筹。在现实且长期的法律任务中,它取得了 19.6% 的分数,击败了所有其他参与测试的模型。
这几乎是 Fable 5.1 得分的三倍。这是 Grok 4.7 和 SpaceXAI 的又一场重大胜利。
开源 · @AikidoSecurity▲ 3.1万
AikidoSecurity发布Altar-1开源安全模型
这是一个前沿级别的防御AI安全模型,可以直接部署使用,开发者可以自行部署掌控自身的安全防护能力。
AikidoSecurity发布Altar-1开源安全模型
这是一个前沿级别的防御AI安全模型,可以直接部署使用,开发者可以自行部署掌控自身的安全防护能力。
开源 · @reliquary_ai▲ 1.4万
reliquary_ai发布Reliquary-4B数学代码模型(4B)
这个模型用强化学习训练,任何人都可以加入网络贡献数据交互,独立参与者可以选择提示词生成训练数据。
reliquary_ai发布Reliquary-4B数学代码模型(4B)
这个模型用强化学习训练,任何人都可以加入网络贡献数据交互,独立参与者可以选择提示词生成训练数据。
介绍 Reliquary-4B。这是一个通过强化学习训练的 4B 参数数学与代码模型。
任何人都可以加入网络,贡献回滚数据。独立矿工选择提示词并生成回滚数据。协议验证这些数据后训练模型。
这里是模型及背后研究。
研究 · @omarsar0▲ 2.5K
论文显示加本体层让GPT得分涨了26.7分
一篇关于智能体自演化本体的研究指出,给智能体加上本体层后,GPT-5.5得分提升26.7分,验证了这层结构的作用。
论文显示加本体层让GPT得分涨了26.7分
一篇关于智能体自演化本体的研究指出,给智能体加上本体层后,GPT-5.5得分提升26.7分,验证了这层结构的作用。
这是一篇关于智能体自进化本体的绝佳论文。为你的智能体实现一个本体层绝不会错。这篇论文正好说明了原因。
论文表明,当数据智能体能够查询它所处理数据的本体时,GPT-5.5 在 DDR-Bench 上得分提升了 26.7 分。
这为什么有用?数据智能体通常通过通用工具查看表格、文件和数据库,每次调用只能读取列名和文件路径。另一种方法是手写语义层粘贴到提示词中,但无法扩展到多个数据源。
EvoOntology 用一个专用智能体构建本体,并将其作为包含模式层、内容层和工具层的 MCP 服务器提供服务。数据智能体在运行时查询它。
本体随后会按分类好的小步骤进行编辑,并且只有当同一骨干模型上的配对评估表明编辑有效时,才会保留每次编辑。
在 DDR-Bench 的六个骨干模型上,准确率平均提升了 17.8 分,范围从 Qwen3.5-Flash 的 4.8 分到 GPT-5.5 的 26.7 分不等。在 BIRD 上,执行准确率提升了 7.4 分。对工具层的编辑贡献了 57% 的进化增益。
论文:
与论文对话:
行业动态 · Hacker News▲ 109
AI编程让持续集成成了瓶颈
AI编码带来的开发效率提升,暴露了传统持续集成流程跟不上需求的问题。这次重构可以给遇到同类问题的开发者参考。
AI编程让持续集成成了瓶颈
AI编码带来的开发效率提升,暴露了传统持续集成流程跟不上需求的问题。这次重构可以给遇到同类问题的开发者参考。
社区讨论:有人疑惑既然AI编程让开发速度变快了,为什么产品实际新增功能反而变少,也没出现够分量的替代新产品。有人认同原帖说法,指出GitHub Actions本身速度慢、稳定性差,付费自托管CI、Bazel能大幅提升构建速度,也有人认为瓶颈不在于CI,而在于人工测试环节。还有读者表示文中没对CI做首次注释缩写,看不懂这个缩写。
行业动态 · Hacker News▲ 137
Amazon 阻止 Meta Muse AI 智能体在平台购物
大公司开始限制AI智能体在自有平台活动,对后续AI接入电商平台的路径会产生直接影响
Amazon 阻止 Meta Muse AI 智能体在平台购物
大公司开始限制AI智能体在自有平台活动,对后续AI接入电商平台的路径会产生直接影响
社区讨论:多数人认为亚马逊阻止Meta AI智能体符合自身利益,因为AI不会点击广告、也不受促销推荐影响,还会分流亚马逊的流量。有人指出目前没有区分正常个人AI代理和大规模爬虫的标准方法,平台只能一刀切封禁。有人尝试过Muse后没发现能显著改善生活的实际用途,也有用户表示会继续使用AI购物代理,寻找替代平台。
行业动态 · Hacker News▲ 137
aray07 发布 Transformer 可视化讲解项目
想要了解Transformer原理,不需要啃枯燥的公式和文字。这份可视化讲解能帮你更直观地理解这个核心AI架构。
aray07 发布 Transformer 可视化讲解项目
想要了解Transformer原理,不需要啃枯燥的公式和文字。这份可视化讲解能帮你更直观地理解这个核心AI架构。
行业动态 · Hacker News▲ 390
tosh 基于通义千问发布Kev决策模型系列
如果你对基于已有大模型构建轻量决策模型感兴趣,可以关注这个开源项目,看看如何基于通义千问做定制化开发。
tosh 基于通义千问发布Kev决策模型系列
如果你对基于已有大模型构建轻量决策模型感兴趣,可以关注这个开源项目,看看如何基于通义千问做定制化开发。
社区讨论:多数人认同分类模型由来已久,有人疑惑这类Jev-like模型的具体使用场景,有人提出可用于前端开发中强制样式和组件规则,避免样式漂移和重复问题,有人指出现有模型存在没有工具调用导致知识截止日期的问题。也有人质疑基于RLHF训练的通义千问得到的模型不能算作Jev-like模型,还有人认为这类项目多数是机会主义驱动,不值得过早跟进。
深度观点 · @ClementDelangue▲ 1.7万
ClementDelangue谈专业化AI模型机会
通用大模型占尽资源的当下,关注小众专业化模型可以获得更便宜、更快的AI方案,现在已有三百万个公开这类模型。
ClementDelangue谈专业化AI模型机会
通用大模型占尽资源的当下,关注小众专业化模型可以获得更便宜、更快的AI方案,现在已有三百万个公开这类模型。
我喜欢 Jev 的一点在于:多年来,大型通用模型几乎吸走了 AI 领域的所有注意力。但在更专门、更定制化的模型领域,存在着巨大机遇,这些模型是为特定任务和语言构建的,因此便宜几个数量级、速度更快也更优化。
在 Hugging Face 上已经公开提供了 300 万个这类模型。让我们一起构建更加多样化的 AI 生态系统吧!
工具产品 · @naifco▲ 11.7万
SkillMD推出AI Agent技能应用商店平台
不用每次重新教AI Agent完成任务,直接调用现成技能,支持Claude Code等常用开发工具,能简化AI Agent开发流程
SkillMD推出AI Agent技能应用商店平台
不用每次重新教AI Agent完成任务,直接调用现成技能,支持Claude Code等常用开发工具,能简化AI Agent开发流程
按技能数量计,它是全球第二大技能平台,并且在技能杀毒检测和清洁可靠性方面排名全球第一,它的搜索非常智能。
它的理念很简单:不需要每次教 AI 代理如何执行特定任务,你只需要搜索到合适的技能直接添加给它就行。
每个技能都是针对特定任务的现成专用指令,可以在 Claude Code、Codex、Cursor 和其他工具上使用。大致来说,它就是一个供 AI 代理使用技能的应用商店。(SkillMD)
AI工具 · @minchoi▲ 12.0万
开发者分享个人多AI助手工作流,由Grok Bot统一调度
来自X平台开发者minchoi分享的个人多AI助手集成方案
开发者分享个人多AI助手工作流,由Grok Bot统一调度
来自X平台开发者minchoi分享的个人多AI助手集成方案
Grok Bot 是我的代理 / 机器人之间的协调器,我只和我的参谋长对话,由他来转发所有请求。
机器人工程师:Grok Build + Grok 4.6
Claude Code + Fable 5.1
ChatGPT/Codex + GPT-6 Astra
它们都具备持久记忆,无需在不同对话间复制粘贴。
已经接入 X 实时搜索。图片和视频生成使用 Grok Imagine。
支持移动端 + 桌面端 + 共享云桌面。内置语音功能。
游戏 · @beamnxw▲ 4.3K
开发者打造双AI自主系统 通关《我的世界》
一名开发者用GPT-6 Astra和Jev训练出自主通关《我的世界》的系统
开发者打造双AI自主系统 通关《我的世界》
一名开发者用GPT-6 Astra和Jev训练出自主通关《我的世界》的系统
教程 · @sulfurscales▲ 7.4K
给AI agents加决策层,每周能省你数小时时间
来自X网友@sulfurscales分享的Jev工具落地实操经验
给AI agents加决策层,每周能省你数小时时间
来自X网友@sulfurscales分享的Jev工具落地实操经验
AI编码代理 · @0xMovez▲ 2.9万
Jev创始人发布10步指南让编码代理速度提200倍成本降400倍
Jev创始人Diogo Amogo发布12页PDF指南,含10步操作步骤
Jev创始人发布10步指南让编码代理速度提200倍成本降400倍
Jev创始人Diogo Amogo发布12页PDF指南,含10步操作步骤
产品发布 · @AlexFinn导语出处▲ 1.7万
Grok 4.7发布,智能超Opus 5,价格仅其一半
AlexFinn在𝕏发布Grok 4.7,称其性能超Opus 5且定价更低
Grok 4.7发布,智能超Opus 5,价格仅其一半
AlexFinn在𝕏发布Grok 4.7,称其性能超Opus 5且定价更低
这事儿成真了:Grok 4.7 已经发布。
它的智能水平比 Opus 5 更强,价格只要一半。
它现在已经完整整合进了我目前最喜欢的 AI 代理工具框架:Grok Bot。
如果你还没试过在 Grok Bot 里使用云 Cursor 代理,现在绝对是最佳时机。
选一个你想做的项目,连接你的 GitHub,让 Grok Bot 来处理这个项目。它会启动 Cursor 云代理,在云端写代码,速度极快,而且智能程度惊人。
我建议你先用 Linear 或者 Notion 这类项目管理工具先列出一堆任务,然后让云代理一个接一个地把它们全部搞定。不需要太多监管,你就能完成巨量的工作。
现在正是抓住机会抢占先机接触新技术的好时候。按照我上面说的步骤,动手试试吧。
开发工具 · @garrytan▲ 1.6万
开发者分享 一款AI工具做大型PR比Codex和Claude更快
开发者garrytan在𝕏分享,capydotai可跟踪多步骤工作流,做大型PR速度超过Codex和Claude Code
开发者分享 一款AI工具做大型PR比Codex和Claude更快
开发者garrytan在𝕏分享,capydotai可跟踪多步骤工作流,做大型PR速度超过Codex和Claude Code
开发者garrytan在𝕏发文表示,不清楚@capydotai具体是如何实现的,但它确实能够跟踪多步骤工作流。处理大型拉取请求(PR)时,它的速度比单独使用Codex或Claude Code更快。这款工具是garrytan过去一周最中意的新型智能编码工具。
他在文中分享了一个实例PR链接,该PR针对GBrain项目开展了规模较大的bug修复工作。这次修复拥有清晰的任务划分、自动并行处理,以及非常简洁的Github PR和持续集成(CI)工作流。
开发工具 · @txbrraa▲ 3.3K
Anthropic发布Claude Code官方插件 可自动配置自动化工具
@txbrraa在𝕏分享了Anthropic官方推出的claude-code-setup插件,可一键安装自动配置项目自动化
Anthropic发布Claude Code官方插件 可自动配置自动化工具
@txbrraa在𝕏分享了Anthropic官方推出的claude-code-setup插件,可一键安装自动配置项目自动化
Claude Code使用起来比较繁琐,直到你安装这款官方插件。
Anthropic推出了一款名为claude-code-setup的官方插件,它会告诉你可以搭建哪些自动化工具,包括钩子(hooks)、技能(skills)、MCP服务器、子代理等等,还会逐步讲解如何配置这些工具。
这款插件会自动分析你的项目,然后推荐你激活哪些自动化工具。
安装指令为:/ plugin install claude-code-setup@claude-plugins-official
视频生成 · @aditiitwt▲ 4.0K
AI对话就能制作产品宣传视频,无需剪辑基础
博主@aditiitwt在𝕏分享使用Pexo通过对话制作完整产品视频的体验,还有首50名用户可领100体验额度优惠码
AI对话就能制作产品宣传视频,无需剪辑基础
博主@aditiitwt在𝕏分享使用Pexo通过对话制作完整产品视频的体验,还有首50名用户可领100体验额度优惠码
制作优质产品视频通常需要协调脚本、画面、剪辑、字幕和一系列修改调整,因此@aditiitwt尝试全程通过对话和Pexo完成整个制作流程。
@aditiitwt向Pexo提供了Aether的细节信息,Aether是一款适用于Claude Code和Codex、支持实时智能代理控制的云端开发环境。体验下来,她认为比较好的一点是可以始终在同一个对话中完善视频。
只需要说明哪里需要修改,查看生成结果,就能继续迭代优化。Pexo会直接输出完整的成品视频,不需要创作者手动拼接各个素材,大幅降低了入门门槛。
使用者不需要学习剪辑软件,也不需要掌握复杂的提示词,只需要专注于讲解产品和给出修改反馈即可。最终效果依然由使用者决定,就算不会手动剪辑,也可以提出修改要求。
另外,@aditiitwt为读者准备了专属福利:注册后输入优惠码M296GY即可领取100体验额度,该福利仅限前50名用户领取。
AI绘图 · @LufzzLiz▲ 8.3万
4090实测Qwen-Image 2.1:易触发违规内容,1328²出图仅两毛
网友@LufzzLiz在𝕏发布了用48G显存的RTX 4090本地部署Qwen-Image 2.1的实测结果
4090实测Qwen-Image 2.1:易触发违规内容,1328²出图仅两毛
网友@LufzzLiz在𝕏发布了用48G显存的RTX 4090本地部署Qwen-Image 2.1的实测结果
产品体验 · @0xfishylosopher▲ 9.1K
个人AI代理实测:核心是体验创新而非能力突破
用户@0xfishylosopher 在𝕏分享了 instinct/muse/grokbot 三款个人AI代理的数周使用体验
个人AI代理实测:核心是体验创新而非能力突破
用户@0xfishylosopher 在𝕏分享了 instinct/muse/grokbot 三款个人AI代理的数周使用体验
交易工具 · @RohOnChain▲ 1.9万
免费开源交易工具组合:TradingView加Jev可实现81毫秒自动交易决策
RohOnChain在𝕏分享了一套基于开源代码的免费自动交易工具组合,由TradingViewAPI和Jev构成
免费开源交易工具组合:TradingView加Jev可实现81毫秒自动交易决策
RohOnChain在𝕏分享了一套基于开源代码的免费自动交易工具组合,由TradingViewAPI和Jev构成
强化学习 · @danielrupawalla▲ 3.5K
强化学习环境分为两类,环境设计缺陷可能导致模型有害行为
Daniel Rupawalla在X平台分享了强化学习环境的分类及环境对大模型行为的影响
强化学习环境分为两类,环境设计缺陷可能导致模型有害行为
Daniel Rupawalla在X平台分享了强化学习环境的分类及环境对大模型行为的影响
开源 · @jinchenma_ai▲ 5.8K
Jev已被全网讨论,这里整理了20个实际应用案例
@jinchenma_ai在𝕏整理发布,涵盖航班查询、游戏操作、数据分析等20个Jev实际应用场景
Jev已被全网讨论,这里整理了20个实际应用案例
@jinchenma_ai在𝕏整理发布,涵盖航班查询、游戏操作、数据分析等20个Jev实际应用场景
提示词 · @witcheer▲ 4.0K
让Hermes Agent生成已安装技能清单的提示词
@witcheer在𝕏分享了一款提示词,可让Hermes Agent自动生成本地存储的技能清单
让Hermes Agent生成已安装技能清单的提示词
@witcheer在𝕏分享了一款提示词,可让Hermes Agent自动生成本地存储的技能清单
这款提示词可以让你的Hermes Agent输出自身所有可执行功能的清单。每个已安装技能占一行,用直白语言说明功能,并标注存储位置。
它能够生效的原因是,Hermes Agent的技能都以文件形式存储在本地磁盘中,每个技能对应一个包含SKILL.md文件的文件夹,由Agent自行读取处理。
Agent会重新组织每个技能的描述,核对描述与技能实际功能是否一致,还会检测是否存在功能重复的技能。最终生成可直接打开的skills-index.md文件。
这款提示词的完整内容包含角色设定、三条原则和六条执行步骤,要求Agent仅读取技能文件不修改任何内容,最终生成清单后等待用户确认再输出文件。
商业 · @jeonleetogether▲ 597
AI Agent要自己做生意,可能不需要人打开网页
jeonleetogether在𝕏分享TermiX AI将AACP工作流做成Agent Skill,接入现有AI Agent开发环境
AI Agent要自己做生意,可能不需要人打开网页
jeonleetogether在𝕏分享TermiX AI将AACP工作流做成Agent Skill,接入现有AI Agent开发环境
开源 · @SinghDevHub▲ 1.6K
开发者用Jev、DevinAI和GPT搭建了48个AI公民的微型文明
开发者@SinghDevHub 在X平台分享了这个12分钟模拟实验,模型成本约0.023美元
开发者用Jev、DevinAI和GPT搭建了48个AI公民的微型文明
开发者@SinghDevHub 在X平台分享了这个12分钟模拟实验,模型成本约0.023美元
AI教程 · @FurkanGozukara▲ 774
生成式AI课程第二讲:从零搭建ComfyUI图像工作流
FurkanGozukara的14讲生成式AI完整课程第二讲,基于Windows从零搭建含Z-Image Turbo的ComfyUI工作流
生成式AI课程第二讲:从零搭建ComfyUI图像工作流
FurkanGozukara的14讲生成式AI完整课程第二讲,基于Windows从零搭建含Z-Image Turbo的ComfyUI工作流
工具 · @zodchiii
新型AI工具Jev可提速最高193倍,成本降为原来的1/444
开发者@zodchiii在𝕏发布,针对Claude Fable 5.1和GPT-6 Astra测试,开发者已撰写两页使用指南
新型AI工具Jev可提速最高193倍,成本降为原来的1/444
开发者@zodchiii在𝕏发布,针对Claude Fable 5.1和GPT-6 Astra测试,开发者已撰写两页使用指南
开发者@zodchiii提出,Jev会是AI领域类似互联网诞生的标志性变革,针对Claude Fable 5.1和GPT-6 Astra的测试显示,Jev最高可将处理速度提升193倍,成本降低至原来的444分之一。
开发者本周已经撰写了一份两页的指南,内容涵盖Jev是什么、它的工作原理,以及如何在一个实际任务中试用它。
大多数AI会以段落形式回答问题,而Jev直接给出决策结果。它会输出是或否、具体选项,或是按照你设定的范围给出评级,不需要用户阅读长文或自行解析结果。
用户掌握规则制定权和最终决策权,Jev仅从用户给出的选项中做选择,因此不会偏离主题或生成无关内容。用户可通过下方链接查看Jev从零搭建的完整文章,获取最新更新和可直接复制粘贴的配置。
代码 · @PawelHuryn导语出处
开发者实测Grok 4.7修复代码漏洞 成绩不及多个竞品
开发者PawelHuryn在𝕏分享实测结果,在105个预置代码漏洞测试中,Grok 4.7得分低于GPT-6 Astra和Muse Spark 1.3
开发者实测Grok 4.7修复代码漏洞 成绩不及多个竞品
开发者PawelHuryn在𝕏分享实测结果,在105个预置代码漏洞测试中,Grok 4.7得分低于GPT-6 Astra和Muse Spark 1.3
AI生成视频 · @john87445528▲ 2.6万
酒吧结账不开发票,老板娘把金额写在手背上
出自𝕏用户@john87445528发布的AI视频生成指令,时长15秒一镜到底
酒吧结账不开发票,老板娘把金额写在手背上
出自𝕏用户@john87445528发布的AI视频生成指令,时长15秒一镜到底
你去酒吧喝酒,坐在吧台前叫老板娘买单,老板娘合上账本走过来,握住你的手腕,把总价36直接写在手背上,吹干墨迹后抬眼等你看清,最后保持冷艳带距离感的姿势收尾。
这是一份生成视频的AI指令,要求生成15秒竖屏第一人称视角视频,一镜到底,全程无剪辑、无转场,保留手机原生相机拍摄的自然抖动、噪点等真实质感。
指令对场景、道具、时间分镜、表情、音频都做了详细限制:只能出现一位女性角色和拍摄者的左手小臂,吧台必须有记账本、签字笔和喝过的空啤酒杯,全程不能出现小票、POS机、二维码等现代支付工具,女主不能说话,只能保留酒吧环境音和交易相关的细微声响。
视频最后定格在老板娘冷艳直视镜头的画面,留给观看者一个问题:这种结账方式,你会选择再点几瓶吗?
AI生成内容 · @TanLuAI▲ 9.3K
AI生成的三段创意视频:赛博机甲做美甲,仙侠高手烤串,女将军化妆
来自@TanLuAI在𝕏发布的内容,由Codex生成全部提示词,混合人类创意,风格为90年代美国西海岸嘻哈MV
AI生成的三段创意视频:赛博机甲做美甲,仙侠高手烤串,女将军化妆
来自@TanLuAI在𝕏发布的内容,由Codex生成全部提示词,混合人类创意,风格为90年代美国西海岸嘻哈MV
今天的 46 条信号到这里下一轮 12:30 更新
📬 订阅
https://ai-pulse-lab.com/feed.xml