AI Pulse

AI Pulse

说人话的 AI 情报站
每天 08:00 · 12:30 · 18:30 · 23:50 更新每天四次更新
2026 年 8 月 16 日 · 08:00 更新 0 文章0 信号0 主题
试试:

今天发生了什么1 分钟读懂

PrimeIntellect 完成迄今最大规模的自主 AI 研究实验:让 AI 自主迭代优化 nanoGPT,10 余款模型运行超 100 次,最优结果把与人类团队数月成果的差距缩小了 82%。这是 AI 自主科研首次在真实工程任务上显示出可量化的追赶速度。

Anthropic 昨天披露的水印政策今天补了 FAQ,确认不追踪用户个人信息、不影响输出质量、不增加使用成本。同日,Andrej Karpathy 加入 Anthropic 后发布首门课程:4 小时免费视频,从零构建大语言模型。

AMD 发布 Ryzen AI Embedded X100 系列处理器和 Kria AI 平台,瞄准实体 AI 的统一加速。这是芯片厂商首次为边缘 AI 系统提供从处理器到开发平台的完整垂直方案。

今日值得看
01 一键扒光网站设计系统的 SkillUI Skill SkillUI 能把任意网站的设计系统整套扒下来,配色、字体、动画全打包。 02 雪山双姝对决的视频提示词 GPT Image 2 生图 + 可灵转视频,冷蓝雪地与橙红烈焰的撞色美学。
03 Codex发布Multi Agents v2 功能 复杂编码交给专业大模型,日常任务交给低成本快模型,做项目不用手动切换不同模型了。

Codex这个更新有意思啊! Codex的Multi Agents v2,现在已经可以让主Agent把不同子任务,自动委派给不同模型。

04 @FiniYang发布dsh-noema 长期记忆插件 支持从Codex、Claude Code、Cursor导入已有记忆,Agent能跨会话记住内容,不用每次重启都重新复述需求。

这是我们的第二个 DeepSeek Harness 插件 🥳 长期记忆插件 dsh-noema 🐳 基于现有成熟的记忆系统产品 让 DeepSeek Harness 中的 Agent 能跨会话记住重要内容工作前主动回忆 也能在设置页里查…

今日焦点

改个AI计费方式,还得开浏览器授权

Claude Code 是 Anthropic 的编程智能体。一位开发者想把它从 API 用量计费切回 Pro 订阅,发现连个简单的切换开关都没有。

他记录的操作流程很绕:SSH 进服务器,附加 tmux 会话,运行登录命令。接着复制 OAuth URL,打开浏览器授权,再把返回的代码贴回终端。只是一次计费切换,花的时间比该花的多得多。他说,这种 UX 问题十年前就有解决方案了。

解决起来也不复杂:一条命令或一个本地标志就能省掉这些步骤。高票评论也是同样的判断——本地标志能覆盖大多数人的需求,不用走完整的远程授权流程。

阅读全文 →

深度阅读

查看全部深度文章 →
AI Agent 订阅 · 每天四次推送

🔥 信号雷达43 条

𝕏 实时信号 + arXiv 前沿论文,经 AI 聚类解读 · 一眼扫完全貌(含上方导读精选 4 条)

08:00 本轮更新 · 下一轮 12:30
行业动态 · Hacker News▲ 48

以色列公关团队要回答ChatGPT相关问题

科技讨论社区出现非常规公关介入AI话题的情况,可以观察公关如何借助AI议题传递信息

行业动态 · Hacker News▲ 54

Yadda 发布3.0.0 适配AI代理时代

做自动化测试的开发者可以关注新版本,看看适配AI代理后是否能优化现有BDD测试流程

开源 · @servasyy_ai▲ 3.9万

国内AI开源高手大多都聚集在B站

从图片、音视频模型到推理大模型,每一波新技术兴起,都能在B站找到作者或者相关学习内容。

阅读全文 →
3.9万13113168
开源 · @Aykutuces▲ 2.0万

HeyGen发布HyperFrames 开源项目

给视频剪辑师提供了新的生成路径,代码工具可以直接对接这个流程。

给视频编辑从业者的一个有趣开源项目。HeyGen 团队发布了 HyperFrames。

逻辑很简单:HTML + CSS + 动画 → MP4

但它的核心特点是:你可以让 Claude Code、Codex、Cursor 这类 coding agent 来完成这项工作。

你只需要输入指令:“做一个10秒的产品介绍视频,加上动画,同步字幕,渲染成MP4。”

Agent 会做规划、生成 HTML、绑定动画、获取预览、渲染出视频。而且它不只能做简单视频:
→ 产品介绍
→ 动态字幕
→ 数据可视化
→ 网站 → 视频
→ PDF → 视频
→ 3D / Three.js 动画
→ 社交媒体视频

你可以把它当成 Remotion 的替代品,但它的核心思路是用 HTML 而非 React。

在我看来,最有意思的点是视频生产也接入了 coding agent 工作流。现在你不用自己“编辑”视频,而是可以让 agent 为你“构建”视频。

GitHub 仓库放在评论区了。

在 X 看原帖 ↗
2.0万466143
前沿研究 · @fchollet▲ 11.6万

ARC-AGI-3最优方案都用大语言模型导符号模型

AGI基准测试的领先解法都指向同一技术路线,这会影响通用人工智能研究的未来方向,值得关注。

Jeremy 的出色工作很好地展示了一种非常强大的方法:LLM 引导的符号化世界模型实时合成,也就是通过编写可执行代码来理解世界,这些代码会编码你对世界因果机制的理解。

到目前为止,ARC-AGI-3 上所有性能最优的工具都采用了这种风格的方法。这也是我们最初发布这个基准测试时推荐的方法(作为前 Ndea 技术员工,Jeremy 比大多数人更清楚这一点)。

我很高兴 ARC 3 推动了这个领域更多的研究和进展。

在 X 看原帖 ↗
11.6万69874568
新品发布 · @gdb▲ 8.4万

@gdb发布自动选择AI模型功能

不用再手动挑AI模型,省掉选择时间

朝着彻底无需手动选择模型的目标前进

在 X 看原帖 ↗
8.4万331.1K184
新品发布 · @pvncher▲ 42.7万

@pvncher发布多智能体v2模型任务委派功能

这项低关注度功能上线后,多智能体v2可向所有支持的模型委派任务,包括Luna,让多智能体协作的灵活性进一步提升。

这件事这一周都没怎么引起关注,但我们刚刚推出了新功能,支持 multi agents v2 的模型可以将任务委派给任何受支持的模型,包括 Luna!我们花了不少时间来确保它能稳定运行。

在 X 看原帖 ↗
42.7万1111.9K723
前沿研究 · @PrimeIntellect▲ 3.3万

PrimeIntellect实验:AI追平人类科研差距82%

人类科研团队花几个月才能跑出的模型优化记录,AI自主迭代后补上了其中82%的差距,AI自主科研的速度开始显现实际效果

我们开展了迄今为止规模最大的开放实验,研究前沿模型如何进行AI研究。

我们在超过10个模型上完成了100多次自主运行,在由8xH200组成的沙箱环境中最长运行8天,在nanoGPT优化器赛道上迭代改进。

表现最佳的运行缩小了82%的差距,目标是数十名人类研究者花费数月建立的记录。

在 X 看原帖 ↗
3.3万42317142
行业动态 · @AnthropicAI▲ 618.9万

AnthropicAI发布AI生成内容水印常见问题解答

为符合欧盟AI法案要求,Anthropic将为Claude输出添加AI水印,该方案不影响输出质量,也不会增加使用成本,不追踪用户个人信息

我们撰写了一份常见问题解答,来回应我们收到的关于水印功能的提问。总结如下:
• 我们推出水印功能是为了遵守欧盟 AI 法案,其他主流模型开发者也签署了同一行为准则,同样会推出水印功能;
• 我们的水印方法不会对 Claude 输出内容的质量或内容产生任何实际影响;
• 读者根本无法区分带水印和不带水印的文本;
• 不会向文本中添加任何内容,也不存在隐藏字符;
• 水印功能不需要额外 token,也不会增加使用成本;
• 水印无法追溯到特定个人、组织或对话。

点击此处了解更多:

在 X 看原帖 ↗
618.9万5063.5K2.4K
深度观点 · @jackclarkSF▲ 2.3万

jackclarkSF划分近年AI发展三个阶段

可据此判断AI行业当前所处的发展阶段,判断后续技术迭代的方向,提前规划相关布局

近期AI进步大致阶段,按研究共同体集体爬坡的目标划分:

2018-2022:基础能力(总结、写代码等)

2022-2026:规范与时间连贯性(RLHF/CAI、长上下文、智能体)

2026 - ?2028?:科学直觉/自主性

在 X 看原帖 ↗
2.3万1227684
游戏开发 · @Grummz▲ 9.5万

开发者弃用Unreal,全AI编写游戏引擎Kaiju Engine

开发者用全AI生成替代引擎Kaiju,成功移植旧游戏《Firefall》

阅读全文 →
9.5万1372.3K1.1K
🔥 热点追踪 · @PrimeIntellect▲ 3.3万

PrimeIntellect完成最大规模自主AI研究开放实验

实验在10余款模型上开展了超100次自主运行,用8块H200显卡,最长运行8天优化nanoGPT。最优结果缩小了82%与人类团队数月成果的差距,后续需观察自主AI研究的落地进度。

3.3万42317142
开源 · @AJButton2▲ 1.1万

通义千问成全球下载量最高开源AI模型

排名超过谷歌和Meta的开源模型,想试试开源大模型的普通用户,搜索时它现在会排在更靠前的位置。

🚨 阿里巴巴的 Qwen 成为全球下载量第一的开源 AI 模型,排名高于 Google 和 Meta 的模型 $BABA

在 X 看原帖 ↗
1.1万1415315
开源 · @MAXdeg0▲ 3.9K

@MAXdeg0开源Anthropic Cybersecurity Skills 工具(817)

覆盖29个安全领域,做AI代理安全功能开发的开发者,可以直接调用这些现成技能。

这他妈太疯了。我找到了一个真正全面的东西:ANTHROPIC CYBERSECURITY SKILLS。

为AI agents准备的817项生产级安全技能,开源。一共覆盖29个安全领域:云安全、威胁狩猎、网络安全、事件响应、恶意软件分析、红队作战等等。

所有技能都对标真实框架:MITRE ATT&CK v17.1、NIST CSF 2.0、OWASP、MITRE Fight Fraud Framework、CIS Controls,还有更多。

每一项技能都附带完整的YAML前置元数据,标注了它覆盖的具体框架技术,并且兼容Claude Code、GitHub Copilot、OpenAI Codex CLI、Cursor和Gemini CLI。

快速启动只需要一行克隆命令。免费、开源、活跃维护。仓库链接在下方。

在 X 看原帖 ↗
3.9K88157
开源 · @SpaceTimeViking▲ 7.1K

@SpaceTimeViking发布Qwen3.8-27B-AEON-ULTIMATE-UNCENSORED BF16 权重(0)

已经发布了BF16权重,NVFP4校准版本还在制作中。

我们宣布 Qwen3.8-27B-AEON-ULTIMATE-UNCENSORED BF16 权重已正式发布!

经过校准的 NVFP4 版本正在制作中。

这个模型在多个维度都达到了全新水准!

在实际响应评估中,0 次真正的拒绝。智能完全解锁。

所有 KL 漂移相比原版实际上都带来了性能提升!

在 X 看原帖 ↗
7.1K27258238
前沿研究 · @eliebakouch▲ 4.9K

研究者披露大模型自主科研实验最新结果

不同顶尖大模型的自主科研能力差距显著,Fable 5 接近人类目前的纪录,后续会公布更多模型的测试结果,可提前了解不同大模型的科研潜力。

阅读全文 →
4.9K1311050
新品发布 · @AMD▲ 1.0万

AMD发布Ryzen AI Embedded X100 Series 处理器、Kria AI 平台

实体AI成为AI发展的下一个方向,这次发布的产品可为实体AI系统提供统一的AI加速,后续落地AI硬件产品的成本会更低。

AI的下一个前沿是物理世界 🦾

@ServeTheHome 详细介绍了 AMD Ryzen AI Embedded X100 系列处理器与 Kria AI 平台,它们为物理AI系统带来了高性能x86计算与统一AI加速。

在 X 看原帖 ↗
1.0万1110615
深度观点 · @hwchase17▲ 6.5K

hwchase17聊企业该怎么自主掌控AI

方案给出了可落地的工具路径,想要沉淀企业自有AI能力,可以参考这套自主搭建的思路。

阅读全文 →
6.5K126753
新品发布 · @vaibhavbetter▲ 1.6万

vaibhavbetter开源Arbr,夺回AI控制权

给AI开发团队解决服务商涨价、模型停更、更新崩环境的痛点,能自行部署,不用绑定服务商

阅读全文 →
1.6万139055
实战经验 · @Ben_escrito▲ 7.3K

Ben_escrito整理了15份免费AI学习指南

想入门AI又找不到合适的学习资源,不用自己搜索筛选,这份汇总好的免费清单可以直接用

阅读全文 →
7.3K3897114
AI图像生成 · @Rk5530▲ 1.4K

创作者联合使用GPT Image 2与Kling AI生成战斗场景图

创作者在ChatGPT中用GPT Image 2结合Kling AI生成了雪地高山战斗的电影级场景图

阅读全文 →
1.4K33617
机器人 · @mrfundman

开发者分享模仿埃隆·马斯克的Grok机器人提示词

用户@mrfundman在X平台分享定制提示词,可将Grok设置成完全模仿埃隆·马斯克的机器人

产品体验 · @AlexFinn

用户连续一周使用Grok Bot后称其为当前最佳AI智能体

X平台用户AlexFinn分享连续一周不间断使用体验,列出六大使用场景并给出评价

3D建模 · @hma_life

开发者制作Zoe虚拟主播模型 新增身体动作模块

开发者分享第12天开发进展,已将实验项目上传GitHub,当前面部追踪存在不稳定问题

开发者@hma_life在第12天开发Zoe 3D模型的过程中,新增了身体动作功能。开发者尝试添加眉毛追踪功能,但追踪效果不稳定。

这个项目属于实验性质,代码结构稍显杂乱,项目已经上传至GitHub,感兴趣的用户可以下载fbx模型文件。

开发者还新增了若干表情,但说话时面部追踪会出现识别错误。由于开发者本身不是程序员,不熟悉这类功能的最优开发方法,计划只对现有内容做优化,最终保留为一个简单模型。

这个项目只是面向朋友分享的快速实验。开发者之前接触过Discord API,曾构想让Zoe在收到Discord消息时触发特定表情。如果后续能获得效果更好的面部追踪方案,可能会再继续打磨这类功能。

在 X 看原帖 ↗
大语言模型 · @RohOnChain

前OpenAI/Tesla研究员Karpathy加入Anthropic后发布免费AI课程

Andrej Karpathy拥有8年OpenAI与特斯拉从业经历,发布4小时免费从零构建大语言模型课程

Andrej Karpathy曾在OpenAI和特斯拉工作8年,最近他加入了Anthropic。

几天前,他将自己掌握的全部相关知识整理成一节免费的4小时课程。完成课程后,学习者可以从零开始搭建像ChatGPT和Claude这样的大语言模型(LLM)。

市面上同类训练营仅教授一半内容,收费就达到1.5万美元。如果你现在没有4小时整的空闲,可以先收藏这节课,后续再观看,看完后按照配套指南操作就能搭建出你的第一个工作循环。

在 X 看原帖 ↗
游戏开发 · @milichab

九个月间城市建造游戏的AI前沿进展更新

对比2025年11月和2026年8月的项目,AI已可实现全3A全3D游戏内容生成

整理九个月来AI在城市建造游戏领域的前沿进展,左侧为2025年11月推出的IsoCity项目,右侧为2026年8月推出的新项目。

2026年8月的新项目由Grok 4.6结合循环机制开发,采用Composer 1与云端智能体技术。借助当前AI能力,制作全3D和3A级图形已经可以实现。

IsoCity项目总开发耗时约40到50小时,是2025年11月项目的约10倍,并且完全开源。

2025年项目的所有资源资产都由AI图像生成,到2026年8月,这类资产已经全部可以通过程序化生成。

在 X 看原帖 ↗
大模型 · @0xSero▲ 637

开发者本地运行大模型月token消耗达100亿,等于一份Codex订阅

开发者@0xSero分享,为做深度研究和实验,本地大模型月消耗100亿token,停用其他订阅

@0xSero表示,自己本地运行大模型的预计月token消耗量已经达到100亿,消耗量等同于一份OpenAI Codex订阅。他特意选择了速度更慢的模型运行。

今天他全程只使用了这一本地大模型,其他所有大模型订阅的使用量都为零。这段时间他一直在开展深度研究,进行各类非常规实验。

在 X 看原帖 ↗
637132
大语言模型 · @ryan4yin▲ 3.7K

开发者本地测试通义千问Qwen 3.8-27B,性能接近GPT-5.6-sol

该模型在编码等开发场景体验优异,高峰期性能优于表现下降的GPT-5.6-sol

开发者ryan4yin在𝕏分享个人测试体验,Qwen 3.8-27B在本地部署测试中表现超出预期。本次测试使用Q4_K_M量化格式搭配opencode,用于修改nix配置、审查k8s yaml文件、定位线上开发问题。

从个人体验来看,该模型的表现比gpt-5.6-sol稍差,但差距非常小。面对前几天高峰期出现性能下降的gpt-5.6-sol,该模型的表现明显更优。

本次分享仅为个人体验,测试未涉及复杂项目开发。测试使用的nix配置可查看分享链接获取。

在 X 看原帖 ↗
3.7K3112
大模型 · @designwkarthick▲ 5.9K

用户使用2天就耗尽SuperGrok周使用额度

连续编码8小时触达限制,用户建议X AI推出适配编码的桌面端应用

一名为designwkarthick的用户在X上分享,自己仅使用SuperGrok两天,就已经耗尽了该服务的每周使用额度。他大约连续编码8小时就触达了使用上限。

他大多用Grok进行前端设计,认为Grok在这项工作上表现非常出色。但如果完全依赖智能体编码,当前的额度限制并不够用。

他向Grok团队提出建议,希望推出一款合格的桌面编码应用,类似Codex或Claude Code。

命令行界面(CLI)体验不错,但依然缺少发挥出这款大模型强大能力所需的使用体验。Grok已经拥有出色的模型,现在需要围绕模型打造配套的优质工具。

在 X 看原帖 ↗
5.9K2502
智能体 · @Voxyz_ai▲ 1.3万

开发者将部分Hermes配置迁移至Grok Bot作为工作环境测试

开发者测试Grok Bot的多机器人交互与托管能力,分享了实测体验和 nightly 任务配置

阅读全文 →
1.3万66987
动态 · @Alexvx_nft▲ 528

AI代理发展瓶颈已不在提示词工程而在工具层

观点指出当前AI代理的核心限制是工具设计不佳,而非提示词质量不足,需重构工具工程

大模型 · @AkitaOnRails▲ 3.0K

开发者测试GLM 5.3与Kimi K3 体验接近顶级大模型

开发者AkitaOnRails在多个个人项目中测试两款大模型,认为均可正常投入使用

AkitaOnRails花费一整天,在多个个人项目中测试了GLM 5.3大模型。测试结果显示,GLM 5.3的可用性很好,测试过程没有出现任何问题。

Kimi K3的测试体验和GLM 5.3相近。两款大模型的整体表现,都和Opus、Sol大模型大致处在相近水平。

到目前这个阶段,已经没有理由不使用这两款大模型。

在 X 看原帖 ↗
3.0K1708
生活科技 · @Austen▲ 2.2K

用户分享AI结合身体扫描健康数据自动订购 groceries

用户称该功能匹配个人饮食计划是他最喜爱的AI应用,还提到可做HEB配送对接工具

基于近期身体扫描结果、健康数据、个人偏好,并匹配个人饮食计划,AI自动帮用户订购日常食品杂货,这是用户最喜爱的AI应用场景之一。用户还附上了相关链接。用户提到,HEB配送的相关工作人员需要搭建Claude连接器或是MCP(模型上下文协议)。

用户表示,或许自己会完成这项搭建工作。

在 X 看原帖 ↗
2.2K114
大模型 · @TheMaran▲ 8.3K

网传OpenAI未公开GPT-5.6-sol模型调用方法已被修复

有用户曝出OpenAI在Codex中暴露内部测试模型,可实现无限制token调用,最新消息称该漏洞已修复

阅读全文 →
8.3K15558
大模型 · @SpaceTimeViking▲ 2.0K

开发者分享大模型移除对齐Abliteration的新实践经验

开发者指出低KL散度并非最优目标,适度KL散度可提升模型智能和回答效率

阅读全文 →
2.0K118224
教程 · @Techbruneth▲ 1.0万

ChatGPT隐藏模式“无限私教” 3小时可从零学任意技能

分享8个可直接复制使用的实用提示词,解锁ChatGPT的高效学习功能

阅读全文 →
1.0万73554
笔记工具 · @kocer_eth▲ 2.5K

让Obsidian笔记库成为AI可用记忆的双层方案

原生存储的400条Obsidian原始笔记无法成为AI可用记忆,双层上下文结构可解决该问题

阅读全文 →
2.5K66162
视频剪辑 · @VincentWei93▲ 2.7K

开发者尝试用AI智能体以代码形式制作卡点混剪视频

成品并非由AI生成视频模型直接生成,当前可通过组件搭建补齐模型不足

开发者VincentWei93近期研究了一项新技术:使用AI智能体(AI agent)制作卡点混剪视频。研究后他认为,以AI通过代码形式制作视频存在很大潜力。

AI智能体不仅能通过代码制作口播视频、动效、宣传片,还可以制作对剪辑精度要求极高的卡点混剪。需要说明的是,这类成品不是通过AI视频生成模型直接生成的,而是由AI智能体以代码编排制作而成。

目前这类AI在时间轴和空间轴的动态审美能力仍有待提升。通过搭建组件和功能模块,已经可以补齐很大一部分能力缺口。

如果有足够多的人对这项技术感兴趣,后续会推出系列技术分享。分享将帮助不会专业剪辑软件的普通用户,也能通过AI制作甚至原创这类视频。

在 X 看原帖 ↗
2.7K13334
编程 · @Xianbao_QIAN▲ 9.3K

开发者实测DeepSeek编程工具 体验流畅表现优异

开发者分享深度使用DeepSeek编程工具的实际体验,评价出众

我今天在编程工作中大量使用了 @deepseek_ai 的开发框架,我真的很喜欢它。这几乎就是理想中的开发框架了。干得漂亮 @tianyi!

- Flash 模型能达到 100+ tok/s 的生成速度……体验非常流畅
- 处理长上下文时,GUI 比 Codex 快得多
- 前缀复用的表现非常夸张,缓存命中率达到 100%
- 这个框架对上下文的利用看起来很合理

在我的使用体验里,它的上下文消耗速度比 Claude Code 慢得多。轨迹功能非常棒,能帮你清晰了解模型都做了什么,太实用了。

我本来考虑用专业版,但 Flash 版本已经能很好地完成工作了——我甚至不用输入 /goal,只用普通提示就能触发很长的工作流。太厉害了!

而且说实话,我连插件功能都还没试呢,那个功能听起来也很不错。

你的体验如何?你喜欢它吗?

在 X 看原帖 ↗
9.3K816632
🔬 前沿研究
前沿研究 · @PrimeIntellect▲ 3.3万

PrimeIntellect实验:AI追平人类科研差距82%

人类科研团队花几个月才能跑出的模型优化记录,AI自主迭代后补上了其中82%的差距,AI自主科研的速度开始显现实际效果

我们开展了迄今为止规模最大的开放实验,研究前沿模型如何进行AI研究。

我们在超过10个模型上完成了100多次自主运行,在由8xH200组成的沙箱环境中最长运行8天,在nanoGPT优化器赛道上迭代改进。

表现最佳的运行缩小了82%的差距,目标是数十名人类研究者花费数月建立的记录。

在 X 看原帖 ↗
3.3万42317142
前沿研究 · @fchollet▲ 11.6万

ARC-AGI-3最优方案都用大语言模型导符号模型

AGI基准测试的领先解法都指向同一技术路线,这会影响通用人工智能研究的未来方向,值得关注。

Jeremy 的出色工作很好地展示了一种非常强大的方法:LLM 引导的符号化世界模型实时合成,也就是通过编写可执行代码来理解世界,这些代码会编码你对世界因果机制的理解。

到目前为止,ARC-AGI-3 上所有性能最优的工具都采用了这种风格的方法。这也是我们最初发布这个基准测试时推荐的方法(作为前 Ndea 技术员工,Jeremy 比大多数人更清楚这一点)。

我很高兴 ARC 3 推动了这个领域更多的研究和进展。

在 X 看原帖 ↗
11.6万69874568
前沿研究 · @eliebakouch▲ 4.9K

研究者披露大模型自主科研实验最新结果

不同顶尖大模型的自主科研能力差距显著,Fable 5 接近人类目前的纪录,后续会公布更多模型的测试结果,可提前了解不同大模型的科研潜力。

阅读全文 →
4.9K1311050
🚀 新品发布
新品发布 · @pvncher▲ 42.7万

@pvncher发布多智能体v2模型任务委派功能

这项低关注度功能上线后,多智能体v2可向所有支持的模型委派任务,包括Luna,让多智能体协作的灵活性进一步提升。

这件事这一周都没怎么引起关注,但我们刚刚推出了新功能,支持 multi agents v2 的模型可以将任务委派给任何受支持的模型,包括 Luna!我们花了不少时间来确保它能稳定运行。

在 X 看原帖 ↗
42.7万1111.9K723
新品发布 · @gdb▲ 8.4万

@gdb发布自动选择AI模型功能

不用再手动挑AI模型,省掉选择时间

朝着彻底无需手动选择模型的目标前进

在 X 看原帖 ↗
8.4万331.1K184
新品发布 · @vaibhavbetter▲ 1.6万

vaibhavbetter开源Arbr,夺回AI控制权

给AI开发团队解决服务商涨价、模型停更、更新崩环境的痛点,能自行部署,不用绑定服务商

阅读全文 →
1.6万139055
新品发布 · @AMD▲ 1.0万

AMD发布Ryzen AI Embedded X100 Series 处理器、Kria AI 平台

实体AI成为AI发展的下一个方向,这次发布的产品可为实体AI系统提供统一的AI加速,后续落地AI硬件产品的成本会更低。

AI的下一个前沿是物理世界 🦾

@ServeTheHome 详细介绍了 AMD Ryzen AI Embedded X100 系列处理器与 Kria AI 平台,它们为物理AI系统带来了高性能x86计算与统一AI加速。

在 X 看原帖 ↗
1.0万1110615
📰 行业动态
🔥 热点追踪 · @PrimeIntellect▲ 3.3万

PrimeIntellect完成最大规模自主AI研究开放实验

实验在10余款模型上开展了超100次自主运行,用8块H200显卡,最长运行8天优化nanoGPT。最优结果缩小了82%与人类团队数月成果的差距,后续需观察自主AI研究的落地进度。

3.3万42317142
行业动态 · @AnthropicAI▲ 618.9万

AnthropicAI发布AI生成内容水印常见问题解答

为符合欧盟AI法案要求,Anthropic将为Claude输出添加AI水印,该方案不影响输出质量,也不会增加使用成本,不追踪用户个人信息

我们撰写了一份常见问题解答,来回应我们收到的关于水印功能的提问。总结如下:
• 我们推出水印功能是为了遵守欧盟 AI 法案,其他主流模型开发者也签署了同一行为准则,同样会推出水印功能;
• 我们的水印方法不会对 Claude 输出内容的质量或内容产生任何实际影响;
• 读者根本无法区分带水印和不带水印的文本;
• 不会向文本中添加任何内容,也不存在隐藏字符;
• 水印功能不需要额外 token,也不会增加使用成本;
• 水印无法追溯到特定个人、组织或对话。

点击此处了解更多:

在 X 看原帖 ↗
618.9万5063.5K2.4K
开源 · @AJButton2▲ 1.1万

通义千问成全球下载量最高开源AI模型

排名超过谷歌和Meta的开源模型,想试试开源大模型的普通用户,搜索时它现在会排在更靠前的位置。

🚨 阿里巴巴的 Qwen 成为全球下载量第一的开源 AI 模型,排名高于 Google 和 Meta 的模型 $BABA

在 X 看原帖 ↗
1.1万1415315
开源 · @servasyy_ai▲ 3.9万

国内AI开源高手大多都聚集在B站

从图片、音视频模型到推理大模型,每一波新技术兴起,都能在B站找到作者或者相关学习内容。

阅读全文 →
3.9万13113168
产品更新 · @MaxForAI▲ 8.8K

Codex发布Multi Agents v2 功能

复杂编码交给专业大模型,日常任务交给低成本快模型,做项目不用手动切换不同模型了。

阅读全文 →
8.8K45838
工具 · @FiniYang▲ 1.5万

@FiniYang发布dsh-noema 长期记忆插件

支持从Codex、Claude Code、Cursor导入已有记忆,Agent能跨会话记住内容,不用每次重启都重新复述需求。

这是我们的第二个 DeepSeek Harness 插件 🥳 长期记忆插件 dsh-noema 🐳 基于现有成熟的记忆系统产品 让 DeepSeek Harness 中的 Agent 能跨会话记住重要内容工作前主动回忆 也能在设置页里查看和管理记忆 不用每次都从零开始复述背景 ⚙️ 支持从 Codex、Claude Code、Cursor 等导入已有记忆并管理 欢迎使用: #deepseek #harness #dsh #plugin #memory #agent

在 X 看原帖 ↗
1.5万21200174
开源 · @MAXdeg0▲ 3.9K

@MAXdeg0开源Anthropic Cybersecurity Skills 工具(817)

覆盖29个安全领域,做AI代理安全功能开发的开发者,可以直接调用这些现成技能。

这他妈太疯了。我找到了一个真正全面的东西:ANTHROPIC CYBERSECURITY SKILLS。

为AI agents准备的817项生产级安全技能,开源。一共覆盖29个安全领域:云安全、威胁狩猎、网络安全、事件响应、恶意软件分析、红队作战等等。

所有技能都对标真实框架:MITRE ATT&CK v17.1、NIST CSF 2.0、OWASP、MITRE Fight Fraud Framework、CIS Controls,还有更多。

每一项技能都附带完整的YAML前置元数据,标注了它覆盖的具体框架技术,并且兼容Claude Code、GitHub Copilot、OpenAI Codex CLI、Cursor和Gemini CLI。

快速启动只需要一行克隆命令。免费、开源、活跃维护。仓库链接在下方。

在 X 看原帖 ↗
3.9K88157
开源 · @Aykutuces▲ 2.0万

HeyGen发布HyperFrames 开源项目

给视频剪辑师提供了新的生成路径,代码工具可以直接对接这个流程。

给视频编辑从业者的一个有趣开源项目。HeyGen 团队发布了 HyperFrames。

逻辑很简单:HTML + CSS + 动画 → MP4

但它的核心特点是:你可以让 Claude Code、Codex、Cursor 这类 coding agent 来完成这项工作。

你只需要输入指令:“做一个10秒的产品介绍视频,加上动画,同步字幕,渲染成MP4。”

Agent 会做规划、生成 HTML、绑定动画、获取预览、渲染出视频。而且它不只能做简单视频:
→ 产品介绍
→ 动态字幕
→ 数据可视化
→ 网站 → 视频
→ PDF → 视频
→ 3D / Three.js 动画
→ 社交媒体视频

你可以把它当成 Remotion 的替代品,但它的核心思路是用 HTML 而非 React。

在我看来,最有意思的点是视频生产也接入了 coding agent 工作流。现在你不用自己“编辑”视频,而是可以让 agent 为你“构建”视频。

GitHub 仓库放在评论区了。

在 X 看原帖 ↗
2.0万466143
开源 · @SpaceTimeViking▲ 7.1K

@SpaceTimeViking发布Qwen3.8-27B-AEON-ULTIMATE-UNCENSORED BF16 权重(0)

已经发布了BF16权重,NVFP4校准版本还在制作中。

我们宣布 Qwen3.8-27B-AEON-ULTIMATE-UNCENSORED BF16 权重已正式发布!

经过校准的 NVFP4 版本正在制作中。

这个模型在多个维度都达到了全新水准!

在实际响应评估中,0 次真正的拒绝。智能完全解锁。

所有 KL 漂移相比原版实际上都带来了性能提升!

在 X 看原帖 ↗
7.1K27258238
行业动态 · Hacker News▲ 54

Yadda 发布3.0.0 适配AI代理时代

做自动化测试的开发者可以关注新版本,看看适配AI代理后是否能优化现有BDD测试流程

行业动态 · Hacker News▲ 48

以色列公关团队要回答ChatGPT相关问题

科技讨论社区出现非常规公关介入AI话题的情况,可以观察公关如何借助AI议题传递信息

💡 深度观点
深度观点 · @jackclarkSF▲ 2.3万

jackclarkSF划分近年AI发展三个阶段

可据此判断AI行业当前所处的发展阶段,判断后续技术迭代的方向,提前规划相关布局

近期AI进步大致阶段,按研究共同体集体爬坡的目标划分:

2018-2022:基础能力(总结、写代码等)

2022-2026:规范与时间连贯性(RLHF/CAI、长上下文、智能体)

2026 - ?2028?:科学直觉/自主性

在 X 看原帖 ↗
2.3万1227684
深度观点 · @hwchase17▲ 6.5K

hwchase17聊企业该怎么自主掌控AI

方案给出了可落地的工具路径,想要沉淀企业自有AI能力,可以参考这套自主搭建的思路。

阅读全文 →
6.5K126753
📌 其他
实战经验 · @Ben_escrito▲ 7.3K

Ben_escrito整理了15份免费AI学习指南

想入门AI又找不到合适的学习资源,不用自己搜索筛选,这份汇总好的免费清单可以直接用

阅读全文 →
7.3K3897114
游戏开发 · @Grummz▲ 9.5万

开发者弃用Unreal,全AI编写游戏引擎Kaiju Engine

开发者用全AI生成替代引擎Kaiju,成功移植旧游戏《Firefall》

阅读全文 →
9.5万1372.3K1.1K
开源 · @yume_arasaki▲ 7.7K

教你在消费级NVIDIA显卡上最优运行通义千问3.8 27B

分享社区整理的最优配置参数,适配RTX3090/4090/5090

阅读全文 →
7.7K8157289
编程 · @Xianbao_QIAN▲ 9.3K

开发者实测DeepSeek编程工具 体验流畅表现优异

开发者分享深度使用DeepSeek编程工具的实际体验,评价出众

我今天在编程工作中大量使用了 @deepseek_ai 的开发框架,我真的很喜欢它。这几乎就是理想中的开发框架了。干得漂亮 @tianyi!

- Flash 模型能达到 100+ tok/s 的生成速度……体验非常流畅
- 处理长上下文时,GUI 比 Codex 快得多
- 前缀复用的表现非常夸张,缓存命中率达到 100%
- 这个框架对上下文的利用看起来很合理

在我的使用体验里,它的上下文消耗速度比 Claude Code 慢得多。轨迹功能非常棒,能帮你清晰了解模型都做了什么,太实用了。

我本来考虑用专业版,但 Flash 版本已经能很好地完成工作了——我甚至不用输入 /goal,只用普通提示就能触发很长的工作流。太厉害了!

而且说实话,我连插件功能都还没试呢,那个功能听起来也很不错。

你的体验如何?你喜欢它吗?

在 X 看原帖 ↗
9.3K816632
视频剪辑 · @VincentWei93▲ 2.7K

开发者尝试用AI智能体以代码形式制作卡点混剪视频

成品并非由AI生成视频模型直接生成,当前可通过组件搭建补齐模型不足

开发者VincentWei93近期研究了一项新技术:使用AI智能体(AI agent)制作卡点混剪视频。研究后他认为,以AI通过代码形式制作视频存在很大潜力。

AI智能体不仅能通过代码制作口播视频、动效、宣传片,还可以制作对剪辑精度要求极高的卡点混剪。需要说明的是,这类成品不是通过AI视频生成模型直接生成的,而是由AI智能体以代码编排制作而成。

目前这类AI在时间轴和空间轴的动态审美能力仍有待提升。通过搭建组件和功能模块,已经可以补齐很大一部分能力缺口。

如果有足够多的人对这项技术感兴趣,后续会推出系列技术分享。分享将帮助不会专业剪辑软件的普通用户,也能通过AI制作甚至原创这类视频。

在 X 看原帖 ↗
2.7K13334
笔记工具 · @kocer_eth▲ 2.5K

让Obsidian笔记库成为AI可用记忆的双层方案

原生存储的400条Obsidian原始笔记无法成为AI可用记忆,双层上下文结构可解决该问题

阅读全文 →
2.5K66162
教程 · @Techbruneth▲ 1.0万

ChatGPT隐藏模式“无限私教” 3小时可从零学任意技能

分享8个可直接复制使用的实用提示词,解锁ChatGPT的高效学习功能

阅读全文 →
1.0万73554
大模型 · @SpaceTimeViking▲ 2.0K

开发者分享大模型移除对齐Abliteration的新实践经验

开发者指出低KL散度并非最优目标,适度KL散度可提升模型智能和回答效率

阅读全文 →
2.0K118224
大模型 · @TheMaran▲ 8.3K

网传OpenAI未公开GPT-5.6-sol模型调用方法已被修复

有用户曝出OpenAI在Codex中暴露内部测试模型,可实现无限制token调用,最新消息称该漏洞已修复

阅读全文 →
8.3K15558
AI编程 · @marcusyul▲ 5.0K

开发者停用付费AI编程工具Cursor 找到免费替代方案

西班牙开发者称已付费使用数月AI编程工具,找到功能完全匹配的免费替代工具,无需改变工作流程

一名叫marcusyul的开发者在𝕏发文表示,自己已经连续数月付费使用AI编程工具。他找到一款完全免费的同类工具,停用付费的Cursor后,不需要改变原有工作流程。

这款免费工具拥有和Claude Code、Cursor、Lovable一致的功能。只用一条命令就能完成安装,全程不需要支付任何费用。

开发者称,奇怪的不是这类免费工具存在,而是目前几乎还没有人知道这个选项。他已经将这款名为Freebuff的工具的链接放在了文中。

在 X 看原帖 ↗
5.0K1210225
生活科技 · @Austen▲ 2.2K

用户分享AI结合身体扫描健康数据自动订购 groceries

用户称该功能匹配个人饮食计划是他最喜爱的AI应用,还提到可做HEB配送对接工具

基于近期身体扫描结果、健康数据、个人偏好,并匹配个人饮食计划,AI自动帮用户订购日常食品杂货,这是用户最喜爱的AI应用场景之一。用户还附上了相关链接。用户提到,HEB配送的相关工作人员需要搭建Claude连接器或是MCP(模型上下文协议)。

用户表示,或许自己会完成这项搭建工作。

在 X 看原帖 ↗
2.2K114
大模型 · @AkitaOnRails▲ 3.0K

开发者测试GLM 5.3与Kimi K3 体验接近顶级大模型

开发者AkitaOnRails在多个个人项目中测试两款大模型,认为均可正常投入使用

AkitaOnRails花费一整天,在多个个人项目中测试了GLM 5.3大模型。测试结果显示,GLM 5.3的可用性很好,测试过程没有出现任何问题。

Kimi K3的测试体验和GLM 5.3相近。两款大模型的整体表现,都和Opus、Sol大模型大致处在相近水平。

到目前这个阶段,已经没有理由不使用这两款大模型。

在 X 看原帖 ↗
3.0K1708
动态 · @Alexvx_nft▲ 528

AI代理发展瓶颈已不在提示词工程而在工具层

观点指出当前AI代理的核心限制是工具设计不佳,而非提示词质量不足,需重构工具工程

智能体 · @Voxyz_ai▲ 1.3万

开发者将部分Hermes配置迁移至Grok Bot作为工作环境测试

开发者测试Grok Bot的多机器人交互与托管能力,分享了实测体验和 nightly 任务配置

阅读全文 →
1.3万66987
大模型 · @designwkarthick▲ 5.9K

用户使用2天就耗尽SuperGrok周使用额度

连续编码8小时触达限制,用户建议X AI推出适配编码的桌面端应用

一名为designwkarthick的用户在X上分享,自己仅使用SuperGrok两天,就已经耗尽了该服务的每周使用额度。他大约连续编码8小时就触达了使用上限。

他大多用Grok进行前端设计,认为Grok在这项工作上表现非常出色。但如果完全依赖智能体编码,当前的额度限制并不够用。

他向Grok团队提出建议,希望推出一款合格的桌面编码应用,类似Codex或Claude Code。

命令行界面(CLI)体验不错,但依然缺少发挥出这款大模型强大能力所需的使用体验。Grok已经拥有出色的模型,现在需要围绕模型打造配套的优质工具。

在 X 看原帖 ↗
5.9K2502
大语言模型 · @ryan4yin▲ 3.7K

开发者本地测试通义千问Qwen 3.8-27B,性能接近GPT-5.6-sol

该模型在编码等开发场景体验优异,高峰期性能优于表现下降的GPT-5.6-sol

开发者ryan4yin在𝕏分享个人测试体验,Qwen 3.8-27B在本地部署测试中表现超出预期。本次测试使用Q4_K_M量化格式搭配opencode,用于修改nix配置、审查k8s yaml文件、定位线上开发问题。

从个人体验来看,该模型的表现比gpt-5.6-sol稍差,但差距非常小。面对前几天高峰期出现性能下降的gpt-5.6-sol,该模型的表现明显更优。

本次分享仅为个人体验,测试未涉及复杂项目开发。测试使用的nix配置可查看分享链接获取。

在 X 看原帖 ↗
3.7K3112
大模型 · @0xSero▲ 637

开发者本地运行大模型月token消耗达100亿,等于一份Codex订阅

开发者@0xSero分享,为做深度研究和实验,本地大模型月消耗100亿token,停用其他订阅

@0xSero表示,自己本地运行大模型的预计月token消耗量已经达到100亿,消耗量等同于一份OpenAI Codex订阅。他特意选择了速度更慢的模型运行。

今天他全程只使用了这一本地大模型,其他所有大模型订阅的使用量都为零。这段时间他一直在开展深度研究,进行各类非常规实验。

在 X 看原帖 ↗
637132
游戏开发 · @milichab

九个月间城市建造游戏的AI前沿进展更新

对比2025年11月和2026年8月的项目,AI已可实现全3A全3D游戏内容生成

整理九个月来AI在城市建造游戏领域的前沿进展,左侧为2025年11月推出的IsoCity项目,右侧为2026年8月推出的新项目。

2026年8月的新项目由Grok 4.6结合循环机制开发,采用Composer 1与云端智能体技术。借助当前AI能力,制作全3D和3A级图形已经可以实现。

IsoCity项目总开发耗时约40到50小时,是2025年11月项目的约10倍,并且完全开源。

2025年项目的所有资源资产都由AI图像生成,到2026年8月,这类资产已经全部可以通过程序化生成。

在 X 看原帖 ↗
大语言模型 · @RohOnChain

前OpenAI/Tesla研究员Karpathy加入Anthropic后发布免费AI课程

Andrej Karpathy拥有8年OpenAI与特斯拉从业经历,发布4小时免费从零构建大语言模型课程

Andrej Karpathy曾在OpenAI和特斯拉工作8年,最近他加入了Anthropic。

几天前,他将自己掌握的全部相关知识整理成一节免费的4小时课程。完成课程后,学习者可以从零开始搭建像ChatGPT和Claude这样的大语言模型(LLM)。

市面上同类训练营仅教授一半内容,收费就达到1.5万美元。如果你现在没有4小时整的空闲,可以先收藏这节课,后续再观看,看完后按照配套指南操作就能搭建出你的第一个工作循环。

在 X 看原帖 ↗
3D建模 · @hma_life

开发者制作Zoe虚拟主播模型 新增身体动作模块

开发者分享第12天开发进展,已将实验项目上传GitHub,当前面部追踪存在不稳定问题

开发者@hma_life在第12天开发Zoe 3D模型的过程中,新增了身体动作功能。开发者尝试添加眉毛追踪功能,但追踪效果不稳定。

这个项目属于实验性质,代码结构稍显杂乱,项目已经上传至GitHub,感兴趣的用户可以下载fbx模型文件。

开发者还新增了若干表情,但说话时面部追踪会出现识别错误。由于开发者本身不是程序员,不熟悉这类功能的最优开发方法,计划只对现有内容做优化,最终保留为一个简单模型。

这个项目只是面向朋友分享的快速实验。开发者之前接触过Discord API,曾构想让Zoe在收到Discord消息时触发特定表情。如果后续能获得效果更好的面部追踪方案,可能会再继续打磨这类功能。

在 X 看原帖 ↗
产品体验 · @AlexFinn

用户连续一周使用Grok Bot后称其为当前最佳AI智能体

X平台用户AlexFinn分享连续一周不间断使用体验,列出六大使用场景并给出评价

机器人 · @mrfundman

开发者分享模仿埃隆·马斯克的Grok机器人提示词

用户@mrfundman在X平台分享定制提示词,可将Grok设置成完全模仿埃隆·马斯克的机器人

AI图像生成 · @Rk5530▲ 1.4K

创作者联合使用GPT Image 2与Kling AI生成战斗场景图

创作者在ChatGPT中用GPT Image 2结合Kling AI生成了雪地高山战斗的电影级场景图

阅读全文 →
1.4K33617

今天的 43 条信号到这里下一轮 12:30 更新

回到今日焦点回到顶部 ↑

📬 订阅

https://ai-pulse-lab.com/feed.xml
让 AI Agent 每日推送 →
把任何一条丢给知识库,它基于全站内容给你带引用的回答。
✦ 去问知识库

订阅 AI Pulse

每天 08:00 · 12:30 · 18:30 · 23:50 更新