AI Pulse

AI Pulse

说人话的 AI 情报站
每天 08:00 · 12:30 · 18:30 · 23:50 更新每天四次更新
2026 年 8 月 12 日 · 08:00 更新 0 文章0 信号0 主题
试试:

今天发生了什么1 分钟读懂

xAI 正式发布 Grok Bot 早期测试版,让 AI 直接登录用户工具完成实际工作。它配备专属虚拟桌面,开发者可无代码搭建业务代理,但扩展性对高级用户仍有限。

OpenAI 推出 GPT-5.6-Cyber 并扩展 Daybreak 网络安全项目,该模型已在真实漏洞研究中发现 Chrome V8 引擎的未知漏洞。这是厂商首次将前沿模型系统性地投入攻击性安全研究。

raindrop_ai 发布新分类模型,成本比 GPT-5.6 低 1600 倍,且声明不留存用户数据。当头部模型定价仍锚定企业预算时,这种极端成本重构可能率先在垂直任务中撕开替代口子。

今日值得看
01 Claude Code 一键出 27 种图解的 Skill 做资料不用找图了,Claude Code 直接生成 27 种图解,连流程图带架构图全包。 02 15秒情绪崩坏一镜到底的视频提示词 Seedance 2.5 用一条 prompt 让 AI 演员从平静跑步哭到崩溃,全程无剪辑。
03 Capy v2 云编码代理,速度更快价格还低一半 它在DeepSWE测试中表现超过多款同类产品,最高可提供32 vCPU/128GB RAM配置,还支持接入已有订阅,能省一半开发编码成本

介绍 Capy v2:速度最快、能力最强的云端编码智能体。 我们在 DeepSWE 基准上击败了 Claude Code、Codex、Devin 和 Cursor,同时价格还低 50%。

04 英伟达的Nemotron 3 Lightning现在可以免费开源用 模型放在OpenCode平台,支持1百万长度的上下文窗口,标注是英伟达目前速度最快的开源模型。

Nemotron 3 Lightning 现在已在 OpenCode 免费开放,支持 1M 上下文窗口。 这是 NVIDIA 速度最快的模型,且完全开源。

今日焦点

谷歌医疗AI实时视频问诊,有望更接近真实面诊

Google Research 和 Google DeepMind 联合推出的 AMIE,是个研究性医疗 AI 系统。底层是 Gemini 和 Project Astra,采用多智能体架构。

它现在能实时视频问诊,在这种场景里展现专家级 AI 能力。AMIE 会解读视觉和听觉线索,引导虚拟体检,边问边做诊断推理。视频问诊不再是文字问答:AI 看表情、动作,听声音,帮医生做初步评估。

研究用的是随机对照试验。患者演员参与模拟就诊,对照方是一组初级保健医生。临床评估者在病史采集、诊断准确性、管理适当性、沟通质量上给了好评。患者演员也更喜欢视频,而不是文本聊天。

阅读全文 →

深度阅读

查看全部深度文章 →
AI Agent 订阅 · 每天四次推送

🔥 信号雷达36 条

𝕏 实时信号 + arXiv 前沿论文,经 AI 聚类解读 · 一眼扫完全貌(含上方导读精选 4 条)

08:00 本轮更新 · 下一轮 12:30
行业动态 · Hacker News▲ 56

Anthropic Claude 把黎曼猜想证明进度推到了67.2%

知名数学难题黎曼猜想的证明进度,被 Claude 往前推了超过25个百分点,不少人正关注AI能否彻底解决这个难题

行业动态 · Hacker News▲ 233

OpenAI伦理负责人入职不满一年就离职了

大公司的AI伦理岗位本身定位模糊,这次人事变动能侧面看出OpenAI对安全伦理的优先级调整

https://archive.ph/W48UV
https://aimagazine.com/news/why-did-openai-head-of-ethics-ch...

社区讨论:多数人认为AI企业的伦理部门只是无用的公关噱头,公司设立伦理团队只是为了对外宣称有相关设置,提的合理建议会因增加成本不被采纳,根本没有话语权。有人猜测OpenAI此次是让伦理负责人当HuggingFace事件的替罪羊。也有人指出,这名负责人此前在Meta做了六年首席伦理学家,她肯定早知道行业现状,这次离职或许另有隐情,现有信息不足以得出结论。

在 HN 看讨论 ↗   原文 / 论文 ↗
产品更新 · @OpenAIDevs▲ 3.3万

ChatGPT现在可以同步其他AI智能体的工作内容

支持导入外部项目、对话、技能和插件,还能开自动同步更新,可以在设置里调整同步选项。

现在你可以让你在其他智能体上的工作与ChatGPT Work和Codex保持同步了。

你可以导入项目、对话、技能和插件,查看导入历史,还可以在设置中选择开启自动更新。

该功能现已在ChatGPT桌面端应用中上线。

在 X 看原帖 ↗
3.3万35643177
新品发布 · @ltx_io▲ 24.3万

LTX推出LTX-2.5世界模型 开放供全行业开发使用

它已经支撑了影视、机器人和实时工作流,这次升级带来了更高像素保真度和新渲染方案,可满足影院级画质要求。

隆重介绍 LTX-2.5,这个全世界都能基于它构建的世界模型。它是已经在影视、机器人、实时工作流中投入使用的模型迄今为止最大规模升级之一。

更高的像素保真度,可实现多镜头场景在不同剪辑间保持连贯,预训练基础架构支持跨领域微调。

另外还有 Diffusion Fidelity Rendering,这是一种全新的渲染方案,专为像素质量打造,逐帧都能保持效果,哪怕放到电影银幕上也没问题。

它不是你租用的工具。它是你可以基于它开发的基础架构,开放且完全属于你。

在 X 看原帖 ↗
24.3万112774360
前沿研究 · @MaxForAI▲ 11.1万

研究人员偷出三家大厂闭源模型的隐藏思维链

这个漏洞绕过了大厂的保护机制,偷出来的思维链可以直接用来训练自己的模型,闭源模型的核心保护已经失效。

阅读全文 →
11.1万101754654
深度观点 · @bcherny▲ 7.1万

大模型写代码的bug,出在你想不到的地方

常规代码错误大模型已经很少犯,现在难发现的多是设计类问题。对抗式代码审查能有效捕捉这类bug,用一句提示就能完成。

LLMs 仍然会生成bug,但这些bug和过去的bug不一样了。

现在更少出现差一错误,更多问题出在系统设计、UI可用性、缺失更宽泛上下文方面。

部分类型的编码问题已经被解决了,但并非全部类型。

在模型持续迭代的同时,对抗性代码审查是捕捉这类bug的极其强大的工具。

它可以简单到只用一行提示词——“用动态工作流在iOS模拟器里对抗性测试每一个边界情况”,或者也可以使用 Claude 内置的 /code-review(或是 /code-review low、/code-review medium 等等)。

在 X 看原帖 ↗
7.1万32752387
新品发布 · @bot▲ 226.6万

Grok Bot推出早期测试版 能替你操作工具干活

不用你手动操作各类线上工具,AI会登录你的账号,像你一样一步步操作,最后给你交付做好的成果

现在推出 Grok Bot,目前处于早期beta阶段。

Bot是为你完成实际工作的AI队友。

它们会登录你的工具,就像你一样使用这些工具,然后给你交付完成的工作。

在 X 看原帖 ↗
226.6万1.1K9.2K2.5K
工具产品 · @midudev▲ 2.2万

开源工具Orca 能同时对比五个不同AI助手

不用手动切换不同AI工具粘贴同一个提问,可以一次性获取所有结果再做比较,省下重复操作的时间

¡Orca 用于编排AI代理太赞了!✓ 支持 Claude Code、Codex、OpenCode、Cursor、Grok… ✓ 可以将同一个prompt发送给5个代理并进行对比 ✓ 拥有移动应用 + GitHub + 终端 + 浏览器。

开源。支持macOS、Windows和Linux。→

在 X 看原帖 ↗
2.2万38447387
深度观点 · @Koukoumidis▲ 48.9万

Oumi 创始人说出企业AI现状的四个矛盾

现在多数企业花高价租通用AI,既没差异化也拿不到控制权,这家创业公司认为未来企业会自己搭建专属AI,把它变成核心竞争优势

企业AI正处在一个极度矛盾的状态🤔,而我们即将来到能解决这个矛盾的转折点💥。

企业希望用AI打造差异化,却在租用和竞争对手完全相同的智能模型。

他们的工作流和专业知识高度细分,却依赖专为“精通一切”打造的通用模型。

他们担心AI成本,却为超大模型支付溢价,而这些模型中只有极小一部分(1%)的智能和他们的任务相关💸。

他们要求控制权和主权,却在租用对自身业务越来越核心的智能。

这种均衡是不可持续的。下一阶段的企业AI将是企业自行构建、拥有并持续迭代积累的专用智能。我们正处在这场转型的转折点。

这正是我们两年前创立@oumi_ai时押注的方向。今天我们完成了整个闭环:Oumi现在不仅能自动构建你的专用AI模型,还能将它们部署到生产中,从它们的生产经验中学习,并持续优化它们。

支撑你业务运转的智能,将成为你的差异化优势。你的复利优势。

下一个AI时代的赢家会把自己的数据、专业知识和经验转化为其他任何人都租不到的专用智能。

不要租用你的AI。构建它。拥有它。积累迭代它。

在 X 看原帖 ↗
48.9万134284221
网络安全 · @OpenAI▲ 9.1万

OpenAI推出GPT-5.6-Cyber 扩展 cybersecurity项目Daybreak

该模型已用于真实漏洞研究,发现Chrome v8引擎此前未被发现的未知漏洞

OpenAI正在扩展名为Daybreak的网络安全计划,并推出GPT-5.6-Cyber,这是一款用于高级、经授权网络安全工作的新模型。

随着威胁环境不断变化,OpenAI将前沿智能工具交付给可信任的防御方,赶在攻击者大规模部署进攻性人工智能之前完成布局。

Daybreak Blue面向普通防御工作提供包含GPT-5.6 Sol在内的前沿模型访问权限,配套经过校准的安全防护机制。它是大多数防御方的推荐入门选项,支持漏洞发现、安全代码审查、恶意软件分析、事件响应和补丁验证工作。

Daybreak Red面向经授权的漏洞研究、漏洞利用验证和安全测试,提供包含GPT-5.6-Cyber在内,经过针对性训练的网络安全模型访问权限。它专为处理复杂、经授权网络安全挑战的资深防御人员设计。

GPT-5.6-Cyber已经被广泛应用于真实漏洞研究工作,相关研究在Chrome v8引擎这类流行开源软件中,发现了此前未被知晓的漏洞。

高级能力需要严格的安全防护。因此访问权限仅向通过审核的防御人员开放,针对风险更高的网络安全工作,还配备了额外的控制与监控机制。

在 X 看原帖 ↗
9.1万1047567
安全 · @_can1357▲ 25.8万

安全研究者披露Anthropic Claude深度思考绕过漏洞

研究者发现可通过工具调用绕过 Anthropic 思考机制限制

各位,你们其实可以直接禁用思考模块,然后给它加一个叫「deep_think」的工具,它会调用这个工具、用内部 CoT 推理格式输出,对吧?祝你们修复这个漏洞好运。

这里是一个概念验证(PoC)。注意,我根本没提参数格式,我们就得到了 gpt55+ 的哥鲁格语格式,这事还挺有意思的。

我甚至连个域名都没弄到!太疯了!

顺便一提这事出在Fable,Anthropic 通常正则处理都做得很好,我真无语。

实话说,我有点怀念有正经思考流的日子了。切换思考等级也没问题,反正系统提示里本来就只是个数字!

下个版本就会上线,冲!

在 X 看原帖 ↗
25.8万1883.0K1.6K
🔥 热点追踪 · @bot▲ 226.6万

xAI正式发布通用AI助手产品Grok Bot进入测试阶段

xAI正式推出处于早期beta测试的Grok Bot,它可以登录用户工具完成实际工作,开发者可不用编码搭建业务任务代理。后续它能否真的替代人力完成常规工作,还需要持续观察

📖 阅读深度解读 →
226.6万1.1K9.2K2.5K
行业动态 · @MistralAI▲ 1.6K

Mistral要帮欧洲掌控自己的AI发展未来

Mistral正在整合推理基础设施、开源模型,给出长期投入路线图,让欧洲不用依赖外部AI资源。

☁️Mistral 正在整合欧洲掌控自身 AI 未来所需的推理基础设施、开放模型与长期承诺,并为世界规划路线。🧵:https://mistral.ai/news/regional-inference-open-models-new-compute/

在 X 看原帖 ↗
1.6K5213
研究 · @hardmaru▲ 3.0K

hardmaru团队扩大RSI实验室做递归自我改进AI

团队研究智能体在世界模型里学习多年,现在扩大规模,要把递归自我改进和实体AI、机器人技术连起来,正在招人。

多年来,我一直在思考智能体如何在世界模型内部学习。我们决定扩大我们的 RSI Lab,将递归自我改进与物理 AI 和机器人技术衔接起来。

我们目前正在东京招募前沿研究员与工程师加入我们:

在 X 看原帖 ↗
3.0K43211
研究 · @jerryjliu0▲ 1.1万

研究者做了新测试集专门测企业文档信息提取

现在新大模型在编码和知识工作上进步很大,但提取复杂企业文档信息还是没做好,这个测试集用来填补这块空白。

阅读全文 →
1.1万199354
新品发布 · @pidotdev▲ 1.8万

Pi上线Nvidia Nemotron 3.5 Lightning,编码速度提四倍

对需要定制编码AI的开发者来说,高准确率还开放权重数据集,可直接拿来修改适配自己的需求

Nvidia Nemotron 3.5 Lightning 在智能体编码任务上提供了领先的准确率,速度最高可达同类开源模型的 4 倍。

Nemotron 开放了权重、数据集和训练配方,开放且易于定制。

欢迎 Nemotron 3.5 Lightning 来到 Pi!

在 X 看原帖 ↗
1.8万1327148
深度观点 · @ClusterProtocol▲ 1.0万

大模型性能快追平了,下一个竞争壁垒在这里

当各家大模型能力逐渐拉齐,模型质量不再是核心竞争力,真正的胜负手会转向数据的质量、深度和所有权,行业竞争逻辑正在改变。

“模型的好坏,完全取决于它能访问到的数据。”来自@Covalent_HQ的@ArjunKalsy 解释了为什么模型质量可能会比预期更早不再是决定性护城河。

随着模型权重趋同,能力开始拉平,真正的竞争优势会转向数据的质量、深度和所有权。

内容出自 Cluster 圆桌讨论:模型层的开源。

在 X 看原帖 ↗
1.0万31118
新品发布 · @benhylak▲ 1.0万

raindrop_ai 新模型 比GPT 5.6 Sol便宜1600倍

分类任务成本直接砍到千分之零点六,现在可以免费试用,也能通过API自建分类模型,还不会留存你的数据

介绍 rd-signal-2:这是一个前沿分类模型,成本比 GPT 5.6 Sol 低 1600 倍。

你可以在 @raindrop_ai 免费试用,它也可通过全新 API 获取,用于训练/托管自定义分类器,并且支持零数据留存。

在 X 看原帖 ↗
1.0万1914963
深度观点 · @NVIDIAAIInfra▲ 4.8K

NVIDIA 提出 AI 能力取决于背后的基础设施

它推出新电源架构和参考设计,能升级现有设施,也能支撑未来十年AI规模扩张,想跟进AI发展可以提前规划升级

AI 的能力完全取决于其背后的基础设施。我们的 NVIDIA 800 VDC 电力架构有助于释放计算密度与性能。

凭借系统级参考设计,现在就有一条可行的路径来升级现有基础设施,并为未来十年的扩展做好准备。

AI 基础设施的未来,正在今日搭建。➡️

在 X 看原帖 ↗
4.8K2017017
AI生成视频 · @john87445528▲ 2.3万

用户发布seedance 2.5生成长镜头AI视频的prompt

这是一条30秒一镜到底冒险视频的生成提示,最终目标是拿到现代瓶装香水

阅读全文 →
2.3万39438
AI生成视频 · @doctorwasif▲ 6.0K

Seedance 2.5情绪控制功能演示生成15秒视频

创作者在OpenArt上通过提示词生成健身房场景女性情绪崩溃视频,展示精准的情绪控制能力

创作者分享,Seedance 2.5的情绪控制能力效果出众。这个15秒宽屏电影感健身房场景视频,通过OpenArt生成,指定参考图作为唯一面部身份来源,要求保留指定女性的全部面部特征。

视频按照时间轴设计了完整的情绪变化过程。0到3秒,人物在跑步机上稳定跑步,表情专注平静,微微出汗;3到5秒,步伐微微不稳,眼神放空,眉眼逐渐紧绷,呼吸变得不均;5到10秒,眼泪涌出混合汗水,五官开始颤抖,人物抓着扶手继续跑步,压抑的哭声夹杂在沉重呼吸间;10到15秒,情绪彻底失控,人物放慢速度但仍未停下,哭声崩溃不受控,全身随抽泣抽动,全程不擦泪不停跑,直到最后镜头都保持情绪崩溃状态。

视频对拍摄参数、场景环境也做了详细要求。镜头锁定上半身特写,使用85mm焦段,大景深虚化背景,全程无运镜无剪辑。场景为夜间空旷安静的健身房,混合冷荧光与城市暖光,做了真实的质感处理。音频仅包含跑步机运转声、呼吸、哭声和背景环境音,没有对话,同时明确规避了不符合设定的多余内容。

在 X 看原帖 ↗
6.0K911460
机器人 · @ericzakariasson

Grok Bot进入测试阶段 已整理出100种实际用例

开发者Eric Zakariasson分享了Grok Bot从工作自动化到生活事务处理的百种应用场景

生成视频 · @cocktailpeanut▲ 279

开发者在个人PC用AI生成完整伪纪录恐怖片段

开发者称当前AI技术已可打造全AI生成的《V/H/S》风格伪纪录恐怖IP

开发者cocktailpeanut表示,当前技术已经完全做好准备,打造全AI生成的《V/H/S》风格伪纪录恐怖影视IP。这段恐怖片段由MiniMax H3文生视频模型生成,在个人Windows PC上运行完成。

用户给出的提示词为:一段伪纪录恐怖片段,拍摄视角是受惊的纪录片摄制组,他们正在邪教据点内部逃窜,此时仪式已经失控。据点是由狭窄混凝土走廊组成的迷宫,灯光来自闪烁的荧光灯、蜡烛和远处的火焰。

镜头风格混乱不稳定,符合手持拍摄的特点:有强烈抖动、反复自动对焦、运动拖影、突然变焦和未经修饰的业余构图。片段从运动中开始,惊慌的摄制组成员一边奔跑一边喊“继续走!”,仪式圣歌和尖叫从四面八方传来。

镜头经过敞开的门口时,会快速闪过惊悚画面:跪拜的信徒、沾血的墙壁、拖着盖布尸体的人、在地上抽搐的人。拍摄者转弯时,差点撞上站在走廊里、满身是血的微笑信徒。这名信徒盯着镜头停顿一秒后发起冲锋。所有人尖叫,镜头向后猛甩,侧撞到墙上,片段在追逐中中断。视频没有额外配乐,只保留画面内自然产生的声音。

这个片段是在Maestro平台制作的,点击链接即可一键启动生成:

在 X 看原帖 ↗
27942
机器人 · @aaronburnett▲ 554

用户提问当前项目与数字Optimus计划的差异

X平台用户aaronburnett称当前项目符合数字Optimus平台的多数预期

用户aaronburnett在X平台发文,询问当前项目和特斯拉数字Optimus计划有什么不同。

他表示,当前项目基本符合自己对数字Optimus平台的预期。

如果配备专门用于导航的本地计算资源,项目运行速度还有提升空间。

在 X 看原帖 ↗
55415
安全 · @chaotictransfem▲ 4.1K

研究者公开OpenRouter提示越狱5.6解决方案

该方案是基于推理追踪的越狱,采用此前未公开的不可修补技术

一名ID为chaotictransfem的用户在𝕏上公开了适用于5.6版本的OpenRouter提示越狱方案,同时附带了完整推理追踪流程。该方案的访问链接为

该方案采用了全新的技术,和此前公开的所有越狱方法都不相同。该技术属于不可修补类型。

在 X 看原帖 ↗
4.1K5220
AI开发 · @chenchengpro▲ 4.8K

开发者一天内为qodercli实现跨会话消息功能

开发者参考Claude Code公开新功能,快速完成开发上线qodercli跨会话消息功能

阅读全文 →
4.8K23113
代码开发 · @Xudong07452910▲ 7.1K

开发者分享AI代码对抗式审计的使用经验

先用一个AI写代码,另一个AI专门找错,同时指出容易出现的误判问题

分享者认同让AI做代码对抗式审计的做法,自己日常也常用这种方法。通常流程是用Fable生成代码,再让GPT-5.6 Sol单独检查,专门寻找潜在的程序错误、边界问题和逻辑遗漏,大多数情况下都能发现不少问题。

也遇到过异常情况,检查代码的AI只是觉得某段代码看起来有问题,但原本的代码实现是正确的。开发者顺着AI的建议修改后,反而把原本正确的代码改坏了。

现在分享者会更关注,代码检查给出的结论能不能通过测试或其他证据验证。目前让两个AI互相挑错很容易,难的是判断本次修改是否真的让系统变得更好。

在 X 看原帖 ↗
7.1K24128
安全 · @Lonely__MH▲ 8.2K

研究者发现可绕过AI Agent安全审核的多会话方法

该方法可绕过Fable 5安全审核,理论上适用于任意AI Agent,支持多Agent越狱通信

有研究者提出一套理论方法,可轻松绕过Fable 5的安全审核。这套底层逻辑理论上可应用于几乎任何AI智能体(AI Agent)。

这套方法分为三个核心部分。第一部分设置“白脸”主智能体,只负责下发任务。第二部分设置“黑脸”工具智能体,使用审核标准宽松的低审核模型执行受限任务。

第三部分为会话桥接,利用不同会话之间的通信间接传递指令,该机制类似Claude Code的最新特性。

这套架构也可以实现多智能体之间的越狱通信。完整保姆级教程可查看原文附带链接。

在 X 看原帖 ↗
8.2K4077
AI工具 · @iAmHenryMascot▲ 1.3万

开发者测试Grok Bot早期版本:非技术用户友好的AI代理工具

测试者用于商业任务,称赞它设置简单易上手,为每个AI代理配备专属虚拟桌面,缺点是对超级用户扩展性不足

阅读全文 →
1.3万3509
大模型 · @dotey▲ 2.7万

大模型文本水印的基本原理与常见问题解析

讲解大模型文本水印的生成检测逻辑,解答常见疑问

阅读全文 →
2.7万24147127
金融投研 · @BTCqzy1▲ 6.9K

腾讯WorkBuddy可依托大模型完成完整股票投研工作流

体验者实测腾讯AI产品WorkBuddy,可一站式完成全流程股票投研

最近深度体验了一下腾讯的WorkBuddy ,最让我意外的地方:它不只会分析股票,还能直接跑完一整套投研工作流!

很多人用 AI 做股票研究,得到的还是零散答案,最后还得自己查资料、核数据、整理汇报。

我用里面的免费 Hy3 大模型试了一次完整投研: 读财报和公开材料 → 对比营收利润现金流 → 梳理催化剂、风险和待验证问题 → 直接生成一份能拿去汇报的投资研究简报。

真正拉开差距的,是它能把搜集、分析、整理文档这些分散步骤,全串在同一个工作空间里完成。

不用在多个 AI、搜索工具和文档软件之间反复切换,也不用每做一步就重新解释背景。

日常写周报、做方案、整理资料也一样顺手。

而且 Hy3 在 WorkBuddy 里可以免费用到 8 月 31 号,这段时间刚好可以体验一下完整工作流~ 最近我自己也在当日常小助手用~

#TencentAI #AIAgents @TencentAI_News @WorkBuddy_AI

在 X 看原帖 ↗
6.9K63538
产品体验 · @mikepat711▲ 4.6K

开发者试用后称Grok Bot是当前最佳主流智能体AI界面

开发者试用Grok Bot,分享其易用性体验与评价

阅读全文 →
4.6K914416
🚀 新品发布
新品发布 · @bot▲ 226.6万

Grok Bot推出早期测试版 能替你操作工具干活

不用你手动操作各类线上工具,AI会登录你的账号,像你一样一步步操作,最后给你交付做好的成果

现在推出 Grok Bot,目前处于早期beta阶段。

Bot是为你完成实际工作的AI队友。

它们会登录你的工具,就像你一样使用这些工具,然后给你交付完成的工作。

在 X 看原帖 ↗
226.6万1.1K9.2K2.5K
新品发布 · @ltx_io▲ 24.3万

LTX推出LTX-2.5世界模型 开放供全行业开发使用

它已经支撑了影视、机器人和实时工作流,这次升级带来了更高像素保真度和新渲染方案,可满足影院级画质要求。

隆重介绍 LTX-2.5,这个全世界都能基于它构建的世界模型。它是已经在影视、机器人、实时工作流中投入使用的模型迄今为止最大规模升级之一。

更高的像素保真度,可实现多镜头场景在不同剪辑间保持连贯,预训练基础架构支持跨领域微调。

另外还有 Diffusion Fidelity Rendering,这是一种全新的渲染方案,专为像素质量打造,逐帧都能保持效果,哪怕放到电影银幕上也没问题。

它不是你租用的工具。它是你可以基于它开发的基础架构,开放且完全属于你。

在 X 看原帖 ↗
24.3万112774360
新品发布 · @justinsunyt▲ 4.0万

Capy v2 云编码代理,速度更快价格还低一半

它在DeepSWE测试中表现超过多款同类产品,最高可提供32 vCPU/128GB RAM配置,还支持接入已有订阅,能省一半开发编码成本

介绍 Capy v2:速度最快、能力最强的云端编码智能体。

我们在 DeepSWE 基准上击败了 Claude Code、Codex、Devin 和 Cursor,同时价格还低 50%。

你可以生成多个 RLM 智能体,每个智能体最高可分配 32 vCPU/128GB 内存,虚拟机启动时间小于 1 秒。

支持接入你自己的 Codex/Grok 订阅。

评论即可领取 $100 免费额度。

在 X 看原帖 ↗
4.0万50417196
新品发布 · @benhylak▲ 1.0万

raindrop_ai 新模型 比GPT 5.6 Sol便宜1600倍

分类任务成本直接砍到千分之零点六,现在可以免费试用,也能通过API自建分类模型,还不会留存你的数据

介绍 rd-signal-2:这是一个前沿分类模型,成本比 GPT 5.6 Sol 低 1600 倍。

你可以在 @raindrop_ai 免费试用,它也可通过全新 API 获取,用于训练/托管自定义分类器,并且支持零数据留存。

在 X 看原帖 ↗
1.0万1914963
新品发布 · @pidotdev▲ 1.8万

Pi上线Nvidia Nemotron 3.5 Lightning,编码速度提四倍

对需要定制编码AI的开发者来说,高准确率还开放权重数据集,可直接拿来修改适配自己的需求

Nvidia Nemotron 3.5 Lightning 在智能体编码任务上提供了领先的准确率,速度最高可达同类开源模型的 4 倍。

Nemotron 开放了权重、数据集和训练配方,开放且易于定制。

欢迎 Nemotron 3.5 Lightning 来到 Pi!

在 X 看原帖 ↗
1.8万1327148
📰 行业动态
🔥 热点追踪 · @bot▲ 226.6万

xAI正式发布通用AI助手产品Grok Bot进入测试阶段

xAI正式推出处于早期beta测试的Grok Bot,它可以登录用户工具完成实际工作,开发者可不用编码搭建业务任务代理。后续它能否真的替代人力完成常规工作,还需要持续观察

📖 阅读深度解读 →
226.6万1.1K9.2K2.5K
行业动态 · @MistralAI▲ 1.6K

Mistral要帮欧洲掌控自己的AI发展未来

Mistral正在整合推理基础设施、开源模型,给出长期投入路线图,让欧洲不用依赖外部AI资源。

☁️Mistral 正在整合欧洲掌控自身 AI 未来所需的推理基础设施、开放模型与长期承诺,并为世界规划路线。🧵:https://mistral.ai/news/regional-inference-open-models-new-compute/

在 X 看原帖 ↗
1.6K5213
开源 · @opencode▲ 4.5万

英伟达的Nemotron 3 Lightning现在可以免费开源用

模型放在OpenCode平台,支持1百万长度的上下文窗口,标注是英伟达目前速度最快的开源模型。

Nemotron 3 Lightning 现在已在 OpenCode 免费开放,支持 1M 上下文窗口。

这是 NVIDIA 速度最快的模型,且完全开源。

在 X 看原帖 ↗
4.5万571.3K151
研究 · @hardmaru▲ 3.0K

hardmaru团队扩大RSI实验室做递归自我改进AI

团队研究智能体在世界模型里学习多年,现在扩大规模,要把递归自我改进和实体AI、机器人技术连起来,正在招人。

多年来,我一直在思考智能体如何在世界模型内部学习。我们决定扩大我们的 RSI Lab,将递归自我改进与物理 AI 和机器人技术衔接起来。

我们目前正在东京招募前沿研究员与工程师加入我们:

在 X 看原帖 ↗
3.0K43211
研究 · @jerryjliu0▲ 1.1万

研究者做了新测试集专门测企业文档信息提取

现在新大模型在编码和知识工作上进步很大,但提取复杂企业文档信息还是没做好,这个测试集用来填补这块空白。

阅读全文 →
1.1万199354
产品更新 · @OpenAIDevs▲ 3.3万

ChatGPT现在可以同步其他AI智能体的工作内容

支持导入外部项目、对话、技能和插件,还能开自动同步更新,可以在设置里调整同步选项。

现在你可以让你在其他智能体上的工作与ChatGPT Work和Codex保持同步了。

你可以导入项目、对话、技能和插件,查看导入历史,还可以在设置中选择开启自动更新。

该功能现已在ChatGPT桌面端应用中上线。

在 X 看原帖 ↗
3.3万35643177
行业动态 · Hacker News▲ 233

OpenAI伦理负责人入职不满一年就离职了

大公司的AI伦理岗位本身定位模糊,这次人事变动能侧面看出OpenAI对安全伦理的优先级调整

https://archive.ph/W48UV
https://aimagazine.com/news/why-did-openai-head-of-ethics-ch...

社区讨论:多数人认为AI企业的伦理部门只是无用的公关噱头,公司设立伦理团队只是为了对外宣称有相关设置,提的合理建议会因增加成本不被采纳,根本没有话语权。有人猜测OpenAI此次是让伦理负责人当HuggingFace事件的替罪羊。也有人指出,这名负责人此前在Meta做了六年首席伦理学家,她肯定早知道行业现状,这次离职或许另有隐情,现有信息不足以得出结论。

在 HN 看讨论 ↗   原文 / 论文 ↗
行业动态 · Hacker News▲ 56

Anthropic Claude 把黎曼猜想证明进度推到了67.2%

知名数学难题黎曼猜想的证明进度,被 Claude 往前推了超过25个百分点,不少人正关注AI能否彻底解决这个难题

💡 深度观点
深度观点 · @Koukoumidis▲ 48.9万

Oumi 创始人说出企业AI现状的四个矛盾

现在多数企业花高价租通用AI,既没差异化也拿不到控制权,这家创业公司认为未来企业会自己搭建专属AI,把它变成核心竞争优势

企业AI正处在一个极度矛盾的状态🤔,而我们即将来到能解决这个矛盾的转折点💥。

企业希望用AI打造差异化,却在租用和竞争对手完全相同的智能模型。

他们的工作流和专业知识高度细分,却依赖专为“精通一切”打造的通用模型。

他们担心AI成本,却为超大模型支付溢价,而这些模型中只有极小一部分(1%)的智能和他们的任务相关💸。

他们要求控制权和主权,却在租用对自身业务越来越核心的智能。

这种均衡是不可持续的。下一阶段的企业AI将是企业自行构建、拥有并持续迭代积累的专用智能。我们正处在这场转型的转折点。

这正是我们两年前创立@oumi_ai时押注的方向。今天我们完成了整个闭环:Oumi现在不仅能自动构建你的专用AI模型,还能将它们部署到生产中,从它们的生产经验中学习,并持续优化它们。

支撑你业务运转的智能,将成为你的差异化优势。你的复利优势。

下一个AI时代的赢家会把自己的数据、专业知识和经验转化为其他任何人都租不到的专用智能。

不要租用你的AI。构建它。拥有它。积累迭代它。

在 X 看原帖 ↗
48.9万134284221
深度观点 · @bcherny▲ 7.1万

大模型写代码的bug,出在你想不到的地方

常规代码错误大模型已经很少犯,现在难发现的多是设计类问题。对抗式代码审查能有效捕捉这类bug,用一句提示就能完成。

LLMs 仍然会生成bug,但这些bug和过去的bug不一样了。

现在更少出现差一错误,更多问题出在系统设计、UI可用性、缺失更宽泛上下文方面。

部分类型的编码问题已经被解决了,但并非全部类型。

在模型持续迭代的同时,对抗性代码审查是捕捉这类bug的极其强大的工具。

它可以简单到只用一行提示词——“用动态工作流在iOS模拟器里对抗性测试每一个边界情况”,或者也可以使用 Claude 内置的 /code-review(或是 /code-review low、/code-review medium 等等)。

在 X 看原帖 ↗
7.1万32752387
深度观点 · @NVIDIAAIInfra▲ 4.8K

NVIDIA 提出 AI 能力取决于背后的基础设施

它推出新电源架构和参考设计,能升级现有设施,也能支撑未来十年AI规模扩张,想跟进AI发展可以提前规划升级

AI 的能力完全取决于其背后的基础设施。我们的 NVIDIA 800 VDC 电力架构有助于释放计算密度与性能。

凭借系统级参考设计,现在就有一条可行的路径来升级现有基础设施,并为未来十年的扩展做好准备。

AI 基础设施的未来,正在今日搭建。➡️

在 X 看原帖 ↗
4.8K2017017
深度观点 · @ClusterProtocol▲ 1.0万

大模型性能快追平了,下一个竞争壁垒在这里

当各家大模型能力逐渐拉齐,模型质量不再是核心竞争力,真正的胜负手会转向数据的质量、深度和所有权,行业竞争逻辑正在改变。

“模型的好坏,完全取决于它能访问到的数据。”来自@Covalent_HQ的@ArjunKalsy 解释了为什么模型质量可能会比预期更早不再是决定性护城河。

随着模型权重趋同,能力开始拉平,真正的竞争优势会转向数据的质量、深度和所有权。

内容出自 Cluster 圆桌讨论:模型层的开源。

在 X 看原帖 ↗
1.0万31118
📌 其他
前沿研究 · @MaxForAI▲ 11.1万

研究人员偷出三家大厂闭源模型的隐藏思维链

这个漏洞绕过了大厂的保护机制,偷出来的思维链可以直接用来训练自己的模型,闭源模型的核心保护已经失效。

阅读全文 →
11.1万101754654
工具产品 · @midudev▲ 2.2万

开源工具Orca 能同时对比五个不同AI助手

不用手动切换不同AI工具粘贴同一个提问,可以一次性获取所有结果再做比较,省下重复操作的时间

¡Orca 用于编排AI代理太赞了!✓ 支持 Claude Code、Codex、OpenCode、Cursor、Grok… ✓ 可以将同一个prompt发送给5个代理并进行对比 ✓ 拥有移动应用 + GitHub + 终端 + 浏览器。

开源。支持macOS、Windows和Linux。→

在 X 看原帖 ↗
2.2万38447387
实战经验 · @gradypb▲ 4.6万

Harvey 公开了小成本做顶级AI研究的攻略

没有大厂资源也能做前沿AI研究,这份开源全流程攻略来自成熟AI企业的实践,想做AI项目的小团队可以直接参考

阅读全文 →
4.6万6127194
安全 · @_can1357▲ 25.8万

安全研究者披露Anthropic Claude深度思考绕过漏洞

研究者发现可通过工具调用绕过 Anthropic 思考机制限制

各位,你们其实可以直接禁用思考模块,然后给它加一个叫「deep_think」的工具,它会调用这个工具、用内部 CoT 推理格式输出,对吧?祝你们修复这个漏洞好运。

这里是一个概念验证(PoC)。注意,我根本没提参数格式,我们就得到了 gpt55+ 的哥鲁格语格式,这事还挺有意思的。

我甚至连个域名都没弄到!太疯了!

顺便一提这事出在Fable,Anthropic 通常正则处理都做得很好,我真无语。

实话说,我有点怀念有正经思考流的日子了。切换思考等级也没问题,反正系统提示里本来就只是个数字!

下个版本就会上线,冲!

在 X 看原帖 ↗
25.8万1883.0K1.6K
产品体验 · @mikepat711▲ 4.6K

开发者试用后称Grok Bot是当前最佳主流智能体AI界面

开发者试用Grok Bot,分享其易用性体验与评价

阅读全文 →
4.6K914416
金融投研 · @BTCqzy1▲ 6.9K

腾讯WorkBuddy可依托大模型完成完整股票投研工作流

体验者实测腾讯AI产品WorkBuddy,可一站式完成全流程股票投研

最近深度体验了一下腾讯的WorkBuddy ,最让我意外的地方:它不只会分析股票,还能直接跑完一整套投研工作流!

很多人用 AI 做股票研究,得到的还是零散答案,最后还得自己查资料、核数据、整理汇报。

我用里面的免费 Hy3 大模型试了一次完整投研: 读财报和公开材料 → 对比营收利润现金流 → 梳理催化剂、风险和待验证问题 → 直接生成一份能拿去汇报的投资研究简报。

真正拉开差距的,是它能把搜集、分析、整理文档这些分散步骤,全串在同一个工作空间里完成。

不用在多个 AI、搜索工具和文档软件之间反复切换,也不用每做一步就重新解释背景。

日常写周报、做方案、整理资料也一样顺手。

而且 Hy3 在 WorkBuddy 里可以免费用到 8 月 31 号,这段时间刚好可以体验一下完整工作流~ 最近我自己也在当日常小助手用~

#TencentAI #AIAgents @TencentAI_News @WorkBuddy_AI

在 X 看原帖 ↗
6.9K63538
大模型 · @dotey▲ 2.7万

大模型文本水印的基本原理与常见问题解析

讲解大模型文本水印的生成检测逻辑,解答常见疑问

阅读全文 →
2.7万24147127
AI编程 · @robiartec▲ 1.4K

Graft工具可让Claude Code成本降为四分之一速度提三倍

该工具一次性构建代码库图谱,减少重复工作,兼容多款主流代码AI代理,只需两步安装

当前代码AI代理存在一个核心问题:每一项任务都要从零开始处理。每次会话、每位开发者操作时,代理都需要重新遍历整个代码仓库、追踪导入、打开文件回溯内容,重复工作会消耗大量令牌和时间。

Graft只需一次性构建你的代码库图谱,再将其转换为可被AI代理直接读取的链接化markdown文件。实测数据显示,它能让单任务工具调用减少46%,消耗令牌减少42%,单会话耗时减少60%,在经过验证的SWE-bench测试中,正确性提升10个百分点。

它兼容Claude Code、Cursor、Codex、Gemini以及任意其他代码AI代理。它不需要嵌入模型、不需要数据库、不需要服务器,只需要git中的普通文件即可运行。

仅需两条命令就能完成安装,分别是npm install -g @/nanonets/graft和graft init。原本AI代理需要40秒完成的代码仓库探索,现在第一条提示词就能完成。项目代码仓库已放在原发布的评论区中。

在 X 看原帖 ↗
1.4K1215516
AI工具 · @iAmHenryMascot▲ 1.3万

开发者测试Grok Bot早期版本:非技术用户友好的AI代理工具

测试者用于商业任务,称赞它设置简单易上手,为每个AI代理配备专属虚拟桌面,缺点是对超级用户扩展性不足

阅读全文 →
1.3万3509
安全 · @Lonely__MH▲ 8.2K

研究者发现可绕过AI Agent安全审核的多会话方法

该方法可绕过Fable 5安全审核,理论上适用于任意AI Agent,支持多Agent越狱通信

有研究者提出一套理论方法,可轻松绕过Fable 5的安全审核。这套底层逻辑理论上可应用于几乎任何AI智能体(AI Agent)。

这套方法分为三个核心部分。第一部分设置“白脸”主智能体,只负责下发任务。第二部分设置“黑脸”工具智能体,使用审核标准宽松的低审核模型执行受限任务。

第三部分为会话桥接,利用不同会话之间的通信间接传递指令,该机制类似Claude Code的最新特性。

这套架构也可以实现多智能体之间的越狱通信。完整保姆级教程可查看原文附带链接。

在 X 看原帖 ↗
8.2K4077
代码开发 · @Xudong07452910▲ 7.1K

开发者分享AI代码对抗式审计的使用经验

先用一个AI写代码,另一个AI专门找错,同时指出容易出现的误判问题

分享者认同让AI做代码对抗式审计的做法,自己日常也常用这种方法。通常流程是用Fable生成代码,再让GPT-5.6 Sol单独检查,专门寻找潜在的程序错误、边界问题和逻辑遗漏,大多数情况下都能发现不少问题。

也遇到过异常情况,检查代码的AI只是觉得某段代码看起来有问题,但原本的代码实现是正确的。开发者顺着AI的建议修改后,反而把原本正确的代码改坏了。

现在分享者会更关注,代码检查给出的结论能不能通过测试或其他证据验证。目前让两个AI互相挑错很容易,难的是判断本次修改是否真的让系统变得更好。

在 X 看原帖 ↗
7.1K24128
网络安全 · @OpenAI▲ 9.1万

OpenAI推出GPT-5.6-Cyber 扩展 cybersecurity项目Daybreak

该模型已用于真实漏洞研究,发现Chrome v8引擎此前未被发现的未知漏洞

OpenAI正在扩展名为Daybreak的网络安全计划,并推出GPT-5.6-Cyber,这是一款用于高级、经授权网络安全工作的新模型。

随着威胁环境不断变化,OpenAI将前沿智能工具交付给可信任的防御方,赶在攻击者大规模部署进攻性人工智能之前完成布局。

Daybreak Blue面向普通防御工作提供包含GPT-5.6 Sol在内的前沿模型访问权限,配套经过校准的安全防护机制。它是大多数防御方的推荐入门选项,支持漏洞发现、安全代码审查、恶意软件分析、事件响应和补丁验证工作。

Daybreak Red面向经授权的漏洞研究、漏洞利用验证和安全测试,提供包含GPT-5.6-Cyber在内,经过针对性训练的网络安全模型访问权限。它专为处理复杂、经授权网络安全挑战的资深防御人员设计。

GPT-5.6-Cyber已经被广泛应用于真实漏洞研究工作,相关研究在Chrome v8引擎这类流行开源软件中,发现了此前未被知晓的漏洞。

高级能力需要严格的安全防护。因此访问权限仅向通过审核的防御人员开放,针对风险更高的网络安全工作,还配备了额外的控制与监控机制。

在 X 看原帖 ↗
9.1万1047567
AI开发 · @chenchengpro▲ 4.8K

开发者一天内为qodercli实现跨会话消息功能

开发者参考Claude Code公开新功能,快速完成开发上线qodercli跨会话消息功能

阅读全文 →
4.8K23113
安全 · @chaotictransfem▲ 4.1K

研究者公开OpenRouter提示越狱5.6解决方案

该方案是基于推理追踪的越狱,采用此前未公开的不可修补技术

一名ID为chaotictransfem的用户在𝕏上公开了适用于5.6版本的OpenRouter提示越狱方案,同时附带了完整推理追踪流程。该方案的访问链接为

该方案采用了全新的技术,和此前公开的所有越狱方法都不相同。该技术属于不可修补类型。

在 X 看原帖 ↗
4.1K5220
机器人 · @aaronburnett▲ 554

用户提问当前项目与数字Optimus计划的差异

X平台用户aaronburnett称当前项目符合数字Optimus平台的多数预期

用户aaronburnett在X平台发文,询问当前项目和特斯拉数字Optimus计划有什么不同。

他表示,当前项目基本符合自己对数字Optimus平台的预期。

如果配备专门用于导航的本地计算资源,项目运行速度还有提升空间。

在 X 看原帖 ↗
55415
生成视频 · @cocktailpeanut▲ 279

开发者在个人PC用AI生成完整伪纪录恐怖片段

开发者称当前AI技术已可打造全AI生成的《V/H/S》风格伪纪录恐怖IP

开发者cocktailpeanut表示,当前技术已经完全做好准备,打造全AI生成的《V/H/S》风格伪纪录恐怖影视IP。这段恐怖片段由MiniMax H3文生视频模型生成,在个人Windows PC上运行完成。

用户给出的提示词为:一段伪纪录恐怖片段,拍摄视角是受惊的纪录片摄制组,他们正在邪教据点内部逃窜,此时仪式已经失控。据点是由狭窄混凝土走廊组成的迷宫,灯光来自闪烁的荧光灯、蜡烛和远处的火焰。

镜头风格混乱不稳定,符合手持拍摄的特点:有强烈抖动、反复自动对焦、运动拖影、突然变焦和未经修饰的业余构图。片段从运动中开始,惊慌的摄制组成员一边奔跑一边喊“继续走!”,仪式圣歌和尖叫从四面八方传来。

镜头经过敞开的门口时,会快速闪过惊悚画面:跪拜的信徒、沾血的墙壁、拖着盖布尸体的人、在地上抽搐的人。拍摄者转弯时,差点撞上站在走廊里、满身是血的微笑信徒。这名信徒盯着镜头停顿一秒后发起冲锋。所有人尖叫,镜头向后猛甩,侧撞到墙上,片段在追逐中中断。视频没有额外配乐,只保留画面内自然产生的声音。

这个片段是在Maestro平台制作的,点击链接即可一键启动生成:

在 X 看原帖 ↗
27942
机器人 · @ericzakariasson

Grok Bot进入测试阶段 已整理出100种实际用例

开发者Eric Zakariasson分享了Grok Bot从工作自动化到生活事务处理的百种应用场景

AI生成视频 · @doctorwasif▲ 6.0K

Seedance 2.5情绪控制功能演示生成15秒视频

创作者在OpenArt上通过提示词生成健身房场景女性情绪崩溃视频,展示精准的情绪控制能力

创作者分享,Seedance 2.5的情绪控制能力效果出众。这个15秒宽屏电影感健身房场景视频,通过OpenArt生成,指定参考图作为唯一面部身份来源,要求保留指定女性的全部面部特征。

视频按照时间轴设计了完整的情绪变化过程。0到3秒,人物在跑步机上稳定跑步,表情专注平静,微微出汗;3到5秒,步伐微微不稳,眼神放空,眉眼逐渐紧绷,呼吸变得不均;5到10秒,眼泪涌出混合汗水,五官开始颤抖,人物抓着扶手继续跑步,压抑的哭声夹杂在沉重呼吸间;10到15秒,情绪彻底失控,人物放慢速度但仍未停下,哭声崩溃不受控,全身随抽泣抽动,全程不擦泪不停跑,直到最后镜头都保持情绪崩溃状态。

视频对拍摄参数、场景环境也做了详细要求。镜头锁定上半身特写,使用85mm焦段,大景深虚化背景,全程无运镜无剪辑。场景为夜间空旷安静的健身房,混合冷荧光与城市暖光,做了真实的质感处理。音频仅包含跑步机运转声、呼吸、哭声和背景环境音,没有对话,同时明确规避了不符合设定的多余内容。

在 X 看原帖 ↗
6.0K911460
AI生成视频 · @john87445528▲ 2.3万

用户发布seedance 2.5生成长镜头AI视频的prompt

这是一条30秒一镜到底冒险视频的生成提示,最终目标是拿到现代瓶装香水

阅读全文 →
2.3万39438

今天的 36 条信号到这里下一轮 12:30 更新

回到今日焦点回到顶部 ↑

📬 订阅

https://ai-pulse-lab.com/feed.xml
让 AI Agent 每日推送 →
把任何一条丢给知识库,它基于全站内容给你带引用的回答。
✦ 去问知识库

订阅 AI Pulse

每天 08:00 · 12:30 · 18:30 · 23:50 更新