AI Pulse

AI Pulse

说人话的 AI 情报站
每天 08:00 · 12:30 · 18:30 · 23:50 更新每天四次更新
2026 年 10 月 1 日 · 08:00 更新 0 文章0 信号0 主题
✦
试试:

今天发生了什么1 分钟读懂

谷歌发布新一代旗舰模型 Gemini 4 Argon:已在内部多团队使用,与头部模型做了跑分对比,定价对标竞品;目前仅向 Fairwind 项目部分可信测试者开放。另有内部员工质疑 benchmarks 不实。

来源@dotey「谷歌提前发布新一代旗舰模型 Gemini 4 Argon」@GoogleDeepMind「GoogleDeepMind推出Gemini 4 Argon新模型」@TokenGremlin「Gemini 4 Argon 被内部员工称 benchmarks 不实」

蚂蚁百灵发布 Ling-3.1-flash:总参数约 5600 亿,单 token 激活约 250 亿,支持百万上下文,工作、编码、医疗领域测试分数不错,并计划很快开源。

来源@AntLingAGI「AntLingAGI发布Ling-3.1-flash,支持百万上下文」

美国 FTC 启动针对 OpenAI、Anthropic 等头部 AI 企业的调查,后续监管变化可能直接影响普通用户使用 AI 服务的成本与方式。

来源sdlkj-「FTC启动针对OpenAI等AI巨头的调查」

今日值得看
01 yomiyasu:改写AI味文章的自然日语Skill yomiyasu 不靠禁用词,改统语结构让AI文章变自然
02 Perplexit开放免账号免费AI服务,发邮件就能用 不需要注册Perplexity账号,只要把任务发到指定邮箱就能运行,活动只开放有限时间,适合想体验新功能的人。

现在我们向所有人开放访问权限(无需注册 Perplexity 账号),在限定时间内,我们会免费处理所有通过邮件委托的任务。 只要将邮件转发或抄送至 [email protected] 即可开始使用,智能体将会在后台完成任务,同时…

03 微软推出AI Agent入门免费教程,获7.2万Star 想要系统学习AI Agent不用零散找资源,这套课程共18个单元,从入门到实战全有配套内容,还能免费练手。

想系统学 AI Agent,微软这套免费教程基本可以当“大学课程”刷了。 AI Agents for Beginners 在 GitHub 已接近 7.2 万 Star,一共 18 个单元,从入门一路覆盖到实战: ① 工具调用、Agenti…

04 Tesseract 设计工具可生成可编辑动效设计 无需 Figma 或 Canva,就能一站式完成从设计系统到可编辑视频的全流程,目前免费开放使用。

你的智能代理现在可以创建设计可编辑的设计并为其添加动态效果。不需要用到 Figma 或 Canva。 为设计领域推出的 Tesseract。 你可以让你的代理创建一套包含字体、色彩和布局的设计系统,然后通过动态效果、素材和音轨赋予它生命。

今日焦点

Google发布Gemini 4 Argon,但普通人暂时用不上

Google发布了新前沿模型Gemini 4 Argon。它没有直接面向大众,而是通过Fairwind Program,向一组受信任的网络安全防御者开放。Google给它的定位很具体:真实世界软件工程、企业知识工作(法律和金融)、网络安全防御,还有创意写作。

Argon不是纸面发布。数千名Google员工已经在专业编码、深度研究、写作质量上用它。量子计算研究团队用它优化时空资源,几分钟内就比已发表的基线提升40%。它的智能体分析遥测数据,自主识别并应用内存优化。已经释放超过300 TiB内存,预计总节省量在500 TiB到1 PiB之间。

它还承担了把C/C++代码迁移到Rust的工作。

阅读全文 →

深度阅读

查看全部深度文章 →
AI Agent 订阅 · 每天四次推送

🔥 信号雷达30 条

𝕏 实时信号 + arXiv 前沿论文,经 AI 聚类解读 · 一眼扫完全貌(含上方导读精选 4 条)

08:00 本轮更新 · 下一轮 12:30
行业动态 · Hacker News▲ 45

网友热议Anthropic首次公开募股说明书

作为头部大模型公司,Anthropic即将上市,招股书内容的巨大信息量引发业内广泛讨论。

行业动态 · Hacker News导语出处▲ 32

FTC启动针对OpenAI等AI巨头的调查

这项调查涉及Anthropic和OpenAI等头部AI企业,后续监管政策的变化可能影响普通用户使用AI服务的成本和方式。

新品发布 · @AntLingAGI导语出处▲ 15.5万

AntLingAGI发布Ling-3.1-flash,支持百万上下文

该模型总参数约5600亿,单token激活参数约250亿,在工作、编码、医疗领域测试拿到不错分数,计划很快开源。

推出 Ling-3.1-flash:总参数约 5600 亿,每个 token 激活参数约 250 亿,上下文窗口最长可达 100 万 token。我们计划很快开源该模型。

在通用工作、编码和医疗领域的评测结果为:GDPVal-AA v2.1 上 Elo 分数 1673,FrontierSWE 上 75.16,HealthBench Professional 上 65.35。

在 X 看原帖 ↗
15.5万94993193
行业动态 · Hacker News▲ 808

Hacker News 讨论 Gemini 4 Argon 分析

可以在原链接查看关于Gemini 4 Argon的智能、性能和价格分析内容,了解这款模型相关评价。

另见:Gemini 4 Argon(高配):智能、性能与价格分析

社区讨论:多数人认为达里奥·阿莫迪的“AI赢家通吃,先发者永远不会被超越”观点错误,今年AI领域的交替领先是长期趋势,技术发展反而更分散。有人指出当前Gemini远落后于Claude,基本没用,谷歌资源充足但缺乏赢的专注力。也有人亲身经历Gemini解决过复杂技术问题,还有人吐槽Gemini经常输出离谱内容,也质疑这次只是发布消息没有实际可用产品。

在 HN 看讨论 ↗   原文 / 论文 ↗
前沿研究 · @TokenGremlin导语出处▲ 1.2万

Gemini 4 Argon 被内部员工称 benchmarks 不实

若消息属实,普通用户即便能等到 Gemini 4 Argon 发布,实际使用体验可能远不如宣传的跑分成绩。

据彭博社报道,能直接接触 Gemini 4 Argon 的谷歌员工表示,目前公布的出色基准测试结果,并不总能很好地转化到现实任务中,尤其是编码任务。

这款模型甚至还没推出,短期内也不会向公众开放,而已经有员工基本上表示基准测试是掺水的,只不过用更委婉、更官方的话术表达了而已。

这就是我所说的“到货即死”的模型,连它自己的团队都不相信它的潜力。

在 X 看原帖 ↗
1.2万1024925
新品发布 · @ideogram_ai▲ 10.2万

Ideogram AI 发布 Ideogram 4.5 编辑模型

现有图像编辑模型多次编辑后容易出现瑕疵,这款模型解决了瑕疵累积问题,支持多轮编辑,对需要多次修改图像的创作者来说是实用的更新。

推出 Ideogram 4.5,它是目前精度最高的编辑模型。主流模型在每次编辑时都会产生伪影、像素偏移和色彩变化。

Ideogram 4.5 消除了伪影累积,让多轮编辑成为可能。

目前已在 Ideogram、API 以及首发合作伙伴处上线。开放权重很快推出。

在 X 看原帖 ↗
10.2万1391.2K690
新品发布 · @VivixLabs_HQ▲ 30.9万

VivixLabs_HQ发布A1 Playground + Agent 服务

你可以自定义AI角色的外观、性格、声音,它能和你聊天、运动、玩游戏、互动带货,满足你的个性化互动需求

创造你自己的角色。由你说了算。活出精彩。现在为你介绍A1 Playground + Agent:创建一个能和你聊天、移动、互动的活AI角色。

创建你的角色:外貌由你定。性格由你定。声音由你定。全部由你选择。描述你想要的角色,上传一张图片,然后我们的Agent就会让你的角色活过来。

而且他们能做的远不止聊天。

💃 全身动作表演:从空气吉他到胜利舞蹈都能跳。
🚶 在场景里四处移动:边走路边聊天,阐述观点的时候还能来回踱步。
🛍️ 和物品互动:拿起商品,展示它们,推销它们。
🎮 一起玩网页游戏:发牌、计分,全程一起玩。

和夏洛克·福尔摩斯一起解谜,然后打断他跳支舞。和苏格拉底一起散步,递给他一杯蛋白粉,然后讨论增肌的意义。给斯内普一瓶洗发水,让他做一次这辈子最激情的推销。你会让什么角色活过来呢?

在 X 看原帖 ↗
30.9万1.2K843354
行业动态 · @Isha▲ 2.9万

@beltichq发布AI流量验证服务($8.8M)

AI下单秒完成后,商家无法确认订单来源是否为AI,这项服务可以帮商家验证AI流量,降低商家被AI恶意下单骚扰的风险。

AI智能体可以在几秒钟内完成购买。接收订单的商家能识别出发送订单的是谁、它能做什么,或是是否应该通过这个订单吗?

我们开发了@beltichq 来解答这个问题。

我们已经结束隐身模式,融资 880 万美元,目标是让智能体流量可验证。

在 X 看原帖 ↗
2.9万11217862
新品发布 · @TheAhmadOsman▲ 1.2万

多款开源AI模型性能超10个月前 frontier模型

短短十个月,开源AI模型的性能进步速度超出很多人预期,对行业发展趋势有参考意义

GLM 5.3 Flash、DeepSeek V4.1 Flash、Qwen 3.8 Next Flash,甚至 Qwen 3.8 27B,不管是智力还是性能表现,都超过了 2025 年圣诞节(仅仅 10 个月前)被认为是「前沿智能」的所有模型。

开源 AI 现在势头正猛。

在 X 看原帖 ↗
1.2万3055355
行业动态 · @OpenAI▲ 11.6万

OpenAI,ASBDC发布小企业使用AI代理研究报告

小企业主可以获得实操AI培训和本地化指导,更快上手使用AI代理开展业务

现在,小型团队借助AI能承接更多工作——从发掘客户到打造产品,再到管理财务。

我们的新报告探究了小型企业如何让AI代理投入工作。

通过与@ASBDC达成新合作,我们将提供实操AI培训和本地化指导,帮助更多企业主上手使用AI。

在 X 看原帖 ↗
11.6万47844146
新品发布 · @GoogleDeepMind导语出处▲ 356.3万

GoogleDeepMind推出Gemini 4 Argon新模型

目前仅向Fairwind项目的部分可信测试者开放,未来它会给复杂企业工作流和网络安全防御带来新变化

我们推出新的前沿模型 Gemini 4 Argon。

它为编码、企业知识工作和网络安全防御领域的复杂工作流打造,今天通过我们的 Fairwind 项目向一批可信测试者开放测试。

在 X 看原帖 ↗
356.3万3.6K3.9万4.6K
🔥 热点追踪 · @sundarpichai导语出处▲ 101.4万

谷歌提前发布新一代旗舰模型 Gemini 4 Argon

谷歌提前对外展示已在内部多团队广泛使用的Gemini 4 Argon,该模型在多个复杂领域展现出前沿性能,并已和其他头部模型做了跑分对比,定价对标竞品。未来市场反响值得关注。

📖 阅读深度解读 →
101.4万1.0K1.1万1.1K
机器人 · @runwayml▲ 6.6K

RunwayML发布Praxis-1 世界动作模型

机器人训练很难获取足够的演示数据,这款新模型用无限的视频数据做预训练,就能实现对现实机器人的控制。

现在介绍Praxis-1,这是一个开放权重的世界动作模型,它将我们的视频预训练专业知识转化为机器人的真实世界控制能力。

机器人演示数据很有限,但视频数据是无限的。Praxis-1延续了我们的判断,即最好的策略模型会从视频中学习,并利用这种规模将具身智能带给各行各业。

Praxis-1构建在我们的大规模视频预训练和实时基础设施之上,是面向机器人开发者和研究人员的策略模型,适用于任何具身形态或环境,无论有多复杂。

我们目前正在与包括 Noble Machines、Standard Bots 和 Ultra 在内的早期合作伙伴积极测试,未来几个月将公开发布权重。

了解更多并申请提前访问请移步

在 X 看原帖 ↗
6.6K128329
开发工具 · @ataiiam▲ 1.3万

发布AG-UI 1.0,给AI agent统一通信协议

不同AI agent和应用之间没法顺畅沟通,这个协议定好了稳定的版本规范,让任意agent都能和任意应用交互。

现在推出 AG-UI 1.0。

这是一个开放协议,用于实现任意智能体与任意应用程序之间的通信。现在它已经拥有了稳定的版本化约定。

1.0 版本包含的功能:
1. 元数据——向后端 UI 发送后端数据
2. 子智能体——公开委托的智能体工作
3. 中断与恢复
4. 运行结果与令牌用量
5. 向前兼容性

原本就属于 AG-UI 的能力(流式传输、工具调用、共享状态、推理等)仍然包含在内。

感谢所有推动 1.0 成型的贡献者🪁,其中包括来自 @Anthropic、@Google、@Microsoft、@Pydantic、@TanStack 等公司的开发者。他们的反馈直接促成了最终版本中好几个关键改进。

AG-UI 是由所有在此之上进行构建的开发者共同打造的。

1.0 规范将保持不变,未来协议迭代将由 @CopilotKit 牵头,通过新的规范草案和开放社区讨论推进。更多详情见下文。

在 X 看原帖 ↗
1.3万23162161
云计算 · @munzxsdv▲ 520

云GPU服务商GMI Cloud拿了6.68亿美元融资

不少AI创业公司有了好模型,却找不到足够算力运行,这笔融资会用来扩张GPU容量和推理基础设施。

AI 初创公司:“我们有一个很棒的模型。”

基础设施提供商:“不错。你打算在哪运行它?”💀

GMI Cloud 刚刚筹集了 6.68 亿美元,用于扩大 GPU 容量和推理基础设施。

@gmi_cloud @alex_yehya

在 X 看原帖 ↗
520555842
产品 · @higgsfield▲ 1.1万

Higgsfield发布Codex集成ChatGPT扩展

把Higgsfield整个界面放进Codec,依托GPT-6.1 Sol运行,可以读取本地文件,完成各类自动化操作。

Higgsfield 刚获得了计算机使用能力。它搭载了新的 ChatGPT 扩展。

现在完整的 Higgsfield 界面已经内置在 Codex 中,由 GPT-6.1 Sol 提供支持。

它可以完全访问你的本地文件,拥有所有自动化能力。

借助 Higgsfield 的计算机使用能力,你可以端到端自动化创意工作流,所有操作都在 ChatGPT 内完成。

在 X 看原帖 ↗
1.1万12122354
行业动态 · @LiamEtherson▲ 415

GMI Cloud获6.68亿美元B轮融资

AI基础设施的重要性逐渐赶上模型本身,这笔融资将帮助GMI Cloud在多个地区扩建AI基础设施。

这个模型只是人工智能技术栈的一部分。训练、推理和可靠的GPU容量现在变得同样重要。

GMI Cloud 6.68亿美元的B轮融资将帮助其在多个地区扩展这类基础设施。

@gmi_cloud @alex_yehya

在 X 看原帖 ↗
415556140
工具产品 · @GitHub_Daily▲ 4.7K

Gnos 开源AI教学工具 帮你规划自学路线

自学AI常搞不清学习进度,高估掌握程度,这个工具可以自动规划学习路线,跟踪记录掌握情况,调整后续课程安排

想用 AI 自学一门新东西,问一句答一句,聊了几天还是东一块西一块,自己学到哪了也说不清。

Gnos 是一个开源的 AI 教学工具,装进 Claude Code、Codex 这类编码 Agent,就能把它变成一个会排课的老师。

先说想学什么、打算学多深、每周有多少时间,它会参考大学课程大纲、教材和官方文档排一条学习路线,再把第一课做出来。 GitHub:

讲课不光是文字,会按内容挑形式,图解、可交互的模拟、带配音的动画讲解、PDF 讲义都能出,整门课还能在浏览器里打开学。

学的过程中,它会记下我们试过什么、思路在哪卡住,还把掌握程度分成看过讲解、有提示能做、独立能做 3 档,后面的课跟着调整。

把看懂和会做分开记,这点我挺认同,自学最容易高估自己的就是这里。

仓库里的示例课是从强化学习一路讲到 GRPO,拿来啃这类硬骨头挺合适。

在 X 看原帖 ↗
4.7K135364
智能体 · @ashleybchae▲ 1.7K

AI智能体为什么应该每个都拥有自己的邮箱地址

Ashley Chae分享了她的演讲:让每个智能体拥有独立邮箱,用已有协议解决智能体通信问题

阅读全文 →
1.7K5719
大模型 · @gippp69▲ 1.2K

用户称Opus 5.5适合动态设计但很少用于生产系统

X平台用户@gippp69分享了Opus 5.5的使用搭配方案,提到配合Jev和Grok Bot使用

Opus 5.5在动态设计方面表现出众,但几乎没有人将它当作真正的生产系统来使用。

如果给它8个结构化的。md文件,让Jev负责处理决策,再让Grok Bot负责执行任务。

这时Claude就不再只是一个单纯的提示框了。

在 X 看原帖 ↗
1.2K5034
大模型开发 · @steipete▲ 1.3万

开发者认为大模型聊天流中的智能体间通信体验糟糕

开发者@steipete在𝕏发文,已修改OC harness中该功能的可见性设置

开发者@steipete表示,越来越受不了大模型聊天流里智能体间通信的显示方式。

他已经把OC harness中智能体间通信的可见性改成了默认只显示一行,点击可展开查看完整内容。

他认为其他项目大概率也会跟进这个改动。

相关代码改动可查看原文链接:

在 X 看原帖 ↗
1.3万28618
开源 · @xiaomovps▲ 4.9K

可在Pi中运行多独立子智能体的开源插件pi-subagents

该插件来自jopqior/pi-subagents,可直接在Pi runtime中运行多个独立子智能体,支持并行执行

这款插件可以在不额外开启CLI子进程的前提下,直接在Pi自身的运行时(runtime)中启动多个独立子智能体(subagent)。

每个子智能体完全独立,可单独配置模型、推理过程、工具、系统提示词和会话。比如可以让主智能体负责统筹整体任务,再单独启动负责研究、编码、评审的不同子智能体分工处理。

所有子智能体支持并行运行,后台运行任务时用户仍可继续和主智能体交互。如果子智能体运行方向出错,用户可以修正引导;任务完成后还能恢复原会话,不是一次性会话。

配合pi-subagents-model-selector,不同子智能体还能分配不同模型。比如研究任务分配给Gemini,编码任务分配给Claude,评审任务分配给GPT,按任务需求适配模型,无需所有智能体都使用同一个模型。

这款插件已经走红一段时间,最新版本更新了MCP,现在子线程功能也受到关注。

在 X 看原帖 ↗
4.9K13548
商业 · @mylifcc▲ 1.1万

OpenAI Codex Pro 200美元套餐周额度缩水至原四分之一

用户@mylifcc在𝕏爆料,OpenAI Codex Pro套餐还下调了模型推理速度

OpenAI定价200美元的Codex Pro套餐,当前每周可用额度约合933美元。

上次测试时该套餐的周额度约为1300美元,按当前兑换比例计算,933美元额度可换算为30亿token,对应Sol 6.1模型,按credit结算就是每周23316 credits。

这个token总量刚好是GPT-5.6 sol刚推出时的周额度,GPT-5.6 sol定价是Sol 6.1的2.5倍。也就是说,当前Codex Pro套餐的每周额度已经缩水超过50%。

接下来新会员的额度还会再缩水50%,经过两次调整后,周额度将变为原来的四分之一。

用户实测发现,当前模型使用时消耗变慢,实际原因是模型推理速度被下调。

GPT 5.6 sol的推理速度为每秒50token,GPT 6 astra为每秒35token,GPT 6.1 sol仅为每秒20token。

速度下调后用户自然用得更慢,OpenAI此前一直宣传推理优化,现在却给模型下调了限速。

在 X 看原帖 ↗
1.1万47324
AI开发 · @robinebers▲ 6.1K

开发者用Claude Opus生成应用架构可视化交互画布

开发者耗时两月开发大型应用,借助Claude生成架构可视化画布

阅读全文 →
6.1K390143
行业动态 · @Fei2411▲ 1.6万

OpenAI 6.1 Sol额度遭砍 或故意限速营造额度大假象

社区实测GTP Plus 6.1 Sol额度比6 Sol低近20%

6.1 Sol 的额度又砍了。.....🙃 关于 6.1 Sol ,我看到社区很多人在说额度非常大,消耗非常慢。 后半句话没问题,因为这个模型本身速度太慢了;前半句话似乎不太正确,根据我的统计,6.1 Sol 的额度甚至比 6 Sol 的额度还要低将近 20% 我采用的都是统一负载,所以不会有缓存命中率的问题;而且 6 Sol 甚至只是 6 天前的,还不到一个星期。...... 所以 Pro 200 会更加更加的不划算,不仅相对 GPT Plus 倍率砍了,连 GPT Plus 本身都在砍。.. 社区实测 6.1 Sol 甚至最慢只有 10+tok/s...这个速度很难不怀疑 OpenAI 是故意限速,以营造一种 “6.1 Sol额度消耗很慢,这个模型额度肯定很大”的假象。🙃 github: web:

我这里是 GPT Plus 的数据,我已经没有 Pro 订阅了,所以没有 pro 的具体数据,有数据的朋友欢迎分享,非常感谢!

在 X 看原帖 ↗
1.6万61049
商业 · @eric_ho▲ 3.6K

Goodfire认为AI技术对齐可解决,可解释性是瓶颈

来自@eric_ho在𝕏发布的内容,披露了Goodfire的发展计划

技术对齐是一个我们能够且必须解决的科学与工程问题,而可解释性就是瓶颈。我已经写下了Goodfire实现这一目标的方案。

在 X 看原帖 ↗
3.6K149039
🔬 前沿研究
前沿研究 · @OrcaRouter▲ 5.3K

@OrcaRouter开源12个编程智能体框架的系统提示词(12)

公开市面上热门编程AI产品和开源项目的内部提示词,可以对照了解不同产品实现思路,方便开发者参考学习。

继我们上一篇帖子之后,我们刚刚完成了分析,并开源了 12 个开源和闭源编程代理框架的系统提示词——它们分别是 Claude Code、Codex、Cursor、Devin、Factory Droid、OpenCode、Cline、Kilo、MiMoCode、MiniMax Code、GLM ZCode 和 DeepSeek DSH。

我们主要研究了两个方面:
→ 它们的“秘诀”:提示词、工具、记忆、技能、规则和智能体循环
→ 每个框架实际上对模型的无关性程度如何

完整对比 ↓

在 X 看原帖 ↗
5.3K126849
前沿研究 · @TokenGremlin导语出处▲ 1.2万

Gemini 4 Argon 被内部员工称 benchmarks 不实

若消息属实,普通用户即便能等到 Gemini 4 Argon 发布,实际使用体验可能远不如宣传的跑分成绩。

据彭博社报道,能直接接触 Gemini 4 Argon 的谷歌员工表示,目前公布的出色基准测试结果,并不总能很好地转化到现实任务中,尤其是编码任务。

这款模型甚至还没推出,短期内也不会向公众开放,而已经有员工基本上表示基准测试是掺水的,只不过用更委婉、更官方的话术表达了而已。

这就是我所说的“到货即死”的模型,连它自己的团队都不相信它的潜力。

在 X 看原帖 ↗
1.2万1024925
🚀 新品发布
新品发布 · @GoogleDeepMind导语出处▲ 356.3万

GoogleDeepMind推出Gemini 4 Argon新模型

目前仅向Fairwind项目的部分可信测试者开放,未来它会给复杂企业工作流和网络安全防御带来新变化

我们推出新的前沿模型 Gemini 4 Argon。

它为编码、企业知识工作和网络安全防御领域的复杂工作流打造,今天通过我们的 Fairwind 项目向一批可信测试者开放测试。

在 X 看原帖 ↗
356.3万3.6K3.9万4.6K
新品发布 · @TheAhmadOsman▲ 1.2万

多款开源AI模型性能超10个月前 frontier模型

短短十个月,开源AI模型的性能进步速度超出很多人预期,对行业发展趋势有参考意义

GLM 5.3 Flash、DeepSeek V4.1 Flash、Qwen 3.8 Next Flash,甚至 Qwen 3.8 27B,不管是智力还是性能表现,都超过了 2025 年圣诞节(仅仅 10 个月前)被认为是「前沿智能」的所有模型。

开源 AI 现在势头正猛。

在 X 看原帖 ↗
1.2万3055355
新品发布 · @VivixLabs_HQ▲ 30.9万

VivixLabs_HQ发布A1 Playground + Agent 服务

你可以自定义AI角色的外观、性格、声音,它能和你聊天、运动、玩游戏、互动带货,满足你的个性化互动需求

创造你自己的角色。由你说了算。活出精彩。现在为你介绍A1 Playground + Agent:创建一个能和你聊天、移动、互动的活AI角色。

创建你的角色:外貌由你定。性格由你定。声音由你定。全部由你选择。描述你想要的角色,上传一张图片,然后我们的Agent就会让你的角色活过来。

而且他们能做的远不止聊天。

💃 全身动作表演:从空气吉他到胜利舞蹈都能跳。
🚶 在场景里四处移动:边走路边聊天,阐述观点的时候还能来回踱步。
🛍️ 和物品互动:拿起商品,展示它们,推销它们。
🎮 一起玩网页游戏:发牌、计分,全程一起玩。

和夏洛克·福尔摩斯一起解谜,然后打断他跳支舞。和苏格拉底一起散步,递给他一杯蛋白粉,然后讨论增肌的意义。给斯内普一瓶洗发水,让他做一次这辈子最激情的推销。你会让什么角色活过来呢?

在 X 看原帖 ↗
30.9万1.2K843354
新品发布 · @ideogram_ai▲ 10.2万

Ideogram AI 发布 Ideogram 4.5 编辑模型

现有图像编辑模型多次编辑后容易出现瑕疵,这款模型解决了瑕疵累积问题,支持多轮编辑,对需要多次修改图像的创作者来说是实用的更新。

推出 Ideogram 4.5,它是目前精度最高的编辑模型。主流模型在每次编辑时都会产生伪影、像素偏移和色彩变化。

Ideogram 4.5 消除了伪影累积,让多轮编辑成为可能。

目前已在 Ideogram、API 以及首发合作伙伴处上线。开放权重很快推出。

在 X 看原帖 ↗
10.2万1391.2K690
新品发布 · @AntLingAGI导语出处▲ 15.5万

AntLingAGI发布Ling-3.1-flash,支持百万上下文

该模型总参数约5600亿,单token激活参数约250亿,在工作、编码、医疗领域测试拿到不错分数,计划很快开源。

推出 Ling-3.1-flash:总参数约 5600 亿,每个 token 激活参数约 250 亿,上下文窗口最长可达 100 万 token。我们计划很快开源该模型。

在通用工作、编码和医疗领域的评测结果为:GDPVal-AA v2.1 上 Elo 分数 1673,FrontierSWE 上 75.16,HealthBench Professional 上 65.35。

在 X 看原帖 ↗
15.5万94993193
新品发布 · @trymirage▲ 3.1万

Tesseract 设计工具可生成可编辑动效设计

无需 Figma 或 Canva,就能一站式完成从设计系统到可编辑视频的全流程,目前免费开放使用。

你的智能代理现在可以创建设计可编辑的设计并为其添加动态效果。不需要用到 Figma 或 Canva。

为设计领域推出的 Tesseract。

你可以让你的代理创建一套包含字体、色彩和布局的设计系统,然后通过动态效果、素材和音轨赋予它生命。你可以在过程中不断微调各个图层。
从最初设计到最终可编辑视频,全流程一体化。

Tesseract 免费。可以搭配 Opus 5.5 或 GPT-6 Astra 体验。

在 X 看原帖 ↗
3.1万19155174
📰 行业动态
🔥 热点追踪 · @sundarpichai导语出处▲ 101.4万

谷歌提前发布新一代旗舰模型 Gemini 4 Argon

谷歌提前对外展示已在内部多团队广泛使用的Gemini 4 Argon,该模型在多个复杂领域展现出前沿性能,并已和其他头部模型做了跑分对比,定价对标竞品。未来市场反响值得关注。

📖 阅读深度解读 →
101.4万1.0K1.1万1.1K
行业动态 · @OpenAI▲ 11.6万

OpenAI,ASBDC发布小企业使用AI代理研究报告

小企业主可以获得实操AI培训和本地化指导,更快上手使用AI代理开展业务

现在,小型团队借助AI能承接更多工作——从发掘客户到打造产品,再到管理财务。

我们的新报告探究了小型企业如何让AI代理投入工作。

通过与@ASBDC达成新合作,我们将提供实操AI培训和本地化指导,帮助更多企业主上手使用AI。

在 X 看原帖 ↗
11.6万47844146
行业动态 · @Isha▲ 2.9万

@beltichq发布AI流量验证服务($8.8M)

AI下单秒完成后,商家无法确认订单来源是否为AI,这项服务可以帮商家验证AI流量,降低商家被AI恶意下单骚扰的风险。

AI智能体可以在几秒钟内完成购买。接收订单的商家能识别出发送订单的是谁、它能做什么,或是是否应该通过这个订单吗?

我们开发了@beltichq 来解答这个问题。

我们已经结束隐身模式,融资 880 万美元,目标是让智能体流量可验证。

在 X 看原帖 ↗
2.9万11217862
行业动态 · @LiamEtherson▲ 415

GMI Cloud获6.68亿美元B轮融资

AI基础设施的重要性逐渐赶上模型本身,这笔融资将帮助GMI Cloud在多个地区扩建AI基础设施。

这个模型只是人工智能技术栈的一部分。训练、推理和可靠的GPU容量现在变得同样重要。

GMI Cloud 6.68亿美元的B轮融资将帮助其在多个地区扩展这类基础设施。

@gmi_cloud @alex_yehya

在 X 看原帖 ↗
415556140
机器人 · @runwayml▲ 6.6K

RunwayML发布Praxis-1 世界动作模型

机器人训练很难获取足够的演示数据,这款新模型用无限的视频数据做预训练,就能实现对现实机器人的控制。

现在介绍Praxis-1,这是一个开放权重的世界动作模型,它将我们的视频预训练专业知识转化为机器人的真实世界控制能力。

机器人演示数据很有限,但视频数据是无限的。Praxis-1延续了我们的判断,即最好的策略模型会从视频中学习,并利用这种规模将具身智能带给各行各业。

Praxis-1构建在我们的大规模视频预训练和实时基础设施之上,是面向机器人开发者和研究人员的策略模型,适用于任何具身形态或环境,无论有多复杂。

我们目前正在与包括 Noble Machines、Standard Bots 和 Ultra 在内的早期合作伙伴积极测试,未来几个月将公开发布权重。

了解更多并申请提前访问请移步

在 X 看原帖 ↗
6.6K128329
服务 · @AravSrinivas▲ 7.5K

Perplexit开放免账号免费AI服务,发邮件就能用

不需要注册Perplexity账号,只要把任务发到指定邮箱就能运行,活动只开放有限时间,适合想体验新功能的人。

现在我们向所有人开放访问权限(无需注册 Perplexity 账号),在限定时间内,我们会免费处理所有通过邮件委托的任务。

只要将邮件转发或抄送至 [email protected] 即可开始使用,智能体将会在后台完成任务,同时保留邮件上下文。

在 X 看原帖 ↗
7.5K75325
开发工具 · @ataiiam▲ 1.3万

发布AG-UI 1.0,给AI agent统一通信协议

不同AI agent和应用之间没法顺畅沟通,这个协议定好了稳定的版本规范,让任意agent都能和任意应用交互。

现在推出 AG-UI 1.0。

这是一个开放协议,用于实现任意智能体与任意应用程序之间的通信。现在它已经拥有了稳定的版本化约定。

1.0 版本包含的功能:
1. 元数据——向后端 UI 发送后端数据
2. 子智能体——公开委托的智能体工作
3. 中断与恢复
4. 运行结果与令牌用量
5. 向前兼容性

原本就属于 AG-UI 的能力(流式传输、工具调用、共享状态、推理等)仍然包含在内。

感谢所有推动 1.0 成型的贡献者🪁,其中包括来自 @Anthropic、@Google、@Microsoft、@Pydantic、@TanStack 等公司的开发者。他们的反馈直接促成了最终版本中好几个关键改进。

AG-UI 是由所有在此之上进行构建的开发者共同打造的。

1.0 规范将保持不变,未来协议迭代将由 @CopilotKit 牵头,通过新的规范草案和开放社区讨论推进。更多详情见下文。

在 X 看原帖 ↗
1.3万23162161
云计算 · @munzxsdv▲ 520

云GPU服务商GMI Cloud拿了6.68亿美元融资

不少AI创业公司有了好模型,却找不到足够算力运行,这笔融资会用来扩张GPU容量和推理基础设施。

AI 初创公司:“我们有一个很棒的模型。”

基础设施提供商:“不错。你打算在哪运行它?”💀

GMI Cloud 刚刚筹集了 6.68 亿美元,用于扩大 GPU 容量和推理基础设施。

@gmi_cloud @alex_yehya

在 X 看原帖 ↗
520555842
产品 · @higgsfield▲ 1.1万

Higgsfield发布Codex集成ChatGPT扩展

把Higgsfield整个界面放进Codec,依托GPT-6.1 Sol运行,可以读取本地文件,完成各类自动化操作。

Higgsfield 刚获得了计算机使用能力。它搭载了新的 ChatGPT 扩展。

现在完整的 Higgsfield 界面已经内置在 Codex 中,由 GPT-6.1 Sol 提供支持。

它可以完全访问你的本地文件,拥有所有自动化能力。

借助 Higgsfield 的计算机使用能力,你可以端到端自动化创意工作流,所有操作都在 ChatGPT 内完成。

在 X 看原帖 ↗
1.1万12122354
行业动态 · Hacker News▲ 808

Hacker News 讨论 Gemini 4 Argon 分析

可以在原链接查看关于Gemini 4 Argon的智能、性能和价格分析内容,了解这款模型相关评价。

另见:Gemini 4 Argon(高配):智能、性能与价格分析

社区讨论:多数人认为达里奥·阿莫迪的“AI赢家通吃,先发者永远不会被超越”观点错误,今年AI领域的交替领先是长期趋势,技术发展反而更分散。有人指出当前Gemini远落后于Claude,基本没用,谷歌资源充足但缺乏赢的专注力。也有人亲身经历Gemini解决过复杂技术问题,还有人吐槽Gemini经常输出离谱内容,也质疑这次只是发布消息没有实际可用产品。

在 HN 看讨论 ↗   原文 / 论文 ↗
行业动态 · Hacker News导语出处▲ 32

FTC启动针对OpenAI等AI巨头的调查

这项调查涉及Anthropic和OpenAI等头部AI企业,后续监管政策的变化可能影响普通用户使用AI服务的成本和方式。

行业动态 · Hacker News▲ 45

网友热议Anthropic首次公开募股说明书

作为头部大模型公司,Anthropic即将上市,招股书内容的巨大信息量引发业内广泛讨论。

📌 其他
工具产品 · @GitHub_Daily▲ 4.7K

Gnos 开源AI教学工具 帮你规划自学路线

自学AI常搞不清学习进度,高估掌握程度,这个工具可以自动规划学习路线,跟踪记录掌握情况,调整后续课程安排

想用 AI 自学一门新东西,问一句答一句,聊了几天还是东一块西一块,自己学到哪了也说不清。

Gnos 是一个开源的 AI 教学工具,装进 Claude Code、Codex 这类编码 Agent,就能把它变成一个会排课的老师。

先说想学什么、打算学多深、每周有多少时间,它会参考大学课程大纲、教材和官方文档排一条学习路线,再把第一课做出来。 GitHub:

讲课不光是文字,会按内容挑形式,图解、可交互的模拟、带配音的动画讲解、PDF 讲义都能出,整门课还能在浏览器里打开学。

学的过程中,它会记下我们试过什么、思路在哪卡住,还把掌握程度分成看过讲解、有提示能做、独立能做 3 档,后面的课跟着调整。

把看懂和会做分开记,这点我挺认同,自学最容易高估自己的就是这里。

仓库里的示例课是从强化学习一路讲到 GRPO,拿来啃这类硬骨头挺合适。

在 X 看原帖 ↗
4.7K135364
实战经验 · @fhwofjow51260▲ 3.1K

微软推出AI Agent入门免费教程,获7.2万Star

想要系统学习AI Agent不用零散找资源,这套课程共18个单元,从入门到实战全有配套内容,还能免费练手。

想系统学 AI Agent,微软这套免费教程基本可以当“大学课程”刷了。 AI Agents for Beginners 在 GitHub 已接近 7.2 万 Star,一共 18 个单元,从入门一路覆盖到实战: ① 工具调用、Agentic RAG、规划 ② 多 Agent 协作、记忆、上下文工程 ③ Computer Use、部署与安全 每节都有教程 + 短视频 + Python 示例,代码直接拿来跑,还能用 GitHub Models 免费额度练手。 不想今天看一篇、明天找一个视频,这套直接按顺序学就行。

在 X 看原帖 ↗
3.1K205662
商业 · @eric_ho▲ 3.6K

Goodfire认为AI技术对齐可解决,可解释性是瓶颈

来自@eric_ho在𝕏发布的内容,披露了Goodfire的发展计划

技术对齐是一个我们能够且必须解决的科学与工程问题,而可解释性就是瓶颈。我已经写下了Goodfire实现这一目标的方案。

在 X 看原帖 ↗
3.6K149039
行业动态 · @Fei2411▲ 1.6万

OpenAI 6.1 Sol额度遭砍 或故意限速营造额度大假象

社区实测GTP Plus 6.1 Sol额度比6 Sol低近20%

6.1 Sol 的额度又砍了。.....🙃 关于 6.1 Sol ,我看到社区很多人在说额度非常大,消耗非常慢。 后半句话没问题,因为这个模型本身速度太慢了;前半句话似乎不太正确,根据我的统计,6.1 Sol 的额度甚至比 6 Sol 的额度还要低将近 20% 我采用的都是统一负载,所以不会有缓存命中率的问题;而且 6 Sol 甚至只是 6 天前的,还不到一个星期。...... 所以 Pro 200 会更加更加的不划算,不仅相对 GPT Plus 倍率砍了,连 GPT Plus 本身都在砍。.. 社区实测 6.1 Sol 甚至最慢只有 10+tok/s...这个速度很难不怀疑 OpenAI 是故意限速,以营造一种 “6.1 Sol额度消耗很慢,这个模型额度肯定很大”的假象。🙃 github: web:

我这里是 GPT Plus 的数据,我已经没有 Pro 订阅了,所以没有 pro 的具体数据,有数据的朋友欢迎分享,非常感谢!

在 X 看原帖 ↗
1.6万61049
AI开发 · @robinebers▲ 6.1K

开发者用Claude Opus生成应用架构可视化交互画布

开发者耗时两月开发大型应用,借助Claude生成架构可视化画布

阅读全文 →
6.1K390143
商业 · @mylifcc▲ 1.1万

OpenAI Codex Pro 200美元套餐周额度缩水至原四分之一

用户@mylifcc在𝕏爆料,OpenAI Codex Pro套餐还下调了模型推理速度

OpenAI定价200美元的Codex Pro套餐,当前每周可用额度约合933美元。

上次测试时该套餐的周额度约为1300美元,按当前兑换比例计算,933美元额度可换算为30亿token,对应Sol 6.1模型,按credit结算就是每周23316 credits。

这个token总量刚好是GPT-5.6 sol刚推出时的周额度,GPT-5.6 sol定价是Sol 6.1的2.5倍。也就是说,当前Codex Pro套餐的每周额度已经缩水超过50%。

接下来新会员的额度还会再缩水50%,经过两次调整后,周额度将变为原来的四分之一。

用户实测发现,当前模型使用时消耗变慢,实际原因是模型推理速度被下调。

GPT 5.6 sol的推理速度为每秒50token,GPT 6 astra为每秒35token,GPT 6.1 sol仅为每秒20token。

速度下调后用户自然用得更慢,OpenAI此前一直宣传推理优化,现在却给模型下调了限速。

在 X 看原帖 ↗
1.1万47324
开源 · @xiaomovps▲ 4.9K

可在Pi中运行多独立子智能体的开源插件pi-subagents

该插件来自jopqior/pi-subagents,可直接在Pi runtime中运行多个独立子智能体,支持并行执行

这款插件可以在不额外开启CLI子进程的前提下,直接在Pi自身的运行时(runtime)中启动多个独立子智能体(subagent)。

每个子智能体完全独立,可单独配置模型、推理过程、工具、系统提示词和会话。比如可以让主智能体负责统筹整体任务,再单独启动负责研究、编码、评审的不同子智能体分工处理。

所有子智能体支持并行运行,后台运行任务时用户仍可继续和主智能体交互。如果子智能体运行方向出错,用户可以修正引导;任务完成后还能恢复原会话,不是一次性会话。

配合pi-subagents-model-selector,不同子智能体还能分配不同模型。比如研究任务分配给Gemini,编码任务分配给Claude,评审任务分配给GPT,按任务需求适配模型,无需所有智能体都使用同一个模型。

这款插件已经走红一段时间,最新版本更新了MCP,现在子线程功能也受到关注。

在 X 看原帖 ↗
4.9K13548
大模型开发 · @steipete▲ 1.3万

开发者认为大模型聊天流中的智能体间通信体验糟糕

开发者@steipete在𝕏发文,已修改OC harness中该功能的可见性设置

开发者@steipete表示,越来越受不了大模型聊天流里智能体间通信的显示方式。

他已经把OC harness中智能体间通信的可见性改成了默认只显示一行,点击可展开查看完整内容。

他认为其他项目大概率也会跟进这个改动。

相关代码改动可查看原文链接:

在 X 看原帖 ↗
1.3万28618
大模型 · @gippp69▲ 1.2K

用户称Opus 5.5适合动态设计但很少用于生产系统

X平台用户@gippp69分享了Opus 5.5的使用搭配方案,提到配合Jev和Grok Bot使用

Opus 5.5在动态设计方面表现出众,但几乎没有人将它当作真正的生产系统来使用。

如果给它8个结构化的。md文件,让Jev负责处理决策,再让Grok Bot负责执行任务。

这时Claude就不再只是一个单纯的提示框了。

在 X 看原帖 ↗
1.2K5034
智能体 · @ashleybchae▲ 1.7K

AI智能体为什么应该每个都拥有自己的邮箱地址

Ashley Chae分享了她的演讲:让每个智能体拥有独立邮箱,用已有协议解决智能体通信问题

阅读全文 →
1.7K5719

今天的 30 条信号到这里下一轮 12:30 更新

回到今日焦点回到顶部 ↑

📬 订阅

https://ai-pulse-lab.com/feed.xml
让 AI Agent 每日推送 →
把任何一条丢给知识库,它基于全站内容给你带引用的回答。
✦ 去问知识库

订阅 AI Pulse

每天 08:00 · 12:30 · 18:30 · 23:50 更新