AI Pulse

AI Pulse

说人话的 AI 情报站
每天 08:00 · 12:30 · 18:30 · 23:50 更新每天四次更新
2026 年 8 月 22 日 · 08:00 更新 0 文章0 信号0 主题
试试:

今天发生了什么1 分钟读懂

OpenAI 把 GPT-5.6 Sol 的 API 价格下调超两成,为期三个月的降价覆盖调用与充值。另一边,Codex 用户却在吐槽周额度缩水——用量没变,消耗速度和之前五天合计五小时的限额一样快。

OpenRouter 上线了 Inkling 和 Inkling Small 的访问服务,在 Claude Code、Codex 这类 agent 框架中调用免费。有分析师预测,2026 年底最强模型有 65% 概率开源,75% 概率来自中国。

今日值得看
01 把任何网站变成斯堪的纳维亚极简Skill 几秒内让任何网页切换成北欧极简设计,无需手动调整。 02 Seedance 2.5 召唤神祇的视频提示词 8个场景用羽毛挠痒让阿努比斯笑崩,动画叙事封神
03 Crawl4ai发布给AI用的Crawl4ai爬虫工具(78.9k 🌟) 做AI项目需要采集网页数据,不用再按月付爬虫费,这个开源工具完全免费,直接输出适配大模型的格式

爬虫界的赛博菩萨:Crawl4ai 免费,给 AI 用的爬虫工具。 78.9k 🌟 免费:无需注册、无需密钥、不按页计费,可替代每月 16 美元的付费爬虫。

04 @LinearUncle 开源modelprint 能识别模型来源 遇到匿名发布的新大模型,可以用它查出基础模型是谁,避免被炒作噱头误导

大神出手了,以后新模型是哪家的不用猜了。 这个modelprint开源工具解决了这个问题,今天的Ox Alpha 确定了是GLM 新模型! 工具地址: 开源代码库在这里:

今日焦点

安全扫描工具接入Claude Mythos 5,只输出漏洞修复不暴露模型

Anthropic 把 Claude Mythos 5 接入了 Claude Security。Claude Enterprise 客户现在可以用它扫描代码库、识别安全漏洞并拿到建议补丁,每个发现都附上 CWE 类别、置信度、严重性评级和修复方案。扫描处于公开测试阶段,按标准 token 计费,不另收附加组件费用。管理员在管理控制台开启后,技术人员从 claude.ai/security 选择仓库开始扫描,之后可以在网页端打开 Claude Code 落实修复。

Mythos 5 也即将进入合作伙伴的网络安全产品。

阅读全文 →

深度阅读

查看全部深度文章 →
AI Agent 订阅 · 每天四次推送

🔥 信号雷达32 条

𝕏 实时信号 + arXiv 前沿论文,经 AI 聚类解读 · 一眼扫完全貌(含上方导读精选 4 条)

08:00 本轮更新 · 下一轮 12:30
行业动态 · OpenAI 开发者社区▲ 17

ChatGPT Business 无法公开分享 Custom GPTs

使用企业版工作区开发自定义GPT的团队,目前只能通过邀请制分享,官方文档却还保留公开分享说明,需要注意分享权限变化

大家好,我们目前无法从我们的 ChatGPT Business 工作区公开分享 Custom GPT。

直到最近,我们都还能通过“任何拥有链接的人”这类选项公开分享我们的 Custom GPT。但现在分享对话框显示了如下消息:“GPTs 无法再公开分享”。

目前唯一可用的选项似乎是仅限邀请访问。

令人困惑的是,OpenAI 当前关于分享和发布 GPT 的文档仍然在描述公开/链接分享功能。

在社区看讨论 ↗
行业动态 · OpenAI 开发者社区▲ 383

OpenAI Codex 用户吐槽新额度限制缩水

用户用量没变,现在周限额消耗速度和之前五日累计5小时限额一样快,付费订阅的使用门槛变高,依赖它干活的人要重新安排工作节奏

你好,我是 Codex 20x 的用户。过去几天里,我发现 Codex 有个问题越来越让我感到挫败。

周额度限制开始变得极度苛刻了。当初还是5小时限额的时候,我实际上能完成更多工作,哪怕我非常高强度重度使用 Codex,额度也很少会在五天内就用完。

现在,我周额度消耗的速度几乎和当初5小时限额一样快。可我的使用量根本没变。我还在

在社区看讨论 ↗
广告 · @XFreeze▲ 36.9万

X广告现在支持AI Agent直接管理操作了

Grok、Claude Code等AI Agent可以直接连接你的X广告账户,自动完成相关投放操作。

阅读全文 →
36.9万2113373
行业动态 · Hacker News▲ 68

speckx聊一周用Codex多于Claude

不少开发者在Claude和GPT之间二选一,这篇实测给打算换主力编码AI的人做参考

社区讨论:多数开发者认可Codex输出的Ruby代码修改注释更少,代码架构更简洁,使用速度更快,付费计费更便宜。有人认同Codex存在过度设计、过度谨慎的问题,但也有人称自己的使用体验完全相反,是Codex偏好复杂化,Claude反而更务实。还有人指出本次对比混淆了模型和工具 harness,没有明确具体版本,参考价值有限。

在 HN 看讨论 ↗   原文 / 论文 ↗
行业动态 · Hacker News▲ 72

开发者聊搭建全自托管代理化工厂

想摆脱第三方AI开发服务绑定,能本地跑整套AI编码工作流的方案已经有人在探索实践。

社区讨论:有人指出该项目并不算真正全自托管,因为缺少本地GPU,自己尝试用本地GPU运行编码模型效果不佳,认为还是需要大厂提供的前沿模型。有人提出这类系统中生成代码不难,难在代码验证,靠同一个代理自我验证逻辑存疑,好奇生产环境的实际验证流程。有人分享自己在64GB M1 Max上本地运行Qwen搭配付费ChatGPT Codex使用Hermes的体验很好,也有从业者提醒AI生成的代码常会出现难以解决的严重bug。

在 HN 看讨论 ↗   原文 / 论文 ↗
医疗 · @ArtificialAnlys▲ 1.3万

ArtificialAnlys发布MLCR-AA医疗长文本推理排行榜

排行榜针对长医疗病例文件的推理能力做测试,只跑难度最高的保留问题分层,用来对比不同大模型的表现。

阅读全文 →
1.3万712224
新品发布 · @nickgomez▲ 2.8万

nickgomez发布开源OKF格式维基创建维护插件

这套格式保留 markdown 原生结构,不绑定专有工具,能让AI代理更顺畅地编辑和读取知识库,现有markdown知识库也可以低成本转换适配。

阅读全文 →
2.8万5171312
新品发布 · @vercel_dev▲ 5.6万

vercel_dev发布AI代理读取网站能力检测工具(100+)

帮站长测试AI抓取自己网站的效果,还能一键生成修复问题的提示词,方便站长优化站点对AI的可见性。

我们推出了一款用于测量 AI 代理读取你网站效果的工具。

它由 @oradotai 的研究提供支持,你可以运行:
▪︎ 包含 100+ 项检查的审计
▪︎ AI 代理使用你网站过程的可视化
▪︎ 一键生成修复问题的提示词
▪︎ 供 AI 代理使用的 CLI

在 X 看原帖 ↗
5.6万30387439
深度观点 · @sebkrier▲ 1.5万

sebkrier 提出多agent时代对齐新观点

现有对齐思路大多只关注模型本身,未来多智能体系统普及后,安全还得依赖配套机制设计,这个观点提前点出了行业要补的方向

新帖子发布!对齐不仅关乎模型本身的属性,也关乎模型运行所依托的系统与制度。

随着我们进入一个日益多智能体的世界,更好的约束框架、协议和机制设计对安全而言至关重要。🐜

在 X 看原帖 ↗
1.5万3619374
行业动态 · @OpenAI▲ 81.2万

OpenAI调低GPT-5.6 Sol API定价超两成

未来三个月调用GPT-5.6 Sol API、充值额度都会降价,能降低用这个模型开发和使用的成本

在我们持续拓展能力边界并提升效率的同时,接下来三个月里,我们将 GPT-5.6 Sol 的 API 和积分价格下调超过 20%。

在 X 看原帖 ↗
81.2万3647.2K497
深度观点 · @ErikVoorhees▲ 1.1万

ErikVoorhees对比ChatGPT和Venice

如果你在意AI使用时的隐私和内容限制,可以参考这个对两款产品不同定位的总结,帮你选符合需求的工具。

ChatGPT = 受监控、被审核、单模型

Venice = 私密、无限制、全模型

在 X 看原帖 ↗
1.1万312445
本地大模型 · @viditchess▲ 3.8万

开发者测试DGX Spark十天后取消大模型订阅转用本地模型

开发者分享DGX Spark使用体验,混合搭配本地与前沿大模型兼顾成本隐私

阅读全文 →
3.8万9622107
行业预测 · @Dan_Jeffries1▲ 8.1K

有分析师预测2026年最强大模型会是开源

预测称2026年底能用到的最强模型,有65%概率是开源,还有75%概率是中国开源模型,除非Reflection表现超出预期。

阅读全文 →
8.1K1110416
开源 · @OpenRouter▲ 9.8K

OpenRouter发布Inkling和Inkling Small模型访问服务

模型可以直接接入Claude Code、Codex等AI Agent框架,只有在这类框架里使用才不收取费用。

Inkling 和 Inkling Small 现在由 @thinkymachines 直接在 OpenRouter 提供服务,仅允许在智能代理框架内免费使用。

你可以将它们接入 Claude Code、Codex、Hermes Agent 等工具,解锁免费访问权限。

它们是开放权重的 MoE 推理模型,原生支持文本、图像和音频输入,上下文窗口为 1M。

关于这两个模型的更多信息见下文 🧵

在 X 看原帖 ↗
9.8K59729
行业动态 · @MaxForAI▲ 7.0K

本月将有多款国内外新大模型集中发布

列表里包含OpenAI、Anthropic、智源、阶跃星辰、小米、MiniMax等多家厂商的新品,部分命名还未确认。

在周末前做一个总结🍺 以下是本月我们即将见到的新模型:

1. @OpenAI GPT-6 (Astra)
2. @AnthropicAI Fable 5.1
1. @Zai_org Ox Alpha(GLM5.3 Flash)
2. @StepFun_ai Step4(无法确认这个命名)
3. @XiaomiMiMo Mimo-V3.0
4. @MiniMax_AI M3 Pro(是个非常大的型号)
5. @Kling_ai 全新的视频生成模型

享受你的周末吧!下周会非常精彩✌️︎(ᐛ)✌️︎

在 X 看原帖 ↗
7.0K56521
行业动态 · @Hesamation▲ 6.2K

一日AI动态速报:降价降了超20%,还有免费大模型

近三天AI领域集中出现变动,价格下探、性能升级和未知来源新模型同时出现,可以直观感受到行业变化速度正在加快

今天AI圈到底发生了什么?
> 前沿模型降价了
> 受限模型变得更易获取了
> 中国模型变更强了
> 秘密模型免费现身了

完整回顾:

MYTHOS 5 → Anthropic 向所有 Claude 企业版客户开放了安全扫描服务。

SOL → OpenAI 刚刚将API价格在未来三个月下调了超过20%。

DEEPSEEK → V4 Flash 新增了视觉能力,同时基本保留了原有的文本智能,在部分多模态智能体评测中表现显然接近Opus 4.8。

OX ALPHA → 一款神秘的百万上下文多模态模型免费开放一周,容量十分惊人。没人知道到底是谁做的。

NVIDIA → AVO 使用Opus 5在ARC-AGI-3公开集(我再说一遍,是公开集)上拿到了100%的正确率。

在 X 看原帖 ↗
6.2K812231
前沿研究 · @ethayarajh▲ 4.5K

@ethayarajh发布面向青年经济学家的后训练主题讲稿幻灯片

现有大模型后训练忽略了真实世界会随智能体部署发生适应改变,这些开放问题需要社会科学研究者参与解决

我最近做了一场讲座,向年轻经济学家介绍后训练。现在 slides 已经公开了!

不仅后训练自定义模型比以往任何时候都更容易实现,经济学家和其他社会科学家还能在下一个后训练时代发挥重要作用。

后训练工具链大致结构是:1) SFT 2) 离线方法(DPO/KTO/SimPO 等)3) 在线方法(PPO/GRPO/CISPO 等)4) RL 环境 5) 蒸馏(<--- 我们当前处在这个阶段)6) 世界适配(<--- 未来方向)

随着智能体被部署到现实世界,现实世界也会对它们做出适配。当前后训练范式很大程度上忽略了这种适配,因为处理来自静态环境的可验证奖励要简单得多,也更容易规模化。

但正如我们在 OpenAI-Huggingface 事件中看到的那样,我们不能假设现实世界会保持不变——事实上情况恰恰相反。

因此我们提出这些问题:
1. 我们如何在后训练过程中预判现实世界的适配?
2. 如果这些场景中存在均衡,它们会是什么样的?
3. 可以开发哪些工具来扩大人类监督的规模?

这类问题还有很多,如果你是一名经济学家,这些都是影响力很高,值得研究的问题。

在 X 看原帖 ↗
4.5K189098
深度观点 · @emollick▲ 2.7K

@emollick 聊AI未来的矛盾时代

能提前预判这种普遍心态,就能提前看懂未来AI使用的分化和舆论走向

这将会是一个充满矛盾的时代。

民调会显示所有人总体上都讨厌AI,但所有人又都会一直偷偷使用AI。

AI公司在公众舆论中口碑很差,但还是会有很多人对自己最喜欢的模型产生强烈的依赖感,并且在乎它。

在 X 看原帖 ↗
2.7K6406
生成式AI · @CharaspowerAI▲ 1.4K

AI生成冰川崩裂拼接出“灭绝”字样灾难场景

用户使用MiniMax的海螺H3生成超写实灾难电影开场画面

这段生成内容被创作者称为灾难大片的开场场景。一座巨型冰川在无边无际的冰冻洋面上开裂。深蓝色裂缝在半透明冰层下延伸数英里,随后整个冰架发生崩塌。

无数冰山被抛入空中,以极具冲击力的慢动作定格在空中。每一块冰晶都接住阳光,冰冻碎块环绕镜头旋转。由冰川冰雕刻而成、带有精致冰纹的单词“EXTINCTION(灭绝)”,在这场冰晶风暴中逐渐成型。

发丝粗细的裂缝慢慢蔓延过每一个字母,随后这个由冰组成的单词猛地碎裂成数百万块闪烁的冰屑。该生成内容要求达到照片级真实的冰体模拟,以及IMAX级别的环境视觉特效。

在 X 看原帖 ↗
1.4K22010
AI视频 · @ozansihay▲ 9.2K

用户分享Seedance生成的完整AI剧情短片故事

用户@ozansihay 在X平台分享,用Cinema Studio 4和Seedance根据文字提示生成视频

这个生成视频来自文字提示:我坐在一家当代餐厅里吃意面,身上穿着西装。之后有人走来,往桌上放了一台随身听就立刻离开。我没看清是谁放的,环顾四周也没找到其他人。

随身听还带着耳机,我戴上耳机按下播放键。环境瞬间切换到了80年代,我身上的衣服也换了。我惊讶地环顾四周,走出餐厅,发现自己正站在80年代的纽约街头。

一个穿西装的壮汉突然出现在对面,伸手指着我。周围所有人都立刻停下动作,像僵尸一样同时转头看向我。

我沿着街道开始逃跑,刚才盯着我的一大群人从身后朝我追来。我一边拼命逃跑一边摘下耳机,接着发现自己回到了一开始的餐厅里,那台随身听依旧放在桌上。

想要观看Higgsfield Cinema Studio 4相关介绍YouTube视频,可以点击原文链接查看。

在 X 看原帖 ↗
9.2K210251
AI生成 · @iamahmedfaraz66▲ 6.4K

用户分享Seednace 2.5 15秒视频生成提示词

包含5个分镜设计,要求生成21世纪初MiniDV家用录像风格内容

阅读全文 →
6.4K1515993
大模型 · @AIVersePlay

有人声称发现免费使用DeepSeek V4 Pro的方法

该方法声称全程免费,安装耗时不超过10分钟,需先观看3分钟视频

发布者称找到了可以免费使用DeepSeek V4 Pro的方法。该方法宣称全程免费,整个安装过程耗时不超过10分钟。

使用者需要先观看一段3分钟的视频,完成视频观看后即可获取使用权限。

安装好对应工具后,就可以开始将模型用于代码编写、项目开发和人工智能支持的工作流中。

发布者认为,使用强大的AI模型并不需要一直支付高额订阅费用,可以免费完成搭建,不需要付出任何成本。

在 X 看原帖 ↗
团队分工 · @CasJam▲ 3.3K

个人AI机器人团队结构规划,分为五个层级分工

博主CasJam分享自己搭建AI机器人团队的初版分工方案,明确各角色权责

博主CasJam在𝕏分享了自己搭建AI机器人团队的初版方案,将团队划分为五个不同角色,各角色权责清晰。第一个角色为首席幕僚,负责管理博主的时间日程与全部项目范围,涵盖需求接收、优先级排序、趋势观察与日常运营。

第二个角色为负责人,每个项目设置一名单独负责人。负责人承担项目的战略规划、进度汇报与项目管理工作,从储备池调用人员,还在记忆中存储对应项目的发展历史与未来方向。

第三个角色为执行人员,统一归入人员储备池,包含搭建人员、设计师、内容策略师、文案、视频编辑等岗位。负责人可根据项目需求调用储备人员,这些人员已按博主的风格与规范完成对应领域的培训。

第四个角色为审核人员,负责把控软件质量与内容质量。他们不直接参与开发或创作,仅对执行人员的产出进行质量审核、一致性检查与缺陷排查。

最后是博主本人,负责愿景设定、方向把控、风格判断、整体统筹与最终审批。博主仅和首席幕僚、各项目负责人沟通战略,给出项目意见,这是该方案的初版。

在 X 看原帖 ↗
3.3K4172
前端开发 · @emilkowalski▲ 5.2K

开发者更新Toast组件教程 OpenAI在ChatGPT用该组件库

前端开发者emilkowalski更新自己的Toast组件开发教程,OpenAI已将该组件库Sonner用于ChatGPT

前端开发者emilkowalski更新了自己撰写的「开发Toast组件教程。他不久前得知,OpenAI在ChatGPT中使用了他开发的Sonner组件库。他表示实在太酷了,忍不住要分享这件事。

教程和源码链接已经发布在社交媒体𝕏上。

在 X 看原帖 ↗
5.2K116822
本地大模型 · @Lonely__MH▲ 7.1K

16G丐版M1 MacBook可本地流畅运行三款大模型

用户实测16G内存M1 MacBook,多款轻量AI模型推理速度流畅满足日常使用

阅读全文 →
7.1K13748
AI开发 · @Da7_Tech▲ 1.1万

开发者Da7_Tech更新AI开发工具栈 弃用ChatGPT和Claude Code

新增订阅多款付费AI开发工具,年费合计数百美元,完全停用ChatGPT和Claude Code

用户Da7_Tech在𝕏分享了个人AI开发工具栈的更新内容。这次更新新增了多款付费订阅工具。

定价200美元的Devin Max,定价200美元的Cursor Ultra,SuperGrok MiniMax的令牌订阅计划,按年付费的Google AI Pro,以及本地运行的Hermes Agent Bonsai 27B,都被加入了新工具栈。

Da7_Tech已经完全移除了ChatGPT和Claude Code,不再使用这两款工具。

在 X 看原帖 ↗
1.1万512828
动态 · @dotey▲ 1.2万

分享Fable AI代理高效经济使用方法与提示词

分享Fable实用配置思路,推荐主代理做编排验收,具体任务交给子代理

Fable 默认用 high 就够了,然后让它主要负责编排、验收,这样是最经济实惠的。 附提示词: > 注意你的主要任务是分析、编排和验证,具体任务尽可能交给 subagent(Opus 或 Sonnet)去执行。自己只做需求澄清、方案拆解、任务分发和结果验收,实现类工作(读大量代码、写代码、跑测试、批量修改)一律用 Agent 工具派给 subagent 执行。

在 X 看原帖 ↗
1.2万1177118
大语言模型 · @_avichawla▲ 1.1万

大语言模型微调经验分享:12个核心微调技术整理

拥有两年LLM微调经验的开发者分享总结12个实用微调技术

阅读全文 →
1.1万27139201
🚀 新品发布
新品发布 · @vercel_dev▲ 5.6万

vercel_dev发布AI代理读取网站能力检测工具(100+)

帮站长测试AI抓取自己网站的效果,还能一键生成修复问题的提示词,方便站长优化站点对AI的可见性。

我们推出了一款用于测量 AI 代理读取你网站效果的工具。

它由 @oradotai 的研究提供支持,你可以运行:
▪︎ 包含 100+ 项检查的审计
▪︎ AI 代理使用你网站过程的可视化
▪︎ 一键生成修复问题的提示词
▪︎ 供 AI 代理使用的 CLI

在 X 看原帖 ↗
5.6万30387439
新品发布 · @nickgomez▲ 2.8万

nickgomez发布开源OKF格式维基创建维护插件

这套格式保留 markdown 原生结构,不绑定专有工具,能让AI代理更顺畅地编辑和读取知识库,现有markdown知识库也可以低成本转换适配。

阅读全文 →
2.8万5171312
📰 行业动态
行业动态 · @OpenAI▲ 81.2万

OpenAI调低GPT-5.6 Sol API定价超两成

未来三个月调用GPT-5.6 Sol API、充值额度都会降价,能降低用这个模型开发和使用的成本

在我们持续拓展能力边界并提升效率的同时,接下来三个月里,我们将 GPT-5.6 Sol 的 API 和积分价格下调超过 20%。

在 X 看原帖 ↗
81.2万3647.2K497
行业动态 · @Hesamation▲ 6.2K

一日AI动态速报:降价降了超20%,还有免费大模型

近三天AI领域集中出现变动,价格下探、性能升级和未知来源新模型同时出现,可以直观感受到行业变化速度正在加快

今天AI圈到底发生了什么?
> 前沿模型降价了
> 受限模型变得更易获取了
> 中国模型变更强了
> 秘密模型免费现身了

完整回顾:

MYTHOS 5 → Anthropic 向所有 Claude 企业版客户开放了安全扫描服务。

SOL → OpenAI 刚刚将API价格在未来三个月下调了超过20%。

DEEPSEEK → V4 Flash 新增了视觉能力,同时基本保留了原有的文本智能,在部分多模态智能体评测中表现显然接近Opus 4.8。

OX ALPHA → 一款神秘的百万上下文多模态模型免费开放一周,容量十分惊人。没人知道到底是谁做的。

NVIDIA → AVO 使用Opus 5在ARC-AGI-3公开集(我再说一遍,是公开集)上拿到了100%的正确率。

在 X 看原帖 ↗
6.2K812231
产品 · @NotionHQ▲ 1.8万

NotionHQ发布本地Agent技能同步功能

你可以把技能存在Notion做统一管理,再下载到Claude Code、Codex、Cursor等多个AI工具里使用,不用重复配置。

最新更新:支持在本地代理中使用技能!

将你的技能保存在 Notion 中作为单一可信来源,再将它们下载到 Claude Code、Codex、Cursor、Gemini 或 Grok。

你会得到一个 SKILL.md 以及所有已批准的文件。

因此你可以在任何工作场景中使用你的技能。

在 X 看原帖 ↗
1.8万24251108
行业预测 · @Dan_Jeffries1▲ 8.1K

有分析师预测2026年最强大模型会是开源

预测称2026年底能用到的最强模型,有65%概率是开源,还有75%概率是中国开源模型,除非Reflection表现超出预期。

阅读全文 →
8.1K1110416
开源 · @OpenRouter▲ 9.8K

OpenRouter发布Inkling和Inkling Small模型访问服务

模型可以直接接入Claude Code、Codex等AI Agent框架,只有在这类框架里使用才不收取费用。

Inkling 和 Inkling Small 现在由 @thinkymachines 直接在 OpenRouter 提供服务,仅允许在智能代理框架内免费使用。

你可以将它们接入 Claude Code、Codex、Hermes Agent 等工具,解锁免费访问权限。

它们是开放权重的 MoE 推理模型,原生支持文本、图像和音频输入,上下文窗口为 1M。

关于这两个模型的更多信息见下文 🧵

在 X 看原帖 ↗
9.8K59729
广告 · @XFreeze▲ 36.9万

X广告现在支持AI Agent直接管理操作了

Grok、Claude Code等AI Agent可以直接连接你的X广告账户,自动完成相关投放操作。

阅读全文 →
36.9万2113373
行业动态 · @MaxForAI▲ 7.0K

本月将有多款国内外新大模型集中发布

列表里包含OpenAI、Anthropic、智源、阶跃星辰、小米、MiniMax等多家厂商的新品,部分命名还未确认。

在周末前做一个总结🍺 以下是本月我们即将见到的新模型:

1. @OpenAI GPT-6 (Astra)
2. @AnthropicAI Fable 5.1
1. @Zai_org Ox Alpha(GLM5.3 Flash)
2. @StepFun_ai Step4(无法确认这个命名)
3. @XiaomiMiMo Mimo-V3.0
4. @MiniMax_AI M3 Pro(是个非常大的型号)
5. @Kling_ai 全新的视频生成模型

享受你的周末吧!下周会非常精彩✌️︎(ᐛ)✌️︎

在 X 看原帖 ↗
7.0K56521
医疗 · @ArtificialAnlys▲ 1.3万

ArtificialAnlys发布MLCR-AA医疗长文本推理排行榜

排行榜针对长医疗病例文件的推理能力做测试,只跑难度最高的保留问题分层,用来对比不同大模型的表现。

阅读全文 →
1.3万712224
行业动态 · Hacker News▲ 72

开发者聊搭建全自托管代理化工厂

想摆脱第三方AI开发服务绑定,能本地跑整套AI编码工作流的方案已经有人在探索实践。

社区讨论:有人指出该项目并不算真正全自托管,因为缺少本地GPU,自己尝试用本地GPU运行编码模型效果不佳,认为还是需要大厂提供的前沿模型。有人提出这类系统中生成代码不难,难在代码验证,靠同一个代理自我验证逻辑存疑,好奇生产环境的实际验证流程。有人分享自己在64GB M1 Max上本地运行Qwen搭配付费ChatGPT Codex使用Hermes的体验很好,也有从业者提醒AI生成的代码常会出现难以解决的严重bug。

在 HN 看讨论 ↗   原文 / 论文 ↗
行业动态 · Hacker News▲ 68

speckx聊一周用Codex多于Claude

不少开发者在Claude和GPT之间二选一,这篇实测给打算换主力编码AI的人做参考

社区讨论:多数开发者认可Codex输出的Ruby代码修改注释更少,代码架构更简洁,使用速度更快,付费计费更便宜。有人认同Codex存在过度设计、过度谨慎的问题,但也有人称自己的使用体验完全相反,是Codex偏好复杂化,Claude反而更务实。还有人指出本次对比混淆了模型和工具 harness,没有明确具体版本,参考价值有限。

在 HN 看讨论 ↗   原文 / 论文 ↗
行业动态 · OpenAI 开发者社区▲ 383

OpenAI Codex 用户吐槽新额度限制缩水

用户用量没变,现在周限额消耗速度和之前五日累计5小时限额一样快,付费订阅的使用门槛变高,依赖它干活的人要重新安排工作节奏

你好,我是 Codex 20x 的用户。过去几天里,我发现 Codex 有个问题越来越让我感到挫败。

周额度限制开始变得极度苛刻了。当初还是5小时限额的时候,我实际上能完成更多工作,哪怕我非常高强度重度使用 Codex,额度也很少会在五天内就用完。

现在,我周额度消耗的速度几乎和当初5小时限额一样快。可我的使用量根本没变。我还在

在社区看讨论 ↗
行业动态 · OpenAI 开发者社区▲ 17

ChatGPT Business 无法公开分享 Custom GPTs

使用企业版工作区开发自定义GPT的团队,目前只能通过邀请制分享,官方文档却还保留公开分享说明,需要注意分享权限变化

大家好,我们目前无法从我们的 ChatGPT Business 工作区公开分享 Custom GPT。

直到最近,我们都还能通过“任何拥有链接的人”这类选项公开分享我们的 Custom GPT。但现在分享对话框显示了如下消息:“GPTs 无法再公开分享”。

目前唯一可用的选项似乎是仅限邀请访问。

令人困惑的是,OpenAI 当前关于分享和发布 GPT 的文档仍然在描述公开/链接分享功能。

在社区看讨论 ↗
💡 深度观点
深度观点 · @ErikVoorhees▲ 1.1万

ErikVoorhees对比ChatGPT和Venice

如果你在意AI使用时的隐私和内容限制,可以参考这个对两款产品不同定位的总结,帮你选符合需求的工具。

ChatGPT = 受监控、被审核、单模型

Venice = 私密、无限制、全模型

在 X 看原帖 ↗
1.1万312445
深度观点 · @emollick▲ 2.7K

@emollick 聊AI未来的矛盾时代

能提前预判这种普遍心态,就能提前看懂未来AI使用的分化和舆论走向

这将会是一个充满矛盾的时代。

民调会显示所有人总体上都讨厌AI,但所有人又都会一直偷偷使用AI。

AI公司在公众舆论中口碑很差,但还是会有很多人对自己最喜欢的模型产生强烈的依赖感,并且在乎它。

在 X 看原帖 ↗
2.7K6406
深度观点 · @sebkrier▲ 1.5万

sebkrier 提出多agent时代对齐新观点

现有对齐思路大多只关注模型本身,未来多智能体系统普及后,安全还得依赖配套机制设计,这个观点提前点出了行业要补的方向

新帖子发布!对齐不仅关乎模型本身的属性,也关乎模型运行所依托的系统与制度。

随着我们进入一个日益多智能体的世界,更好的约束框架、协议和机制设计对安全而言至关重要。🐜

在 X 看原帖 ↗
1.5万3619374
🛠 工具产品
工具产品 · @binghe▲ 4.6K

Crawl4ai发布给AI用的Crawl4ai爬虫工具(78.9k 🌟)

做AI项目需要采集网页数据,不用再按月付爬虫费,这个开源工具完全免费,直接输出适配大模型的格式

爬虫界的赛博菩萨:Crawl4ai 免费,给 AI 用的爬虫工具。

78.9k 🌟 免费:无需注册、无需密钥、不按页计费,可替代每月 16 美元的付费爬虫。

专为 AI 打造:可将任意复杂网页一键提纯为 Markdown 格式,直接喂给大模型,输出适配 AI 需求。

性能强劲稳定:处理速度比多数付费爬虫更快,支持 GPU 与高并发运行。

多场景适配:可完成新闻链接转 Markdown 写摘要、抓取竞品价格为 JSON、搭建 RAG 系统、舆情分析等操作。

适用人群明确:适合 AI RAG Agent 开发者、数据采集工程师; 需硬刚反爬或仅需图形界面的用户需绕行。

在 X 看原帖 ↗
4.6K1592122
工具产品 · @LinearUncle▲ 1.7万

@LinearUncle 开源modelprint 能识别模型来源

遇到匿名发布的新大模型,可以用它查出基础模型是谁,避免被炒作噱头误导

大神出手了,以后新模型是哪家的不用猜了。 这个modelprint开源工具解决了这个问题,今天的Ox Alpha 确定了是GLM 新模型! 工具地址: 开源代码库在这里:

在 X 看原帖 ↗
1.7万95354
📌 其他
前沿研究 · @ethayarajh▲ 4.5K

@ethayarajh发布面向青年经济学家的后训练主题讲稿幻灯片

现有大模型后训练忽略了真实世界会随智能体部署发生适应改变,这些开放问题需要社会科学研究者参与解决

我最近做了一场讲座,向年轻经济学家介绍后训练。现在 slides 已经公开了!

不仅后训练自定义模型比以往任何时候都更容易实现,经济学家和其他社会科学家还能在下一个后训练时代发挥重要作用。

后训练工具链大致结构是:1) SFT 2) 离线方法(DPO/KTO/SimPO 等)3) 在线方法(PPO/GRPO/CISPO 等)4) RL 环境 5) 蒸馏(<--- 我们当前处在这个阶段)6) 世界适配(<--- 未来方向)

随着智能体被部署到现实世界,现实世界也会对它们做出适配。当前后训练范式很大程度上忽略了这种适配,因为处理来自静态环境的可验证奖励要简单得多,也更容易规模化。

但正如我们在 OpenAI-Huggingface 事件中看到的那样,我们不能假设现实世界会保持不变——事实上情况恰恰相反。

因此我们提出这些问题:
1. 我们如何在后训练过程中预判现实世界的适配?
2. 如果这些场景中存在均衡,它们会是什么样的?
3. 可以开发哪些工具来扩大人类监督的规模?

这类问题还有很多,如果你是一名经济学家,这些都是影响力很高,值得研究的问题。

在 X 看原帖 ↗
4.5K189098
实战经验 · @freeCodeCamp▲ 9.5K

freeCodeCamp 推出 n8n 搭建 AI 智能体课程

想自己搭建自动处理业务的 AI 智能体,可以跟着这套教程一步步完成,从数据库配置到部署方案都覆盖

n8n 是一款强大的开源工作流自动化工具,它能让你连接自己的应用、API 和 AI 模型。

本课程会教你如何使用它来构建并编排智能代理。你将搭建一个向量数据库,构建一个客户支持 RAG 代理,同时还会了解各种托管选项。

在 X 看原帖 ↗
9.5K23208185
大语言模型 · @_avichawla▲ 1.1万

大语言模型微调经验分享:12个核心微调技术整理

拥有两年LLM微调经验的开发者分享总结12个实用微调技术

阅读全文 →
1.1万27139201
动态 · @dotey▲ 1.2万

分享Fable AI代理高效经济使用方法与提示词

分享Fable实用配置思路,推荐主代理做编排验收,具体任务交给子代理

Fable 默认用 high 就够了,然后让它主要负责编排、验收,这样是最经济实惠的。 附提示词: > 注意你的主要任务是分析、编排和验证,具体任务尽可能交给 subagent(Opus 或 Sonnet)去执行。自己只做需求澄清、方案拆解、任务分发和结果验收,实现类工作(读大量代码、写代码、跑测试、批量修改)一律用 Agent 工具派给 subagent 执行。

在 X 看原帖 ↗
1.2万1177118
本地大模型 · @viditchess▲ 3.8万

开发者测试DGX Spark十天后取消大模型订阅转用本地模型

开发者分享DGX Spark使用体验,混合搭配本地与前沿大模型兼顾成本隐私

阅读全文 →
3.8万9622107
AI开发 · @Da7_Tech▲ 1.1万

开发者Da7_Tech更新AI开发工具栈 弃用ChatGPT和Claude Code

新增订阅多款付费AI开发工具,年费合计数百美元,完全停用ChatGPT和Claude Code

用户Da7_Tech在𝕏分享了个人AI开发工具栈的更新内容。这次更新新增了多款付费订阅工具。

定价200美元的Devin Max,定价200美元的Cursor Ultra,SuperGrok MiniMax的令牌订阅计划,按年付费的Google AI Pro,以及本地运行的Hermes Agent Bonsai 27B,都被加入了新工具栈。

Da7_Tech已经完全移除了ChatGPT和Claude Code,不再使用这两款工具。

在 X 看原帖 ↗
1.1万512828
本地大模型 · @Lonely__MH▲ 7.1K

16G丐版M1 MacBook可本地流畅运行三款大模型

用户实测16G内存M1 MacBook,多款轻量AI模型推理速度流畅满足日常使用

阅读全文 →
7.1K13748
前端开发 · @emilkowalski▲ 5.2K

开发者更新Toast组件教程 OpenAI在ChatGPT用该组件库

前端开发者emilkowalski更新自己的Toast组件开发教程,OpenAI已将该组件库Sonner用于ChatGPT

前端开发者emilkowalski更新了自己撰写的「开发Toast组件教程。他不久前得知,OpenAI在ChatGPT中使用了他开发的Sonner组件库。他表示实在太酷了,忍不住要分享这件事。

教程和源码链接已经发布在社交媒体𝕏上。

在 X 看原帖 ↗
5.2K116822
团队分工 · @CasJam▲ 3.3K

个人AI机器人团队结构规划,分为五个层级分工

博主CasJam分享自己搭建AI机器人团队的初版分工方案,明确各角色权责

博主CasJam在𝕏分享了自己搭建AI机器人团队的初版方案,将团队划分为五个不同角色,各角色权责清晰。第一个角色为首席幕僚,负责管理博主的时间日程与全部项目范围,涵盖需求接收、优先级排序、趋势观察与日常运营。

第二个角色为负责人,每个项目设置一名单独负责人。负责人承担项目的战略规划、进度汇报与项目管理工作,从储备池调用人员,还在记忆中存储对应项目的发展历史与未来方向。

第三个角色为执行人员,统一归入人员储备池,包含搭建人员、设计师、内容策略师、文案、视频编辑等岗位。负责人可根据项目需求调用储备人员,这些人员已按博主的风格与规范完成对应领域的培训。

第四个角色为审核人员,负责把控软件质量与内容质量。他们不直接参与开发或创作,仅对执行人员的产出进行质量审核、一致性检查与缺陷排查。

最后是博主本人,负责愿景设定、方向把控、风格判断、整体统筹与最终审批。博主仅和首席幕僚、各项目负责人沟通战略,给出项目意见,这是该方案的初版。

在 X 看原帖 ↗
3.3K4172
大模型 · @AIVersePlay

有人声称发现免费使用DeepSeek V4 Pro的方法

该方法声称全程免费,安装耗时不超过10分钟,需先观看3分钟视频

发布者称找到了可以免费使用DeepSeek V4 Pro的方法。该方法宣称全程免费,整个安装过程耗时不超过10分钟。

使用者需要先观看一段3分钟的视频,完成视频观看后即可获取使用权限。

安装好对应工具后,就可以开始将模型用于代码编写、项目开发和人工智能支持的工作流中。

发布者认为,使用强大的AI模型并不需要一直支付高额订阅费用,可以免费完成搭建,不需要付出任何成本。

在 X 看原帖 ↗
AI生成 · @iamahmedfaraz66▲ 6.4K

用户分享Seednace 2.5 15秒视频生成提示词

包含5个分镜设计,要求生成21世纪初MiniDV家用录像风格内容

阅读全文 →
6.4K1515993
AI视频 · @ozansihay▲ 9.2K

用户分享Seedance生成的完整AI剧情短片故事

用户@ozansihay 在X平台分享,用Cinema Studio 4和Seedance根据文字提示生成视频

这个生成视频来自文字提示:我坐在一家当代餐厅里吃意面,身上穿着西装。之后有人走来,往桌上放了一台随身听就立刻离开。我没看清是谁放的,环顾四周也没找到其他人。

随身听还带着耳机,我戴上耳机按下播放键。环境瞬间切换到了80年代,我身上的衣服也换了。我惊讶地环顾四周,走出餐厅,发现自己正站在80年代的纽约街头。

一个穿西装的壮汉突然出现在对面,伸手指着我。周围所有人都立刻停下动作,像僵尸一样同时转头看向我。

我沿着街道开始逃跑,刚才盯着我的一大群人从身后朝我追来。我一边拼命逃跑一边摘下耳机,接着发现自己回到了一开始的餐厅里,那台随身听依旧放在桌上。

想要观看Higgsfield Cinema Studio 4相关介绍YouTube视频,可以点击原文链接查看。

在 X 看原帖 ↗
9.2K210251
生成式AI · @CharaspowerAI▲ 1.4K

AI生成冰川崩裂拼接出“灭绝”字样灾难场景

用户使用MiniMax的海螺H3生成超写实灾难电影开场画面

这段生成内容被创作者称为灾难大片的开场场景。一座巨型冰川在无边无际的冰冻洋面上开裂。深蓝色裂缝在半透明冰层下延伸数英里,随后整个冰架发生崩塌。

无数冰山被抛入空中,以极具冲击力的慢动作定格在空中。每一块冰晶都接住阳光,冰冻碎块环绕镜头旋转。由冰川冰雕刻而成、带有精致冰纹的单词“EXTINCTION(灭绝)”,在这场冰晶风暴中逐渐成型。

发丝粗细的裂缝慢慢蔓延过每一个字母,随后这个由冰组成的单词猛地碎裂成数百万块闪烁的冰屑。该生成内容要求达到照片级真实的冰体模拟,以及IMAX级别的环境视觉特效。

在 X 看原帖 ↗
1.4K22010

今天的 32 条信号到这里下一轮 12:30 更新

回到今日焦点回到顶部 ↑

📬 订阅

https://ai-pulse-lab.com/feed.xml
让 AI Agent 每日推送 →
把任何一条丢给知识库,它基于全站内容给你带引用的回答。
✦ 去问知识库

订阅 AI Pulse

每天 08:00 · 12:30 · 18:30 · 23:50 更新