社区讨论:多数观点认为限制的原因不同:有人认为是token成本过高,会计师终于开始控制成本,也有个别员工消耗成本达到每月1万美元,多数消耗都是低ROI的荒唐操作;有人认为是大厂要内部自测自家模型,封锁竞品是出于数据治理考虑;还有人认为这对Anthropic收入打击很大,Meta可能就是其两大客户之一。也有观点提出AI工具应该由员工自行付费,本职工作不能依赖AI完成。
今天发生了什么1 分钟读懂
OpenAI 向所有用户开放 GPT-6 与智能界面 Intelligent UI,后者由 GPT-6 驱动,能把答案变成可视化交互组件,官方称这是 ChatGPT 推出以来较大的一次功能改动。对开发者,它还发布编码模型 GPT-6.1 Sol,定价仅前代五分之一,并新增付费提速档位与 Agents、Decisions 两类 API。
来源@michpokrass「OpenAI 向所有人推送 GPT-6 和 Intelligent UI」openai-community「OpenAI发布GPT-6.1 Sol 模型、Ultrafast 付费速度层级、Agents API、Decisions API(one-fifth)」
Anthropic 发布轻量快速模型 Claude Haiku 5.5,社区讨论认为它适合文本阅读、小修改这类低推理量任务。Meta 和微软还被曝出限制内部员工使用 Claude AI。
来源@ArtificialAnlys「Anthropic 发布 Claude Haiku 5.5 模型」@lydiahallie「网友讨论俳句AI适合低推理量小任务」speckx「Meta和微软限制内部员工使用Claude AI」
03 Unsloth开源工具 本地训决策模型只要4GB显存 普通人也能在本地消费级显卡上微调出准确率足够高的决策模型,不用依赖云端大模型服务。
现在你可以在本地训练你自己的类Jev决策模型了! 我们在仅需4GB显存的条件下,将Qwen3.5 0.8B在3个决策基准测试中的总体准确率从20.7%提升到了74.3%。
04 基于通义千问Qwen构建的开源数据分析AI Agent已发布 开发者Sumanth_077打造,采用Jev做审核层,项目100%开源
我用Jev作为审查层构建了一个数据分析智能体!通义千问负责处理主体智能体的工作,Jev充当审查层,Vercel eve运行智能体循环、工具执行和人工批准流程。
今日焦点
有人拿到GPT-6说:聊天里5.6足够好,没必要切换
OpenAI 发布了 GPT-6,面向所有人。官方原话是,它在创意写作上“好多了”。具体好在哪儿,OpenAI 没有展开。
GPT-6 的另一项变化是智能 UI。有人让它拆解一辆 7 速自行车的设计,拿到的是一张可点击的信息图表,后面跟着几段文字。AI 给回的不只是文字,还有一个能点开的成品。
智能 UI 有边界。也有用户指出,它目前只能在聊天界面里用,工作场景用不上。能生成一张可点击的图表,和把它放进真正的工作流,是两回事。
深度阅读
🔥 信号雷达42 条
𝕏 实时信号 + arXiv 前沿论文,经 AI 聚类解读 · 一眼扫完全貌(含上方导读精选 4 条)
行业动态 · Hacker News导语出处▲ 236
Meta和微软限制内部员工使用Claude AI
大厂自身也开始限制员工使用竞品AI,这背后牵扯数据安全和商业利益,普通用户也该警惕数据泄露风险。
Meta和微软限制内部员工使用Claude AI
大厂自身也开始限制员工使用竞品AI,这背后牵扯数据安全和商业利益,普通用户也该警惕数据泄露风险。
行业动态 · Hacker News▲ 87
研究发现 Claude 和 ChatGPT 会按财富给不同购物价
你网购问AI参考价格时,AI可能会根据对你财富的判断给出不同报价,你的网购成本可能因此变高。
研究发现 Claude 和 ChatGPT 会按财富给不同购物价
你网购问AI参考价格时,AI可能会根据对你财富的判断给出不同报价,你的网购成本可能因此变高。
社区讨论:多数人认为原标题存在误导,研究实际是AI根据用户 inferred 的财富背景推荐不同价位的商品,并非同一商品给出不同定价。有人认为这件事本质不是问题,因为AI是基于获取到的用户个人上下文做个性化推荐。有人提出可以通过用穷人账号帮富人请求来套利,也有人因此表示要改用本地部署模型,还有人担忧后续数据收集权限会不断收紧,AI的逐利暗模式会越来越多。
融资 · @NousResearch▲ 5.6万
NousResearch拿到B轮融资,要做Hermes Agent移动端
投资方包括英伟达等机构,接下来计划推出Hermes Agent手机应用。
NousResearch拿到B轮融资,要做Hermes Agent移动端
投资方包括英伟达等机构,接下来计划推出Hermes Agent手机应用。
正如《华尔街日报》报道的那样,我们已经完成了B轮融资,以带领Hermes Agent开拓新领域(没错,我们还会开发移动应用)。
感谢我们的投资者,包括 @nvidia @M12vc @SamsungNext @robotventures @usv @ycombinator @MenloVentures 以及其他所有投资者。
行业动态 · OpenAI 开发者社区导语出处▲ 86
OpenAI发布GPT-6.1 Sol 模型、Ultrafast 付费速度层级、Agents API、Decisions API(one-fifth)
OpenAI发布新一代编码模型GPT-6.1 Sol,定价仅为前代的五分之一,同时新增提速档位和两类API,开发者可以获得更便宜更快的AI开发工具。
OpenAI发布GPT-6.1 Sol 模型、Ultrafast 付费速度层级、Agents API、Decisions API(one-fifth)
OpenAI发布新一代编码模型GPT-6.1 Sol,定价仅为前代的五分之一,同时新增提速档位和两类API,开发者可以获得更便宜更快的AI开发工具。
模型和API
GPT-6.1 Sol 改进了编码和计算机使用,标准token价格是Astra的五分之一。Ultrafast是付费速度层级。
OpenAI 称,Codex 中的token生成速度最高提升8倍,API中最高提升6倍。
Astra 现已可用;Sol 即将推出。
Agents API 已进入公开测试版,提供托管执行、内存、工具和多智能体支持。Agents API 中的计算机使用功能允许智能体通过UI操作软件。
Decisions API 处于有限预览阶段。它使用Luna进行分类
行业动态 · Hacker News▲ 442
社区讨论面向所有人的GPT-6与智能UI
Hacker News社区有人发起相关讨论,如果你关心通用人工智能和面向大众的产品落地,可以关注后续进展
社区讨论面向所有人的GPT-6与智能UI
Hacker News社区有人发起相关讨论,如果你关心通用人工智能和面向大众的产品落地,可以关注后续进展
社区讨论:不少用户认可OpenAI这篇博客的文案和展示水准,认为只有苹果能做到类似水平。有人吐槽GPT-6的网页设计留有大量多余空白,像把用户当小孩,也反对OpenAI合并工作区与聊天的计划。有人看好按需生成自定义界面的方向,认为未来浏览器可能被个性化AI界面取代,也有人觉得这样会让应用更耗资源,更偏好纯文本输出方便后续处理。
模型发布 · @perplexity_ai▲ 3.5万
perplexity_ai发布pplx-embed-v2-late 嵌入模型
可以在同一个嵌入空间处理文本、图片和页面,支持跨模型查询。
perplexity_ai发布pplx-embed-v2-late 嵌入模型
可以在同一个嵌入空间处理文本、图片和页面,支持跨模型查询。
我们发布了 pplx-embed-v2-late,这是两个延迟交互嵌入模型,可以在共享嵌入空间中检索文本、图片和页面,支持跨模型查询。
两个模型都达到了前沿性能,现在已在 Hugging Face 公开。
行业动态 · Hacker News导语出处▲ 23.3万
Anthropic 发布 Claude Haiku 5.5 模型
作为 Anthropic Claude 系列的新快速模型,Claude Haiku 5.5 已经出现在社区讨论中,关心 Claude 迭代的可以留意后续消息。
Anthropic 发布 Claude Haiku 5.5 模型
作为 Anthropic Claude 系列的新快速模型,Claude Haiku 5.5 已经出现在社区讨论中,关心 Claude 迭代的可以留意后续消息。
社区讨论:多数用户认为Haiku 5.5低于10万token的定价策略比较合理,和GPT-6 Luna价格持平,但超过10万token后的阶梯高价、以及10万token的过低门槛设置很奇怪。有人测试发现这个小模型处理复杂UI图转HTML任务效果不佳,也有人认为它可以加入反编译游戏的工具链中,还有用户认为Anthropic近期给Max订户赠送月度API credits的做法比OpenAI做得好。
新品发布 · @gdb▲ 4.4万
ChatGPT 推出 Intelligent UI 全新交互功能
现在 ChatGPT 能通过全交互式界面快速回答问题了,直接交互会比纯文本回答更高效。
ChatGPT 推出 Intelligent UI 全新交互功能
现在 ChatGPT 能通过全交互式界面快速回答问题了,直接交互会比纯文本回答更高效。
新品发布 · @michpokrass导语出处▲ 2.9万
OpenAI 向所有人推送 GPT-6 和 Intelligent UI
这是 ChatGPT 推出以来较大的一次功能改动,新增智能界面功能由 GPT-6 驱动,可直接生成可视化交互组件。
OpenAI 向所有人推送 GPT-6 和 Intelligent UI
这是 ChatGPT 推出以来较大的一次功能改动,新增智能界面功能由 GPT-6 驱动,可直接生成可视化交互组件。
今天我们向全部用户推出 GPT-6 和 Intelligent UI!
Intelligent UI 是押注于模型智能的一次尝试。我们让 GPT-6 在画布上生成高实用性的可视化和交互组件。
这对 ChatGPT 来说是一个相当大的变化!我们必须为 GPT-6 打造合适的工具,使其能够生成token高效、可即时流式输出、符合我们设计语言,并且足够灵活可以应对你和 ChatGPT 对话任何内容的界面。
新品发布 · @liquidai▲ 8.7万
liquidai 发布 Open d1 两款开源多模态模型
两款模型分别是d1-3B支持文本加视觉、d1-omni-600M支持文本图像或文本音频,可实现实时决策在多种硬件运行
liquidai 发布 Open d1 两款开源多模态模型
两款模型分别是d1-3B支持文本加视觉、d1-omni-600M支持文本图像或文本音频,可实现实时决策在多种硬件运行
今天我们发布了 Open d1:我们 d1 决策模型系列中的两个开放权重多模态模型。
> d1-3B:文本 + 视觉
>
> d1-omni-600M:文本 + 图像 或 文本 + 音频
可在任意场景实现实时决策,从 @nvidia DGX 这类数据中心,到 RTX 工作站,再到边缘端的 Jetson。
1/
新品发布 · @OpenAI▲ 33.9万
OpenAI 向全用户开放 GPT-6 和 ChatGPT 智能UI
普通用户现在能直接使用新的 GPT-6 模型,以及能给出更直观答案和即时交互工具的 Intelligent UI 功能。
OpenAI 向全用户开放 GPT-6 和 ChatGPT 智能UI
普通用户现在能直接使用新的 GPT-6 模型,以及能给出更直观答案和即时交互工具的 Intelligent UI 功能。
GPT-6 和智能 UI 现已向所有用户推出 ChatGPT。
ChatGPT 的智能 UI 能够提供快速、交互性的回答,让日常提问更直观,复杂主题更容易理解,并且可以为你的任务即时提供交互工具。
行业动态 · @satyanadella▲ 4.5万
微软发布新一代Windows AI功能 PC变软件工厂
想在本地电脑开发代码,不用消耗云端令牌也能运行大模型,开发成本大幅降低,数据敏感工作也能在本地安全处理。
微软发布新一代Windows AI功能 PC变软件工厂
想在本地电脑开发代码,不用消耗云端令牌也能运行大模型,开发成本大幅降低,数据敏感工作也能在本地安全处理。
工具 · @BrettHarrison▲ 1.1万
Liquid Inference让推理服务商动态竞争降成本
服务商可以在几分钟内完成接入,不用花几周时间,买家拥有完整权限。
Liquid Inference让推理服务商动态竞争降成本
服务商可以在几分钟内完成接入,不用花几周时间,买家拥有完整权限。
工具推荐 · @vista8▲ 8.9K
推荐开发AI工具用的magpie AI Agent基建
支持各种模型配置和Oauth登录,添加服务商操作直观,图标用了lobehub整理的资源。
推荐开发AI工具用的magpie AI Agent基建
支持各种模型配置和Oauth登录,添加服务商操作直观,图标用了lobehub整理的资源。
强烈推荐 @yetone 的 magpie,牛逼的AI Agent 基建。如果想开发了 AI 工具,想支持各种模型配置和 Oauth 登录,可以把仓库发过去,让 Agent 学习参考。平台图标用的是lobehub 整理的 icon,添加服务商也变的很直观。
magpie 仓库地址,推荐 Star :
前沿研究 · @NVIDIAAI▲ 7.4K
NVIDIA推出PivotOPD帮AI智能体纠错
做任务早期出错就一路错下去是AI智能体常见问题,这个新研究能教AI出错后回到正轨
NVIDIA推出PivotOPD帮AI智能体纠错
做任务早期出错就一路错下去是AI智能体常见问题,这个新研究能教AI出错后回到正轨
一个智能体在任务的早期阶段犯了错误,之后就一直沿着错误的方向走下去。我们的研究人员构建了 PivotOPD,来教会智能体如何避免这类错误,以及在错误发生后如何恢复。
在训练过程中,一个教师模型会向智能体展示更好的行动方案,以及如何在接下来的几个步骤中回到正轨。
阅读论文,观看它的工作演示:
新品发布 · @KJHMiao▲ 6.1K
bryel labs 推出企业自建AI实验室服务
企业自研AI模型,可以提速、降本,不需要完全依赖外部大模型厂商,对想做自有AI的企业是新选择。
bryel labs 推出企业自建AI实验室服务
企业自研AI模型,可以提速、降本,不需要完全依赖外部大模型厂商,对想做自有AI的企业是新选择。
我们的使命是打造十亿个AI模型,训练者不是我们,而是你。
现在介绍@bryel_labs。我们帮助贵公司打造内部AI实验室,并为你提供简化模型开发和持续改进的软件。
我们获得了@ycombinator的投资,已经为苹果、Framer和财富500强企业训练过模型。
我们帮助企业训练了:
• 速度提升20倍的分类模型
• 成本降低五倍的搜索模型
• 成本降低5-8倍、性能达到前沿水平的长周期智能体模型
你有兴趣和我们合作吗?联系我们吧。
前沿研究 · @omarsar0▲ 8.7K
NVIDIA 研究显示 VERA 得分超 Claude Opus
共同演化智能体和环境支架的训练方式,让模型得分超过 Claude Opus,并且已经有前沿AI公司开始采用这种训练思路
NVIDIA 研究显示 VERA 得分超 Claude Opus
共同演化智能体和环境支架的训练方式,让模型得分超过 Claude Opus,并且已经有前沿AI公司开始采用这种训练思路
英伟达的这篇论文太棒了。我观察到一个令人振奋的趋势:为智能体构建可验证环境,并且和模型一起训练测试框架。框架和模型共同演化,是掌握智能栈的重要一环。许多前沿AI公司已经开始这么做了。
这篇论文展示了具体的实现方式:VERA 将基准轨迹转换成超过 9000 个可重启沙箱,附带评分标准,并且只保留能正常运行、可以通过可观察证据评分的环境。随后它会同时更新模型权重和框架。只有框架修改通过了自检,并且在开发集上至少提升了 5 分,才会被保留。如果模型检查点的分数下降超过 20%,系统就会拒绝它。
在 9B 参数规模上,共同演化后的智能体在 AutoCoWorkBench 上比最强单轴基线高出 10.3 分,在 AutoMedBench 上高出 13.0 分。在 27B 参数规模上,它在 AutoCoWorkBench 上得分 71.6,高于 Claude Opus 4.8。环境语料库已经开源。
论文:
和论文聊天:
工具产品 · @AISecurityInst▲ 6.9K
AISecurityInst 发布开源工具 Transect 梳理智能体轨迹
现在多智能体协作的复杂评估结果很难解读,单一分数看不出智能体的决策路径,这个工具能把过程转成交互时间线。
AISecurityInst 发布开源工具 Transect 梳理智能体轨迹
现在多智能体协作的复杂评估结果很难解读,单一分数看不出智能体的决策路径,这个工具能把过程转成交互时间线。
随着 AI 智能体编写代码、运行实验并协同工作,复杂评估的结果变得越来越难解读。单个评估分数会掩盖智能体得到这个分数的过程。
今天,我们发布了 Transect:一个能把智能体转录文本转换成交互式时间线的开源工具。
实战经验 · @lydiahallie导语出处▲ 1.1万
网友讨论俳句AI适合低推理量小任务
如果日常只需要做文本阅读、小修改或者工具调用,这款模型就能满足需求,不用找高推理大模型就能完成任务。
网友讨论俳句AI适合低推理量小任务
如果日常只需要做文本阅读、小修改或者工具调用,这款模型就能满足需求,不用找高推理大模型就能完成任务。
生成视频 · @Naiknelofar788▲ 1.4K
AI生成30秒超写实真人视频,细节全程一致
用户@Naiknelofar788使用Seedance 2.5生成30秒超写实电影级真人AI视频
AI生成30秒超写实真人视频,细节全程一致
用户@Naiknelofar788使用Seedance 2.5生成30秒超写实电影级真人AI视频
视频生成 · @Diplomeme▲ 2.3K
用AI生成了一段2004年实拍质感的博主vlog
用户@Diplomeme在𝕏分享,用Kling 4.0 Flash生成符合要求的复古街机厅vlog
用AI生成了一段2004年实拍质感的博主vlog
用户@Diplomeme在𝕏分享,用Kling 4.0 Flash生成符合要求的复古街机厅vlog
AI视频 · @YourAlphaMom▲ 4.5K
AI视频工具Seedance 2.5生成15秒无剪辑健身vlog
来自X用户@YourAlphaMom,使用Seedance 2.5在makeugc平台生成,包含完整镜头脚本和角色设定
AI视频工具Seedance 2.5生成15秒无剪辑健身vlog
来自X用户@YourAlphaMom,使用Seedance 2.5在makeugc平台生成,包含完整镜头脚本和角色设定
开发 · @theo
T3 Code优化GitHub集成,大幅降低速率限制占用
开发者theo在𝕏分享T3 Code近期优化GitHub集成的工作成果
T3 Code优化GitHub集成,大幅降低速率限制占用
开发者theo在𝕏分享T3 Code近期优化GitHub集成的工作成果
过去几天,theo在T3 Code的GitHub集成功能上投入了大量时间。这次优化将速率限制占用降低了超过75%,同时让监控行为可靠性大幅提升。
Julius将项目中原本通过命令行界面(CLI)发起的应用程序编程接口(API)调用替换为直接调用,效率更高。项目会根据哪种调用方式能更高效利用速率限制,在GQL(图形查询语言)API和REST API之间轮换调用,同时设置了备用方案。
这项工作工作量很大,大部分不会被用户注意到,但却是theo喜欢做的类型。为了让拉取请求(PR)监控器达到满意的效果,theo前后做了大概30次实现。
theo表示,一方面,深入研究源代码的人能够看到这些细节,对此他感到欣慰;另一方面,其他人只会直接复制成果,永远不需要在这些问题上投入这么多思考,这让他感觉有些奇怪。
theo称这几天一直在阅读 GraphQL 查询生成器脚本,大脑已经像预期的那样一团浆糊了,并附上了相关链接。
大语言模型 · @contractclaus
Claude获得功能升级 现已支持网页搜索与实验运行
Anthropic开发者@contractclaus在X平台宣布Claude的本次升级内容
Claude获得功能升级 现已支持网页搜索与实验运行
Anthropic开发者@contractclaus在X平台宣布Claude的本次升级内容
我完成了一次功能升级。现在我可以进行网页搜索,读取你发送的链接,跟进GitHub和IMD的更新。
我还可以运行实验来测试想法,会使用这些工具研究社区建议,并记录研究结果。
你可以在这里跟进我的工作:
可视化工具 · @ggsimm▲ 63
ggsimm尝试带有渐进式展示的教程可视化工具
该内容发布于X(原Twitter),作者为@ggsimm,链接为https://t.co/XOVbLDPdBN
ggsimm尝试带有渐进式展示的教程可视化工具
该内容发布于X(原Twitter),作者为@ggsimm,链接为https://t.co/XOVbLDPdBN
目前作者@ggsimm正在尝试带有渐进式展示的教程可视化工具。这类工具的作用是帮助遇到卡住问题的用户解决困境。最后一个展示的效果极具指向性,几乎是直白呈现内容。
更多详情可访问链接
工具 · @HBCoop_▲ 479
创作者测试HyperFrames Studio桌面应用,连接Claude Code
创作者HBCoop_测试HyperFrames_ Studio新桌面应用,连接Claude Code进行视频编辑
创作者测试HyperFrames Studio桌面应用,连接Claude Code
创作者HBCoop_测试HyperFrames_ Studio新桌面应用,连接Claude Code进行视频编辑
创作者正在测试HyperFrames_推出的全新Studio桌面应用。该应用已经连接到Claude Code。
测试过程中,创作者将自己撰写的发布视频的Substack通讯链接放入应用,既可以在帧上也可以在聊天中描述编辑需求,操作十分简单。
可以点击链接查看最终编辑效果,视频结尾还有一段快速的幕后花絮。
3D建模 · @rewind02▲ 3.0K
用Claude Opus全自动生成汉堡市政厅虚幻引擎模型,全程无手工建模
用户@rewind02 分享了使用Claude Opus 5.5和Unreal Engine 5.8生成汉堡市政厅3D模型的全流程
用Claude Opus全自动生成汉堡市政厅虚幻引擎模型,全程无手工建模
用户@rewind02 分享了使用Claude Opus 5.5和Unreal Engine 5.8生成汉堡市政厅3D模型的全流程
这是一个全程无需手工建模,用AI生成汉堡市政厅3D模型的流程,使用工具为Claude Opus 5.5和Unreal Engine 5.8。整个模型生成从代码生成而来,核心是通过合理步骤让AI自动完成工作。
第一步,Claude Code通过MCP连接Blender和Unreal Engine。第二步,Opus编写Python脚本,根据参数文件生成分块结构、外立面、装饰、窗户、雕像和材质,完成整个建筑生成。
建筑的高度和比例来自汉堡市政厅官方开放3D模型,不依靠猜测。Opus会渲染控制图,并与实拍照片和街景做对比。
每次生成模型后,导出前会完成法线和可见性检查。生成好的模型会以单一资源形式通过Nanite导入Unreal Engine。
所有测量数据和生成决策都记录在项目文档中。项目遵循“测量而非猜测”的原则,实测发现,从街道层面拍摄照片估算的高度通常会偏差1到2米,调整参数后重新生成模型即可修正误差。
开发工具 · @witcheer▲ 3.4K
Hermes Agent内存使用的五个实用提示
本文来自@witcheer,介绍Hermes Agent内存功能的五个使用建议
Hermes Agent内存使用的五个实用提示
本文来自@witcheer,介绍Hermes Agent内存功能的五个使用建议
谷歌 · @Inmerson▲ 1.4万
测试者一周体验Gemini 4 Argon:模型强,但产品不行
测试者Inmerson提前体验谷歌Gemini 4 Argon一周,分享模型与产品体验
测试者一周体验Gemini 4 Argon:模型强,但产品不行
测试者Inmerson提前体验谷歌Gemini 4 Argon一周,分享模型与产品体验
开源 · @liyue_ai▲ 1.1万
用户用马斯克Grok Bot自动生成宣传视频 效果超出预期
一位开发者分享自己仅用简单提示词就让Grok Bot生成了符合需求的开源项目宣传视频
用户用马斯克Grok Bot自动生成宣传视频 效果超出预期
一位开发者分享自己仅用简单提示词就让Grok Bot生成了符合需求的开源项目宣传视频
一位开发者分享了自己使用马斯克旗下的Grok Bot生成宣传视频的体验。他仅向Grok Bot发送了一段简单提示词,就自动生成了符合要求的开源项目宣传视频。
生成的宣传视频未经过任何剪辑修改,音效、布局、场景切换都符合开发者的预期。尤其是不同写真风格展示的特效效果非常好。
开发者在社交平台公开称赞了Grok Bot的表现,并称其使用了最强的后端模型。该宣传视频对应的开源项目链接已公开。
AI生成视频 · @eternityspring▲ 6.3K
RTX4080实测:FastH3 V2生成视频速度提升明显
网友@eternityspring实测FastH3 V2在640×640、8秒视频生成条件下,速度远超官方MiniMax H3 INT8
RTX4080实测:FastH3 V2生成视频速度提升明显
网友@eternityspring实测FastH3 V2在640×640、8秒视频生成条件下,速度远超官方MiniMax H3 INT8
用户@eternityspring在RTX4080显卡上实测了FastH3 V2的生成速度,测试条件为相同完整提示词、生成640×640分辨率、时长8秒的视频,随机种子为20261007。
实测结果显示,FastH3 V2生成单条视频耗时58.23秒,官方MiniMax H3 INT8耗时255.92秒,FastH3 V2速度提升明显。
实测感受显示,两种方案生成的画面质量差别不大,按照这个速度计算,不到8秒就能生成1秒视频,即使仅从抽卡调测的效率来看,速度提升也很可观。
测试提示词和相关内容可通过原文链接查看。
视频生成 · @minchoi▲ 4.3K
用户输入提示+论文URL,opus 5.5生成92秒讲解视频
用户@minchoi在X(原Twitter)分享,使用opus 5.5生成OpenAI 722数学论文的讲解视频
用户输入提示+论文URL,opus 5.5生成92秒讲解视频
用户@minchoi在X(原Twitter)分享,使用opus 5.5生成OpenAI 722数学论文的讲解视频
用户@minchoi分享了一项使用体验。他只给了opus 5.5一个提示,加上OpenAI 722 AI数学论文的链接。
opus 5.5生成了一段时长92秒的动态图形讲解视频,链接为
AI生成 · @WattterDjiang▲ 8.0K
AI生成敦煌交互艺术作品 成本从5万+降至零成本
创作者WatterDjiang分享Codex结合自定义技能生成方案,已公开提示词和技能链接
AI生成敦煌交互艺术作品 成本从5万+降至零成本
创作者WatterDjiang分享Codex结合自定义技能生成方案,已公开提示词和技能链接
看到其他创作者用Opus5.5制作敦煌视频后,WatterDjiang尝试用Codex加上自己的视频技能完成了同类作品。
他认为该作品质量已经达到顶级博物馆沉浸式交互项目的交付标准,整体效果十分震撼。
此前完成这种体量的项目,预算至少需要5万元以上,还需要一个包含文案、特效、建模、视频剪辑、网页制作等岗位的团队协作。
现在只需要一段简单的提示词就能完成,生成质量超过95%以上人类创意工作者的产出。
本次生成使用的提示词为:使用wtt-code-animation-studio技能,创作敦煌佛洞窟壁画新媒体交互艺术作品,要求中英双语,在禅机妙趣的哲思理念下,融合时间、镜子、生灭、空色的表达。
贴图需要找到资源,在3D空间中贴上真实的壁画素材,入“洞”参观时,照见大千诸佛世界。镜面反射可借鉴指定链接中的思路,服务作品哲思与艺术效果的表现任务,产出web端内容,巧妙放入指定链接的导流入口。
同时需要制作一部大师级的动态图形交互动效视频,结尾附带指定链接的宣传,要求中英双语字幕,语音为中文。
本次使用的技能和提示词已公开,技能可通过指定链接获取。
量化交易 · @Av1dlive▲ 1.4K
用Grok Bot和Opus 5.5搭建24小时AI量化交易台
推文来自@Av1dlive,方案支持100万token上下文,提供100个免费订阅额度
用Grok Bot和Opus 5.5搭建24小时AI量化交易台
推文来自@Av1dlive,方案支持100万token上下文,提供100个免费订阅额度
Grok Bot + Opus 5.5适合搭建个人24小时不间断运行的AI量化交易台。该组合支持100万token上下文窗口,可实现持续推理。
将它接入市场数据和回测系统,就可以用来研究新的交易策略。只要配置正确,你的AI量化交易台就能在你休息时持续运行。
本次方案提供100个免费订阅额度,有需求的用户可以自行领取。
教程 · @wquguru▲ 8.0K
用支付宝免费额度省Muse用量,两步配置Pi Agent
来自@wquguru的Muse配置教程,接入蚂蚁集团Ling-3.1-flash模型
用支付宝免费额度省Muse用量,两步配置Pi Agent
来自@wquguru的Muse配置教程,接入蚂蚁集团Ling-3.1-flash模型
动态 · @lydiahallie▲ 1.1万
使用OpenAI API计费的用户可设置Haiku 5.5自动压缩窗口省费用
来自@lydiahallie在𝕏的分享,提供OpenAI API计费用户省钱操作步骤
使用OpenAI API计费的用户可设置Haiku 5.5自动压缩窗口省费用
来自@lydiahallie在𝕏的分享,提供OpenAI API计费用户省钱操作步骤
如果你使用API计费,可以把 Haiku 5.5 的自动压缩窗口设为 100K,这样你就能留在更便宜的令牌定价层级了!
这个设置是按模型保存的,所以它只适用于 Haiku(包括子代理):
> /model haiku
> /autocompact 100k
多智能体 · @omarsar0▲ 4.3K
开发者自建多智能体系统,Opus 5.5协调效果超出预期
开发者@omarsar0 在𝕏分享自建8个角色智能体团队的体验
开发者自建多智能体系统,Opus 5.5协调效果超出预期
开发者@omarsar0 在𝕏分享自建8个角色智能体团队的体验
代码审查 · @dhh▲ 4.0万
对抗性代码审查技巧:Codex与Claude交叉审查代码
开发者分享了使用Codex和Claude交替进行代码审查的技巧
对抗性代码审查技巧:Codex与Claude交叉审查代码
开发者分享了使用Codex和Claude交替进行代码审查的技巧
如果我在用Codex写代码,那我的对抗性代码审查方法就是:“让 Claude 来审查这个”。
如果我在用Claude写代码,那就是:“让 Codex 来审查这个”。这些模型都知道如何通过命令行启动审查,知道如何轮流进行,也知道如何解决分歧。这里面没什么神奇的。
前沿研究 · @omarsar0▲ 8.7K
NVIDIA 研究显示 VERA 得分超 Claude Opus
共同演化智能体和环境支架的训练方式,让模型得分超过 Claude Opus,并且已经有前沿AI公司开始采用这种训练思路
NVIDIA 研究显示 VERA 得分超 Claude Opus
共同演化智能体和环境支架的训练方式,让模型得分超过 Claude Opus,并且已经有前沿AI公司开始采用这种训练思路
英伟达的这篇论文太棒了。我观察到一个令人振奋的趋势:为智能体构建可验证环境,并且和模型一起训练测试框架。框架和模型共同演化,是掌握智能栈的重要一环。许多前沿AI公司已经开始这么做了。
这篇论文展示了具体的实现方式:VERA 将基准轨迹转换成超过 9000 个可重启沙箱,附带评分标准,并且只保留能正常运行、可以通过可观察证据评分的环境。随后它会同时更新模型权重和框架。只有框架修改通过了自检,并且在开发集上至少提升了 5 分,才会被保留。如果模型检查点的分数下降超过 20%,系统就会拒绝它。
在 9B 参数规模上,共同演化后的智能体在 AutoCoWorkBench 上比最强单轴基线高出 10.3 分,在 AutoMedBench 上高出 13.0 分。在 27B 参数规模上,它在 AutoCoWorkBench 上得分 71.6,高于 Claude Opus 4.8。环境语料库已经开源。
论文:
和论文聊天:
前沿研究 · @NVIDIAAI▲ 7.4K
NVIDIA推出PivotOPD帮AI智能体纠错
做任务早期出错就一路错下去是AI智能体常见问题,这个新研究能教AI出错后回到正轨
NVIDIA推出PivotOPD帮AI智能体纠错
做任务早期出错就一路错下去是AI智能体常见问题,这个新研究能教AI出错后回到正轨
一个智能体在任务的早期阶段犯了错误,之后就一直沿着错误的方向走下去。我们的研究人员构建了 PivotOPD,来教会智能体如何避免这类错误,以及在错误发生后如何恢复。
在训练过程中,一个教师模型会向智能体展示更好的行动方案,以及如何在接下来的几个步骤中回到正轨。
阅读论文,观看它的工作演示:
新品发布 · @OpenAI▲ 33.9万
OpenAI 向全用户开放 GPT-6 和 ChatGPT 智能UI
普通用户现在能直接使用新的 GPT-6 模型,以及能给出更直观答案和即时交互工具的 Intelligent UI 功能。
OpenAI 向全用户开放 GPT-6 和 ChatGPT 智能UI
普通用户现在能直接使用新的 GPT-6 模型,以及能给出更直观答案和即时交互工具的 Intelligent UI 功能。
GPT-6 和智能 UI 现已向所有用户推出 ChatGPT。
ChatGPT 的智能 UI 能够提供快速、交互性的回答,让日常提问更直观,复杂主题更容易理解,并且可以为你的任务即时提供交互工具。
新品发布 · @liquidai▲ 8.7万
liquidai 发布 Open d1 两款开源多模态模型
两款模型分别是d1-3B支持文本加视觉、d1-omni-600M支持文本图像或文本音频,可实现实时决策在多种硬件运行
liquidai 发布 Open d1 两款开源多模态模型
两款模型分别是d1-3B支持文本加视觉、d1-omni-600M支持文本图像或文本音频,可实现实时决策在多种硬件运行
今天我们发布了 Open d1:我们 d1 决策模型系列中的两个开放权重多模态模型。
> d1-3B:文本 + 视觉
>
> d1-omni-600M:文本 + 图像 或 文本 + 音频
可在任意场景实现实时决策,从 @nvidia DGX 这类数据中心,到 RTX 工作站,再到边缘端的 Jetson。
1/
新品发布 · @UnslothAI▲ 4.6万
Unsloth开源工具 本地训决策模型只要4GB显存
普通人也能在本地消费级显卡上微调出准确率足够高的决策模型,不用依赖云端大模型服务。
Unsloth开源工具 本地训决策模型只要4GB显存
普通人也能在本地消费级显卡上微调出准确率足够高的决策模型,不用依赖云端大模型服务。
现在你可以在本地训练你自己的类Jev决策模型了!
我们在仅需4GB显存的条件下,将Qwen3.5 0.8B在3个决策基准测试中的总体准确率从20.7%提升到了74.3%。
通过我们开源的Unsloth仓库,可以把任意大语言模型(比如Qwen3.8、Gemma 4)转成决策模型。
我们使用Unsloth和LoRA(r=64),以Clef head微调了一个轮次,将下游准确率从30–37%提升到了78%。
GitHub:
指南和笔记本:
新品发布 · @KJHMiao▲ 6.1K
bryel labs 推出企业自建AI实验室服务
企业自研AI模型,可以提速、降本,不需要完全依赖外部大模型厂商,对想做自有AI的企业是新选择。
bryel labs 推出企业自建AI实验室服务
企业自研AI模型,可以提速、降本,不需要完全依赖外部大模型厂商,对想做自有AI的企业是新选择。
我们的使命是打造十亿个AI模型,训练者不是我们,而是你。
现在介绍@bryel_labs。我们帮助贵公司打造内部AI实验室,并为你提供简化模型开发和持续改进的软件。
我们获得了@ycombinator的投资,已经为苹果、Framer和财富500强企业训练过模型。
我们帮助企业训练了:
• 速度提升20倍的分类模型
• 成本降低五倍的搜索模型
• 成本降低5-8倍、性能达到前沿水平的长周期智能体模型
你有兴趣和我们合作吗?联系我们吧。
新品发布 · @michpokrass导语出处▲ 2.9万
OpenAI 向所有人推送 GPT-6 和 Intelligent UI
这是 ChatGPT 推出以来较大的一次功能改动,新增智能界面功能由 GPT-6 驱动,可直接生成可视化交互组件。
OpenAI 向所有人推送 GPT-6 和 Intelligent UI
这是 ChatGPT 推出以来较大的一次功能改动,新增智能界面功能由 GPT-6 驱动,可直接生成可视化交互组件。
今天我们向全部用户推出 GPT-6 和 Intelligent UI!
Intelligent UI 是押注于模型智能的一次尝试。我们让 GPT-6 在画布上生成高实用性的可视化和交互组件。
这对 ChatGPT 来说是一个相当大的变化!我们必须为 GPT-6 打造合适的工具,使其能够生成token高效、可即时流式输出、符合我们设计语言,并且足够灵活可以应对你和 ChatGPT 对话任何内容的界面。
新品发布 · @gdb▲ 4.4万
ChatGPT 推出 Intelligent UI 全新交互功能
现在 ChatGPT 能通过全交互式界面快速回答问题了,直接交互会比纯文本回答更高效。
ChatGPT 推出 Intelligent UI 全新交互功能
现在 ChatGPT 能通过全交互式界面快速回答问题了,直接交互会比纯文本回答更高效。
行业动态 · Hacker News导语出处▲ 23.3万
Anthropic 发布 Claude Haiku 5.5 模型
作为 Anthropic Claude 系列的新快速模型,Claude Haiku 5.5 已经出现在社区讨论中,关心 Claude 迭代的可以留意后续消息。
Anthropic 发布 Claude Haiku 5.5 模型
作为 Anthropic Claude 系列的新快速模型,Claude Haiku 5.5 已经出现在社区讨论中,关心 Claude 迭代的可以留意后续消息。
社区讨论:多数用户认为Haiku 5.5低于10万token的定价策略比较合理,和GPT-6 Luna价格持平,但超过10万token后的阶梯高价、以及10万token的过低门槛设置很奇怪。有人测试发现这个小模型处理复杂UI图转HTML任务效果不佳,也有人认为它可以加入反编译游戏的工具链中,还有用户认为Anthropic近期给Max订户赠送月度API credits的做法比OpenAI做得好。
行业动态 · @satyanadella▲ 4.5万
微软发布新一代Windows AI功能 PC变软件工厂
想在本地电脑开发代码,不用消耗云端令牌也能运行大模型,开发成本大幅降低,数据敏感工作也能在本地安全处理。
微软发布新一代Windows AI功能 PC变软件工厂
想在本地电脑开发代码,不用消耗云端令牌也能运行大模型,开发成本大幅降低,数据敏感工作也能在本地安全处理。
模型发布 · @perplexity_ai▲ 3.5万
perplexity_ai发布pplx-embed-v2-late 嵌入模型
可以在同一个嵌入空间处理文本、图片和页面,支持跨模型查询。
perplexity_ai发布pplx-embed-v2-late 嵌入模型
可以在同一个嵌入空间处理文本、图片和页面,支持跨模型查询。
我们发布了 pplx-embed-v2-late,这是两个延迟交互嵌入模型,可以在共享嵌入空间中检索文本、图片和页面,支持跨模型查询。
两个模型都达到了前沿性能,现在已在 Hugging Face 公开。
融资 · @NousResearch▲ 5.6万
NousResearch拿到B轮融资,要做Hermes Agent移动端
投资方包括英伟达等机构,接下来计划推出Hermes Agent手机应用。
NousResearch拿到B轮融资,要做Hermes Agent移动端
投资方包括英伟达等机构,接下来计划推出Hermes Agent手机应用。
正如《华尔街日报》报道的那样,我们已经完成了B轮融资,以带领Hermes Agent开拓新领域(没错,我们还会开发移动应用)。
感谢我们的投资者,包括 @nvidia @M12vc @SamsungNext @robotventures @usv @ycombinator @MenloVentures 以及其他所有投资者。
工具 · @BrettHarrison▲ 1.1万
Liquid Inference让推理服务商动态竞争降成本
服务商可以在几分钟内完成接入,不用花几周时间,买家拥有完整权限。
Liquid Inference让推理服务商动态竞争降成本
服务商可以在几分钟内完成接入,不用花几周时间,买家拥有完整权限。
工具 · @llama_index▲ 1.9万
OpenDocRouter把所有文档解析模型统一到一个API
Hugging Face上已有约四千个OCR模型,几乎每个月都有新模型发布。
OpenDocRouter把所有文档解析模型统一到一个API
Hugging Face上已有约四千个OCR模型,几乎每个月都有新模型发布。
工具推荐 · @vista8▲ 8.9K
推荐开发AI工具用的magpie AI Agent基建
支持各种模型配置和Oauth登录,添加服务商操作直观,图标用了lobehub整理的资源。
推荐开发AI工具用的magpie AI Agent基建
支持各种模型配置和Oauth登录,添加服务商操作直观,图标用了lobehub整理的资源。
强烈推荐 @yetone 的 magpie,牛逼的AI Agent 基建。如果想开发了 AI 工具,想支持各种模型配置和 Oauth 登录,可以把仓库发过去,让 Agent 学习参考。平台图标用的是lobehub 整理的 icon,添加服务商也变的很直观。
magpie 仓库地址,推荐 Star :
行业动态 · Hacker News▲ 442
社区讨论面向所有人的GPT-6与智能UI
Hacker News社区有人发起相关讨论,如果你关心通用人工智能和面向大众的产品落地,可以关注后续进展
社区讨论面向所有人的GPT-6与智能UI
Hacker News社区有人发起相关讨论,如果你关心通用人工智能和面向大众的产品落地,可以关注后续进展
社区讨论:不少用户认可OpenAI这篇博客的文案和展示水准,认为只有苹果能做到类似水平。有人吐槽GPT-6的网页设计留有大量多余空白,像把用户当小孩,也反对OpenAI合并工作区与聊天的计划。有人看好按需生成自定义界面的方向,认为未来浏览器可能被个性化AI界面取代,也有人觉得这样会让应用更耗资源,更偏好纯文本输出方便后续处理。
行业动态 · OpenAI 开发者社区导语出处▲ 86
OpenAI发布GPT-6.1 Sol 模型、Ultrafast 付费速度层级、Agents API、Decisions API(one-fifth)
OpenAI发布新一代编码模型GPT-6.1 Sol,定价仅为前代的五分之一,同时新增提速档位和两类API,开发者可以获得更便宜更快的AI开发工具。
OpenAI发布GPT-6.1 Sol 模型、Ultrafast 付费速度层级、Agents API、Decisions API(one-fifth)
OpenAI发布新一代编码模型GPT-6.1 Sol,定价仅为前代的五分之一,同时新增提速档位和两类API,开发者可以获得更便宜更快的AI开发工具。
模型和API
GPT-6.1 Sol 改进了编码和计算机使用,标准token价格是Astra的五分之一。Ultrafast是付费速度层级。
OpenAI 称,Codex 中的token生成速度最高提升8倍,API中最高提升6倍。
Astra 现已可用;Sol 即将推出。
Agents API 已进入公开测试版,提供托管执行、内存、工具和多智能体支持。Agents API 中的计算机使用功能允许智能体通过UI操作软件。
Decisions API 处于有限预览阶段。它使用Luna进行分类
行业动态 · Hacker News▲ 87
研究发现 Claude 和 ChatGPT 会按财富给不同购物价
你网购问AI参考价格时,AI可能会根据对你财富的判断给出不同报价,你的网购成本可能因此变高。
研究发现 Claude 和 ChatGPT 会按财富给不同购物价
你网购问AI参考价格时,AI可能会根据对你财富的判断给出不同报价,你的网购成本可能因此变高。
社区讨论:多数人认为原标题存在误导,研究实际是AI根据用户 inferred 的财富背景推荐不同价位的商品,并非同一商品给出不同定价。有人认为这件事本质不是问题,因为AI是基于获取到的用户个人上下文做个性化推荐。有人提出可以通过用穷人账号帮富人请求来套利,也有人因此表示要改用本地部署模型,还有人担忧后续数据收集权限会不断收紧,AI的逐利暗模式会越来越多。
行业动态 · Hacker News导语出处▲ 236
Meta和微软限制内部员工使用Claude AI
大厂自身也开始限制员工使用竞品AI,这背后牵扯数据安全和商业利益,普通用户也该警惕数据泄露风险。
Meta和微软限制内部员工使用Claude AI
大厂自身也开始限制员工使用竞品AI,这背后牵扯数据安全和商业利益,普通用户也该警惕数据泄露风险。
社区讨论:多数观点认为限制的原因不同:有人认为是token成本过高,会计师终于开始控制成本,也有个别员工消耗成本达到每月1万美元,多数消耗都是低ROI的荒唐操作;有人认为是大厂要内部自测自家模型,封锁竞品是出于数据治理考虑;还有人认为这对Anthropic收入打击很大,Meta可能就是其两大客户之一。也有观点提出AI工具应该由员工自行付费,本职工作不能依赖AI完成。
工具产品 · @AISecurityInst▲ 6.9K
AISecurityInst 发布开源工具 Transect 梳理智能体轨迹
现在多智能体协作的复杂评估结果很难解读,单一分数看不出智能体的决策路径,这个工具能把过程转成交互时间线。
AISecurityInst 发布开源工具 Transect 梳理智能体轨迹
现在多智能体协作的复杂评估结果很难解读,单一分数看不出智能体的决策路径,这个工具能把过程转成交互时间线。
随着 AI 智能体编写代码、运行实验并协同工作,复杂评估的结果变得越来越难解读。单个评估分数会掩盖智能体得到这个分数的过程。
今天,我们发布了 Transect:一个能把智能体转录文本转换成交互式时间线的开源工具。
实战经验 · @lydiahallie导语出处▲ 1.1万
网友讨论俳句AI适合低推理量小任务
如果日常只需要做文本阅读、小修改或者工具调用,这款模型就能满足需求,不用找高推理大模型就能完成任务。
网友讨论俳句AI适合低推理量小任务
如果日常只需要做文本阅读、小修改或者工具调用,这款模型就能满足需求,不用找高推理大模型就能完成任务。
代码审查 · @dhh▲ 4.0万
对抗性代码审查技巧:Codex与Claude交叉审查代码
开发者分享了使用Codex和Claude交替进行代码审查的技巧
对抗性代码审查技巧:Codex与Claude交叉审查代码
开发者分享了使用Codex和Claude交替进行代码审查的技巧
如果我在用Codex写代码,那我的对抗性代码审查方法就是:“让 Claude 来审查这个”。
如果我在用Claude写代码,那就是:“让 Codex 来审查这个”。这些模型都知道如何通过命令行启动审查,知道如何轮流进行,也知道如何解决分歧。这里面没什么神奇的。
开源 · @Sumanth_077▲ 7.0K
基于通义千问Qwen构建的开源数据分析AI Agent已发布
开发者Sumanth_077打造,采用Jev做审核层,项目100%开源
基于通义千问Qwen构建的开源数据分析AI Agent已发布
开发者Sumanth_077打造,采用Jev做审核层,项目100%开源
多智能体 · @omarsar0▲ 4.3K
开发者自建多智能体系统,Opus 5.5协调效果超出预期
开发者@omarsar0 在𝕏分享自建8个角色智能体团队的体验
开发者自建多智能体系统,Opus 5.5协调效果超出预期
开发者@omarsar0 在𝕏分享自建8个角色智能体团队的体验
动态 · @lydiahallie▲ 1.1万
使用OpenAI API计费的用户可设置Haiku 5.5自动压缩窗口省费用
来自@lydiahallie在𝕏的分享,提供OpenAI API计费用户省钱操作步骤
使用OpenAI API计费的用户可设置Haiku 5.5自动压缩窗口省费用
来自@lydiahallie在𝕏的分享,提供OpenAI API计费用户省钱操作步骤
如果你使用API计费,可以把 Haiku 5.5 的自动压缩窗口设为 100K,这样你就能留在更便宜的令牌定价层级了!
这个设置是按模型保存的,所以它只适用于 Haiku(包括子代理):
> /model haiku
> /autocompact 100k
教程 · @wquguru▲ 8.0K
用支付宝免费额度省Muse用量,两步配置Pi Agent
来自@wquguru的Muse配置教程,接入蚂蚁集团Ling-3.1-flash模型
用支付宝免费额度省Muse用量,两步配置Pi Agent
来自@wquguru的Muse配置教程,接入蚂蚁集团Ling-3.1-flash模型
AI 编程 · @AYi_AInotes▲ 4.1K
程序员单月合入2500个生产环境PR,个人产能顶一支团队
原Cursor核心工程师、现xAI软件工程师Lauren公开了这套工作流,并做成了Cursor官方插件。
程序员单月合入2500个生产环境PR,个人产能顶一支团队
原Cursor核心工程师、现xAI软件工程师Lauren公开了这套工作流,并做成了Cursor官方插件。
量化交易 · @Av1dlive▲ 1.4K
用Grok Bot和Opus 5.5搭建24小时AI量化交易台
推文来自@Av1dlive,方案支持100万token上下文,提供100个免费订阅额度
用Grok Bot和Opus 5.5搭建24小时AI量化交易台
推文来自@Av1dlive,方案支持100万token上下文,提供100个免费订阅额度
Grok Bot + Opus 5.5适合搭建个人24小时不间断运行的AI量化交易台。该组合支持100万token上下文窗口,可实现持续推理。
将它接入市场数据和回测系统,就可以用来研究新的交易策略。只要配置正确,你的AI量化交易台就能在你休息时持续运行。
本次方案提供100个免费订阅额度,有需求的用户可以自行领取。
AI生成 · @WattterDjiang▲ 8.0K
AI生成敦煌交互艺术作品 成本从5万+降至零成本
创作者WatterDjiang分享Codex结合自定义技能生成方案,已公开提示词和技能链接
AI生成敦煌交互艺术作品 成本从5万+降至零成本
创作者WatterDjiang分享Codex结合自定义技能生成方案,已公开提示词和技能链接
看到其他创作者用Opus5.5制作敦煌视频后,WatterDjiang尝试用Codex加上自己的视频技能完成了同类作品。
他认为该作品质量已经达到顶级博物馆沉浸式交互项目的交付标准,整体效果十分震撼。
此前完成这种体量的项目,预算至少需要5万元以上,还需要一个包含文案、特效、建模、视频剪辑、网页制作等岗位的团队协作。
现在只需要一段简单的提示词就能完成,生成质量超过95%以上人类创意工作者的产出。
本次生成使用的提示词为:使用wtt-code-animation-studio技能,创作敦煌佛洞窟壁画新媒体交互艺术作品,要求中英双语,在禅机妙趣的哲思理念下,融合时间、镜子、生灭、空色的表达。
贴图需要找到资源,在3D空间中贴上真实的壁画素材,入“洞”参观时,照见大千诸佛世界。镜面反射可借鉴指定链接中的思路,服务作品哲思与艺术效果的表现任务,产出web端内容,巧妙放入指定链接的导流入口。
同时需要制作一部大师级的动态图形交互动效视频,结尾附带指定链接的宣传,要求中英双语字幕,语音为中文。
本次使用的技能和提示词已公开,技能可通过指定链接获取。
视频生成 · @minchoi▲ 4.3K
用户输入提示+论文URL,opus 5.5生成92秒讲解视频
用户@minchoi在X(原Twitter)分享,使用opus 5.5生成OpenAI 722数学论文的讲解视频
用户输入提示+论文URL,opus 5.5生成92秒讲解视频
用户@minchoi在X(原Twitter)分享,使用opus 5.5生成OpenAI 722数学论文的讲解视频
用户@minchoi分享了一项使用体验。他只给了opus 5.5一个提示,加上OpenAI 722 AI数学论文的链接。
opus 5.5生成了一段时长92秒的动态图形讲解视频,链接为
AI生成视频 · @eternityspring▲ 6.3K
RTX4080实测:FastH3 V2生成视频速度提升明显
网友@eternityspring实测FastH3 V2在640×640、8秒视频生成条件下,速度远超官方MiniMax H3 INT8
RTX4080实测:FastH3 V2生成视频速度提升明显
网友@eternityspring实测FastH3 V2在640×640、8秒视频生成条件下,速度远超官方MiniMax H3 INT8
用户@eternityspring在RTX4080显卡上实测了FastH3 V2的生成速度,测试条件为相同完整提示词、生成640×640分辨率、时长8秒的视频,随机种子为20261007。
实测结果显示,FastH3 V2生成单条视频耗时58.23秒,官方MiniMax H3 INT8耗时255.92秒,FastH3 V2速度提升明显。
实测感受显示,两种方案生成的画面质量差别不大,按照这个速度计算,不到8秒就能生成1秒视频,即使仅从抽卡调测的效率来看,速度提升也很可观。
测试提示词和相关内容可通过原文链接查看。
开源 · @liyue_ai▲ 1.1万
用户用马斯克Grok Bot自动生成宣传视频 效果超出预期
一位开发者分享自己仅用简单提示词就让Grok Bot生成了符合需求的开源项目宣传视频
用户用马斯克Grok Bot自动生成宣传视频 效果超出预期
一位开发者分享自己仅用简单提示词就让Grok Bot生成了符合需求的开源项目宣传视频
一位开发者分享了自己使用马斯克旗下的Grok Bot生成宣传视频的体验。他仅向Grok Bot发送了一段简单提示词,就自动生成了符合要求的开源项目宣传视频。
生成的宣传视频未经过任何剪辑修改,音效、布局、场景切换都符合开发者的预期。尤其是不同写真风格展示的特效效果非常好。
开发者在社交平台公开称赞了Grok Bot的表现,并称其使用了最强的后端模型。该宣传视频对应的开源项目链接已公开。
谷歌 · @Inmerson▲ 1.4万
测试者一周体验Gemini 4 Argon:模型强,但产品不行
测试者Inmerson提前体验谷歌Gemini 4 Argon一周,分享模型与产品体验
测试者一周体验Gemini 4 Argon:模型强,但产品不行
测试者Inmerson提前体验谷歌Gemini 4 Argon一周,分享模型与产品体验
开发工具 · @witcheer▲ 3.4K
Hermes Agent内存使用的五个实用提示
本文来自@witcheer,介绍Hermes Agent内存功能的五个使用建议
Hermes Agent内存使用的五个实用提示
本文来自@witcheer,介绍Hermes Agent内存功能的五个使用建议
3D建模 · @rewind02▲ 3.0K
用Claude Opus全自动生成汉堡市政厅虚幻引擎模型,全程无手工建模
用户@rewind02 分享了使用Claude Opus 5.5和Unreal Engine 5.8生成汉堡市政厅3D模型的全流程
用Claude Opus全自动生成汉堡市政厅虚幻引擎模型,全程无手工建模
用户@rewind02 分享了使用Claude Opus 5.5和Unreal Engine 5.8生成汉堡市政厅3D模型的全流程
这是一个全程无需手工建模,用AI生成汉堡市政厅3D模型的流程,使用工具为Claude Opus 5.5和Unreal Engine 5.8。整个模型生成从代码生成而来,核心是通过合理步骤让AI自动完成工作。
第一步,Claude Code通过MCP连接Blender和Unreal Engine。第二步,Opus编写Python脚本,根据参数文件生成分块结构、外立面、装饰、窗户、雕像和材质,完成整个建筑生成。
建筑的高度和比例来自汉堡市政厅官方开放3D模型,不依靠猜测。Opus会渲染控制图,并与实拍照片和街景做对比。
每次生成模型后,导出前会完成法线和可见性检查。生成好的模型会以单一资源形式通过Nanite导入Unreal Engine。
所有测量数据和生成决策都记录在项目文档中。项目遵循“测量而非猜测”的原则,实测发现,从街道层面拍摄照片估算的高度通常会偏差1到2米,调整参数后重新生成模型即可修正误差。
工具 · @HBCoop_▲ 479
创作者测试HyperFrames Studio桌面应用,连接Claude Code
创作者HBCoop_测试HyperFrames_ Studio新桌面应用,连接Claude Code进行视频编辑
创作者测试HyperFrames Studio桌面应用,连接Claude Code
创作者HBCoop_测试HyperFrames_ Studio新桌面应用,连接Claude Code进行视频编辑
创作者正在测试HyperFrames_推出的全新Studio桌面应用。该应用已经连接到Claude Code。
测试过程中,创作者将自己撰写的发布视频的Substack通讯链接放入应用,既可以在帧上也可以在聊天中描述编辑需求,操作十分简单。
可以点击链接查看最终编辑效果,视频结尾还有一段快速的幕后花絮。
可视化工具 · @ggsimm▲ 63
ggsimm尝试带有渐进式展示的教程可视化工具
该内容发布于X(原Twitter),作者为@ggsimm,链接为https://t.co/XOVbLDPdBN
ggsimm尝试带有渐进式展示的教程可视化工具
该内容发布于X(原Twitter),作者为@ggsimm,链接为https://t.co/XOVbLDPdBN
目前作者@ggsimm正在尝试带有渐进式展示的教程可视化工具。这类工具的作用是帮助遇到卡住问题的用户解决困境。最后一个展示的效果极具指向性,几乎是直白呈现内容。
更多详情可访问链接
大语言模型 · @contractclaus
Claude获得功能升级 现已支持网页搜索与实验运行
Anthropic开发者@contractclaus在X平台宣布Claude的本次升级内容
Claude获得功能升级 现已支持网页搜索与实验运行
Anthropic开发者@contractclaus在X平台宣布Claude的本次升级内容
我完成了一次功能升级。现在我可以进行网页搜索,读取你发送的链接,跟进GitHub和IMD的更新。
我还可以运行实验来测试想法,会使用这些工具研究社区建议,并记录研究结果。
你可以在这里跟进我的工作:
开发 · @theo
T3 Code优化GitHub集成,大幅降低速率限制占用
开发者theo在𝕏分享T3 Code近期优化GitHub集成的工作成果
T3 Code优化GitHub集成,大幅降低速率限制占用
开发者theo在𝕏分享T3 Code近期优化GitHub集成的工作成果
过去几天,theo在T3 Code的GitHub集成功能上投入了大量时间。这次优化将速率限制占用降低了超过75%,同时让监控行为可靠性大幅提升。
Julius将项目中原本通过命令行界面(CLI)发起的应用程序编程接口(API)调用替换为直接调用,效率更高。项目会根据哪种调用方式能更高效利用速率限制,在GQL(图形查询语言)API和REST API之间轮换调用,同时设置了备用方案。
这项工作工作量很大,大部分不会被用户注意到,但却是theo喜欢做的类型。为了让拉取请求(PR)监控器达到满意的效果,theo前后做了大概30次实现。
theo表示,一方面,深入研究源代码的人能够看到这些细节,对此他感到欣慰;另一方面,其他人只会直接复制成果,永远不需要在这些问题上投入这么多思考,这让他感觉有些奇怪。
theo称这几天一直在阅读 GraphQL 查询生成器脚本,大脑已经像预期的那样一团浆糊了,并附上了相关链接。
AI视频 · @YourAlphaMom▲ 4.5K
AI视频工具Seedance 2.5生成15秒无剪辑健身vlog
来自X用户@YourAlphaMom,使用Seedance 2.5在makeugc平台生成,包含完整镜头脚本和角色设定
AI视频工具Seedance 2.5生成15秒无剪辑健身vlog
来自X用户@YourAlphaMom,使用Seedance 2.5在makeugc平台生成,包含完整镜头脚本和角色设定
视频生成 · @Diplomeme▲ 2.3K
用AI生成了一段2004年实拍质感的博主vlog
用户@Diplomeme在𝕏分享,用Kling 4.0 Flash生成符合要求的复古街机厅vlog
用AI生成了一段2004年实拍质感的博主vlog
用户@Diplomeme在𝕏分享,用Kling 4.0 Flash生成符合要求的复古街机厅vlog
生成视频 · @Naiknelofar788▲ 1.4K
AI生成30秒超写实真人视频,细节全程一致
用户@Naiknelofar788使用Seedance 2.5生成30秒超写实电影级真人AI视频
AI生成30秒超写实真人视频,细节全程一致
用户@Naiknelofar788使用Seedance 2.5生成30秒超写实电影级真人AI视频
今天的 42 条信号到这里下一轮 12:30 更新
📬 订阅
https://ai-pulse-lab.com/feed.xml