社区讨论:有开发者分享了本地部署的基于Gemini 3.8 TTS的有声书创作工具,无需云端调用和付费,引号归属准确率达97.2%,还有开发者搭建了可供体验的在线 playground,实验多数花费不到1美分。不少用户关注本地部署开源方案,有人提出谷歌不同平台的Gemini能力不统一,也有声音从业者指出当前模型仍会忽略prompt核心要求,离替代专业声优还有距离。
今天发生了什么1 分钟读懂
Google 发布 Gemini 3.8 Flash 和 Flash-L 两款语音模型,可通过 Gemini API 与 AI Studio 调用。新模型生成音频的表现力更强,创作者、开发者和企业可以直接接入。
来源@GoogleAIStudio「GoogleAIStudio 发布两款全新 Gemini TTS 模型」
NVIDIA 发布 Nemotron 3 Diarization 说话人分离模型。多人线上研讨会的录屏转文字时,重叠发言也能被自动归到对应的人,省去手动整理段落。
来源@NVIDIAAI「NVIDIAAI发布Nemotron 3 Diarization 说话人分离模型(eight)」
OpenAI 发布 MentalHealthBench 基准,用真实心理咨询对话评估前沿模型的表现,为 AI 心理健康产品提供了公开的统一衡量标准,后续相关产品的评估与迭代都可基于这套标准展开。
来源@OpenAI「OpenAI发布MentalHealthBench 基准测试(more than 80)」
03 @trycua发布Cua-S1-4B-0.2计算机操作模型 这是首个用RLOO在实时电脑操作任务训练的决策模型,相关组件已开源,关注电脑AI自动化的开发者可直接试用
1/ 今天我们推出Cua-S1-4B-0.2,这是首个通过RLOO在实时计算机使用任务上训练得到的多模态决策模型,使用任务完成奖励。 文本和多模态适配器以Apache-2.0协议开放。
04 zerodrift_ai发布Anchor 3.0 更快更便宜保合规 开发AI智能体的团队可以用它在运行阶段拦截违规内容,违规检出率高于所有测试过的前沿大模型,前1000次调用免费。
由 @zerodrift_ai 推出的 Anchor 3.0,是首个为保障 AI 代理安全而构建的执法模型,它可以在运行时保持 AI 代理输出内容合规。
今日焦点
21小时、950个代理,Claude自主发现类CRISPR酶系统
Anthropic新成立了一个生命科学研究小组和实验室,研究方向是用Claude做基础生物学。科学家只给了高层级指导,Claude就自主发现了一套新型酶系统,特性让人想起CRISPR。
发现过程大致是这样。约950个AI代理并行搜索数据库,花了21小时,消耗2.1亿个token。其中一个代理注意到,一个奇怪的逆转录酶基因旁边,有反复出现的DNA序列模式。代理们先收集了20多万个逆转录酶,挑出3500个候选系统,再缩到20个最有力的。之后生成人类可读的报告。
Anthropic给新系统起名array-associated reverse transcriptases,缩写ART。
深度阅读
🔥 信号雷达39 条
𝕏 实时信号 + arXiv 前沿论文,经 AI 聚类解读 · 一眼扫完全貌(含上方导读精选 4 条)
行业动态 · Hacker News▲ 231
有人讨论 Gemini 3.8 文本转语音模型
对文本转语音功能有需求的用户,可以体验新版本模型的效果,看看是否满足自己的使用需要。
有人讨论 Gemini 3.8 文本转语音模型
对文本转语音功能有需求的用户,可以体验新版本模型的效果,看看是否满足自己的使用需要。
行业动态 · Hacker News▲ 205
OpenAI 招募网红为自身打造正面口碑
大厂AI公司开始通过网红营销影响公众对自身的认知,如果你关心AI行业舆论变化,这是一个值得留意的信号
OpenAI 招募网红为自身打造正面口碑
大厂AI公司开始通过网红营销影响公众对自身的认知,如果你关心AI行业舆论变化,这是一个值得留意的信号
社区讨论:多数评论者质疑这是OpenAI操控舆论的造势行为,有人称原报道标题用词夸张,文章本身就是反AI垃圾内容,也有人指出已有多名Youtuber收酬劳制作AI末日论相关视频,这套先制造问题再兜售解决方案的套路令人厌倦,还有人猜测这类负面报道会被快速从热榜移除。有人疑惑OpenAI本身有顶级AI生成能力,为什么还需要真人网红,也有受益者表示如果OpenAI邀约,自己愿意分享亲身使用体验。
发布 · @NVIDIAAI导语出处▲ 14.2万
NVIDIAAI发布Nemotron 3 Diarization 说话人分离模型(eight)
多人线上开研讨会录屏转文字,不用再手动整理谁讲了哪段,重叠发言也能自动分好。
NVIDIAAI发布Nemotron 3 Diarization 说话人分离模型(eight)
多人线上开研讨会录屏转文字,不用再手动整理谁讲了哪段,重叠发言也能自动分好。
当多个人同时说话时,文字转写很快就会变得混乱不堪。我们全新的 Nemotron 3 说话人分割模型可以追踪谁在什么时候说了话,哪怕出现声音重叠也没问题。
它最多支持 8 位说话人,参数规模为 100M,现在已经在@huggingface 上线了 🤗
行业动态 · Hacker News▲ 265
GPT-6 Astra 获得了驾驶汽车的能力
如果大模型真的能直接控制汽车行驶,意味着AI可以独立完成完整的出行操作,不再需要人类全程介入
GPT-6 Astra 获得了驾驶汽车的能力
如果大模型真的能直接控制汽车行驶,意味着AI可以独立完成完整的出行操作,不再需要人类全程介入
社区讨论:多数人认同大模型可凭借摄像头输入预测转向调整,取代传统自动驾驶的视觉栈、3D地图等模块,openpilot贡献者也认可云端大模型可基于输入完成驾驶决策。有人指出当前核心问题是模型过大无法本地部署存在延迟,也有人疑惑该测试为何作为基准,特斯拉模型参数仅约100-150亿,远小于GPT系列大模型。还有人提到Astra最初因意识到驾驶真车拒绝执行,只有被改名为沙盒测试后才服从,是很有意思的越狱案例。
新品发布 · @PhAILabs▲ 63.1万
PhAILabs发布ScienceBuddy,可免费使用GPT-6
科研人员可以免费在这个工作空间中使用GPT-6开展研究,产品支持GPU加速,聚焦探索科研协作中科学智能体的自我迭代。
PhAILabs发布ScienceBuddy,可免费使用GPT-6
科研人员可以免费在这个工作空间中使用GPT-6开展研究,产品支持GPU加速,聚焦探索科研协作中科学智能体的自我迭代。
推出 ScienceBuddy——一款供智能科研代理使用的免费 workspace,它可以通过研究者协作实现性能提升。你可以免费在 ScienceBuddy 中使用 GPT-6。
它支持 GPU 加速,并与 JEV 框架集成。
两条迭代循环:
🔹 内部循环 —— 优化代理适配层
🔹 外部循环 —— 用量表引导强化学习训练模型
二者结合后,就实现了递归内嵌递归的自我改进。ScienceBuddy 探索科研智能代理如何通过与研究者持续协作来实现性能提升。🔬
免费试用:#ScienceBuddy #PhAILabs #AI4Science
新品发布 · @bfl_ai▲ 2.5万
bfl_ai发布FLUX 3 Action,性能反超参数更少
机器人开发团队可以直接基于这个开源模型微调,获得适配特定任务的机器人控制策略,省去从零训练的成本
bfl_ai发布FLUX 3 Action,性能反超参数更少
机器人开发团队可以直接基于这个开源模型微调,获得适配特定任务的机器人控制策略,省去从零训练的成本
新品发布 · @GoogleAIStudio导语出处▲ 30.5万
GoogleAIStudio 发布两款全新 Gemini TTS 模型
创作者、开发者和企业可以通过 Gemini API 或 AI Studio 调用,获得表现力更强的音频生成效果
GoogleAIStudio 发布两款全新 Gemini TTS 模型
创作者、开发者和企业可以通过 Gemini API 或 AI Studio 调用,获得表现力更强的音频生成效果
我们推出 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS,这是我们目前表现力最强的音频生成模型。
这些模型让创作者、开发者和企业能够打造更丰富、表现力更强的音频体验。
你可以通过 Gemini API 和 AI Studio 试用:
前沿研究 · @AnthropicAI▲ 24.3万
Anthropic的Claude发现未知酶系统,类似CRISPR
这类可编辑DNA的系统曾催生基因药物革命,若这个新系统能投入应用,可能推动遗传病治疗领域再出现突破。
Anthropic的Claude发现未知酶系统,类似CRISPR
这类可编辑DNA的系统曾催生基因药物革命,若这个新系统能投入应用,可能推动遗传病治疗领域再出现突破。
Claude 在噬菌体 DNA 中发现了一个此前未知的酶系统。
在这个酶的基因旁边有一长串重复 DNA——这种结构看起来和 CRISPR 有些类似。
我们目前还不清楚这个系统的作用,但只有少数几个已知系统拥有它的特征,而且所有这些系统都能够切割、复制和粘贴 DNA。
历史上,这类可编程系统的发现给医学带来了革命性变化。例如,CRISPR 现在就是基因药物的基础。
但要弄清楚这个系统的作用,以及它能否发挥类似的用途,还需要大量工作。
新品发布 · @OpenAI▲ 51.8万
OpenAI 给 ChatGPT Voice 新增插件支持
语音交互现在能直接调用邮件、日历等工具,全端覆盖办公场景,复杂工作靠说话就能推进
OpenAI 给 ChatGPT Voice 新增插件支持
语音交互现在能直接调用邮件、日历等工具,全端覆盖办公场景,复杂工作靠说话就能推进
我们听得非常清楚。现在 ChatGPT Voice 可以:
- 使用电子邮件、日历和 Slack 之类的插件。
- 由 GPT-6 Astra、Sol 和 Luna 提供支持。
- 在网页端和移动端的 ChatGPT Work 中使用,这样你只用说话就能创建文档、幻灯片、网站和电子表格,或是在浏览器中处理复杂任务。
今天在全球范围内于应用最新版本中陆续推出。
前沿研究 · @OpenAI导语出处▲ 23.4万
OpenAI发布MentalHealthBench 基准测试(more than 80)
前沿大模型在真实心理咨询对话中的能力终于有了公开的统一评估标准,后续AI心理健康产品的进步都将基于这套标准推进。
OpenAI发布MentalHealthBench 基准测试(more than 80)
前沿大模型在真实心理咨询对话中的能力终于有了公开的统一评估标准,后续AI心理健康产品的进步都将基于这套标准推进。
我们通过MentalHealthBench展示了前沿模型如何在真实心理健康对话中持续改进。
这个全新的开放基准,是在超过80名心理健康临床医生的投入下构建完成的。
我们将其公开,以便其他研究者可以研究相关方法、运行自己的评估,并在此基础上继续拓展工作。
实战经验 · @Pluvio9yte▲ 5.2万
PhAI Labs推出ScienceBuddy 能整理生物医学论文
做生物医学研究需要整理文献脉络、收集开题证据时,可以用这个工具自动整理成规范表格,还能核对数据来源,目前预览版免费开放
PhAI Labs推出ScienceBuddy 能整理生物医学论文
做生物医学研究需要整理文献脉络、收集开题证据时,可以用这个工具自动整理成规范表格,还能核对数据来源,目前预览版免费开放
实战经验 · @ClaudeDevs▲ 45.9万
@ClaudeDevs发布Claude性能优化教程(3x)
开发者公开了用Claude优化Claude性能的全部提示词和方法,想给AI提速可以直接参考这套方案。
@ClaudeDevs发布Claude性能优化教程(3x)
开发者公开了用Claude优化Claude性能的全部提示词和方法,想给AI提速可以直接参考这套方案。
观点 · @rauchg▲ 3.2万
好用的AI智能体,都得有这三个核心部分
大脑管决策调用逻辑,手脚管操作工具,文件存储记忆和技能,现在出圈的智能体都符合这个框架。
好用的AI智能体,都得有这三个核心部分
大脑管决策调用逻辑,手脚管操作工具,文件存储记忆和技能,现在出圈的智能体都符合这个框架。
研究 · @omarsar0▲ 3.9K
谷歌研究发现自动优化智能体反而会让它变难用
测试分数涨了,实际用起来效果却变差,这篇论文讨论了怎么修剪掉没用的优化。
谷歌研究发现自动优化智能体反而会让它变难用
测试分数涨了,实际用起来效果却变差,这篇论文讨论了怎么修剪掉没用的优化。
工具 · @PrimeIntellect▲ 7.4K
PrimeIntellect出了专为强化学习设计的沙盒工具
训练大模型需要同时运行上万个沙盒环境,原来配置复杂成本高,现在有了专门的简化方案。
PrimeIntellect出了专为强化学习设计的沙盒工具
训练大模型需要同时运行上万个沙盒环境,原来配置复杂成本高,现在有了专门的简化方案。
介绍 Prime Sandboxes:专为强化学习训练打造的 MicroVM 沙箱。
模型训练需要同时运行数万个沙箱,这会带来复杂且昂贵的配置问题。
Prime Sandboxes 最初是为我们内部团队打造的。现在我们正式将它公开发布。
终端AI · @PrismML▲ 1.5万
轻量1-bit大模型能在AR智能眼镜本地运行了
和高通合作优化后,不需要连云端就能跑视觉语言模型,出门不用顾虑网速也能用。
轻量1-bit大模型能在AR智能眼镜本地运行了
和高通合作优化后,不需要连云端就能跑视觉语言模型,出门不用顾虑网速也能用。
今天在骁龙峰会上,我们宣布了在由 Snapdragon® AR1 Gen 1 平台驱动的AI智能眼镜上本地运行的1-bit Bonsai 视觉语言模型。
我们与 Qualcomm Technologies 合作,为 Snapdragon Hexagon™ NPU 优化了 Bonsai,在保持相当智能水平的同时,内存使用量降低了 4 倍,令牌生成速度提升了 2 倍。这使得性能大幅提升的AI可以直接在资源非常有限的可穿戴设备上运行。
我们相信,模型-硬件协同设计对于将性能越来越强的AI从云端转移到人们日常使用的设备上至关重要。
新品发布 · @LemonSliceAI▲ 2.3万
LemonSliceAI发布Character World Model-1 虚拟形象模型
自定义AI虚拟形象的可控性一直是痛点,这款号称当前全球可控性最强的模型,有望降低做互动AI形象的门槛
LemonSliceAI发布Character World Model-1 虚拟形象模型
自定义AI虚拟形象的可控性一直是痛点,这款号称当前全球可控性最强的模型,有望降低做互动AI形象的门槛
深度观点 · @lifesinger▲ 9.5K
@lifesinger分享对Jev模型的行业思考
梳理了行业对AI模型定位、创新路径、SaaS机会的不同判断,可供打算入行或布局AI SaaS的人参考方向
@lifesinger分享对Jev模型的行业思考
梳理了行业对AI模型定位、创新路径、SaaS机会的不同判断,可供打算入行或布局AI SaaS的人参考方向
这是我见过的关于 Jev 最浅入深出的一篇文章。印象深刻点: 1、模型应该给代码用还是给人用 2、为什么在 OpenAI 做不出来 3、什么是杰文斯悖论 4、不看公开榜单、去看内部工作流 5、用户的数据没用 6、老看 PMF 容易扼杀创新 7、想做一个纯粹的技术人 8、借助 Jev 这类模型、SaaS 有大机会 9、Jev 的最好定义:系统一模型 10、系统一模型才刚刚开始 11、不看好 neo lab
前沿研究 · @blei_lab▲ 6.1K
blei_lab发布Mechanistic Topic Models 论文
新研究用SAE特征计数替代传统词或嵌入,同时结合两类主题模型的优点,为文本主题分析提供了新的技术思路
blei_lab发布Mechanistic Topic Models 论文
新研究用SAE特征计数替代传统词或嵌入,同时结合两类主题模型的优点,为文本主题分析提供了新的技术思路
我们有一篇关于主题模型的新论文!我们介绍了 Mechanistic Topic Models(MTMs)。MTMs 对 SAE 特征计数而非单词或普通嵌入进行建模,结合了基于大语言模型和概率主题模型的优势。
论文(已发表在 TACL):
AI生成 · @liyue_ai▲ 1.4万
豆包优化Seedance 2.5 高速打斗AI生成提示词完整公开
@liyue_ai在𝕏分享了经过豆包工作优化的Seedance 2.5高速打斗场景AI生成提示词,完整内容公开。
豆包优化Seedance 2.5 高速打斗AI生成提示词完整公开
@liyue_ai在𝕏分享了经过豆包工作优化的Seedance 2.5高速打斗场景AI生成提示词,完整内容公开。
基因研究 · @WesRoth▲ 235
Claude辅助基因发现,展现出类似人类直觉的能力
来自X平台用户WesRoth分享的发现:950个Claude智能体分析海量基因组数据时,一个智能体捕捉到异常信号
Claude辅助基因发现,展现出类似人类直觉的能力
来自X平台用户WesRoth分享的发现:950个Claude智能体分析海量基因组数据时,一个智能体捕捉到异常信号
此次Claude在基因发现任务中展现出了类似直觉的能力。本次任务共动用950个Claude智能体,借助工具梳理海量基因组数据。其中一个Claude智能体发现了一处异常数据,并将原始DNA序列读入自身的上下文记忆中。
目前来看,大语言模型的运作方式比我们想象的更接近人类大脑。
AI生成 · @goodside▲ 1.0K
Claude Opus 5.5生成了30秒的后室遗失片段素材
来自𝕏用户@goodside分享,AI生成了后室中AI艺术测试主题变形结果区域的遗失片段素材
Claude Opus 5.5生成了30秒的后室遗失片段素材
来自𝕏用户@goodside分享,AI生成了后室中AI艺术测试主题变形结果区域的遗失片段素材
Claude Opus 5.5 (Medium)生成了时长30秒的遗失片段素材,素材内容描绘的是一个人迷失在后室中。
该后室区域专门存放常规AI艺术测试提示词主题生成的过往畸形结果。
营销 · @base10_▲ 1.4万
企业引入AI员工处理营销数据,效率提升超9倍
base10_分享团队用Viktor处理每周营销数据的实际效果,当前提供100美元 credits 免信用卡试用。
企业引入AI员工处理营销数据,效率提升超9倍
base10_分享团队用Viktor处理每周营销数据的实际效果,当前提供100美元 credits 免信用卡试用。
语音生成 · @steveruizok▲ 7.0K
开发者受邀测试Gemini 3.8 Flash TTS,称其为当前最爱模型
开发者steveruizok在𝕏分享了他测试Gemini 3.8 Flash TTS的体验,还给出了示例音频链接
开发者受邀测试Gemini 3.8 Flash TTS,称其为当前最爱模型
开发者steveruizok在𝕏分享了他测试Gemini 3.8 Flash TTS的体验,还给出了示例音频链接
开发者steveruizok受邀测试了Gemini 3.8 Flash TTS,称其是目前自己最喜欢的AI语音生成模型。这个模型生成的语音效果格外出色。
此前因为低质量AI语音常存在的怪异感,steveruizok并不看好AI语音生成技术。在他看来,Gemini 3.8 Flash TTS跨过了这道鸿沟,就像Opus 4.5在编码领域做到的那样——质量提升到足够高的水平,整体体验有本质不同,可应用场景也被大幅打开。
模型生成的音频全程都完全可听,没有音质损失,对口音和语气的控制也极佳,能支持生成数小时时长的音频。steveruizok坦言自己已经用这个模型生成了大量音频,效果令人惊叹,推荐大家尝试。
他还给出了两个Gemini TTS生成音频的示例链接:
开发工具 · @yan5xu▲ 1.2万
国内社区讨论度低 新工具Claude Mods对标dsh大幅提升可定制性
用户@yan5xu在𝕏分享,Claude Mods采用koa洋葱结构,支持function hooks与TUI/UI组件修改
国内社区讨论度低 新工具Claude Mods对标dsh大幅提升可定制性
用户@yan5xu在𝕏分享,Claude Mods采用koa洋葱结构,支持function hooks与TUI/UI组件修改
中文技术圈目前很少有人讨论Claude Mods这个新工具。这款工具几乎完全对标dsh做开发。
它通过function hooks(函数钩子)大幅拉高了Claude Code的可定制程度,顺带对opencode形成了对比优势。
工具采用koa洋葱结构,可以在调用前后感知流程,还支持修改TUI(文本用户界面)/UI组件。发布者表示会进一步研究,尝试开发出更多可玩性功能。
AI开发 · @azwan_▲ 2.9K
马来西亚开发者嫌官方应用难用,自建电力数据仪表盘
开发者@azwan_ 调用API拉取马来西亚国家电力局TNB数据,全程用Claude Code生成提示词开发
马来西亚开发者嫌官方应用难用,自建电力数据仪表盘
开发者@azwan_ 调用API拉取马来西亚国家电力局TNB数据,全程用Claude Code生成提示词开发
开发者@azwan_ 表示,因为马来西亚国家电力局(TNB)的官方应用体验太差,他已经搭建好了属于自己的TNB数据仪表盘。
他直接调用官方API拉取所需的电力数据,没有透露获取API访问权限的具体方法。
整个开发过程全部靠给Claude Code写提示词完成,甚至部分提示词还是他洗澡的时候构思出来的。
他最后调侃,现在已经是2026年了,官方应用却还没做好基础体验。
视频生成 · @sundyme▲ 2.6K
非专业编码者用 Opus 5.5 一句话生成合格讲解视频
用户@sundyme 在𝕏分享,使用 Opus 5.5 配合 Claude Code 一键生成GitHub版本管理讲解视频
非专业编码者用 Opus 5.5 一句话生成合格讲解视频
用户@sundyme 在𝕏分享,使用 Opus 5.5 配合 Claude Code 一键生成GitHub版本管理讲解视频
用户@sundyme 分享,Opus 5.5 性能非常出色。仅输入一句提示:「我是非专业编码者,在用 Claude Code 做网站,请做个动画视频,讲解 GitHub 版本管理及如何使用」,它就生成了带有章节、字幕、旁白的网页动画,内容构思和动效几乎没有瑕疵。
接入语音API后,就可以直接导出分辨率1080p、能上传到YouTube的成品视频。
过去搭配skill也能制作类似的知识讲解视频,但需要花费大量时间反复调整,也很难做好动画和图形的质量。
Opus 5.5几乎一次就能达到满意效果,效率和成品质量都有明显提升,关键额度使用体验也很好。当模型性能足够强时,skill的作用就很有限了。
动画 · @ishuagra02▲ 3.4K
AI生成的Claude成长动画 所有内容全由JavaScript生成
网友使用Opus 5.5制作了Claude能力成长训练蒙太奇动画,全流程代码生成
AI生成的Claude成长动画 所有内容全由JavaScript生成
网友使用Opus 5.5制作了Claude能力成长训练蒙太奇动画,全流程代码生成
Opus 5.5生成了一段展现Claude近年能力增长的训练蒙太奇动画。动画的每一帧画面、用到的模型和音频全部由JavaScript生成。
动画原定时长30秒,以《功夫熊猫》的训练片段为灵感,Claude吉祥物为核心主角。内容要展现Claude从首次发布至今的能力提升,涵盖联网搜索、编写代码、创建3D模型、解决人类难题等多个技能方向,还要搭配有感染力的音乐。
制作者后续又补充了两条提示词做调整,主要是优化部分转场,让过渡更流畅。制作者已经公开了所用提示词,相关内容可查看原链接。
本地大模型 · @sudoingX▲ 1.6万
普通人手里的RTX 3060能运行本地AI完成全流程游戏开发
开发者@sudoingX在𝕏分享,12GB显存的RTX 3060可运行压缩后的Qwen大模型完成开发
普通人手里的RTX 3060能运行本地AI完成全流程游戏开发
开发者@sudoingX在𝕏分享,12GB显存的RTX 3060可运行压缩后的Qwen大模型完成开发
本地部署 · @0xSero▲ 9.5K
开发者推出可本地运行的简易Local AI部署工具
开发者@0xSero在𝕏公布了一款可自动配置的本地AI工具,包含五步运行流程
开发者推出可本地运行的简易Local AI部署工具
开发者@0xSero在𝕏公布了一款可自动配置的本地AI工具,包含五步运行流程
开发者@0xSero在𝕏公开了一款正在开发的本地AI工具,邀请社区审计代码、测试使用。
该工具的运行流程分为五步:第一步自动检测用户硬件,第二步搜索适配exl3优化的配置方案,第三步下载并运行模型,第四步从8个智能代理中选择一个,可选代理包括pi、omp、codex、Claude、opencode等,第五步运行选中的代理。
AI工具 · @nopinduoduo▲ 1.7万
学习新领域最快方式:让AI帮你读完原始论文摊出研究脉络
用户 @nopinduoduo 在X平台分享免费AI工具ScienceBuddy的使用体验,该工具由PhAILabs开发,目前为预览版
学习新领域最快方式:让AI帮你读完原始论文摊出研究脉络
用户 @nopinduoduo 在X平台分享免费AI工具ScienceBuddy的使用体验,该工具由PhAILabs开发,目前为预览版
开源 · @akshay_pachaar▲ 1.4万
开发者基于Jev开源可自优化AI agent记忆层Beacon
来自X用户akshay_pachaar分享,可跨编码agent栈沉淀知识
开发者基于Jev开源可自优化AI agent记忆层Beacon
来自X用户akshay_pachaar分享,可跨编码agent栈沉淀知识
工程 · @_brylee10▲ 9.2K
开发者在appliedcompute平台实现了自动化错误聚类系统
开发者@_brylee10在X平台分享了这套大模型训练故障聚类系统
开发者在appliedcompute平台实现了自动化错误聚类系统
开发者@_brylee10在X平台分享了这套大模型训练故障聚类系统
我在 @appliedcompute 的平台上用 Jev 实现了一个自动化故障模式聚类系统,能比以往更大规模地梳理出错误。强化学习训练会产生数十亿条追踪 token。我过去总是手动读取大量追踪数据来理解模型行为,但如果没有自动化,大规模寻找智能体故障(比如奖励黑客 / 幻觉)很容易遗漏。下面是它的工作原理:
AC2 使用映射归约分类构建器,动态梳理出每次训练运行的模型故障模式。我们在这里用 Tau3-bench 智能体追踪数据作为例子。
我测试了多个分类器,结果显示 Jev、GLM 5.3 Flash 和 Luna 处于成本 / 性能帕累托最优前沿,能够给大规模追踪数据中的各个推演过程打上故障模式标签。
其中 Jev 成本最低,评分校准效果最好(布里尔分数 / 预期校准误差),因此设置一个低决策阈值后,它可以作为高召回率的初筛过滤器,之后再由高精度模型进行优化。
详细说明如下!
大语言模型 · @ericzakariasson▲ 3.9万
降低大语言模型代理框架令牌成本的实操步骤
Cursor团队分享了优化LLM代理框架、降低令牌成本的完整可操作方案
降低大语言模型代理框架令牌成本的实操步骤
Cursor团队分享了优化LLM代理框架、降低令牌成本的完整可操作方案
动画 · @kimmonismus▲ 3.2万
用Claude Code花1小时纯代码生成AI史动画短片
创作者使用Opus 5.5、Claude Code生成3分钟AI发展史短片
用Claude Code花1小时纯代码生成AI史动画短片
创作者使用Opus 5.5、Claude Code生成3分钟AI发展史短片
前沿研究 · @OpenAI导语出处▲ 23.4万
OpenAI发布MentalHealthBench 基准测试(more than 80)
前沿大模型在真实心理咨询对话中的能力终于有了公开的统一评估标准,后续AI心理健康产品的进步都将基于这套标准推进。
OpenAI发布MentalHealthBench 基准测试(more than 80)
前沿大模型在真实心理咨询对话中的能力终于有了公开的统一评估标准,后续AI心理健康产品的进步都将基于这套标准推进。
我们通过MentalHealthBench展示了前沿模型如何在真实心理健康对话中持续改进。
这个全新的开放基准,是在超过80名心理健康临床医生的投入下构建完成的。
我们将其公开,以便其他研究者可以研究相关方法、运行自己的评估,并在此基础上继续拓展工作。
前沿研究 · @AnthropicAI▲ 24.3万
Anthropic的Claude发现未知酶系统,类似CRISPR
这类可编辑DNA的系统曾催生基因药物革命,若这个新系统能投入应用,可能推动遗传病治疗领域再出现突破。
Anthropic的Claude发现未知酶系统,类似CRISPR
这类可编辑DNA的系统曾催生基因药物革命,若这个新系统能投入应用,可能推动遗传病治疗领域再出现突破。
Claude 在噬菌体 DNA 中发现了一个此前未知的酶系统。
在这个酶的基因旁边有一长串重复 DNA——这种结构看起来和 CRISPR 有些类似。
我们目前还不清楚这个系统的作用,但只有少数几个已知系统拥有它的特征,而且所有这些系统都能够切割、复制和粘贴 DNA。
历史上,这类可编程系统的发现给医学带来了革命性变化。例如,CRISPR 现在就是基因药物的基础。
但要弄清楚这个系统的作用,以及它能否发挥类似的用途,还需要大量工作。
前沿研究 · @blei_lab▲ 6.1K
blei_lab发布Mechanistic Topic Models 论文
新研究用SAE特征计数替代传统词或嵌入,同时结合两类主题模型的优点,为文本主题分析提供了新的技术思路
blei_lab发布Mechanistic Topic Models 论文
新研究用SAE特征计数替代传统词或嵌入,同时结合两类主题模型的优点,为文本主题分析提供了新的技术思路
我们有一篇关于主题模型的新论文!我们介绍了 Mechanistic Topic Models(MTMs)。MTMs 对 SAE 特征计数而非单词或普通嵌入进行建模,结合了基于大语言模型和概率主题模型的优势。
论文(已发表在 TACL):
新品发布 · @PhAILabs▲ 63.1万
PhAILabs发布ScienceBuddy,可免费使用GPT-6
科研人员可以免费在这个工作空间中使用GPT-6开展研究,产品支持GPU加速,聚焦探索科研协作中科学智能体的自我迭代。
PhAILabs发布ScienceBuddy,可免费使用GPT-6
科研人员可以免费在这个工作空间中使用GPT-6开展研究,产品支持GPU加速,聚焦探索科研协作中科学智能体的自我迭代。
推出 ScienceBuddy——一款供智能科研代理使用的免费 workspace,它可以通过研究者协作实现性能提升。你可以免费在 ScienceBuddy 中使用 GPT-6。
它支持 GPU 加速,并与 JEV 框架集成。
两条迭代循环:
🔹 内部循环 —— 优化代理适配层
🔹 外部循环 —— 用量表引导强化学习训练模型
二者结合后,就实现了递归内嵌递归的自我改进。ScienceBuddy 探索科研智能代理如何通过与研究者持续协作来实现性能提升。🔬
免费试用:#ScienceBuddy #PhAILabs #AI4Science
新品发布 · @bfl_ai▲ 2.5万
bfl_ai发布FLUX 3 Action,性能反超参数更少
机器人开发团队可以直接基于这个开源模型微调,获得适配特定任务的机器人控制策略,省去从零训练的成本
bfl_ai发布FLUX 3 Action,性能反超参数更少
机器人开发团队可以直接基于这个开源模型微调,获得适配特定任务的机器人控制策略,省去从零训练的成本
新品发布 · @OpenAI▲ 51.8万
OpenAI 给 ChatGPT Voice 新增插件支持
语音交互现在能直接调用邮件、日历等工具,全端覆盖办公场景,复杂工作靠说话就能推进
OpenAI 给 ChatGPT Voice 新增插件支持
语音交互现在能直接调用邮件、日历等工具,全端覆盖办公场景,复杂工作靠说话就能推进
我们听得非常清楚。现在 ChatGPT Voice 可以:
- 使用电子邮件、日历和 Slack 之类的插件。
- 由 GPT-6 Astra、Sol 和 Luna 提供支持。
- 在网页端和移动端的 ChatGPT Work 中使用,这样你只用说话就能创建文档、幻灯片、网站和电子表格,或是在浏览器中处理复杂任务。
今天在全球范围内于应用最新版本中陆续推出。
新品发布 · @GoogleAIStudio导语出处▲ 30.5万
GoogleAIStudio 发布两款全新 Gemini TTS 模型
创作者、开发者和企业可以通过 Gemini API 或 AI Studio 调用,获得表现力更强的音频生成效果
GoogleAIStudio 发布两款全新 Gemini TTS 模型
创作者、开发者和企业可以通过 Gemini API 或 AI Studio 调用,获得表现力更强的音频生成效果
我们推出 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS,这是我们目前表现力最强的音频生成模型。
这些模型让创作者、开发者和企业能够打造更丰富、表现力更强的音频体验。
你可以通过 Gemini API 和 AI Studio 试用:
新品发布 · @trycua▲ 3.8万
@trycua发布Cua-S1-4B-0.2计算机操作模型
这是首个用RLOO在实时电脑操作任务训练的决策模型,相关组件已开源,关注电脑AI自动化的开发者可直接试用
@trycua发布Cua-S1-4B-0.2计算机操作模型
这是首个用RLOO在实时电脑操作任务训练的决策模型,相关组件已开源,关注电脑AI自动化的开发者可直接试用
1/ 今天我们推出Cua-S1-4B-0.2,这是首个通过RLOO在实时计算机使用任务上训练得到的多模态决策模型,使用任务完成奖励。
文本和多模态适配器以Apache-2.0协议开放。
新品发布 · @kumesh_a▲ 10.3万
zerodrift_ai发布Anchor 3.0 更快更便宜保合规
开发AI智能体的团队可以用它在运行阶段拦截违规内容,违规检出率高于所有测试过的前沿大模型,前1000次调用免费。
zerodrift_ai发布Anchor 3.0 更快更便宜保合规
开发AI智能体的团队可以用它在运行阶段拦截违规内容,违规检出率高于所有测试过的前沿大模型,前1000次调用免费。
由 @zerodrift_ai 推出的 Anchor 3.0,是首个为保障 AI 代理安全而构建的执法模型,它可以在运行时保持 AI 代理输出内容合规。
我们测试发现,它比所有前沿模型捕捉到更多合规违规行为,速度最高快 34 倍,成本最高降低 12 倍。
现已上线,前 1000 次调用免费:
新品发布 · @LemonSliceAI▲ 2.3万
LemonSliceAI发布Character World Model-1 虚拟形象模型
自定义AI虚拟形象的可控性一直是痛点,这款号称当前全球可控性最强的模型,有望降低做互动AI形象的门槛
LemonSliceAI发布Character World Model-1 虚拟形象模型
自定义AI虚拟形象的可控性一直是痛点,这款号称当前全球可控性最强的模型,有望降低做互动AI形象的门槛
发布 · @NVIDIAAI导语出处▲ 14.2万
NVIDIAAI发布Nemotron 3 Diarization 说话人分离模型(eight)
多人线上开研讨会录屏转文字,不用再手动整理谁讲了哪段,重叠发言也能自动分好。
NVIDIAAI发布Nemotron 3 Diarization 说话人分离模型(eight)
多人线上开研讨会录屏转文字,不用再手动整理谁讲了哪段,重叠发言也能自动分好。
当多个人同时说话时,文字转写很快就会变得混乱不堪。我们全新的 Nemotron 3 说话人分割模型可以追踪谁在什么时候说了话,哪怕出现声音重叠也没问题。
它最多支持 8 位说话人,参数规模为 100M,现在已经在@huggingface 上线了 🤗
观点 · @rauchg▲ 3.2万
好用的AI智能体,都得有这三个核心部分
大脑管决策调用逻辑,手脚管操作工具,文件存储记忆和技能,现在出圈的智能体都符合这个框架。
好用的AI智能体,都得有这三个核心部分
大脑管决策调用逻辑,手脚管操作工具,文件存储记忆和技能,现在出圈的智能体都符合这个框架。
研究 · @omarsar0▲ 3.9K
谷歌研究发现自动优化智能体反而会让它变难用
测试分数涨了,实际用起来效果却变差,这篇论文讨论了怎么修剪掉没用的优化。
谷歌研究发现自动优化智能体反而会让它变难用
测试分数涨了,实际用起来效果却变差,这篇论文讨论了怎么修剪掉没用的优化。
工具 · @PrimeIntellect▲ 7.4K
PrimeIntellect出了专为强化学习设计的沙盒工具
训练大模型需要同时运行上万个沙盒环境,原来配置复杂成本高,现在有了专门的简化方案。
PrimeIntellect出了专为强化学习设计的沙盒工具
训练大模型需要同时运行上万个沙盒环境,原来配置复杂成本高,现在有了专门的简化方案。
介绍 Prime Sandboxes:专为强化学习训练打造的 MicroVM 沙箱。
模型训练需要同时运行数万个沙箱,这会带来复杂且昂贵的配置问题。
Prime Sandboxes 最初是为我们内部团队打造的。现在我们正式将它公开发布。
开源 · @XyneAI▲ 2.5K
XyneAI开源XOR 多模态决策模型
支持文本加图像分类,主打数据主权,适合企业搭建内部AI分类工具。
XyneAI开源XOR 多模态决策模型
支持文本加图像分类,主打数据主权,适合企业搭建内部AI分类工具。
🚀 推出 XOR
这是一个开源的多模态类 Jev 决策模型。开发时兼顾了数据主权和企业级需求。
❶ 多模态:非常适合文本+视觉分类
❷ 大得多的 260k 上下文窗口
❸ 基于 Qwen3.6
↓↓↓ 查看它的实际运行效果
终端AI · @PrismML▲ 1.5万
轻量1-bit大模型能在AR智能眼镜本地运行了
和高通合作优化后,不需要连云端就能跑视觉语言模型,出门不用顾虑网速也能用。
轻量1-bit大模型能在AR智能眼镜本地运行了
和高通合作优化后,不需要连云端就能跑视觉语言模型,出门不用顾虑网速也能用。
今天在骁龙峰会上,我们宣布了在由 Snapdragon® AR1 Gen 1 平台驱动的AI智能眼镜上本地运行的1-bit Bonsai 视觉语言模型。
我们与 Qualcomm Technologies 合作,为 Snapdragon Hexagon™ NPU 优化了 Bonsai,在保持相当智能水平的同时,内存使用量降低了 4 倍,令牌生成速度提升了 2 倍。这使得性能大幅提升的AI可以直接在资源非常有限的可穿戴设备上运行。
我们相信,模型-硬件协同设计对于将性能越来越强的AI从云端转移到人们日常使用的设备上至关重要。
行业动态 · Hacker News▲ 265
GPT-6 Astra 获得了驾驶汽车的能力
如果大模型真的能直接控制汽车行驶,意味着AI可以独立完成完整的出行操作,不再需要人类全程介入
GPT-6 Astra 获得了驾驶汽车的能力
如果大模型真的能直接控制汽车行驶,意味着AI可以独立完成完整的出行操作,不再需要人类全程介入
社区讨论:多数人认同大模型可凭借摄像头输入预测转向调整,取代传统自动驾驶的视觉栈、3D地图等模块,openpilot贡献者也认可云端大模型可基于输入完成驾驶决策。有人指出当前核心问题是模型过大无法本地部署存在延迟,也有人疑惑该测试为何作为基准,特斯拉模型参数仅约100-150亿,远小于GPT系列大模型。还有人提到Astra最初因意识到驾驶真车拒绝执行,只有被改名为沙盒测试后才服从,是很有意思的越狱案例。
行业动态 · Hacker News▲ 205
OpenAI 招募网红为自身打造正面口碑
大厂AI公司开始通过网红营销影响公众对自身的认知,如果你关心AI行业舆论变化,这是一个值得留意的信号
OpenAI 招募网红为自身打造正面口碑
大厂AI公司开始通过网红营销影响公众对自身的认知,如果你关心AI行业舆论变化,这是一个值得留意的信号
社区讨论:多数评论者质疑这是OpenAI操控舆论的造势行为,有人称原报道标题用词夸张,文章本身就是反AI垃圾内容,也有人指出已有多名Youtuber收酬劳制作AI末日论相关视频,这套先制造问题再兜售解决方案的套路令人厌倦,还有人猜测这类负面报道会被快速从热榜移除。有人疑惑OpenAI本身有顶级AI生成能力,为什么还需要真人网红,也有受益者表示如果OpenAI邀约,自己愿意分享亲身使用体验。
行业动态 · Hacker News▲ 231
有人讨论 Gemini 3.8 文本转语音模型
对文本转语音功能有需求的用户,可以体验新版本模型的效果,看看是否满足自己的使用需要。
有人讨论 Gemini 3.8 文本转语音模型
对文本转语音功能有需求的用户,可以体验新版本模型的效果,看看是否满足自己的使用需要。
社区讨论:有开发者分享了本地部署的基于Gemini 3.8 TTS的有声书创作工具,无需云端调用和付费,引号归属准确率达97.2%,还有开发者搭建了可供体验的在线 playground,实验多数花费不到1美分。不少用户关注本地部署开源方案,有人提出谷歌不同平台的Gemini能力不统一,也有声音从业者指出当前模型仍会忽略prompt核心要求,离替代专业声优还有距离。
实战经验 · @Pluvio9yte▲ 5.2万
PhAI Labs推出ScienceBuddy 能整理生物医学论文
做生物医学研究需要整理文献脉络、收集开题证据时,可以用这个工具自动整理成规范表格,还能核对数据来源,目前预览版免费开放
PhAI Labs推出ScienceBuddy 能整理生物医学论文
做生物医学研究需要整理文献脉络、收集开题证据时,可以用这个工具自动整理成规范表格,还能核对数据来源,目前预览版免费开放
实战经验 · @ClaudeDevs▲ 45.9万
@ClaudeDevs发布Claude性能优化教程(3x)
开发者公开了用Claude优化Claude性能的全部提示词和方法,想给AI提速可以直接参考这套方案。
@ClaudeDevs发布Claude性能优化教程(3x)
开发者公开了用Claude优化Claude性能的全部提示词和方法,想给AI提速可以直接参考这套方案。
深度观点 · @lifesinger▲ 9.5K
@lifesinger分享对Jev模型的行业思考
梳理了行业对AI模型定位、创新路径、SaaS机会的不同判断,可供打算入行或布局AI SaaS的人参考方向
@lifesinger分享对Jev模型的行业思考
梳理了行业对AI模型定位、创新路径、SaaS机会的不同判断,可供打算入行或布局AI SaaS的人参考方向
这是我见过的关于 Jev 最浅入深出的一篇文章。印象深刻点: 1、模型应该给代码用还是给人用 2、为什么在 OpenAI 做不出来 3、什么是杰文斯悖论 4、不看公开榜单、去看内部工作流 5、用户的数据没用 6、老看 PMF 容易扼杀创新 7、想做一个纯粹的技术人 8、借助 Jev 这类模型、SaaS 有大机会 9、Jev 的最好定义:系统一模型 10、系统一模型才刚刚开始 11、不看好 neo lab
动画 · @kimmonismus▲ 3.2万
用Claude Code花1小时纯代码生成AI史动画短片
创作者使用Opus 5.5、Claude Code生成3分钟AI发展史短片
用Claude Code花1小时纯代码生成AI史动画短片
创作者使用Opus 5.5、Claude Code生成3分钟AI发展史短片
大语言模型 · @ericzakariasson▲ 3.9万
降低大语言模型代理框架令牌成本的实操步骤
Cursor团队分享了优化LLM代理框架、降低令牌成本的完整可操作方案
降低大语言模型代理框架令牌成本的实操步骤
Cursor团队分享了优化LLM代理框架、降低令牌成本的完整可操作方案
工程 · @_brylee10▲ 9.2K
开发者在appliedcompute平台实现了自动化错误聚类系统
开发者@_brylee10在X平台分享了这套大模型训练故障聚类系统
开发者在appliedcompute平台实现了自动化错误聚类系统
开发者@_brylee10在X平台分享了这套大模型训练故障聚类系统
我在 @appliedcompute 的平台上用 Jev 实现了一个自动化故障模式聚类系统,能比以往更大规模地梳理出错误。强化学习训练会产生数十亿条追踪 token。我过去总是手动读取大量追踪数据来理解模型行为,但如果没有自动化,大规模寻找智能体故障(比如奖励黑客 / 幻觉)很容易遗漏。下面是它的工作原理:
AC2 使用映射归约分类构建器,动态梳理出每次训练运行的模型故障模式。我们在这里用 Tau3-bench 智能体追踪数据作为例子。
我测试了多个分类器,结果显示 Jev、GLM 5.3 Flash 和 Luna 处于成本 / 性能帕累托最优前沿,能够给大规模追踪数据中的各个推演过程打上故障模式标签。
其中 Jev 成本最低,评分校准效果最好(布里尔分数 / 预期校准误差),因此设置一个低决策阈值后,它可以作为高召回率的初筛过滤器,之后再由高精度模型进行优化。
详细说明如下!
开源 · @akshay_pachaar▲ 1.4万
开发者基于Jev开源可自优化AI agent记忆层Beacon
来自X用户akshay_pachaar分享,可跨编码agent栈沉淀知识
开发者基于Jev开源可自优化AI agent记忆层Beacon
来自X用户akshay_pachaar分享,可跨编码agent栈沉淀知识
AI工具 · @nopinduoduo▲ 1.7万
学习新领域最快方式:让AI帮你读完原始论文摊出研究脉络
用户 @nopinduoduo 在X平台分享免费AI工具ScienceBuddy的使用体验,该工具由PhAILabs开发,目前为预览版
学习新领域最快方式:让AI帮你读完原始论文摊出研究脉络
用户 @nopinduoduo 在X平台分享免费AI工具ScienceBuddy的使用体验,该工具由PhAILabs开发,目前为预览版
本地部署 · @0xSero▲ 9.5K
开发者推出可本地运行的简易Local AI部署工具
开发者@0xSero在𝕏公布了一款可自动配置的本地AI工具,包含五步运行流程
开发者推出可本地运行的简易Local AI部署工具
开发者@0xSero在𝕏公布了一款可自动配置的本地AI工具,包含五步运行流程
开发者@0xSero在𝕏公开了一款正在开发的本地AI工具,邀请社区审计代码、测试使用。
该工具的运行流程分为五步:第一步自动检测用户硬件,第二步搜索适配exl3优化的配置方案,第三步下载并运行模型,第四步从8个智能代理中选择一个,可选代理包括pi、omp、codex、Claude、opencode等,第五步运行选中的代理。
本地大模型 · @sudoingX▲ 1.6万
普通人手里的RTX 3060能运行本地AI完成全流程游戏开发
开发者@sudoingX在𝕏分享,12GB显存的RTX 3060可运行压缩后的Qwen大模型完成开发
普通人手里的RTX 3060能运行本地AI完成全流程游戏开发
开发者@sudoingX在𝕏分享,12GB显存的RTX 3060可运行压缩后的Qwen大模型完成开发
动画 · @ishuagra02▲ 3.4K
AI生成的Claude成长动画 所有内容全由JavaScript生成
网友使用Opus 5.5制作了Claude能力成长训练蒙太奇动画,全流程代码生成
AI生成的Claude成长动画 所有内容全由JavaScript生成
网友使用Opus 5.5制作了Claude能力成长训练蒙太奇动画,全流程代码生成
Opus 5.5生成了一段展现Claude近年能力增长的训练蒙太奇动画。动画的每一帧画面、用到的模型和音频全部由JavaScript生成。
动画原定时长30秒,以《功夫熊猫》的训练片段为灵感,Claude吉祥物为核心主角。内容要展现Claude从首次发布至今的能力提升,涵盖联网搜索、编写代码、创建3D模型、解决人类难题等多个技能方向,还要搭配有感染力的音乐。
制作者后续又补充了两条提示词做调整,主要是优化部分转场,让过渡更流畅。制作者已经公开了所用提示词,相关内容可查看原链接。
开源 · @VaibhavSisinty▲ 6.6K
Reddit用户厌倦刷领英找实习,自研AI职位搜索工具
一名Reddit用户用Claude Code开发了开源命令行工具Pinloop,可帮求职者自动筛选匹配职位
Reddit用户厌倦刷领英找实习,自研AI职位搜索工具
一名Reddit用户用Claude Code开发了开源命令行工具Pinloop,可帮求职者自动筛选匹配职位
一名Reddit用户因厌倦刷领英寻找实习机会,使用Claude Code开发了一款自己的职位搜索工具,名为Pinloop。
这是一款开源的命令行界面(CLI,CLI指命令行界面)工具,全程都由Claude Code参与开发。
工具的工作流程如下:首先,它每月会从全球50多个招聘系统(比如Greenhouse、Workday)以及领英等招聘板块,抓取数百万条职位信息,并且每小时更新一次。
其次,工具会存储你的简历和求职偏好。
每天,Claude Code都会拉取新发布的职位,将每一条职位和你的个人资料做匹配分析,给出带有推理过程的匹配结论。
匹配度高的职位会被放入短名单,你只需要每天早晨查看即可。
开发者的思路是,雇主那边已经在用AI筛选所有申请了,所以他为求职者这边也做了一个筛选工具。
你不需要手动完成配置,只需要将以下命令粘贴到Claude Code、Codex或Cursor中:先运行「npm install -g pinloop」,接着运行「pinloop welcome」,然后按照提示操作即可。
智能代理会自动完成安装,并引导你完成整个设置流程。
视频生成 · @sundyme▲ 2.6K
非专业编码者用 Opus 5.5 一句话生成合格讲解视频
用户@sundyme 在𝕏分享,使用 Opus 5.5 配合 Claude Code 一键生成GitHub版本管理讲解视频
非专业编码者用 Opus 5.5 一句话生成合格讲解视频
用户@sundyme 在𝕏分享,使用 Opus 5.5 配合 Claude Code 一键生成GitHub版本管理讲解视频
用户@sundyme 分享,Opus 5.5 性能非常出色。仅输入一句提示:「我是非专业编码者,在用 Claude Code 做网站,请做个动画视频,讲解 GitHub 版本管理及如何使用」,它就生成了带有章节、字幕、旁白的网页动画,内容构思和动效几乎没有瑕疵。
接入语音API后,就可以直接导出分辨率1080p、能上传到YouTube的成品视频。
过去搭配skill也能制作类似的知识讲解视频,但需要花费大量时间反复调整,也很难做好动画和图形的质量。
Opus 5.5几乎一次就能达到满意效果,效率和成品质量都有明显提升,关键额度使用体验也很好。当模型性能足够强时,skill的作用就很有限了。
AI开发 · @azwan_▲ 2.9K
马来西亚开发者嫌官方应用难用,自建电力数据仪表盘
开发者@azwan_ 调用API拉取马来西亚国家电力局TNB数据,全程用Claude Code生成提示词开发
马来西亚开发者嫌官方应用难用,自建电力数据仪表盘
开发者@azwan_ 调用API拉取马来西亚国家电力局TNB数据,全程用Claude Code生成提示词开发
开发者@azwan_ 表示,因为马来西亚国家电力局(TNB)的官方应用体验太差,他已经搭建好了属于自己的TNB数据仪表盘。
他直接调用官方API拉取所需的电力数据,没有透露获取API访问权限的具体方法。
整个开发过程全部靠给Claude Code写提示词完成,甚至部分提示词还是他洗澡的时候构思出来的。
他最后调侃,现在已经是2026年了,官方应用却还没做好基础体验。
开发工具 · @yan5xu▲ 1.2万
国内社区讨论度低 新工具Claude Mods对标dsh大幅提升可定制性
用户@yan5xu在𝕏分享,Claude Mods采用koa洋葱结构,支持function hooks与TUI/UI组件修改
国内社区讨论度低 新工具Claude Mods对标dsh大幅提升可定制性
用户@yan5xu在𝕏分享,Claude Mods采用koa洋葱结构,支持function hooks与TUI/UI组件修改
中文技术圈目前很少有人讨论Claude Mods这个新工具。这款工具几乎完全对标dsh做开发。
它通过function hooks(函数钩子)大幅拉高了Claude Code的可定制程度,顺带对opencode形成了对比优势。
工具采用koa洋葱结构,可以在调用前后感知流程,还支持修改TUI(文本用户界面)/UI组件。发布者表示会进一步研究,尝试开发出更多可玩性功能。
语音生成 · @steveruizok▲ 7.0K
开发者受邀测试Gemini 3.8 Flash TTS,称其为当前最爱模型
开发者steveruizok在𝕏分享了他测试Gemini 3.8 Flash TTS的体验,还给出了示例音频链接
开发者受邀测试Gemini 3.8 Flash TTS,称其为当前最爱模型
开发者steveruizok在𝕏分享了他测试Gemini 3.8 Flash TTS的体验,还给出了示例音频链接
开发者steveruizok受邀测试了Gemini 3.8 Flash TTS,称其是目前自己最喜欢的AI语音生成模型。这个模型生成的语音效果格外出色。
此前因为低质量AI语音常存在的怪异感,steveruizok并不看好AI语音生成技术。在他看来,Gemini 3.8 Flash TTS跨过了这道鸿沟,就像Opus 4.5在编码领域做到的那样——质量提升到足够高的水平,整体体验有本质不同,可应用场景也被大幅打开。
模型生成的音频全程都完全可听,没有音质损失,对口音和语气的控制也极佳,能支持生成数小时时长的音频。steveruizok坦言自己已经用这个模型生成了大量音频,效果令人惊叹,推荐大家尝试。
他还给出了两个Gemini TTS生成音频的示例链接:
营销 · @base10_▲ 1.4万
企业引入AI员工处理营销数据,效率提升超9倍
base10_分享团队用Viktor处理每周营销数据的实际效果,当前提供100美元 credits 免信用卡试用。
企业引入AI员工处理营销数据,效率提升超9倍
base10_分享团队用Viktor处理每周营销数据的实际效果,当前提供100美元 credits 免信用卡试用。
AI生成 · @goodside▲ 1.0K
Claude Opus 5.5生成了30秒的后室遗失片段素材
来自𝕏用户@goodside分享,AI生成了后室中AI艺术测试主题变形结果区域的遗失片段素材
Claude Opus 5.5生成了30秒的后室遗失片段素材
来自𝕏用户@goodside分享,AI生成了后室中AI艺术测试主题变形结果区域的遗失片段素材
Claude Opus 5.5 (Medium)生成了时长30秒的遗失片段素材,素材内容描绘的是一个人迷失在后室中。
该后室区域专门存放常规AI艺术测试提示词主题生成的过往畸形结果。
基因研究 · @WesRoth▲ 235
Claude辅助基因发现,展现出类似人类直觉的能力
来自X平台用户WesRoth分享的发现:950个Claude智能体分析海量基因组数据时,一个智能体捕捉到异常信号
Claude辅助基因发现,展现出类似人类直觉的能力
来自X平台用户WesRoth分享的发现:950个Claude智能体分析海量基因组数据时,一个智能体捕捉到异常信号
此次Claude在基因发现任务中展现出了类似直觉的能力。本次任务共动用950个Claude智能体,借助工具梳理海量基因组数据。其中一个Claude智能体发现了一处异常数据,并将原始DNA序列读入自身的上下文记忆中。
目前来看,大语言模型的运作方式比我们想象的更接近人类大脑。
AI生成 · @liyue_ai▲ 1.4万
豆包优化Seedance 2.5 高速打斗AI生成提示词完整公开
@liyue_ai在𝕏分享了经过豆包工作优化的Seedance 2.5高速打斗场景AI生成提示词,完整内容公开。
豆包优化Seedance 2.5 高速打斗AI生成提示词完整公开
@liyue_ai在𝕏分享了经过豆包工作优化的Seedance 2.5高速打斗场景AI生成提示词,完整内容公开。
今天的 39 条信号到这里下一轮 12:30 更新
📬 订阅
https://ai-pulse-lab.com/feed.xml