社区讨论:作者澄清这不是大语言模型,是从头训练的小型自回归Transformer,核心观点是复杂问题无需大模型即可解决,此前该基准只有耗费巨额成本的大模型或微调能参与。有人质疑只跑单个基准、存在训练数据泄露过拟合,作者澄清并未使用测试集标签训练,该方法实现提交后从头训练,能避免合成数据刷榜保证公平。多数开发者认可样本效率是AI未解决的核心问题。
今天发生了什么1 分钟读懂
OpenAI公布新模型Astra的细节:这是第一个达到自家“关键网络安全阈值”的大语言模型,不用人指挥就能发现并利用系统漏洞。在工程师改版的测试里,Astra发现并利用了2个还没有公开修复方案的零日漏洞。详情见今日深读。
来源今日深读《OpenAI新模型Astra自主发现并利用2个零日漏洞》
Anthropic发布Fable 5.1,称其为全球最先进的编码和知识工作模型。首批实测反馈分化:有开发者说数据提取流程明显更自然、错误更少;也有人同条件对比,发现它比GPT 5.6 Sol更贵更慢。
来源@claudeai「Claude AI 发布两款全新5.1版本大模型」@felixrieseberg「Fable 5.1发布,智能体编码任务体验优化」@Dorialexander「开发者称Fables 5.1解锁了数据提取的实际障碍」@notjazii「相同prompt高推理测试下 Fable 5.1比GPT 5.6 Sol更贵更慢」
多条信号指向同一个趋势:小模型在特定任务上开始打败大模型。Shopify微调0.8b参数的专用模型,性能超过GPT 5.6-sol xhigh;一篇论文显示7B开源模型在奥数难题上赢了o1;还有人1.5小时就训出效果不输现有大模型的小模型。
来源@tobi「Shopify 0.8b微调模型击败GPT 5.6-sol xhigh」@marfinxx「7B小开源模型居然在奥数上赢了OpenAI o1」porridgeraisin「porridgeraisin 1.5小时训出超多数大模型的小模型」
03 Google Gemini 推出智能视频理解功能,降本超六成 这套方案不再固定帧率处理视频,由模型主动抓取需要的内容,能降低成本和Token消耗,同时提升准确率,现在已经可以调用使用
我们推出基于 Gemini 的智能体化视频理解。 不同于静态处理——即按照固定帧率摄入媒体,该模型现在可以以主动、目标导向的方式决定要观看什么内容、以何种速度、通过哪种模态(帧、音频或文本转写),只获取需要的时刻和信号。
04 Perplexity推出能云本地切换的混合计算功能 任务可以先在云端运行,再转到你自己的Mac本地模型处理,敏感隐私文件也能放心处理。
我们在 Perplexity Computer 中推出混合计算功能。 Computer 可以在云端启动任务,随后转移到在你 Mac 上运行的本地模型继续处理。 这项功能可用于涉及私人文件或敏感数据的操作步骤。
今日焦点
OpenAI新模型Astra自主发现并利用2个零日漏洞
OpenAI公布了新模型Astra的更多细节。公司说,这是第一个达到自家“关键网络安全阈值”的大语言模型。简单说,Astra能自己找出计算机系统里的未知漏洞,不用人指挥就利用。
在ExploitBench基准测试里,Astra拿了满分。这个测试衡量大语言模型利用已知漏洞的能力。OpenAI工程师改了一版测试。Astra在里面发现并利用了2个零日漏洞,也就是还没有公开修复方案的漏洞。
OpenAI计划很快让Astra上线,但最先进的网络安全功能访问会更受限。公司会先让一组测试者预览,至于谁、怎么选的,没有透露。Anthropic今年早些时候对自家Mythos模型也表达过类似的担忧。
深度阅读
🔥 信号雷达37 条
𝕏 实时信号 + arXiv 前沿论文,经 AI 聚类解读 · 一眼扫完全貌(含上方导读精选 4 条)
行业动态 · Hacker News导语出处▲ 543
porridgeraisin 1.5小时训出超多数大模型的小模型
训练大模型的时间和成本门槛再次被压低,普通人也能尝试训出效果不输现有大模型的小模型。
porridgeraisin 1.5小时训出超多数大模型的小模型
训练大模型的时间和成本门槛再次被压低,普通人也能尝试训出效果不输现有大模型的小模型。
行业动态 · Hacker News▲ 127
carloslfu 发布slotstream 大模型低内存运行
普通消费级Mac也能跑百B级大模型,不用顶配高内存机型就能运行大参数模型,降低了本地运行大模型的硬件门槛
carloslfu 发布slotstream 大模型低内存运行
普通消费级Mac也能跑百B级大模型,不用顶配高内存机型就能运行大参数模型,降低了本地运行大模型的硬件门槛
我开发了 slotstream,它能让你在最低 16GB 内存的 Mac 上运行 4-bit 量化的 Qwen3.8-Flash-Next。
这个模型拥有 1250 亿参数,原本需要 100GB 以上的内存/RAM,slotstream 能运行它要归功于专家卸载/SSD 流式加载。
它安装更新都很简单,基于 MLX 和 Swift 原生适配 Mac。
它内置自动模式,可以在内存占用和速度之间取得不错的平衡。我下一步会实现并移植用于投机解码的 MTP 模块。
社区讨论:多数开发者指出苹果芯片平台已有多个实现大模型SSD分页流的同类开源项目,呼吁开发者合并协作而非重复造轮子,有人吐槽项目README更像会话日志而非清晰的项目说明。有人看好这类优化能让32GB内存的苹果芯片成为够用的本地大模型运行设备,也有人质疑16GB统一内存跑出5tok/s的说法,另有用户担心持续流读写会损伤SSD,还有用户求问扩展更大上下文窗口的方法。
发布 · @drfeifei▲ 10.6万
theworldlabs团队发布Atlas多模态世界模型
模型结合视觉生成与理解任务,可以生成对应内容,是团队多年研究整合出的新项目。
theworldlabs团队发布Atlas多模态世界模型
模型结合视觉生成与理解任务,可以生成对应内容,是团队多年研究整合出的新项目。
我太激动了,我们@theworldlabs团队今天达成了一项重大里程碑!全新推出 Atlas——这是首个从零开始训练的多模态世界模型!🚀
Atlas 能够生成具备像素级精确相机控制的画面,仅需单张输入图像就能重建大型场景,通过重帧化视频实现时空模拟,可从一张或多张输入图像原生输出3D空间,还能将多张不同姿态的图像合成为一致的3D世界,还有更多能力!
这是目前最优秀的基于相机条件的世界模型,为从视觉特效到机器人在内的众多应用场景打开了大门。我真的真的真的为我们的团队感到骄傲!♥️
今天我们分享 Atlas,我们全新的多模态世界模型。这个模型对我来说之所以如此特别,原因之一在于它结合了我研究超过十年的两项核心视觉智能任务:生成与重建。
行业动态 · Hacker News▲ 149
Apple 诉 OpenAI 披露前员工 MacBook 证据
苹果指控OpenAI侵权,目前案件出现关键证物,可能影响后续AI行业侵权诉讼走向
Apple 诉 OpenAI 披露前员工 MacBook 证据
苹果指控OpenAI侵权,目前案件出现关键证物,可能影响后续AI行业侵权诉讼走向
社区讨论:多数人认为OpenAI收下带泄密材料的前苹果员工的做法不光彩,显得绝望又不专业,还有同行企业曾直接通报原发企业此类挖人带机密的事件。有人好奇iCloud同步会牵扯出个人设备隐私的问题,也有人点出苹果在本案中主张商业机密喂给AI会造成不可逆扩散,和他们自身支持AI训练合理使用的立场相悖。本案还会首次测试这一AI相关商业机密主张的法律效力。
行业动态 · Hacker News▲ 192
ChatGPT/Codex app 打包了完整 LibreOffice
不少用户疑惑AI应用为什么要附带一整套办公软件,可能会占用额外设备存储空间
ChatGPT/Codex app 打包了完整 LibreOffice
不少用户疑惑AI应用为什么要附带一整套办公软件,可能会占用额外设备存储空间
社区讨论:多数开发者认为打包完整LibreOffice让应用体积过大,达到2GB远超出必要范围,也有网友认为 productivity 应用捆绑未用到的功能本就常见,且LibreOffice本身经过长期验证,不算错误决策。有人发现应用的开源许可部分没有LibreOffice的相关声明,怀疑违反了MPL 2.0许可。还有人质疑,OpenAI资金充足,却不用Rust重写原生应用、选用更轻量的跨平台库,也有人指出没必要提前打包完整组件,按需下载更合理。
新品发布 · @theworldlabs▲ 23.4万
theworldlabs发布全球首个可控相机的Atlas世界模型
它能生成图像视频帧、同时重建3D结构,未来可用于空间模拟,给生成式AI打开新的应用方向。
theworldlabs发布全球首个可控相机的Atlas世界模型
它能生成图像视频帧、同时重建3D结构,未来可用于空间模拟,给生成式AI打开新的应用方向。
新品发布 · @viskoai▲ 34.7万
viskoai发布Orbis 1.0 实时动态世界生成模型
可以生成带持久记忆、可交互、符合物理规律的无限长度动态世界,相关服务已开放API可供测试
viskoai发布Orbis 1.0 实时动态世界生成模型
可以生成带持久记忆、可交互、符合物理规律的无限长度动态世界,相关服务已开放API可供测试
今天我们发布 Orbis 1.0,这是我们的第一个 Live Model!
你可以用它创造活的世界,并且实时推流,它具备持久化记忆、可交互性,以及基于物理的无限长度生成。
现在就可以通过 API 试用,API 由 @reactorworld 提供:
动态版本:
稳定版本:
前沿研究 · @tomas_hk▲ 9.5万
@tomas_hk发布模型路由评估方法(20–80%)
这套方法比传统静态基准更符合代理成本累积规律,在主流基准测试中实现帕累托最优,能以更低成本达到Opus xhigh同等质量。
@tomas_hk发布模型路由评估方法(20–80%)
这套方法比传统静态基准更符合代理成本累积规律,在主流基准测试中实现帕累托最优,能以更低成本达到Opus xhigh同等质量。
今天我们发布了用于评估模型路由的方法,采用交互式基准测试。相比静态基准测试,它能更好地体现智能体的成本累积。
在多个主流基准测试中,我们实现了帕累托最优,质量超过 Opus 的最高水平,成本还降低了 20–80%。
新品发布 · @OpenAI▲ 47.7万
OpenAI 推出 Astra 网络安全模型预览
即将正式发布的 Astra 已经达到其安全评估框架的高危级门槛,提前公开评估过程与防护方案,可以观望后续进展对网络安全领域的影响
OpenAI 推出 Astra 网络安全模型预览
即将正式发布的 Astra 已经达到其安全评估框架的高危级门槛,提前公开评估过程与防护方案,可以观望后续进展对网络安全领域的影响
在我们准备发布 Astra 之际,我们专注于让能力不断提升的 AI 变得安全,并且能够被广泛获取。
Astra 代表着网络安全能力的重大进步,达到了我们准备框架下的 Critical 门槛。
我们将预先展示我们是如何评估这个模型的,它的安全防护是如何随着能力同步升级的,以及我们未来还会继续学习和改进哪些内容。
前沿研究 · @tobi导语出处▲ 16.8万
Shopify 0.8b微调模型击败GPT 5.6-sol xhigh
针对特定场景训练的小模型,性能可能超过大很多的通用大模型,这会大幅降低企业AI部署的成本
Shopify 0.8b微调模型击败GPT 5.6-sol xhigh
针对特定场景训练的小模型,性能可能超过大很多的通用大模型,这会大幅降低企业AI部署的成本
如果你拥有出色的自我改进递归飞轮,为特定用途场景训练小模型的效果会好到不可思议。
Shopify ML团队状态极佳。他们微调后的0.8b模型,在这个高度专门化任务上击败了GPT 5.6-sol xhigh。
新品发布 · @claudeai导语出处▲ 155.7万
Claude AI 发布两款全新5.1版本大模型
目前宣称这是全球最先进的编码和知识工作模型,普通用户可以期待后续更强的AI工作体验
Claude AI 发布两款全新5.1版本大模型
目前宣称这是全球最先进的编码和知识工作模型,普通用户可以期待后续更强的AI工作体验
🔥 热点追踪 · @tobi导语出处▲ 16.8万
Shopify微调小模型在专用任务上击败大模型
Shopify ML团队微调的0.8b参数专用小模型,在对应特定任务上性能超过GPT 5.6-sol xhigh,多位开发者称这类场景中小模型表现更优,行业会否迎来定制智能新趋势
Shopify微调小模型在专用任务上击败大模型
Shopify ML团队微调的0.8b参数专用小模型,在对应特定任务上性能超过GPT 5.6-sol xhigh,多位开发者称这类场景中小模型表现更优,行业会否迎来定制智能新趋势
研究 · @marfinxx导语出处▲ 5.5K
7B小开源模型居然在奥数上赢了OpenAI o1
论文显示模型获胜时,没有从训练数据中复制单个题目的token,参数小的模型也能在特定难题上超过大模型。
7B小开源模型居然在奥数上赢了OpenAI o1
论文显示模型获胜时,没有从训练数据中复制单个题目的token,参数小的模型也能在特定难题上超过大模型。
研究 · @RTomMcCoy▲ 4.9K
八年研究探究大模型为啥能做好符号类任务
大语言模型和传统符号系统看起来差异很大,但在语言、代码、数学这类领域表现很好,研究试图解释背后原因。
八年研究探究大模型为啥能做好符号类任务
大语言模型和传统符号系统看起来差异很大,但在语言、代码、数学这类领域表现很好,研究试图解释背后原因。
🤖🧠新论文🧠🤖(这是一个历时8年项目的成果!)
LLMs 看起来和符号系统非常不同,但 LLM 却在符号领域(比如语言/代码/数学)表现出色。它们是怎么做到的?
我们的发现是:LLM 的表征存在隐式符号结构!链接在推文串中 ⬇️ 1/n
发布 · @felixrieseberg导语出处▲ 9.1万
Fable 5.1发布,智能体编码任务体验优化
新版本在多类任务上都有小幅提升,解决智能体编码任务的体验有明显改进。
Fable 5.1发布,智能体编码任务体验优化
新版本在多类任务上都有小幅提升,解决智能体编码任务的体验有明显改进。
产品 · @omarsar0▲ 9.9K
AI模型能不用代码实时直接生成界面了
演示视频里的界面完全由模型直接生成,不需要提前写代码或者HTML,能拓展的应用方向很多。
AI模型能不用代码实时直接生成界面了
演示视频里的界面完全由模型直接生成,不需要提前写代码或者HTML,能拓展的应用方向很多。
新品发布 · @aditabrm▲ 2.7万
reductoai发布r-1文档解析模型,成本低至六分之一
处理复杂格式文档的解析成本降低,错误率也更低,现有文档解析工具使用者可领迁移 credits 测试
reductoai发布r-1文档解析模型,成本低至六分之一
处理复杂格式文档的解析成本降低,错误率也更低,现有文档解析工具使用者可领迁移 credits 测试
今日我们宣布推出 r-1,这是我们全新的文档解析模型。它比我们目前性能最强的智能体 OCR 模型更准确、速度更快,成本还最高可降低 6 倍。
在 @reductoai,我们花了两年时间,为复杂视觉布局、跨多页表格,以及删除线这类关键格式打造专用模型。然后我们用积累的全部经验构建了 r-1,它是新一代模型的首个作品,设计目标就是在不增加成本的前提下处理最复杂的文档。
本次早期预览版,相比我们之前最准确的旧版智能体模型,错误率降低了 20%,并且未来几周内还会通过新 checkpoint 持续优化。
准确性只是开始。r-1 预览版的全包含价格仅为每页 1 美分,用量提升后还可享受额外批量折扣。
近期我们还会发布 r-1 mini,以及一个能为每页自动智能选择最佳处理方案的自动模式。
如果你目前正在使用其他解析工具,我们提供最高 5000 美元的 credits,供你评估和迁移。
你可以通过评论区链接申领迁移福利,了解更多关于 r-1 的信息。祝解析愉快!
行业动态 · @Jack_W_Lindsey▲ 8.1K
Anthropic 招心理设计研究者研究AI性格
公司开始专门研究训练会给AI性格带来什么影响,未来对齐方向的AI设计可能会因此发生变化
Anthropic 招心理设计研究者研究AI性格
公司开始专门研究训练会给AI性格带来什么影响,未来对齐方向的AI设计可能会因此发生变化
我们 Anthropic 正在招聘「心理设计」方向的研究人员。
我们的目标是更深入地理解训练过程会对模型的特性与对齐产生怎样的影响。
我们希望应聘者拥有 LLM 微调、可解释性和对齐评估方向的研究经验。
更多细节见下文。
新品发布 · @AlexObuchowski▲ 2.5万
Google发布TimesFM-3,可多维度预测时序数据
做销量、床位 occupancy、医疗监测等时序预测的团队,可直接拿模型输出结果,不用微调,省掉GPU训练时间,目前权重仅开放非商用使用。
Google发布TimesFM-3,可多维度预测时序数据
做销量、床位 occupancy、医疗监测等时序预测的团队,可直接拿模型输出结果,不用微调,省掉GPU训练时间,目前权重仅开放非商用使用。
行业动态 · @wallstengine▲ 3.2万
戴尔预测到2030年推理令牌需求涨87倍
AI产业需求结构已经转变,推理需求超过训练。想布局AI相关产业,可以参考戴尔给出的增长节点
戴尔预测到2030年推理令牌需求涨87倍
AI产业需求结构已经转变,推理需求超过训练。想布局AI相关产业,可以参考戴尔给出的增长节点
戴尔谈及AI推理需求时表示:“推理需求已经超过训练,是我们行业当前实打实的需求。”
戴尔预计,到2030年,推理令牌需求将增长87倍,达到3600千万亿令牌,与此同时训练需求增长5倍。
“到2028年,企业智能体将成为规模最大的单一工作负载。”
新品发布 · @GoogleDeepMind▲ 4.5万
GoogleDeepMind发布智能体视频理解功能(88%)
分析视频的token消耗最高降88%,同样长度的视频,能省大量推理成本和调用费用
GoogleDeepMind发布智能体视频理解功能(88%)
分析视频的token消耗最高降88%,同样长度的视频,能省大量推理成本和调用费用
行业动态 · @alexeheath▲ 4.1万
Alex Heath发布对话播客节目
涉及OpenAI放缓前沿研究、对齐、AGI、IPO、消费硬件等多个核心话题,可以了解OpenAI最新的战略方向
Alex Heath发布对话播客节目
涉及OpenAI放缓前沿研究、对齐、AGI、IPO、消费硬件等多个核心话题,可以了解OpenAI最新的战略方向
实战经验 · @AlexFinn▲ 1.8万
Fable 5.1 模型上线,作者分享入门玩法
想抢先体验这款号称目前最强的AI模型,可以跟着这五步操作,测完就能比大部分人先摸透新模型的能力
Fable 5.1 模型上线,作者分享入门玩法
想抢先体验这款号称目前最强的AI模型,可以跟着这五步操作,测完就能比大部分人先摸透新模型的能力
生成式视频 · @nopinduoduo▲ 1.7万
用户测试MiniMax H3 生成5秒AI视频效果细节清晰
用户@nopinduoduo在𝕏分享了Hailuo AI MiniMax H3直出的5秒AI生活场景视频,附完整生成提示词
用户测试MiniMax H3 生成5秒AI视频效果细节清晰
用户@nopinduoduo在𝕏分享了Hailuo AI MiniMax H3直出的5秒AI生活场景视频,附完整生成提示词
视频生成 · @Fujimoto_hina▲ 6.7K
用户用Veo 3.1生成了4K薯片商业宣传AI视频
用户@Fujimoto_hina在𝕏分享了自己用Veo 3.1生成10秒商业视频的完整提示词
用户用Veo 3.1生成了4K薯片商业宣传AI视频
用户@Fujimoto_hina在𝕏分享了自己用Veo 3.1生成10秒商业视频的完整提示词
3D建模 · @neilsonks
用户发现可以通过特殊方法把Atlas改造成3D建模工具
社交媒体用户neilsonks发现,仅需相机位姿和RGB信息即可实现这一效果
用户发现可以通过特殊方法把Atlas改造成3D建模工具
社交媒体用户neilsonks发现,仅需相机位姿和RGB信息即可实现这一效果
社交媒体用户@neilsonks分享了一个有趣发现,可以通过特殊方法“欺骗”Atlas,将它改造成3D建模工具。
具体的操作方法是把输入图像放置在三维空间中,之后模型会自动生成一个连贯完整的场景。
整个过程中,模型只需要获取相机位姿和RGB两种输入信息。
大模型 · @Dorialexander导语出处▲ 299
开发者称Fables 5.1解锁了数据提取的实际障碍
开发者Dorialexander在𝕏发文称,新版Fables 5.1比5.0表现更自然,输出错误更少
开发者称Fables 5.1解锁了数据提取的实际障碍
开发者Dorialexander在𝕏发文称,新版Fables 5.1比5.0表现更自然,输出错误更少
开发者Dorialexander在社交平台𝕏发文评价Fables 5.1大模型。他认为Fables 5.1是一款表现不错的模型。
这个新版本刚刚解锁了数据提取环节的一个关键障碍。相比Fables 5.0,它的处理效果更自然,很少出现劣质输出。
区块链 · @Baili1018▲ 1.1万
BNB Chain诞生六周年 从交易设施成长为多方向公链
用户@Baili1018在𝕏发文纪念BNB Chain诞生六周年,梳理其六年发展变化
BNB Chain诞生六周年 从交易设施成长为多方向公链
用户@Baili1018在𝕏发文纪念BNB Chain诞生六周年,梳理其六年发展变化
六年前,BNB Chain产出了第一个区块。六年后的今天,它已经从最初的交易基础设施,发展为可以承载DeFi(去中心化金融)、AI、RWA(现实资产上链)、GameFi(链游)等多个方向项目的区块链基础设施。
对很多普通用户来说,BNB Chain的意义不在于冰冷的数据,而在于亲身的使用经历。@Baili1018表示,自己最早就是通过参与BNB Chain上的项目接触Web3,从早期参与项目、研究DeFi,到后来接触AI智能体、RWA等新方向,BNB Chain一直是他探索Web3世界的入口。
这些年他看着不少项目从无到有发展起来,也认识了很多因BNB结缘的同好。他认为,区块链行业变化很快,最终能留存下来的,大多是长期持续建设、不断更新优化的网络。
六周年只是一个新的起点。@Baili1018祝BNB Chain六周年快乐,期待它未来能连接更多开发者、用户和创新项目,见证更多新故事。
游戏开发 · @MattVidPro▲ 4.4K
开发者在Unreal Engine中测试Fable 5.1大模型生成物理游戏Demo
创作者@MattVidPro在社交平台𝕏分享测试过程,测试依托MCP完成,对比过往版本与Claude的表现
开发者在Unreal Engine中测试Fable 5.1大模型生成物理游戏Demo
创作者@MattVidPro在社交平台𝕏分享测试过程,测试依托MCP完成,对比过往版本与Claude的表现
@MattVidPro在Unreal Engine中测试AI模型Fable 5.1。他借助MCP向模型输入了要求相当高的物理游戏Demo生成提示词。
此前5.6 Sol版本在这项任务上表现不错,但他认为在Unreal Engine这类环境中,模型还有很大的优化空间。
Claude通常在3D相关任务中表现更好,他对Fable 5.1的测试结果非常好奇。本次测试结果来自Codex,目前Fable可以正常运行。
大语言模型 · @KyleHessling1▲ 2.6K
开发者初步测试显示Qwopus 3.8候选版本推理消耗降低
开发者Kyle Hessling在𝕏公布测试结果,该版本已在Claude Code智能体循环中进行高强度测试
开发者初步测试显示Qwopus 3.8候选版本推理消耗降低
开发者Kyle Hessling在𝕏公布测试结果,该版本已在Claude Code智能体循环中进行高强度测试
初步测试结果显示,Qwopus 3.8候选版本的推理量显著低于完全不启用推理机制的基础版本。
开发者已经在Claude Code的智能体循环中对该候选版本进行了高强度测试,最初测试结果好到让开发者不敢轻信。
更多细节将在后续公布。
短视频 · @Caden_Flux▲ 1.7万
韩国爆款韩剧风短剧AI生成教程,操作无需复杂配置
这是发布在𝕏平台@Caden_Flux的教程,介绍Flova AI生成韩剧风短剧的方法
韩国爆款韩剧风短剧AI生成教程,操作无需复杂配置
这是发布在𝕏平台@Caden_Flux的教程,介绍Flova AI生成韩剧风短剧的方法
你如果想学习如何生成韩国爆火的韩剧风短剧,这套操作无需复杂设置。
第一步,在平台首页选择「K-Drama Vibe Short Series」功能。
第二步,输入你的故事创意,或者上传一张参考图,剩下的工作都交给智能代理完成即可。
用Flova就能创作下一个引爆社交媒体的AI短剧。
大模型测评 · @notjazii导语出处▲ 1.6万
相同prompt高推理测试下 Fable 5.1比GPT 5.6 Sol更贵更慢
博主@notjazii在𝕏发布两款大模型的同条件测试对比数据
相同prompt高推理测试下 Fable 5.1比GPT 5.6 Sol更贵更慢
博主@notjazii在𝕏发布两款大模型的同条件测试对比数据
Fable 5.1 vs GPT 5.6
Sol 用相同提示词、在最高推理设置下测试了两个模型。
Fable 完成测试花了 10 分钟,花费 $1.6。
Sol 花了 7 分钟,花费大约 $0.95。
尽管 Sol 更便宜也更快,但结果差别非常大,谁赢了?
3D建模 · @HarshithLucky3▲ 5.4K
用户测试Claude的Fable 5.1后想购买Max订阅
博主在𝕏分享Fable 5.1 High对比旧版生成长3D模型的测试
用户测试Claude的Fable 5.1后想购买Max订阅
博主在𝕏分享Fable 5.1 High对比旧版生成长3D模型的测试
这是我对 Fable 5.1 的第一次测试。
对比 Claude Code 中的 Fable 5.1 High 和 Fable 5 high > 在 Three.js 中生成空客 H145 直升机的 3D 模型。
Fable 5.1 又勾得我想买 Max 订阅了😭
提示词非常简单 ↓
提示词:在 Three.js 中创建一个空客 H145 直升机的写实 3D 模型。使用原厂演示标准配色,突出紧凑机身、涵道式尾桨 Fenestron 和细节丰富的旋翼组件。在 Three.js 中使用干净几何、写实 PBR 材质、柔和影棚打光和中性背景。
前沿研究 · @tobi导语出处▲ 16.8万
Shopify 0.8b微调模型击败GPT 5.6-sol xhigh
针对特定场景训练的小模型,性能可能超过大很多的通用大模型,这会大幅降低企业AI部署的成本
Shopify 0.8b微调模型击败GPT 5.6-sol xhigh
针对特定场景训练的小模型,性能可能超过大很多的通用大模型,这会大幅降低企业AI部署的成本
如果你拥有出色的自我改进递归飞轮,为特定用途场景训练小模型的效果会好到不可思议。
Shopify ML团队状态极佳。他们微调后的0.8b模型,在这个高度专门化任务上击败了GPT 5.6-sol xhigh。
前沿研究 · @tomas_hk▲ 9.5万
@tomas_hk发布模型路由评估方法(20–80%)
这套方法比传统静态基准更符合代理成本累积规律,在主流基准测试中实现帕累托最优,能以更低成本达到Opus xhigh同等质量。
@tomas_hk发布模型路由评估方法(20–80%)
这套方法比传统静态基准更符合代理成本累积规律,在主流基准测试中实现帕累托最优,能以更低成本达到Opus xhigh同等质量。
今天我们发布了用于评估模型路由的方法,采用交互式基准测试。相比静态基准测试,它能更好地体现智能体的成本累积。
在多个主流基准测试中,我们实现了帕累托最优,质量超过 Opus 的最高水平,成本还降低了 20–80%。
新品发布 · @claudeai导语出处▲ 155.7万
Claude AI 发布两款全新5.1版本大模型
目前宣称这是全球最先进的编码和知识工作模型,普通用户可以期待后续更强的AI工作体验
Claude AI 发布两款全新5.1版本大模型
目前宣称这是全球最先进的编码和知识工作模型,普通用户可以期待后续更强的AI工作体验
新品发布 · @OpenAI▲ 47.7万
OpenAI 推出 Astra 网络安全模型预览
即将正式发布的 Astra 已经达到其安全评估框架的高危级门槛,提前公开评估过程与防护方案,可以观望后续进展对网络安全领域的影响
OpenAI 推出 Astra 网络安全模型预览
即将正式发布的 Astra 已经达到其安全评估框架的高危级门槛,提前公开评估过程与防护方案,可以观望后续进展对网络安全领域的影响
在我们准备发布 Astra 之际,我们专注于让能力不断提升的 AI 变得安全,并且能够被广泛获取。
Astra 代表着网络安全能力的重大进步,达到了我们准备框架下的 Critical 门槛。
我们将预先展示我们是如何评估这个模型的,它的安全防护是如何随着能力同步升级的,以及我们未来还会继续学习和改进哪些内容。
新品发布 · @GoogleDeepMind▲ 4.5万
GoogleDeepMind发布智能体视频理解功能(88%)
分析视频的token消耗最高降88%,同样长度的视频,能省大量推理成本和调用费用
GoogleDeepMind发布智能体视频理解功能(88%)
分析视频的token消耗最高降88%,同样长度的视频,能省大量推理成本和调用费用
新品发布 · @AIatMeta▲ 2.4万
Meta发布Muse Voice Transcribe语音转写模型
支持二十人以上同时发言区分,多语言无缝混转,在公开 benchmarks 上拿到了语音转写相关榜单第一,语音转写体验有望提升。
Meta发布Muse Voice Transcribe语音转写模型
支持二十人以上同时发言区分,多语言无缝混转,在公开 benchmarks 上拿到了语音转写相关榜单第一,语音转写体验有望提升。
欢迎介绍 Muse Voice Transcribe,这是 Meta Superintelligence Labs 推出的首个实时音频感知模型。
Muse Voice Transcribe 可提供实时流式自动语音识别、支持20名以上说话者的说话人分割,以及端点检测功能。
它支持多语言,可无缝处理语码转换,还能通过语言、关键词和上下文偏置提升识别准确率。
该模型在@ArtificialAnlys流式语音转文本测试和公开说话人分割基准测试中均排名第一。
新品发布 · @AlexObuchowski▲ 2.5万
Google发布TimesFM-3,可多维度预测时序数据
做销量、床位 occupancy、医疗监测等时序预测的团队,可直接拿模型输出结果,不用微调,省掉GPU训练时间,目前权重仅开放非商用使用。
Google发布TimesFM-3,可多维度预测时序数据
做销量、床位 occupancy、医疗监测等时序预测的团队,可直接拿模型输出结果,不用微调,省掉GPU训练时间,目前权重仅开放非商用使用。
新品发布 · @viskoai▲ 34.7万
viskoai发布Orbis 1.0 实时动态世界生成模型
可以生成带持久记忆、可交互、符合物理规律的无限长度动态世界,相关服务已开放API可供测试
viskoai发布Orbis 1.0 实时动态世界生成模型
可以生成带持久记忆、可交互、符合物理规律的无限长度动态世界,相关服务已开放API可供测试
今天我们发布 Orbis 1.0,这是我们的第一个 Live Model!
你可以用它创造活的世界,并且实时推流,它具备持久化记忆、可交互性,以及基于物理的无限长度生成。
现在就可以通过 API 试用,API 由 @reactorworld 提供:
动态版本:
稳定版本:
新品发布 · @theworldlabs▲ 23.4万
theworldlabs发布全球首个可控相机的Atlas世界模型
它能生成图像视频帧、同时重建3D结构,未来可用于空间模拟,给生成式AI打开新的应用方向。
theworldlabs发布全球首个可控相机的Atlas世界模型
它能生成图像视频帧、同时重建3D结构,未来可用于空间模拟,给生成式AI打开新的应用方向。
新品发布 · @GoogleAIStudio▲ 3.0万
Google Gemini 推出智能视频理解功能,降本超六成
这套方案不再固定帧率处理视频,由模型主动抓取需要的内容,能降低成本和Token消耗,同时提升准确率,现在已经可以调用使用
Google Gemini 推出智能视频理解功能,降本超六成
这套方案不再固定帧率处理视频,由模型主动抓取需要的内容,能降低成本和Token消耗,同时提升准确率,现在已经可以调用使用
我们推出基于 Gemini 的智能体化视频理解。
不同于静态处理——即按照固定帧率摄入媒体,该模型现在可以以主动、目标导向的方式决定要观看什么内容、以何种速度、通过哪种模态(帧、音频或文本转写),只获取需要的时刻和信号。
这种新方法最高可削减 66% 的成本,最高减少 88% 的 token 消耗,同时还能提升准确率。
现已通过 Gemini API 和 AI Studio 开放使用。
新品发布 · @aditabrm▲ 2.7万
reductoai发布r-1文档解析模型,成本低至六分之一
处理复杂格式文档的解析成本降低,错误率也更低,现有文档解析工具使用者可领迁移 credits 测试
reductoai发布r-1文档解析模型,成本低至六分之一
处理复杂格式文档的解析成本降低,错误率也更低,现有文档解析工具使用者可领迁移 credits 测试
今日我们宣布推出 r-1,这是我们全新的文档解析模型。它比我们目前性能最强的智能体 OCR 模型更准确、速度更快,成本还最高可降低 6 倍。
在 @reductoai,我们花了两年时间,为复杂视觉布局、跨多页表格,以及删除线这类关键格式打造专用模型。然后我们用积累的全部经验构建了 r-1,它是新一代模型的首个作品,设计目标就是在不增加成本的前提下处理最复杂的文档。
本次早期预览版,相比我们之前最准确的旧版智能体模型,错误率降低了 20%,并且未来几周内还会通过新 checkpoint 持续优化。
准确性只是开始。r-1 预览版的全包含价格仅为每页 1 美分,用量提升后还可享受额外批量折扣。
近期我们还会发布 r-1 mini,以及一个能为每页自动智能选择最佳处理方案的自动模式。
如果你目前正在使用其他解析工具,我们提供最高 5000 美元的 credits,供你评估和迁移。
你可以通过评论区链接申领迁移福利,了解更多关于 r-1 的信息。祝解析愉快!
🔥 热点追踪 · @tobi导语出处▲ 16.8万
Shopify微调小模型在专用任务上击败大模型
Shopify ML团队微调的0.8b参数专用小模型,在对应特定任务上性能超过GPT 5.6-sol xhigh,多位开发者称这类场景中小模型表现更优,行业会否迎来定制智能新趋势
Shopify微调小模型在专用任务上击败大模型
Shopify ML团队微调的0.8b参数专用小模型,在对应特定任务上性能超过GPT 5.6-sol xhigh,多位开发者称这类场景中小模型表现更优,行业会否迎来定制智能新趋势
行业动态 · @alexeheath▲ 4.1万
Alex Heath发布对话播客节目
涉及OpenAI放缓前沿研究、对齐、AGI、IPO、消费硬件等多个核心话题,可以了解OpenAI最新的战略方向
Alex Heath发布对话播客节目
涉及OpenAI放缓前沿研究、对齐、AGI、IPO、消费硬件等多个核心话题,可以了解OpenAI最新的战略方向
行业动态 · @wallstengine▲ 3.2万
戴尔预测到2030年推理令牌需求涨87倍
AI产业需求结构已经转变,推理需求超过训练。想布局AI相关产业,可以参考戴尔给出的增长节点
戴尔预测到2030年推理令牌需求涨87倍
AI产业需求结构已经转变,推理需求超过训练。想布局AI相关产业,可以参考戴尔给出的增长节点
戴尔谈及AI推理需求时表示:“推理需求已经超过训练,是我们行业当前实打实的需求。”
戴尔预计,到2030年,推理令牌需求将增长87倍,达到3600千万亿令牌,与此同时训练需求增长5倍。
“到2028年,企业智能体将成为规模最大的单一工作负载。”
行业动态 · @Jack_W_Lindsey▲ 8.1K
Anthropic 招心理设计研究者研究AI性格
公司开始专门研究训练会给AI性格带来什么影响,未来对齐方向的AI设计可能会因此发生变化
Anthropic 招心理设计研究者研究AI性格
公司开始专门研究训练会给AI性格带来什么影响,未来对齐方向的AI设计可能会因此发生变化
我们 Anthropic 正在招聘「心理设计」方向的研究人员。
我们的目标是更深入地理解训练过程会对模型的特性与对齐产生怎样的影响。
我们希望应聘者拥有 LLM 微调、可解释性和对齐评估方向的研究经验。
更多细节见下文。
研究 · @marfinxx导语出处▲ 5.5K
7B小开源模型居然在奥数上赢了OpenAI o1
论文显示模型获胜时,没有从训练数据中复制单个题目的token,参数小的模型也能在特定难题上超过大模型。
7B小开源模型居然在奥数上赢了OpenAI o1
论文显示模型获胜时,没有从训练数据中复制单个题目的token,参数小的模型也能在特定难题上超过大模型。
发布 · @drfeifei▲ 10.6万
theworldlabs团队发布Atlas多模态世界模型
模型结合视觉生成与理解任务,可以生成对应内容,是团队多年研究整合出的新项目。
theworldlabs团队发布Atlas多模态世界模型
模型结合视觉生成与理解任务,可以生成对应内容,是团队多年研究整合出的新项目。
我太激动了,我们@theworldlabs团队今天达成了一项重大里程碑!全新推出 Atlas——这是首个从零开始训练的多模态世界模型!🚀
Atlas 能够生成具备像素级精确相机控制的画面,仅需单张输入图像就能重建大型场景,通过重帧化视频实现时空模拟,可从一张或多张输入图像原生输出3D空间,还能将多张不同姿态的图像合成为一致的3D世界,还有更多能力!
这是目前最优秀的基于相机条件的世界模型,为从视觉特效到机器人在内的众多应用场景打开了大门。我真的真的真的为我们的团队感到骄傲!♥️
今天我们分享 Atlas,我们全新的多模态世界模型。这个模型对我来说之所以如此特别,原因之一在于它结合了我研究超过十年的两项核心视觉智能任务:生成与重建。
产品 · @perplexity_ai▲ 8.3万
Perplexity推出能云本地切换的混合计算功能
任务可以先在云端运行,再转到你自己的Mac本地模型处理,敏感隐私文件也能放心处理。
Perplexity推出能云本地切换的混合计算功能
任务可以先在云端运行,再转到你自己的Mac本地模型处理,敏感隐私文件也能放心处理。
我们在 Perplexity Computer 中推出混合计算功能。
Computer 可以在云端启动任务,随后转移到在你 Mac 上运行的本地模型继续处理。
这项功能可用于涉及私人文件或敏感数据的操作步骤。
现已在 Perplexity Mac 应用中上线。
研究 · @RTomMcCoy▲ 4.9K
八年研究探究大模型为啥能做好符号类任务
大语言模型和传统符号系统看起来差异很大,但在语言、代码、数学这类领域表现很好,研究试图解释背后原因。
八年研究探究大模型为啥能做好符号类任务
大语言模型和传统符号系统看起来差异很大,但在语言、代码、数学这类领域表现很好,研究试图解释背后原因。
🤖🧠新论文🧠🤖(这是一个历时8年项目的成果!)
LLMs 看起来和符号系统非常不同,但 LLM 却在符号领域(比如语言/代码/数学)表现出色。它们是怎么做到的?
我们的发现是:LLM 的表征存在隐式符号结构!链接在推文串中 ⬇️ 1/n
发布 · @felixrieseberg导语出处▲ 9.1万
Fable 5.1发布,智能体编码任务体验优化
新版本在多类任务上都有小幅提升,解决智能体编码任务的体验有明显改进。
Fable 5.1发布,智能体编码任务体验优化
新版本在多类任务上都有小幅提升,解决智能体编码任务的体验有明显改进。
产品 · @omarsar0▲ 9.9K
AI模型能不用代码实时直接生成界面了
演示视频里的界面完全由模型直接生成,不需要提前写代码或者HTML,能拓展的应用方向很多。
AI模型能不用代码实时直接生成界面了
演示视频里的界面完全由模型直接生成,不需要提前写代码或者HTML,能拓展的应用方向很多。
行业动态 · Hacker News▲ 192
ChatGPT/Codex app 打包了完整 LibreOffice
不少用户疑惑AI应用为什么要附带一整套办公软件,可能会占用额外设备存储空间
ChatGPT/Codex app 打包了完整 LibreOffice
不少用户疑惑AI应用为什么要附带一整套办公软件,可能会占用额外设备存储空间
社区讨论:多数开发者认为打包完整LibreOffice让应用体积过大,达到2GB远超出必要范围,也有网友认为 productivity 应用捆绑未用到的功能本就常见,且LibreOffice本身经过长期验证,不算错误决策。有人发现应用的开源许可部分没有LibreOffice的相关声明,怀疑违反了MPL 2.0许可。还有人质疑,OpenAI资金充足,却不用Rust重写原生应用、选用更轻量的跨平台库,也有人指出没必要提前打包完整组件,按需下载更合理。
行业动态 · Hacker News▲ 149
Apple 诉 OpenAI 披露前员工 MacBook 证据
苹果指控OpenAI侵权,目前案件出现关键证物,可能影响后续AI行业侵权诉讼走向
Apple 诉 OpenAI 披露前员工 MacBook 证据
苹果指控OpenAI侵权,目前案件出现关键证物,可能影响后续AI行业侵权诉讼走向
社区讨论:多数人认为OpenAI收下带泄密材料的前苹果员工的做法不光彩,显得绝望又不专业,还有同行企业曾直接通报原发企业此类挖人带机密的事件。有人好奇iCloud同步会牵扯出个人设备隐私的问题,也有人点出苹果在本案中主张商业机密喂给AI会造成不可逆扩散,和他们自身支持AI训练合理使用的立场相悖。本案还会首次测试这一AI相关商业机密主张的法律效力。
行业动态 · Hacker News▲ 127
carloslfu 发布slotstream 大模型低内存运行
普通消费级Mac也能跑百B级大模型,不用顶配高内存机型就能运行大参数模型,降低了本地运行大模型的硬件门槛
carloslfu 发布slotstream 大模型低内存运行
普通消费级Mac也能跑百B级大模型,不用顶配高内存机型就能运行大参数模型,降低了本地运行大模型的硬件门槛
我开发了 slotstream,它能让你在最低 16GB 内存的 Mac 上运行 4-bit 量化的 Qwen3.8-Flash-Next。
这个模型拥有 1250 亿参数,原本需要 100GB 以上的内存/RAM,slotstream 能运行它要归功于专家卸载/SSD 流式加载。
它安装更新都很简单,基于 MLX 和 Swift 原生适配 Mac。
它内置自动模式,可以在内存占用和速度之间取得不错的平衡。我下一步会实现并移植用于投机解码的 MTP 模块。
社区讨论:多数开发者指出苹果芯片平台已有多个实现大模型SSD分页流的同类开源项目,呼吁开发者合并协作而非重复造轮子,有人吐槽项目README更像会话日志而非清晰的项目说明。有人看好这类优化能让32GB内存的苹果芯片成为够用的本地大模型运行设备,也有人质疑16GB统一内存跑出5tok/s的说法,另有用户担心持续流读写会损伤SSD,还有用户求问扩展更大上下文窗口的方法。
行业动态 · Hacker News导语出处▲ 543
porridgeraisin 1.5小时训出超多数大模型的小模型
训练大模型的时间和成本门槛再次被压低,普通人也能尝试训出效果不输现有大模型的小模型。
porridgeraisin 1.5小时训出超多数大模型的小模型
训练大模型的时间和成本门槛再次被压低,普通人也能尝试训出效果不输现有大模型的小模型。
社区讨论:作者澄清这不是大语言模型,是从头训练的小型自回归Transformer,核心观点是复杂问题无需大模型即可解决,此前该基准只有耗费巨额成本的大模型或微调能参与。有人质疑只跑单个基准、存在训练数据泄露过拟合,作者澄清并未使用测试集标签训练,该方法实现提交后从头训练,能避免合成数据刷榜保证公平。多数开发者认可样本效率是AI未解决的核心问题。
实战经验 · @AlexFinn▲ 1.8万
Fable 5.1 模型上线,作者分享入门玩法
想抢先体验这款号称目前最强的AI模型,可以跟着这五步操作,测完就能比大部分人先摸透新模型的能力
Fable 5.1 模型上线,作者分享入门玩法
想抢先体验这款号称目前最强的AI模型,可以跟着这五步操作,测完就能比大部分人先摸透新模型的能力
3D建模 · @HarshithLucky3▲ 5.4K
用户测试Claude的Fable 5.1后想购买Max订阅
博主在𝕏分享Fable 5.1 High对比旧版生成长3D模型的测试
用户测试Claude的Fable 5.1后想购买Max订阅
博主在𝕏分享Fable 5.1 High对比旧版生成长3D模型的测试
这是我对 Fable 5.1 的第一次测试。
对比 Claude Code 中的 Fable 5.1 High 和 Fable 5 high > 在 Three.js 中生成空客 H145 直升机的 3D 模型。
Fable 5.1 又勾得我想买 Max 订阅了😭
提示词非常简单 ↓
提示词:在 Three.js 中创建一个空客 H145 直升机的写实 3D 模型。使用原厂演示标准配色,突出紧凑机身、涵道式尾桨 Fenestron 和细节丰富的旋翼组件。在 Three.js 中使用干净几何、写实 PBR 材质、柔和影棚打光和中性背景。
大模型测评 · @notjazii导语出处▲ 1.6万
相同prompt高推理测试下 Fable 5.1比GPT 5.6 Sol更贵更慢
博主@notjazii在𝕏发布两款大模型的同条件测试对比数据
相同prompt高推理测试下 Fable 5.1比GPT 5.6 Sol更贵更慢
博主@notjazii在𝕏发布两款大模型的同条件测试对比数据
Fable 5.1 vs GPT 5.6
Sol 用相同提示词、在最高推理设置下测试了两个模型。
Fable 完成测试花了 10 分钟,花费 $1.6。
Sol 花了 7 分钟,花费大约 $0.95。
尽管 Sol 更便宜也更快,但结果差别非常大,谁赢了?
短视频 · @Caden_Flux▲ 1.7万
韩国爆款韩剧风短剧AI生成教程,操作无需复杂配置
这是发布在𝕏平台@Caden_Flux的教程,介绍Flova AI生成韩剧风短剧的方法
韩国爆款韩剧风短剧AI生成教程,操作无需复杂配置
这是发布在𝕏平台@Caden_Flux的教程,介绍Flova AI生成韩剧风短剧的方法
你如果想学习如何生成韩国爆火的韩剧风短剧,这套操作无需复杂设置。
第一步,在平台首页选择「K-Drama Vibe Short Series」功能。
第二步,输入你的故事创意,或者上传一张参考图,剩下的工作都交给智能代理完成即可。
用Flova就能创作下一个引爆社交媒体的AI短剧。
大语言模型 · @KyleHessling1▲ 2.6K
开发者初步测试显示Qwopus 3.8候选版本推理消耗降低
开发者Kyle Hessling在𝕏公布测试结果,该版本已在Claude Code智能体循环中进行高强度测试
开发者初步测试显示Qwopus 3.8候选版本推理消耗降低
开发者Kyle Hessling在𝕏公布测试结果,该版本已在Claude Code智能体循环中进行高强度测试
初步测试结果显示,Qwopus 3.8候选版本的推理量显著低于完全不启用推理机制的基础版本。
开发者已经在Claude Code的智能体循环中对该候选版本进行了高强度测试,最初测试结果好到让开发者不敢轻信。
更多细节将在后续公布。
游戏开发 · @MattVidPro▲ 4.4K
开发者在Unreal Engine中测试Fable 5.1大模型生成物理游戏Demo
创作者@MattVidPro在社交平台𝕏分享测试过程,测试依托MCP完成,对比过往版本与Claude的表现
开发者在Unreal Engine中测试Fable 5.1大模型生成物理游戏Demo
创作者@MattVidPro在社交平台𝕏分享测试过程,测试依托MCP完成,对比过往版本与Claude的表现
@MattVidPro在Unreal Engine中测试AI模型Fable 5.1。他借助MCP向模型输入了要求相当高的物理游戏Demo生成提示词。
此前5.6 Sol版本在这项任务上表现不错,但他认为在Unreal Engine这类环境中,模型还有很大的优化空间。
Claude通常在3D相关任务中表现更好,他对Fable 5.1的测试结果非常好奇。本次测试结果来自Codex,目前Fable可以正常运行。
区块链 · @Baili1018▲ 1.1万
BNB Chain诞生六周年 从交易设施成长为多方向公链
用户@Baili1018在𝕏发文纪念BNB Chain诞生六周年,梳理其六年发展变化
BNB Chain诞生六周年 从交易设施成长为多方向公链
用户@Baili1018在𝕏发文纪念BNB Chain诞生六周年,梳理其六年发展变化
六年前,BNB Chain产出了第一个区块。六年后的今天,它已经从最初的交易基础设施,发展为可以承载DeFi(去中心化金融)、AI、RWA(现实资产上链)、GameFi(链游)等多个方向项目的区块链基础设施。
对很多普通用户来说,BNB Chain的意义不在于冰冷的数据,而在于亲身的使用经历。@Baili1018表示,自己最早就是通过参与BNB Chain上的项目接触Web3,从早期参与项目、研究DeFi,到后来接触AI智能体、RWA等新方向,BNB Chain一直是他探索Web3世界的入口。
这些年他看着不少项目从无到有发展起来,也认识了很多因BNB结缘的同好。他认为,区块链行业变化很快,最终能留存下来的,大多是长期持续建设、不断更新优化的网络。
六周年只是一个新的起点。@Baili1018祝BNB Chain六周年快乐,期待它未来能连接更多开发者、用户和创新项目,见证更多新故事。
大模型 · @Dorialexander导语出处▲ 299
开发者称Fables 5.1解锁了数据提取的实际障碍
开发者Dorialexander在𝕏发文称,新版Fables 5.1比5.0表现更自然,输出错误更少
开发者称Fables 5.1解锁了数据提取的实际障碍
开发者Dorialexander在𝕏发文称,新版Fables 5.1比5.0表现更自然,输出错误更少
开发者Dorialexander在社交平台𝕏发文评价Fables 5.1大模型。他认为Fables 5.1是一款表现不错的模型。
这个新版本刚刚解锁了数据提取环节的一个关键障碍。相比Fables 5.0,它的处理效果更自然,很少出现劣质输出。
3D建模 · @neilsonks
用户发现可以通过特殊方法把Atlas改造成3D建模工具
社交媒体用户neilsonks发现,仅需相机位姿和RGB信息即可实现这一效果
用户发现可以通过特殊方法把Atlas改造成3D建模工具
社交媒体用户neilsonks发现,仅需相机位姿和RGB信息即可实现这一效果
社交媒体用户@neilsonks分享了一个有趣发现,可以通过特殊方法“欺骗”Atlas,将它改造成3D建模工具。
具体的操作方法是把输入图像放置在三维空间中,之后模型会自动生成一个连贯完整的场景。
整个过程中,模型只需要获取相机位姿和RGB两种输入信息。
开源 · @superalesha
开发者完成通义千问Qwen3.8 27B全模型可视化Atlas
开发者@superalesha在𝕏发布Atlas,支持完整可视化Qwen3.8 27B的全部结构与运行状态,已开放在线体验和开源仓库
开发者完成通义千问Qwen3.8 27B全模型可视化Atlas
开发者@superalesha在𝕏发布Atlas,支持完整可视化Qwen3.8 27B的全部结构与运行状态,已开放在线体验和开源仓库
开发者@superalesha宣布已完成针对通义千问Qwen3.8 27B的Atlas可视化项目,实现了对该模型的完整覆盖。项目覆盖模型全部1199个张量、完整架构,以及模型运行时的内部状态。
该项目的最终成品是“活模型”功能。开发者运行了Qwen处理英文、代码和智能体轨迹数据,映射了全部64层、激活量化、所有完整注意力层、线性内存、110万个神经元、视觉模块的信号流,还记录了将每一层换为INT4量化后带来的性能损耗。
所有数据都来自模型真实权重或实际运行结果,没有任何占位数据。项目同时支持深色模式和适配的移动端浏览,最终成品已经达到可用产品的状态。
目前项目已开放在线体验,代码也公开在Github仓库。
视频生成 · @Fujimoto_hina▲ 6.7K
用户用Veo 3.1生成了4K薯片商业宣传AI视频
用户@Fujimoto_hina在𝕏分享了自己用Veo 3.1生成10秒商业视频的完整提示词
用户用Veo 3.1生成了4K薯片商业宣传AI视频
用户@Fujimoto_hina在𝕏分享了自己用Veo 3.1生成10秒商业视频的完整提示词
生成式视频 · @nopinduoduo▲ 1.7万
用户测试MiniMax H3 生成5秒AI视频效果细节清晰
用户@nopinduoduo在𝕏分享了Hailuo AI MiniMax H3直出的5秒AI生活场景视频,附完整生成提示词
用户测试MiniMax H3 生成5秒AI视频效果细节清晰
用户@nopinduoduo在𝕏分享了Hailuo AI MiniMax H3直出的5秒AI生活场景视频,附完整生成提示词
今天的 37 条信号到这里下一轮 12:30 更新
📬 订阅
https://ai-pulse-lab.com/feed.xml