-
- 2026/9/28
- 默认分类
注意了!NVIDIA首席科学家在博物馆论坛的YouTube评论区,OpenAI的Jalapeno负责人回复说,Jalapeno已经在SemiAnalysis的InferenceX基准上证明了自己跑得很快(顺便说一句,这比NVIDIA的Jul- 89阅读
- 0评论
-
- 2026/9/28
- 默认分类
DeepSeek一提到“逆转裁判”的Wright,立马就激活了记忆!我们深入探查了V4.1 Flash的Engram记忆门,发现它记住的远不止名字和事实……(1/6)🧵- 56阅读
- 0评论
-
- 2026/9/28
- 默认分类
我们来拆解一下苹果M6和台积电N2。所有内容我们都会在这里免费分享。台积电在三个领域领先(GAAFET代工厂),扩展、优化,还有一些惊喜。敬请期待!(系列第一部分)- 80阅读
- 0评论
-
- 2026/9/28
- 默认分类
在测试ClusterMAX 3.0的过程中,我们最重点测试的就是可靠性。我们基于之前的研究,确定了哪些云服务提供商能稳定带来良好效果(goodput),主要通过两点:一是及时识别故障,二是快速从故障中恢复。(1/7)🧵- 79阅读
- 0评论
-
- 2026/9/28
- 默认分类
鲁宾HBM解构 = Nvidia削减可卡因 多尔·帕特尔:芬太尼等级计算 - 为什么GB300机架在2030年将比每磅200美元的毒品更具价格优势 GB300 NVL72重约1,580公斤,完全填充且最近的采购订单为每机架500万美元,即每- 93阅读
- 0评论
-
- 2026/9/28
- 默认分类
转发 SemiAnalysis:中国AI基础设施大爆发:推出SemiAnalysis中国数据中心模型,60多家运营商遍布1000多个设施,首次以零售为主,通过AI进行翻转,最大的超大规模租户占据全国五分之一的容量,12个月内达到100兆瓦,- 86阅读
- 0评论
-
- 2026/9/28
- 默认分类
RT 艾尔维斯,我刚刚用一个开源堆栈运行了一个论文研究代理,大约10秒后,本周排名前五的关于代理记忆的论文就出现在了我的终端上。它是怎么工作的呢?我使用Tavily抓取了过去7天的arXiv论文,然后由NVIDIA Nemotron 3 U- 48阅读
- 0评论
-
- 2026/9/28
- 默认分类
每次看到榜单顶部的模型,总感觉不太妙,希望我是第一个被打脸的人!leo 🐾:果然,新Opus唯一的槽点就是个吃token的大胃王。每个智能指数任务消耗的token都是目前所有模型中最高的。现在降价反而更合理了!- 47阅读
- 0评论