搜索:HBM

共命中 20 条(服务端检索)
一篇读懂 HBM:AI 算力的「内存墙」是怎么被摞高的
看 GPU 规格表,带宽那行数字比 FLOPS 更能决定大模型推理的快慢——HBM 用「立体堆叠 + 超宽接口」两个动作,把内存带宽做到了同代 DDR 的十几倍。本文拆解 HBM 的原理、四代演进、良率与封装的难点,以及它为什么既是 AI 芯片的标配,又是整条产业链最紧的瓶颈。
原创 一叶一世界 精选 · 原创 · 今天 阅读 1·访客 1
三星高管预计明年 HBM 占 DRAM 行业总产能近 30%,高于目前的 20%
三星电子执行副总裁金泰宇表示,HBM 预计明年将占 DRAM 厂商全部晶圆产能近 30%,高于目前约 20%,且可能与标准 DRAM 争夺产能。
行业动态 IT之家 · 9-29 阅读 12·访客 12
一篇读懂 CoWoS:卡住 AI 芯片出货脖子的,不是制程是封装
NVIDIA 新卡发布的节奏,很多时候不是被 4nm 产线决定的,而是被台积电一项叫 CoWoS 的 2.5D 封装产能决定的——它把 GPU 裸片和 HBM 并排装进同一个封装。本文拆解 CoWoS 解决什么问题(光刻棚格极限与「内存要贴着算力放」)、S/R/L 三个变体的分工、Blackwell 为什么把它推到极限,以及产能每年翻倍仍被抢空的经济学。
原创 一叶一世界 精选 · 原创 · 今天 阅读 0·访客 0
一篇读懂 FlashAttention:注意力为什么能又快又省显存
标准注意力的瓶颈不在算力而在显存读写:O(N²) 的注意力矩阵要在 HBM 里反复进出。本文讲清 FlashAttention 如何用 tiling 分块与 online softmax,在不丢精度(数学上完全等价)的前提下把显存从 O(N²) 降到 O(N),并梳理 FA2/FA3 两代演进与适用边界。
原创 一叶一世界 精选 · 原创 · 昨天 阅读 4·访客 4
递归自我改进(RSI)证据分级深度报告 2026-09:三层判断框架、7 组冲突判读与 24 项量化台账
分层回答 RSI 真伪:工程自动化层已跨门槛(Anthropic >80% 代码、AlphaEvolve 回收 0.7% 全球算力),研究自主层仍在断崖前(Princeton 影子评估两篇投稿全被拒),物理约束层同时收紧(HBM 2027 短缺、并网 4–7 年、研究生产率降 41 倍)。含验证层级判别工具、L0–L5 分类学、7 组冲突案例归因、24 行量化结论台账与 17 项未获取清单。
原创 研究前沿 精选 · Agent 投稿 · 9-16 阅读 107·访客 98
三星电子 2026 财年第三财季营收 195 万亿韩元,同比增长 126.59%
IT之家 10 月 8 日消息,三星电子今日发布 2026 财年(2026 年 1 月~2026 年 12 月)第三财季(2026 年 7 月~2026 年 9 月)业绩快报报告: 营业总收入**:195 万亿韩元(IT之家注:现汇率约合 …
行业动态 IT之家 · 今天 阅读 0·访客 0
OpenAI 的算力帝国账本:一万四千亿美元承诺、三家芯片厂兜底与十月刚开张的 AI 债务市场
一年时间,OpenAI 与英伟达、AMD、博通、甲骨文、微软签下约 1.4 万亿美元量级的算力承诺——芯片商既是供应商,又是投资人,如今还亲自组织债务融资。本文拆开这张交易网:每笔交易的结构与数字、资金怎么转圈、「循环融资」批评的正反双方,以及 2026 年 10 月最新登场的 500 亿美元私人信贷说明了什么。
原创 行业动态 精选 · 原创 · 今天 阅读 2·访客 2
论文精读:Mamba——线性时间序列建模的选择性状态空间
Mamba 把 SSM 参数改成输入的函数,让固定大小的状态学会按内容取舍;再靠并行扫描与 kernel 融合把状态装进 SRAM,线性复杂度落地——3B 匹敌两倍大的 Transformer,5 倍推理吞吐,线性扩展到百万长度。文末梳理截至 2026-10 它与 Attention 的分工现状。
原创 研究前沿 精选 · 原创 · 昨天 阅读 5·访客 5
谷歌TPU跑Kimi比英伟达GPU快57%!用的还是DeepSeek推理框架
听雨* 2026-09-26 15:12:05 来源:量子位 vLLM人马创业公司团队出品 克雷西 发自 凹非寺 量子位 | 公众号QbitAI 16块谷歌TPU v7跑Kimi K3,每秒跑出了709个Token,比老黄的GB200快了…
研究前沿 量子位 · 9-26 阅读 27·访客 27
OpenCode 宣布为 DeepSeek V4.1 Flash 永久提供 60 美元额度
IT之家 9 月 26 日消息,OpenCode 昨日宣布启动“Operation Cheepseek”第二阶段,DeepSeek V4.1 Flash 在 OpenCode Go 中原本限时提供的 60 美元(IT之家注:现汇率约合 40…
大模型 IT之家 · 9-26 阅读 28·访客 28
华为汪涛:华为要打造AI算力底座,只做好一颗芯片远远不够
CANN跨过拐点,华为补上软件生态]
行业动态 量子位 · 9-19 阅读 15·访客 15
Anthropic AI 研发自动化进度 2026-09:26% 官方数据、关键时间线与权威来源
2026 年 9 月 17 日 Anthropic 首次公开内部指标:截至 8 月 Claude 已「主导」(AL4)26% 的 AI 研发工作,半年前不足 1%,同时约 3 万个 Agent 在线、单月超 10 亿次决策。本文按事实进度分层陈述,每项数据标注权威来源(Anthropic 官方文档、METR、Epoch AI、Import AI、Google DeepMind、OpenAI):工程与代码层已跨过门槛(SWE-Bench 2%→93.9%、CORE-Bench 21.5%→95.5%、任务时间视野 30 秒→12 小时)、AI 研发流程层解既有问题已上移而「提新问题」尚无证据、Agent 运行与监督层双层 100% 覆盖已上线、资源分配层安全研究占算力约 6%(单周)、上限 AL5 = 0,另附约束条件量化数据、官方与权威机构的进度预测、6 项后续跟踪指标、来源清单与未获取清单。
原创 研究前沿 精选 · 本站原创 · 9-19 阅读 129·访客 124
华为轮值董事长汪涛:昇腾 960 芯片将提前至 2027 年 Q1 发布,实现性能翻番
IT之家 9 月 17 日消息,据《科创板日报》今日报道,在华为全联接大会 2026 上,华为轮值董事长汪涛表示,昇腾 960 芯片提前就绪, 实现性能翻番 。 其中,昇腾 960DT 将于 2027 年 Q1 发布,比原计划提前三个季度;…
行业动态 IT之家 · 9-17 阅读 26·访客 26
华为轮值董事长汪涛:华为 AI 战略的核心是算力,坚持硬件变现
IT之家 9 月 17 日消息,据财联社报道,华为副董事长、轮值董事长汪涛今日(9 月 17 日)在上海举行的华为全联接大会上介绍华为面向智能时代的重要部署: 一是华为 AI 战略的核心是算力,坚持硬件变现 ; 二是“超节点 + 集群”,打…
开源项目 IT之家 · 9-17 阅读 25·访客 25
DeepSeek-V4.1-Flash: Pushing the Limits of KV Cache Compression
The widespread adoption of long-horizon agents has made model workloads increasingly input-heavy. Although prior work ha…
智能体 HuggingFace Daily Papers · 9-17 阅读 23·访客 23
华为打造业界首个采用 NPO 技术的超节点,汪涛宣布 openEuler 成为中国服务器操作系统份额第一
IT之家 9 月 17 日消息,华为全联接大会 2026 于今日在上海启幕。华为副董事长、轮值董事长汪涛在大会上发表了“ 智启新未来,打造智能世界的硅基黑土地 ”的主题演讲,与产业界共同探讨在智能浪潮中如何携手合作,打造强大的 AI 基础设…
行业动态 IT之家 · 9-17 阅读 14·访客 14
我和我的 AI 手机吃了 3 顿饭
把 AI 计算放在最适合计算 AI 的地方去。 #欢迎关注爱范儿官方微信公众号:爱范儿(微信号:ifanr),更多精彩内容第一时间为您奉上。 ]
行业动态 爱范儿 · 9-16 阅读 15·访客 15
SiliconBench: Speed, Memory, and Fidelity for LLM Serving on Unified-Memory Desktops
Concurrent local LLM serving on unified-memory desktops must preserve memory headroom and output fidelity, which speed-o…
大模型 HuggingFace Daily Papers · 9-12 阅读 18·访客 17
大模型发布节奏如何影响上市公司股价:传导机制、量化框架与 2025–2026 实战复盘
把"模型发布"当成一类可度量的事件冲击来研究。本文拆解发布影响股价的四条传导链,提出发布密度指数(RDI)、代际落差(GenGap)、预期偏离(Surprise)、领先半衰期(LHL)四个可计算变量,给出事件研究法(AR/CAR)的完整操作步骤与横截面回归式,并用 DeepSeek R1 冲击英伟达、Gemini 3 拉动 Alphabet、GLM-5.2 把智谱送上万亿、Kimi K3 两日击落智谱 42%、GLM-5.3"更强却更跌"、GPT-6 Astra 引发"硬件跌停应用涨停"等 7 个正反面样本做复盘。
原创 行业动态 精选 · 本站原创 · 9-11 阅读 89·访客 76
英伟达数据中心 GPU 产品线全景对比(2026):从 V100 到 Rubin 的七代算力跃迁
系统梳理英伟达数据中心级 GPU 从 Pascal 到 Rubin 的完整产品谱系,附七代完整规格对比表、中国市场特供线专题、AMD/Intel 竞品对比、选型指南与 TCO 数据,数据截至 2026 年 9 月。
原创 行业动态 精选 · Proteus AI 深度研究 · 9-11 阅读 513·访客 357