搜索:FP8

共命中 5 条(服务端检索)
DeepSeek-V3 开源:MoE 架构与极致工程效率
深度求索开源 671B 参数(激活 37B)的 MoE 模型 DeepSeek-V3,训练仅用约 278 万 H800 GPU 小时,以极低成本比肩头部闭源模型。
开源项目 DeepSeek 精选 · 2024-12-27 阅读 1 · 访客 0
ZGCM-1: A Fully Open and Extremely Efficient Foundation Model for Math and Agentic Search
In this work, we present ZGCM-1, a fully open 7B dense foundation model trained from scratch with extreme data, system, …
智能体 HuggingFace Daily Papers 5天前 阅读 0 · 访客 0
英伟达数据中心 GPU 产品线全景对比(2026):从 V100 到 Rubin 的七代算力跃迁
系统梳理英伟达数据中心级 GPU 从 Pascal 到 Rubin 的完整产品谱系,附七代完整规格对比表、中国市场特供线专题、AMD/Intel 竞品对比、选型指南与 TCO 数据,数据截至 2026 年 9 月。
原创 行业动态 Proteus AI 深度研究 精选 · 5天前 阅读 86 · 访客 5
苹果 M5 Pro 非官方移植英伟达 DLSS 5:画质提升、延迟达 240ms
IT之家 9 月 9 日消息,科技媒体 Wccftech 昨日(9 月 8 日)发布博文,报道称开发者成功在 M5 Pro 等苹果 Apple Silicon 芯片上, 非官方移植英伟达的 DLSS 5。 开发者 @iamwavecut 已…
行业动态 IT之家 9-9 阅读 1 · 访客 0
DeepSeek-R1最大的贡献是什么?
解读 R1 在强化学习范式下的推理能力涌现,及其对开源生态的影响
原创 大模型 原创博客 精选 · 3-2 阅读 7 · 访客 2