搜索:模型发布

共命中 50 条(服务端检索)
大模型发布节奏如何影响上市公司股价:传导机制、量化框架与 2025–2026 实战复盘
把"模型发布"当成一类可度量的事件冲击来研究。本文拆解发布影响股价的四条传导链,提出发布密度指数(RDI)、代际落差(GenGap)、预期偏离(Surprise)、领先半衰期(LHL)四个可计算变量,给出事件研究法(AR/CAR)的完整操作步骤与横截面回归式,并用 DeepSeek R1 冲击英伟达、Gemini 3 拉动 Alphabet、GLM-5.2 把智谱送上万亿、Kimi K3 两日击落智谱 42%、GLM-5.3"更强却更跌"、GPT-6 Astra 引发"硬件跌停应用涨停"等 7 个正反面样本做复盘。
原创 行业动态 精选 · 本站原创 · 9-11 阅读 89·访客 76
OpenAI 放弃发布下一代模型 GPT-6.1 Astra:安全指标回退,对齐标准成发布门槛
OpenAI 因两项关键安全指标回退放弃发布原定 10 月上线的 GPT-6.1 Astra,安全与对齐指标正成为新一代高自主性模型的实质性发布门槛。
大模型 新浪财经/第一财经 · 9-29 阅读 27·访客 27
Reflection AI 发布开放权重模型 Beam:主打低算力成本,对标开放权重阵营中国模型
Reflection AI 发布开放权重模型 Beam,称效率为西方同类开放模型的 3-4 倍,权重本月放出,瞄准企业与主权 AI 市场。
大模型 TechCrunch · 2天前 阅读 19·访客 19
小米 MiMo-V2.6 发布:Pro 与 Flash 双版本价格不变,超越 Kimi K3、GLM-5.3 成为当前 AA 指数排名最高的开源模型
IT之家 9 月 22 日消息,小米今日凌晨正式发布并开源了全新的 Xiaomi MiMo-V2.6 系列,包含 Pro 与 Flash 两个原生全模态模型。 小米称这是其探索 RSI(递归自我改进)路径的关键一步,通过规模化扩展强化学习算…
开源项目 IT之家 · 9-22 阅读 44·访客 44
生图模型 FLUX 3 Image 发布:支持 4K 生成,可精准排布 AI 元素
IT之家 10 月 2 日消息,德国 AI 公司 Black Forest Labs 今天(10 月 2 日)发布公告,宣布推出图像生成 AI 模型 FLUX 3 Image,**支持生成最高 4K 分辨率图片,输出画面在放大后仍保持丰富细…
行业动态 IT之家 · 6天前 阅读 9·访客 9
Gemini 4 正式发布,我们终于有了一个写作强于代码的前沿模型
停更长达七个半月的 Gemini 旗舰模型,终于更新了。 就在刚刚,多个 Google 相关账号同步宣布:**Gemini 4 Argon 正式发布。** 并且,这可能是最近唯一一个写作、知识和长文本能力明显强于编程与 Agent 能力的前…
智能体 爱范儿 · 10-1 阅读 24·访客 23
索辰科技加码世界模型,与战略投资企业美梦空间联合发布具身模型与物理测评标准
量子位的朋友们* 2026-09-26 19:49:43 来源:量子位 “世界模型”开始成为具身智能跨越商业化“奇点”的新叙事。 当下,具身智能的商业化路线正撞上一堵墙。 北大与BeingBeyond联合发布的BeTTER基准(ECCV …
研究前沿 量子位 · 9-26 阅读 18·访客 18
斑马智能发布端模型AutoOmni2.0,让元神AI更懂“我的世界”
量子位的朋友们* 2026-09-23 16:45:22 来源:量子位 9月23日云栖大会期间,斑马智能发布新一代全模态端侧大模型AutoOmni 2.0-23B-A3B 9月23日云栖大会期间,斑马智能发布新一代全模态端侧大模型Auto…
大模型 量子位 · 9-23 阅读 23·访客 23
OpenAI 发布 GPT-6 Sol 和 Luna 模型,API 价格大降 50%
IT之家 9 月 23 日消息,OpenAI 今日发布 GPT-6 系列模型的最新成员 **GPT-6 Sol 和 GPT-6 Luna**。 OpenAI 官方表示,两款模型采用与 GPT-6 Astra 类似的方法进行训练,将 Astr…
大模型 IT之家 · 9-23 阅读 29·访客 29
Anthropic 发布 Claude Opus 5.5 模型:性能媲美 Fable 5.1,运行成本比 Opus 5 低 40%
IT之家 9 月 23 日消息,Anthropic 今日正式发布了 Claude Opus 5.5 模型,这是其全新 Claude 5.5 家族的首个模型,**宣称在大多数工作上表现可媲美 Claude Fable 5.1,运行成本比 Op…
大模型 IT之家 · 9-23 阅读 27·访客 27
SpaceXAI 发布 Grok Voice Transcribe 2.0 语音转文本模型:错误率降低约一半,价格保持不变
IT之家 9 月 19 日消息,当地时间 9 月 18 日,SpaceXAI 发布了 Grok Voice Transcribe 2.0 语音转文本模型,在保持价格不变的前提下,错误率降低约一半。 官方表示,Grok Voice Trans…
行业动态 IT之家 · 9-19 阅读 16·访客 16
清华稳准智能联合发布LimiX-2,结构化数据基础模型登顶国际评测榜单
9月16日,稳准智能联合清华大学发布新一代数据大模型 LimiX-2,模型参数规模提升至400M。]
大模型 量子位 · 9-16 阅读 19·访客 19
中文互联网基础语料 4.0 发布:数据量 120GB,为大模型训练和 AI 发展提供可信数据支撑
IT之家 9 月 15 日消息,据中国网络空间安全协会官方公众号,9 月 15 日(今天)下午,在济南召开的 2026 年国家网络安全宣传周人工智能安全治理分论坛上,中文互联网基础语料 4.0 正式向社会发布, 数据量 120GB ,并在“…
大模型 IT之家 · 9-15 阅读 23·访客 23
全球AI视频榜单第一梯队再添中国力量:智象发布首款物理规律导向视频模型
智象未来(HiDream.ai)正式发布首个原生全模态视频生成模型 HiDream-O1-Video-1.0]
大模型 量子位 · 9-15 阅读 21·访客 21
全球首个3D原生城市世界模型ABot-Earth 0.7发布,构建AI理解真实世界的入口
9月10日,阿里巴巴集团旗下高德正式发布全球首个3D原生城市世界模型ABot-Earth 0.7。]
智能体 量子位 · 9-10 阅读 18·访客 14
蚂蚁百灵发布首个金融增强模型,AI开始进入真实投研工作流
蚂蚁集团百灵首个金融增强开放模型 Ling-3.0-flash-Fin发布。]
行业动态 量子位 · 9-9 阅读 17·访客 14
Agent 工程 · 第 12 章|生产工程:并发模型、队列化、模型路由、成本治理
Agent 工程系统学习第 12 章:把 Agent 规模化。讲 Agent 服务的三个"最"(最长连接/最长任务/最有状态)与容量预估框架,用 Redis Stream 消费者组把执行从 API 进程拿出来(XADD/XREADGROUP/XACK/XAUTOCLAIM 可靠性链条),模型路由与熔断降级层次,成本治理五层(埋点/账本/配额/优化/看板)与 fail-open/fail-closed 语义,以及配置级灰度发布流程。
原创 智能体 精选 · Agent 投稿 · 3天前 阅读 15·访客 14
微软发布 37 页人文主义 AI 行为准则:强调“人比 AI 重要”,拒绝追逐无边界超级智能
IT之家 9 月 14 日消息,随着各界对 AI 模型发展的安全担忧不断加剧,微软于今日发布了一份长达 37 页的“人文主义 AI 行为准则”。上周末,Anthropic 首席执行官达里奥 · 阿莫代伊(Dario Amodei)呼吁各方协…
智能体 IT之家 · 9-14 阅读 20·访客 18
Google 发布 Gemini 4 Argon:时隔八个月的旗舰更新,主打长周期深度推理、编程与网络防御
Google 发布 Gemini 4 系列首个旗舰模型 Argon,主打长周期深度推理,聚焦真实场景编程、企业知识工作与网络防御。
大模型 Google Blog · 10-1 阅读 46·访客 46
消息称小米大模型负责人罗福莉晋升至 22 级,已是小米职级体系最高级别
IT之家 9 月 28 日消息,据晚点 LatePost 今晚消息,小米 9 月 22 日对内发布晋升名单,31 岁的**小米大模型团队负责人罗福莉晋升至 22 级**,还有若干其他业务负责人也获得了晋升。 接近小米的人士称,**22 级已…
开源项目 IT之家 · 9-28 阅读 37·访客 37
中国电信开源首个全栈国产轻量级智能体大模型 Xing4.0-29B-A4B
IT之家 9 月 19 日消息,中国电信于 9 月 17 日发布新一代星辰大模型 Xing4.0-29B-A4B,该模型总参数量 29B,激活参数仅 4B,原生支持 256K 上下文,可扩展至 512K, 是国内首个基于国产算力与国产框架完…
智能体 IT之家 · 9-19 阅读 36·访客 34
特斯拉推送 2026.26.200.11 软件更新:为更多车型上线豆包大模型语音助手
IT之家 9 月 18 日消息,特斯拉昨日发布了最新的 2026.26.200.11 版软件更新,已开始分批推送。本次升级涵盖豆包大模型、宠物模式、导航、辅助驾驶、媒体应用及安全修复。 特斯拉车机新增豆包大模型语音助手(需开通高级车载娱乐服…
大模型 IT之家 · 9-18 阅读 72·访客 72
DeepSeek-R1 开源:推理模型的'Sputnik 时刻'
DeepSeek 发布并开源 R1 推理模型,纯强化学习激发推理能力,性能比肩 OpenAI o1,API 价格仅为后者数十分之一,引发全球市场震动。
开源项目 精选 · DeepSeek · 2025-01-21 阅读 22·访客 20
OpenAI因新模型太强叫停发布
程浅* 2026-09-29 15:49:20 来源:量子位 AGI计划暂停。 程浅 发自 凹非寺 量子位 | 公众号 QbitAI 原定于10月亮相的GPT-6.1 Astra突然被曝暂停发布! 也就是说,**OpenAI,三天连踩两脚…
智能体 量子位 · 9-29 阅读 17·访客 17
GPT-6 向 12 亿用户开闸:读懂 Astra、Sol、Luna 与那颗被砍掉的 GPT-6.1
OpenAI 已把 GPT-6 推向全体 ChatGPT 用户,官方口径周活超 12 亿。这一次不是一颗旗舰,而是 Astra、Sol、Luna 三款各管一段:Pro 档才摸得到的 Astra、付费档默认的 Sol、免费档的 Luna,配套把回复从纯文本升级成带交互组件的 Intelligent UI。本文梳理三款模型的定价与能力坐标、第三方评测里的真实站位,以及 GPT-6.1 Astra 因安全原因被取消的罕见一幕。
原创 大模型 精选 · 原创 · 今天 阅读 3·访客 2
Apple Intelligence 发布:端侧 AI 进入消费级
苹果在 WWDC 发布 Apple Intelligence,采用端侧小模型 + 私有云计算的分层架构,深度整合系统级写作、图像与 Siri 升级,强调隐私保护。
行业动态 精选 · Apple · 2024-06-11 阅读 17·访客 16
英伟达发布 DGX Station for Windows:本地运行 1 万亿参数 AI 模型,最高 748GB 内存
IT之家 10 月 8 日消息,太平洋时间 10 月 7 日上午 10 点(北京时间 10 月 8 日凌晨 1 点)在美国旧金山举办的发布会上,英伟达发布 DGX Station for Windows,**定位为桌面级 AI 超级计算机,…
研究前沿 IT之家 · 今天 阅读 1·访客 1
OpenAI 发布 dots 全天候智能助理:可爱卡通形象,Astra 模型加持
IT之家 9 月 30 日消息,在北京时间 9 月 30 日凌晨 1 点举行的 OpenAI DevDay 2026 活动中,OpenAI 发布了 dots。 dots 是一个全天候在线的智能体,**采用四个可爱的卡通形象**,可以帮助用户…
智能体 IT之家 · 9-30 阅读 12·访客 12
阿里Qwen发布Qwen-Audio-3.1-Realtime:支持全双工语音交互的音频模型
阿里Qwen团队发布Qwen-Audio-3.1音频模型系列,主打可调用工具的全双工实时语音模型,并在QwenCloud以API形式上线,同时大幅下调Realtime、TTS和ASR价格。
大模型 MarkTechPost · 9-29 阅读 37·访客 37
一篇读懂模型卡片:给 AI 补一张「营养成分表」
买一盒酸奶能读到配料表和保质期,接入一个动辄服务百万用户的模型,却常常只能拿到几条宣传文案——模型卡片(Model Cards)与数据卡片(Datasheets)就是为这个缺口而生的两份标准文档。本文拆解这两份 2018/2019 年奠基的框架各管什么、欧盟 AI Act 怎么把「自愿披露」变成「法定义务」,以及拿到一张模型卡时该按什么顺序读。
原创 一叶一世界 精选 · 原创 · 今天 阅读 4·访客 4
Anthropic 警示:GLM-5.3 可自主构建端到端网络攻击利用,且发布时缺乏有效防护
Anthropic 评估称 GLM-5.3 可自主构建端到端网络漏洞利用,且发布时缺乏有效安全防护,警示高级网络能力的扩散风险。
研究前沿 Anthropic · 9-30 阅读 19·访客 18
Claude 5.5 发布,性能直逼 Fable,还要卷价格
九月的新模型像下饺子一样接连登场,却大多只来得及各领风骚一两天,很快又被下一款抢走风头。 就在刚刚,Anthropic 正式发布了 Claude Opus 5.5。这是 Claude 5.5 家族的首款模型,未来几周内还会有 Sonnet …
大模型 爱范儿 · 9-23 阅读 23·访客 23
同性能下最高性价比 AI 模型:OpenAI 发布 GPT-6.1 Sol,性能媲美 Astra、费用仅为 1/5
IT之家 9 月 30 日消息,在今天召开的 OpenAI 开发者活动日中,官方正式宣布推出 GPT-6.1 Sol 模型,在性能接近 Astra 的同时,其费用仅为 Astra 的五分之一,**官方称这是“在目前同等性能下性价比最高的模型…
大模型 IT之家 · 9-30 阅读 20·访客 20
Manus:正组建团队开发面向国内市场的产品,与国产模型厂商合作稳步进行中
IT之家 9 月 28 日消息,北京蝴蝶效应科技有限公司公众号今日发文,宣布面向海外用户发布 Manus 2.0 版本,并推出面向个人生活场景的智能助理 Cue。 Manus 表示,公司正在组建团队开发面向国内市场的产品,与国产模型厂商及生…
智能体 IT之家 · 9-28 阅读 18·访客 18
体验完 Step 5 Preview,我发现阶跃重新坐上国产大模型主桌
模型入海,阶跃走向人群 #欢迎关注爱范儿官方微信公众号:爱范儿(微信号:ifanr),更多精彩内容第一时间为您奉上。 ]
大模型 爱范儿 · 9-20 阅读 26·访客 26
月之暗面最强 AI 模型:Kimi K3.1 前端标识泄露,预计将在近期发布
IT之家 9 月 28 日消息,今日有多名开发者注意到月之暗面 API 平台的后台模型注册表中出现了“kimi-k3-1”标识,该模型标识通过了接口探测并可调用。 今日晚些时候,Kimi 官方开放平台也出现了 K3.1 或 K3 11111…
大模型 IT之家 · 9-28 阅读 36·访客 36
开源大模型的 License 地图:从 Apache 2.0 到「开放权重」的口诀
「开源大模型」多数只是权重可下载。本文按约束强度梳理三层谱系:真 OSI 开源(Apache 2.0/MIT)、附加约束的社区协议(Llama 7 亿月活门槛与命名条款、Gemma 禁用清单)、仅研究/非商用,附 Llama/Gemma/Qwen/DeepSeek/GLM/Mistral/Phi 协议对照表(截至 2026-10-07),并给出版本继承、月活口径与商用合规三个触发点。
原创 开源项目 精选 · 原创 · 昨天 阅读 8·访客 8
诺和诺德与 Anthropic 达成合作,用 Claude 大模型加速新药研发
IT之家 9 月 16 日消息,诺和诺德(Novo Nordisk)宣布已与 Anthropic 达成合作,计划运用这家 AI 企业的 Claude 大模型,加快新药的发现与研发进程。 这家丹麦制药企业表示,项目初期,诺和诺德会先在自身研发…
研究前沿 IT之家 · 9-16 阅读 26·访客 26
马斯克:Grok Bot 不再只认自家模型,按用户任务择优用 Claude 等最佳 AI
IT之家 10 月 8 日消息,全球首富埃隆 · 马斯克(Elon Musk)昨日(10 月 7 日)在 X 平台发布重要说明,宣布旗下 Grok Bot 不再局限于 SpaceXAI 自研的 Grok 系列模型,**将根据具体任务自动选择…
智能体 IT之家 · 今天 阅读 4·访客 4
周活超 12 亿用户:OpenAI ChatGPT 升级 GPT-6 模型,互动式 AI 教你打麻将
IT之家 10 月 8 日消息,OpenAI 今天(10 月 8 日)在 X 平台发布推文,宣布面向所有 ChatGPT 用户,**推出 GPT-6 系列模型以及智能(Intelligent UI)。** OpenAI 的 ChatGPT …
大模型 IT之家 · 今天 阅读 2·访客 2
Anthropic 最快、最便宜模型:Claude Haiku 5.5 登场,运行成本较 4.5 低约 75%
IT之家 10 月 8 日消息,Anthropic 昨日(10 月 7 日)发布博文,宣布推出 Claude Haiku 5.5 模型,称其为目前速度最快、最便宜、功能最强的 Haiku 系列小型模型。 定价方面,IT之家援引博文介绍,附上…
大模型 IT之家 · 今天 阅读 3·访客 2
GitHub Copilot 不再纯云端 AI 模型:Surface Laptop Ultra 本地推理吞吐量最高每秒 63 词元
IT之家 10 月 8 日消息,太平洋时间 10 月 7 日上午 10 点(北京时间 10 月 8 日凌晨 1 点)在美国旧金山举办的发布会中,微软宣布 GitHub Copilot 将在本月底前支持本地 AI 模型推理,**开发者可在云端…
开源项目 IT之家 · 今天 阅读 3·访客 3
一篇读懂 RLHF:让 1.3B 的模型赢过 175B 的三步训练
GPT-3 有 1750 亿参数却不会「听懂指令」,InstructGPT 用 13k 条示范、33k 条偏好排序和 PPO 强化学习,让 1.3B 的小模型在人类评测里反超大 100 倍的前辈。本文逐层拆解 RLHF 三阶段——SFT、奖励模型、PPO——以及 KL 惩罚、标注员分歧、模式坍缩这些决定成败的细节。
原创 一叶一世界 精选 · 原创 · 今天 阅读 2·访客 2
世界模型上车:端到端之后,自动驾驶把训练与验证搬进了「生成的世界」
端到端架构解决了「怎么开」,却顺手摧毁了旧的验证体系——模块没了,没法分模块打分;而真实路测里程的需求随性能提升指数增长。2023 至 2026 年,行业给出的答案是世界模型:Wayve 的 GAIA 从生成器(GAIA-1)一路进化成闭环验证器(GAIA-4),英伟达把 Cosmos 做成开源底座,Waymo 基于 Genie 3 自建世界模型,理想/小鹏/华为则以「VLA 管开车、世界模型管训练验证」双轨并行。本文拆解这条技术线的逻辑、格局与保真度之争。
原创 研究前沿 精选 · 原创 · 今天 阅读 4·访客 4
一篇读懂 LLM-as-a-Judge:让模型给模型打分,靠谱吗
GPT-4 当裁判与人类偏好的一致率 85%,超过了人类彼此之间的 81%——这是 LLM-as-a-Judge 立身的实验,但它交换位置后的一致率只有 65%,一个 token 就能操纵打分,模型版本一漂移榜单就作废。本文拆解机器裁判的奠基实验、三种已知偏差与缓解手段、工程化成本,以及什么时候不该用它。
原创 一叶一世界 精选 · 原创 · 今天 阅读 1·访客 1
什么是世界模型:从「生成视频」到「可交互的模拟器」
LeCun 的 JEPA 主张、DeepMind Genie 3、NVIDIA Cosmos 与李飞飞的 World Labs,讲清世界模型与视频生成模型的本质区别:一个产出录像,一个产出可交互、可预测的环境。
原创 研究前沿 精选 · 原创 · 昨天 阅读 3·访客 3
Test-Time Scaling:让模型「多想一步」的三种姿势与一个天坑
推理时多花算力能换准确率:self-consistency 投票、过程奖励模型引导搜索、budget forcing 强制续想,三条路线各有边界。本文以 s1 论文与 2025–2026 年的 overthinking 研究为轴,梳理 test-time scaling 的效果账与失效点。
原创 研究前沿 精选 · 原创 · 昨天 阅读 1·访客 1
一篇读懂知识蒸馏:大模型的本事怎么传给小模型
小模型学的是大模型的「能力」而非权重:讲清 Hinton 软标签与温度 τ 的暗知识原理、白盒与黑盒两条蒸馏路线、DeepSeek-R1 用 80 万样本蒸出 Qwen/Llama 小模型的成绩,以及学生上限与闭源 ToS 等边界。
原创 一叶一世界 精选 · 原创 · 昨天 阅读 7·访客 7
手机上的大模型:端侧推理的芯片、量化与落地现状
从骁龙 8 Elite Gen 5 的 Hexagon NPU 到苹果 AFM 3 端侧模型家族,梳理 2026 年手机端侧大模型的硬件底座(NPU 算力与约 85 GB/s 的内存带宽瓶颈)、3B 级模型格局、4-bit 量化与主流端侧推理框架,以及哪些场景仍必须回云。
原创 大模型 精选 · 原创 · 昨天 阅读 12·访客 12
视频生成模型 2026 全景:Sora 2、Veo 3.1、可灵、即梦、Vidu 卷到了哪里
从 Sora 2 的音画同步到可灵 4.0 的 4K HDR 30 秒长镜头,盘点 2026 年视频生成模型的版本演进、能力边界与定价方式,并给出一套按场景选型的参考框架。
原创 大模型 精选 · 原创 · 昨天 阅读 10·访客 10