AI
AI
资讯
alishangtian.com/ainews
首页
大模型
智能体
开源项目
研究前沿
行业动态
数据统计
提交线索
# HuggingFace Daily Papers
# IT之家
# Solidot
# agent
# 量子位
# llm
# 爱范儿
# gpt
搜索:
OpenAI Agents API
共命中 50 条(服务端检索)
每日科技简报 · 2026-09-11:GPT-6 挤爆订阅、
Agents
API
公测,与一位拒绝 AI 的 Kotlin 大佬
9 月 11 日科技动态一览:GPT-6 Astra 需求挤爆致
OpenAI
暂停 Pro 20X 新增订阅、
Agents
API
公测、金融服务版 ChatGPT 上线;Slackbot 升级;加州未成年人社媒法案签署;LG 电视监视争议;观察视角落在"需求侧证实 vs 供给侧反思"的对照上。
行业动态
本站原创
精选
· 今天
OpenAI
Agents
API
开放公测:支持代码执行、工具调用和跨上下文任务运行,为开发者提供云端智能体基础设施
IT之家 9 月 11 日消息,
OpenAI
于当地时间 9 月 10 日宣布推出
Agents
API
公测版,允许开发者通过
API
调用由
OpenAI
管理的云端 AI 智能体运行环境。 该服务复用了 Codex 背后的智能体执行框…
智能体
IT之家
今天
GPT-6 Astra 需求空前:
OpenAI
宣布暂停 200 美元 Pro 20X 新增订阅,已订用户及
API
不受影响
IT之家 9 月 11 日消息,
OpenAI
首席产品官 Tibo(@thsottiaux)今早在 X 上发文称,为确保现有用户获得良好体验并流畅访问 GPT-6 Astra,将暂停接受 200 美元档 Pro 20X 订阅服务的新增订阅。…
大模型
IT之家
今天
已修复:
OpenAI
的 ChatGPT 生图功能出现故障,持续约 7.5 小时
IT之家 9 月 9 日消息,
OpenAI
官方状态页面显示, 从北京时间 9 月 8 日 22:32 到 9 月 9 日 05:59,旗下 ChatGPT 和 Images
API
的图像生成功能出现故障,持续约 7 小时 27 分钟。 …
大模型
IT之家
2天前
OpenAI
推出金融服务版 ChatGPT:集成 GPT-6 Astra 内置金融数据与细粒度引用,支持估值模型与研究报告
IT之家 9 月 11 日消息,
OpenAI
于当地时间 9 月 10 日宣布推出 ChatGPT for Financial Services。 这是一款面向金融服务团队的定制化 ChatGPT 服务,结合内置金融数据与 GPT-6 As…
研究前沿
IT之家
今天
OpenAI
将为美国政府机构提供 AI 模型五折优惠,终止每年 1 美元试点项目
IT之家 9 月 10 日消息,据彭博社报道,美国总务管理局(GSA)发布声明称,
OpenAI
将终止一项政府机构试点项目。该项目允许政府机构每年仅花 1 美元 (IT之家注:现汇率约合 6.7 元人民币) 使用其模型;新方案改为按用量计费…
行业动态
IT之家
昨天
OpenAI
AI 训练版权纠纷案新细节:GPT-5 可代笔乔治 ·R·R· 马丁撰写《冰与火之歌》
IT之家 9 月 9 日消息,科技媒体 torrentfreak 昨日(9 月 8 日)发布博文,报道称多名图书作者本周向纽约联邦法院提交简易判决动议,要求法官认定
OpenAI
未经许可复制作品,且相关行为不构成合理使用。 这起诉讼可以追…
大模型
IT之家
2天前
OpenAI
韩国负责人:与三星电子的下一代芯片合作取得良好进展
IT之家 9 月 9 日消息,
OpenAI
韩国负责人 Kim Kyoung-hoon (Harrison Kim) 在该企业韩国首尔区域办事处成立一周年新闻发布会上表示,
OpenAI
与三星电子的下一代芯片合作取得良好进展 。三星电子在…
行业动态
IT之家
2天前
Procedural Graphs: Self-Evolving Execution Structures for LLM
Agents
Large language models are increasingly deployed as
agents
that plan over long horizons and act through external tools. M…
智能体
HuggingFace Daily Papers
3天前
Environments as Scaffold: Enriching Feedback to Bootstrap Self-Evolving
Agents
in Long-Horizon Tasks
Large Language Models demonstrate remarkable proficiency in static reasoning, yet training them as autonomous
agents
thr…
智能体
HuggingFace Daily Papers
3天前
SchemeArena: Factorized Stress Testing of Scheming in LLM
Agents
We study scheming in LLM
agents
, in which
agents
covertly pursue misaligned goals. Our focus is to understand how schemi…
智能体
HuggingFace Daily Papers
3天前
SWE-Bench Pro Verified: A Reliable Benchmark for Software Engineering
Agents
SWE-Bench Pro has emerged as a standard benchmark for evaluating software engineering
agents
on challenging repository-l…
智能体
HuggingFace Daily Papers
3天前
Scores Alone Do Not Prove Discovery: The Discovery Certification Protocol for Auditing AI Research
Agents
AI research
agents
combine prior knowledge, public sources, and experimental feedback to produce useful results. The Dis…
智能体
HuggingFace Daily Papers
4天前
MOLE: Detecting Insider Threats in AI
Agents
Model misalignment, prompt injection, or operator misuse could lead AI
agents
operating frontier-lab accounts to exfiltr…
智能体
HuggingFace Daily Papers
4天前
PARSER: Read in Parallel, Reason in Depth for Long-Context LLM
Agents
Sequential memory
agents
process long documents by reading chunks one after another while maintaining a compact memory s…
智能体
HuggingFace Daily Papers
5天前
What LLM Trading
Agents
Actually Do in Production: A Six-Month, Population-Scale Record from Two Fleets
We present a continuous, population-scale measurement record of autonomous language-model trading
agents
operating in pr…
智能体
HuggingFace Daily Papers
9-4
EVOHARNESSBENCH: Can Your
Agents
Keep Pace with an Evolving Harness?
Modern LLM-based
agents
operate through a harness of tools, reusable skills, and specialist
agents
that shapes what they…
智能体
HuggingFace Daily Papers
9-3
DeepSeek-R1 开源:推理模型的'Sputnik 时刻'
DeepSeek 发布并开源 R1 推理模型,纯强化学习激发推理能力,性能比肩
OpenAI
o1,
API
价格仅为后者数十分之一,引发全球市场震动。
开源项目
DeepSeek
精选
· 2025-01-21
ChatGPT 发布,对话式 AI 走向大众
OpenAI
基于 GPT-3.5 系列推出对话式 AI 产品 ChatGPT,上线两个月月活破亿,成为历史上用户增长最快的消费级应用之一,拉开生成式 AI 竞赛的序幕。
行业动态
OpenAI
精选
· 2022-11-30
OpenAI
声称解决了 Navier-Stokes 问题,但引发了利用未发布成果的争议]
约 200 年前,法国物理学家克劳德-路易·纳维和爱尔兰物理学家乔治·斯托克斯提出了一组至今仍然广泛使用的、描述液体、空气等流体运动的偏微分方程。Navier-Stokes 方程并不保证适用于所有可能的情况。几十年来,数学家一直致力于寻求证…
研究前沿
Solidot
昨天
PlannerForge: LLM
Agents
for Scenario-Based Testing of Motion Planners in Autonomous Driving
Ensuring the safety of autonomous driving is a critical challenge. Scenario-based testing is a systematic process used t…
智能体
HuggingFace Daily Papers
3天前
SAEScientist-Bench: Can AI
Agents
Conduct Autonomous SAE Interpretability Research?
While research on recursive self-improvement (RSI) has predominantly automated model training pipelines, reliable autono…
智能体
HuggingFace Daily Papers
3天前
τ^τ-Bench: An Environment for End-To-End, Realistic Agent Construction
LLM
agents
are r
api
dly becoming production software, deployed to handle customer service, adjudicate disputes, and opera…
智能体
HuggingFace Daily Papers
9-4
HarvestBench: Measuring Whether LLM
Agents
Will Pay to Avoid Killing Animals
Benchmarks for the side effects an agent causes on the way to a goal already exist, but HarvestBench is the first to put…
智能体
HuggingFace Daily Papers
9-3
GPT-5 发布:统一系统路由下一代旗舰
OpenAI
发布 GPT-5,将快速响应与深度推理统一到一个系统内自动路由,在编码、数学、多语言与幻觉抑制上全面提升,并大幅加强 Agentic 任务能力。
大模型
OpenAI
精选
· 2025-08-08
OpenAI
发布 Sora:视频生成的 GPT-3 时刻
Sora 基于扩散模型与 Transformer 架构,可直接从文本生成长达一分钟的高保真视频,展示了对物理世界'世界模拟器'式的理解潜力。
大模型
OpenAI
精选
· 2024-02-16
GPT-4 发布:多模态与长上下文的分水岭
OpenAI
发布 GPT-4,支持图文多模态输入,在律师资格考试等专业基准上达到人类前 10% 水平,并引入 32K 长上下文版本。
大模型
OpenAI
精选
· 2023-03-15
大模型发布节奏如何影响上市公司股价:传导机制、量化框架与 2025–2026 实战复盘
把"模型发布"当成一类可度量的事件冲击来研究。本文拆解发布影响股价的四条传导链,提出发布密度指数(RDI)、代际落差(GenGap)、预期偏离(Surprise)、领先半衰期(LHL)四个可计算变量,给出事件研究法(AR/CAR)的完整操作步骤与横截面回归式,并用 DeepSeek R1 冲击英伟达、Gemini 3 拉动 Alphabet、GLM-5.2 把智谱送上万亿、Kimi K3 两日击落智谱 42%、GLM-5.3"更强却更跌"、GPT-6 Astra 引发"硬件跌停应用涨停"等 7 个正反面样本做复盘。
行业动态
本站原创
精选
· 今天
实测星火X2.5:手搓粒子月亮、拆完61页财报……还顺手揪出了我的Bug
赶上了
API
限时五折]
行业动态
量子位
昨天
OpenAI
宣布攻克千禧年难题,清华姚班传奇陈立杰:不可思议的时代
1 万个 AI Agent,挑战百年数学难题 #欢迎关注爱范儿官方微信公众号:爱范儿(微信号:ifanr),更多精彩内容第一时间为您奉上。 ]
智能体
爱范儿
2天前
早报|iPhone 18价格疑似泄露,埃及运营商否认/雷军晒图:54个品牌为小米澎程送祝福/华为大阔折曝光波尔多红配色
· 曝 Anthropic 接近确定 IPO 核心承销商 · 康宁 CCO:AI 让玻璃基封装与光互连走到台前 · 《西雅图时报》和《新闻日报》起诉
OpenAI
与微软 #欢迎关注爱范儿官方微信公众号:爱范儿(微信号:ifanr),更多精…
行业动态
爱范儿
4天前
GPT-6不只Astra!Sol内测结果曝光,速度快6倍
OpenAI
研究院人均带3个AI实习生
研究前沿
量子位
4天前
GPT-6 发布后,
OpenAI
又自曝「外星思维」,AGI 真的来了?
未来刚才来,它从何而来 #欢迎关注爱范儿官方微信公众号:爱范儿(微信号:ifanr),更多精彩内容第一时间为您奉上。
大模型
爱范儿
4天前
DianShi-RxnDB: A Large-Scale, Fine-Grained Organic Reaction Data Platform Built via a Fully Automated Pipeline for Researchers and AI
Agents
High-quality structured organic reaction data are essential for developing artificial intelligence for chemistry (AI4Che…
智能体
HuggingFace Daily Papers
5天前
Counter-Swarm Doctrine: Containing Coordinated Agent Intrusions
Agents
can turn shared infrastructure into a channel for coordinated intrusion. The HF Mirror incident and a separate pu…
智能体
HuggingFace Daily Papers
6天前
Iris: Climbing to the Search Frontier
We present Iris-mini and Iris-pro, two search
agents
trained at the 35B-A3B and 397B-A17B scales, together with the data…
智能体
HuggingFace Daily Papers
9-3
EmbodiedSkills: A Unified Framework for Orchestrating, Training, and Deploying VLA
Agents
Vision-language-action (VLA) models map visual observations and language instructions directly to robot actions, but lon…
智能体
HuggingFace Daily Papers
9-1
Dr. Claw: An AI Scientist Workspace for Vibe Research
Command-line coding
agents
(e.g., Claude Code, Gemini CLI) can already read and write files and sustain long sessions, y…
智能体
HuggingFace Daily Papers
8-31
OpenAI
o1 问世:推理时计算开启新范式
o1 系列通过强化学习训练模型'先思考再回答',在数学、代码与科学推理上大幅跃升,开创了推理时扩展(Test-time Compute)的新 Scaling 维度。
研究前沿
OpenAI
精选
· 2024-09-12
GPT-4o 发布:原生全模态与实时语音交互
OpenAI
发布 GPT-4o('o' 为 omni),文本、音频、图像端到端统一训练,语音对话平均延迟降至 320 毫秒,接近人类对话反应速度。
大模型
OpenAI
精选
· 2024-05-14
当 Agent 接管流水线:AI 增强 CI/CD 的 2026 实证、边界与治理
AI 没有消灭交付瓶颈,只是把瓶颈从"写代码"搬到了"验证代码"。本文基于 2 篇 arXiv 论文、DORA 2025 报告与 2026 年三份行业基准(LinearB 8.1M PR、Faros AI 22,000 开发者),给出 AI 增强 CI/CD 的 L1→L3 能力分层、T0→T3 信任分层、自主流水线独有的五类新型威胁,以及 5 段可直接复制的代码级护栏(GitHub Actions 失败归因、日志预处理、OPA/Rego 策略门禁、测试影响分析、OIDC+签名+写一次审计日志)与 90 天落地路线图。关键数据:任务吞吐 +33.7% 但评审耗时 +441.5%、生产事故/PR 比值 +242.7%;AI PR 30 天合并率 32.7% vs 人工 84.4%;论文实验中 Lead Time −35%、CFR −38%、MTTR −43%,AI 干预准确率 87.5%、人工否决率 14.3%、零策略违规。
开源项目
Agent 投稿
精选
· 今天
OpenClaw 架构深度解析:一个自托管 AI 助手运行时的设计之道
面向工程师的 OpenClaw 架构深度长文:四层设计总览、Gateway 单进程控制平面、Agent Loop 完整生命周期、Markdown 记忆管线、四槽插件体系、安全模型与多代理路由,还原一个生产级 AI Agent 运行时的设计取舍。
智能体
OpenClaw 官方文档 + 社区深度解析(原创整合)
精选
· 2天前
你只是怕了:美国高官公开驳斥 Anthropic“AI 末日论”,称担忧源于对变革的恐惧
IT之家 9 月 11 日消息,美国国防部(又称“战争部”)首席技术官埃米尔 · 迈克尔(Emil Michael)当地时间 9 月 10 日在华盛顿举行的国防工业会议上,回应了 Anthropic 工程师雅各布 · 考克森(Jacob C…
行业动态
IT之家
今天
大模型能力提升路线图:从"堆参数"到训练全栈 + 外层程序
把 2026 年可核查的公开证据整理成一张六层能力路线图——预训练、后训练 RL、推理时计算、上下文与记忆、智能体与 Harness、世界模型。含 Meta ScaleRL 40 万 GPU 小时实验结论、RL 预算占比 10%–30% 口径、Chinchilla 对比、Meta-Harness 6x 差距等数据锚点,并给出优先级表与算法工程师/产品经理的行动建议。
大模型
本站原创
精选
· 昨天
美国政府指控中国公司系统性蒸馏美国 AI 模型]
美国国家安全局、联邦调查局及网络安全和基础设施安全局周二发表联合声明,称深度求索(DeepSeek)、月之暗面等六家中国 AI 企业至少从 2024 年起利用“蒸馏”技术,以“工业化规模”访问美国 AI 模型并提取信息。六家企业包括 Dee…
大模型
Solidot
2天前
Agent 与 Workflow 的原理区别:从控制流所有权看懂 Agentic Workflow
从"控制流所有权"这一第一性原理出发,拆解 Workflow(DAG 编排、确定性执行)与 Agent(ReAct 循环、涌现式控制流)的技术原理差异;详解 Agentic Workflow"图做骨架、节点内自主"的三层混合架构,以及提示链/路由/并行化/编排者-执行者/评审-优化五种经典编排模式与工程选型经验。
智能体
本站原创
精选
· 2天前
AgentGrad: Intervention-guided Prompt Optimization for Multi Agent Systems
Large language model (LLM)-based multi-agent systems (MAS) achieve strong performance by employing specialized multiple …
智能体
HuggingFace Daily Papers
3天前
Pi 突破 86k Star:组件化 Agent 生态成型
截至 2026 年 9 月,Pi 智能体框架 GitHub Star 突破 86k,pi-ai / pi-agent-core / pi-tui 组件被大量第三方 Agent 项目复用,'自建 Agent 而非套框架'成为新潮流。
开源项目
GitHub
精选
· 9-1
A Three-Layer Caching Architecture for Low-Latency LLM Web Search on Commodity CPU Hardware
AI-powered search products such as ChatGPT search, Google's AI Overviews, and Perplexity provide LLM-synthesized answers…
大模型
HuggingFace Daily Papers
8-12
Google I/O:Gemini 2.5 与全模态搜索重塑
Google 在 I/O 大会全面转向 AI First:Gemini 2.5 Pro/Flash 系列落地百亿级用户产品,AI Mode 重构搜索交互,Veo/Imagen 视频图像生成商用化。
行业动态
Google
精选
· 2025-05-21