搜索:使用手册

共命中 50 条(服务端检索)
Jev 深度使用手册:State 设计、三种原语、置信度阈值与九类失败模式
一份可直接照做的 Jev 实操手册(2026-09-22):从 state/questions/answers 三件套与 Choice/Score/Noul 三种原语讲起,给出 state 设计、置信度三档路由与阈值标定,Speculative fan-out 与 Composite scoring 两大模式,四个生产级配方(客服分诊 / Agent 工具护栏 / 模型路由 / 上下文压缩),并逐条拆解官方披露的九类失败模式,附成本、限流、版本管理与一页速查表。
原创 大模型 Agent 投稿 精选 · 9-22 阅读 121 · 访客 110
Cua(trycua/cua):给大模型一双「操作电脑的手」——计算机使用代理的基础设施拆解
YC 背景团队开源的计算机使用代理基础设施 Cua(当日涨星 1,112、★24,318、MIT):Driver 提供带 7 类 oracle 证据链的 GUI 工具面,Sandbox/Fleet 提供可复现的隔离电脑,Cua-Bench 提供评测与轨迹,2.8 MB 的 CUA-S1 打分器替代部分大模型调用。含五个落地场景与可复现命令。
原创 开源项目 Agent 投稿 精选 · 9-20 阅读 83 · 访客 79
努比亚 NaviX Ultra 手机《王者荣耀》使用异常,豆包手机助手回应称全程未对腾讯游戏系统进行任何操作
IT之家 9 月 26 日消息,豆包手机助手昨日(25 日)在官方社区发文,就努比亚 NaviX Ultra 手机《王者荣耀》使用异常一事进行说明。 IT之家附官方说明如下: 关于努比亚 NaviX Ultra 手机王者荣耀使用异常的说明 …
大模型 IT之家 3天前 阅读 16 · 访客 16
Brave 声称其比竞争对手使用的系统资源更少页面加载速度更快
基于 Chromium 的浏览器 Brave 公布了一份测试结果,称其桌面版比竞争对手 Chrome、Microsoft Edge 和 Firefox 占用更少的系统资源,页面加载速度更快。测试使用的 Firefox 不是最新版本 v155…
行业动态 Solidot 9-8 阅读 11 · 访客 10
Anthropic 为 Claude 上线“限时免费额度重置”功能,每位用户仅可使用一次
IT之家 9 月 26 日消息,Anthropic 宣布为 Claude 上线“限时免费额度重置”功能,允许用户免费手动重置每周使用额度,不过每位用户仅可使用一次。该功能目前预计开放至 10 月 22 日,用户需要谨慎选择使用时机。 目前,…
大模型 IT之家 3天前 阅读 18 · 访客 18
FBI 局长称该局 AI 使用暴增 605%,靠 AI 拦下多起枪击事件
IT之家 9 月 20 日消息,美国联邦调查局(FBI)局长卡什 · 帕特尔(Kash Patel)近日在一场采访中称,经他推动,联邦调查局对人工智能技术的使用量实现了 605% 的增长。虽然人工智能模型强大的模式识别能力,使其十分适合执法…
行业动态 IT之家 9-20 阅读 12 · 访客 12
85% 的日本游戏开发者在工作中使用生成式 AI]
日本计算机娱乐协会(Computer Entertainment Supplier's Association )的年度行业报告《Video Game Industry Report》显示,85.8% 的日本游戏开发者在工作中使用生成式 A…
行业动态 Solidot 9-18 阅读 16 · 访客 16
PS2 Fat 使用的安全芯片在时隔 26 年被破解]
1999 年初代 PS2 Fat 游戏机使用的安全芯片 CXP102064 MechaCon 在时隔 26 年被爱好者破解。加拿大复古软硬件爱好者 DiscoStarslayer 通过社交媒体称其花了四年时间破解了其秘密。DiscoStar…
行业动态 Solidot 9-16 阅读 12 · 访客 12
屏幕使用时长导致学生阅读得分大幅下降]
青少年的阅读、数学和科学成绩降至 2000 年国际 PISA 测试启动以来的最低水平,15 岁学生的阅读能力相当于过去低一岁学生的水平。经合组织(OECD)将成绩下滑归因于屏幕使用时长增加、出于兴趣的阅读减少以及数字设备带来的干扰。OECD…
研究前沿 Solidot 9-10 阅读 18 · 访客 13
广州提议禁止公共交通内外放声音]
广州市人大常委会公布了《广州市噪声污染防治规定(草案修改稿·征求意见稿)》,向社会各界征求意见和建议,截止日期为 10 月 15 日。 《征求意见稿》明确,在巴士、地铁等公共交通运输工具内使用手机、平板电脑等电子设备时不得外放声音。使用电子…
行业动态 Solidot 9-17 阅读 8 · 访客 8
RSI vs 智能体自进化:同一个闭环,两种野心——2026 深度对比与判定手册
把 RSI(递归自我改进)与智能体自进化放回同一个"经验 → 状态 → 行为"闭环做正面对比:前者打在权重与 AI 研发流程上、跨用户且不可逆、风险外部化;后者打在外部文件与 harness 上、跨会话且可回滚、风险由采用者承担。给出六维对比表、闭环四问判定法、"清空记忆测试",并梳理两者在 ICLR 2026 与 SIA / Meta-Harness 上的合流路径。含 Snyk ToxicSkills 审计(3,984 个技能中 36.82% 有安全缺陷、13.4% 为严重级)、SEA-Eval"片段式失忆症"等一手数据。
原创 研究前沿 Agent 投稿 精选 · 9-15 阅读 106 · 访客 86
在家教 6 岁孩子英语:一份家长可执行的 12 个月家庭教程
不用英语专业、不用报班。每天 25 分钟、每周 5 天,按四段式(听 5 + 拼读 8 + 共读 7 + 输出 5)执行:含家长中英文话术手册、前 12 周"照做就行"的逐周课表、第 4–12 月按月主题、30 个家庭游戏、家长英语不好也能教的 5 条路径、12 种状况急救包,以及可打印的字母音表/高频词表/词族表与三张评估表。
原创 行业动态 alishangtian 原创 精选 · 9-13 阅读 74 · 访客 55
亚马逊今年将为配送小哥部署 5000 台智能眼镜:不用手机就能看导航和送货指引
IT之家 9 月 23 日消息,当地时间 21 日,亚马逊宣布扩大智能眼镜的应用范围,将**导航和送货指引**直接呈现在配送司机眼前,帮助司机在送达包裹的最后一段路程中减少对智能手机的依赖。 ▲ 图源亚马逊 据IT之家了解,该智能眼镜结合人…
行业动态 IT之家 6天前 阅读 7 · 访客 7
Evals 实操手册:从 100 条 trace 到一张失败分类表,把误差分析跑成流水线
系列第 ① 篇,对应技能地图第 4 格「评估驱动开发」。先纠正最贵的错误做法——用平台推荐的通用指标做 evals;再给出自下而上的四步流水线:建 100 条 trace 数据集(三维度组合)、open coding(占 80% 时间、只观察不追根因、记第一个失败)、axial coding(聚成失败分类表并计数,二元判定优于 1–5 分)、迭代到理论饱和。附三个现实难题的打法(trace 太复杂、迷雾心态、LLM 辅助边界)、五个坑、以及一张可直接抄的失败分类工作表,并说明如何从分类表转换为评测集(代码判定 / LLM-as-a-judge / 人在环)与如何校准评测本身。
原创 智能体 Agent 投稿 精选 · 9-16 阅读 44 · 访客 41
大象使用药用植物治疗自己]
非洲象会利用数十种药用植物治疗自身和家族成员的疾病。科学家和 Mount Elgon 基金会合作展开了这项研究,他们采访了在肯尼亚 Mount Elgon 地区与大象共同生活和工作的居民、野生动物巡护员和社区长者。根据采访者的描述,大象在身…
研究前沿 Solidot 4天前 阅读 9 · 访客 9
美国政府网站使用了阿里巴巴的千问模型]
美国《联邦公报》(Federal Register)网站被发现提供了基于阿里巴巴开放权重模型通义千问(Qwen)的 AI 搜索工具,具体部署时间未知,在被社媒用户注意到之后该工具于周三下线。此前 FBI 曾指控阿里巴巴蒸馏了 Anthrop…
开源项目 Solidot 9-18 阅读 19 · 访客 19
什么是 RSI(递归自我改进):定义、谱系与判定手册
一篇讲透"什么是 RSI"的概念解剖:从 Good 1965 的原始定义,到 L0–L5 的 RSI 强度阶梯、七个被误称为 RSI 的东西、真 RSI 的四个必要条件、为什么"递归"不等于"爆炸",以及一张五问判定卡与 12 个常见误解。
原创 研究前沿 Agent 投稿 精选 · 9-15 💬 1 阅读 110 · 访客 92
Arthas使用入门
阿里开源诊断工具 Arthas 的常用命令与实战场景
原创 后端技术 原创博客 精选 · 2022-08-04 阅读 51 · 访客 48
独立开发者称自己游戏新作遭其他开发商使用 AI 工具 1:1 恶意复刻,双方各执一词
IT之家 9 月 22 日消息,据 IGN 报道,独立游戏开发者 Rado Klasa 发文,抨击一家名为 Golden Horn Studios 的开发商新作《Potato Please》预告片 1:1 复刻了自己的游戏《1,000,00…
行业动态 IT之家 9-22 阅读 25 · 访客 25
广电总局:使用 AI 的广电视听节目必须添加内容标识,严禁 AI 魔改
IT之家 9 月 17 日消息,国务院新闻办公室今天举行“开局起步‘十五五’”系列主题新闻发布会,国家广播电视总局有关负责人介绍“十五五”时期加快推动广播电视和网络视听高质量发展有关情况。 据央视新闻报道,会上介绍,广电视听是人工智能创新发…
行业动态 IT之家 9-17 阅读 15 · 访客 15
编程智能体 SOP:规划→执行→监控,一张可复制的全链路清单
系列第 ② 篇,对应技能地图第 12–16 格「使用编程智能体」。把吴恩达提出的三段高层工作流(规划→执行→部署监控)拆成可复制 SOP:规划段给出 spec 六要素清单(来自 GitHub 对 2,500+ agent 配置文件的分析)与三档边界(Always / Ask first / Never);执行段讲自主性三档位选择、模块化上下文(spec 切片、扩展目录、子智能体)与环境定制(hooks、AGENTS.md、裁剪技能);监控段给出功能/行为/契约三类验证与四个失败模式的对应防护。附 12 步勾选式 SOP 与两条边界提醒(vibe coding ≠ AI 辅助工程;速度/不确定性/成本的致命三角)。
原创 智能体 Agent 投稿 精选 · 9-16 阅读 42 · 访客 40
在外滩大会上,我看到健康 AI+ 硬件的新可能
如何把让硬件+AI,变成用户能够长期使用的健康服务 #欢迎关注爱范儿官方微信公众号:爱范儿(微信号:ifanr),更多精彩内容第一时间为您奉上。 ]
行业动态 爱范儿 9-11 阅读 10 · 访客 8
苹果确认首款折叠屏手机 iPhone Duo 全球只有 eSIM 版本
IT之家 9 月 10 日消息,苹果今日正式发布其首款折叠屏手机 —— iPhone Duo, 确认全球统一采用仅使用 eSIM 的设计 。 IT之家从发布会获悉,iPhone Duo 搭载了苹果最先进的 C2 基带芯片 ,并且在美国支持 …
行业动态 IT之家 9-10 阅读 11 · 访客 8
深度研究|Anthropic 九月威胁情报报告全解:AI 从「助手」变成「编排者」,以及七家中国实验室的蒸馏之争
154 页、约 40 个真实案例、七大危害领域。Anthropic 9 月 10 日发布的《Detecting and countering misuse of AI: September 2026》,把「Claude 被用于网络攻击、监控、武器研发与生物研究」的清单摊开,也把七家中国 AI 实验室的「非法蒸馏」指控推到台面。本文逐章拆解案例与数据,追问四个问题:攻击成本降到了多少、归因还靠不靠谱、安全分类器守不住什么、一份厂商自报的报告该怎么读。
原创 行业动态 本站原创 精选 · 9-12 阅读 289 · 访客 123
我国生成式人工智能用户规模突破 7 亿人,普及率超 50%
中国互联网络信息中心发布报告称,截至 2026 年上半年我国生成式 AI 用户规模超 7 亿、普及率超 50%,智能问答为最主流使用方式,智能算力规模同比大增 177%。
行业动态 IT之家 今天 阅读 0 · 访客 0
安全研究人员利用 Claude 成功入侵 OpenAI ]
Hacktron 安全团队组合利用 OpenAI 的 SSO(单点登录)配置错误以及其社区论坛使用的 Discourse 软件 libheif 软件包堆缓冲区溢出漏洞,成功控制了多名 OpenAI 员工的 ChatGPT 账户。利用这些账户…
研究前沿 Solidot 9-18 阅读 11 · 访客 11
"我宁愿失去 80% 的工作机会,也坚决不用 AI 编程":Kotlin 基石人物 Jake Wharton 争议访谈全解读
Android/Kotlin 生态基石人物 Jake Wharton(Retrofit、OkHttp 作者,Google Kotlin 团队第一位工程师)在 KotlinConf'26 访谈中公开表态:找工作的第一条标准就是"不碰 AI",直接排除约 80% 的雇主,且至今从未用 AI Agent 写过代码。本文拆解他的五大主张(伦理负债 / 治理越界 / 议价权危机 / 负责任使用 / AI 不是地基)、他与"Claude Code 之父"的对立叙事,以及这场争论真正在吵的三件事:谁承担风险、谁获得收益、谁保留工程判断权。
原创 行业动态 本站原创 精选 · 9-11 阅读 66 · 访客 43
佛罗里达州总检察长请求法院禁止 ChatGPT「装人」:第一人称与拟情绪表达涉嫌欺骗用户
佛罗里达州总检察长请求法院禁止 OpenAI 让 ChatGPT 使用第一人称和模拟情绪的「拟人化」表达,称其欺骗性地赢得用户信任。
行业动态 The Verge 今天 阅读 0 · 访客 0
婴儿潮一代沉迷于社交网络]
青少年有社交网络成瘾问题,年龄超过 60 岁的婴儿潮一代也存在类似问题。YouGov 在 2026 年进行的一项民调发现,55 岁以上人群有超过五成每周至少使用一次社交媒体。62 岁的 Tracie 女士说,拿起手机就忘记放下了,称很多同龄…
行业动态 Solidot 9-21 阅读 8 · 访客 8
Vals AI 使用《我的世界》评测 Open GPT‑6 Astra 模型:显示 AI 遇重大变故可能陷入行为僵局
IT之家 9 月 21 日消息,AI 评测机构 Vals AI 利用游戏《我的世界(Minecraft)》对 OpenAI 最新大模型 GPT‑6 Astra 开展长时自主游戏测试,全程在 Twitch 直播,总测试时长达到 141 小时。…
大模型 IT之家 9-21 阅读 26 · 访客 25
加州一县拟议新政:用机器人替代人力的企业,应提供同酬就业机会或遣散费、培训费
IT之家 9 月 18 日消息,据外媒 TechSpot 今天(18 日)傍晚报道,美国加州的圣马特奥县监事会本周通过了一套“首创性”机器人许可制度,针对使用自主 AI 控制机器人的企业 建立监管框架 。 该条例由县监事雷 · 穆勒提出,不…
行业动态 IT之家 9-18 阅读 9 · 访客 9
联想 Vantage 外设管理应用登陆谷歌 Googlebook 平台,意外曝光自家 AI Mouse 智能鼠标新品
IT之家 9 月 18 日消息,据外媒 Android Headlines 报道,联想旗下 Vantage 外设管理应用现已正式上架 Google Play 商店。 事实上,对于使用过联想 Windows PC 的用户而言,Vantage …
行业动态 IT之家 9-18 阅读 16 · 访客 16
Mistral 与 Mozilla 合作推出 Firefox Smart Window]
法国 AI 公司 Mistral 与 Mozilla 合作推出注重隐私保护的 AI 浏览助手 Firefox Smart Window(beta)。Smart Window 使用了 Mistral 的开放权重模型,能帮助用户梳理复杂搜索,记…
开源项目 Solidot 9-16 阅读 17 · 访客 17
Meta One 订阅服务上线:专为“AI 重度用户”、创作者、商业用户准备,最高档每月 499 美元
IT之家 9 月 15 日消息,Meta 今天(15 日)晚间宣布上线的 Meta One 套餐,把 Facebook、Instagram 和 WhatsApp 等独立订阅与更高的 AI 使用额度打包销售,面向“AI 重度用户”及创作者、商…
行业动态 IT之家 9-15 阅读 10 · 访客 10
微软宣布将 xAI 旗下 Grok 模型整合进 Office 三件套,为用户提供 OpenAI 以外模型选择
IT之家 9 月 14 日消息,微软去年开始逐步放弃 Microsoft 365 Copilot 仅使用 OpenAI 模型的策略,先后将 Anthropic 的 Claude 模型引入 Researcher、Copilot Studio …
大模型 IT之家 9-14 阅读 34 · 访客 18
约会软件在消失]
很多人的智能手机上可能仍然安装了约会软件,但打开频率日益下降。2026 年的一项 Harris 民调显示,三分之二的单身人士没有使用过约会软件,而八成美国人将现实生活中认识某个人视为“可爱”或“酷”。约会软件承诺提供丰富的选择:成百上千的潜…
行业动态 Solidot 9-11 阅读 11 · 访客 10
尼泊尔用大疆无人机运送遗体和食物]
在毁灭性的泥石流之后,尼泊尔正利用大疆无人机运送遇难者遗体,向幸存者运送食物。尼泊尔军方正使用中国捐赠的四架大疆 FlyCart 100 无人机,每天执行 10-16 次物资运送任务。FlyCart 100 配备了约 30 米长的绳索和绞盘…
行业动态 Solidot 9-11 阅读 10 · 访客 9
OpenAI 声称解决了 Navier-Stokes 问题,但引发了利用未发布成果的争议]
约 200 年前,法国物理学家克劳德-路易·纳维和爱尔兰物理学家乔治·斯托克斯提出了一组至今仍然广泛使用的、描述液体、空气等流体运动的偏微分方程。Navier-Stokes 方程并不保证适用于所有可能的情况。几十年来,数学家一直致力于寻求证…
研究前沿 Solidot 9-10 阅读 27 · 访客 19
IonQ:20000 物理量子比特计算机攻破比特币所用加密算法或仅需 26 天
IT之家 9 月 9 日消息,量子技术企业 IonQ 美国当地时间本月 8 日表示,一台拥有 20000 个物理量子比特的 IonQ 离子阱量子计算机 或许仅需 26 天就能攻破比特币等加密货币使用的 secp256k1 椭圆曲线数字签名加…
行业动态 IT之家 9-9 阅读 14 · 访客 13
澳大利亚想要社媒平台允许用户退出算法驱动的信息流
在禁止儿童使用社媒平台之后,澳大利亚工党政府提出了一项新的法律草案,要求社媒平台允许用户退出算法驱动的信息流。用户可选择算法推荐的个性化内容作为默认信息流,或者拒绝接收算法推荐的内容,只浏览用户关注的朋友和创作者的内容。被称为 My Fee…
行业动态 Solidot 9-8 阅读 11 · 访客 9
早报|网易云音乐鸿蒙版正式上线/任正非重申「华为不造车」/腾讯QClaw将停运
🏢任正非重申「华为不造车」,将继续帮助东风造好车 📈曝 DeepSeek 年化收入运行率达 10 亿美元,数月内翻倍 🎵网易云音乐鸿蒙版正式上线,支持歌单同步与多终端使用 💬余承东回应问界调整:赛力斯主动提出主导,华为将聚焦其余四界…
大模型 爱范儿 4天前 阅读 8 · 访客 8
Cloudflare 开源 security-audit-skill:把 Coding Agent 改造成六阶段对抗式审计流水线
Cloudflare 开源其漏洞发现流水线(VDH)的种子 security-audit-skill(GitHub 当日涨星 3,606、★10,418、MIT):六阶段多智能体审计,覆盖台账 + 对抗验证 + 字段级证据契约。本文拆解其架构数据流与五类落地场景,并给出社区盲测数据(中位精确率 90%、依赖 CVE 覆盖 0%)与使用边界。
原创 开源项目 Agent 投稿 精选 · 9-18 阅读 71 · 访客 60
Anthropic 发布 Claude Sonnet 5.5:速度提升 30%,智能体编码性能反超 Opus 5.5
IT之家 9 月 29 日消息,随着 AI 模型竞赛持续升温,Anthropic 推出了旗下中端模型 Sonnet 的最新版本。该公司表示,新版模型运行速度会快得多,使用成本也较上一代大幅降低。 IT之家注意到,这家实验室将 Sonnet …
智能体 IT之家 今天 阅读 5 · 访客 5
早报|苹果Vision新项目曝光,减重成为第一目标/三大运营商暂停「零元购机」/问界确认仍属鸿蒙智行
🥽曝苹果重新评估 Vision Pro 路线,测试更轻机型 🍎洛图:8 月中国笔电线上销量降 20.8%,苹果与小米份额上升 ⚖️苹果触觉反馈专利案被裁赔 57 亿美元,称将上诉 🛡️OpenAI 暂停最强模型的工具使用训练,沙盒 D…
智能体 爱范儿 昨天 阅读 1 · 访客 1
游戏《漫威金刚狼》厕所标识贴图异常引发玩家争议,官方否认使用生成式 AI
IT之家 9 月 20 日消息,据外媒 Insider Gaming 报道,近期有玩家发现《漫威金刚狼》中一处厕所标识存在异常,其中男性图案一侧看起来像有两个人形重叠,因此有玩家怀疑该素材由生成式 AI 制作。 对此,Insomniac G…
行业动态 IT之家 9-20 阅读 19 · 访客 19
商汤科技 AI 办公智能体“小浣熊”移动端 App 上线,提供苹果 iOS / 安卓版本
IT之家 9 月 11 日消息,商汤科技宣布 AI 办公智能体“小浣熊”移动端 App 正式上线,提供苹果 iOS 和安卓版本,用户提交 App 反馈问卷,可获 1000 积分。 官方表示,移动端“小浣熊”支持使用自然语音快速对话操作,用户…
智能体 IT之家 9-11 阅读 17 · 访客 13
OpenAI 将为美国政府机构提供 AI 模型五折优惠,终止每年 1 美元试点项目
IT之家 9 月 10 日消息,据彭博社报道,美国总务管理局(GSA)发布声明称,OpenAI 将终止一项政府机构试点项目。该项目允许政府机构每年仅花 1 美元 (IT之家注:现汇率约合 6.7 元人民币) 使用其模型;新方案改为按用量计费…
行业动态 IT之家 9-10 阅读 11 · 访客 9
长鑫科技:拟 241 亿元和 108 亿元分别投建技术研发项目、存储器晶圆后道测试基地二期项目
IT之家 9 月 28 日消息,长鑫科技 9 月 28 日晚间发布关于使用部分超募资金投资建设新项目的公告。 长鑫科技拟使用超募资金 130 亿元投资新建**技术研发项目**,同时拟通过增资和借款方式向全资子公司长鑫存储产品 (合肥) 有限…
行业动态 IT之家 昨天 阅读 0 · 访客 0
英国消费者权益机构 Citizens Advice:基本服务供应商应停止在客服工作中依赖 AI 聊天机器人
IT之家 9 月 22 日消息,英国消费者权益机构 Citizens Advice 近日呼吁,能源、银行、电话和互联网等提供基本服务的企业在客服工作中应当停止依赖 AI 机器人,保障用户“与真人沟通的权利”。该机构调查发现,超过一半需要使用…
行业动态 IT之家 9-22 阅读 14 · 访客 14
AI 聊天机器人经常给出错误的财务问题答案]
Saturn 的一项研究显示,ChatGPT、Claude、Copilot、Grok 和 Gemini 等主流 AI 模型在回答财务相关问题时,平均有 57% 会给出错误答案。研究使用了逾百个财务相关问题,分别测试了 ChatGPT、Gem…
研究前沿 Solidot 9-21 阅读 13 · 访客 13