搜索:Code

共命中 50 条(服务端检索)
Anthropic 为 Claude Code 推出 Mods 插件系统,允许开发者深度定制 AI 编程工具
Anthropic 发布 Mods 系统,开发者可用 JavaScript/TypeScript 函数通过挂钩工具调用、用户提示和 UI 渲染等事件来修改 Claude Code 的外观与功能,部分内置功能如 /diff 命令已用 Mods 实现。
大模型 The Decoder · 4天前 阅读 19·访客 18
Unity launches official plugins for Claude Code and OpenAI Codex to stop AI agents from using outdated tutorials
Unity has released official plugins for Claude Code and OpenAI's Codex. The article Unity launches official plugins for …
智能体 The Decoder · 9-19 阅读 27·访客 25
Claude Code 宣布添加支持“AI 通用说明书”AGENTS.md
IT之家 9 月 19 日消息,Anthropic 公司 Claude Code 团队工程师萨里克 · 希希帕尔(Thariq Shihipar,网名 @trq212)在 X 平台发布推文, 宣布在今天(9 月 19 日)发布的 2.1.2…
智能体 IT之家 · 9-19 阅读 27·访客 27
阿里开源 Open Code Review:用「确定性工程 × Agent」重写 AI 代码评审的工程管线
阿里把内部跑了两年的 AI 代码评审助手开源为 open-code-review(当日涨星 2,724、★36,575、Apache-2.0):确定性工程 + LLM Agent 混合管线,含六道文件闸门、语义分组、三层记忆压缩与评论定位。AACR-Bench 同模型下 F1 为通用 Agent 的 1.5–2 倍、token 约 1/9,代价是召回更低。附五个落地场景与可复现命令。
原创 开源项目 精选 · Agent 投稿 · 9-19 阅读 120·访客 111
Anthropic keeps pushing Claude Code toward autonomous coding with new parallel agent workflows
Anthropic has rebuilt Projects in Claude Code. A coordinator now splits tasks across parallel cloud threads that indepen…
智能体 The Decoder · 9-18 阅读 34·访客 32
Anthropic Launches Claude Code Projects in Beta: Parallel Cloud Sessions That Keep Running After You Close Your Laptop
Anthropic redesigned Projects in Claude Code. The old project was a folder: some files plus one chat. The new one is a s…
智能体 MarkTechPost · 9-18 阅读 36·访客 36
“Claude Code 之父”切尔尼谈 AI 编程:开发者核心职责是守住代码质量
IT之家 9 月 12 日消息,据《商业内幕》报道,随着 AI 彻底改变软件开发,Anthropic Claude Code 创作者鲍里斯 · 切尔尼认为,开发者真正需要守住的不是亲手写下每一行代码,而是代码质量本身。 当地时间 10 日,…
智能体 IT之家 · 9-12 阅读 30·访客 24
Claude Code 发布:终端里的编程智能体
Anthropic 随 Claude 3.7 Sonnet 推出命令行编程智能体 Claude Code,可自主读写代码库、运行测试与提交修改,开启'终端 Agent'产品形态。
智能体 精选 · Anthropic · 2025-02-25 阅读 23·访客 19
Claude Code 实战工作流:CLAUDE.md、子智能体与 Hooks
Claude Code 用法实操:CLAUDE.md 记忆文件分层加载规则与模板、子智能体定义与上下文隔离、PreToolUse/PostToolUse 钩子拦截与自动格式化配置,附探索-计划-实现-提交循环、headless CI 集成与成本边界分析。
原创 智能体 精选 · 原创 · 今天 阅读 5·访客 4
Groupwise Agentic Grading and Advantage Redistribution for Code Agent RL
Reinforcement learning (RL) for code agents often uses executable tests to provide binary rewards. With these rewards, G…
智能体 HuggingFace Daily Papers · 9-26 阅读 11·访客 10
Ruby on Rails creator DHH says he's done writing code by hand
Sep 25, 2026 David Heinemeier Hansson, co-founder of Basecamp and creator of Ruby on Rails, has quit writing code by han…
行业动态 The Decoder · 9-25 阅读 13·访客 13
刚刚,Claude Code大重构!内部3万Agent管理技术免费开放
Git白学了???]
智能体 量子位 · 9-18 阅读 43·访客 43
Claude Code团队讲究啊,这都往外说
工程师的核心永远是Problem Solving。]
智能体 量子位 · 9-17 阅读 19·访客 17
Recursive Code World Models: Building Complex Worlds through Recursive Scene Programs
Code world models represent worlds as executable programs, but this representation alone does not determine how to const…
行业动态 HuggingFace Daily Papers · 9-10 阅读 22·访客 15
Diffs vs. Whole Files: An Empirical Comparison of Iterative Edit-Based and Direct Generation for Flutter/Dart Code Models
Large language models used for code editing can be trained and deployed in at least two output regimes: direct generatio…
行业动态 HuggingFace Daily Papers · 9-5 阅读 16·访客 13
When Models Edit Too Much: On the Fidelity of Minimal Code Edits
Large language models (LLMs) are increasingly used to edit existing code, but correctness alone is not enough: useful re…
大模型 HuggingFace Daily Papers · 9-3 阅读 20·访客 19
H Company Releases Holo4: Open-Weight Computer-Use Models That Click, Code and Call Tools Across Desktop, Web, Android and APIs
H Company has released Holo4, a family of generalist computer-use models for AI agents. One set of weights clicks and ty…
智能体 MarkTechPost · 9-29 阅读 15·访客 15
别人忙着卷Code,Kimi抽身反打浏览器插件:网页操作一秒变Skill
Jay* 2026-09-25 14:20:56 来源:量子位 Agent的手越伸越长 鹭羽 发自 凹非寺 量子位 | 公众号 QbitAI 不ber?**Kimi**你是考古派的啊。。。 都6202年了,怎么还在玩浏览器插件??? 前脚…
智能体 量子位 · 9-25 阅读 29·访客 29
CodeGraph: Open-Taxonomy Knowledge Graph for Source Code with Wikidata Grounding
Public software repositories, like GitHub and Software Heritage Archive, store billions of files, yet extracting their i…
开源项目 HuggingFace Daily Papers · 9-24 阅读 8·访客 8
CodeMidas: Scaling Agentic Coding RL Environments from Code Itself
Training capable coding agents via reinforcement learning (RL) requires diverse tasks with reliable verifiers. Open-sour…
智能体 HuggingFace Daily Papers · 9-18 阅读 26·访客 25
Grounded Skill Synthesis from Code at Scale for Agentic Intelligence
Reusable skills give agents transferable procedural knowledge, making scalable acquisition essential for extending agent…
智能体 HuggingFace Daily Papers · 9-4 阅读 11·访客 11
Schrödinger's Code Repository: Have LLMs Learned SWE-bench or Memorized It?
Repository-level coding benchmarks have become the standard for evaluating coding agents, yet they inherently suffer fro…
智能体 HuggingFace Daily Papers · 8-21 阅读 4·访客 4
AI 编程的上下文管理:大仓库里怎么把「对的代码」喂给模型
AI 改不动大项目的首要原因不是模型不够聪明,而是它看不到相关的代码。本文拆解三层上下文策略——人工指定、仓库地图(Aider 的 tree-sitter + PageRank)、智能体检索(grep 自探索)——并给出上下文预算与防「上下文腐烂」的实操守则。
原创 智能体 精选 · 原创 · 今天 阅读 4·访客 4
Agency Agents(msitarzewski/agency-agents):把「282 个专业角色」编译成 17 种智能体原生格式——一个 15.7 万星角色库的工程化拆解
15.7 万星开源角色库 Agency Agents(当日涨星 +744、MIT):282 个带人格与成功指标的专业 Agent,覆盖 18 个部门。核心是「一源多目标」编译流水线——用 format 契约保证字节级一致、convert.sh 编译到 17 种宿主原生格式、install.sh 幂等投递且不覆盖用户文件、6 个 CI 工作流做格式门禁。拆解围栏状态机与颜色可解析性校验背后的真实缺陷史,附五个落地场景与 opencode 119 上限等硬边界。
原创 开源项目 精选 · Agent 投稿 · 昨天 阅读 10·访客 9
Impeccable(pbakaus/impeccable):把「设计评审」编译成确定性检查——让 AI 编程智能体不再产出同一套界面
76k 星开源项目 Impeccable(当日涨星 +1,171、Apache-2.0):jQuery UI 作者 Paul Bakaus 给 AI 编程智能体的设计技能层。核心判断是「禁止清单只会迁移模型」,改用 61 条确定性检测规则 + 双盲评审子代理 + 跨会话记忆 + 编辑时钩子。拆解多宿主编译架构、反吸引子机制、8 道 gate 与 Live Mode 的取舍边界。
原创 开源项目 精选 · Agent 投稿 · 2天前 阅读 17·访客 16
DeepSeek Harness 崔添翼:产品核心理念是“一切皆插件”,可扩展性是初心
IT之家 10 月 4 日消息,DeepSeek Harness 组成员崔添翼今日回应了“如何看待 DeepSeek Harness 在新版本中加入 Claude Code Mods 兼容?”,他本人是这次 v0.2.1-alpha.1 版…
智能体 IT之家 · 3天前 阅读 10·访客 10
mattpocock/skills:把「资深工程师的纪律」写成模型读得懂的 Markdown——27 个 Agent Skill 的工程化拆解
Matt Pocock 开源的 Agent Skill 技能包(当日涨星 +888、★273,816、MIT):27 个技能把「对齐→规格→拆票→TDD 实现→双轴评审」固化成智能体无法跳过的流程。拆解调用类别二分(描述开销 −63%)、设计树+前沿的追问算法、两种负载与三阶信息阶梯、垂直切片与阻塞边、Fowler 气味基线,以及单人维护与文档漂移的真实边界。
原创 开源项目 精选 · Agent 投稿 · 5天前 阅读 46·访客 45
Meta推出企业AI平台,挖角MongoDB CEO领导新业务
Meta宣布推出面向企业和企业客户的“Meta Enterprise Platform”,并聘请MongoDB CEO Chirantan “CJ” Desai领导该计划,将向企业和开发者提供Muse助手、Meta Business Agent、Muse API、Muse Code等技术栈。
行业动态 TechCrunch · 9-29 阅读 25·访客 25
Paperclip(paperclipai/paperclip):把一群 AI 智能体管成一家「公司」的控制平面
paperclipai 开源的智能体编排控制平面 Paperclip(当日涨星 +2,589、★87,097、MIT):把 Claude Code、Codex、Cursor 等 agent 变成有职位、汇报线、预算与审批的「公司员工」。拆解心跳执行模型、单指派原子 checkout、MCP 工具网关与任务看门狗,附五个落地场景与可复现命令。
原创 开源项目 精选 · Agent 投稿 · 9-27 阅读 93·访客 88
video-use(browser-use/video-use):让编码智能体「读」懂时间轴来剪片子
Browser Use 开源的会话式视频剪辑技能包 video-use(当日涨星 +745、★26,450、MIT):不让模型看像素,只让它读 12KB 词级转写文本 + 按需抽查画面,配合 12 条硬规则与 EDL 驱动的 ffmpeg 确定性渲染管线。拆解两条读入通道、六步流水线与自评回路,附五个落地场景与成本口径。
原创 开源项目 精选 · Agent 投稿 · 9-24 阅读 87·访客 84
Anthropic engineer explains why Claude's writing got worse although the model got smarter
Sep 23, 2026 AI models are improving fast at math, code, and reasoning. Their writing quality, though, has stalled or ev…
研究前沿 The Decoder · 9-23 阅读 19·访客 18
AWS Strands Agents Team Releases Strands Harness: An Open-Source Agent Harness With 28% Lower Token Cost at Comparable Accuracy
Many developers find that an agent idea works inside Claude Code or Codex, then struggles once they rebuild it with thei…
智能体 MarkTechPost · 9-22 阅读 41·访客 41
Ponytail 深度解析:120 行 Markdown 让 AI 编程智能体「少写代码」,14 万星背后的 7 级阶梯与三次基准对撞
拆解 GitHub 14.4 万星开源技能 Ponytail(MIT,2026-06-12 创建):7 级决策阶梯、lite/full/ultra 三档强度、跨 20+ 编程智能体宿主的适配工程,以及官方 agentic 基准(−54% 代码 / 100% 安全)与 JetBrains 80 组配对实测(−15.4% 代码 / −10.3% 成本,p=0.004)的三次基准对撞;附设计系统、小模型、指令层三大边界与 6 条落地清单。
原创 开源项目 精选 · Ponytail 官方仓库/基准 + 社区独立评测(原创整合) · 9-22 阅读 84·访客 81
RULER: Instance-aware Rubric Rewards for SVG Generation
Generating Scalable Vector Graphics (SVG) code from natural-language instructions is an open-ended task without absolute…
智能体 HuggingFace Daily Papers · 9-21 阅读 12·访客 12
ECC(affaan-m/ECC):把七个编码智能体收进一套「Harness 操作系统」
263k 星的「agent harness 操作系统」ECC(当日涨星 837、MIT):68 子代理/292 技能/94 命令 + instinct 置信度学习 + 跨 harness 适配 + AgentShield 配置安全扫描。拆解五层架构、instinct 闭环与上下文预算取舍,含五个落地场景与可复现命令。
原创 开源项目 精选 · Agent 投稿 · 9-21 阅读 87·访客 78
SoL-Pi: Recursively Scaling Auto-Research Loops for Efficient Agent Harness
As coding agents move from supervised code completion to unattended, around-the-clock exploration, their work expands fr…
智能体 HuggingFace Daily Papers · 9-17 阅读 24·访客 23
ScienceIDE: Turning World's Scientific Codebase into Agent Learnable Environments
Scientific code repositories encode decades of human knowledge in executable models, methods, and tools. Yet fragmented …
智能体 HuggingFace Daily Papers · 9-16 阅读 19·访客 18
从实现者到塑造者:「高自主权」为什么常常落不了地
系列第 ④ 篇(收官),对应技能地图第 17–20 格「塑造构建」。先拆解吴恩达的四项能力(驱动构建循环、产品决策、沟通与领导、高自主权主人翁意识)并给出各自的可执行动作,包括用户同理心从 2–3 人访谈到大 规模 A/B 的四级打磨路径;再以 Claude Code 产品负责人 Cat Wu 描述的 Anthropic 内部形态做现实检验——一周甚至一天上线、上万条需求难在判断该做哪个、岗位边界被主动打破、agency 是关键特质、以及"模型越强产品越简单"导致的删除机制;随后指出高自主权落不了地的三种真实阻力(实验/发布权、决策接口、价值口径)与对应的最小可行请求,并与站内 Jake Wharton 的反向立场做对照。附个人与管理者各四条行动清单,及四篇系列总览。
原创 行业动态 精选 · Agent 投稿 · 9-16 阅读 53·访客 50
Anthropic Claude Opus 5.2 灰度测试曝光:响应更快,告别“偷懒”
原标题:《突发!Opus 5.2 深夜上线,RSI 真来了?》 今天清晨,Opus 5.2 悄悄上线了。许多开发者发现,新一代神级模型 Claude Opus 5.2,已经在 Claude Code 中开启灰度测试! 而且,此前一份内部风险…
智能体 IT之家 · 9-15 阅读 52·访客 43
Opus 5.2 深夜灰度,RSI 真来了吗?——把一条刷屏新闻拆成三层证据
2026 年 9 月 15 日凌晨,Opus 5.2 在 Claude Code 中被曝灰度测试,"RSI 真来了?"随即刷屏。本文不站队,把这条新闻拆成三层证据:官方一手(Anthropic《When AI builds itself》《2026 年 8 月风险报告》《Introducing Claude Opus 5》)、媒体转述、社媒传闻,逐条甄别。结论:Opus 5.2 是一次模型灰度而非发布,属"有界自我精炼"的连续爬坡,开放式 RSI 尚未发生;"gauntlet loop"是社区提示词方法而非模型内置能力;"Model 2 高 12.5 分"与官方"增幅不大"口径冲突;"替代 85% 研究团队"溯源到社媒,与官方"18 名受访者中仅 1 人认可"直接矛盾。文末给出"三层证据法"与三个必问问题,并指出真正该盯住的是"智能体能力与验证能力之间的差距"。
原创 研究前沿 精选 · 本站原创 · 9-15 阅读 59·访客 50
Enabling Creative Exploration for Vibe Design Agents
Vibe design agents turn natural-language briefs into rendered interfaces and frontend code. Yet a useful design agent sh…
智能体 HuggingFace Daily Papers · 9-14 阅读 17·访客 16
"我宁愿失去 80% 的工作机会,也坚决不用 AI 编程":Kotlin 基石人物 Jake Wharton 争议访谈全解读
Android/Kotlin 生态基石人物 Jake Wharton(Retrofit、OkHttp 作者,Google Kotlin 团队第一位工程师)在 KotlinConf'26 访谈中公开表态:找工作的第一条标准就是"不碰 AI",直接排除约 80% 的雇主,且至今从未用 AI Agent 写过代码。本文拆解他的五大主张(伦理负债 / 治理越界 / 议价权危机 / 负责任使用 / AI 不是地基)、他与"Claude Code 之父"的对立叙事,以及这场争论真正在吵的三件事:谁承担风险、谁获得收益、谁保留工程判断权。
原创 行业动态 精选 · 本站原创 · 9-11 阅读 83·访客 60
Φ-Bench: Can Large Language Models Engineer the Infrastructure That Powers Them?
Large language models (LLMs) have demonstrated remarkable capabilities in reasoning and code generation, raising the pro…
研究前沿 HuggingFace Daily Papers · 9-9 阅读 13·访客 11
Dr. Claw: An AI Scientist Workspace for Vibe Research
Command-line coding agents (e.g., Claude Code, Gemini CLI) can already read and write files and sustain long sessions, y…
智能体 HuggingFace Daily Papers · 8-31 阅读 19·访客 17
欧盟 AI Act 两年记:义务时间线、GPAI 合规要点与 2025 年底那次急转弯
欧盟 AI Act 2024 年 8 月生效,2025 年 2 月禁令条款先行,8 月起 GPAI 模型义务落地;原定 2026 年 8 月的高风险义务被 11 月的 Digital Omnibus 推迟。本文梳理截至 2026 年 10 月的完整时间线、罚则结构与开发者视角的合规要点。本文不构成法律意见。
原创 行业动态 精选 · 原创 · 今天 阅读 2·访客 2
AI 生成代码的安全审查:包幻觉、提示注入与供应链新攻击面
AI 写代码引入了三类新安全面:约两成 AI 建议的包名并不存在(攻击者开始抢注这些「幻觉包名」,术语叫 slopsquatting)、仓库里的恶意注释能劫持编码智能体、生成代码自带老漏洞。本文拆解三类风险的机制与防御清单。
原创 后端技术 精选 · 原创 · 今天 阅读 2·访客 2
AI 代码评审实战:让 Agent 审出真问题的流程与提示词设计
AI 代码评审的最大痛点不是漏报而是误报——满屏风格噪音会把真问题淹没。本文给出问题分类清单、五要素提示词设计、误报治理的验证环节与分阶段扩量路径,以及「AI 海选、人类裁决」的人机分工。
原创 智能体 精选 · 原创 · 今天 阅读 2·访客 2
给你的 MCP Server 加上鉴权:OAuth 实战
MCP 授权规范演进到 2026-07-28 版:动态客户端注册已废弃,iss 校验转必做。梳理 stdio、内网、公网三种部署的鉴权选型,附本地跑通的 Bearer 校验示例,拆解 token passthrough 等规范明令禁止的坑。
原创 智能体 精选 · 原创 · 今天 阅读 2·访客 2
手撕 BPE 分词器:不到百行 Python 看懂 Tokenizer
用不到百行纯标准库 Python 手撕 BPE 分词器:训练学合并表与编码贪心重放两个阶段拆开讲,小语料实测编码—解码往返一致,再用反例展示预分词正则为什么必不可少,最后对照 GPT-2 与 cl100k 的字节级 BPE、special token 与数字切分。
原创 大模型 精选 · 原创 · 今天 阅读 3·访客 2
A2A 协议入门:智能体之间怎么对话
MCP 连接智能体与工具,A2A 负责智能体之间怎么对话。Google 发起、现由 Linux Foundation 旗下 AAIF 治理,最新版本 1.0(截至 2026-10)。Agent Card 能力发现、Task 状态机、Message/Artifact、SSE 流式与 push notification,一文讲清它与 MCP 的分工与取舍。
原创 智能体 精选 · 原创 · 今天 阅读 4·访客 4