Glean 拾遗
最近收录

7 条 · 按时间

08-31

Claude 5 上下文工程新规:规则让位判断,示例让位接口设计

Anthropic 工程师 Thariq Shihipar 从 Claude Code 的迭代中总结:旧一代模型的上下文工程经验对 Claude 5 代模型已成误区。系统提示不再堆硬规则,而是让模型凭判断行事,例如删掉“禁止多行注释”的禁令,改为“匹配周边代码风格”;工具使用不靠示例,而是设计更富表达力的参数;上下文改为 progressive disclosure,验证与代码审查拆成可按需调用的 skill,工具用 ToolSearch 延后加载定义。CLAUDE.md 应轻量,只写仓库特有的 gotchas,复杂实践放 skill 里;spec 也可用 HTML mockup、测试套件、代码片段或 rubric 等富引用替代简单 markdown。文章还介绍 claude doctor 命令,可自动简化上下文。适合用 Claude Code 维护上下文或自建 agent harness 的工程读者,但全文没有基准数据。

claude.com · 7 min · Agent Engineering · Agent Skills · Claude Code
08-27

可验证的架构图生成 Agent Skill,把代码库变成交互式系统地图

Archify 是一个面向 AI 编码代理(Agent)的图表生成技能:把一段系统描述或一个 GitHub 仓库变成可交互的架构、工作流、时序、数据流和生命周期图。它用带 schema 的类型化 JSON IR 作为事实来源,先校验后交付,失败时返回机器可读的修复码,并支持 Before/Delta/After 架构对比,适合在 PR 审查时使用。最终产物是自包含的单文件 HTML,可导出 PNG、SVG、WebM 与 1200×630 分享卡。适合需要为代码库快速生成可信可视化的工程师、技术文档作者和 AI 工具链使用者。

github.com · 15 min · Agent Skills · AI Engineering · CLI
08-24

AIEWF 2026 侧记:从自主狂热到在环工程,智能体开始上岗

2026 年 AI Engineer World’s Fair 上,三个议题主导了讨论:harness 工程、编码代理与 agent skills。Lilian Weng 的旧文谈 agent 的 planning、memory、tool use,新文则转向围绕模型的 harness;AutoGPT 式全自主幻梦已被外环(outer loop)模式取代——OpenClaw 作者 Steinberger 宣称代理跑内环,人来定方向。Vercel、Warp、Cursor 把部署形态推向长期运行的软件工厂,前向部署工程师(FDE)负责把代理接入企业并保证严格 ROI。Google DeepMind 的 Schmid 提出 agents are just files,用 Markdown 技能扩展能力;Matt Pocock 则提醒 skills hell:技能要少而小,结构重于数量。文章也保留怀疑态度:Horthy 说 hype outruns discipline,Huntley 担心一年后“工厂失败、环路失败”成为新口头禅。适合关注代理工程、编码工具和企业 AI 落地的工程师快速建立 2026 年行业坐标。

www.latent.space · 19 min · Agent Engineering · Agent Skills · Coding Agents
08-20

为 AI 代理而生的可共享浏览器:并行自动化、共享你的登录态

ego lite 是一款为 AI 代理设计的 macOS 浏览器,核心是让代理与你共享同一个浏览器环境,却不互相打扰。代理在各自的独立 Space 里并行执行浏览器自动化任务,你的标签页和鼠标操作保持不变。与 Browser-use、agent-browser 这类纯自动化框架不同,ego lite 自带完整浏览器并支持一键继承 Chrome 的登录态、Cookie、扩展和书签;它通过 `ego-browser` 技能把浏览器能力封装成 JavaScript 工具集,代理以写代码而非敲命令的方式多步驱动页面,官方称复杂任务比 CLI 方案最多快 2.5 倍并以更低 token 消耗完成。适合正在使用 Claude Code、Codex 等 agent CLI,希望让代理安全上网、复用登录态的一线工程师。

github.com · 10 min · Agent Skills · AI Agents · Browser Automation
08-20

为 AI 编程助手的编辑级图表设计系统

Diagram Design 是一套面向 AI 编程助手(Claude Code、Codex、Pi 等)的图表设计技能,内置 38 种编辑级图表类型,以自包含 HTML+SVG 输出零依赖的静态图表。它把一套严格的设计系统——单一强调色、无阴影、4px 网格、三种静态变体——固化进提示与模板,解决 AI 生成图表千篇一律、视觉廉价的问题。你只需给出网址即可在 60 秒内完成品牌匹配;导入 draw.io / Mermaid 文件时可调整格式、尺寸、细节与受众,并在转换后给出取舍账本。适合希望 AI 画图后无需手工返工的工程师、技术作者与产品团队。

github.com · 40 min · Agent Skills · Claude Code · Data Visualization
07-10

Claude Code 技能实战:Anthropic 内部数百条技能的经验与分类

Anthropic 工程师基于内部使用数百条 Claude Code 技能的经验,系统总结了技能的九大类型(库/API 参考、产品验证、数据获取、业务流程、代码模板、代码质量、CI/CD、Runbook、基础设施运维),并给出了具体编写技巧:聚焦非显而易见的提示、构建 Gotchas 部分、利用文件系统渐进式披露、避免过度约束、合理设计配置、用 description 字段触发选择、在技能内存入数据(如日志文件或 SQLite)、以及用脚本/库减少模型 token 消耗。文章还讨论了技能的分发方式(仓库内嵌 vs 插件市场)、依赖组合与埋点测量。适合正在构建 Agent 工作流的工程师参考。

x.com · 15 min · Agent Engineering · Agent Skills · Anthropic
06-30

每日必用的5个Agent技能:编码你的开发流程

资深工程师 Matt Pocock 分享了他在日常开发中频繁使用的5个 Agent 技能(Skills),旨在将人类的开发流程编码成严格可复用的指令,解决 LLM 无记忆、易跑偏的核心缺陷。文章围绕一套技能套件展开:grill-me 通过穷举式提问确保与模型达成共识后再动手;to-prd 将讨论转化为产品需求文档;to-issues 将 PRD 拆解为可独立执行的垂直切片任务;tdd 强制模型遵循红-绿-重构循环,显著提升输出代码质量;improve-codebase-architecture 则定期审视代码库结构,识别“浅模块”并给出深化建议。作者强调技能不必冗长,选对措辞和时机即可带来质变。适合使用 Claude Code 等 Agent 化工具的开发者阅读,尤其是正在为 Agent 输出质量不稳定的团队。

www.aihero.dev · 8 min · Agent Skills · Claude Code · Process Encoding