Glean 拾遗
最近收录

3 条 · 按时间

06-18

面向 AI Agent 的结构化网络安全技能知识库

这是一个专为 AI 编程与安全助手设计的结构化网络安全技能库,并不是传统的脚本合集或渗透测试工具包。项目包含 754 个可执行的安全技能,覆盖 26 个安全领域,每项技能都用 YAML 前置元数据和分步骤的 Markdown 工作流编码了资深分析师的决策逻辑。核心价值在于把从业者的隐性知识转化为 AI 能直接发现、加载和执行的标准化指令,让通用大模型在网络安全调查中具备专家级操作能力。所有技能都映射到了 MITRE ATT&CK、NIST CSF 2.0 等五大威胁与治理框架,适合希望将 AI 智能体引入安全运维、事件响应和威胁狩猎等一线工作的工程师和研究员。

github.com · 28 min · AI Agents · Claude Code · Cybersecurity
06-14

从桌面到云端:为 AI Agent 构建基础设施时我们学到的两课

本文为 CREAO 团队分享的一线实践经验,聚焦于将 Agent 从个人桌面迁移至云端多租户沙箱时所必须面对的核心架构差异。文章核心论点有二:其一是必须将变化速率不同的组件(用户环境与平台运行时代码)解耦,通过快照冻结用户环境,并设计了一个约 300 毫秒的原子热插拔流程来更新运行时代码,从而在不破坏用户状态的前提下实现平台高频部署;其二是严格将凭证隔离在执行边界之外,采用网络层 IP 白名单与每次运行签发的短生命周期 JWT 双重校验,通过一个运行在沙箱外的主机侧 API 桥接器注入密钥,确保即使沙箱内代码被完全攻破,攻击者也无法获取长期凭证。文章提供了具体的命令、校验序列和实施细节,适合正在将 Agent 产品化的后端与基础设施工程师阅读。

x.com · 10 min · Agents · AI Engineering · Infra
06-13

Anthropic 发布 Mythos 级模型 Claude Fable 5:能力最强,但带着更多安全限制

Anthropic 发布了一款能力超越所有前代公开模型的 Claude Fable 5,并将其定级为“Mythos 级”。Fable 5 在几乎所有基准测试中表现领先,尤其在长周期、复杂任务上优势明显,覆盖软件工程、知识工作、视觉、科研等领域。为应对 Mythos 级模型在网络安全和生物学领域的严重滥用风险,Anthropic 内置了保守的安全分类器,会将敏感请求(如网络攻击相关)转交给 Opus 4.8,触发率约 5%。同时,他们为特定用户群发布了解除限制的 Claude Mythos 5,用于网络防御和生物医学研究,并推出了新的 30 天业务数据留存政策。文章展示了 Stripe 在 5000 万行 Ruby 代码库中一天完成两个月工作的案例、Slay the Spire 和 Pokémon 测试中的自主性能提升,以及蛋白质设计和分子生物学假设生成方面的突破。定价为每百万输入 token 10 美元,输出 50 美元。适合关注前沿 AI 能力、安全实践和工程应用的开发者与研究人员。

www.anthropic.com · 26 min · AI Engineering · AI Industry · Anthropic