Harden.run 发布研究结果:用 SLM 与 IRM 提升 Coding Agent 安全性,基准表现超过 GPT5.5-xhigh
Harden.run 发布研究结果:用 SLM 与 IRM 提升 Coding Agent 安全性,基准表现超过 GPT5.5-xhigh
研究概况
Harden.run 公布了一项关于 Coding Agent 安全性的研究。文章提到,这类代理可以生成任意代码,安全防护难度比常见的红队测试更高,处理方式也更复杂。
团队给出的方案包括几部分:对一个网络安全小型 LLM 进行后训练,调整模型的推理方式,再配合程序分析技术补强控制能力,其中提到了 inline reference monitoring(IRM)。
核心结论
按照文中的说法,这套方法在一些难度较高的基准测试上,表现超过了 GPT5.5-xhigh。提到的测试集包括 LinuxArena 和 SleightBench。
从表述来看,重点不只放在模型本身,也放在外部控制与程序分析配合后的整体安全能力上。对于会直接产出代码的代理系统,这类组合式方案更贴近真实使用场景。
产品与链接
Harden.run 表示,相关产品已经可以在 harden.run 免费使用,完整基准测试结果则放在博客文章中。
- 原文标题:Show HN: Beating GPT5.5-xhigh for Coding agent security with SLMs and IRM
- 来源链接:https://harden.run/blog/aif-research-and-evidence
- 评论链接:https://news.ycombinator.com/item?id=49472151
- Hacker News Points:6
- 评论数:3
// 相关阅读
Agent-hop:用 Rust TUI 在 Claude Code 对话中切换到 Codex
Agent-hop 是一个基于 Rust 的 TUI,支持在进行中的 Claude Code 聊天里切换到其他编程代理,尽量不丢失上下文。项目作者提到,它最早源自一个简历与搜索工具,后来因为使用过程中的阻碍,单独做成了现在的界面。
Show HN 项目速览:面向 Java 高性能优化的 Codex / Claude Code harness
Hacker News 上出现了一个名为“Codex / Claude Code harness for Java high performance improvements”的 Show HN 条目。页面信息显示,项目条目指向 MCP Registry 中 JAIPilot 的 6.4.2 版本,当前获得 3 分,评论数为 0。
Show HN 项目 Poka-Yoke:给 Claude Code 做“防错”,并附带基准测试
Hacker News 上出现了一个名为 Poka-Yoke 的项目,核心指向 Claude Code 的防错技能设计,项目页同时给出了 benchmark。当前条目对应评论数为 0,积分为 1。