我们的 AI 引擎 Neutron 在加州大学伯克利分校的 CyberGym 基准测试中取得了 96.75% 的成绩。 了解更多

标签

#agentic harness

1 篇文章

智能体运行框架(agentic harness)改变了大语言模型在移动应用安全测试中所能完成的工作。单靠模型本身,它可以列举出可能的风险,例如不安全的存储、暴露的密钥、高风险权限、存在漏洞的 SDK、后端问题和隐私泄露,但应用本身可能始终未被触碰。当模型周围配备了合适的工具、上下文、记忆、提示词、执行循环和运行时反馈时,它就能检查应用包、观察行为、跟踪流量、关联信号,并留下安全团队可以审查的证据。从权限分析到借助 GEF 的原生漏洞利用,差异在执行轨迹中清晰可见:留下的是应用证据、工具输出、运行时证明和可复现的步骤,而不是貌似报告的文字。