Patronus AI 于 6 月 25 日宣布完成 5000 万美元融资,由前 Meta AI 研究员 Anand Kannappan 和 Rebecca Qian 创立。该公司构建模拟数字环境,帮助模型开发者与企业评估 AI 代理在复杂多步任务中的表现与可靠性。
AI 代理正从简单问答转向自主执行长周期任务,传统基准测试已难以捕捉真实场景下的失效风险。Patronus 的“数字世界”平台通过生成可控的虚拟环境,对代理的规划、工具调用和错误恢复能力进行系统化压力测试,填补了这一空白。
与 Anthropic、OpenAI 等前沿实验室自建内部评估体系不同,Patronus 提供第三方、可复用的测试基础设施,目标成为代理部署前的“安全阀”。融资后公司将扩展环境生成规模,并与更多模型提供商合作。
这一举动反映出行业从“模型竞赛”转向“可靠性竞赛”的趋势。谁能在真实部署前发现并修复代理失效,谁就能在企业采用浪潮中占据先机。接下来值得跟踪的是,Patronus 是否会成为监管或保险机构认可的第三方认证平台。
信源:https://techcrunch.com/2026/06/25/patronus-ai-lands-50m-to-build-digital-worlds-that-stress-test-ai-agents/










