# Sierra 开源 hyper-τ-bench：评估能构建智能体的智能体

- 来源：Sierra：Blog（RSS）
- 作者：Ben Shi, Keshav Dhandhania
- 发布时间：2026-09-09 04:25
- AIHOT 分数：38
- AIHOT 链接：https://aihot.news/items/cmtt9xrai020orofps61otpfi
- 原文链接：https://sierra.ai/blog/hyper-t-bench-evaluating-agents-that-build-agents

## AI 摘要

Sierra 今日开源 hyper-𝜏-bench，这是一个新的长时程智能体评测基准，用于衡量模型不仅能作为智能体行动、还能构建智能体的能力。该基准聚焦于“构建智能体的智能体”这一任务场景，为长时程自主智能体开发提供评测标准。

## 正文

按该来源的展示范围，站内仅提供摘要。

> 站内仅提供摘要，全文见原文。
