教程 / 实战普通Sierra 开源 hyper-τ-bench:评估能构建智能体的智能体信息来源:Sierra:Blog(RSS)·2026-09-09 04:25原始标题:Hyper-τ-bench: Evaluating agents that build agents内容摘要Sierra 今日开源 hyper-τ-bench,这是一个新的长时程智能体评测基准,用于衡量模型不仅能作为智能体行动、还能构建智能体的能力。该基准聚焦于"构建智能体的智能体"这一任务场景,为长时程自主智能体开发提供评测标准。内容分类AI 教程与实战内容层级普通情报发布时间(北京时间)2026-09-09 04:25本站收录时间(北京时间)2026-09-09 07:01信息来源Sierra:Blog(RSS)站内情报编号intel-7f19c879a6c7f812d94880a5阅读原始信息 ↗查看数据来源更多教程 / 实战分享文章