AI圈报
模型发布 / 更新精选

Community Evals:因为我们不再信任黑箱排行榜胜过社区

信息来源:Hugging Face:Blog(RSS)·
原始标题:Community Evals: Because we're done trusting black-box leaderboards over the community

内容摘要

LMSys 推出了社区驱动的评估框架 Community Evals,旨在通过开源和开放科学推进人工智能民主化。该框架允许社区贡献和审查评估案例,以透明、可复现的方式测试模型。此举旨在改变依赖少数机构"黑箱"排行榜的现状,让更广泛的社区参与定义和衡量AI模型的能力与价值。
内容层级精选情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源Hugging Face:Blog(RSS)
站内情报编号intel-befec657d9baf6dc6b31a06a