论文研究普通
Φ-Bench:大语言模型能否工程化支撑自身运行的基础设施?
原始标题:Φ-Bench: Can Large Language Models Engineer the Infrastructure That Powers Them?
内容摘要
研究者提出 Φ-Bench,用于系统评估 LLM 工程化 LLM 基础设施栈的能力,任务源自前沿研究中的优化问题并基于真实代码仓库,覆盖从局部 kernel 级函数补全到长周期实现与端到端系统优化。对前沿 LLM 的实验揭示了它们在工程化复杂 LLM 基础设施上的现有能力与局限。
内容分类AI 论文与研究
内容层级普通情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源HuggingFace Daily Papers(社区热门论文)
站内情报编号intel-a04a215af8960b0542a3206c