NeFut Logo NeFut
EN 管理员登录

[AI学术] TicTacBench:评估编码代理时序闭合能力的基准

发布于:2026-09-23 22:00 最后更新:2026-09-24 00:40
#AI #optimization #LLM

近期大型语言模型(LLM)的进展催生了能够完成复杂工程任务的编码代理,包括寄存器传输级(RTL)设计与优化。现有 RTL 基准主要关注功能正确性以及性能、功耗、面积(PPA),对代理的时序闭合能力评估不足。为此我们提出 TicTacBench,专门用于在后布局后仿真(post‑PnR)环境下评估编码代理的 RTL 级时序闭合能力。Benchmark 包含 30 条多样化任务,每条任务提供一个次优 RTL 设计、真实的时序约束、功能等价验证以及时序报告。我们在 8 种前沿 LLM 上执行了超过 300 次实验,结果显示即使是表现最好的代理也只能在 53.3% 的任务上实现时序闭合,平均导致 7.18% 的面积‑延迟积(ADP)退化和 8.83% 的能量‑延迟平方积(EDDP)提升。通过分析失败案例,我们归纳出若干常见的失效类别,并据此提出 TicTacSkill——一种引导代理遵循标准时序闭合流程的新方法,能够将时序闭合率提升约 9%。这些结果表明,尽管编码代理在 RTL 设计方面取得了显著进展,但其时序闭合能力仍有大量提升空间。

点评

原文链接: https://arxiv.org/abs/2609.23363

[h] 返回首页