让知识彼此相连

知识图谱

沿着人物与判断,回到原始证据。

1 位人物 · 1 个来源 · 1 条观点

放回语境

KernelBench GPU内核评估

选择一条判断,追溯到它所在的原始对话。

KernelBench 衡量 LLM 生成 GPU 内核的正确性与执行速度

放回语境KernelBench GPU内核评估1 条观点
2026-07-04

等分区块用于阅读定位,不表示排名或权重。

当前 1–1 / 共 1 条判断 · 按来源日期由新到旧

1 / 1

当前判断

KernelBench 衡量 LLM 生成 GPU 内核的正确性与执行速度

KernelBench 通过 250 个 PyTorch 任务评估大语言模型(LLM)生成 GPU 内核的能力,核心指标为 fast_p——即生成的内核中既正确又快于基线内核的比例。

这些是个人表达的观点,并非共识度量。原始资料保持其原始语言。

支持这项说法

用于自我改进的 Harness 工程

KernelBench:评估所生成核函数的正确性与执行速度。包含250个PyTorch任务,用于评测大语言模型(LLM)能否编写出既快速又正确的核函数。

原始摘录
KernelBench : evaluate correctness and speed for generated GPU kernels. 250 PyTorch tasks to evaluate whether LLM can write fast and correct kernels.
上下文

评估指标 fast_p = 生成核函数中既正确、又快于基线版本的比例。

原始上下文

The evaluation metric fast_p = the percentage of generated kernels that are correct and faster than baseline.

日期表示来源发表时间,不代表观点发生变化。 缺少审核合格译文的内容保留原文。