原文跳转提示
此资讯内容来源于外部网站,将在 60 秒后自动跳转到原文页面
https://arxiv.org/abs/2608.17379
立即前往原文

PTXBench评估并适配使用架构专用PTX进行GPU内核优化的LLM

PTXBench是一套用于评估和适配大型语言模型的基准测试,旨在利用架构专用PTX优化GPU内核。它在H100和B200 GPU上测量功能正确性、选定目标指令是否在运行时实际执行,以及相对于领先库的加速效果。评估显示,模型能力仍不均衡:在复杂的注意力反向传播工作负载上,成功率明显下降;而执行目标指令也不一定能带来有竞争力的性能。没有任何受测模型能在整套测试中持续达到领先库的水平。对Qwen3.6-27B进行监督微调后,基于修复条件的训练改善了部分任务,但泛化能力仍不稳定。
行业资讯 硬件 AI模型 研究 2026-08-19 23:30:54 405 阅读 阅读约 1 分钟 来源:Hugging Face
本文来源:Hugging Face,仅供学习参考,版权归原作者所有。