LMBuild:评估LLM智能体生成可建造、可运行结构的能力
LMBuild是一项基准测试,用于评估LLM智能体能否生成不仅几何形态合理,而且可以实际建造并实现预期功能的结构。该框架包括用于检索、创建和放置部件的交互环境,基于现有CAD数据集构建的基准,以及对结构稳固性、功能性、设计质量和物理实现可行性的评估。对30个系统的测试表明,即使是领先的闭源模型,功能性和实际可操作性仍比结构稳固性更难实现。提供功能规格有助于提升零件完整度、运动学表现和可操作性。
本文来源:Hugging Face,仅供学习参考,版权归原作者所有。