CodeGolf Bench: A Multi-Language Benchmark for Evaluating Concise Code Generation Capabilities of Large Language Models 文章

ArXiv CS.AI2026-06-01NEWSen作者: Vedant Padwal

CodeGolf Bench: A Multi-Language Benchmark for Evaluating Concise Code Generation Capabilities of Large Language Models · 相关事件

暂无数据