构建率97%,任务完成率48%,这中间藏的事比论文本身有意思
速评:这可能是今年最"自曝"的一篇 benchmark 论文。 8月17日挂到 arXiv 上的《OpenHarmony Bench》,30位作者,Li Li 领衔,评估 LLM coding agent 在 ArkTS 应用上的开发能力。

速评:这可能是今年最"自曝"的一篇 benchmark 论文。 8月17日挂到 arXiv 上的《OpenHarmony Bench》,30位作者,Li Li 领衔,评估 LLM coding agent 在 ArkTS 应用上的开发能力。
