Android Bench —— Google 官方针对 Android 应用开发的的 LLM 性能排行榜
排行榜链接:https://developer.android.com/bench
在AI辅助软件工程领域,已涌现出多个用于评估大语言模型(LLM)能力的基准测试。然而,Android开发者面临的一些特定挑战并未被现有基准测试覆盖,因此 Google 官方创建了一个专注于高质量Android开发核心目标的基准测试。
此基准测试的目标如下:
- 推动大语言模型在Android开发领域的性能提升。
- 帮助Android开发者评估并选择能提供有效辅助的AI模型。
- 促进整个Android生态系统应用质量的提升。
为此,Google 构建了一个与模型无关(model-agnostic)的基准测试,以准确评估大语言模型在各类Android开发任务中的表现。
这篇文章是否对你有帮助?
发现错误或想要改进这篇文章?
在 GitHub 上编辑此页