8月24日,Artificial Analysis与Liquid AI联合发布面向手机端的AI跑分基准,重点测试苹果iPhone 17 Pro平台性能。双方分别负责智能水平与推理性能测试,采用BFCL、IFBench等5项基准。测试对象为4-bit量化、体积≤8GB的轻量模型,如Nanbeige4.2-3B和LFM2.5-2.6B。在16K上下文长度下,二者并列得分最高;响应限时1分钟时,LFM2.5-8B-A1B居首。该基准旨在推动移动端AI模型评估标准化。