人的价值
Artificial Analysis 公布苹果 iPhone 17 Pro 跑 8GB 以内本地 AI 性能排名_我的网站

A | 8 月 26 日消息,Artificial Analysis 于 8 月 24 日发布博文,宣布携手 Liquid AI,发布面向手机端的 AI 跑分基准,重点关注 AI 模型在苹果 iPhone 17 Pro 上的表现。其中 Artificial Analysis 负责智能水平测试系统,Liquid AI 负责推理性能测试系统,双方选用 5 项基准测试:BFCL(Berkeley 函数调用排行榜)IFBench(指令遵循测试)AA-Omniscience(知识与认知相关测试)GPQA Diamond(高难度问答测试)MATH-500(数学问题测试)。测试模型对象为 4 bit 量化后体积不超过 8GB 的模型,示例包括 Gemma 4 E2B 和 LFM2-2.6B-Exp。

B | 当上下文长度限制为 16K tokens 后,平均基准测试得分最高的是 Nanbeige4.2-3B 和 LFM2.5-2.6B。当响应时间限制为最长 1 分钟时,LFM2.5-8B-A1B 排名第 1,随后是 LFM2-2.6B-Exp、Gemma 4 E4B(Non-reasoning)和 Granite 4.1 8B。

C |
8月16日,魔术核心班凯罗做客篮球节目,复盘上赛季对阵76人的生死附加赛。Nanbeige4.2-3B 是 BOSS 直聘旗下的南北阁实验室推出,仅含 30 亿非嵌入参数(总参数约 40 亿),采用 Looped Transformer 架构,通过在不增加参数量的前提下复用 Transformer 层(循环两遍),提高模型的有效计算深度和容量。横轴表示“输出 256 个 token 所需的时间(秒)”,纵轴表示“上下文长度限制为 16K 个 token 时的平均基准测试得分”。“Nanbeige4.2-3B”的基准测试得分与“LFM2.5-2.6B”相当。
他坦言自己那场比赛状态极差,下半场多次获得空位三分机会却不敢出手,还频繁出现失误。在上下文长度限制为 16K 个 Token 时,平均基准测试得分中得分最高的是 Nanbeige4.2-3B 和 LFM2.5-2.6B。班凯罗直言赛场心态一旦迟疑,自己就完全打不出水准。
此役魔术客场97-109不敌76人无缘东部第七,班凯罗全场22投7中,三分颗粒无收,交出18分5篮板4助攻,附带6次失误,全场-17的正负值为队内最低。当响应时间限制为最长 1 分钟时,LFM2.5-8B-A1B 排名第 1,随后是 LFM2-2.6B-Exp、Gemma 4 E4B(Non-reasoning)和 Granite 4.1 8B。附上相关截图如下:。
Current article:http://rqba.caihezhehuagenshun.sbs/news/20260826_862727.html
Published on:10:11:18



【IT家居评估室】海信手机钻石4专业评估:商务强项外观
沧海桑田!15/16赛季蓝狐81分夺英超,纽卡37分仍降级维拉垫底
Chinese research vessel Tan Kah Kee makes first visit to Sabah, Malaysia
Chinese modernization offers insights for development paths, says senior Tajik official
党建引领结对共建 筑牢森林“防火墙”
“儿子把我的头按着撞向切菜板”,妈妈报警哭泣:我养了他30多年,不工作也不结婚,我伤透了心;儿子:因晚饭吃菜还是吃肉起冲突
数智赋能新业态 一组数据看电商经济活力,数智赋能新业态 一组数据看电商经济活力
从0到N,雄安这样定义创新 | “雄安星”何以一飞冲天
黄章:美祖16S的价格比16S高500元左右。
NCAA助攻王!步行者签下38号秀布雷登史密斯
中信证券:保险重塑行业经营逻辑 大公司持续巩固优势地位
芯碁微装:上半年净利润2.81亿元,同比增长98.13%