欢乐颂原创文学网 - 纯净的绿色文学家园 !

欢乐颂(全文在线阅读>

欢乐颂

罕见!抽签决定晋级,中国U17女足3连胜无缘决赛_我的网站

罗马假日

一 |      8 月 26 日消息,Artificial Analysis 于 8 月 24 日发布博文,宣布携手 Liquid AI,发布面向手机端的 AI 跑分基准,重点关注 AI 模型在苹果 iPhone 17 Pro 上的表现。    

北京时间8月20日,在上海明日之星冠军杯半决赛中,中国U17女足与阿森纳U17女足战至下半场第50分钟时,因雷电天气原因比赛中止,中止时比分为2-2。双方沟通过后决定通过抽签方式决定晋级队伍,最终阿森纳方胜出,晋级决赛。其中 Artificial Analysis 负责智能水平测试系统,Liquid AI 负责推理性能测试系统,双方选用 5 项基准测试:BFCL(Berkeley 函数调用排行榜)IFBench(指令遵循测试)AA-Omniscience(知识与认知相关测试)GPQA Diamond(高难度问答测试)MATH-500(数学问题测试)。测试模型对象为 4 bit 量化后体积不超过 8GB 的模型,示例包括 Gemma 4 E2B 和 LFM2-2.6B-Exp。记者雷杰深、蒋娴同步消息如下:“由于中国U17女足vs阿森纳U17女足的半决赛遭遇雷雨天气,比赛先后经历两次30分钟暂停,因现场再次出现闪电,比赛被迫中止。当上下文长度限制为 16K tokens 后,平均基准测试得分最高的是 Nanbeige4.2-3B 和 LFM2.5-2.6B。

二 | ”“受后续赛程排序紧凑、球队行程等因素限制,经组委会与双方球队协商,不再进行补赛,依据赛事规程,通过抽签方式确定晋级队伍。当响应时间限制为最长 1 分钟时,LFM2.5-8B-A1B 排名第 1,随后是 LFM2-2.6B-Exp、Gemma 4 E4B(Non-reasoning)和 Granite 4.1 8B。Nanbeige4.2-3B 是 BOSS 直聘旗下的南北阁实验室推出,仅含 30 亿非嵌入参数(总参数约 40 亿),采用 Looped Transformer 架构,通过在不增加参数量的前提下复用 Transformer 层(循环两遍),提高模型的有效计算深度和容量。横轴表示“输出 256 个 token 所需的时间(秒)”,纵轴表示“上下文长度限制为 16K 个 token 时的平均基准测试得分”。“Nanbeige4.2-3B”的基准测试得分与“LFM2.5-2.6B”相当。最终,阿森纳U17女足抽签胜出,获得决赛晋级资格。”“中国队将在8月22日16:00的三四名决赛中对阵皇家马德里U17女足。在上下文长度限制为 16K 个 Token 时,平均基准测试得分中得分最高的是 Nanbeige4.2-3B 和 LFM2.5-2.6B。

三 | 当响应时间限制为最长 1 分钟时,LFM2.5-8B-A1B 排名第 1,随后是 LFM2-2.6B-Exp、Gemma 4 E4B(Non-reasoning)和 Granite 4.1 8B。

四 | ”此前,中国U17女足在小组赛3战全胜,先后击败皇马、拜仁和曼城的U17女足。附上相关截图如下:。3场比赛打进14球0丢球。遗憾的是,半决赛面对B组第2名阿森纳U17女足的比赛,不幸遭遇雷电天气。

Current article:http://zxuirk.foujiongwenruapoumeizhan.buzz/news/20260826_22783.html

Published on:08:11:31


顶一下
(0)
0%
踩一下
(0)
0%
------分隔线----------------------------
栏目列表