当前位置: 首页
科技数码
苹果CoreAI基准 Qwen3 0.6B领先 8B逼近MLX

苹果CoreAI基准 Qwen3 0.6B领先 8B逼近MLX

热心网友 时间:2026-06-17
转载

苹果CoreAI引擎取代CoreML,专注端侧大模型推理。M4Mac上Qwen30 6B解码速度达MLX的2 47倍,8B持平。持续负载下GPU易降频,CoreML配合神经引擎更稳定。谷歌LiteRT-LM内存效率优于MLX。

苹果在2026年WWDC大会上正式发布了CoreAI引擎,全面接替已服役长达9年的CoreML框架。此前,CoreML自2017年起主要承担iOS和macOS平台上图像分类等小型静态任务,而全新登场的CoreAI则将战略重点全面转向端侧大模型推理——在设备本地运行大型语言模型,支持更灵活的模型格式并允许更大的内存占用,这无疑是其真正的核心使命。

与此同时,MLX作为苹果生态中的另一套机器学习框架,聚焦于研究、训练和模型微调,开发者经常借助它来测试和部署本地大模型。换句话说,CoreAI与MLX虽同属苹果体系,但分工非常清晰:一个主攻端侧推理,另一个偏向研究与训练场景。

从首批基准测试结果来看,CoreAI呈现出“小模型性能突出、大模型表现持平”的鲜明特征。在M4 Mac上运行Qwen3 0.6B模型时,CoreAI的解码速度大约是MLX的2.47倍;而在iPhone 17 Pro上,这一优势缩小至约1.6倍。所谓解码速度,即大模型每秒能够生成多少个token(tok/s),该数值越高,用户等待回复的时间就越短。


当模型规模提升至80亿参数(Qwen3 8B,M4 Max)后,CoreAI仅比MLX快了约5%,两者基本处于同一水平。这说明随着模型体量增大,CoreAI的性能优势明显收窄——在小模型上可以拉开倍速差距,而大模型上则趋于持平状态。

在持续负载能力方面的测试更具参考价值。数据显示,iPhone 17 Pro的GPU在长时间运行大模型后会较快触发温控降频,从而削弱基于GPU路线的持续吞吐能力。反倒是CoreML与苹果神经引擎(ANE)的组合,在性能保持率上实现了反超。这表明纯GPU路线并非最优方案,融合神经引擎的混合架构在长时间推理场景下更为稳定可靠。


再横向对比其他厂商的方案,你会发现针对特定模型深度优化的引擎更容易胜出。谷歌的LiteRT-LM在iPhone 17 Pro上运行Gemma时,每秒可达55.4个token,而RAM占用仅641 MB。作为对照,苹果MLX运行相同模型的内存占用高达2900 MB,是前者的4.5倍。这组数据很直观地说明:内存效率与推理速度之间的平衡,往往成为端侧AI落地的关键瓶颈。


来源:https://www.163.com/dy/article/KV58VQ5R0511B8LM.html

游乐网为非赢利性网站,所展示的游戏/软件/文章内容均来自于互联网或第三方用户上传分享,版权归原作者所有,本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容,请联系youleyoucom@outlook.com。

同类文章
更多
罗福莉入选新一届35岁以下科技创新35人中国区名单

罗福莉入选新一届35岁以下科技创新35人中国区名单

2025年《麻省理工科技评论》“35岁以下科技创新35人”中国区名单在上海发布,罗福莉、姚顺宇等入选。罗福莉推动大模型从“能聊天”走向“能干活”,探索智能体演进;姚顺宇建立非厄米拓扑能带理论。本届AI+机器人领域入选者占四成。

时间:2026-07-25 21:58
美国科技巨头为AI投资年内裁员近14万人

美国科技巨头为AI投资年内裁员近14万人

美国科技巨头年内裁员近14万人,同时计划在AI基础设施上投入7250亿美元。裁员主要目的为AI投资腾出资金并纠正疫情期间过度招聘,市场对AI相关裁员反应负面,而AI初创公司正加速扩招,形成对比。

时间:2026-07-25 21:58
位AI Infra高管复盘WAIC:暴力美学触顶后求变?

位AI Infra高管复盘WAIC:暴力美学触顶后求变?

WAIC2026上,AIInfra行业关注点从算力规模转向推理效率与Token产出。Agent驱动Token消耗激增,AI工厂与Token工厂成为关键载体。效率竞争取代规模竞赛,玩家分层加速,具备全栈优化能力的头部厂商优势凸显。

时间:2026-07-25 21:58
显卡厂商封仓引发涨价 玩家面临高价购买

显卡厂商封仓引发涨价 玩家面临高价购买

显卡市场,恐怕又要迎来一波涨价潮了。过去两年,不少玩家咬咬牙买下的高价显卡,如今回头看,竟然成了抄底。但问题在于,硬件市场每一次涨价,最终买单的永远还是玩家。 业内消息显示,GDDR7显存价格出现了明显上涨,单颗2GB显存价格上涨接近20美元。按8GB显存规格计算,一张显卡的显存成本或将增加约542

时间:2026-07-25 21:58
OpenAI加入签署AI开源模型公开信,组织达35家

OpenAI加入签署AI开源模型公开信,组织达35家

7月25日,微软、英伟达等25家美国公司联署公开信支持开放权重AI模型,随后签署方增至35家,新增包括OpenAI等。开放权重模型可下载、修改、运行,能扩大创新、强化竞争并降低风险,避免AI收益集中于少数巨头。

时间:2026-07-25 21:28
热门专题
更多
刀塔传奇破解版无限钻石下载大全 刀塔传奇破解版无限钻石下载大全
洛克王国正式正版手游下载安装大全 洛克王国正式正版手游下载安装大全
思美人手游下载专区 思美人手游下载专区
好玩的阿拉德之怒游戏下载合集 好玩的阿拉德之怒游戏下载合集
不思议迷宫手游下载合集 不思议迷宫手游下载合集
百宝袋汉化组游戏最新合集 百宝袋汉化组游戏最新合集
jsk游戏合集30款游戏大全 jsk游戏合集30款游戏大全
宾果消消消原版下载大全 宾果消消消原版下载大全
  • 热门数据榜