当前位置: 首页
AI
英伟达小模型NVARC登顶ARC-AGI2:零预训练低成本展现高效实力

英伟达小模型NVARC登顶ARC-AGI2:零预训练低成本展现高效实力

热心网友 时间:2025-12-09
转载

在一场人工智能领域的高难度评测中,英伟达推出的4B参数小模型NVARC以显著优势登顶。面对ARC-AGI2评测设置的全新挑战,该模型以27.64%的得分超越GPT-5 Pro的18.3%,同时在成本效率上展现出惊人表现——每项任务处理成本仅需20美分,仅为对手7美元的约1/35。这场胜利不仅标志着小模型在复杂推理任务中的突破,更引发业界对“更大不一定更强”发展路径的重新审视。

免费影视、动漫、音乐、游戏、小说资源长期稳定更新! 👉 点此立即查看 👈

评测机构精心设计的测试方案成为此次竞争的关键。ARC-AGI2评测摒弃了传统的固定数据集模式,转而要求模型在完全陌生的任务场景中快速学习新规则。测试题目涵盖逻辑推理、空间想象、数学证明等12个维度,每个任务仅提供3个示范样本,迫使模型通过有限信息推导出通用解决方案。这种设计精准打击了依赖大规模预训练的通用模型,却为NVARC的零预训练架构提供了施展空间。

英伟达研发团队采用的合成数据策略构成了技术突破的核心。他们构建的离线数据工厂包含三个创新环节:首先从现有数据集中解构出基础逻辑单元,其次通过多维度组合生成320万道增强谜题,最后运用多阶段验证机制确保每道题目的质量。在这个过程中,GPT-OSS-120B模型扮演着"智能出题官"角色,其生成的合成数据在难度梯度和知识覆盖度上均达到新高度。相比传统数据采集方式,该方案使训练效率提升40倍,同时将硬件资源消耗降低75%。

在算法架构层面,NVARC对ARChitects推理框架进行了深度优化。研发团队将复杂问题拆解为可验证的子模块,通过对交互式模板降低理解门槛。训练阶段采用的NeMo强化学习框架与Megatron并行计算后端的结合,使模型在保持小体积的同时具备强大的泛化能力。特别开发的TTFT(任务自适应微调)技术,通过动态调整神经网络连接权重,使模型能在10分钟内完成对新任务规则的适配。

这场胜利引发的讨论远超技术范畴。行业观察者指出,NVARC的成功证明在特定领域中,精准优化的专用模型可能比通用大模型更具实用价值。其每秒处理12.8个任务的速度优势,结合极低的运营成本,使该模型在医疗诊断、金融风控等对时效性和成本控制敏感的场景中展现出巨大潜力。尽管仍有质疑声音认为合成数据训练可能限制模型的真实世界适应力,但英伟达团队公布的测试数据显示,NVARC在跨领域迁移任务中的表现已达到行业平均水平的2.3倍。

来源:https://www.itbear.com.cn/html/2025-12/1044954.html

游乐网为非赢利性网站,所展示的游戏/软件/文章内容均来自于互联网或第三方用户上传分享,版权归原作者所有,本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容,请联系youleyoucom@outlook.com。

同类文章
更多
谷歌内存论文疑被抄袭,华人学者控诉业内学术不公

谷歌内存论文疑被抄袭,华人学者控诉业内学术不公

新智元报道编辑:好困 Aeneas【新智元导读】把闪存股一夜干崩的谷歌顶会论文,出大事了。TurboQuant的核心方法,两年前就被一位华人学者做完、发完顶会、代码全部开源了。谷歌不仅没正面提及,而

时间:2026-03-28 16:58
OpenClaw漏洞威胁:智能家居被反锁与隐私泄露风险

OpenClaw漏洞威胁:智能家居被反锁与隐私泄露风险

新智元报道编辑:倾倾【新智元导读】2025年底,极客圈发生了一场数字哗变,Anthropic的遮羞布被Peter Steinberger撕了个精光。从OpenClaw开源到Claude被扒出80页「

时间:2026-03-28 16:52
华为大模型负责人离职,重大人事变动引发行业关注

华为大模型负责人离职,重大人事变动引发行业关注

智东西作者|江宇编辑|冰倩智东西3月28日报道,今日,华为诺亚方舟实验室主任、华为盘古大模型负责人王云鹤在朋友圈发文,确认离职。王云鹤于2017年以华为北京部门首位实习生身份加入,至今已接近9年。在

时间:2026-03-28 16:46
Nature重磅:AI生成论文在顶会通过率55%,单篇成本仅15美元

Nature重磅:AI生成论文在顶会通过率55%,单篇成本仅15美元

新智元报道编辑:元宇【新智元导读】刚刚,Nature盖章AI独立科研时代!全新Scaling Law显现,人类死守的学术铁王座,正发生不可逆的转移。一篇长达数十页的学术论文,在人类设定研究主题和实验

时间:2026-03-28 15:07
CMU首创无毒AutoGEO方案,破解GEO投毒产业链焦虑

CMU首创无毒AutoGEO方案,破解GEO投毒产业链焦虑

新智元报道编辑:LRST【新智元导读】ChatGPT上线广告、315曝光GEO投毒产业链,AI搜索商业化的隐忧接连浮出水面。龙虾热背后,3000元就能让AI搜索信口开河,离全面「瞎说」还有多远?来自

时间:2026-03-28 15:01
热门专题
更多
刀塔传奇破解版无限钻石下载大全 刀塔传奇破解版无限钻石下载大全
洛克王国正式正版手游下载安装大全 洛克王国正式正版手游下载安装大全
思美人手游下载专区 思美人手游下载专区
好玩的阿拉德之怒游戏下载合集 好玩的阿拉德之怒游戏下载合集
不思议迷宫手游下载合集 不思议迷宫手游下载合集
百宝袋汉化组游戏最新合集 百宝袋汉化组游戏最新合集
jsk游戏合集30款游戏大全 jsk游戏合集30款游戏大全
宾果消消消原版下载大全 宾果消消消原版下载大全
  • 日榜
  • 周榜
  • 月榜
热门教程
更多
  • 游戏攻略
  • 安卓教程
  • 苹果教程
  • 电脑教程