32B 模型横扫 SWE 任务,这款代码智能体模型有点东西

(PHP中文网报道)2025年不仅是智能体全面爆发的一年,也是AI在软件工程领域开启新纪元的起点。以人工智能为核心的自动化开发正以前所未有的速度重塑传统开发模式。
免费影视、动漫、音乐、游戏、小说资源长期稳定更新! 👉 点此立即查看 👈
昆仑万维今日正式发布全球首个开源代码智能体Skywork-SWE-32B,该模型通过“轻量化参数”实现仓库级别的修复逻辑重构。
这是一场开源生态对抗闭源霸权的重要突破——Skywork-SWE-32B使得企业仅需消费级显卡即可部署AI工程师,大幅降低使用门槛。
在SWE-bench-Verified测试中(基于OpenHands代码辅助平台),该模型将修复准确率提升至47.0%,不仅超越了所有参数规模小于32B的开源模型,更逼近闭源模型Claude v3.7(56.0%)的性能极限。
摆脱闭源限制后,AI的角色也从“辅助工具”跃迁为“协作伙伴”,标志着软件工程真正迈入由智能体驱动的新时代。
目前,开发者已经可以在Hugging Face平台上下载这位“开源工程师”。
技术报告:https://www.php.cn/link/bb8054b490d695da02c573c665824b88
博客地址:https://www.php.cn/link/98be175f18ff12118f056c7e448ade23
模型权重:https://www.php.cn/link/1f3ecb87f576752202975d3e0b868bdc
01
SWE任务:对智能体能力的终极考验
对于有经验的程序员来说,软件工程(Software Engineering, SWE)任务远比一般代码生成更具挑战性。将大型语言模型作为智能体应用于真实软件工程项目,并非只是简单地执行“写代码”的指令。
即便是人类开发者,在面对陌生项目时,首次Bug修复成功率也不足70%。
如今,把一个SWE任务交给智能体模型,就相当于要求一位“AI工程师”在极短时间内快速适应新团队、接手庞大且不熟悉的遗留系统,准确理解一份描述模糊的Bug报告,找出根本问题,设计出符合团队规范且不影响其他功能的修复方案,并一次性提交正确的代码修改。
这样的“AI工程师”堪称稀缺资源。
远超传统代码生成的技术门槛
与传统意义上的代码生成相比,SWE任务对模型能力的要求可谓天差地别。任何一个环节的能力短板,都可能导致智能体在面对复杂工程现实时无从下手。
游乐网为非赢利性网站,所展示的游戏/软件/文章内容均来自于互联网或第三方用户上传分享,版权归原作者所有,本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容,请联系youleyoucom@outlook.com。
同类文章
徐静雨盛赞洛克王国:世界剧情登顶,老玩家集体回归掀起怀旧热潮
知名解说徐静雨于2026年4月5日发布视频,高度评价洛克王国:世界的剧情表现,称其“层次丰富、节奏多变,远超同类作品”。这番评价迅速引发广泛共鸣,大量曾陪伴洛克王国成长的老玩家纷纷重返社区,分享多年
特斯拉严打非授权启用FSD:违规将致保修失效、担责甚至入刑
2026年4月5日,特斯拉针对未经许可激活全自动驾驶功能的行为采取了严格管控措施,并向车主发出正式警示:凡通过非最新途径启用该功能,车辆整车保修将自动失效;若因此引发交通事故,全部法律责任由用户自行
小虞姬就高价陪玩订单少言论致歉:系市场性价比权衡,非否定选手实力
近日,游戏主播兼陪玩店经营者小虞姬在直播中谈及当前陪玩行业的运营现状,提到部分高定价陪玩订单量偏低,以及曾有世界赛级别选手标价千元以上却较难获得客户认可的现象。随后,小虞姬在个人社交平台就相关表述公
任天堂或将推星际火狐新作,2026年登陆新主机,主打深度叙事与角色塑造
任天堂或将推出全新星际火狐作品,据多方消息显示,该作预计于2026年登陆新一代主机平台,且在剧情架构与叙事表达上有望实现显著突破。长期以来,星际火狐系列更侧重于快节奏的飞行射击体验,剧情始终处于辅助
荣耀600 Pro国际版发布:星宇橙配色+骁龙8至尊版+超声波指纹
2026年4月5日,荣耀新一代数字系列——荣耀600系列正式在马来西亚正式亮相,包含荣耀600与荣耀600 Pro两款机型。今日,荣耀600 Pro国际版真机首次公开。其背部采用横向大尺寸矩阵式镜头
- 日榜
- 周榜
- 月榜
1
2
3
4
5
6
7
8
9
10
相关攻略
2015-03-10 11:25
2015-03-10 11:05
2021-08-04 13:30
2015-03-10 11:22
2015-03-10 12:39
2022-05-16 18:57
2025-05-23 13:43
2025-05-23 14:01
热门教程
- 游戏攻略
- 安卓教程
- 苹果教程
- 电脑教程

