面包屑图标 当前位置: 首页
AI资讯
热点详情

OpenAI遭开源倒逼推出两款GPT-OSS模型

AI热点日报
AI热点日报时间:2026-07-20
热点解读

OpenAI开源GPT-OSS系列两个模型(120B与20B),采用MoE架构与原生4位量化。120B性能对标o4-mini,20B媲美o3-mini,多项基准测试达SOTA。120B可在单张80GH100运行,20B仅需16GB显存,消费级硬件可驾驭。原生支持工具调用与代码执行,获HuggingFace、英伟达等全面支持。

OpenAI 重磅开源两大 AI 模型,性能直逼商业版本,硬件要求却大幅降低——这无疑是开发者的福音。

核心信息点如下:

  • 技术突破:GPT-OSS 系列采用 MoE 架构与原生量化技术,效率惊人。
  • 性能越级:120B 版本对标 o4-mini,20B 版本媲美 o3-mini,多项基准测试中展现 SOTA 实力。
  • 极致效率:120B 模型可在单张 80G H100 上运行,20B 仅需 16GB 显存,消费级硬件也能驾驭。
  • Agent 友好:原生支持工具调用、代码执行与结构化输出,智能体开发更顺畅。
  • 生态完备:发布即获 Hugging Face、英伟达、微软、Ollama 等巨头全面支持,部署微调无缝衔接。

OpenAI被开源倒逼,一口气开源2个超级重磅模型GPT-OSS

五年沉寂,一朝破壁。就在凌晨,OpenAI 以 GPT-OSS 的姿态重返开源战场,一口气开源两个权重语言模型:gpt-oss-120bgpt-oss-20b

关键信息速读

  • 两大模型:发布 gpt-oss-120b 与 gpt-oss-20b,采用 Apache 2.0 协议,完全开放商用。
  • 性能越级:120B 版本性能直逼 o4-mini,20B 版本媲美 o3-mini,在多个基准测试中展现 SOTA 实力。
  • 极致效率:采用 MoE 架构与原生 4 位量化(MXFP4),120B 模型可在单张 80G H100 上运行,20B 模型仅需 16GB 显存,消费级硬件即可驾驭。
  • Agent 友好:原生支持工具调用、代码执行与结构化输出,为构建强大的 AI 智能体铺平道路。
  • 生态完备:发布即获 Hugging Face、英伟达、微软、Ollama 等业界巨头全面支持,部署和微调体验无缝衔接。

五年磨一剑,OpenAI 重拾“开放”初心?

距离 GPT-2 发布已过去五年,当行业几乎将“OpenAI”视为“ClosedAI”的同义词时,它用 gpt-oss 给出了最强有力的回应。这不仅是自 ChatGPT 时代以来 OpenAI 首次开源语言模型,更是一次碘伏性的市场行动。

gpt-oss 系列包含两个版本:120B 模型面向生产级高推理任务,20B 模型则专为低延迟、本地化和边缘计算场景设计。

性能“奇点”:MoE 架构与原生量化

GPT-OSS 的惊人之处在于,它在保持强大性能的同时,将硬件门槛降至了前所未有的低点。这背后的核心技术,是混合专家(MoE)架构与原生 4 位(MXFP4)量化方案的精妙结合。

不同于传统模型需要调动全部参数,MoE 架构仅激活处理当前任务所需的一小部分“专家”参数。gpt-oss-120b 总参数高达 1170 亿,但每个 token 仅激活 51 亿;20B 模型则从 210 亿参数中激活 36 亿。这种稀疏激活模式正是效率的源泉。

更具革命性的是原生量化。OpenAI 并非在训练后进行精度压缩,而是在训练阶段就让模型适应低精度环境。这种“出厂即量化”的设计,使得模型体积大幅缩小,性能损失却微乎其微。

最终,一个性能堪比 o4-mini 的庞然大物,得以在单张 80GB 显卡上安家;而一个超越众多开源模型的 20B 版本,仅需 16GB 显存即可流畅运行。这让高端 AI 技术真正飞入了寻常开发者的工作站。

SOTA 级表现与客观短板

在多个核心基准测试中,GPT-OSS 的表现堪称惊艳。无论是在编程竞赛(Codeforces)、通用问答(MMLU),还是在专业领域的健康咨询(HealthBench)和数学竞赛(AIME)上,gpt-oss-120b 都展现出与 o4-mini 分庭抗礼甚至超越的实力。

OpenAI被开源倒逼,一口气开源2个超级重磅模型GPT-OSS

在同等规模的开源模型对比中,GPT-OSS 几乎呈现出碾压性的优势,重新确立了开源 SOTA 的新标杆。这无疑给所有致力于开源大模型的团队带来了巨大的竞争压力。

然而,作为一款主打推理的纯文本模型,GPT-OSS 并非完美。根据社区的初步测试,它在处理某些创意性或复杂代码生成任务时,表现不如顶级闭源模型。同时,其幻觉率也显著高于 o3 和 o4-mini——这是小型化和推理优化过程中难以避免的权衡。

开源是手段,生态是目的

OpenAI 此刻选择开源,绝非一时兴起。在以 DeepSeek 为代表的全球开源力量迅速崛起的背景下,继续固守纯闭源策略已非明智之举。通过开源性能卓越的次顶级模型,OpenAI 意在重新夺回开发者心智,巩固其技术生态的护城河。

gpt-oss 全面兼容 OpenAI 的 API 规范,并原生支持函数调用与代码执行等 Agent 核心能力。这意味着开发者可以在本地低成本开发、测试和迭代 AI 应用,成熟后再无缝迁移至 OpenAI 的付费 API,从而形成一个强大的商业闭环。

开放,是为了更深远的掌控。这盘棋,OpenAI 下得愈加清晰。

GPT-OSS 的发布,与其说是 OpenAI 的一次慷慨馈赠,不如说是开源力量倒逼下的必然结果。它为全球开发者拉低了准入门槛,也为整个行业抬高了竞争基线。一个更开放、更激烈的 AI 新纪元,已然开启。


热点追踪提示词
你是一名 AI 行业编辑,请围绕下面这条热点输出一份资讯解读:
热点:OpenAI遭开源倒逼推出两款GPT-OSS模型要求:
1. 先用一句话解释这条热点在讲什么
2. 再总结它为什么重要
3. 说明会影响哪些 AI 产品或内容方向
4. 最后给出 3 个适合资讯站使用的标题
来源:https://www.53ai.com/news/OpenSourceLLM/2025080674563.html
ai 人工智能

游乐网为非赢利性网站,所展示的游戏/软件/文章内容均来自于互联网或第三方用户上传分享,版权归原作者所有,本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容,请联系youleyoucom@outlook.com。

相关热点
AI热点2026-07-21 09:10
技嘉发布RTX 5080木艺显卡与X870E蝶翼主板的独特设计

在COMPUTEX2026展会上,技嘉展示了AORUSGeForceRTX5080INFINITYWOOD显卡和AORUSX870EINFINITYNEXT主板。RTX5080显卡采用白色主题与木色元素装饰,设计独特;X870E主板则以蝴蝶翅膀为灵感,采用类蜂窝结构和金属3D打印

AI热点2026-07-21 09:10
星际荣耀火箭海上回收导航系统关键试验成功

星际荣耀公司近日成功完成SQX-3运载火箭海上回收高精度导航系统的无人机挂飞试验。该试验在广东阳江海域进行,采用创新的半实物动态模拟方案,全面验证了导航系统在复杂海况下的性能。结果表明,系统各项指标均优于设计要求,能够稳定提供火箭与回收船之间的高精度相对导航信息。这标志着该核心系统已完成全部地面验证

AI热点2026-07-21 09:10
Origin Code发布全新英特尔CQDIMM与AMD EXPO ULL内存新品带来AI与渲染性能的强劲提升

PC内存厂商OriginCode近日分别针对英特尔和AMD平台推出专项优化内存。面向英特尔平台的CQDIMM内存,通过与技嘉合作验证了256GB8000MT s的高带宽套条,旨在为本地AI、视频渲染等重载任务提供强大数据吞吐能力,并计划在2026年台北电脑展展出。针对AMD平台,则推出多款支持E

AI热点2026-07-21 09:10
东风本田5月销量环比增长20% CR-V等车型限时购车权益

东风本田公布5月销量达18563台,环比增长20%,其中CR-V销量增长显著。品牌同步推出6月限时购车权益,涵盖CR-V、英仕派、HR-V及思域等多款车型,权益价最低至9 79万元起,并可叠加国家以旧换新补贴及原厂配置加装优惠,为近期有购车计划的消费者提供了具体的价格参考与增值选择。

延伸阅读