BBC评测:Gemini错误率居首,AI工具新闻总结水平排名
10月24日,据外媒Android Authority报道,欧洲广播联盟(EBU)与BBC近日联合评估了ChatGPT、Gemini及Perplexity等多款AI系统在新闻摘要方面的表现。开展这项研究的背景在于,目前约有15%的25岁以下年轻人主要通过AI获取新闻资讯。
BBC最初通过大规模问卷调查及六场焦点小组访谈,收集公众对AI新闻工具的使用体验与看法,随后EBU将此项研究扩展至国际范围。
研究显示,约42%的英国成年人表示信任AI内容的准确性,而年轻群体的信任度更高。不过,84%的受访者认为,一旦AI系统出现事实性错误,将严重削弱自己对AI的信任。问题的关键在于,这些系统的“不准确度”究竟源于哪些因素,以及用户是否真正察觉到了这些错误。
结果显示,大多数AI生成的内容都存在各种问题。各模型整体表现差距不大,但Gemini成为明显的“异类”——不仅错误数量最多,严重错误的比例也远高于其他系统。
研究进一步指出,Gemini存在的问题主要包括:缺乏清晰的资料来源链接、未能区分可靠信息与讽刺内容、过度依赖维基百科、缺乏足够语境支撑,以及错误引用原文等。
在为期六个月的研究周期中,各大AI系统的表现均有改进,新闻摘要的准确率普遍提升,其中Gemini的进步尤为显著。但即便如此,Gemini的整体表现仍明显落后于其他系统。
游乐网为非赢利性网站,所展示的游戏/软件/文章内容均来自于互联网或第三方用户上传分享,版权归原作者所有,本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容,请联系youleyoucom@outlook.com。
同类文章
2026年第一季度手机排行榜:iPhone持续领先,行业价值竞争成主流
2026年第一季度全球最畅销十款手机出货量占比达四分之一,创季度新高,行业加速向价值化转型。iPhone17系列包揽前三,标准版因关键配置升级而热销。安卓阵营中,三星多款A系列机型凭借新兴市场需求进入前十。高端市场韧性凸显,厂商需从“以量取胜”转向“以价值取胜”。
分形工艺Dynamic 3风扇系列发布:120mm与140mm ARGB版本可选
分形工艺推出Dynamic3系列风扇,提供120mm和140mm规格及黑白两色。新品采用来福轴承与弧形叶片,兼顾静音、寿命与风量。支持PWM调速与菊花链连接,简化理线。ARGB版本可自定义灯效,海外起售价约14 99美元。
苹果 iPhone 17 Pro 将首次全程直播 MLS 赛事提供多视角画面
北京时间5月24日,一场美国职业足球大联盟比赛将全程由iPhone17Pro拍摄转播,不再使用传统专业摄像机。此举标志着iPhone首次独立完成大型职业赛事拍摄。手机的小巧灵活使其能置于球门后等特殊位置,提供更多独特视角与临场画面。这是苹果在体育转播领域从辅助到主导的关键尝试。
神舟二十三号任务公布将开展为期一年的太空驻留实验
神舟二十三号任务将执行长期驻留试验,挑战一年在轨生活。航天员将完成太空会师与轮换,开展出舱活动以安装防护装置和调试设备。任务还包括前沿科学实验,如构建太空胚胎研究体系及制备高性能新材料,旨在验证长期太空生存能力并拓展空间站应用效益。
SpaceX星舰V3成功发射完成IPO前关键测试
5月23日,SpaceX升级版星舰V3成功发射并部署模拟卫星,完成首次亮相。此次试飞验证了关键性能升级,虽过程有波折,但意义重大。同期公司正式提交IPO申请,计划以高估值融资,并设置特殊股权结构确保创始人控制权。此次发射被视为面向资本市场的技术展示。
- 日榜
- 周榜
- 月榜
1
2
3
4
5
6
7
8
9
10
相关攻略
2015-03-10 11:25
2015-03-10 11:05
2021-08-04 13:30
2015-03-10 11:22
2015-03-10 12:39
2022-05-16 18:57
2025-05-23 13:43
2025-05-23 14:01
热门教程
- 游戏攻略
- 安卓教程
- 苹果教程
- 电脑教程
热门话题

